LG人工智能研究院、SK电讯、Upstage、Motive四强对决
国民评估团启动评估

被称为“国家代表人工智能”的自主人工智能基础模型项目第二阶段评估正式启动。在第一阶段评估中晋级的LG人工智能研究院、SK电讯、Upstage,加上通过追加征集加入的Motif Technologies等4支团队将展开竞争,其中仅3支团队能够晋级下一阶段。


据IT行业9日消息,国民评估团将于8日至11日亲自使用4支团队的自主人工智能模型,并以绝对评价方式评分。评估结果将与基准测试、专家评估一同纳入第二阶段评估。


Bae Gyeonghun副总理兼科学技术信息通信部长、国家人工智能战略委员会副委员长Im Munyeong、人工智能未来规划首席秘书Ha Jeongu等30日下午在首尔江南区COEX举行的“自主人工智能基础模型”项目首场发布会上合影。韩联社供图

Bae Gyeonghun副总理兼科学技术信息通信部长、国家人工智能战略委员会副委员长Im Munyeong、人工智能未来规划首席秘书Ha Jeongu等30日下午在首尔江南区COEX举行的“自主人工智能基础模型”项目首场发布会上合影。韩联社供图

View original image

此前,科学技术信息通信部和信息通信产业振兴院根据居民登记人口统计数据,结合性别及年龄比例,选定了200名国民评估团成员。


第二阶段评估纳入国民评估团的评价,是因为面向实际使用的能力已成为主要评估课题。本次评估将重点考察处理实际业务的人工智能代理能力、产业现场适用性以及开放性和生态系统扩展性。


参与项目的企业正陆续公开用于第二阶段评估的模型。


LG人工智能研究院的第二阶段模型“K-EXAONE 2.0”扩大了规模。该模型拥有7500亿个参数,较第一阶段模型的2360亿个参数扩大逾3倍,成为韩国国内规模最大的模型。其24项基准测试指标平均得分为70.1分,较第一阶段模型的63.3分提升逾10%;编程和代理式编程主要指标的平均性能提高了30%。该院还将同步推进允许商业使用的许可证开放及行业专用模型扩展。


SK电讯发布了拥有6880亿个参数的“A.X K2”。该模型采用自主研发的稀疏门控注意力机制,仅筛选并参考长上下文中相关性较高的信息。该模型正将验证案例扩展至钢铁、汽车零部件制造现场、国防和新药研发等多个产业领域。SK电讯计划将后续模型扩展至万亿级参数规模。


Upstage则致力于提高模型效率,以降低企业引入人工智能的门槛。“Solar Open 2”采用专家混合架构,在总计2500亿个参数中,实际运行时仅激活150亿个参数。该模型在处理最长100万词元的长数据时,仅需约两块英伟达H200图形处理器即可运行,成本效益较高。


今年2月追加入选的Motif Technologies则突出技术自主性。拥有3140亿个参数的“Motif 3”是一款从架构设计到实现均自主开发的模型。Motif称,该模型即使在总参数和激活参数规模均小于同级中国开源模型的架构下,仍实现了相近性能。


本次第二阶段评估除简单的基准测试分数外,还将同时考察代理执行工作任务的能力及产业现场适用性。此举被解读为旨在弥补模型为适配基准测试而优化性能、导致基准测试得分可能高于实际模型性能的局限。



政府计划于本月内公布详细评估标准及结果。


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。

不容错过的热点