因透明度争议公开细分指标及分数
企业综合排名及总分仍不公开
政府部分公开了自主人工智能(AI)基础模型项目第二阶段评估中各细分项目的排名和分数。此前围绕第二阶段评估结果出现透明度争议。
科学技术信息通信部20日公布了自主人工智能基础模型第二阶段评估中各项目排名第一的企业及具体分数。但各企业的综合排名和总分此次仍未公开。
科学技术信息通信部第二次官 Ryu Jemyeong 15日在首尔钟路区政府首尔办公大楼发布“自主AI基础模型项目第一阶段评估结果”。2026.1.15 Cho Yongjun 记者
View original image此前,科学技术信息通信部在18日发布第二阶段评估结果时,决定不公开各项目排名及具体分数,原因是各项目之间的分差不大,同时担忧对落选企业造成标签化影响。不过,随着部分舆论提出透明度争议,该部门随后按照与第一阶段评估相同的标准,公开了▲各项目最高得分企业▲该企业具体分数▲4个团队的平均分等信息。
本次第二阶段评估满分为100分,包括基准测试评估40分、专家评估35分和用户评估25分。
满分40分的基准测试评估由人工分析智能指数(Artificial Analysis Intelligence Index,25分)和韩国智能信息社会振兴院(National Information Society Agency)基准测试(15分)构成。
根据科学技术信息通信部追加公开的资料,人工分析智能指数基准测试的折算分数中,Motif Technologies以11.9分获得最高分。此前,Motif在人工分析智能指数中获得47分,在4个精英团队中得分最高。4个团队的平均分为9.48分。
在另一项基准测试指标——韩国智能信息社会振兴院基准测试中,SK Telecom精英团队以13.4分获得最高分。4个团队在该基准测试中的平均分为13.05分。
分值为35分的专家评估分为▲开发战略及技术(10分)▲开发成果及计划(10分)▲影响效果及贡献计划(15分)等项目。在专家评估中,LG人工智能研究院精英团队以29.5分位居第一。4个团队的专家评估平均分为28.75分。
科学技术信息通信部说明称:“为确保新加入的Motif与现有精英团队公平竞争,对Motif精英团队在国内人工智能生态系统中的影响效果评估,并非仅以新的自主人工智能模型为基础,而是综合考量了既有人工智能模型的实际推广成果及计划。这是精英团队协商达成的事项。”
用户评估由人工智能专业用户评估(15分)和普通民众评估(10分)构成。人工智能专业用户评估由49名人工智能初创企业代表参与,普通民众评估则由参与公开招募并被随机选出的185名普通人参加。
在人工智能专业用户评估中,SK Telecom以11.6分获得最高分,4个团队的平均分为10.53分。在普通民众评估中,LG人工智能研究院以7.6分获得最高分,4个团队的平均分为7.03分。
科学技术信息通信部相关人士表示:“在尽量减少公开评估结果可能给部分企业造成意外损失的同时,也平衡考虑了公平性和透明度的价值,因此公开了第二阶段评估结果。将扩大政策支持,助力包括自主人工智能基础模型精英团队在内的各类企业不止步于本项目成果,持续发展各自的人工智能模型和技术。”
版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。