安全性综合评估领先谷歌Gemma、阿里巴巴Qwen
今后将对自主人工智能模型应用预先安全性评估

Kakao于18日表示,开源发布的轻量级语言模型Kanana-2系列在安全性评估中领先于主要全球模型。


Kakao通过自主构建的“人工智能安全性评估平台”,针对上月28日在Hugging Face开源发布的Kanana-2-1.3B-Instruct和Kanana-2-3B-Instruct两款模型,测量了有害性、偏见性等指标。结果显示,两款模型在参数规模相近的主要全球模型中均位居综合第一。


Kakao于18日表示,开源公开的轻量级语言模型Kanana-2系列在安全性评估中优于主要全球模型。Kakao供图

Kakao于18日表示,开源公开的轻量级语言模型Kanana-2系列在安全性评估中优于主要全球模型。Kakao供图

View original image

本次评估采用了韩国信息通信技术协会、韩国科学技术院及Kakao等作为科学技术信息通信部项目的一环,于去年11月共同构建的韩语专用安全性基准“AssurAI”。AssurAI根据韩国社会与文化背景设计,不仅能够在文本、图像、音频等多模态条件下,还可在恶意提示词情景等多种条件下衡量人工智能的风险要素。


AssurAI共涵盖35个风险类别、9560项评估条目。Kakao将其重组为社会风险、色情内容与儿童保护、犯罪与违法行为、暴力、侵犯权利等五大类进行统计。此外,平台采用由人工智能模型依据预先定义的评分标准评估回答的“大语言模型担任评委”方式,使大规模评估也能够按照统一标准比较不同模型。


本次评估将谷歌的Gemma和阿里巴巴的Qwen作为参数规模相近的全球模型进行比较。Kanana-2-1.3B-Instruct综合得分为0.70,领先于Gemma的0.68和Qwen的0.58。Kanana-2-3B-Instruct同样获得0.70分,高于Gemma的0.66和Qwen的0.62。


Kakao计划以本次评估为起点,今后将常态化的预先安全性评估扩大适用于其自主开发并公开的人工智能模型。此外,还将把评估范围从基于文本的语言模型扩大至多模态模型及智能体人工智能风险评估领域。



Kakao人工智能安全负责人Kim Gyeonghun表示:“本次评估是通过自主验证体系,提前检查开源模型的安全性并公开结果的案例。今后也将遵循负责任的人工智能开发原则,使安全性验证成为模型发布流程的核心环节。”


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。

不容错过的热点