公开4款Kanana-2小型语言模型
针对智能手机等设备优化……用于“Kanana in KakaoTalk”等服务
性能媲美同等规模的全球模型

Kakao于28日宣布,已将其自主研发的人工智能(AI)模型Kanana的小型语言模型(SLM)以开源形式公开。


Kakao在开源AI平台Hugging Face上发布的Kanana-2小型语言模型系列包括:▲Kanana-2-1.3B-Base ▲Kanana-2-1.3B-Instruct ▲Kanana-2-3B-Base ▲Kanana-2-3B-Instruct。这些模型缩小了规模,可在智能手机等设备上运行。


Kakao于28日宣布,将自主研发的人工智能模型Kanana小型语言模型以开源形式公开。Kanana小型语言模型性能指标。Kakao供图

Kakao于28日宣布,将自主研发的人工智能模型Kanana小型语言模型以开源形式公开。Kanana小型语言模型性能指标。Kakao供图

View original image

Kakao表示,随着可在个人设备上运行的小型语言模型的重要性日益凸显,公司一直致力于研究即使模型规模较小、性能也足以应用于实际服务的小型语言模型。本次公开的模型目前已应用于“Kanana in KakaoTalk”、“KakaoTalk对话摘要及通话摘要”、“AI国民秘书”等多项服务。


Kakao称,本次公开的模型在韩语和英语两方面均实现了全球领先水平的性能。尤其是Kanana-2-1.3B-Instruct和Kanana-2-0.9B-Instruct,在对话、知识、代码、数学、指令遵循及工具调用等实际服务能力方面,也展现出可与Qwen(阿里巴巴)、Gemma(谷歌)等同级全球模型竞争的性能。


韩语处理性能也得到提升。Kakao采用自主开发的韩语专用分词器,使韩语处理效率较此前提升30%以上。分词器是一项用于确定AI模型处理文本时如何将句子拆分为细小单元的技术;分词器越针对韩语优化,处理相同句子所需的单元就越少,从而提升运算速度并降低成本。


该模型的另一特点是针对智能手机等算力受限的端侧环境进行了优化设计。为解决处理长对话时内存占用增加的问题,模型引入了“滑动窗口注意力”架构。借此,即使在最长32K(3.2万个词元)长度的对话中,也可最多节省72.7%的内存,同时保持稳定性能。


Kakao将通过允许商业使用的“Kanana开放许可证”发布本次模型。



Kakao Unified Foundation Model成果负责人Noh Byeongseok表示:“在为智能体AI时代做准备的过程中,我们切实感受到云端大规模AI和端侧轻量AI都十分重要。Kakao正不断提升这两个领域的技术竞争力,希望此次开源公开的模型能够推动更多开发者和企业开发新的AI服务,并为激活韩国国内AI生态系统作出贡献。”


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。