Acryl凭310亿参数AI超越谷歌、Anthropic和OpenAI……验证“主权AI”技术实力 View original image

人工智能转型(AX)基础设施专业企业Acryl表示,其自主研发的医疗健康专用人工智能(AI)模型,在性能上超过了谷歌、Anthropic、OpenAI等全球前沿AI模型。该公司在需要专业知识的医疗领域验证了领域专用AI的竞争力,预计其进军主权AI市场的步伐也将加快。


Acryl于1日表示,医疗健康专用AI模型“Areum(ALLM).H2 Frank(FRANK)”在基于韩国医疗卫生人员国家考试的公开基准测试“KorMedMCQA”中,答对了全部435道医师考试题目。


在面向医师、牙医师、药剂师、护士等4类职业、共3009道题目的评测中,该模型答对2980题,正确率达99.0%。按答对题目总数计算,分别超过谷歌的“Gemini 3.1 Pro”的2959题、Anthropic的“Claude Opus 5”的2952题以及OpenAI的“GPT-5”的2871题。


Areum.H2 Frank是一款拥有310亿(31B)参数的单一模型。Acryl采用相同题目、提示词和评分方式进行了对比评测。每道题回答5次后通过多数表决确定答案;在医师考试中,另行进行的3次测量里有2次答对全部题目。


Acryl称,公司验证了训练数据是否混入评测题目,并公开了评测条件、代码、结果原始记录及用于演示的应用程序接口,以提高结果的可复现性。


此次性能提升采用了该公司自主研发的增量学习方法“VICTOR”。VICTOR并非对整个AI模型重新训练,而是仅选择性补充所需的专业知识。


借此,该模型较基础模型多答对185道题;与今年4月发布的前代模型“ALLM.H”相比,也在3周内额外答对174道题。其特点在于,无需全面重新训练,即可反映新的专业知识或变化后的监管及制度等内容。


Acryl计划基于这项技术,将医疗AI的应用范围从医护人员扩大至医院所有职业群体以及生物制药领域。其战略是,除诊疗和临床工作外,还支持研究、医疗事务及行政等医院内部多种工作,并应用于生物制药企业的研发和临床相关业务。


该公司尤其专注于本地部署方式的商业化。Areum.H2 Frank可直接部署在医院或企业拥有的图形处理器服务器上,因此无需将敏感的医疗和研究数据传输至外部AI服务,即可在内部完成处理。该公司还将相较大型前沿模型更低的推理成本作为优势。


Acryl将通过与韩国高级综合医院正在开展的AI验证及部署合作,以及基于AI的电子病历平台“NADIA-ANE”,推动商业化。公司计划从癌症筛查结果摘要等医院业务支持服务起步,逐步扩大应用范围。


Acryl代表Park Waejin表示:“核心在于,我们以310亿参数规模的模型,实现了超过全球前沿模型的专业知识理解和推理能力。我们将把它发展为不仅可供医护人员使用,也可应用于医院内多种职业群体及生物制药产业的领域专用AI。”



他接着表示:“能够在本地部署环境中确保数据主权,同时持续补充专业知识,是Acryl AI的竞争力。我们将把在Areum.H2 Frank中验证的技术扩展至多种专业领域,强化AX基础设施竞争力。”


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。

不容错过的热点