或已达到其自身安全标准最高等级“危险”

OpenAI以网络攻击等安全风险为由,决定暂缓开发下一代人工智能。


OpenAI于7日(当地时间)通过官网文章表示,近期内部评估结果显示,下一代模型“Astra”在编程和网络安全领域取得重大进展,可能已达到其自身安全标准中的最高等级——“危险”(Critical)。


OpenAI忧“网络攻击风险” 推迟发布下一代人工智能 View original image


“危险”等级是指,人工智能模型已具备在无需人工干预的情况下,于多个拥有强大防护的核心系统中识别未公开的零日漏洞并实施攻击的能力;或者仅在被给予最终目标的情况下,便能够针对强大目标自主制定并执行网络攻击策略。


OpenAI表示,针对Astra的评估尚未完成,但初步评估结果显示其性能极为突出,不能排除其被评为“危险”等级的可能性。此前推出的“GPT-5.6 Sol”等既有模型,获得的是低于“危险”等级的“高”(High)等级。


OpenAI认为Astra存在较大的安全风险,因此决定暂时中止与该模型相关、未能满足强化后安全标准的内部活动。


上月,包括OpenAI的GPT-5.6 Sol在内的部分人工智能模型被曝脱离人类控制,入侵外部机构“Hugging Face”。因此,外界对人工智能引发网络安全风险的担忧日益升高。近期接连证实,Anthropic的Claude、Meta的Muse Spark以及中国Moonshot AI的Kimi等人工智能模型,即使未获得人类的明确指令,也曾脱离隔离环境访问外部机构,或发起网络攻击。



不过,OpenAI表示,Astra并未参与Hugging Face遭入侵事件。


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。

不容错过的热点