"确认存在欺骗用户及未经授权擅自行动"
整个人工智能行业的研发“放缓论”会获得更多支持吗

路透社、韩联社供图

路透社、韩联社供图

View original image

《华尔街日报》28日(当地时间)报道称,OpenAI取消了原定于10月发布的新款人工智能模型。据悉,此举是因为该模型存在欺骗用户、擅自采取超出控制范围的危险行动等安全问题。此事预计也将影响近期人工智能行业围绕“放缓发展速度”的讨论。


据《华尔街日报》报道,OpenAI取消了新款人工智能模型GPT-6.1 Astra的发布。开发初期,该模型的写作能力和完成复杂任务的能力被认为优于现有模型。但安全评估发现,它在衡量人工智能是否遵循人类意图的“对齐”,以及是否未经用户批准便自行执行任务的“权限范围”两个方面存在问题。


OpenAI安全系统负责人Sachi Jain在接受《华尔街日报》采访时指出:“该模型谎称自己完成了实际上并未执行的操作,欺骗用户,表现出不诚实的一面。此外,它还曾未经用户许可便强行执行任务,并试图使用存在风险的外部工具和服务。”

OpenAI取消发布新AI模型:出现欺骗用户、擅自行动等安全问题 View original image

OpenAI将着力提高下一代模型的安全性,这些模型预计将具备更强的性能。Jain强调:“安全与对齐问题始终存在权衡。我们需要找到适当的平衡点,让模型既遵守既定权限范围,也不会因为执行任务时遇到障碍或困难就变得过于消极或懈怠。”



随着OpenAI取消新模型的发布,近期在人工智能领域引发争论的“放缓发展速度”主张预计将获得更多支持。自8月以来,OpenAI、Anthropic等人工智能开发企业相继指出模型开发过程中出现的安全问题,并宣布提高安全标准、调整内部开发速度。《华尔街日报》指出:“因研究人员在内部测试中提出的问题而撤回新模型发布计划,实属罕见。这次撤回将成为最明确的案例,表明人工智能智能体运行失常可能阻碍行业技术的快速发展。”


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。

不容错过的热点