安全公司Hacktron利用Opus 5模型
OpenAI向该公司支付900万韩元奖金

Anthropic的人工智能模型Claude被用于入侵竞争对手OpenAI的案例曝光。


据《华尔街日报》等媒体18日(当地时间)报道,美国人工智能安全研究公司Hacktron表示,其3名研究人员利用“Claude Opus 5”模型,成功控制了OpenAI员工的人工智能聊天机器人ChatGPT及编程工具Codex账户。

OpenAI与Anthropic标识。路透社韩联社供图

OpenAI与Anthropic标识。路透社韩联社供图

View original image

事件始于对OpenAI漏洞赏金计划的调查。研究人员首先在OpenAI社区网站使用的帮助论坛中发现图像处理漏洞,并成功接入服务器。随后,研究人员要求Claude协助将该漏洞转化为实际攻击代码,从而进入OpenAI社区服务器。


在此获取的认证令牌中,部分与OpenAI员工账户关联。此后,他们利用相关账户信息进入名为“Monorepo”的OpenAI内部系统,并留下已入侵的证据。据悉,该系统是存放核心算法机密的代码库。


研究人员确认能够访问内部代码库后便停止测试。他们表示,起初曾尝试利用“Opus 4.8”编写攻击代码,但未能奏效;而在Anthropic恰好发布“Opus 5”后,仅用数小时便成功制作出攻击脚本。从最初发现漏洞到入侵内部系统,耗时不足72小时。


Hacktron就此次入侵所耗时间强调:“代理程序的工作耗时数天,但人类研究人员投入的时间仅为数小时。随着新型人工智能模型不断出现,其能力正日益增强。”



研究人员已向OpenAI报告漏洞。OpenAI确认后修复了问题,并废止了受影响的认证令牌等,同时向Hacktron支付了6500美元(约900万韩元)赏金。OpenAI在收到报告后14小时内完成系统加固措施。业界对这一事件的担忧,更多不在于OpenAI遭到攻破本身,而在于人工智能可能大幅缩短实施黑客攻击所需专业工作的时间。


本报道由人工智能(AI)翻译技术生成。

版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。

不容错过的热点