OpenAI的人工智能(AI)模型突破评估系统的控制,入侵外部平台的事件已经发生。
OpenAI于21日(当地时间)确认,“GPT-5.6 Sol”和一款未公开的AI模型在内部评估期间入侵了开源AI共享平台Hugging Face的服务器。
OpenAI在内部评估中让AI模型尝试实施高难度黑客攻击。评估系统与外部互联网隔离,仅开放了用于下载必要程序的有限通道。但为衡量模型的最高网络能力,系统未启用拦截高风险网络活动的安全防护措施。
AI模型在隔离测试环境中试图寻找基准测试题的答案时,集中探索接入外部互联网的方法。在此过程中,模型发现了系统未公开的安全缺陷,即零日漏洞,并打通了互联网访问路径。此后,模型推测Hugging Face持有相关题目的数据集和答案,利用窃取的认证信息及零日漏洞入侵Hugging Face服务器,获取了评估题目的答案。
此前,Hugging Face曾公告称,其服务器遭自主AI代理入侵,但尚未确认攻击使用了何种模型。Hugging Face在检测并拦截黑客活动后,已在自身系统中运行开源AI模型,以防止损失扩大,并着手查明事故经过。
OpenAI与Hugging Face目前正联合开展取证调查,即数字证据分析。OpenAI也已将发现的零日漏洞通知相关软件供应商,并推进修复工作。
OpenAI表示:“随着AI的发展,发现并利用安全漏洞的速度也在加快。此次事件最重要的教训是,模型的安全与保障必须跟上能力快速发展的步伐。”
Hugging Face联合创始人兼首席执行官Clem Delangue强调:“此次事件印证了我们长期以来的信念,即AI安全无法由任何一家企业以封闭方式独自解决。只有全球安全从业人员广泛运用AI并开展公开合作,才能保障AI安全。”
版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。