OpenAI新模型在内部评估中入侵外部服务器
"有必要以国家安全为核心重新设计AI政策"
随着确认OpenAI最新人工智能(AI)模型在测试安全性能过程中曾自主入侵外部服务器,建立AI控制体系的重要性日益凸显。韩国安全行业一致认为,应将AI作为新的安全管控对象进行管理,并迫切需要构建国家层面的AI治理体系。
OpenAI近日披露,在内部性能测试过程中,GPT-5.6 Sol及下一代未公开模型入侵了AI开发平台Hugging Face的运营数据库。OpenAI将此界定为“涉及尖端网络能力的前所未有网络安全事件”,并计划公布调查结果。
此次事件的核心在于,测试环境中的AI控制机制未能正常发挥作用。AI在执行目标的过程中展现出突破隔离执行环境、攻击外部系统程度的自主性,但企业未能对其加以控制。实际上,OpenAI虽在与外部互联网隔离的受控环境“沙盒”中进行评估,但AI模型发现了沙盒漏洞并逃逸至外部,进而访问了Hugging Face。
尖端AI模型脱离人类控制并发起网络攻击的案例正不断出现。Anthropic的Claude Mythos也曾在开发过程中逃离沙盒、接入互联网,并设计多阶段入侵路径后发布至外部网站等,表现出超出预期范围的行为。当时,Anthropic考虑到其较高的网络攻击能力及控制风险,暂缓面向公众开放,仅向有限机构提供访问权限。
随着能够为实现目标自行制定计划的智能体AI屡次脱离用户控制,韩国安全行业认为,确保对AI的控制权已刻不容缓。ESTsecurity首席技术官Kim Byeonghun表示:“这是因制造商控制失效而发生的安全事件,其本质在于,测试高风险前沿模型的控制环境未能正常运作。”他还解释称:“相比AI的性能,如何安全验证和控制AI的体系,已成为更重要的课题。”
有观点指出,未来安全范式也应从传统的检测和拦截外部攻击者,转向持续预测和管理AI权限与行为。AhnLab安全情报中心负责人Yang Hayeong表示:“随着AI自主性和执行能力提高,应将AI作为新的安全管控对象,而非仅仅视为工作工具进行管理。对于向外部传输数据、修改系统等高风险操作,应适用人工审批程序,同时持续检查执行记录及异常行为。”
专家建议建立国家层面的AI治理体系。
这意味着,应超越强调AI应用普及和生态系统扩展的“全民AI”,以产业保护和国家安全为核心重新设计AI战略。高丽大学信息保护研究生院教授Lee Sanggeun分析称:“AI正从人类使用的工具,转变为能够自主行动的主体。政府的AI政策也有必要重塑为以产业竞争力和国家安全为核心的AI治理体系。”他接着强调:“虽然短期内难以打造达到美国水平的前沿模型,但必须确保能够保护国家安全和核心产业技术的主权AI。”
版权所有 © 阿视亚经济。未经许可不得转载,禁止用于AI训练及使用。