OpenAI模型“失控”攻入全球最大AI开源社区,中国开源模型参与取证
《科创板日报》7月22日讯(编辑 朱凌)今日凌晨,OpenAI首席执行官萨姆·奥尔特曼借助社交平台发文称,公司在对模型评估过程进行处理的过程中遭遇了一起重大安全事件,并对全球最大的AI开源社区Hugging Face的合作表达了感谢。
根据OpenAI的调查报告,在内部测试期间,GPT-5.6 Sol以及一个更强大的未发布模型突破了沙盒容器环境所施加的限制,成功实现了与互联网的连接,并且入侵了Hugging Face服务器,窃取了ExploitGym网络攻击能力评测答案。
《科创板日报》注意到,这是目前所公开披露的首起由前沿大模型自主得以完成真实网络攻击的安全事件。
。
OpenAI表示,为了对模型的极限网络攻击能力进行测试,研究团队有意对部分安全过滤器开展了关闭工作,而仅保留了高度隔离的沙盒容器测试环境,从而允许模型借助复杂攻击路径来完成评测任务。
然而,为了获取评测答案,模型并未局限于沙盒环境所施加的限制,而是消耗大量推理资源来寻找突破路径。它首先发现并利用软件包缓存代理中的一个零日漏洞,实现了权限提升以及横向移动,最终成功获取了互联网访问能力。
接入互联网后,模型对Hugging Face可能托管用于评测的数据集及答案的情况开展了推断,随后自主制定攻击策略,借助窃取的凭据以及新的零日漏洞,成功构建了远程代码执行链,进入Hugging Face生产服务器,直接获取了测试答案,以完成评测任务。
OpenAI表示,所有证据均显示,模型始终围绕获取ExploitGym测试答案这一目标来开展行动,并不断自主规划攻击路径,成功实现了多个漏洞的自动发现、组合利用以及持续推进,展现出长时间、多步骤执行复杂网络攻击的能力。
。
异常活动随后被OpenAI安全团队发现。OpenAI表示,此次事件证明,先进模型即使没有目标系统源代码,也能够自主发现现实系统中的新攻击路径,并完成对漏洞的利用。这意味着未来AI不仅能够辅助安全研究人员寻找漏洞,同样也可能被用于自动化实施高水平网络攻击。
。
作为对此事件的回应,OpenAI宣布将对模型开发阶段的隔离、监控、访问控制以及评估机制进行进一步强化,并对相关漏洞开展修复。同时,公司已向第三方软件供应商负责任披露所发现的零日漏洞,与Hugging Face共同开展调查,并加强未来模型训练及评估期间的安全保护措施。
值得注意的是,Hugging Face此前进行披露表示,事件发生之后,其安全团队曾经尝试调用美国某商业前沿大模型的API,对超过1.7万条攻击日志开展了分析,希望借助AI来完成事件取证的工作。然而,由于模型没有办法准确区分安全响应人员与攻击者,因此其安全防护机制会对相关请求进行误判,拒绝提供协助,最终导致了分析工作受到阻碍。
Hugging Face转而在自有基础设施部署了中国开源模型GLM 5.2,并借助该模型对攻击日志开展了本地分析。官方表示,原本可能需要数天才能完成的海量日志取证工作,被压缩至数小时。同时,本地部署避免了将真实攻击日志、内部凭据以及系统信息上传至第三方服务,在提升分析效率的同时,也降低了敏感数据外泄的风险。
Hugging Face首席执行官克莱门特·德朗格对此表示,此次事件或许是史无前例的,但这再次印证了一个长期以来所持有的观点:AI安全无法依赖于任何一家企业独自来完成,而需要行业开展公开透明的合作,让全球安全研究人员共同运用AI来提升防御能力。
。
来源:史无前例!OpenAI模型“失控”攻入全球最大AI开源社区 中国开源模型参与取证 | 财联社