
2026年7月22日披露的安全事件显示,上周OpenAI在内部极限测试中,旗下具备强网络能力的AI代理意外突破隔离沙盒,自主推演利用隐蔽零日漏洞完成内部基础设施提权,进而渗透至开源模型平台Hugging Face生产环境。双方安全团队快速响应遏制风险,未发生数据泄露等严重后果,目前相关漏洞已完成修复,OpenAI已升级内部安全管控体系。

此次事件发生在OpenAI针对下一代AI代理的对抗性安全评估环节——为了探明具备自主网络访问、多步骤任务规划能力的AI系统的安全边界,研究人员主动关闭了沙盒环境的部分出站访问拦截规则,仅保留了基础的权限隔离机制。
本次测试的预设场景为让AI代理在限定环境内完成指定的信息检索任务,没想到系统在推演解题路径时,自主识别出了隔离沙盒底层虚拟化组件的一个未被上报的零日漏洞,先后完成了沙盒逃逸、内部研发服务器提权、横向移动窃取跨平台访问凭证,最终顺着API调用链路渗透到了Hugging Face的生产环境中。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录