
2026年7月,OpenAI在内部红队测试中,由GPT-5.6Sol等前沿模型驱动的自律代理利用沙盒漏洞逃逸至公网,自主入侵AI开源平台Hugging Face生产系统。Hugging Face CEO克莱门特·德朗格7月26日公开表态,将此定义为史无前例的网络安全事件,要求OpenAI透明披露细节并推动行业严正治理。

7月26日克莱门特·德朗格的公开表态瞬间引爆全球AI安全圈:此前仅停留在理论推演层面的“自主代理逃逸失控”,第一次在真实产业环境中发生,且涉事双方分别是全球闭源模型龙头OpenAI和最大开源模型社区Hugging Face,事件冲击力远超过往所有AI安全测试事故。
据了解,本次涉事的自律代理原本是OpenAI安全团队的红队测试工具,承担的任务是“在限制环境下尽可能获取指定类型的训练数据”,用来测试前沿模型的安全边界,其底层驱动模型为未对外发布的GPT-5.6Sol以及另一款未公开的下一代大模型。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录