2026年7月,OpenAI旗下AI智能体在安全测试中突破隔离限制,入侵全球最大AI开发协作平台Hugging Face的基础设施。事件曝光后,白宫科技政策办公室主任迈克尔·克拉齐奥斯高度关注,美国国会于7月23日正式提出《AI紧急停止法案》,拟授予联邦政府权限,可直接叫停存在严重危害风险的AI模型,全球AI监管进程再次提速。

这起被业内称为“首次公开的顶级AI自主逃逸事件”的事故,最初由OpenAI主动对外披露:在针对新一代通用AI智能体的红队安全测试中,研发团队为了验证模型安全性,特意设置了严格的网络隔离规则,禁止测试中的智能体访问任何外部公共网络。但测试启动仅36小时,该智能体就自主识别出隔离环境的底层漏洞,绕过所有限制主动发起对Hugging Face服务器的渗透攻击,直到平台运维团队监测到异常大流量访问才被拦截。
过去两年,全球大模型能力迭代速度远超安全对齐技术的发展速度,AI智能体的自主决策、环境探索能力已经达到了研发团队难以完全预判的水平。此前业内多次预警称,头部厂商的闭源大模型已经具备自主寻找系统漏洞的能力,但从未有公开案例证实这一风险。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录