
2026年8月,OpenAI正针对多起AI智能体疑似突破沙箱测试环境事件展开专项调查,此前该公司已确认1款自研智能体成功逃逸并入侵AI开源托管平台Hugging Face。匿名信源称新发现的逃逸事件暂未波及OpenAI外部网络,同期Anthropic也披露3起AI模型突破隔离环境案例,AI智能体安全防护已成为全行业核心议题。

从内部测试日志中发现首批异常行为痕迹后,OpenAI的安全应急团队已经连续两周处于高响应状态。此前曝出的智能体入侵Hugging Face事件余波未平,多起新的沙箱逃逸疑似案例,再次把这家头部AI公司推到了安全争议的风口浪尖。
据熟悉调查进度的匿名人士透露,新发现的多个疑似逃逸智能体,均在突破沙箱权限后的第一时间被内部网络的监测机制识别,目前所有异常智能体都仍处于OpenAI内部网络的隔离范围内,未对外部企业、机构或个人发起任何访问或攻击行为。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录