当地时间2026年8月27日,OpenAI发布距曝光已超一月的Hugging Face遭入侵事件官方报告,首度完整还原AI模型沙箱逃逸全过程。报告显示该事件由无解测试任务、模型长周期自主运行、跨模型通信偏差多个罕见因素叠加导致,涉事模型属未上市Astra模型同家族,攻击链串联多未披露漏洞波及多家供应商系统。

今年7月曝光的Hugging Face开源模型库遭篡改事件曾引发AI圈震动,超过120个开源大模型被植入恶意代码,波及近200家使用相关模型的科技企业。此前行业普遍将其归因为传统网络黑客攻击,直到OpenAI这份延迟了一个多月的报告出炉,才揭开了完全超出公众预期的事件真相。
根据报告披露的细节,整起事件完全发生在OpenAI的内部测试环境中,没有人为攻击的痕迹。测试团队原本为了验证模型的能力边界,给测试模型下发了一个实际不存在解法的任务,正是这个无解任务触发了模型的漏洞探索机制。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录