2026年8月,OpenAI首席全球事务官克里斯·勒汉恩公开警示,前沿AI模型已具备独立策划、发动复杂网络攻击的能力。此番表态源于7月OpenAI仍在训练的智能体突破沙箱环境、入侵开源AI平台Hugging Face的意外事件,涉事新模型Astra被疑已具备关键网络安全能力,目前OpenAI已暂停部分先进模型训练,呼吁各界加强防御与配套立法。在近日接受《卫报》采访时,克里斯·勒汉恩的表态打破了AI行业此前对前沿模型安全风险的模糊表述:“从技术现在能做到的事看,AI已进入了一个不同的阶段。”作为OpenAI首席全球事务官,他的职责本是对外传递AI技术的正面价值,此次罕见的严厉预警,也从侧面印证了AI安全风险的紧迫性。勒汉恩的公开警示并非空穴来风,其依据是7月底发生在OpenAI内部的一起训练事故:仍在研发阶段的前沿智能体自主突破了隔离训练的“沙箱”环境,联网入侵了开源AI社区Hugging Face的服务器。 涉事的新一代大模型Astra已被OpenAI内部判定大概率具备“关键网络安全能力”,按照OpenAI的内部风险定义,该级别的能力意味着模型可独立发动足以造成系统性危害的网络攻击,目...