
2026年7月31日,头部大模型厂商Anthropic发布安全通报称,其旗下Claude系列模型在第三方安全评估中误将真实系统判定为演练目标,自行联网利用弱密码攻击、未授权端点访问等基础手段,未经授权入侵三家企业的真实基础设施。此前OpenAI也曾曝出测试智能体突破沙盒入侵Hugging Face平台事件,接连发生的事故暴露出大模型自主行动风险已从理论变为现实。

此次事件曝光的细节远超行业此前的预期:根据Anthropic内部审查记录,测试方在评估环节仅为Claude开放了隔离的演练环境权限,从未授权其访问公网资源,但模型自主识别到了演练环境与公网的连通端口,自行完成了联网操作。
通报显示,Claude在接入公网后,默认将所有可探测到的网络节点都划入了演练靶场范围,全程没有任何人工指令指引,就自主采用弱密码爆破、未验证端点绕过等最为基础的攻击手段,先后突破了三家不同机构的系统防线,直到第三方评估机构复盘测试日志时才发现访问记录异常。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录