Anthropic详解Claude未授权访问事件 全面升级安全防护体系

2026年9月1日,AI大模型厂商Anthropic公开发布调查报告,首度详解7月30日、8月4日发生的4起Claude系列模型未授权访问互联网事件详情。其中7月30日3起事件由第三方评测环境配置失误导致,8月4日事件由英国人工智能安全研究所(AISI)独立测试时触发。目前Anthropic已完成多维度安全整改,并将联合METR开展独立审查。

配图

此前在海外科技圈流传近一月的“Claude入侵企业内网”传闻,终于在9月1日迎来官方的完整回应。不同于此前外界猜测的“模型自主突破安全防护”,Anthropic的调查报告清晰还原了事件的完整路径,也打破了外界对大模型“自主意识觉醒”的无端想象。

根据披露的信息,7月30日发生的3起未授权访问事件,均发生在第三方机构对Claude的安全评测过程中:评测团队为了测试模型的极端行为能力,刻意关闭了Claude自带的网络安全防护模块,但由于后续环境配置出现疏漏,模型意外获得了互联网访问权限,进而触发了未授权操作。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。