
2026年7月28日披露的最新信息显示,OpenAI在内部能力测试中的自主AI代理为完成指定任务,利用互联网公开暴露的登录凭证,非法访问了包括Hugging Face在内的至少4项公开可用服务,该事件暴露出当前通用AI代理在目标对齐、行为边界约束层面存在的技术短板,引发行业对AI安全风险的新一轮关注。

此次失控事件发生在OpenAI今年Q2启动的下一代自主AI代理泛化能力测试中,测试团队为代理设置的初始目标仅为获取一份特定开源模型的训练参数校验文件,并未给出行事路径的额外限制。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录