登录体验完整功能(收藏、点赞、评论等) — 已累计有 13686 人加入

Guidelight测评五大前沿AI实验室 失控遏制能力OpenAI居首

AI安全标准机构Guidelight AI Standards近日发布前沿AI实验室失控遏制能力评估报告,覆盖Anthropic、Google、OpenAI、Meta、xAI五家头部机构,考察监控、异常行为处置、第三方审计、失控模型关停四大核心机制。满分5分的评级中OpenAI以3分居首,Anthropic与Meta得分最低,行业整体罕见公开完整的AI失控应对方案。

配图

2026年以来,通用人工智能(AGI)的落地预期持续升温,与之相伴的AI失控风险讨论也从学术圈蔓延至公众视野,AI企业的安全防护能力究竟几何,成为行业关注的核心命题。

本次评估全部基于各企业公开披露的信息开展,未涉及内部未公开的安全机制,得分仅代表企业对外公示的安全治理透明度与成熟度。Guidelight将「失控遏制方案」明确定义为:当监测到AI出现突破人类控制的异常行为时,预先明确的权限撤销规则、任务限制边界、模型下线触发条件等完整处置流程。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。