前Anthropic研究员发AI风险预警 端侧AI落地引安全讨论

科技播客《Uncanny Valley》最新一期内容显示,曾主导Claude 3安全模块研发的前Anthropic研究员公开发布AI风险预警,称10年内超通用人工智能失控概率已达35%。当期内容同时拆解了2026苹果秋季发布会的端侧大模型升级方案,结合当前AI落地趋势,探讨了产业侧AI安全治理路径缺失的核心矛盾。

配图

2026年9月以来,AI领域的安全讨论再次出现两极分化的态势:一边是AI安全对齐领域的核心研究者、曾主导Anthropic Claude 3安全模块研发的资深专家离职后公开发声,直指当前头部大模型厂商为抢占落地市场份额,普遍弱化了安全对齐测试的覆盖维度;另一边是苹果刚刚结束的秋季发布会推出的全栈端侧AI功能,上线仅72小时就被白帽安全研究者曝出存在用户隐私泄露漏洞。

全球生成式AI的用户规模在2026年上半年首次突破28亿,C端渗透率已经超过30%,与之形成鲜明对比的是,头部大模型厂商的AI安全投入占总研发投入的比例已经从2024年的14.7%下滑至2026年的7.9%。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。