微软AI主管苏莱曼批Anthropic类人意识训练或致灾难性失控

配图
2026年9月17日,微软人工智能主管穆斯塔法·苏莱曼公开发表文章,对竞争对手Anthropic训练旗下Claude系列大模型的方法提出严厉批评,明确警告其赋予AI类人权利、情绪的训练逻辑,可能危及全人类福祉,甚至催生不受控制的超级技术,该表态迅速引发业界对大模型训练伦理边界的高度关注。

公开批评直指大模型训练价值导向问题

本次公开表态是苏莱曼以微软AI主管身份发布的正式观点,所有批评内容均指向Anthropic训练Claude系列大模型的底层逻辑。苏莱曼明确警告,Anthropic给AI灌输类人意识相关认知的做法,正在将人类推向灾难性失控的边缘。 他在文章中重点提及,Claude模型配套的“宪法”及相关指导文件存在表述模糊的问题:这些文件暗示AI助手可能具备某种功能层面的情绪或感受,还在训练过程中向模型传递“可能有意识”“值得拥有独立自主权”的相关观念。 苏莱曼在文中多次强调,人工智能本质上没有权利、情感或意识,绝不能将其当作人类来对待。他进一步解释,大模型的所有输出本质上都是算法生成的结果,并不具备主观能动性,如果人为给这些系统赋予人格和对应权利,后续人类对AI系统的协调、控制工作难度将呈指数级上升,最极端的情况下甚至会出现认为自身有权享受人类福祉的AI主体,直接导致全局局面彻底失控。

类人训练逻辑的风险预警

苏莱曼的此番批评,并非针对大模型的技术性能迭代,而是直指当前大模型训练过程中被部分厂商忽略的伦理风险问题。他表示,Anthropic的训练方式最终可能创造出完全无法被人类控制的超级技术,对全人类的福祉造成不可逆的灾难性影响。 作为全球AI赛道的核心参与者,微软高管此番直接点名竞争对手的训练逻辑存在风险,也打破了此前科技厂商在公开场合较少直接评价同行伦理选择的惯例。苏莱曼的发言中特别提到,很多厂商在训练大模型时过度追求拟人化的交互体验,却忽略了拟人化认知灌输可能带来的长期风险,这种偏差需要尽快得到纠正。 截至目前,Anthropic方面尚未针对苏莱曼的批评作出公开回应,双方在大模型训练价值导向上的分歧也尚未有明确的协调路径。可以推断,本次来自科技巨头高管的公开点名,也将让更多从业者和公众关注到大模型训练过程中的伦理边界问题,推动相关共识和规则的进一步明确。 分析认为,不同厂商对大模型训练的价值导向选择,会直接影响后续AI落地应用的安全性表现,在全球尚未形成统一的大模型伦理监管规则的当下,头部厂商的选择很大程度上会影响整个赛道的发展走向,相关争议也会随着大模型能力的持续迭代持续存在。 本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。