2026年9月23日多家科技媒体跟进404 Media此前发布的报道,OpenAI多名负责ChatGPT回答质量评分的外包合同工,因违规使用AI工具代本人工评估工作,被公司解雇或移出相关项目。该岗位的人工评估结果是人类反馈训练的核心素材,用于大模型迭代优化,AI代工会直接污染人工反馈、降低训练数据质量,截至目前OpenAI尚未就事件具体细节作出官方回应。

根据事实核查结果,本次被处置的外包人员核心职责为人工评估ChatGPT回答的准确性、安全性、有用性,相关评估结果会作为人类反馈素材支撑大模型迭代。OpenAI内部指引明确禁止评分员在工作中使用三类工具,包括ChatGPT等聊天机器人、AI检测器GPTZero以及写作辅助工具Grammarly。
需要明确的是,本次禁令仅针对承担评分职责的外包工作人员,并非普遍禁止普通用户使用AI工具,也不等同于禁止外部AI内容进入OpenAI训练流程,此前“OpenAI禁止用户用AI训练其AI”的概括存在误导性。
关于评分团队的整体规模,据AI Weekly转述404 Media的消息,OpenAI内部文件提及评分管道中有超过1万名合同工,但该数字仅来自内部文件与媒体报道,目前并未得到OpenAI官方公开确认。
公开信息显示,2026年9月中旬,404 Media就曾报道OpenAI使用数百名外包人员阅读、评分真实ChatGPT对话,目标是减少模型过度奉承、拟人化等问题;相关合同工通过Crossing Hurdles招募,由Mercor负责支付薪酬。
作者观点:人工评估的真实性是人类反馈强化学习模式的核心前提,“AI评AI”的造假行为会直接导致训练数据失真,不仅会浪费标注环节的人力投入,还可能对模型迭代方向造成负面影响。
截至多家媒体跟进报道的节点,暂未搜到OpenAI就本次解雇事件发布正式公告,也未对外披露具体解雇人数、违规发生的精确日期以及对应的技术检测标准,事件处置细节仍有待官方确认。
针对普通用户关心的对话数据使用规则,OpenAI帮助中心明确说明:个人版ChatGPT默认可能使用用户对话内容改进模型,用户可手动关闭“为所有人改进模型”选项;ChatGPT Business、Enterprise、Edu及API产品则默认不使用输入、输出内容训练模型。