OpenAI多名外包评分员用AI代做评估 遭解雇或移出项目

事件核心摘要

2026年9月23日多家科技媒体跟进404 Media此前发布的报道,OpenAI多名负责ChatGPT回答质量评分的外包合同工,因违规使用AI工具代本人工评估工作,被公司解雇或移出相关项目。该岗位的人工评估结果是人类反馈训练的核心素材,用于大模型迭代优化,AI代工会直接污染人工反馈、降低训练数据质量,截至目前OpenAI尚未就事件具体细节作出官方回应。

配图

事件详情与规则边界

根据事实核查结果,本次被处置的外包人员核心职责为人工评估ChatGPT回答的准确性、安全性、有用性,相关评估结果会作为人类反馈素材支撑大模型迭代。OpenAI内部指引明确禁止评分员在工作中使用三类工具,包括ChatGPT等聊天机器人、AI检测器GPTZero以及写作辅助工具Grammarly。

需要明确的是,本次禁令仅针对承担评分职责的外包工作人员,并非普遍禁止普通用户使用AI工具,也不等同于禁止外部AI内容进入OpenAI训练流程,此前“OpenAI禁止用户用AI训练其AI”的概括存在误导性。

人员规模与事件背景

关于评分团队的整体规模,据AI Weekly转述404 Media的消息,OpenAI内部文件提及评分管道中有超过1万名合同工,但该数字仅来自内部文件与媒体报道,目前并未得到OpenAI官方公开确认。

公开信息显示,2026年9月中旬,404 Media就曾报道OpenAI使用数百名外包人员阅读、评分真实ChatGPT对话,目标是减少模型过度奉承、拟人化等问题;相关合同工通过Crossing Hurdles招募,由Mercor负责支付薪酬。

作者观点:人工评估的真实性是人类反馈强化学习模式的核心前提,“AI评AI”的造假行为会直接导致训练数据失真,不仅会浪费标注环节的人力投入,还可能对模型迭代方向造成负面影响。

官方回应与用户数据规则

截至多家媒体跟进报道的节点,暂未搜到OpenAI就本次解雇事件发布正式公告,也未对外披露具体解雇人数、违规发生的精确日期以及对应的技术检测标准,事件处置细节仍有待官方确认。

针对普通用户关心的对话数据使用规则,OpenAI帮助中心明确说明:个人版ChatGPT默认可能使用用户对话内容改进模型,用户可手动关闭“为所有人改进模型”选项;ChatGPT Business、Enterprise、Edu及API产品则默认不使用输入、输出内容训练模型。

参考资料

  1. Enterprise AI Privacy Pages: Direct Links to OpenAI, Anthropic, Google, and Microsoft Data Documentation -
  2. AI News for September 23, 2026 — Daily Edition | AI Weekly - AI Weekly
  3. OpenAI Contractors Were Reportedly Fired for Using AI to Train ChatGPT - TechnoSports Media Group
  4. 据报OpenAI雇数百名外包人员阅读ChatGPT对话 -
  5. How your data is used to improve model performance | OpenAI Help Center - OpenAI
  6. 你的ChatGPT对话可能被真人看过:OpenAI人工审核机制曝光 - 中国AI网 - 中国AI网
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。