OpenAI解雇多名使用AI代做ChatGPT回复评分的承包商

核心摘要

2026年9月23日前后OpenAI被404 Media曝光解雇多名外部评分承包商,解雇原因是相关人员使用AI工具代替人工完成ChatGPT回复质量评估,存在偷工减料行为,AI Weekly等媒体随后跟进报道。项目明确禁止评分人员使用聊天机器人、GPTZero、Grammarly等工具代做任务,本次事件发生在Project Lily人工评分项目被曝光之后,相关文件显示OpenAI评分管道总规模超万人,事件也引发外界对用户聊天数据隐私安全的关注。

配图

事件基本详情

本次涉及的承包商属于OpenAI Project Lily项目,岗位名称为“prompt reviewer”,该岗位核心职责为评估ChatGPT的回复质量,并不直接参与模型训练工作。2026年9月中旬,404 Media首次曝光Project Lily项目,项目安排数百名承包商对真实ChatGPT对话进行阅读、总结,并按照1-7分的标准对回复质量进行评分。

2026年9月23日前后的后续报道显示,多名承包商因使用AI工具完成评分工作被OpenAI解雇,解雇理由为工作“偷工减料”。截至报道发布,本次被解雇人员的准确人数、姓名、所属外包公司均未披露,也暂无官方公布的具体处理细节。

评分项目规则与人员配置

根据404 Media获取的内部文件,OpenAI明确要求参与评分的承包商不得使用聊天机器人、GPTZero、Grammarly及各类AI检测工具完成评分任务。文件同时披露,OpenAI整个评分管道中有超过一万名承包商,需要注意的是,该数字为全评分管道的总人员规模,并不等同于本次被解雇的人数。早前Project Lily的相关报道显示,部分承包商通过第三方人力公司可获得50美元以上的时薪。

禁令设置的核心考量

人工评分、强化学习反馈是当前大模型优化流程中的常见环节,评分结果的质量会直接影响模型迭代的最终效果。作者观点:OpenAI出台严格的工具禁令、解雇使用AI代做评分的承包商,核心原因是担心低质量的自动化反馈进入模型优化流程,导致训练信号被污染,影响ChatGPT后续的迭代质量。

数据隐私与使用规则

根据曝光信息,Project Lily的评分材料据称经过自动化隐私过滤,但OpenAI承认过滤机制并不完美,承包商使用的操作界面还可能展示“用户记忆摘要”,这一情况也引发外界对真实聊天数据被人工阅读、隐私过滤不充分的担忧。

根据OpenAI官方帮助中心说明,个人版ChatGPT、OpenAI Codex的内容在用户设置允许时可用于改进模型;个人免费版、Plus、Pro等账户的模型改进设置默认开启,Business、Enterprise、Edu、API渠道的数据默认不用于模型训练。目前OpenAI现行帮助中心仍保留“Improve the model for everyone”的数据控制说明,尚未针对本次解雇事件发布独立新闻稿。

参考资料

  1. Pogosta vprašanja o uporabi podatkov za potrošniške storitve | OpenAI Help Center - OpenAI
  2. AI News for September 23, 2026 — Daily Edition | AI Weekly - AI Weekly
  3. OpenAI is paying people to read your ChatGPT conversations — turn this setting off NOW - GB News
  4. Product News and Updates | OpenAI - OpenAI
  5. Connected apps in ChatGPT | OpenAI Help Center - OpenAI
  6. AI Tools News 2026 — Latest Releases & Updates | AItoolFit -
  7. 我们如何监控内部编程智能体的对齐失范 | OpenAI - OpenAI
  8. OpenAI 秘密专案曝光!数百名外包人工评分 ChatGPT 对话,隐私恐失守 | 科技新报 | LINE TODAY - LINE TODAY
  9. How your data is used to improve model performance | OpenAI Help Center - OpenAI
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。