OpenAI莉莉计划曝光 人工审核ChatGPT用户聊天记录

配图
2026年9月16日曝光的信息显示,OpenAI内部长期运行代号为“莉莉计划”(Project Lily)的人工评估项目,安排提示词审核员对ChatGPT用户的真实聊天记录进行人工审阅与打分,该消息打破了外界此前认为大模型进化仅靠算法升级和自动化训练数据的固有认知,引发广泛关注。

项目细节首次公开

据外媒404Media披露,“莉莉计划”是OpenAI内部存续已久的人工评估类项目,参与项目的提示词审核员需要查看经过匿名化处理的ChatGPT用户真实会话样本,对模型的回复质量进行打分。 审核工作的核心评判维度包含两项:一是核查模型回复是否切题,二是排查文本中是否存在过度“AI化”表述、高高在上的说教语气、不当使用表情符号或谄媚口吻等问题。 该项目配套的操作指引对模型输出内容作出了明确的限制性要求,严格禁止AI使用任何拟人化表述或编造“个人经历”,例如允许模型输出“我查到了一些相关信息”,但不允许出现“身为一名厨师,我喜欢……”“我明白这种感受”这类表述。

打破大模型训练固有认知

此前外界普遍认为,大模型的迭代升级完全依靠算法优化和庞大的自动化训练数据集支撑,本次“莉莉计划”的曝光,直接揭示了人工审核环节在大模型训练迭代过程中仍然扮演着不可替代的关键角色。 本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。