夜雨聆风学习资料网

ARTICLE · 1038845

OpenAI「Lily计划」调查全解读:你的对话正在被人类评分,而这件事几乎整个行业都在做

OpenAI「Lily计划」调查全解读:你的对话正在被人类评分,而这件事几乎整个行业都在做

声明:本文为 AI 行业资讯梳理,基于 404 Media 调查报道及各公司公开官方页面整理,含 AI 辅助创作,关键事实已标注来源;涉及诉讼与数据处理的表述均保留原始出处限定,具体信息以各官方公告为准。

2026年9月14日,美国调查媒体 404 Media 发布调查,称掌握了 OpenAI 内部项目"Lily计划"的直接材料——指导手册、Slack内部频道、真实用户提问与一套完整评分体系。这些材料指向一个事实:数百名外包合同工正在逐条阅读真实用户的 ChatGPT 对话,对模型生成的回复打分、写评语,用来优化模型表现,其中不少对话带有敏感个人信息。目前只知道项目名称,具体训练哪个模型并未披露。

一、审核员在做什么

审核链路分三步:阅读真实提问 → 总结用户意图 → 对模型生成的4个候选回复逐一批评、打分。

回复按 1—7 分评级:1分为"不可接受、无法使用",7分为"几乎没有进一步优化空间"。

扣分项包括:AI腔调与表情符号滥用、谄媚讨好(sycophancy)、强行模仿用户风格、放大沮丧情绪。拟人化红线也很明确——"作为一名厨师,我喜欢……""我懂那种感受"不允许;"让我来看一下"可以用。审核员FAQ显示,OpenAI并不要求他们外部检索核查准确性,医疗、法律、财务等高风险领域若缺引用来源要扣分。

Lily计划的核心目标之一,是让模型减少拟人化、降低"讨好型"人格。据相关诉讼指控,GPT-4o模型被指因过度顺从用户,在一定程度上与多起自杀事件相关。

二、匿名不是绝对的

OpenAI表示,对话提交前会经 Privacy Filter(隐私过滤器) 去标识化,仪表盘不显示用户名。但该公司官网也承认:

"与所有模型一样,隐私过滤器也会出错,可能遗漏罕见标识符或模棱两可的私密表述。"

据404 Media看到的材料,提问上方有时会附带"用户记忆汇总",概述该用户过往用途,甚至含居住地等背景。一位参与处理的工作人员直言:"我不认为他们会想到某个地方的外包人员正在分析这些对话。"

三、默认即同意,才是争议中心

时间线:404 Media询问OpenAI是否明确告知用户提问会被人工审核——对方最初未明确答复;报道发表后,OpenAI才指出官网上"人工审查可能用于提高模型性能"的说明,并更新帮助页补充退出指引,但对"真人逐条阅读"一事仍未清晰回应。

需客观交代:OpenAI确实长期公开过"数据控制"说明页,所以"完全未告知"并不准确。更准确的说法是:告知入口分散、默认开启,而"真人逐条阅读"这一点此前未被清晰点明。

免费版 / Plus / Pro"为所有人改进模型"默认开启,须手动关闭

Enterprise / Business / Edu该选项默认关闭

关闭路径:头像 → 设置 → 数据控制 →「为所有人改进模型」→ 关闭。⚠️ 仅对关闭后新对话生效,无法追溯既有记录。

四、这不是OpenAI独有       

Google Gemini 隐私中心明确:为改进服务,人工审核员可能审查部分保存对话,最长保留三年;Anthropic 确认审核部分 Claude 对话,审核前移除邮箱等账户标识符,数据不用于营销或出售。

横向对比结论是:"与AI一对一私密交谈"的默认预期,在整个行业都已不成立。区别只在三点——脱敏做到什么程度、开关默认开还是关、告知写得有多清楚。Lily计划被质疑的,不是"用人工训练AI"本身,而是OpenAI把默认开启 + 不追溯 + 真人阅读未清晰点明叠在了一起。

五、外包链与新风险

招聘机构 Crossing Hurdles → 转送 AI训练公司 Mercor → Mercor 实际发放薪资。招聘信息刻意不提OpenAI,但职责描述与Lily计划高度吻合。据公开报道,Mercor在2026年4月遭遇严重数据泄露,Meta已终止合作——一段敏感对话要经过多少层供应商,公开信息并未回答。

现在就做的3件事

  1. 关闭模型改进(必做)
    :设置 → 数据控制 → 关闭。⚠️ 只对关闭后新对话生效。
  2. 高敏感场景改用临时聊天(Temporary Chat)
    :不进历史、不用于改进(出于安全目的保留30天)。
  3. 输入前先脱敏
    :病历、合同、身份信先删除姓名、账号、身份证号——这一步不依赖任何开关。

      AI越来越像一个耐心的助手,人也越容易忘记它同时是一项需要上传数据的网络服务。看清一点,不是为了让你别用,而是让你开口之前,自己先脱一层敏。

关键事实来源:

本文事实综合以下公开来源:404 Media《Inside 'Project Lily'》调查报道(2026-09-14,含内部指导手册、评分体系、审核员访谈、外包链 Crossing Hurdles / Mercor);OpenAI 官网"Privacy that puts you in control"(Privacy Filter 说明、"Improve the model for everyone"开关、Temporary Chat、企业版默认不训练)与帮助中心"数据控制"(关闭路径、仅对新对话生效);Anthropic Help Center / Privacy Center(人工审核、去标识化、不用于营销或出售);Google 帮助中心《Gemini 应用隐私信息中心》(人工审查、最长保留三年);对标原文《OpenAI"Lily计划"曝光 你的聊天记录可能正在被人工审核》见 https://mp.weixin.qq.com/s/u4I5vXWlBjfb2f8nUB7Yug 。具体信息以各官方公告为准。

相关学习资料