OpenAI内部“莉莉计划”曝光:人工审核员正在审阅用户聊天记录

1 阅读

用户以为在和机器聊天,其实有人在看

很多人把 ChatGPT 当成树洞——深夜倾诉焦虑、反复修改求职信、甚至试探性地问“我是不是该离婚”。他们默认这些对话只存在于自己和算法之间,不会被真人读到。

但现实可能没那么私密。

根据外媒 404Media 的调查,OpenAI 内部长期运行一个名为“莉莉计划”(Project Lily)的人工评估项目。在这个项目里,被称为“提示词审核员”的工作人员会定期查看真实用户的聊天记录样本,任务是给模型的回答打分。

这些记录经过匿名化处理,不显示用户名或账号信息。但审核员看到的不只是孤立的一问一答,而是一段带有上下文的完整对话,有时还附带一份“用户记忆摘要”——里面汇总了该用户过去提过的问题、表现出的兴趣,甚至可能包含地理位置等元数据。

审核什么?不审核什么?

审核员的核心任务不是判断事实对错,而是评估模型的“说话方式”。

具体来说,他们会检查回答是否切题、有没有过度使用表情符号、是否显得谄媚(比如“好问题!”“您说得完全正确!”这类话术),以及是否存在高高在上的说教感。OpenAI 明确要求模型避免拟人化表达,比如不能说“身为一名厨师,我喜欢……”,但可以说“我查到了一些相关信息”。

这种设计源于一个共识:即使答案正确,如果语气让人不适,用户体验也会大打折扣。因此,“莉莉计划”本质上是在打磨 AI 的“人格”——让它既专业又不傲慢,既友好又不过度热情。

值得注意的是,明显的事实错误会被标记,但深度的事实核查由其他团队负责。安全审查(比如检测违法或有害内容)也属于独立流程。莉莉计划专注的是“风格”而非“真相”。

隐私保护真的够吗?

OpenAI 强调所有数据都经过匿名化,且审核员需签署保密协议。但公司也向媒体承认,过滤系统并非万无一失——尤其是简短对话,更容易残留可识别的个人信息。

更关键的问题是:用户是否知情?

默认情况下,普通 ChatGPT 用户的“允许使用你的对话记录改进产品”选项是开启的。企业版、教育版用户则默认关闭。但即便你后来手动关掉这个开关,此前的对话可能早已被提取、匿名化,并存入训练或评估数据集。删除聊天记录也无法保证它没被提前抓取。

在 404Media 报道发布前,OpenAI 的帮助页面只模糊提到“为改进模型,部分对话可能由人工审核”,但从未明确说“会有真人阅读你的聊天内容”。报道刊出后,公司悄悄更新了文档,增加了退出数据收集的指引,却依然回避“人工阅读”这一事实。

行业普遍做法,但透明度参差不齐

OpenAI 并非孤例。

谷歌在其 Gemini 隐私中心明确写道:“我们可能会保存部分聊天记录,并由人工审核。”Anthropic 也在官网专门设立页面解释其人工评估流程,包括如何匿名化、审核范围及退出方式。相比之下,Perplexity 的隐私政策语焉不详,既未确认也未否认员工可访问聊天日志。

这说明,在当前的大模型开发范式中,人类反馈仍是不可或缺的一环。无论强化学习(RLHF)还是直接偏好优化(DPO),都需要大量人工标注来引导模型行为。完全依赖自动化评估,很难捕捉到“语气是否自然”这类微妙维度。

但问题在于:用户是否应该拥有更清晰的选择权?

目前,大多数平台把“同意数据用于改进”设为默认选项,且说明文字藏在二级菜单里。普通用户很少主动去翻隐私设置,更不会意识到“改进”可能意味着“被真人阅读”。

高薪背后的机械劳动

据参与过该项目的人透露,“莉莉计划”的审核工作时薪超过 50 美元,对远程兼职者颇具吸引力。任务本身并不复杂:看一段对话,按几个维度打分,偶尔写简短评语。

但重复性极高。一位前审核员形容:“就像每天读几百封陌生人的邮件,判断回信是否礼貌、有用、不啰嗦。”长期下来,容易产生情感疏离——毕竟你看到的可能是某人刚经历分手后的崩溃倾诉,而你的任务只是给 AI 的安慰话术打个分。

这种劳动处于 AI 产业链的隐秘角落:既支撑着模型的“人性化”,又被刻意隐藏在技术神话背后。用户以为自己在和纯粹的智能体互动,殊不知背后有一群人在默默校准它的“情商”。

用户能做什么?

如果你在意隐私,可以手动关闭数据收集选项:

  1. 登录 ChatGPT 网页版
  2. 点击左下角头像 → Settings → Data controls
  3. 关闭 “Improve the model for everyone”

但请记住:这仅对未来对话生效。历史记录是否已被纳入审核池,无法追溯。

此外,避免在聊天中输入身份证号、住址、病历等敏感信息——即使你信任 OpenAI 的匿名化技术,也无法排除系统漏检或未来政策变动的风险。

技术进步的代价

“莉莉计划”的存在提醒我们:当前所谓的“通用人工智能”仍高度依赖人类干预。从数据清洗、标注到效果评估,人的判断贯穿始终。AI 的流畅对话背后,是无数琐碎、重复、甚至略带窥探性质的人工劳动。

这未必是坏事。人工反馈确实能有效提升模型表现。但问题在于透明度和选择权。用户有权知道自己的对话是否会被真人阅读,并应能轻松选择退出。

目前,行业在这方面的实践远未统一。OpenAI 的沉默、谷歌的坦白、Perplexity 的模糊,反映出一种普遍心态:技术公司更愿意强调 AI 的自主性,而不愿暴露其对人力的依赖。

或许,真正的“人性化 AI”不仅指语气友好,也包括对用户知情权的尊重。