探所 Curio 再探再报 了解探所 →
#AI

404 Media 曝光 OpenAI「Lily 计划」:人工读你的聊天记录

404 Media 依据获取到的内部操作指引、Slack 工作群记录与真实对话样本,披露了 OpenAI 内部代号「Lily 计划」的评估项目:公司招募**数百名合同工**担任「提示词审核员」,逐条阅读经匿名化处理的真实用户对话,评判 ChatGPT 回复是否切题、是否过度使用「AI 式话术」、说教语气、表情符号或谄媚口吻。

问题出在隐私环节。审核员看不到用户名,OpenAI 也说自己会先用模型过滤个人信息,但公司向 404 Media 承认**过滤仍可能漏掉敏感细节**,短会话出现这类问题的概率更高。交给审核员的会话版本还附带一份「用户记忆摘要」,汇总提问、兴趣偏好与上下文,甚至可能包含位置信息;报道指出大量对话里用户明确要求 ChatGPT 对内容保密。

💡 为什么值得看几亿 ChatGPT 用户默认开启训练,私密对话可能被人工阅读。

查证

来源与可信度

· 404 Media 依据泄露内部文档与真实对话样本,披露 OpenAI 内部「Lily 计划」用人工审核 ChatGPT 对话。 [1][2]
· OpenAI 招募数百名合同工担任「提示词审核员」,逐条阅读并评分真实用户对话。 [1][2]
· 审核对话虽经匿名化处理,OpenAI 承认过滤仍可能漏掉个人敏感信息,短会话尤甚。 [1][2]
孤证 · 审核员界面在提示词上方附带「用户记忆摘要」,汇总兴趣偏好、上下文,甚至可能含位置信息。 [2]

延伸阅读

企业与教育版默认关闭的边界 · ithome.com 8 分钟
报道里唯一带明确商业含义的部分:默认开启 + 不回溯的组合,直接决定哪些客户的数据会进入人工审核管线,值得对照各家隐私条款细看。
人工审核在模型迭代中的权重 · 404media.co 10 分钟
调查的核心论点之一是模型变好不只靠算力与爬数据,还有大量低薪外部合同工的重复劳动——这条线索对判断 AI 训练成本结构更关键。
与竞品的隐私条款对照 · ithome.com 10 分钟
Gemini 写明可能人工审核、Anthropic 持相似立场、Perplexity 语焉不详,横向对照能看出谁把这件事写进了公示、谁没写。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中