#AI
404 Media 曝光 OpenAI「Lily 计划」:人工读你的聊天记录
404 Media 依据获取到的内部操作指引、Slack 工作群记录与真实对话样本,披露了 OpenAI 内部代号「Lily 计划」的评估项目:公司招募**数百名合同工**担任「提示词审核员」,逐条阅读经匿名化处理的真实用户对话,评判 ChatGPT 回复是否切题、是否过度使用「AI 式话术」、说教语气、表情符号或谄媚口吻。
问题出在隐私环节。审核员看不到用户名,OpenAI 也说自己会先用模型过滤个人信息,但公司向 404 Media 承认**过滤仍可能漏掉敏感细节**,短会话出现这类问题的概率更高。交给审核员的会话版本还附带一份「用户记忆摘要」,汇总提问、兴趣偏好与上下文,甚至可能包含位置信息;报道指出大量对话里用户明确要求 ChatGPT 对内容保密。
💡 为什么值得看几亿 ChatGPT 用户默认开启训练,私密对话可能被人工阅读。
查证
来源与可信度
孤证
· 审核员界面在提示词上方附带「用户记忆摘要」,汇总兴趣偏好、上下文,甚至可能含位置信息。
[2]
延伸阅读
报道里唯一带明确商业含义的部分:默认开启 + 不回溯的组合,直接决定哪些客户的数据会进入人工审核管线,值得对照各家隐私条款细看。
调查的核心论点之一是模型变好不只靠算力与爬数据,还有大量低薪外部合同工的重复劳动——这条线索对判断 AI 训练成本结构更关键。
Gemini 写明可能人工审核、Anthropic 持相似立场、Perplexity 语焉不详,横向对照能看出谁把这件事写进了公示、谁没写。