探所 Curio 再探再报 了解探所 →
#AI

DOJ 为 OpenAI 版权诉讼站队

9 月 2 日,美国司法部(DOJ)在纽约南区联邦法院提交利益声明,正式支持 OpenAI 对抗《纽约时报》的版权诉讼,这是联邦政府**首次正式表态**机器学习模型训练是否构成侵权。DOJ 认定训练「极其变革性」,内核论据是大语言模型「并不复现其训练文本」。(c1, c2)

问题在于,这个事实主张恰恰是 OpenAI 自己的证据所动摇的。据社论披露,《纽约时报》此前在法庭上指控 OpenAI 隐瞒了内部工具 **Project Giraffe**——一个专门检测 ChatGPT 输出是否逐字复现训练数据的系统,以及一个据称约含 7800 万条去标识化对话的数据库。如果模型真不复现文本,建这个检测器就没有必要。这一落差为 NYT 的质询提供了现成的靶子。(c3)

💡 为什么值得看联邦表态 AI 训练侵权,与 OpenAI 内部证据冲突。

查证

来源档案

TemperatureZero

AI 行业社论/深度分析博客,逐段解析 DOJ 提交的法律文档并对照本案证据。

对 DOJ 立案时间、各方论点与 Project Giraffe 细节的叙述详尽且具体,可信度较高;但单一来源、无第二独立源互证,关键数字与内部工具细节宜待后续法庭文档确认。

延伸阅读

四大合理使用要素 · temperaturezero.com 15 分钟
看 DOJ 为何只猛打「变革性」这一条、其余三要素一笔带过,以及作者认为本可以有的更强主张。
Project Giraffe 悖论 · temperaturezero.com 10 分钟
作者论证:检测复现的工具本身,反证 OpenAI 知道复现存在;DOJ 的绝对化措辞成了「hostage to fortune」。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store