#AI
DOJ 为 OpenAI 版权诉讼站队
9 月 2 日,美国司法部(DOJ)在纽约南区联邦法院提交利益声明,正式支持 OpenAI 对抗《纽约时报》的版权诉讼,这是联邦政府**首次正式表态**机器学习模型训练是否构成侵权。DOJ 认定训练「极其变革性」,内核论据是大语言模型「并不复现其训练文本」。(c1, c2)
问题在于,这个事实主张恰恰是 OpenAI 自己的证据所动摇的。据社论披露,《纽约时报》此前在法庭上指控 OpenAI 隐瞒了内部工具 **Project Giraffe**——一个专门检测 ChatGPT 输出是否逐字复现训练数据的系统,以及一个据称约含 7800 万条去标识化对话的数据库。如果模型真不复现文本,建这个检测器就没有必要。这一落差为 NYT 的质询提供了现成的靶子。(c3)
💡 为什么值得看联邦表态 AI 训练侵权,与 OpenAI 内部证据冲突。
查证
来源档案
TemperatureZero
AI 行业社论/深度分析博客,逐段解析 DOJ 提交的法律文档并对照本案证据。
对 DOJ 立案时间、各方论点与 Project Giraffe 细节的叙述详尽且具体,可信度较高;但单一来源、无第二独立源互证,关键数字与内部工具细节宜待后续法庭文档确认。
延伸阅读
看 DOJ 为何只猛打「变革性」这一条、其余三要素一笔带过,以及作者认为本可以有的更强主张。
作者论证:检测复现的工具本身,反证 OpenAI 知道复现存在;DOJ 的绝对化措辞成了「hostage to fortune」。