探所 Curio 再探再报 了解探所 →
#AI

牛津博德利藏书被曝喂给 OpenAI 训练

牛津大学的博德利图书馆(The Bodleian Library)把历史典籍交给了 OpenAI。一份内部文档显示,由 OpenAI 完成数字化的藏书已被用来「构建 OpenAI 的训练集」。校方 2025 年 3 月宣布这项合作时,说法是用 OpenAI 的软件做数字化、方便学生和研究人员查阅,并未提及资料会进入模型训练。

据《信息自由法》调取的会议纪要,包括博德利管理委员会成员在内的教职员工表达过顾虑:既担心与 OpenAI 合作带来声誉风险,也指出这项合作涉及高能耗技术,可能拖累大学自身的环保承诺。牛津方面否认向公众和学生隐瞒用途,称数字化本就是内核诉求,教职人员也明确承认项目会同时为模型提供训练数据,并强调这批文献规模有限、均已过版权保护期,OpenAI 的使用权是非排他性的。

💡 为什么值得看合作公告里没提训练用途,内部纪要显示教职员工早就担心声誉与能耗问题。

查证

来源档案

IT 之家(转述英媒卫报)

中文科技媒体,本条为对英媒卫报调查报道的转述集成,含校方与 OpenAI 双方书面回应。

事件事实(内部文档、会议纪要、扫描数量)均为转述二手,未见卫报原文或牛津官方文档;单源,训练用途的具体范围待官方进一步说明。

延伸阅读

合作协议里的用途条款 · ithome.com 5 分钟
2025 年 3 月公告只说数字化便利查阅,训练用途何时、以何种条款写入值得追。
NextGenAI 的图书馆清单 · ithome.com
波士顿公共图书馆、Caltech、MIT、密歇根大学等同类协议如何披露用途,可横向对照。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 目前邀请测试中