#AI
牛津博德利藏书被曝喂给 OpenAI 训练
牛津大学的博德利图书馆(The Bodleian Library)把历史典籍交给了 OpenAI。一份内部文档显示,由 OpenAI 完成数字化的藏书已被用来「构建 OpenAI 的训练集」。校方 2025 年 3 月宣布这项合作时,说法是用 OpenAI 的软件做数字化、方便学生和研究人员查阅,并未提及资料会进入模型训练。
据《信息自由法》调取的会议纪要,包括博德利管理委员会成员在内的教职员工表达过顾虑:既担心与 OpenAI 合作带来声誉风险,也指出这项合作涉及高能耗技术,可能拖累大学自身的环保承诺。牛津方面否认向公众和学生隐瞒用途,称数字化本就是内核诉求,教职人员也明确承认项目会同时为模型提供训练数据,并强调这批文献规模有限、均已过版权保护期,OpenAI 的使用权是非排他性的。
💡 为什么值得看合作公告里没提训练用途,内部纪要显示教职员工早就担心声誉与能耗问题。
查证
来源档案
IT 之家(转述英媒卫报)
中文科技媒体,本条为对英媒卫报调查报道的转述集成,含校方与 OpenAI 双方书面回应。
事件事实(内部文档、会议纪要、扫描数量)均为转述二手,未见卫报原文或牛津官方文档;单源,训练用途的具体范围待官方进一步说明。
延伸阅读
2025 年 3 月公告只说数字化便利查阅,训练用途何时、以何种条款写入值得追。
波士顿公共图书馆、Caltech、MIT、密歇根大学等同类协议如何披露用途,可横向对照。