产业观察
英国第二大图书馆:牛津大学博德利图书馆藏书被曝用于 OpenAI 模型训练
📋总体概括
据《卫报》报道,牛津大学允许OpenAI利用博德利图书馆的历史典籍训练AI模型。该馆为英国第二大图书馆,2025年3月校方宣布与OpenAI合作进行数字化,但公告未提及资料会用于模型训练。内部文件显示数字化藏书已被用于构建OpenAI训练集,截至2025年6月已提供12.5万份历史学位论文扫描页。校方教职员工担忧声誉风险及高能耗技术与环保承诺冲突。OpenAI还在NextGenAI项目下与多家美国图书馆签有类似协议,牛津是唯一英国成员。
⚡关键信息
- ▸牛津大学博德利图书馆与OpenAI合作数字化藏书,内部文件确认这些藏书已被用于构建OpenAI的AI训练集
- ▸2025年3月的合作公告称目的是方便学生和研究人员查阅文献,并未提及资料将用于训练模型
- ▸截至2025年6月,图书馆已提供12.5万份19至20世纪欧美高校博士论文的扫描影印页
- ▸通过《信息自由法》调取的会议纪要显示,教职员工担忧声誉风险及高能耗技术对大学环保承诺的负面影响
- ▸OpenAI的NextGenAI项目已与波士顿公共图书馆、加州理工、MIT、密歇根大学等签署类似协议,牛津是唯一英国成员
🔥犀利点评
又一次「先上车后补票」。校方公告只谈数字化便民,绝口不提训练语料,直到《信息自由法》撬开会议纪要才见光——这不是透明合作,是话术包装。高校把几百年文化资产廉价换算成「数字化服务」,OpenAI则用「守护人类瑰宝」的漂亮话遮住数据摄取的本质。当学术机构自己都不愿公开条款,公众凭什么相信AI训练的数据获取是干净的?
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →