牛津博德利图书馆藏书被曝用于 OpenAI 模型训练,校方称已告知教职员工
中文摘要
牛津博德利图书馆数字化藏书被曝用于OpenAI训练,校方称此前未明确用途,但强调资料已过版权保护期。
English Summary
Bodleian Library digitized collections were used for OpenAI training without prior disclosure, but the university claims the materials are out of copyright.
原文节选
据卫报援引《信息自由法》调取的内部文件,OpenAI 数字化的牛津大学博德利图书馆藏书已被用于构建 OpenAI 训练集,而 2025 年 3 月的合作公告未提及此用途。截至 2025 年 6 月已提供 12.5 万份历史学位论文扫描影印页及 1 万首 16 世纪宽边民谣珍藏集;教职员工曾担忧声誉与环保风险,校方回应称资料均已超出版权保护期、授权非排他,并将陆续公开这批数字化文献。