牛津博德利图书馆藏书被用于OpenAI模型训练,校方内部曾表担忧
摘要
牛津大学与OpenAI合作数字化博德利图书馆藏书,内部文件显示这些资料已被用于构建OpenAI训练集。校方2025年3月宣布合作时未提及此用途,教职员工对声誉风险及高能耗问题表达顾虑。
据英国《卫报》报道,牛津大学已允许OpenAI利用其博德利图书馆(Bodleian Library)的历史典籍来训练人工智能模型。博德利图书馆是牛津大学主要的研究图书馆,也是英国规模仅次于大英图书馆的第二大图书馆。
一份内部文件显示,由OpenAI完成数字化的博德利藏书已被用来“构建OpenAI的训练集”。牛津大学于2025年3月宣布与该公司达成合作,使用OpenAI的软件对该校这座享誉世界的图书馆藏书进行数字化处理。校方当时表示,此举将让广大学生和研究人员更便捷地查阅这些文献资料。然而,当时的合作公告并未提及这些资料会被用于训练OpenAI的模型。
OpenAI的一位发言人表示,公司很荣幸能够促成“当今的AI模型为后世守护人类的历史文化瑰宝”。该发言人还补充道:“目前全球已有超过十亿人在日常生活中使用这项技术,因此让它充分反映不同的文化、历史和视角至关重要。”
一份根据《信息自由法》调取的牛津大学会议纪要显示,包括博德利管理委员会成员在内的教职员工均表达了顾虑。他们不仅担忧与OpenAI合作可能会引发声誉风险,还指出这项合作涉及高能耗技术,可能会对大学自身作出的环保承诺产生负面影响。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗