美司法部表态:AI训练数据版权争议或迎转折点
摘要
美国司法部在OpenAI与《纽约时报》的版权诉讼中提交非约束性意见书,认为用受版权文本训练大模型通常构成合理使用,并警告强制全面许可可能削弱美国AI竞争力。该意见为行业提供重要参照,但个案数据获取及输出问题仍待法院裁定。
美国司法部近日在OpenAI与《纽约时报》的版权纠纷中正式提交法律意见书,就生成式人工智能训练数据的版权边界问题亮明立场。此举被视为联邦政府对AI行业核心法律争议的一次罕见介入,引发法律与科技界广泛关注。
意见书核心观点认为,使用受版权保护的文本材料训练大型语言模型,在一般情况下应被判定为合理使用。司法部强调,模型训练过程具有显著的转换性——它并非简单复制原作,而是从海量文本中抽象出语言规律与知识结构,其产物与原始作品存在本质差异。
与此同时,司法部从国家安全与产业竞争力角度发出警示:若强制要求AI开发者对全部训练数据取得逐项授权,将大幅推高合规成本,拖慢美国本土AI企业的研发节奏,在全球竞赛中处于不利地位。这一表述被解读为联邦层面在创新保护与版权人权益之间倾向于前者。
需要明确的是,该意见书仅具建议性质,对法院裁判不构成强制约束力。司法部同时指出,训练数据的获取方式是否合法、模型输出是否实质性复制了受保护段落,仍需作为独立问题由法院在具体案件中逐案审查。这意味着即便整体原则偏向AI开发者,个案裁决仍存在较大不确定性。
此次表态为持续胶着的AI版权诉讼提供了新的政策参照系。业内分析认为,若法院采纳该立场,将显著降低AI企业面临的数据合规风险,但版权方与平台间的博弈预计仍将长期存在,未来立法层面的细则完善或成关键变量。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗