引言
近日,两位联邦法官裁定,使用受版权保护的作品训练人工智能模型符合版权法规定的“合理使用”。两项判决表明,合理使用结果可能取决于多种因素,包括存在哪些市场损害的证据,以及在训练之前如何获取和使用副本。Chhabria 法官的意见强调了原告的举证责任,而 Alsup 法官则在创新的机器学习用途与普通的盗版之间划出了一条清晰的界限。
以下是相关案例和判决的简要概述。
Kadrey诉Meta Platforms案(北加州 - 法官Vince Chhabria)
以小说家理查德·卡德雷为首的十三位知名作家指控Meta从“影子图书馆”下载他们的书籍,并将其输入其Llama模型。查布里亚法官驳回了这些作家的动议,并裁定Meta的部分简易判决,认为Meta对这些原告的培训使用是公平的。
因素 1(目的/特征):训练大模型(LLM)具有“高度变革性”,因为它可以将书籍转化为可以起草电子邮件、翻译文本或编写代码的工具的统计模式;商业动机并没有超过这种变革性用途。
因素 2(作品的性质):这些书富有表现力,但该因素在这里“很少发挥重要作用”,因此影响不大。
因素 3(数量和实质性):复制整个作品是“合理必要的”,因为 LLM 在接受完整、高质量的文本训练时表现更好。
因素 4(市场影响):这个是导致作者的败诉“最重要的一个因素”。法院没有发现任何证据表明Llama能够从作者的书中剥离出有意义的内容,也没有发现其存在损害了销量。法院裁定,将书籍授权为训练数据的机会的丧失,并不属于版权法规定的可认知市场。
法官指出,由于起诉人“提出了错误的论点,并且未能提供证据支持正确的论点”,Meta 逃脱了责任——但这仅限于这13位原告,而非其作品被其使用的“无数其他”原告。因此,法院为未来的艺术家和作家起诉 Meta 侵犯版权留下了空间。
Bartz诉Anthropic案(北加州 - 法官William Alsup)
三位作家——安德里亚·巴茨 (Andrea Bartz)、查尔斯·格雷伯 (Charles Graeber) 和柯克·华莱士·约翰逊 (Kirk Wallace Johnson)——起诉了 Anthropic,指控这家初创公司盗版了数百万本图书,这些图书要么是从 Books3/LibGen 盗版的,要么是购买、扫描并存储在其内部图书馆中,然后使用其中的一部分来训练 Claude。Alsup 法官的裁决如下:
训练副本:复制书籍以获得“统计关系”并建立LLM“极具转换性”,因此属于合理使用。
扫描购买:将合法购买的印刷书籍转换为数字文件以供内部参考也是公平的,就像制作节省空间、可搜索的备份一样。
盗版图书馆:在永久参考图书馆中保存从盗版网站下载的未经授权的副本不属于合理使用;法院认为,建立私人研究档案并不能成为全面侵权的理由。
该裁决使 Anthropic 可能要对与盗版书籍相关的损害承担责任,但保护了其模型训练流程和合法获取书籍的数字化。
有小伙伴分享了这两个案件裁判思路的对比图,原图附在这里:

本文参考网址:https://www.taftlaw.com/news-events/law-bulletins/two-federal-judges-rule-in-separate-cases-that-training-ai-models-using-copyrighted-works-is-fair-use/
近日,两位联邦法官裁定,使用受版权保护的作品训练人工智能模型符合版权法规定的“合理使用”。两项判决表明,合理使用结果可能取决于多种因素,包括存在哪些市场损害的证据,以及在训练之前如何获取和使用副本。Chhabria 法官的意见强调了原告的举证责任,而 Alsup 法官则在创新的机器学习用途与普通的盗版之间划出了一条清晰的界限。
以下是相关案例和判决的简要概述。
Kadrey诉Meta Platforms案(北加州 - 法官Vince Chhabria)
以小说家理查德·卡德雷为首的十三位知名作家指控Meta从“影子图书馆”下载他们的书籍,并将其输入其Llama模型。查布里亚法官驳回了这些作家的动议,并裁定Meta的部分简易判决,认为Meta对这些原告的培训使用是公平的。
因素 1(目的/特征):训练大模型(LLM)具有“高度变革性”,因为它可以将书籍转化为可以起草电子邮件、翻译文本或编写代码的工具的统计模式;商业动机并没有超过这种变革性用途。
因素 2(作品的性质):这些书富有表现力,但该因素在这里“很少发挥重要作用”,因此影响不大。
因素 3(数量和实质性):复制整个作品是“合理必要的”,因为 LLM 在接受完整、高质量的文本训练时表现更好。
因素 4(市场影响):这个是导致作者的败诉“最重要的一个因素”。法院没有发现任何证据表明Llama能够从作者的书中剥离出有意义的内容,也没有发现其存在损害了销量。法院裁定,将书籍授权为训练数据的机会的丧失,并不属于版权法规定的可认知市场。
法官指出,由于起诉人“提出了错误的论点,并且未能提供证据支持正确的论点”,Meta 逃脱了责任——但这仅限于这13位原告,而非其作品被其使用的“无数其他”原告。因此,法院为未来的艺术家和作家起诉 Meta 侵犯版权留下了空间。
Bartz诉Anthropic案(北加州 - 法官William Alsup)
三位作家——安德里亚·巴茨 (Andrea Bartz)、查尔斯·格雷伯 (Charles Graeber) 和柯克·华莱士·约翰逊 (Kirk Wallace Johnson)——起诉了 Anthropic,指控这家初创公司盗版了数百万本图书,这些图书要么是从 Books3/LibGen 盗版的,要么是购买、扫描并存储在其内部图书馆中,然后使用其中的一部分来训练 Claude。Alsup 法官的裁决如下:
训练副本:复制书籍以获得“统计关系”并建立LLM“极具转换性”,因此属于合理使用。
扫描购买:将合法购买的印刷书籍转换为数字文件以供内部参考也是公平的,就像制作节省空间、可搜索的备份一样。
盗版图书馆:在永久参考图书馆中保存从盗版网站下载的未经授权的副本不属于合理使用;法院认为,建立私人研究档案并不能成为全面侵权的理由。
该裁决使 Anthropic 可能要对与盗版书籍相关的损害承担责任,但保护了其模型训练流程和合法获取书籍的数字化。
有小伙伴分享了这两个案件裁判思路的对比图,原图附在这里:

本文参考网址:https://www.taftlaw.com/news-events/law-bulletins/two-federal-judges-rule-in-separate-cases-that-training-ai-models-using-copyrighted-works-is-fair-use/
