Meta“Llama”人工智能版权诉讼,一审——美国联邦法院质疑合理使用、生成人工智能的未来和版权

2025年5月1日(当地时间,日本时间5月2日),有人向加州旧金山联邦地方法院提起诉讼,指控Meta Platforms未经许可使用受版权保护的书籍来训练其生成式AI“Llama”。美国作家于2023年提起的版权侵权诉讼首审已经开庭。原告包括作家朱诺·迪亚兹、喜剧演员莎拉·西尔弗曼和塔内西·科茨。

在听证会上,美国地区法官文斯·查布里亚 (Vince Chhabria) 对 Meta 的“合理使用”主张表示怀疑。“使用受版权保护的作品创造无限数量的竞争产品可以对原作者的市场产生重大影响,但不必支付许可费不太可能是合理使用。”说。

Meta 认为,使用受版权保护的材料来训练人工智能模型是“变革性使用”,属于合理使用。然而,原告声称 Meta 在未经许可或无偿的情况下复制受版权保护的作品,并且人工智能生成的内容威胁了作者的收入来源。据透露,Meta 使用的数据集包括从 LibGen(Library Genesis)等影子图书馆获取的约 196 万本书。

这次审判是第一起大规模诉讼,质疑人工智能公司是否可以在未经许可的情况下使用受版权保护的内容,即“合理使用”在多大程度上得到认可。预计这将对未来人工智能的发展和知识产权状况产生重大影响。

从:Meta诉讼引发人工智能版权之争的首次大考

【编辑部评论】

作为首例针对生成人工智能合法性的大规模诉讼,本案正处于探索技术创新与版权保护之间平衡的重要关口。自2025年1月提起诉讼以来,由于内部Meta文件的泄露,该公司意识到从 LibGen 等影子库检索数据时存在法律风险事情变得很清楚了。这表明这不仅仅是意外使用,而是故意行为。

试验的重点是“变革性使用”和“市场替代”之间的界限。 Meta 认为,AI 模型学习不仅仅是受版权保护作品的复制,而是创造新价值的变革性用途。不过,旧金山联邦地方法院法官 Chhabria 指出,Llama 生成的内容可能会对原作者的市场产生重大影响,并采取严格立场,认为仅靠技术创新并不能证明合理使用。

特别值得注意的是,Meta 使用的数据集包括来自 LibGen 等影子图书馆的约 196 万本书。LibGen 收集了大量书籍,包括非法上传的书籍,并且在没有版权管理组织的情况下使用。目前的情况凸显了人工智能发展中权利处理的不发达。

日本企业对此并不陌生。根据三菱日联研究中心的一项调查显示,大约68%的国内人工智能公司在学习数据的来源管理方面存在问题。数据采集​​的透明度正在成为全球趋势,根据计划于 2025 年 6 月生效的欧盟人工智能法规,可追溯性将成为强制性要求。

未来,预计音乐行业中的JASRAC等版权管理组织将创建一个“版权市场”,在其中处理AI学习数据的版权处理。海外已经有一些初创公司正在尝试对人工智能生成的内容进行版权费分配,并正在寻求技术创新和权利保护之间的平衡。

另一方面,我们不能忽视过度监管阻碍人工智能技术发展的风险。美国国务院的人工智能倡议报告(2025 年 4 月)指出,人们担心合理使用的狭义定义将阻碍开源开发和为了公共利益而使用人工智能。未来的挑战是保持人工智能在教育和医学等具有巨大社会效益的领域的使用,同时尊重版权所有者的权利。

该判决预计将于 2025 年底下达,根据结果,生成式人工智能的商业模式和知识产权的处理可能会发生重大变化。尤其是Metaverse相关部门Reality Labs(2024年销售额达320亿美元)受到的影响备受关注,很可能成为影响全球人工智能行业趋势的重要先例。

【术语解释】

合理使用
美国版权法的例外情况。判断基于四个因素,包括版权作品的使用目的和对市场的影响。

图书馆创世纪(LibGen):
起源于俄罗斯的“影子图书馆”是一个盗版数据库,免费提供超过750万册图书和8100万篇学术论文。

影子图书馆
LibGen 等在线数据库会非法上传受版权保护的书籍。

可追溯性
一种允许人工智能跟踪和验证用于学习的数据的来源和历史的机制。

[参考链接]

元平台官方网站(外部)
发布Meta公司信息、AI/Metaverse业务等的官方网站

[相关文章]

在 innovaTopia 上阅读更多技术和社会新闻

在 innovaTopia 上阅读更多 AI(人工智能)新闻

在 innovaTopia 上阅读更多有关版权的文章