用海量版权书籍训练AI模型,到底合不合法?这个困扰出版界和科技圈已久的问题,最近有了一个看似矛盾却极具分量的答案。
去年,在一起同类案件中具有里程碑意义的裁决里,法官威廉·阿尔苏普(William Alsup)命令AI公司Anthropic向一群作家支付高达15亿美元的版权和解金——这些作家的作品被用于训练该公司的AI模型。表面上看,这似乎是作者阵营的道德胜利,但法官实际上裁定,Anthropic的AI训练行为是合法的。
![]()
那这15亿美元罚的是什么?答案是:盗版。法官惩罚的是Anthropic从非法的网络影子图书馆盗取这些书籍的行为,而非使用它们训练模型本身。
法官:AI读书,就像作家读书
阿尔苏普法官在裁决中写道:“像任何渴望成为作家的读者一样,Anthropic的大语言模型(LLM)训练所依据的作品,不是为了抢先复制或取代它们——而是为了转过一个艰难的弯,创造出不同的东西。”他将LLM吸收数万亿词汇的过程,比作作家对文学的研究。
这一类比触及了问题的核心:阅读受版权保护的作品,与复制受版权保护的作品,在法律上有着天壤之别。版权法约束的是“复制”行为,而不是“使用”“体验”“消费”或“阅读”作品的行为。
15亿美元罚单,对AI公司是好事?
![]()
专精知识产权、版权和技术的律师凯西·盖利斯(Cathy Gellis)认为,这项裁决对AI公司更为有利。她算了一笔账:对于一家预计到2028年年收入约2000亿美元的公司来说,15亿美元的罚款算什么?
“我认为这对AI训练来说总体上是个好消息,因为他审视了正在发生的事情,并真正将其类比为阅读受版权保护的作品,而不是复制受版权保护的作品,”盖利斯说。
法律还停留在1976年
问题的复杂性在于,美国版权法自1976年以来就没有更新过。这意味着法官们必须用50年前的规则,去解释可能塑造AI行业未来的法律问题。
“现在每个人都非常担心,因为法律五花八门,就是因为这个问题,”JWL International知识产权与媒体业务高级律师兼创始人杰森·亨德森(Jason Henderson)表示,“他们知道AI模型已经训练了太多东西,而法律还没有真正跟上这个问题。”
这些问题的核心往往归结于合理使用原则——即对受版权保护作品的使用是否具有足够的“变革性”,从而在法律上被允许。合理使用是版权法的一个例外条款,允许在未经明确许可的情况下使用受版权保护的材料。在AI训练与版权保护的这场拉锯战中,这个50年前的法律框架,正在被推向前所未有的压力测试。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.