ChatGPT、Gemini、Claude这些AI模型,训练数据里塞进了数亿本书、论文和网页内容。绝大多数作者根本不知情,也没同意,自己的作品就成了AI的“养料”。这听起来像是明摆着的侵权,但法律上的答案远没有这么干脆。
“这个领域的法律和技术都太复杂了,”专攻知识产权和版权的律师Cathy Gellis对TechCrunch说,“各方情绪都很激烈,支持和反对的声音都有。”
![]()
1.5亿美元罚单,罚的却不是“训练”
去年,法官William Alsup做出了一项标志性裁决:要求Anthropic向一群作家支付高达15亿美元的版权和解金,这些作家的作品被用来训练Anthropic的AI模型。
乍一看,这是作者们的道德胜利。但细看判决书,Alsup法官实际上认定Anthropic的AI训练行为是合法的。他罚的是另一件事——Anthropic从非法的网络影子图书馆盗版了这些书。
法官在判决里打了个比方:AI模型吞下数万亿个词,就像作家研读文学作品一样。“像任何想成为作家的读者一样,Anthropic的大语言模型训练于这些作品,不是为了超越或取代它们,而是为了转过一个艰难的弯,创造出不同的东西。”
罚15亿,对AI公司是“好消息”?
Gellis认为,这个裁决对AI公司其实更有利。一家预计到2028年年收入约2000亿美元的公司,15亿美元的罚款算得了什么?
![]()
“我认为这对AI训练来说总体是个好消息,因为他看待这件事的方式,是把它类比为阅读受版权保护的作品,而不是复制受版权保护的作品,”Gellis说,“版权法围绕复制展开,但它不围绕使用、体验、消费或阅读作品展开。”
法律还停留在1976年
版权法自1976年以来就没更新过。这意味着法官们得用50年前的规则,去裁决可能塑造AI行业未来走向的法律问题。
“现在大家都很焦虑,因为法律到处都是漏洞,根源就在这个问题上,”JWL International知识产权与媒体业务高级律师Jason Henderson说,“他们知道AI模型训练用了太多东西,而法律还没真正跟上这个问题。”
这些问题的核心,往往落在“合理使用”原则上——具体来说,就是对受版权保护作品的使用,是否“变革性”到足以被法律允许。合理使用是版权法的一个例外条款,允许在未经明确许可的情况下使用受版权保护的材料,前提是符合特定条件。
AI训练与版权之间的博弈,远未尘埃落定。这场争论的最终答案,可能要在未来几年由更多判例来书写。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.