AI训练版权作品的法律困局
「AI大模型训练使用版权书籍是否合法?美国法院首次做出相关裁决,认定Anthropic训练行为合法但因盗版书籍被罚15亿美元。版权法五十年未更新,合理使用原则成为争论焦点,法律体系尚未跟上AI技术发展步伐。」
当人们询问AI模型如何使用数百亿本图书进行训练时,答案并非简单的合法或非法。近期一项具有里程碑意义的法院裁决揭示了这个问题的复杂性:一位法官同时认定AI训练行为本身合法,却对获取训练数据的方式开出了巨额罚单。
美国地区法官William Alsup裁定Anthropic需向一群作家支付15亿美元的版权和解金,这些作家声称其作品被用于训练AI模型。表面上看,这似乎是作者群体的胜利,但法院实际上认定Anthropic的AI训练行为是合法的。法官所惩罚的,是该公司从非法在线影子图书馆获取受版权保护书籍的行为,而非训练行为本身。
“像任何渴望成为作家的读者一样,Anthropic的大语言模型基于作品进行训练,不是为了赶超或取代它们,而是为了转过一个艰难的拐角,创造出不同的东西。”法官在裁决中写道,将大语言模型消化数万亿单词的过程比作作家对文学的研究。这一类比反映了技术界与法律界对AI本质理解的深刻分歧。
知识产权与科技领域资深律师Cathy Gellis认为这一裁决对AI公司更为有利。她指出:“这总体来说对AI训练是个好消息,因为他看到的情况类似于阅读受版权保护的作品,而非复制受版权保护的作品。版权法约束的是复制,但不约束使用、体验、消费或阅读作品。”
事件的背景是美国版权法自1976年以来从未更新。这意味着法官们必须尝试用五十年前的指导方针来应对可能塑造AI产业未来的法律问题。科技律师Jason Henderson警告说:“现在每个人都非常担忧,因为法律体系到处都存在漏洞,原因就在这个问题上。他们知道AI模型已经在海量数据上训练过,而法律并未真正跟上这个问题。”
这些争议的核心常常落在合理使用原则之上。合理使用是版权法的一个例外条款,允许在未经明确许可的情况下使用受版权保护的材料,以保护人们对作品进行评论和迭代创作的能力。问题的关键往往在于这种使用是否具有足够的“转化性”——即是否在原有作品基础上创造了新的、不同的东西。
在AI语境下,大语言模型对文本的吸收与生成是否构成“转化性使用”,成为诉讼双方争论的焦点。AI公司主张训练过程中的统计分析与传统意义上的复制有本质区别,而作者群体则认为大规模扫描和使用其作品未经授权,严重损害了他们的权益。
这场法律博弈的结果将深刻影响全球AI产业的发展路径。一方面,过于宽松的判决可能削弱创作者的积极性;另一方面,过于严格的限制可能遏制技术创新。目前,这一领域的法律实践仍处于早期阶段,不同法院有可能得出截然不同的结论。
对于AI行业而言,这一裁决传递了重要信号:合法的AI训练方式本身受到保护,但获取训练数据的手段必须符合现有法律要求。这意味着AI公司需要重新审视其数据采集流程,确保训练语料的合法性,以避免陷入类似的法律纠纷中。
随着更多案件进入司法程序,这些判例将逐步勾勒出AI版权法的轮廓,为技术开发者和内容创作者提供更清晰的指引。在此之前,AI训练所涉及的法律边界仍然充满不确定性,所有参与者都在等待更明确的法律规范出台。
来源:Heooo AI工具导航