🌐 English 即时比分

用受版权保护的书籍训练AI模型合法吗?情况很复杂

人工智能 来源: TechCrunch 发布时间: 热度: 👍
用受版权保护的书籍训练AI模型合法吗?情况很复杂
🤖
🤖

核心导读

AI公司未经作者许可,使用海量受版权保护的书籍训练模型,是否合法?美国法院的初步裁决显示,情况远比想象中复杂:Anthropic因盗版书籍需支付巨额罚款,但训练本身被认定为合法;汤森路透诉Ross案则强调直接竞争性使用不属合理使用。核心争议在于版权法“公平使用”原则的解读,而法律自1976年未更新,导致各地裁判不一。AI生成的版权归属、以及未来诉讼走向,仍是悬而未决的问题。

你现在大概已经知道,驱动ChatGPT、Gemini、Claude及其他聊天机器人的AI模型,是在看似无穷无尽的已出版作品数据库上训练的,这些数据库包含数亿本书籍、在线文章、学术论文,以及基本上你在互联网上能找到的任何内容。绝大多数已出版作者,在不知情或未同意的情况下,为那些威胁其生计的AI工具的发展做出了贡献。这看起来似乎是违法的,对吧? 现实并非如此简单。 “我认为,在这一整个法律领域和这一整个技术领域里,问题之一在于涉及的因素太多,”拥有知识产权、版权和技术方面专业知识的律师凯茜·盖利斯告诉TechCrunch,“情况非常复杂,而且人们对正在发生的事情有着大量强烈的感受,无论是支持还是反对。” 去年,在同类首批裁决之一中,法官威廉·阿尔苏普责令Anthropic向一群作品被用于训练该公司AI模型的作家支付高达15亿美元的版权赔偿金。从表面上看,这似乎是支持作者的道德胜利,但阿尔苏普法官实际上裁定,Anthropic的AI训练是合法的。阿尔苏普对Anthropic的处罚,是因为该公司从非法的网络影子图书馆盗版了这些书籍。 “像任何渴望成为作家的读者一样,Anthropic的大语言模型训练所依据的作品,不是为了抢先复制或取代它们——而是为了转过一个艰难的弯,去创造不同的东西,”法官写道,将大语言模型吸收数万亿词汇的方式比作作家对文学的研究。 盖利斯认为,这项裁决对AI公司更为有利。对于一家预计到2028年年收入约2000亿美元的公司来说,15亿美元的罚款又算得了什么? “我认为,对于AI训练来说,他审视了正在发生的事情,并真正将其视为类似于阅读受版权保护的作品,而非复制受版权保护的作品,这总体上是个好消息,”盖利斯说,“版权法的基础是复制,而不是使用作品、体验作品、消费作品或阅读作品。” 版权法自1976年以来从未更新过,这意味着法官在面对可能塑造AI行业未来的法律问题时,必须设法解释50年前的指导方针。 “现在每个人都非常担忧,因为法律众说纷纭,而正是因为这个问题,”JWL国际知识产权与媒体业务高级律师兼创始人贾森·亨德森告诉TechCrunch,“他们知道AI模型已经在海量内容上训练过,而法律并没有真正跟上这个问题。” 这些问题往往取决于合理使用法——即对受版权保护作品的使用是否具有足够的‘变革性’,从而被认为是法律上允许的。 合理使用是版权法的一个例外,允许在未经明确许可的情况下使用受版权保护的材料,通过批评、模仿、教育和其他方式保护对受版权保护作品进行评论和迭代的能力。法官在决定某行为是否属于合理使用时,会考虑具体因素,包括作品使用的目的和性质、使用量及其对市场的影响。 “版权总是关于保护和扩大市场,”亨德森指出,“法院在(AI案件的)推理上有点各说各话。如果某人使用他人的财产进行训练,目的是直接竞争,那么法院往往会反对……如果你所做的事情不会构成竞争,那么法院往往会设法认为这是可以的。” 亨德森提到的案件是,媒体科技公司汤森路透起诉研究公司Ross Intelligence复制其内容,以构建一个具有竞争性的基于AI的法律平台。 “Ross的使用不具有变革性,因为它没有汤森路透所具有的‘进一步目的或不同性质’,”法官斯特凡诺斯·比巴斯去年写道。 在该案中,比巴斯法官裁定,利用路透的内容训练一个直接与之竞争的新平台并不属于合理使用。虽然作者们可能主张聊天机器人通过使用其作品生成新的、合成书籍来与他们竞争,但这一论点尚未在法庭上获胜。 当涉及到AI与版权的关系时,盖利斯认为,缩小我们真正讨论的范围是有帮助的——我们对AI训练中版权的思考方式,与我们看待AI生成内容版权的方式截然不同。 在Thaler诉Perlmutter一案中,法院裁定,如果一件作品100%由AI生成,则不受版权保护,这引发了一系列全新的问题——我们如何确切证明一件作品是否由AI生成?如果是,我们如何知道其中有多少百分比是由AI创作或辅助的? “如果你在(微软)Word里写小说并运行拼写检查,我们大体上能接受‘Word不拥有你的小说’这种说法,”盖利斯说,“(AI)正迫使我们审视一大堆我们一度忽视的决定。” 大多数AI公司目前仍深陷于这些问题的未决诉讼中,这意味着我们短期内不会得到这些问题的明确解决方案。 “你现在看到的是,最初的开场交锋正在产生影响力,而如果其他法院做出不同的裁决,这种影响力本身可能会被推翻,并且需要后续的诉讼阶段来弄清楚哪一个会胜出,”盖利斯说,“但与此同时,所有这些裁决都在塑造正在发生的一切。如果AI公司忽视它们,那将是愚蠢的。”
分享这篇文章: