返回

文章详情

训练人工智能模型使用受版权保护的书籍合法吗?这很复杂

TechCrunch2026年8月23日 15:00

你可能现在已经知道,推动ChatGPT、Gemini、Claude等聊天机器人的人工智能模型,是基于看似无限的已出版作品数据库进行训练的,这些数据库包含数亿本书、在线文章、学术论文,以及你在互联网上能找到的基本上任何东西。大多数出版作者在不知情或未同意的情况下,参与了开发同样威胁到他们生计的人工智能工具。这似乎是违法的,对吧?然而,现实并没有那么简单。"我认为,这个法律领域及技术领域存在的问题之一就是,它们发生了很多事情,"拥有知识产权、版权和技术专长的律师Cathy Gellis告诉TechCrunch。"这非常复杂,人们对正在发生的事情有很多强烈的情感,无论是支持还是反对。"去年,在一起类似案件的首次裁决中,法官William Alsup裁定Anthropic向一群其作品被用于训练公司人工智能模型的作家支付高达15亿美元的版权和解金。从表面上看,这似乎是一个支持作者的道德胜利,但法官Alsup实际上裁定Anthropic的人工智能训练是合法的。他所罚款Anthropic的是因从非法的在线影子图书馆盗版这些书籍。"像任何希望成为作家的读者一样,Anthropic的LLMs对作品的训练并不是为了迅速复制或取代它们——而是为了拐个弯,创造一些不同的东西,"法官写道,将LLM吸收万亿单词的方式与作家的文学研究进行了比较。Gellis认为这项裁决更有利于人工智能公司。对一家预计到2028年年收入约为2000亿美元的公司来说,15亿美元的罚款算什么?"我认为这对于人工智能训练来说是个好消息,因为他认为发生的事情和阅读版权作品类比,而不是复制版权作品,"Gellis说。"版权法依赖于复制,但并不依赖于使用、体验、消费或阅读该作品。"自1976年以来,版权法没有更新,这意味着法官在面对可能塑造人工智能行业未来的法律问题时,必须考虑50年前的指南。"大家现在都非常担心,因为法律是杂乱无章的,这正是因为这个问题,"JWL国际知识产权与媒体事务部的高级律师和创始人Jason Henderson告诉TechCrunch。"他们知道人工智能模型训练了这么多东西,法律实际上并没有跟上这个问题。"这些问题通常依赖于公平使用法——也就是说,使用受版权保护的作品是否“具备变革性”以被认为是合法的。公平使用是版权法的一项例外,允许在没有明确许可的情况下使用受版权保护的材料,保护通过批评、戏仿、教育和其他方式对受版权作品进行评论和迭代的能力。法官在决定某物是否为公平使用时会考虑特定因素,包括作品的目的和性质、使用的数量以及其对市场的影响。"版权始终是关于保护和发展市场,"Henderson指出。"在AI案件中,法院在推理方面各自的立场不一。[法院对AI案件的推理]未必一致。如果你正在利用他人的资产来直接竞争,法院会对此持反对态度……如果你的行为不涉及竞争,法院则更倾向于找到可以接受的处理方式。"Henderson提到了一个案例,其中媒体和技术公司汤森路透起诉研究公司Ross Intelligence,因其复制内容以建立一个竞争的基于人工智能的法律平台。"Ross的使用并不能被视为变革性,因为它并没有相较于汤森路透有“进一步的目的或不同的特征,"法官Stephanos Bibas去年写道。在那个案例中,Bibas法官认为,利用路透社的内容进行训练以创建一个直接竞争的平台并不构成公平使用。虽然作者可能 argument 聊天机器人使用他们的作品生成新的、合成的书籍是与他们竞争,但这种主张在法庭上尚未占上风。当谈到人工智能与版权之间的关系时,Gellis发现将我们的讨论明确定位是有帮助的——我们想到的版权与人工智能训练之间的关系,与我们对人工智能生成内容的版权理解是相当不同的。在一起案例Thaler诉Perlmutter中,法院裁定如果作品是100%由人工智能生成的,那么它不受版权保护,这引发了许多新的问题——我们如何能确定某个作品是否是通过人工智能生成的,如果是,那么我们又如何知道其中多少比例是由人工智能创造或协助的?"如果你在[微软] Word中写下你的小说

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡