返回

文章详情

法官拒绝谷歌通过DMCA逃避被抓取的尝试

Hacker News2026年7月27日 18:15

来自于提升阶梯部门的消息,去年12月我们指出谷歌因公司抓取谷歌搜索结果而提起了一项DMCA 1201诉讼。诉讼的各个方面似乎存在问题,尤其是谷歌的整个业务是建立在抓取网络之上的。起诉另一家公司抓取谷歌的内容,感觉真的很...令人反感。而现在法官驳回了这项诉讼,尽管留有谷歌重新提起诉讼的余地。一些背景:现在我们已进入人工智能时代,各类数据的获取变得愈发珍贵,这意味着我们看到越来越多的尝试在开放网络的某些部分设立收费站,主要针对AI公司。然而,其余人却在这个过程中被锁在门外。SerpAPI是其中的一家参与者,顾名思义,它基本上试图为搜索引擎结果页面创建一个未经授权的API。去年秋天,Reddit起诉了SerpAPI及其他一些公司(包括搜索AI公司Perplexity),声称由于SerpAPI允许他人(如Perplexity)通过抓取谷歌访问Reddit内容,违反了DMCA的反规避条款(DMCA 1201)。我们发现整个事情是对开放网络原则的攻击。这真的很奇怪。Reddit对用户的帖子没有版权利益(用户持有版权),而SerpAPI是在抓取谷歌,而不是Reddit。Reddit与谷歌有一个API协议,但是被起诉的所有者都不是该协议的当事方。整个事情只是“我们不喜欢这种情况,所以我们起诉。”谷歌的案件几个月后依然类似,聚焦在SerpAPI上。尽管至少在这个案例中(不同于Reddit),它们可以指出SerpAPI是在抓取自己的网站,但声称抓取开放网站会违反1201反规避条款,仍然没有道理,不论你怎样抛出“技术保护措施”来试图阻止抓取。Reddit案件仍在继续推进,被告正在提出驳回动议,但谷歌案件似乎走在了前面,法官已经驳回了投诉,并正确指出谷歌在这里没有合理的版权主张。在SerpAPI尝试多种不同方式终止诉讼时,似乎可以坚持的是谷歌显然在夸大DMCA 1201的运作方式。记住,1201是DMCA的“反规避”部分,最初是为了保护DRM编写的,因此如果人们破坏了DRM(或者甚至讨论如何破坏DRM),他们仍然可能因为绕过“技术保护措施”而承担版权侵权责任。这部广泛且措辞不当的法律在其后果中造成了巨大的混乱,包括明显的滥用,比如一些公司辩称,由于这些设备中实施的脆弱“技术保护措施”,你不能使用第三方打印机墨水或第三方车库门开关,尽管该绕过与版权没有任何关系。法院还审视了其中一个早期案件(关于Lexmark的打印机),但得出结论认为它不适用于此——长话短说,不值得详细讲述,除了值得注意的是,Lexmark面临的相关先例来自商标法,而不是DMCA,即使Lexmark也试图(但失败)使用第1201条。然而,SerpAPI(正确地)也指出谷歌在过度声称“SearchGuard”——即“技术保护措施”——在此处实际保护的内容。正如法庭所解释的,SearchGuard基本上是一种验证码:SearchGuard的工作方式是向谷歌从未被识别的来源收到的搜索查询发送一个JavaScript“挑战”,以确认这些查询是来自真实用户而不是自动化软件。身份不明第29段。谷歌的计算机系统传输JavaScript代码,调用用户的浏览器向谷歌发送一个“解决”挑战的信息,即,向谷歌发送用户生成请求的具体信息。身份不明第29段。对于人工用户,“解决方案”相对简单;他们的浏览器运行JavaScript代码,无缝地将所需的信息返回,而不会打扰用户体验。身份不明第29段。然而,在大规模提交自动查询的自动化系统通常无法解决SearchGuard挑战。身份不明第29段。因此,SearchGuard拒绝他们访问谷歌的搜索结果。但正如SerpAPI所强调的,SearchGuard与版权几乎没有关系。至少这一点引起了法庭的注意:SerpAPI主张谷歌在DMCA下的主张应当被驳回,因为SearchGuard被设计和功能用于控制访问并防止抓取谷歌搜索结果,而不论这些结果是否包含版权成分,而且因为SearchGuard并没有合理地调整以仅控制与可能包含在谷歌搜索结果中的任何版权成分相关的访问。法院的裁决...

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡