Hacker News 中文摘要

RSS订阅

法官驳回谷歌利用DMCA规避数据抓取的企图 -- Judge Rejects Google's Attempt to DMCA Its Way Out of Being Scraped

文章摘要

法官驳回谷歌试图利用《数字千年版权法》逃避被数据抓取的诉讼,指出谷歌自身靠抓取网络起家,起诉他人抓取显得荒谬。

文章总结

一名美国法官驳回了谷歌依据《数字千年版权法》(DMCA)第1201条提起的诉讼,该诉讼指控SerpAPI公司通过抓取其搜索结果侵犯了版权。法官指出,谷歌的“SearchGuard”技术保护措施(类似验证码)主要用于阻止自动化抓取,而非专门保护受版权保护的内容,因此不适用于DMCA的反规避条款。谷歌的搜索结果多为公开信息的汇编,仅偶尔包含第三方授权的版权内容(如知识面板),且谷歌未能证明其有权代表版权所有者实施该保护措施。尽管谷歌可能针对特定版权内容重新起诉,但法官的裁决强调了开放互联网原则,批评谷歌自身靠抓取网络起家,却起诉他人抓取其数据,是“过河拆桥”的行为。SerpAPI对此表示欢迎,认为这维护了公共信息的开放访问权。

评论总结

根据评论内容,主要观点和论据总结如下:

1. 对谷歌虚伪行为的批评(评分:None) - 评论1:Hypocrisy-rich.(虚伪至极。) - 评论2:引用“You are trying to kidnap what I have rightfully stolen, and I think it quite ungentlemanly.”(“你想绑架我合法偷来的东西,我觉得这很不绅士。”)

2. 对搜索结果可抓取性的支持(评分:None) - 评论4:询问是否意味着可以合法抓取谷歌搜索结果。 - 评论5:强调SERP可抓取的重要性,因为能揭露广告诈骗(如ETA/ESTA网站)。 - 评论6:批评谷歌废弃搜索API,导致只能依赖第三方抓取。

3. 对谷歌AI摘要内容使用的质疑(评分:None) - 评论8:质疑谷歌是否建立了让内容创作者获得报酬的系统。

4. 对裁决双重影响的担忧(评分:None) - 评论9:认为裁决虽好,但强化了谷歌自身抓取的合法性,谷歌“输了但赢了”。 - 评论10:指出搜索引擎被视为公共索引,数据不受版权保护,可能影响AI模型权重版权。

5. 对法律差异的讨论(评分:None) - 评论12:对比欧盟数据库保护(需实质性投资)与美国版权法(需原创性),认为PageRank应受版权保护。

6. 对谷歌诉讼策略的批评(评分:None) - 评论13:认为谷歌利用资源起诉小公司,即使败诉也不受“败诉方付费”规则约束。

平衡性总结:评论呈现对立观点——一方支持抓取谷歌搜索结果(认为其公开且必要),另一方质疑谷歌虚伪(自身抓取却起诉他人),并担忧裁决可能巩固谷歌垄断。法律层面,欧盟与美国对数据保护标准不同,引发对AI模型版权影响的思考。