--:--
今日 PV 0
独立 IP 0
在线 0
今日实时08/11LIVE
0今日访问
真人访问050%
搜索蜘蛛050%
当前在线0now
0PV 浏览量
0独立 IP
0蜘蛛抓取
24 小时访问趋势暂无数据
小伍的游乐场大数据

谷歌起诉 SerpApi 被驳回,看看美国的爬虫官司

燎原爬虫阅读 3留言 0

一直在关注 Google 起诉 SerpApi 采集 Google 搜索结果的官司。这是一个影响范围很大的官司,如果 Google 胜诉,Google 搜索结果不能再被采集,从 SEO 、生成式 AI 、GEO 这些行业会遭受毁灭性的打击。说说事情起因,SerpApi 是第三方数据服务商,主要业务就是提供搜索引擎的搜索结果,给大模型公司的,因为生成式AI需要规模庞大的搜索结果做 RAG。现在的 GEO 也需要 SERP。Google 在 2025 年初部署了名为 SearchGuard 的反爬虫防护机制,用来拦截未识别的自动化请求。SerpApi 通过代理IP、浏览器指纹伪造、动态 IP 轮换和 CAPTCHA 自动化破解等手段绕过了 SearchGuard,搜索请求量在两年内激增 25,000%,达到每天数亿次。去年 12 月,Google 向美国加州北区联邦地区法院正式向 SerpApi 提起诉讼。Google 的核心指控是:  
 规避传统的“服务条款(ToS)违约”,直接引用美国《数字千年版权法》(DMCA)第 1201 条(禁止规避技术保护措施及交易规避工具)。主要罪状:指控 SerpApi 采用“寄生型商业模式”,伪造浏览器属性和 IP 伪装成正常用户提交“假搜索”,绕过 SearchGuard。声称搜索结果页(SERP)以及知识图谱、精选摘要中包含受版权保护的内容,SerpApi 擅自抓取并转售获利。诉讼请求: 申请永久禁令阻止 SerpApi 运营,要求法院下令销毁其核心抓取技术。今年7月终于出结果了,Google的诉讼请求被驳回了。法官驳回的依据是:
Google搜索结果不受 DMCA 保护: 法官指出,纯文本搜索结果、URL 和汇总数据属于公开事实数据,不构成《版权法》保护的作品。Google 不能以 DMCA 为由禁止爬取无版权的搜索结果。第三方版权主体问题: 对于知识图谱中的第三方授权内容,Google 并非版权所有者;若要引用 DMCA 防护,Google 必须证明这些第三方版权所有者明确授权了 Google 部署 SearchGuard 代其保护。Google 未能在此前诉状中提供此类授权证明。裁决结果: 法院驳回了搜索数据的版权主张(还不可重诉);法院然后给予 Google 21 天时间修改诉状,要求补充第三方版权授权证据。这个事情,每隔一阵我就会关注一下进展,我很想知道这种绕过反爬限制采集数据有没有刑事问题,在美国是没有的。我看了最近两年几个美国关于数据采集方面的官司。像 Facebook 和 推特起诉 BrightData 采集他们的数据,Facebook 和 推特也都是败诉的。得出的结论是:未登录 + 公开数据,是可以采集的。核心是是否采集的公开数据,焦点不在你是否有绕过反爬措施。这个在国内是不可想象的。

留言

NO REGISTRATION · 临时网名 + 邮箱即可开聊

无需注册 · 邮箱仅用于回复通知,绝不公开 · 广告与机器人会被蜜罐直接吞掉

谷歌起诉 SerpApi 被驳回,看看美国的爬虫官司 | 小伍的游乐场