2026年7月20日,北加州聯邦地區法院做了一個對整個開放網路都意義重大的裁決——全面駁回 Google 對爬蟲公司 SerpApi 的 DMCA 訴訟。這是近年來平臺嘗試用版權法打壓網頁爬蟲的最大敗仗之一。

簡單說:Google 開發了一套反爬蟲系統 SearchGuard,然後告訴法院「別人繞過它去抓搜尋結果,就是侵犯 DMCA 版權」。法官聽完笑了——SearchGuard 防的是爬蟲,不是版權;而且你抓到的東西根本不受版權保護。

這個案子不只是 SerpApi 的勝利,更是對「公開網路重新圈地」趨勢的一次重要攔截。

- 廣告 -

Google 為什麼選擇 DMCA?

要理解這場戰爭,得先搞清楚平臺在訴訟策略上的困境演變。

2022年第九巡迴上訴法院在 hiQ v. LinkedIn 案中確立了一個對爬蟲友善的先例:爬取公開網頁不違反 CFAA(電腦詐欺與濫用法)。這讓 Google 的訴訟工具箱少了一把利器。版權侵權?搜尋結果主要是事實性內容,通常屬於第三方。違約之訴?州法契約爭議,執行力弱、補償有限。

DMCA §1201 成了最佳選擇。它是聯邦法,有法定損害賠償,而且不需要證明特定作品的侵權——只要證明別人「繞過技術保護措施」就行。

Google 的戰略很明確:把反爬蟲系統重新定義為 DMCA 意義下的「版權存取控制措施」。若成功,任何網站的反爬蟲機制都能成為聯邦版權法下的鎖,爬蟲等於破鎖。這將徹底改變網路的開放性。

SearchGuard 到底是什麼?

事情從 2025年1月說起。Google 在那時開發並部署了 SearchGuard——一套基於 JavaScript Challenge 的反爬蟲系統。它的運作方式不複雜:當瀏覽器或爬蟲存取 Google 搜尋結果時,SearchGuard 會要求執行一段 JS 程式碼來驗證「你是真人」。沒透過的請求會被擋下。

同年9月,Google 開始收緊手腳。它取消了長期支援的 num=100 SERP 引數(一次回傳一百筆結果),SEO 工具的成本暴增十倍。月底更限制 SerpApi 的 Light Fast API 僅回傳前三筆結果,DataForSEO 甚至連八零%成本的方案都在五天內被識別並封殺。

SerpApi 當時已經在 Google 搜尋結果上運作多年,它的商業模式就是幫開發者繞過 SearchGuard,把結構化的搜尋資料透過 API 賣出去。客戶包括 Nvidia、Uber、Adobe 等科技巨頭。SearchGuard 一收緊,SerpApi 的營運成本直接暴漲。

法院的「兩個桶子」裁決邏輯

法官 Yvonne Gonzalez Rogers 在裁決中做了一個很巧妙的分類——她把 Google 的訴訟分為兩個層面處理。

第一個桶子是「不含版權內容的搜尋結果」。這部分包含一般文字搜尋結果、摘要資訊等公開資料。法院認為這些是公開資訊的彙整,本身不受版權法保護。SearchGuard 防的是存取行為,但它防的不是某個特定版權作品。所以 DMCA §1201 在這裡不適用——永久駁回,不可再訴

第二個桶子是「含授權圖片的知識面板」(Knowledge Panels)。知識面板中可能包含 Google 取得授權的第三方圖片。但問題在於:Google 不是這些圖片的版權所有人。DMCA 要求保護措施必須「經版權所有者授權」運作,而 Google 只是主張顯示授權就隱含了控制權,法院不採納這套說法——駁回但可以修正起訴狀

這個分類的好處在於,第一個桶子的裁決具有先例重量(precedential weight),在該法院永久生效。以後北加州的法官遇到類似案件,都可以直接參考這個邏輯。

五大關鍵法律論點

SerpApi 在這場官司中打得很漂亮,核心論點集中在五個方向。

SearchGuard 是版權保護措施嗎?SerpApi 給了一個很直白的名字——「SearchGuard, not CopyrightGuard」。法院採納了這個說法:SearchGuard 的主要功能是管理自動化存取,不是保護特定版權作品。

Google 有訴訟資格嗎?搜尋結果的版權大部分屬於第三方(新聞媒體、內容農場等),Google 能不能代表他們主張 DMCA?法院部分接受——DMCA 的利益範圍不限於版權所有人,但 Google 仍需證明授權關係。這一點在知識面板案中成為關鍵弱點。

爬蟲行為等於「迴避」嗎?SerpApi 的論點是:它沒有解密、解碼或破壞任何技術措施,讀取的只是公開可見的內容。法院認為 SearchGuard 的 JS Challenge 確實構成某種形式的「迴避」,但這個迴避作用的物件是非版權內容——所以還是沒觸及 DMCA §1201。

hiQ v. LinkedIn 先例呢?方向一致。第九巡迴上訴法院已確立爬取公開網頁不違反 CFAA,DMCA 同理。Lexmark 先例(第六巡迴)更妙:後門上的鎖控制不了前門大開的房子——SearchGuard 是「後門」,搜尋結果的「前門」對所有人開放。

- 廣告 -

Reddit 案的平行戰線

同一時期,Reddit 在紐約南區聯邦法院也對 SerpApi 提起了類似訴訟。這個案子有些微妙的不同。

Reddit 的主張是:SerpApi 爬 Google 搜尋結果時,間接取得了出現在其中的 Reddit 使用者生成內容,等於繞過了 Reddit 自身的 bot-detection 技術。Reddit 甚至在 Google 索引中植入了「陷阱貼文」(Trap Post)——不可見使用者的假貼文——然後證明 Perplexity 確實透過 Google 取得了這些資料。

但 SerpApi 在 Reddit 案中同樣有五大弱點可以攻擊:Reddit 不擁有內容(使用者保留版權,Reddit 只有非專屬授權)、爬的是 Google 不是 Reddit 本身、從搜尋結果間接取得資料不等於繞過 Reddit 的技術保護、聲稱的商譽損失均為推測性、hiQ 先例同樣適用。

更重要的是,Google 案的裁決對 Reddit 案有直接的負面影響——同一個 DMCA 理論、北加州法院已明確拒絕,Reddit 在紐約南區的前景堪憂。SerpApi 已經提交了「不可再訴」的撤銷動議(with prejudice)。

API 末日與公開網路的重新圈地

把視野拉大一點會看到一個更大的趨勢:自 2023年夏天以來,出版商和平臺正在大規模關閉對爬蟲的存取。

Cloudflare Bot Management 被廣泛部署,Medium、New York Times 等主流媒體加上了付費牆與 bot-detection,Reddit 在2023年底改革 API 定價導致第三方 App 集體崩潰。法律專家 Meredith Rose(Public Knowledge)形容這是「公開網路的重新圈地」(re-enclosure of the open web)。

影響不僅限於 AI 訓練。研究、檔案儲存、新聞報導、公共衛生資訊——所有依賴大規模匿名爬蟲的工作都受到波及。SerpApi 案若敗訴,整個 SEO/搜尋資料產業將面臨 DMCA 法定損害賠償(每筆查詢 $200-$2,500),理論上可達兆美元級。

Google 的雙重標準

這個案子最有趣的一點是 Google 自身的矛盾。

Google 靠爬取整個公開網路建立了搜尋引擎——未經任何網站授權。現在卻主張 SerpApi 爬取 Google 搜尋結果等於 DMCA 侵權。SerpApi 的反擊很直接:「Google 是地球上最大的爬蟲。」

這不是口號。Google 的爬蟲每天處理數以億計的網頁,從各種網站抓取內容來訓練搜尋索引和 AI 模型。它對別人開放自己的前門,然後在後門裝 SearchGuard——法院的邏輯很清楚:在大門敞開的房子後門裝個偵測器,不等於那房子裡的東西變成了你的版權財產。

AI 資料授權市場的爆發

這個裁決發生的背景還有一場正在升溫的市場戰。2025年以來,AI 公司與內容平臺的授權協議價格飆升——Reddit 與 Google、OpenAI 的授權協議合計達數億美元,Perplexity AI 的融資估值從140億暴漲到180億美元。

「取得方式」(acquisition method)正變得與「使用方式」(use)同等重要。SerpApi 這種公司夾在中間,既要控制成本又要確保資料來源合法。它的 CEO Julien Khaleghy 從起訴第一天就公開辯護,建立「為開放網路而戰」的品牌形象——客戶包括 Nvidia、Uber、Adobe 等科技巨頭,這些公司的利益與 SerpApi 高度一致。

Google 還有什麼路可走?

裁決給 Google 留了一條縫:知識面板中的版權圖片部分還可以修正起訴狀,21天內重新主張。最可能的情境是 Google 補充授權事實後讓這個子案繼續,但範圍會大幅縮小。DMCA §1201 對一般搜尋爬蟲的限制理論基本確立。

Reddit 案在紐約南區被駁回的機率中等偏高——參考 Google 案先例,SerpApi、Perplexity 等可能獲全面勝利。

案件上訴至第九巡迴或最高法院的機率中等偏低。但一旦發生,將成為定義網路爬蟲法的終極判例。

對各方的實際建議

對 SEO 和行銷人員:審視所用工具的資料來源,確認爬蟲方法是否符合 DMCA 標準。很多工具可能正在邊緣地帶運作。

對 AI 公司:建立訓練資料的「來源證明」(data provenance)檔案;區分哪些是爬取的、哪些是授權取得的。在監管趨嚴的環境中,資料來歷和資料內容同等重要。

對平臺營運者:若依賴 DMCA §1201 保護爬蟲,需明確主張特定版權作品及其授權關係。光有反爬蟲系統不夠,還得證明它控制的是版權內容。

對開發者和研究者:公開可見資料的爬取仍受保護。但要避免大量複製 copyrighted content——DMCA §1201 只是第一道防線,版權、合約、隱私法仍在。

DMCA §1201 對網頁爬蟲的保護邊界

最後用一個簡單的公式收斂:

技術保護措施 + 受版權保護的作品 + 版權所有人授權 = DMCA §1201 適用

加密 DVD、軟體 DRM、有密碼鎖定的內容——這些明確受保護。JavaScript Challenge / CAPTCHA 是灰色地帶,需證明控制的是「版權作品」。公開可見的搜尋結果、無版權的事實資料、前門大開的網站——不受 DMCA §1201 保護。

這個案子本質上是在回答一個問題:誰有權鎖住公開資訊?法院的答案很明確——在大門敞開的房子後門裝個偵測器,不等於那房子裡的東西變成了你的版權財產。

爬蟲從此無往不利嗎?不是。版權、合約、隱私法仍適用。但至少「反爬蟲 = 破 DMCA」這個最危險的理論,在關鍵節點被擋下了。


參考來源:

  1. Ars Technica — Google Won’t Give Up Its Odd War Against AI Web Scraping Despite Court Loss (2026/07/27)
  2. SerpApi Blog — Google v. SerpApi: We’re filing a Motion to Dismiss (2026/02/20)
  3. ScrapeBadger — Google Sued a Scraper Under Copyright Law and Lost (2026/07/22)
  4. PPC Land — Google loses DMCA bid to treat search scraping like DVD piracy (2026/07/21)
  5. Search Engine Journal — Court Dismisses Google’s DMCA Claims Against SerpApi (2026/07/21)
  6. ALM Corp — Reddit v. SerpApi: Web Scraping Lawsuit, DMCA & What’s at Stake (2026/03/14)
  7. 法院判決書 PDF — Google v. SerpApi, Order Granting Motion to Dismiss (2026/07/20)