瀏覽器自動化必須知道的事
涵蓋 Playwright MCP、Browser Use、Chrome DevTools MCP、程式開發 Agent 與其操作瀏覽器的指南、洞察、比較與評測。
指南用 Playwright 抓網頁:等候、擷取、核對筆數
對 JavaScript 渲染頁做 GET,可能拿不到人眼看到的卡片。先等候渲染後的 DOM,再擷取欄位,最後核對筆數。
指南Playwright Storage State:Cookie、Local Storage、隔離與過期
storageState 檔是 cookies 與 localStorage 的快照。sessionStorage 預設不在裡面。載入全新 context 後,去讀你存過的鍵,不要只看登入表單剛好消失。
指南Playwright 驗證實戰:登入一次、重用狀態與重新驗證
Playwright 驗證失敗有三種可辨認的表現,其中兩種看起來像別處出了 bug:又回到登入頁、API 回傳 401,或登入後的元素一直不出現。本指南拆開四類根因,用實際量測過的執行示範登入一次的流程,並涵蓋過期偵測、自動重新驗證、並行帳號隔離,以及在依賴工作階段之前證明它確實還活著的核對步驟。
指南網頁爬蟲分頁處理:編號頁、載入更多與無限捲動
分頁程式會以三種不同方式失敗,因為它本來就是三個問題。本指南會說明如何從頁面辨識模式、為編號頁推導 URL 規則與終止條件、正確等待載入更多與無限捲動、把抓取狀態記下來以免當機毀掉整次執行,再用筆數與欄位檢查驗證結果。文中每一個實測數字,都來自受控的本機夾具:135 筆編號頁、81 筆載入更多、60 筆資訊流。
指南JavaScript 網頁抓取:靜態 HTML 與渲染頁面
多數 JavaScript 爬蟲在開始解析前就失敗了,原因是請求走錯了路線。先決定存取路線,再挑工具。
比較大規模網頁抓取的 Apify 替代方案
到了百萬頁的規模,平台費用已經不是重點。真正決定你實際付多少的是 Proxy 流量、並行上限與重試計費;這也決定了哪一款 Apify 替代方案適合你。
比較AI Agent 沙盒瀏覽器自動化:本地與遠端執行完整比較
從隔離層、登入狀態歸屬、人工接管、並行執行、重播、混合路由到驗證方法,整理一套可落地的沙盒瀏覽器架構判斷方式。
比較MCP、CLI 與瀏覽器擴充功能:Agent 控制方式該怎麼選
用同一項任務的實測結果,說清楚 MCP、CLI 與瀏覽器擴充功能各自所在的層級,以及安全模型、混合架構與適用情境。
洞察WebMCP 怎麼改變瀏覽器自動化:能做什麼,又不能取代什麼
WebMCP 讓網站把結構化工具提供給瀏覽器中的 AI Agent。我們用 Chrome 152 實測官方飯店範例,檢查哪些環節確實可用、使用者在哪一步仍握有主控權,以及為何應用程式端的驗證依然不能省。