关于浏览器自动化,你需要知道的一切
涵盖 Playwright MCP、Browser Use、Chrome DevTools MCP、编程 Agent 及其驱动浏览器的指南、洞察、对比与评测。
对比Browser Use、Stagehand 与 ego (lite):实测三条路线
基于固定的本地任务、原始故障日志、官方文档和明确的 AI 访问限制,比较自主框架、混合 SDK 和编程 Agent 浏览器。
对比Playwright MCP 与 CLI 对比:Token 消耗、安装配置与取舍
Official workflow guidance, fixed-version CLI and MCP runs, a false-success fixture, and a clear boundary around historical token claims.
指南2026 年最佳 Manus 替代品:浏览器自动化工具推荐
Manus 是托管式 Agent,并带有浏览器扩展,所以替代品问题的核心其实是浏览器跑在哪里、登录态放在哪里、你能不能看着它执行。本文给出五条有官方文档依据的路线、每条路线的边界,以及用来筛选的六个问题。
指南用 Playwright 做网页抓取:等待、提取、核对条数
对 JavaScript 渲染页发 GET,可能拿不到人眼看到的卡片。先等待渲染后的 DOM,再提取字段,最后核对条数。
指南Playwright Storage State:Cookie、Local Storage、隔离与过期
storageState 文件是 cookies 与 localStorage 的快照。sessionStorage 默认不在里面。加载到全新 context 后,去读你存过的键,不要只看登录表单刚好消失。
指南Playwright 认证:登录一次、复用状态与重新认证
Playwright 认证失败有三种可辨认的表现,其中两种看起来像别的地方出了 bug:又回到登录页、API 返回 401,或登录后的元素一直不出现。本指南拆开四类根因,用实测过的运行演示登录一次的流程,并覆盖过期检测、自动重新认证、并行账号隔离,以及在依赖会话之前证明它确实还活着的核验步骤。
指南网页抓取分页:数字翻页、加载更多与无限滚动
分页代码会以三种不同方式失败,因为它本来就是三个问题。本指南会说明如何从页面识别模式,为数字页推导 URL 规则和终止条件,给加载更多和无限滚动写对等待,把抓取状态记下来以免崩溃毁掉整次运行,再用条数和字段检查验证结果。文中每一个实测数字,都来自受控的本地夹具:135 条数字页、81 条加载更多、60 条信息流。
指南Claude Code MCP 配置与 Playwright 修复
一份按 scope 逐项讲解的 Claude Code MCP 配置教程,基于官方文档整理,并重点覆盖最关键的 Playwright 修复方法:Windows 上的 npx/cmd stdio、待审批状态,以及工具缺失。
指南用 JavaScript 做网页抓取:静态 HTML 与渲染页面
大多数 JavaScript 爬虫在开始解析之前就已经失败,原因往往是请求走错了路线。先根据目标确定访问路线,再决定用什么工具。