开发与工程 browser-automationclichromiumrustmcpaccessibilityweb-vitals

Agent Browser:面向 AI 代理的浏览器自动化 CLI

为 AI 代理打造的高性能 Rust 浏览器自动化命令行工具,提供快照、点击、填写、截图等能力。

FollowAgents 评估 · FARS-2.1
不推荐
54/ 100 五分制 2.7 / 5
1 2 3 4 5 6
1信任安全10 / 29 · 1.7/5

证据显示:CLI 提供多种命令,但未明确权限最小化设计;有用户确认机制(如对话框处理),但未全面覆盖;数据流透明度有限,未详细说明数据收集;敏感数据处理(如 cookies、credentials)有命令,但未说明安全存储;依赖安全未明确;外部影响(如网络请求、文件写入)有命令,但未限制;回滚机制未提及;来源归属明确(Vercel Labs),但未验证。扣分:缺乏权限最小化、用户确认、数据流透明、敏感数据安全、依赖安全、外部影响控制、回滚机制的具体证据。

2可靠稳定9 / 14 · 3.2/5

证据显示:命令文档一致,但未验证实际行为;依赖(Chrome)有安装说明,但未验证可用性;失败消息有提及(如点击失败),但未全面。扣分:未执行测试,无法验证一致性、依赖可用性和失败消息的准确性。

3适用触发12 / 18 · 3.3/5

证据显示:面向 AI 代理和开发者,场景广泛;能力边界有说明(如 read 不读 llms-full.txt);触发精度有说明(如 refs);环境适配有说明(如 Linux 依赖)。扣分:未验证实际适配性,部分边界未明确。

4规范维护11 / 18 · 3.1/5

证据显示:信息架构清晰(README 详细);安装说明完整;命名稳定(命令一致);示例丰富;已知限制部分提及(如 read 不读 llms-full.txt);许可证明确(Apache-2.0);版本和变更日志有(CHANGELOG.md);维护责任明确(Vercel Labs)。扣分:已知限制不全面,未提及所有限制。

5有效结果9 / 13 · 3.5/5

证据显示:输出可用(如 snapshot、screenshot);边际价值高(提供多种功能);成本效益合理(免费开源)。扣分:未验证实际输出质量,成本效益未量化。

6证据核验3 / 8 · 1.9/5

证据显示:README 中的声明有部分支持(如命令列表),但未提供测试结果;跨来源验证有限(仅 README 和 CI);事实与推断未明确区分。扣分:缺乏测试证据,声明未充分验证。

证据充分度: 评估于 2026年8月9日 审查版本 acbc22bdc5d4
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
使用前请注意
  • 未验证的发布者身份,需谨慎对待。
  • 静态审查,未执行测试,实际行为未验证。
  • 敏感数据处理(如 cookies、credentials)未说明安全存储,需注意。
  • 依赖安全未明确,需检查依赖漏洞。
评估证据 [1][2][3][4][5]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

Agent Browser 是 Vercel Labs 开发的原生 Rust CLI,专为 AI 代理设计,用于浏览器自动化。它通过后台守护进程保持浏览器会话,提供稳定的元素引用(ref)系统,使 AI 能够基于可访问性树快照进行确定性交互。除核心操作外,还支持网络拦截、HAR 录制、Cookie 管理、会话持久化、React 内省、Web Vitals 指标、可访问性审计以及 MCP 服务器集成。它支持无头模式,并可通过 Chrome for Testing 自动下载 Chrome。

agent-browser CLI 提供了一套完整的浏览器自动化命令:opensnapshotclickfill 等。它通过 CDP 连接 Chrome 或 Lightpanda 引擎,使用后台守护进程保持会话。快照命令返回带 ref 的可访问性树(如 @e1),AI 可用这些 ref 进行交互。它支持 CSS、XPath 和语义定位器(如 find role button)。可提取页面文本(read)、运行 JavaScript(eval)、管理 cookie 和存储、记录网络请求和 HAR 文件。还包括 React 组件树检查(需 --enable react-devtools)和 Web Vitals 性能指标。它提供 MCP 服务器(agent-browser mcp)供客户端通过 stdio 调用。安全功能包括域白名单、内容边界标记、动作策略和动作确认。

  1. 需要可重复、确定性浏览器交互的 AI 代理,例如自动化测试或数据抓取。
  2. 开发者希望利用现有 Chrome 登录状态(通过 profile 复用)自动执行需要认证的流程。
  3. QA 工程师用快照和 ref 进行可访问性审计(使用内置 axe-core)和视觉回归(diff 截图)。
  4. 前端开发者使用 React DevTools 集成检查组件树、suspense 状态和 Web Vitals。
  5. AI 编程助手需要浏览器访问来验证开发的 UI、填充表单或检查页面状态。
  6. 希望与其 AI 工作流集成浏览器的 MCP 用户,通过标准 MCP 协议。

这个 Agent 有哪些优点和局限?

优点
  • Rust 编写的原生 CLI,速度快,后台守护进程支持命令链式执行。
  • ref 系统提供确定性选择,避免 CSS 选择器在动态页面中的脆弱性。
  • 内置 Chrome 下载(Chrome for Testing),无需单独安装浏览器。
  • 提供 MCP 服务器,可无缝集成到支持 MCP 的 AI 工具。
  • 包含安全功能:域白名单、动作确认、内容边界标记。
局限
  • 核心功能依赖 Chrome(或 Lightpanda),Safari/iOS 支持有限。
  • 高级功能(React 内省、WebGPU)可能需要特定启动参数或配置。
  • 从源码构建需要 Node.js 24+、pnpm 11+ 和 Rust,对某些用户门槛较高。
  • AI 聊天功能依赖 Vercel AI Gateway,需要 API 密钥。
  • 文档非常庞大,新用户可能感到信息过载。

如何安装或部署这个 Agent?

推荐全局安装:npm install -g agent-browser,然后运行 agent-browser install 下载 Chrome(来自 Chrome for Testing)。也支持 Homebrew:brew install agent-browser;Cargo:cargo install agent-browser。从源代码构建需要 Node.js 24+、pnpm 11+ 和 Rust:克隆仓库后运行 pnpm install && pnpm build && pnpm build:native && pnpm link --global,最后 agent-browser install。Linux 用户可能需要 agent-browser install --with-deps 来安装系统库。

如何使用这个 Agent?

首先安装 Chrome:agent-browser install。然后打开页面并获取快照:agent-browser open example.comagent-browser snapshot -i。使用快照中的 ref 执行操作:agent-browser click @e2agent-browser fill @e3 "text"。获取文本:agent-browser get text @e1。截图:agent-browser screenshot page.png。关闭:agent-browser close。也可以使用传统 CSS 选择器:agent-browser click "#submit"。MCP 使用:配置客户端启动 agent-browser mcp

这个 Agent 与同类方案有什么区别?

与 Playwright 或 Puppeteer 相比,agent-browser 专为 AI 代理设计,提供基于 ref 的快照系统、后台守护进程和 MCP 集成,而 Playwright/Puppeteer 是更通用的库,需要更多编程工作。

常见问题

它需要单独的浏览器吗?
需要。首次运行 agent-browser install 会从 Chrome for Testing 下载 Chrome。也可以自动检测并使用现有的 Chrome、Brave、Playwright 或 Puppeteer 安装。
它如何处理登录状态?
支持多种方式:Chrome 配置文件复用(--profile)、持久配置文件(--profile <path>)、会话持久化(--session + --restore)、从正在运行的 Chrome 导入认证状态(--auto-connect)以及状态文件。
AI 聊天功能是否免费?
AI 聊天(chat 命令)通过 Vercel AI Gateway 工作,需要 AI_GATEWAY_API_KEY。如果没有密钥,聊天功能不可用,但所有其他自动化功能无需密钥。
它支持无头模式吗?
默认是无头模式。可以用 --headed 打开可见窗口进行调试。在 Linux 无显示环境,它会自动使用 Xvfb。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents