自动化与运维 browser-automationchrome-extensionmcp-connectorauthenticated-web-accessparallel-tabsapi-fallbackreusable-recipes

Actionbook 浏览器智能体

让 AI 操作已登录的网站,交付带来源的报告、CSV 与可发送草稿。

FollowAgents 评估 · FARS-2.1
不推荐
42/ 100 五分制 2.1 / 5
1 2 3 4 5 6
1信任安全7 / 29 · 1.2/5

README明确说明远程MCP端点、Chrome扩展、复用已登录会话,以及打开标签页、读取页面、点击和填写表单等外部操作,因此基本数据流和作用范围可见;工作流也使用空的顶层权限或显式的最小GitHub权限。不过,材料未说明扩展权限、远程服务接收或保留哪些页面及凭据数据、加密和删除政策、按操作确认机制、域名限制、敏感字段保护或撤销与回滚流程。依赖使用固定的pnpm版本和一个覆盖项,但多数版本为范围约束,GitHub Actions也仅固定到主版本,未展示审计或漏洞处理政策。README、仓库名、社交渠道和许可证中的Cue Labs, Inc.提供了部分来源归属,但发布者未经企业注册验证,维护身份和责任边界仍不完整。

2可靠稳定6 / 14 · 2.1/5

README、package.json和工作流显示可识别的构建、测试及发布结构,并覆盖Windows单元和端到端测试配置;包管理器和常见依赖来源也清楚,足以支持一般依赖可获得性判断。但当前推荐的远程连接器与扩展并未在所给源码中展示,CLI已标记弃用,而发布通知工作流仍包含CLI安装文案,且扩展发布分支被作业条件排除,形成一定叙述不一致。失败处理证据主要限于缺少API密钥时跳过测试、curl失败退出和安装流程中的连接确认,没有面向用户的错误分类、恢复指导或降级行为。

3适用触发9 / 18 · 2.5/5

材料明确面向需要跨登录网站检索、生成报告或CSV、起草内容及重复执行Recipe的AI应用用户,并列出Claude、ChatGPT、Perplexity、Hermes、OpenClaw及其他MCP客户端,普通场景与环境适配说明较好。能力被概括为search、manual、goto、snapshot、click和type等,但完整命令、支持网站、读写边界及并发限制被留在外部工具描述或文档中。触发方式只有自然语言示例和可选的显式提示,没有静态可审查的路由条件、歧义处理或防止在不适当页面触发的规则。

4规范维护10 / 18 · 2.8/5

README结构清晰,覆盖定位、安装、快速开始、工具、文档、社区、贡献和许可证;三步远程连接器安装说明对普通使用较充分。Apache-2.0全文和package.json元数据一致,因此许可证获满分。项目使用Changesets、同步版本脚本、发布工作流和发布标签约定,说明存在版本发布路径,但根包仍为0.0.0,且没有提供变更日志内容。当前产品、Legacy段落、已弃用CLI和仍处理CLI发布的工作流并存,使命名与产品代际边界不够稳定。示例较少且FAQ、详细限制、支持范围和明确维护负责人均未在材料中给出;社区渠道仅提供一般支持入口。

5有效结果7 / 13 · 2.7/5

README具体描述可交付的报告、CSV、草稿和可复用Recipe,这些输出对目标工作具有直接可用性;在登录后数据访问、API优先和UI回退以及多标签并发方面也显示了相对于普通浏览器代理的潜在增量价值。但10倍提速、准确性、韧性及192个网站两分钟等效果主要是营销陈述或视频引用,所给文件没有方法、基线或结果数据。虽然标称Chrome安装免费且无需CLI,但远程托管、隐私、服务限制、资源消耗、付费条件和维护成本未披露,因此成本收益只能获得有限分数。

6证据核验3 / 8 · 1.9/5

部分声明可追溯到具体配置,例如Apache许可证、pnpm版本、测试工作流、远程端点及弃用提示;README、package.json和工作流也交叉印证了Actionbook项目、包结构和发布机制。然而核心Agent和托管连接器的实现、扩展清单、隐私控制、完整测试以及外部文档均不在材料内,关键安全与性能声明无法从源码闭环核对。营销事实、演示结果和架构推断没有系统地区分,性能与准确性陈述也未附静态证据,因此三项均仅属薄弱支持。

证据充分度: 评估于 2026年8月16日 审查版本 5a3eb05ec18f
源码中未见的安全控制:执行前用户确认、敏感信息处理、回滚或恢复路径
使用前请注意
  • 该产品复用真实Chrome中的登录会话并能点击和填写表单;在授予访问前,应单独核查扩展权限、远程数据传输、保留与删除政策,以及高影响操作的确认机制。
  • 不要把“10x faster”“Accurate”或192个网站两分钟的演示视为独立验证;所给材料没有提供基准方法或可审计结果。
  • 当前推荐产品是托管MCP连接器加Chrome扩展,而所给源码主要展示仓库元数据、旧CLI相关工作流和少量测试配置,无法完整审计运行时实现。
  • CLI弃用说明与仍包含CLI安装文本的发布自动化并存,采用前应确认当前支持路径、版本兼容性和故障恢复流程。
评估证据 [1][2][3][4][5][6][7]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

Actionbook 是运行在 Chrome 侧边栏中的浏览器智能体,通过远程 MCP 连接器与 Chrome 扩展协同工作。它使用用户真实浏览器中的已登录会话,读取登录墙或付费墙后的数据,并操作当前使用的网站。执行时优先采用直接 API 请求,无法使用 API 时再回退到界面自动化;其无状态架构还支持并行操作多个标签页。它可以交付带来源的报告、整理后的 CSV 或可直接发送的草稿,而不仅是回答问题。成功的任务可以保存为 Recipe,之后换用新输入再次运行。部署边界依赖 Actionbook 托管的 MCP 端点与 Chrome 扩展,README 未提供自托管方案。

用户在兼容 MCP 的 AI 应用中连接 https://edge.actionbook.app/mcp,并通过 Actionbook Chrome 扩展关联真实 Chrome。智能体随后调用单一的 actionbook MCP 工具:用 searchmanual 查找操作手册,再通过 gotosnapshotclicktype 等子命令打开页面、读取快照、点击控件和填写表单。它能够复用浏览器中的登录状态,同时跨多个页面或标签页并发执行任务;访问网站时优先直接调用 API,必要时使用 UI 自动化。最终产物可包括带来源的报告、干净的 CSV 和待发送草稿;可重复的流程还能保存为 Recipe。

  1. 需要汇总内部 SaaS 数据的运营人员,可让它同时打开 Stripe、Linear 和 Vercel 等已登录网站并提取所需信息。
  2. 研究多个受登录墙限制的网站时,分析人员可利用现有 Chrome 会话读取页面,并将结果整理为带来源的报告。
  3. 需要批量检查许多公司网站的研究团队,可利用其无状态架构并行处理多个标签页,而不是逐页串行访问。
  4. 经常重复同一网页流程的团队,可将验证过的任务保存为 Recipe,并在下一次运行时替换输入。
  5. 需要网页数据交付物的业务用户,可要求输出整洁 CSV 或可直接发送的草稿,而非仅获得对话式答案。

这个 Agent 有哪些优点和局限?

优点
  • 复用真实 Chrome 的已登录会话,可处理登录墙后的页面,无需为每个网站单独建立新的认证流程。
  • 直接 API 调用与 UI 自动化回退相结合,可在 API 可用时减少纯视觉式网页操作。
  • 通过操作手册指导智能体执行具体步骤,README 声称相较逐步截图解析方式可达到 10 倍速度提升。
  • 无状态架构支持并行操作多个标签页,适合批量网站检查。
  • 能够生成报告、CSV 和待发送草稿,并可把成功流程保存为可复用 Recipe。
局限
  • 核心执行依赖 Actionbook 托管的 https://edge.actionbook.app/mcp,来源未记录自托管部署方式。
  • 必须使用 Chrome 和 Actionbook Chrome 扩展,不能仅靠无浏览器的服务器环境运行完整流程。
  • 需要允许扩展和远程连接器接触用户已登录网页,因此采用前应评估敏感账户与页面数据的权限边界。
  • 旧版 @actionbookdev/cli 已弃用,现有 CLI 集成需要迁移到远程 MCP 连接器与扩展模式。
  • 来源没有说明价格、服务可用性保证、支持网站清单,或 API 与 UI 回退失败时的具体行为。

如何安装或部署这个 Agent?

无需安装 CLI。首先从 Chrome Web Store 安装 Actionbook Chrome 扩展。然后在 Claude、ChatGPT、Perplexity、Hermes、OpenClaw 或其他兼容 MCP 的应用中打开连接器设置,添加自定义连接器并填入 https://edge.actionbook.app/mcp。接着访问 https://actionbook.app/dashboard,登录并按引导完成客户端连接,确认扩展已经关联。运行环境需要 Google Chrome、网络连接、该扩展以及能够连接远程 MCP 端点的 AI 应用。旧的 @actionbookdev/cli 已弃用,不应作为新安装方式。

如何使用这个 Agent?

完成连接后,直接向智能体描述任务,例如:Open stripe.com, linear.app, and vercel.com, then grab the pricing from each. Actionbook 会获取操作手册并驱动真实 Chrome,执行打开标签页、读取快照、点击和填写表单等动作。若要明确要求使用它,可在提示中加入:Use Actionbook to understand and operate the web page. 任务达到预期后,可以将其保存为 Recipe,以便使用新输入再次执行。

这个 Agent 与同类方案有什么区别?

README 将 Actionbook 与依赖每一步截图、解析页面后再决策的常规浏览器智能体方式对比。Actionbook 使用操作手册、优先直接调用 API,并在必要时回退到 UI 自动化;其无状态架构还支持并行标签页。来源声称这能达到 10 倍速度提升,但没有提供独立基准或点名具体竞品。

常见问题

是否需要把网站账号密码交给 Actionbook?
来源说明它复用真实 Chrome 中已有的登录会话,没有描述单独提交账号密码的步骤。不过扩展会操作已登录页面,采用前仍应审查其访问权限。
可以自行托管 MCP 服务吗?
来源只记录了 Actionbook 托管端点 https://edge.actionbook.app/mcp,没有提供自托管流程。
是否仍可使用 @actionbookdev/cli
该独立 CLI 包已经弃用;当前推荐架构是远程 MCP 连接器加 Chrome 扩展。
遇到无法直接调用 API 的网站怎么办?
Actionbook 会在无法使用直接 API 时回退到 UI 自动化,通过 snapshotclicktype 等操作控制页面;来源未说明所有网站都能成功处理。
是否收费?
Chrome 安装按钮标注为免费,但来源没有提供完整定价、用量限制或付费方案信息。

相关 Agents