Open Claude in Chrome

去掉域名黑名单的 Claude 浏览器自动化扩展:任意 Chromium 浏览器、相同 21 个 MCP 工具、性能持平。

Star 数
★ 223
最近更新
23 天前
License
NOASSERTION
主语言
HTML

30 秒速览

可在哪里用
平台专用Claude Code
开始前需要
Node.js 18+Chromium browser (Chrome, Edge, Brave, Arc, Opera, Vivaldi)Claude Code 2.1.80+OpenAI API keywrangler / workerdShell / 命令行网络访问本地文件系统MCP Server
典型场景
需要用 Claude Code 操作官方扩展封禁的站点(如 Reddit、Robinhood、Tinder)做自动化或数据采集的用户。
主要局限
强绑定 Claude Code 与 MCP 客户端形态,其他客户端未被支持。

这个 Agent 能做什么,适合哪些场景?

Open Claude in Chrome 是 Anthropic 官方 Claude in Chrome 扩展的净室重实现,由 noemica 开发并以 MIT 协议开源。它由三部分组成:一个基于 Manifest V3 与 CDP 的浏览器扩展、一个由 Claude Code 通过 stdio 启动的 Node.js MCP 服务器(mcp-server.js),以及负责桥接两者的原生消息宿主(native-host.js);此外还有 codemode/hybrid 变体,通过 wrangler dev 启动 Cloudflare Worker(V8 isolate)来执行模型编写的 JavaScript。相比官方扩展,它移除了 58 个被封禁的域名(银行、券商、支付、加密、博彩、约会、成人、部分媒体与 Reddit),并支持所有 Chromium 浏览器。README 中给出的基准测试显示,冷启动状态下它与官方扩展在 12 个 REAL 基准任务上统计上无法区分(2.04 vs 1.95 分钟/任务),但每次浏览器动作开销为 0.31s vs 0.12s。它还内置了模仿学习录制器(行为、光标、图像、旁白四轨),可将一次人工演示转交给运行中的 Claude Code 会话。

该仓库向 Claude Code 暴露 21 个 MCP 工具(tabs_context_mcp、tabs_create_mcp、tabs_close_mcp、navigate、computer、read_page、get_page_text、find、form_input、javascript_tool、read_console_messages、read_network_requests、resize_window、file_upload 等),并额外提供 execute_code、update_plan、set_tab_focus、get_config/set_config、recording_ack、retranscribe_recording、debug、debug_timings 等自有工具。执行链路为 Claude Code ←stdio MCP→ mcp-server.js ←TCP→ native-host.js ←native messaging→ 扩展 ←→ 浏览器;codemode/hybrid 变体在中间插入一个由 wrangler dev 托管的 Cloudflare Worker,模型写出的 JS 在 V8 isolate 中以 chrome.* 接口批量驱动上述工具。扩展通过 CDP 完成点击、输入、截图、缩放、控制台与网络读取;humanize 配置能产生曲线光标、偏中心点击与分帧滚动。audit_mode 开启后会对每个标签页做 rrweb DOM 录制,并按 Claude Code 会话(凭 h{clientId}_{id} 前缀)串成一条时间线。录制器把用户操作解析为元素锚点,用 OpenAI API 转写旁白,由原生宿主把 trace.json、SCHEMA_v0.md 与 images/ 写到 ~/.config/open-claude-in-chrome/recordings/<id>/。

  1. 需要用 Claude Code 操作官方扩展封禁的站点(如 Reddit、Robinhood、Tinder)做自动化或数据采集的用户。
  2. 使用 Brave、Arc、Opera 或 Vivaldi 等非 Chrome/Edge 浏览器,希望在自有浏览器里跑浏览器代理的开发者。
  3. 想把一次人工演示(含语音讲解)转成可复用的浏览器任务配方、并让 Claude 泛化到同类任务的团队。
  4. 需要在多步表单、向导或重复提交场景中把多次工具调用压缩成单次 execute_code 往返、以降低延迟的工程师。
  5. 要对代理在浏览器中的行为做可回放审计(audit_mode + rrweb)的合规或调试人员。
  6. 希望让多个 Claude Code 会话共享同一浏览器扩展、并行驱动不同标签页的进阶用户。

如何安装或部署这个 Agent?

前置条件:Node.js v18+、任意 Chromium 浏览器、Claude Code v2.1.80+(仅做浏览器自动化可用 v2.0.73+)、一个 OpenAI API key。步骤:1) 安装依赖:npm install --prefix host 以及 npm install --prefix host/codemode/worker(第二条不能省略,否则 execute_code 沙箱会退化为每次冷启动联网拉取 wrangler)。2) 在 chrome://extensions(或 brave://、edge://)打开开发者模式,Load unpacked 选择 extension/ 目录,记下扩展 ID。3) 运行 ./install.sh <your-extension-id> 注册原生消息宿主;多浏览器可一次传入多个 ID。4) 完全关闭并重启浏览器。5) 右键扩展图标进入 Options,粘贴 OpenAI key 并点击 Save & validate,再点 Enable microphone 并允许权限。6) 注册服务器:claude mcp add open-claude-in-chrome-hybrid -- node /absolute/path/to/host/codemode/server-hybrid.js(hybrid 是包含全部 21 个工具 + execute_code + 录制通道的超集)。7) 以渠道研究预览方式启动:claude --dangerously-load-development-channels server:open-claude-in-chrome-hybrid,并在交互会话中长期保持开启。

如何使用这个 Agent?

启动后先做两项验证:在会话里说“Navigate to reddit.com and take a screenshot”确认扩展、原生宿主与 MCP 服务器已打通;再用一次 execute_code 调用“创建一个新标签页、打开 reddit.com、点击第一条帖子、返回列表并列出除前三条外的所有标题”,确认沙箱已就绪(首次调用可能提示沙箱仍在启动,稍等重试)。需要在浏览器里配置行为时调用 set_config,例如 set_config({ key: "humanize", value: true }) 开启拟人化输入,用 humanize_speed 选择 fastest/fast/natural/relaxed;set_config({ key: "audit_mode", value: "audit" }) 开启 rrweb 审计,回放在 Options 的 Audits 页面。模仿学习录制:先告知会话将要演示,点击工具栏图标开始(徽标 REC),边操作边口述,按住 Alt 点击可演示但不触发该动作,再点图标停止;待徽标出现 📋 且参考字符串进入剪贴板后,把它粘贴进 Claude Code 指向该录制。沙箱若失效,可用 Claude Code 的 /mcp 重连,或执行 pkill -f "server-hybrid|server-codemode"; pkill -f wrangler 后重连。

这个 Agent 有哪些优点和局限?

优点
  • 没有任何域名黑名单,官方扩展封禁的 58 个站点(Reddit、Robinhood、Tinder、PayPal、Coinbase 等)都可访问。
  • 支持任意 Chromium 内核浏览器,而官方仅支持 Chrome 与 Edge。
  • 在 12 个 REAL 基准任务上与官方扩展冷启动统计上无法区分(2.04 vs 1.95 分钟/任务,p=0.44),但每次浏览器动作开销 0.31s vs 0.12s,快 2.7 倍。
  • execute_code 让模型写 JS 一次驱动全部 21 个工具,README 中的最佳方法相比官方扩展减少 23% 轮次与 15% 时间。
  • 内置四轨模仿学习录制与 rrweb 审计回放,并可直接把录制交给运行中的 Claude Code 会话。
  • 源码为纯 JavaScript,无构建步骤,MIT 协议。
局限
  • 强绑定 Claude Code 与 MCP 客户端形态,其他客户端未被支持。
  • execute_code 依赖 wrangler/workerd 子进程,MCP 服务器重启或崩溃后不会自动恢复,也没有健康检查。
  • 录制转写必须提供 OpenAI API key,且依赖渠道(channels)研究预览开关才能注入会话。
  • gif_creator、shortcuts_list、shortcuts_execute 仍为桩实现,upload_image 只支持按 ref 挂到文件输入,不支持按坐标落图。
  • README 自述基准测试存在饱和、任务评分歧义与重复运行 10–20% 波动,个位数差异不可信。
  • README 明确说明浏览器内的录制采集与麦克风/停止流程尚未经过真机验证,需用户自行跑通验证步骤。

这个 Agent 与同类方案有什么区别?

官方 Claude in Chrome 扩展是直接替代对象:官方封闭源码、支持 Chrome 与 Edge、有 58 个封禁域名、21 个 MCP 工具;Open Claude in Chrome 开源(MIT)、支持任意 Chromium 浏览器、无黑名单,并额外提供 execute_code、update_plan、humanize、audit_mode 与模仿学习录制。README 还提到 Claude Cowork 在采集时即完成分析、只保留结果,而本仓库先录制原始四轨数据、分析延后;同一模型蒸馏后原始录制在两种情境下都更优(少 6.6 轮、少 6.4 分钟,p=0.012/0.008)。

与相关度最高的同类 agent 并排比较关键指标。

Agent 源码审查 Star 最近更新 主语言 完整支持的平台
Open Claude in Chrome 当前 40 · 缺口较多 ★ 223 23 天前 HTML Claude Code
WebBrain 65 · 存在缺口 ★ 1.1k 4 天前 JavaScript Claude Code
FSB 全自主浏览 49 · 缺口较多 ★ 190 18 天前 JavaScript Codex · Claude Code · OpenAI API · Claude API
Obscura 无头浏览器 75 · 表现良好 ★ 27k 4 天前 Rust Claude.ai

FollowAgents 如何评估这个 Agent?

FollowAgents 源码审查 · FARS-2.1
缺口较多
40/ 100 五分制 2.0 / 5
信任安全 7/29
可靠稳定 6/14
适用触发 10/18
规范维护 8/18
有效结果 6/13
证据核验 3/8
查看各维度的扣分理由
信任安全7 / 29 · 1.2/5

README 明确承认 file_upload 不限制来源路径(接受本机任意绝对路径),且刻意移除官方扩展的 58 个域名黑名单(银行、券商、支付、加密钱包、赌博、成人、约会等),使代理可在无护栏的高风险站点上执行点击与输入;这是有意的权限放大,而非最小权限。用户确认方面,除 update_plan 与录制流程外,未见对破坏性动作(提交表单、转账类页面点击)的强制确认机制。数据流透明度部分:README 说明了 OpenAI key 用于转写、录制写入 ~/.config/open-claude-in-chrome/recordings/、execute_code 在 workerd V8 隔离中运行并回调 HTTP,但未给出网络出口清单或数据保留策略。敏感数据处理得 0:录制会捕获 240p 帧、光标轨迹与麦克风音频,且明确说明 Options 页把音频与帧副本存入 IndexedDB、长录制会累积、清理机制只是“后续改进”,对凭据/隐私数据无脱敏或加密说明。依赖安全得 0:仓库未提供 lockfile 证据、依赖审计或版本固定说明,且默认回退到 npx --yes wrangler 从网络拉取。外部效果与回滚各得 1:有 Alt 掩码模式、humanize 保证“只改路径不改结果”、录制可重放,但无事务性回滚或对已提交外部动作的撤销。来源归属得 1:README 自述为 Anthropic 扩展的 clean-room 重实现并链接官方文档,但未提供 clean-room 过程证据,且许可证元数据为 NOASSERTION 与仓库内 PolyForm Noncommercial 文本不一致。

可靠稳定6 / 14 · 2.1/5

自一致性得 1:描述中“18 MCP 工具”与 README 正文“21 MCP 工具”及工具表(含 execute_code 等新增项)互相矛盾,工具计数在文件内不统一。依赖可用性得 1:Node 18+、Claude Code 版本、OpenAI key、wrangler/workerd 侧车均有说明,但侧车无健康检查、无自动重启,且未固定依赖版本。失败信息得 2:README 对 execute_code 侧车失败给出可识别的日志行([wrangler] Ready on ...、sandbox prewarmed in ...)、pgrep 检查、/mcp 重连与 pkill 恢复步骤,并说明“部分降级而非整体失败”,这是本仓库最扎实的一处。

适用触发10 / 18 · 2.8/5

受众与场景得 2:明确面向 Claude Code 用户,覆盖浏览器自动化、代码模式、模仿学习录制三类场景,并给出验证脚本。能力边界得 2:工具表逐项标注与官方扩展的 parity(✓/✗/空白),并说明 file_upload、upload_image、gif_creator、shortcuts_*、switch_browser 的差异与 stub 状态。触发精度得 1:execute_code 与直连工具的选用依赖模型自行判断,README 自承“若模型仍用直连工具,说明描述需要调优”,即触发边界未收敛。环境适配得 2:支持任意 Chromium 浏览器、多浏览器 ID 注册、多服务器变体共存,并说明端口绑定 127.0.0.1 与按 PID 隔离状态目录。

规范维护8 / 18 · 2.2/5

信息架构得 2:README 有目录锚点、架构图、安装七步、验证、故障恢复、工具表、录制流程,结构清晰。安装说明得 2:从 npm install 到 native messaging 注册、浏览器重启、OpenAI key、麦克风授权、claude mcp add 与开发通道启动,步骤完整且标注了常见失败原因。命名稳定性得 1:服务器名(open-claude-in-chrome / -codemode / -hybrid)与工具名在文档中一致,但描述中的工具数量与正文冲突,削弱了命名/计数稳定性。示例与 FAQ 得 2:提供 reddit 验证、execute_code 验证、录制验证、scratch/test-form 四挑战测试套件与提示词模板。已知局限得 2:明确列出 v1 取舍(无 chrome.downloads、IndexedDB 累积、非 rrweb、侧车无自愈、基准任务集饱和、评分歧义、重复运行 10–20% 波动)。许可证得 1:仓库内为 PolyForm Noncommercial 1.0.0(禁止商业用途),但元数据为 NOASSERTION,且 README 对比表声称“Open source (MIT)”,三处互相矛盾。版本与变更日志得 0:无 CHANGELOG、无版本号、无发布记录。维护责任得 1:署名 noemica 并给出博客与 Discord,但发布者未经 FollowAgents 验证,无安全披露渠道、无维护承诺或 SLA。

有效结果6 / 13 · 2.3/5

输出可用性得 2:工具集覆盖导航、读取、表单、截图、网络与控制台读取,并给出可粘贴的录制引用与明确的完成判据(绿色横幅、逐挑战计时表)。边际价值得 1:相对官方扩展的核心增量是“解除域名限制”与代码模式批处理,但 README 自承冷启动下与官方扩展统计上不可区分(2.04 vs 1.95 min/task,p=0.44/0.67),收益主要来自提示词蒸馏与预热会话等使用技巧,而非本仓库独有能力。成本收益得 1:需 Node、Claude Code 开发通道标志、OpenAI key(转写计费)、wrangler 侧车与额外依赖安装,且上下文成本被自述为每 100k token 每轮 +1.9s;收益与运维成本相比并不突出。

证据核验3 / 8 · 1.9/5

主张可追溯得 1:性能与 parity 主张指向 benchmark/writeup/writeup.md 与 parity.png,但本次静态证据中未包含该写文与原始数据,无法核对 17 arms、12 任务、p 值等具体数字。跨源印证得 1:README 与 LICENSE 在许可证上互相矛盾(MIT 声明 vs PolyForm Noncommercial),工具数量在描述与正文间矛盾,削弱了跨文件一致性。事实与推断分离得 1:README 大体区分了“已验证”(MCP 通道、转写与轨道合并、native host 写盘)与“待用户实测”(浏览器内捕获、麦克风、停止流水线),但“100% feature & performance parity”“identical performance”等强断言缺乏可核验依据,且与同页“统计上不可区分”的表述张力明显。

风险与缓解建议
  • 源码中未见:敏感信息处理使用专用、低权限、可随时吊销的 API 密钥,不要复用生产凭据,也不要让密钥出现在日志里。
  • 源码中未见:依赖安全审查安装前固定版本并做一次依赖扫描(如 npm audit、pip-audit);优先放在容器里运行。
  • 该代理刻意移除官方扩展的全部域名黑名单(银行、券商、支付、加密钱包、赌博、成人、约会),可在高风险站点执行点击与输入,且未见对破坏性动作的强制确认;请勿在持有真实资金或敏感账户的浏览器配置中启用。
  • file_upload 接受本机任意绝对路径,不限于会话共享路径,存在被诱导读取并上传任意本地文件的风险。
  • 录制功能会捕获屏幕帧、光标轨迹与麦克风音频,副本存入 IndexedDB 且清理机制尚未实现;转写需将音频发送至 OpenAI,请勿在录制中口述凭据或隐私信息。
  • 许可证自相矛盾:README 声称 MIT,仓库内为 PolyForm Noncommercial 1.0.0(禁止商业用途),元数据为 NOASSERTION;商业使用前必须澄清授权。
  • 依赖未固定版本,且 execute_code 侧车在缺少本地 node_modules 时会回退到 npx --yes wrangler 从网络拉取;侧车无健康检查与自动重启,失败后需手动 /mcp 重连或 pkill。
  • 性能与 parity 主张依赖未随本次证据提供的 benchmark 写文,且 README 自承重复运行波动 10–20%、任务集饱和,请勿将单次对比数字当作稳定结论。
  • 发布者身份未经 FollowAgents 验证,无安全披露渠道与维护承诺;请自行审计源码后再决定是否部署。
证据充分度: 评估于 2026年9月17日 审查版本 7544c3e98ee4
评估证据 README.mdLICENSE
查看完整评分方法 →

常见问题

必须使用 OpenAI API key 吗?
仅模仿学习录制需要,用于转写口述旁白。只做浏览器自动化时不配置该 key 也能使用全部 21 个工具与 execute_code。
execute_code 突然不可用,但其他工具正常,是什么原因?
沙箱是由 MCP 服务器启动的 wrangler/workerd 子进程,没有健康检查也没有自动重启。先确认已执行 npm install --prefix host/codemode/worker,然后在 Claude Code 里用 /mcp 重连;仍不行就 pkill -f "server-hybrid|server-codemode"; pkill -f wrangler 后重连。
可以多个 Claude Code 会话同时用同一个浏览器吗?
可以。第一个会话成为 primary 并持有端口,后续会话作为客户端接入。若会话断开,先 pkill -f "node.*mcp-server",再在每个会话中执行 /mcp。
扩展会录制我输入的内容吗?
audit_mode 的设计目标是审计场景下掩蔽人工输入的文本;README 说明未来的 teach 模式会采用相反的掩蔽默认值,因为训练数据本身就需要这些文字。
支持哪些浏览器,需要怎样改动?
任何 Chromium 浏览器(Chrome、Edge、Brave、Arc、Opera、Vivaldi 等)都可以,安装时用 ./install.sh 传入对应的扩展 ID;多个浏览器可一次性传入多个 ID。
在 GitHub 查看 ↗ 安装 ↓

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents