Open Claude in Chrome
去掉域名黑名单的 Claude 浏览器自动化扩展:任意 Chromium 浏览器、相同 21 个 MCP 工具、性能持平。
- Star 数
- ★ 223
- 最近更新
- 23 天前
- License
- NOASSERTION
- 主语言
- HTML
- FA 评分
- 40/100 · 缺口较多
30 秒速览
- 可在哪里用
- 平台专用Claude Code
- 开始前需要
- 典型场景
- 需要用 Claude Code 操作官方扩展封禁的站点(如 Reddit、Robinhood、Tinder)做自动化或数据采集的用户。
- 主要局限
- 强绑定 Claude Code 与 MCP 客户端形态,其他客户端未被支持。
这个 Agent 能做什么,适合哪些场景?
Open Claude in Chrome 是 Anthropic 官方 Claude in Chrome 扩展的净室重实现,由 noemica 开发并以 MIT 协议开源。它由三部分组成:一个基于 Manifest V3 与 CDP 的浏览器扩展、一个由 Claude Code 通过 stdio 启动的 Node.js MCP 服务器(mcp-server.js),以及负责桥接两者的原生消息宿主(native-host.js);此外还有 codemode/hybrid 变体,通过 wrangler dev 启动 Cloudflare Worker(V8 isolate)来执行模型编写的 JavaScript。相比官方扩展,它移除了 58 个被封禁的域名(银行、券商、支付、加密、博彩、约会、成人、部分媒体与 Reddit),并支持所有 Chromium 浏览器。README 中给出的基准测试显示,冷启动状态下它与官方扩展在 12 个 REAL 基准任务上统计上无法区分(2.04 vs 1.95 分钟/任务),但每次浏览器动作开销为 0.31s vs 0.12s。它还内置了模仿学习录制器(行为、光标、图像、旁白四轨),可将一次人工演示转交给运行中的 Claude Code 会话。
该仓库向 Claude Code 暴露 21 个 MCP 工具(tabs_context_mcp、tabs_create_mcp、tabs_close_mcp、navigate、computer、read_page、get_page_text、find、form_input、javascript_tool、read_console_messages、read_network_requests、resize_window、file_upload 等),并额外提供 execute_code、update_plan、set_tab_focus、get_config/set_config、recording_ack、retranscribe_recording、debug、debug_timings 等自有工具。执行链路为 Claude Code ←stdio MCP→ mcp-server.js ←TCP→ native-host.js ←native messaging→ 扩展 ←→ 浏览器;codemode/hybrid 变体在中间插入一个由 wrangler dev 托管的 Cloudflare Worker,模型写出的 JS 在 V8 isolate 中以 chrome.* 接口批量驱动上述工具。扩展通过 CDP 完成点击、输入、截图、缩放、控制台与网络读取;humanize 配置能产生曲线光标、偏中心点击与分帧滚动。audit_mode 开启后会对每个标签页做 rrweb DOM 录制,并按 Claude Code 会话(凭 h{clientId}_{id} 前缀)串成一条时间线。录制器把用户操作解析为元素锚点,用 OpenAI API 转写旁白,由原生宿主把 trace.json、SCHEMA_v0.md 与 images/ 写到 ~/.config/open-claude-in-chrome/recordings/<id>/。
- 需要用 Claude Code 操作官方扩展封禁的站点(如 Reddit、Robinhood、Tinder)做自动化或数据采集的用户。
- 使用 Brave、Arc、Opera 或 Vivaldi 等非 Chrome/Edge 浏览器,希望在自有浏览器里跑浏览器代理的开发者。
- 想把一次人工演示(含语音讲解)转成可复用的浏览器任务配方、并让 Claude 泛化到同类任务的团队。
- 需要在多步表单、向导或重复提交场景中把多次工具调用压缩成单次 execute_code 往返、以降低延迟的工程师。
- 要对代理在浏览器中的行为做可回放审计(audit_mode + rrweb)的合规或调试人员。
- 希望让多个 Claude Code 会话共享同一浏览器扩展、并行驱动不同标签页的进阶用户。
如何安装或部署这个 Agent?
前置条件:Node.js v18+、任意 Chromium 浏览器、Claude Code v2.1.80+(仅做浏览器自动化可用 v2.0.73+)、一个 OpenAI API key。步骤:1) 安装依赖:npm install --prefix host 以及 npm install --prefix host/codemode/worker(第二条不能省略,否则 execute_code 沙箱会退化为每次冷启动联网拉取 wrangler)。2) 在 chrome://extensions(或 brave://、edge://)打开开发者模式,Load unpacked 选择 extension/ 目录,记下扩展 ID。3) 运行 ./install.sh <your-extension-id> 注册原生消息宿主;多浏览器可一次传入多个 ID。4) 完全关闭并重启浏览器。5) 右键扩展图标进入 Options,粘贴 OpenAI key 并点击 Save & validate,再点 Enable microphone 并允许权限。6) 注册服务器:claude mcp add open-claude-in-chrome-hybrid -- node /absolute/path/to/host/codemode/server-hybrid.js(hybrid 是包含全部 21 个工具 + execute_code + 录制通道的超集)。7) 以渠道研究预览方式启动:claude --dangerously-load-development-channels server:open-claude-in-chrome-hybrid,并在交互会话中长期保持开启。
如何使用这个 Agent?
启动后先做两项验证:在会话里说“Navigate to reddit.com and take a screenshot”确认扩展、原生宿主与 MCP 服务器已打通;再用一次 execute_code 调用“创建一个新标签页、打开 reddit.com、点击第一条帖子、返回列表并列出除前三条外的所有标题”,确认沙箱已就绪(首次调用可能提示沙箱仍在启动,稍等重试)。需要在浏览器里配置行为时调用 set_config,例如 set_config({ key: "humanize", value: true }) 开启拟人化输入,用 humanize_speed 选择 fastest/fast/natural/relaxed;set_config({ key: "audit_mode", value: "audit" }) 开启 rrweb 审计,回放在 Options 的 Audits 页面。模仿学习录制:先告知会话将要演示,点击工具栏图标开始(徽标 REC),边操作边口述,按住 Alt 点击可演示但不触发该动作,再点图标停止;待徽标出现 📋 且参考字符串进入剪贴板后,把它粘贴进 Claude Code 指向该录制。沙箱若失效,可用 Claude Code 的 /mcp 重连,或执行 pkill -f "server-hybrid|server-codemode"; pkill -f wrangler 后重连。
这个 Agent 有哪些优点和局限?
- 没有任何域名黑名单,官方扩展封禁的 58 个站点(Reddit、Robinhood、Tinder、PayPal、Coinbase 等)都可访问。
- 支持任意 Chromium 内核浏览器,而官方仅支持 Chrome 与 Edge。
- 在 12 个 REAL 基准任务上与官方扩展冷启动统计上无法区分(2.04 vs 1.95 分钟/任务,p=0.44),但每次浏览器动作开销 0.31s vs 0.12s,快 2.7 倍。
- execute_code 让模型写 JS 一次驱动全部 21 个工具,README 中的最佳方法相比官方扩展减少 23% 轮次与 15% 时间。
- 内置四轨模仿学习录制与 rrweb 审计回放,并可直接把录制交给运行中的 Claude Code 会话。
- 源码为纯 JavaScript,无构建步骤,MIT 协议。
- 强绑定 Claude Code 与 MCP 客户端形态,其他客户端未被支持。
- execute_code 依赖 wrangler/workerd 子进程,MCP 服务器重启或崩溃后不会自动恢复,也没有健康检查。
- 录制转写必须提供 OpenAI API key,且依赖渠道(channels)研究预览开关才能注入会话。
- gif_creator、shortcuts_list、shortcuts_execute 仍为桩实现,upload_image 只支持按 ref 挂到文件输入,不支持按坐标落图。
- README 自述基准测试存在饱和、任务评分歧义与重复运行 10–20% 波动,个位数差异不可信。
- README 明确说明浏览器内的录制采集与麦克风/停止流程尚未经过真机验证,需用户自行跑通验证步骤。
这个 Agent 与同类方案有什么区别?
官方 Claude in Chrome 扩展是直接替代对象:官方封闭源码、支持 Chrome 与 Edge、有 58 个封禁域名、21 个 MCP 工具;Open Claude in Chrome 开源(MIT)、支持任意 Chromium 浏览器、无黑名单,并额外提供 execute_code、update_plan、humanize、audit_mode 与模仿学习录制。README 还提到 Claude Cowork 在采集时即完成分析、只保留结果,而本仓库先录制原始四轨数据、分析延后;同一模型蒸馏后原始录制在两种情境下都更优(少 6.6 轮、少 6.4 分钟,p=0.012/0.008)。
与相关度最高的同类 agent 并排比较关键指标。
| Agent | 源码审查 | Star | 最近更新 | 主语言 | 完整支持的平台 |
|---|---|---|---|---|---|
| Open Claude in Chrome 当前 | 40 · 缺口较多 | ★ 223 | 23 天前 | HTML | Claude Code |
| WebBrain | 65 · 存在缺口 | ★ 1.1k | 4 天前 | JavaScript | Claude Code |
| FSB 全自主浏览 | 49 · 缺口较多 | ★ 190 | 18 天前 | JavaScript | Codex · Claude Code · OpenAI API · Claude API |
| Obscura 无头浏览器 | 75 · 表现良好 | ★ 27k | 4 天前 | Rust | Claude.ai |
FollowAgents 如何评估这个 Agent?
查看各维度的扣分理由
README 明确承认 file_upload 不限制来源路径(接受本机任意绝对路径),且刻意移除官方扩展的 58 个域名黑名单(银行、券商、支付、加密钱包、赌博、成人、约会等),使代理可在无护栏的高风险站点上执行点击与输入;这是有意的权限放大,而非最小权限。用户确认方面,除 update_plan 与录制流程外,未见对破坏性动作(提交表单、转账类页面点击)的强制确认机制。数据流透明度部分:README 说明了 OpenAI key 用于转写、录制写入 ~/.config/open-claude-in-chrome/recordings/、execute_code 在 workerd V8 隔离中运行并回调 HTTP,但未给出网络出口清单或数据保留策略。敏感数据处理得 0:录制会捕获 240p 帧、光标轨迹与麦克风音频,且明确说明 Options 页把音频与帧副本存入 IndexedDB、长录制会累积、清理机制只是“后续改进”,对凭据/隐私数据无脱敏或加密说明。依赖安全得 0:仓库未提供 lockfile 证据、依赖审计或版本固定说明,且默认回退到 npx --yes wrangler 从网络拉取。外部效果与回滚各得 1:有 Alt 掩码模式、humanize 保证“只改路径不改结果”、录制可重放,但无事务性回滚或对已提交外部动作的撤销。来源归属得 1:README 自述为 Anthropic 扩展的 clean-room 重实现并链接官方文档,但未提供 clean-room 过程证据,且许可证元数据为 NOASSERTION 与仓库内 PolyForm Noncommercial 文本不一致。
自一致性得 1:描述中“18 MCP 工具”与 README 正文“21 MCP 工具”及工具表(含 execute_code 等新增项)互相矛盾,工具计数在文件内不统一。依赖可用性得 1:Node 18+、Claude Code 版本、OpenAI key、wrangler/workerd 侧车均有说明,但侧车无健康检查、无自动重启,且未固定依赖版本。失败信息得 2:README 对 execute_code 侧车失败给出可识别的日志行([wrangler] Ready on ...、sandbox prewarmed in ...)、pgrep 检查、/mcp 重连与 pkill 恢复步骤,并说明“部分降级而非整体失败”,这是本仓库最扎实的一处。
受众与场景得 2:明确面向 Claude Code 用户,覆盖浏览器自动化、代码模式、模仿学习录制三类场景,并给出验证脚本。能力边界得 2:工具表逐项标注与官方扩展的 parity(✓/✗/空白),并说明 file_upload、upload_image、gif_creator、shortcuts_*、switch_browser 的差异与 stub 状态。触发精度得 1:execute_code 与直连工具的选用依赖模型自行判断,README 自承“若模型仍用直连工具,说明描述需要调优”,即触发边界未收敛。环境适配得 2:支持任意 Chromium 浏览器、多浏览器 ID 注册、多服务器变体共存,并说明端口绑定 127.0.0.1 与按 PID 隔离状态目录。
信息架构得 2:README 有目录锚点、架构图、安装七步、验证、故障恢复、工具表、录制流程,结构清晰。安装说明得 2:从 npm install 到 native messaging 注册、浏览器重启、OpenAI key、麦克风授权、claude mcp add 与开发通道启动,步骤完整且标注了常见失败原因。命名稳定性得 1:服务器名(open-claude-in-chrome / -codemode / -hybrid)与工具名在文档中一致,但描述中的工具数量与正文冲突,削弱了命名/计数稳定性。示例与 FAQ 得 2:提供 reddit 验证、execute_code 验证、录制验证、scratch/test-form 四挑战测试套件与提示词模板。已知局限得 2:明确列出 v1 取舍(无 chrome.downloads、IndexedDB 累积、非 rrweb、侧车无自愈、基准任务集饱和、评分歧义、重复运行 10–20% 波动)。许可证得 1:仓库内为 PolyForm Noncommercial 1.0.0(禁止商业用途),但元数据为 NOASSERTION,且 README 对比表声称“Open source (MIT)”,三处互相矛盾。版本与变更日志得 0:无 CHANGELOG、无版本号、无发布记录。维护责任得 1:署名 noemica 并给出博客与 Discord,但发布者未经 FollowAgents 验证,无安全披露渠道、无维护承诺或 SLA。
输出可用性得 2:工具集覆盖导航、读取、表单、截图、网络与控制台读取,并给出可粘贴的录制引用与明确的完成判据(绿色横幅、逐挑战计时表)。边际价值得 1:相对官方扩展的核心增量是“解除域名限制”与代码模式批处理,但 README 自承冷启动下与官方扩展统计上不可区分(2.04 vs 1.95 min/task,p=0.44/0.67),收益主要来自提示词蒸馏与预热会话等使用技巧,而非本仓库独有能力。成本收益得 1:需 Node、Claude Code 开发通道标志、OpenAI key(转写计费)、wrangler 侧车与额外依赖安装,且上下文成本被自述为每 100k token 每轮 +1.9s;收益与运维成本相比并不突出。
主张可追溯得 1:性能与 parity 主张指向 benchmark/writeup/writeup.md 与 parity.png,但本次静态证据中未包含该写文与原始数据,无法核对 17 arms、12 任务、p 值等具体数字。跨源印证得 1:README 与 LICENSE 在许可证上互相矛盾(MIT 声明 vs PolyForm Noncommercial),工具数量在描述与正文间矛盾,削弱了跨文件一致性。事实与推断分离得 1:README 大体区分了“已验证”(MCP 通道、转写与轨道合并、native host 写盘)与“待用户实测”(浏览器内捕获、麦克风、停止流水线),但“100% feature & performance parity”“identical performance”等强断言缺乏可核验依据,且与同页“统计上不可区分”的表述张力明显。
- 源码中未见:敏感信息处理使用专用、低权限、可随时吊销的 API 密钥,不要复用生产凭据,也不要让密钥出现在日志里。
- 源码中未见:依赖安全审查安装前固定版本并做一次依赖扫描(如 npm audit、pip-audit);优先放在容器里运行。
- 该代理刻意移除官方扩展的全部域名黑名单(银行、券商、支付、加密钱包、赌博、成人、约会),可在高风险站点执行点击与输入,且未见对破坏性动作的强制确认;请勿在持有真实资金或敏感账户的浏览器配置中启用。
- file_upload 接受本机任意绝对路径,不限于会话共享路径,存在被诱导读取并上传任意本地文件的风险。
- 录制功能会捕获屏幕帧、光标轨迹与麦克风音频,副本存入 IndexedDB 且清理机制尚未实现;转写需将音频发送至 OpenAI,请勿在录制中口述凭据或隐私信息。
- 许可证自相矛盾:README 声称 MIT,仓库内为 PolyForm Noncommercial 1.0.0(禁止商业用途),元数据为 NOASSERTION;商业使用前必须澄清授权。
- 依赖未固定版本,且 execute_code 侧车在缺少本地 node_modules 时会回退到 npx --yes wrangler 从网络拉取;侧车无健康检查与自动重启,失败后需手动 /mcp 重连或 pkill。
- 性能与 parity 主张依赖未随本次证据提供的 benchmark 写文,且 README 自承重复运行波动 10–20%、任务集饱和,请勿将单次对比数字当作稳定结论。
- 发布者身份未经 FollowAgents 验证,无安全披露渠道与维护承诺;请自行审计源码后再决定是否部署。