Endoplexity 浏览器智能控制
用你已订阅的 Claude 或 Cursor 驱动真实浏览器的智能体控制,无需按量计费的 API Key。
按维度查看评分与理由
最小权限证据充分:仅浏览器工具、MCP令牌门控、origin锁定、127.0.0.1绑定,测试锁定这些行为;扣分点是审批门控仅为英文标签启发式,SECURITY.md自认会漏。用户确认有三种模式且fail-closed,但trust模式完全绕过门控,仅靠红色提示。数据流与敏感数据说明较清楚(upload/read_file不对称、密钥制文件解析),但Windows下0600无保护被明确承认,属于已知削弱。依赖安全仅四个常规依赖、无锁文件或审计证据,给1分。回滚仅文件副本删除,无更广泛回滚机制。
README与测试描述一致(156测试、14工具、v0.0.1),测试覆盖delta、auth、附件等关键边界,命名一致;静态审阅无法验证声明,故不满分。依赖可用性合理(Node>=24已声明),失败信息在测试中有证据(如out-of-range from的优雅处理、caps命名可调用恢复)。
受众(有Claude/Cursor订阅的个人用户)和场景(表单填写、比价、文件问答)清晰;能力边界陈述非常详尽(chrome://不可驱动、ATS combobox限制等),得3分。环境适配明确承认Windows优先、mac/Linux autostart未实现,扣1分。触发精度(@引用、Enter/Ctrl+Enter语义)有说明但静态无法验证。
信息架构良好(README分节、docs/handrun.md、SECURITY.md),安装说明具体可执行;已知局限一节极其诚实详尽,得3分。许可证为完整Apache-2.0文本并附NOTICE。扣分项:无CHANGELOG(v0.0.1可谅解但确实缺失);维护责任为单人维护、仅承诺一周内善意回复非SLA,更新路径弱。
输出可用性有证据(对比表、来源引用、快照分页与delta设计);边际价值突出——复用已付订阅免API计费,3.8x token削减有数据;成本收益有实测数据($0.0959/单任务)但为自报、静态无法复核,扣1分。
事实与推断分离做得好:明确标注demo在trust模式、测试为单元级、成本为CLI等价值;声明可追溯到具体文件(gate.ts、auth测试)。跨源印证限于仓库内部(README↔SECURITY↔测试一致),无外部验证,故各扣分。
- 审批门控是英文标签启发式:非英文、措辞异常或纯图标按钮不会被拦截,勿在高风险页面依赖normal模式。
- trust模式完全关闭审批门控,误选即失去全部人工确认。
- 文件允许列表即全部边界:read_file会把内容送入模型上下文,只放入你确实愿意共享的文件。
- Windows下令牌文件的0600权限不生效,任何以你用户身份运行的进程都能读取。
- 依赖无锁文件与审计证据,静态审阅无法确认无已知漏洞依赖。
- 单人维护、v0.0.1、无SLA,安全问题修复时间不可保证。
- 避免在含敏感会话(网银、邮箱)的浏览器配置中运行;该工具驱动的是你的真实登录状态。
这个 Agent 能做什么,适合哪些场景?
Endoplexity(GitHub: Endokelp/Endoplexity)是一个 Chrome 扩展加本地桥接的组合,让已有的 claude 或 cursor-agent CLI 订阅直接操控你正在使用的真实浏览器。架构分三层:MV3 侧边栏面板持有 chrome.debugger 的 CDP 连接;本地 TypeScript 桥接进程绑定 127.0.0.1:8787,通过 WebSocket(按扩展来源固定校验)与面板通信,并通过带令牌门控的 MCP/HTTP 端点(/mcp)向 CLI 暴露 14 个浏览器工具;智能体循环本身由已登录订阅的 CLI 完成。页面以无障碍树快照而非原始 HTML 提供给模型,动作执行后返回变化后的页面内容以减少回合数。项目处于早期 v0.0.1,附带 156 个单元测试、桥接内的审批门(提交、删除、购买等不可逆操作需人工确认)和 watch/normal/trust 三种自主模式,安全策略实现在桥接层而非提示词中。
用户在 Chrome 侧边栏输入指令后,面板将任务交给本地桥接,桥接通过 MCP 调用 claude -p 或 cursor-agent -p 运行智能体循环。模型通过 14 个工具操作浏览器:snapshot、navigate、click、type、key、upload、read_file、select、scroll、hover、back、forward、tabs、use_tab。页面以无障碍树快照形式提供,动作返回后仅重发变更行以节省令牌。read_file 可将 PDF、DOCX、XLSX、PPTX、CSV、JSON、Markdown 等附件读为文本供模型回答问题;upload 可将文件填入表单字段。不可逆操作触发审批门,自主模式在桥接层强制执行。
- 已付 Claude Pro 订阅的求职者:让智能体在真实 Greenhouse 招聘表单上自动填写完整职位申请(实测成本约合 0.0959 美元 API 等价、10 个回合、42 秒)。
- 需要跨站比价的用户:一条指令打开 Vercel、Netlify、Cloudflare Pages 三个定价页并在一张表中对比免费额度。
- 依赖已登录会话的操作者:智能体直接在你的真实浏览器会话上工作,无需无头浏览器重新登录。
- 提交含附件的用户:拖拽简历等文件后,智能体可读取附件内容回答问题或将其上传到表单。
- 重视安全的用户:需要人工审批提交、删除、购买等不可逆操作的场景,可使用 watch 模式逐步监督。
这个 Agent 有哪些优点和局限?
- 复用已有 Claude/Cursor 订阅,无按点击计费的 API Key;实测完整职位申请仅约 0.0959 美元等价 API 花销。
- 在真实浏览器会话上运行而非无头副本,保留所有已登录状态。
- 安全设计较扎实:桥接仅绑定 127.0.0.1、扩展按 RSA 固定来源校验、MCP 端点用 0600 令牌文件门控、CLI 以白名单与隔离配置运行,且经实际验证而非仅读文档。
- 性能优化有实测数据:动作返回变更行使令牌消耗降低 3.8 倍(119,856 → 31,626);156 个单元测试加面板内自检。
- Windows 优先:npm run setup 的自启动仅支持 Windows,macOS/Linux 需手动 npm start。
- 仍处 v0.0.1 早期:会话仅存于桥接内存,重启即失效;chrome:// 页面和 Web Store 无法驱动;真实 ATS 组合框需点击流而非 select 工具。
- 审批门是英文标签启发式匹配(submit、pay、delete 等),非英文或措辞异常的按钮不会被拦截,安全关键场景必须用 watch 模式。
- 强依赖 Node 24+ 与已登录的 claude/cursor-agent CLI 订阅,没有订阅则完全无法使用。
如何安装或部署这个 Agent?
- 准备 Node 24+、Chrome 114+、以及已登录订阅的 claude 或 cursor-agent CLI(Claude Pro 即可,建议在模型下拉框选 Sonnet)。2. 克隆安装:git clone https://github.com/Endokelp/Endoplexity.git && cd Endoplexity && npm install。3. 启动桥接:Windows 上运行 npm run setup(写入启动文件夹实现开机自启);其他平台或手动运行用 npm start。4. 加载扩展:打开 chrome://extensions,开启开发者模式,点击"加载已解压的扩展程序",选择仓库中的 extension/ 文件夹。5. 可选:运行 npm run cursor-login 一次性登录 Cursor。
如何使用这个 Agent?
点击工具栏 Endoplexity 图标打开侧边栏,输入任务后点击 Run。要点:Enter 开启新任务,Ctrl/Cmd+Enter 在当前会话中追问;输入 @ 可引用已打开的其他标签页;Run 会附加到你当前查看的标签页,请先打开目标页面。拖拽、粘贴或点击回形针添加附件,智能体可 read_file 读取或 upload 上传。首次建议先让它总结当前页面等低风险任务。可在面板中切换 watch/normal/trust 三种自主模式。