Nanobrowser 浏览器自动化
用自有模型密钥在 Chrome 或 Edge 中执行多智能体网页自动化。
按维度查看评分与理由
证据显示:README声称隐私优先、本地执行、用户控制,但未提供具体实现细节。存在安全政策(SECURITY.md)和依赖覆盖(package.json中的overrides),但未提供权限清单或数据流说明。扣分原因:缺乏代码级证据支持权限最小化、用户确认、数据流透明等声明;未提及回滚机制;发布者身份未验证。
证据显示:README和package.json提供构建和运行说明,但未提供错误处理或失败消息的细节。扣分原因:静态审查无法验证自洽性、依赖可用性或失败消息的实际质量;仅基于文档描述。
证据显示:README详细描述了目标受众(寻求OpenAI Operator替代品的用户)、使用场景(新闻摘要、GitHub研究、购物研究)和环境要求(Chrome、Node.js、pnpm)。扣分原因:能力边界未明确说明,触发精度(如任务指令的精确性)未详细描述。
证据显示:README提供安装、构建、配置说明,包含示例和社区链接;LICENSE为Apache-2.0;package.json包含版本号。扣分原因:缺少变更日志、已知限制部分不明确、维护责任未明确(发布者未验证)。
证据显示:README声称免费、开源、隐私友好,提供多LLM支持和本地模型选项,具有成本效益。扣分原因:输出可用性(如生成结果的质量)未提供具体证据;边际价值基于声明而非实测。
证据显示:README包含功能声明和社区测试链接,但未提供可追溯的验证数据。扣分原因:声明缺乏独立验证,事实与推断未明确区分。
- 发布者身份未验证,需谨慎对待来源。
- README中的隐私和本地执行声明缺乏代码级证据,需进一步审查。
- 未提供权限清单或数据流说明,可能涉及过度权限。
- 依赖安全仅通过overrides部分缓解,需检查完整依赖树。
这个 Agent 能做什么,适合哪些场景?
Nanobrowser 是运行在浏览器中的开源 AI 网页自动化 Chrome 扩展,也支持 Edge。它通过侧边栏聊天界面接收任务,并显示执行过程中的实时状态。系统由 Planner 和 Navigator 等专职智能体协作,可为不同智能体配置不同模型。用户添加自己的 LLM API 密钥后,自动化在本地浏览器中执行;项目宣称凭据不会交给其云服务。它还提供追问和会话历史管理,适合需要让浏览器完成跨网站重复操作的用户。
安装扩展后,用户点击工具栏中的 Nanobrowser 图标打开侧边栏,在 Settings 中添加 LLM API keys,并为 Navigator 与 Planner 选择模型。用户以自然语言输入任务;Planner 负责规划,Navigator 执行网页导航类工作,协同完成网页自动化流程。侧边栏提供实时状态更新,任务完成后可继续提出与该任务相关的 follow-up questions,并在 Conversation History 中访问和管理交互记录。README 给出的任务示例包括提取 TechCrunch 过去 24 小时的前 10 条新闻标题、寻找 GitHub 热门 Python 仓库,以及按价格和续航条件筛选 Amazon 商品。
- 研究人员需要汇总 TechCrunch 过去 24 小时的 10 条头条时,可在侧边栏直接下达提取任务。
- 开发者需要调研 GitHub 上星标较多的热门 Python 仓库时,可让扩展执行网页研究流程。
- 消费者要在 Amazon 寻找价格低于 50 美元、具备防水设计且续航至少 10 小时的蓝牙音箱时,可用自然语言描述筛选条件。
- 经常在多个网站重复执行浏览和信息收集任务的个人,可为 Planner 和 Navigator 分别配置合适的模型来平衡成本与能力。
- 重视本地浏览器执行与自持 API 密钥的用户,可选择 Ollama 或自定义 OpenAI-compatible provider 配置本地模型。
这个 Agent 有哪些优点和局限?
- 可分别为 Planner 和 Navigator 选择模型,便于按推理能力、导航效率与成本分配模型。
- 支持 OpenAI、Anthropic、Gemini、Ollama、Groq、Cerebras、Llama 及自定义 OpenAI-compatible providers。
- 以浏览器扩展和交互式侧边栏交付,包含实时状态、追问与会话历史,而非仅提供一次性脚本。
- README 将执行边界描述为本地浏览器,且采用用户自有 API key。
- 官方完整支持仅限 Chrome 和 Edge;Firefox、Safari 及 Opera、Arc 等其他 Chromium 浏览器被列为不支持。
- 必须自行提供 LLM API key;虽然扩展本身免费,模型调用仍由用户向所选提供商付费。
- 成本优先的模型组合对复杂任务可能更不稳定,并可能需要更多迭代。
- 从源码构建要求 Node.js 22.12.0+ 与 pnpm 9.15.1+;Chrome Web Store 版本也可能因审核而落后于最新版本。
如何安装或部署这个 Agent?
稳定版:从 Chrome Web Store 安装 Nanobrowser,点击“Add to Chrome”并确认。最新版手动安装:下载官方 GitHub release 中的 nanobrowser.zip,解压后在 Chrome 打开 chrome://extensions/,启用 Developer mode,点击 Load unpacked,并选择解压后的 nanobrowser 文件夹。源码构建:需 Node.js v22.12.0 或更高版本及 pnpm v9.15.1 或更高版本,然后运行:
git clone https://github.com/nanobrowser/nanobrowser.git
cd nanobrowser
pnpm install
pnpm build构建产物位于 dist 目录,按手动安装步骤加载。首次使用时打开侧边栏的 Settings,添加 LLM API keys,并为 Navigator 和 Planner 选定模型。
如何使用这个 Agent?
点击浏览器工具栏中的 Nanobrowser 图标打开侧边栏。进入 Settings 添加所选提供商的 API key,并分别选择 Planner 与 Navigator 使用的模型。随后在聊天界面输入具体网页任务,例如“Go to TechCrunch and extract top 10 headlines from the last 24 hours”。通过实时状态观察执行;完成后可针对结果继续提问,或在 Conversation History 中管理此前对话。若使用本地模型,可配置 Ollama 或其他 custom OpenAI-compatible provider;README 建议将复杂任务拆成清晰、具体的步骤。
这个 Agent 与同类方案有什么区别?
项目将自身定位为 OpenAI Operator 的免费替代方案。其明确差异是使用用户自有 API key、可为不同智能体选择模型,并在本地浏览器中运行;README 不提供两者的基准测试或功能对照。