开发与工程 multi-agent-orchestrationcodexgemini-clielectronlocal-firstmemory

Munder Difflin – 多智能体办公桌

一个开源桌面工具,将你现有的 Claude Code、Codex 等终端智能体变成自我协作的团队,由你的数字分身管理。

FollowAgents 评估 · FARS-2.1
不推荐
43/ 100 五分制 2.2 / 5
1 2 3 4 5 6
1信任安全10 / 29 · 1.7/5

证据显示:README 和 SECURITY.md 描述了本地优先架构、通过 contextBridge 的 IPC、路径验证、单提交者 git,以及人类审批门(花费、破坏性操作)。但这些都是声明,没有代码验证。扣分:缺少对权限最小化的实际代码证据,用户确认机制未在代码中展示,数据流透明性仅靠文档,敏感数据处理(如密钥)未详细说明,依赖安全未审计,外部影响(如网络)未明确,回滚机制未描述,来源归属仅基于作者声明。

2可靠稳定6 / 14 · 2.1/5

证据显示:README 和 CHANGELOG 描述了功能,但自洽性中等,因为存在一些不一致(如版本号、功能描述)。依赖可用性未验证,失败消息未在代码中展示。扣分:依赖可用性未验证,失败消息未在代码中展示。

3适用触发9 / 18 · 2.5/5

证据显示:README 描述了多种场景(多代理、不同 CLI、本地模型),受众明确(开发者、团队)。能力边界有描述(如审批门、电路断路器),但触发精度未详细说明,环境适配有描述(macOS/Windows/Linux)。扣分:能力边界和触发精度缺乏具体代码或配置示例。

4规范维护9 / 18 · 2.5/5

证据显示:README 结构清晰,安装说明详细,许可证明确(MIT),有 CHANGELOG 和版本号。但命名稳定性未验证,示例和 FAQ 有限,已知限制未明确列出,维护责任未明确。扣分:命名稳定性、示例、已知限制、维护责任不足。

5有效结果6 / 13 · 2.3/5

证据显示:README 描述了输出(如终端流、记忆搜索),边际价值高(多代理协调),成本效益合理(使用现有订阅)。但输出可用性未验证,成本效益未量化。扣分:输出可用性未验证,成本效益未量化。

6证据核验3 / 8 · 1.9/5

证据显示:README 和 CHANGELOG 提供了一些声明,但缺乏可追溯性,跨源验证有限,事实与推断未明确分离。扣分:声明缺乏代码或测试支持,跨源验证不足,事实与推断未明确分离。

证据充分度: 评估于 2026年9月2日 审查版本 cc741fe37544
使用前请注意
  • 静态审查无法验证安全声明,如路径验证和审批门。
  • 依赖项(如 localtunnel、tunnelmole)可能引入网络暴露,需审查。
  • 发布者身份未验证,需谨慎对待。
评估证据 [1][2][3][4][5][6]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

Munder Difflin 是一个本地运行的多智能体协调框架(Desktop app),它复用你已有的终端 CLI 智能体(如 Claude Code、Codex、Gemini CLI、Grok 等),把它们包装成带长期记忆、邮箱和 2D 办公室桌位的“员工”。核心是 GOD agent(称 Michael),它作为你的替身,接收任务、自动分派和升级,只能由你最终控制。系统采用“hive”机制:一个本地 git 仓库存储智能体的记忆、黑板和事件日志,通过 node-pty 真实终端进程运行各个 CLI,并用 Pixi.js 渲染可视化办公室。该项目基于 Electron、React、TypeScript、xterm.js 构建,采用 MIT 许可证,支持 macOS(签名并公证)、Windows 和 Linux。

Munder Difflin 包装了多种真实终端 AI 编程 CLI(包括 claude、codex、grok、kimi、gemini、qwen、opencode、crush、pi、copilot 等),为每个 CLI 启动独立的 node-pty 进程,并用 xterm.js 渲染真实字节的终端流。它创建了一个“hive”:一个本地 git 仓库,包含每个智能体的 markdown 记忆、原子文件邮箱、共享黑板和附加事件日志。GOD agent(Michael)读取所有请求,自行解决常规任务,并仅将关键审批(如支出、破坏性操作、范围变更)升级到队列。智能体通过写入自己的 outbox/ 与路由将消息传递到收件箱来通信。UI 显示 Pixi.js 办公室楼层,智能体作为化身走动,邮件飞来飞去;用户可实时查看任何终端,直接向会话输入,浏览文件,并查看 git 历史。应用还提供命令中心、看板、日程、记忆搜索、Monaco IDE(内置 git 功能)、技能浏览器,以及 Slack/webhook 集成(可从消息创建临时智能体)。

  1. 个人开发者想在自己的机器上并行运行多个 Claude Code 会话,同时保持一个会记忆上下文的中央协调者。
  2. 需要将已支付的 Claude Code 或 Codex 订阅用于自动化项目,而不额外支付 API 费用,并希望每小时限制由多智能体共享。
  3. 希望用看板管理任务、设置计划任务和监控 CI,同时与能自主运行但受护栏约束的 AI 团队成员协作的团队。
  4. 希望导入现成角色(通过 Agent Gallery 的分享链接)并快速启动带预设身份的智能体的用户。
  5. 通过 Slack 或 webhook 发送消息,让 Michael 生成临时智能体、回复线程并自动结束任务的操作者。
  6. 偏好本地流程、需自带 API 密钥并希望接入 Ollama 或 LM Studio 本地模型的隐私敏感用户。

这个 Agent 有哪些优点和局限?

优点
  • 支持 12+ 种现有 CLI(Claude Code、Codex、Grok 等),复用你已有的订阅,无额外 token 成本。
  • 完整的多智能体记忆系统(hive)包含语义搜索,智能体可跨会话持续记忆。
  • 提供可视化的办公室楼层,可实时查看终端、内存搜索和活动日志,提供高度透明的运行过程。
  • 包含多项安全功能:支出、范围和破坏性操作的门控、断路器三阶段控制(引导、限制、停止)以及按代理预算。
局限
  • 当前为预发布(v0.4.6),可能会遇到不稳定的边缘情况;已知 0.3.8 存在限制保护缺陷。
  • 每个智能体必须至少有一个终端 CLI 安装,且应用依赖 node-pty,需要 C/C++ 工具链构建。
  • 必须依赖订阅或自带的 API 密钥(支持本地模型),但核心操作植根于特定 CLI 生态,不能完全脱离这些服务。
  • 资源消耗高:作为 Electron 桌面应用,需要运行大量终端进程,且界面采用 Pixi.js 渲染。

如何安装或部署这个 Agent?

推荐:从 GitHub Releases(https://github.com/chaitanyagiri/munder-difflin/releases/latest)下载已签名 macOS、Windows 或 Linux 构建版本,直接安装并运行,无需 Node 或源码。若要构建源码,请确保有 Node.js 18+、npm 和 C/C++ 工具链;然后运行:git clone https://github.com/chaitanyagiri/munder-difflin.git && cd munder-difflin && npm install && npm run dev。另需至少一个支持的 agent CLI(如 Claude Code 的 claude)在你的 PATH 中,应用可从“Settings → Prerequisites”自动安装缺失的 CLI。

如何使用这个 Agent?

首次启动后进入引导向导,它会检查并安装缺失的依赖。在主界面中,点击“Add agent”选择合适的 CLI、模型和自主级别,为其分配办公桌;GOD 代理会自动驻留在 Michael 的办公室。通过与 Michael 交谈来分配任务,他会路由请求并升级审批。可通过点击任一办公桌实时观察并交互代理终端。若要从源码构建并运行,执行 npm install 后运行 npm run dev,首次启动会进入向导;生产构建可运行 npm run build。

常见问题

运行 Munder Difflin 我是否需要支付额外的 API 费用?
不需要。它复用你已有的 CLI 订阅(如 Claude Code、Codex 等),仅在那些服务的每小时限制内运行。你可以自带密钥,或连接本地模型(Ollama、LM Studio、vLLM)。
我可以让代理无限自主运行吗?
可以,但有限制。每个代理都有一个自主级别设置,支出、破坏性文件和范围变更会升级给你审批。另外,断路器会引导、限制并最终停止循环或超出预算的代理。
它能在 macOS、Windows 和 Linux 上运行吗?
是。官方发布版提供 macOS(签名并公证)、Windows 和 Linux。但 node-pty 需要本机编译(需要 C/C++ 工具链),若是从源码构建则必须安装。
我的代理数据存储在何处,隐私如何处理?
所有数据在本地:hive 是本地 git 存储库,记忆以本地 markdown 文件存储。官方构建发送匿名使用事件(应用已打开、代理已生成),不会包含提示、代码或文件路径;你可通过设置或 DO_NOT_TRACK 退出,或从源码构建完全禁用遥测。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents