BagIdea Office
把多模型 AI 团队变成桌面上的可视化办公室。
按维度查看评分与理由
证据显示项目具备多层权限控制:项目注册、权限代理、统一审批队列、插件审批、默认 workspace-write 隔离、只读容器挂载、Webhook HMAC,以及 CI 的 contents:read 权限。外部发布、邮件和回复等场景也声称经过人工批准。但定时、文件、事件和聊天触发器可无人值守启动工作,代理还会自主开会和提出项目,因此不能视为所有外部效果均逐次确认。README 说明了主要模型、消息渠道、记忆和 API 密钥用途,但没有完整的数据流图、逐供应商传输清单、密钥落盘方式或保留/删除政策。依赖方面有 Cargo.lock 锁定构建、跨平台 CI、注册表核验和清理废弃包的证据,但未展示漏洞扫描、依赖清单审计或固定到提交的 Actions。回滚证据覆盖技能旧版本、隔离 worktree、持久化运行和审批历史,但未覆盖插件、配置及全部外部操作的通用撤销。来源注明了灵感项目、贡献者、MIT 版权主体和社区渠道;发布者身份仍未知,维护归属也不够明确。
跨平台 Rust 构建、Node 20/22 测试矩阵、Claude CLI/PATH 检查、doctor 诊断以及依赖不可用时拒绝静默降级,足以支持普通环境下的依赖可用性。异常运行会把明确原因写入持久历史,安装器和桌面连接故障也给出针对性错误与修复提示,因此失败消息证据充分。主要扣分在自洽性:根 package.json 仍标为 0.9.30 且 private:true,而 README 宣称到 1.6.1、提供 npm 安装和持续发布;CI 还明确排除需要真实 Claude 环境的会议测试,API 测试在守护进程未运行或端点较旧时会跳过。
README 对开发团队、研究、内容、客服、个人助理、营销、邮件、日程、工作流和多代理协作等受众与场景描述具体,并提供团队模板、插件、模型替换、远程执行和多语言支持。触发器的计划、Webhook、事件、文件、RSS、关键词及审批节点语义较明确,Webhook 还有 HMAC。环境适配证据包括 Windows、macOS、Linux CI,Docker、SSH、Ollama、本地/远程模型和平台感知文件选择器。能力边界仍有扣分:大量模型、插件和通信渠道的权限、不可用功能及供应商差异没有逐项界定,macOS/Linux 安装仍被称为 beta,部分功能依赖额外 API 密钥。
README 将网站、入门文档、生态设计、工具指南和 CHANGELOG 串联起来,并使用稳定的全大写 UI 名称协调十四种语言,信息架构和命名证据较强。安装入口、npx 方式、Claude Code 前置条件、可选密钥及 doctor 有说明,但所给材料没有完整安装章节内容或卸载/升级失败恢复步骤。发行说明非常详细,MIT 许可证文本完整;但根 package.json 的 0.9.30 与 README 的 1.6.1 不一致,削弱版本权威性。已知限制散见 beta 标记、会议测试排除和平台条件,而非集中维护。存在 Discord、Issue/PR 引用和更新命令,但未清楚列出具体维护者、支持承诺、安全报告路径或发布责任人;未知发布者身份本身不作为惩罚。
该产品把多代理状态、审批、任务、日历、工作流、通知、成本和记忆整合到桌面办公室中,具有明显的增量价值,且可见历史、任务板、审批队列和诊断信息有助于直接使用输出。预算上限、80% 警告、100% 停止新回合、按代理和项目归因,以及本地 Ollama 选项改善成本收益。不过输出可用性和成本收益主要由 README 陈述,未给出代表性端到端产物、质量基准、资源占用数据或不同模型成本估算方法;完整体验还要求 Claude Code,并可能需要多个付费 API。
README 将许多变更关联到版本、Issue/PR、测试数量、端点和具体故障机制;提供的 CI 与测试文件也能佐证跨平台构建、若干 API 契约和 AUTO 状态判定。扣分在于大量核心能力仅由 README 宣称,未提供相应实现文件或完整测试,且部分 API 测试可以因守护进程缺失或旧端点而跳过。营销性表述把可观察行为与诸如代理有灵魂、成长、社会生活等解释混合,事实、推断和愿景分隔不够严格。根版本元数据冲突也降低了声明追踪的确定性。
- 根 package.json 的 0.9.30/private:true 与 README 所述 1.6.1 和 npm 发布路径不一致;安装或升级前应核对实际发布工件与修订。
- 启用定时、Webhook、文件、RSS 或消息触发器前,应逐项审查可调用工具、网络目标、项目目录、预算和人工审批边界。
- README 未完整说明 API 密钥、对话、记忆、语音、媒体及消息平台数据的存储、传输、保留和删除方式。
- CI 不执行需要真实 Claude CLI/模型的会议测试,部分 API 测试也会跳过;静态证据不能证明端到端代理行为。
- 插件和自我修正技能会扩大运行能力;应在隔离环境审阅提案、差异、依赖及回滚路径后再批准。
这个 Agent 能做什么,适合哪些场景?
BagIdea Office 是一个运行在桌面壁纸中的 2.5D 多智能体工作环境,由 Godot 4 场景、零依赖 Node.js 事件守护进程、WebView 界面和 bagidea CLI 组成。每名员工实际对应一个无头 Claude Code 会话,可以在已登记的项目目录中使用工具、接收委派并把执行状态呈现在办公室场景里。不同员工可以分别使用 Claude、OpenAI、Gemini、GLM、DeepSeek、Qwen、Kimi、Groq、Ollama、LM Studio 等模型,但 Claude Code 仍是所有员工的执行引擎。系统还提供任务看板、日历、可执行工作流、审批队列、记忆、技能、插件、语音和 Telegram、Discord、LINE、Slack、WhatsApp、Messenger 等消息入口。它适合希望长期运行一支可观察、可控制的本地 AI 团队,并愿意承担桌面运行时、权限治理和模型配置成本的用户。
用户通过桌面聊天界面、消息渠道、bagidea CLI 或 HTTP API 提交任务;POST /chat 会启动真实的 claude -p 无头会话,并注入员工身份、所分配的技能与允许使用的工具。Director 可以把任务委派给其他员工或幽灵克隆,员工在真实项目目录中执行工作,事件守护进程再通过 WebSocket 把工作、会议、阻塞、完成和成本状态同步到 Godot 世界与界面。工作流引擎逐节点执行图,可并行运行分支、等待汇合、处理判断、延迟、通知和人工审批,并保存能够跨重启恢复的运行记录;工作流还可由计划、Webhook、办公室事件、文件到达或消息关键词触发。任务、会议行动项和委派会进入统一任务板,日历支持重复事件、提醒以及 .ics 导入导出。系统把共享 OFFICE.md、员工记忆和项目 MEMORY.md 建立本地 BM25 索引,也可连接 OpenAI 兼容的 embeddings 端点进行语义召回。插件能增加界面、服务端路由、触发器、工作流节点和智能体可调用命令;文件媒体技能还可借助 LibreOffice、pandoc、yt-dlp、ffmpeg、ImageMagick 和 jq 处理文档、媒体与结构化数据。
- 需要同时推进多个软件或内容项目的个人开发者,可让 Director 分派任务给不同模型的员工,并通过任务板、活动流和 Codex 复核查看进度。
- 希望在本机长期运行自动化的独立创作者,可用计划、文件、Webhook 或聊天关键词触发工作流,同时把高风险步骤留在统一审批队列中。
- 需要控制模型成本的小团队,可把复杂决策交给 Claude,把常规执行分配给较便宜或本地的模型,并设置办公室、员工和项目预算上限。
- 经常跨设备工作的用户,可从 Telegram、Discord、LINE、Slack、WhatsApp 或 Messenger 下达任务、接收通知并处理待审批事项。
- 处理 PDF、Office 文档、演示文稿、图片或音视频的知识工作者,可让员工转换文件、制作文档、提取视频转录,并把所得知识写入可检索记忆。
这个 Agent 有哪些优点和局限?
- 把真实 Claude Code 会话、委派、幽灵并行任务、会议和阻塞状态映射到可视化办公室,而不是只提供聊天窗口或静态仪表盘。
- 支持逐员工切换多种云端与本地模型,内置 Anthropic 与 OpenAI 协议转换,并提供实时模型列表、故障转移、上下文压缩和分项成本统计。
- 自动化能力覆盖可持久化图工作流、计划与 Webhook 触发、任务依赖、重复任务、日历和跨渠道审批,可形成完整的人机协作闭环。
- 权限、项目钩子、提案和插件扩展都设置了人工关卡,并支持按办公室、员工和项目设置预算上限。
- 插件、MCP、技能库、文件媒体工具和可配置记忆提供了较宽的扩展面,且本地 Ollama/LM Studio 路径无需模型 API 密钥。
- 核心执行仍依赖 Claude Code CLI;多模型能力并不意味着可以完全替换这一运行时,因此迁移到其他智能体框架需要较大改造。
- 平台成熟度不一致:Windows 11 标为稳定,macOS 13+ 为 beta,Linux 仍是实验性支持,Wayland 还会退化为置底全屏窗口。
- 完整功能涉及 Godot 桌面世界、Node.js 守护进程、WebView、模型连接、项目权限和可选辅助二进制,部署与排障成本高于普通聊天客户端。
- 语音转录、TTS、实时通话、图片和视频功能需要额外服务与费用;第三方模型成本多为估算值,视频生成约每段 2 美元。
- 自主会议、提案、AUTO 模式和自动触发工作流会扩大后台执行范围,采用前需要认真设置预算、通知、项目登记和审批策略。
如何安装或部署这个 Agent?
前置条件是安装 Claude Code CLI;所有员工都通过它运行,即使员工选择了第三方模型。来源明确提供的 npm 启动方式是 npx bagidea,也提供面向 Windows 的一键安装器以及处于 beta 状态的 macOS/Linux 安装路径,但给出的材料没有包含一键安装器的完整命令。安装完成后可使用 bagidea start 启动、bagidea status 检查状态,或用 bagidea doctor 排查守护进程、代理、防火墙、执行策略和 Claude Code 安装问题。Claude 登录对于只使用第三方模型的用户是可选的;对应模型仍需在设置中配置服务商连接。OpenAI 和 Gemini API 密钥不是基本运行所必需,但语音、实时通话、图像生成等完整体验需要相应密钥。
如何使用这个 Agent?
先运行 npx bagidea 完成安装或启动流程,再用 bagidea start 启动办公室。打开设置连接所需模型提供商,为每名员工选择模型、技能和工具,并只登记允许员工工作的项目目录;项目自带的 .claude 命令钩子会进入安全审批。可以在 CEO 聊天界面直接下达任务,也可使用 bagidea ask、bagidea chat 或 POST /chat;状态与成本可通过 bagidea status、bagidea stats 和界面中的 STATS、TASKS、RUNS 查看。需要自动运行时,在 Workflow Builder 中建立节点图并配置计划、Webhook、事件、文件或消息关键词触发器;审批会集中出现在 APPROVALS,并可从连接的手机渠道回应。若要调用 Codex,可启用系统工具后使用 bagidea codex "任务"、POST /codex/exec,或由 Director 发出 DELEGATE: codex @ project :: task。
这个 Agent 与同类方案有什么区别?
项目明确称其灵感来自 openclaw 的智能体办公室理念和 Hermes 的自学习技能,并表示自己把可视化办公室、技能学习、经人工批准的真实项目执行以及插件提案结合在一起。与把模型本身当作执行环境的方案不同,BagIdea Office 始终以 Claude Code 作为工具、技能和会话引擎,再为各员工替换背后的模型;这带来统一执行能力,也形成对 Claude Code 的核心依赖。