Cezar — AI 编码代理编排器
一个控制中心并行编排 Claude Code、Codex、OpenCode 等 AI 编码代理,本地或 24/7 在自己的服务器上运行。
- Star 数
- ★ 261
- 最近更新
- 今天
- License
- MIT
- 主语言
- TypeScript
- FA 评分
- 63/100 · 存在缺口
30 秒速览
- 运行形态
- 可在哪里用
- 通用 · 跨平台Codex · Claude Code
- 费用
- 免费,无需付费服务
- 上手难度
- 低 · 几分钟可跑通
- 开始前需要
- 典型场景
- 单人开发者想在多个仓库上同时跑多个编码代理,让它们各自在独立 worktree 中处理不同任务。
- 不适合
- 只想在 Slack/IM 里聊着用、不需要 Web 操作台的团队
- 不愿让代理直接改动代码仓库或使用 git worktree 的项目
- 源码审查
- 63/100 · 存在缺口
这个 Agent 能做什么,适合哪些场景?
Cezar 是 open-mercato/cezar 仓库提供的开源编排器与代理开发环境(ADE),通过一个 Web 操作台同时运行多个 AI 编码代理。它复用你已登录的 claude、codex、opencode 或 pi 命令行登录态,无需额外 API 密钥。每个任务在独立的 git worktree 中执行,多个代理可并行工作,多余任务进入队列。工作流以简短的 YAML 文件定义,技能是 Markdown 文件,可按步骤混用不同代理;运行过程实时流式展示代理输出、工具调用、token 和费用。它无需数据库,全部状态以普通文件保存在 .ai/cezar/ 目录,可用 npx cezar-run 在本地启动,也可用 server-install 命令部署到 Ubuntu VPS 上实现 24/7 运行,并通过手机响应式界面随时查看。
Cezar 读取任务描述(手动输入、附带文件或来自 GitHub issue / Jira / Linear),在新 git worktree 中按 YAML 工作流(如内置 quick-task)执行代理步骤和 shell 检查。典型工作流如下:
yaml
name: fix-and-verifysteps:
- id: implement
prompt: "{{task}}"
skill: project-conventions
runner: codex
- id: verify
command: "npm test"
onFail: { retry: implement, max: 2 }它调用本机已登录的代理 CLI 执行步骤,失败时自动重试并回传错误;操作台实时流式展示每一步、工具调用、token 与费用。支持同一任务运行 ×2/×3 变体并对比 diff,代理可向子任务委派独立工作(父任务最多 4 个并发子任务),也可接入 Automations 按时间表或 GitHub/tracker 事件自动启动任务。所有内容(工作流、技能、任务状态)以纯文件形式存放在 .ai/cezar/,结果以 diff 审阅,可发送备注或打开草稿 PR,但任何内容都不会自动合并。
- 单人开发者想在多个仓库上同时跑多个编码代理,让它们各自在独立 worktree 中处理不同任务。
- 远程/自由职业开发者把 Cezar 部署到 VPS 上,合上笔记本后代理继续 24/7 工作,用手机随时审查 diff。
- 维护开源项目的维护者一键把 GitHub issue 交给代理处理,并人工审查草稿 PR。
- 使用 Jira 或 Linear 的团队从工单直接启动工作流,并按事件触发自动任务。
- 想比较不同方案的开发者将同一任务运行 ×2/×3,对比 diff 后保留最优结果。
- 团队想追踪各项目的 token 消耗与报告费用,通过 Usage & cost 面板汇总分析。
如何安装或部署这个 Agent?
前提:Node 20+,以及至少一个已登录的代理 CLI(Claude Code、Codex、OpenCode 或 pi);git 和 gh 可选。无需数据库或 API 密钥。
bash
cd your-repo
npx cezar-run这会在 http://localhost:4321 打开操作台。想先体验可运行:
bash
CEZ_DRY_RUN=1 npx cezar-run(使用内置 mock 代理,无需登录。)部署到服务器:
bash
npx cezar-run server-install --platform ubuntu-vps该命令配置 HTTPS、登录和系统服务,可从任何地方(包括手机)访问操作台。文档另有 macOS + ngrok 部署指南。
如何使用这个 Agent?
在操作台输入任务、选择工作流后点击 Start,或用命令行无头运行:
bash
npx cezar-run run "add a -- flag to the export command"初始化项目脚手架:
bash
npx cezar-run init尝试夜间构建:
bash
npx cezar-run@nightly自定义工作流是 .ai/cezar/workflows/ 下的 YAML 文件,技能是 .ai/skills 下的 Markdown 文件;工作流可在界面中拖拽构建并保存为 YAML。每步可通过 runner 字段指定不同代理,命令步骤以退出码 0 判定通过。还可连接 GitHub、Jira 或 Linear,从 issue/工单一键启动任务,或在 Automations 中设置定时与事件触发。
这个 Agent 有哪些优点和局限?
- 复用现有代理 CLI 登录态,无需 API 密钥,直接跑 Claude Code、Codex、OpenCode 或 pi。
- 每个任务独立 git worktree,多代理真正并行,且支持父子任务委派(最多 4 个并发子任务)。
- 实时流式展示代理文本、工具调用、token 与费用,可按项目对比成本。
- Automations 支持定时任务和 GitHub/tracker 事件触发,配合 VPS 部署实现 24/7 运行。
- 无数据库依赖,全部状态为 .ai/cezar/ 下的纯文件,易备份、易理解。
- 需要 Node 20+ 并已登录至少一个代理 CLI(claude、codex、opencode 或 pi),没有这些 CLI 就无法运行真实任务。
- 父任务最多 4 个并发子任务,预算需父子共享,大规模并行的团队可能受限。
- 采用你自己的 Claude/Codex/OpenCode 订阅额度,重度使用时代理用量成本由用户承担(软件本身免费)。
- 复杂行为依赖手写或拖拽生成的 YAML 工作流与 Markdown 技能,初次使用需学习其格式。
- 云端 sandbox(openmercatocloud.com)为推广的付费路径,但本档案信息来自 README,免费自托管之外的定价未在源中说明。
这个 Agent 与同类方案有什么区别?
README 将 Cezar 定位为 Claude Code、Codex、OpenCode、Pi 等单个编码代理 CLI 之上的编排层:这些 CLI 是它调用的执行后端,而 Cezar 提供并行调度、worktree 隔离、工作流、Automations 和统一操作台——单一 CLI 本身不具备这些能力。
与相关度最高的同类 agent 并排比较关键指标。
| Agent | 源码审查 | 形态 / 费用 | Star | 最近更新 | 主语言 | 完整支持的平台 |
|---|---|---|---|---|---|---|
| Cezar — AI 编码代理编排器 当前 | 63 · 存在缺口 | 命令行工具免费 | ★ 261 | 今天 | TypeScript | Codex · Claude Code |
| Kandev | 74 · 存在缺口 | 命令行工具免费 + 模型费 | ★ 848 | 2 天前 | Go | Codex · Claude Code |
| Solo Agent | 48 · 缺口较多 | 自托管服务免费 + 模型费 | ★ 695 | 15 天前 | Go | Codex · Claude Code |
| Emdash:并行 AI 编码代理桌面端 | 45 · 缺口较多 | 桌面应用免费 + 模型费 | ★ 5.8k | 1 天前 | TypeScript | ChatGPT · Codex · Claude Code |
FollowAgents 如何评估这个 Agent?
查看各维度的扣分理由
证据显示:本地绑定 127.0.0.1、git worktree 隔离、子任务上限 4 个、'Nothing auto-merges'、server-install/uninstall 可逆、SECURITY.md 明确威胁模型(DNS rebinding/CSRF/路径穿越),故 least_privilege、external_effects、rollback、user_confirmation 得 2。扣分点:sensitive_data_handling 仅在漏洞范围中提到 tracker secrets,无密钥存储/加密细节(1);未提供逐项权限确认机制的代码证据,user_confirmation 只到'人工审查 diff'层面。
self_consistency:README 描述的 dry-run、runs.、provider 禁用行为均与 e2e 测试断言一致(2)。dependency_availability:Node 20+、agent CLI、gh 等前置要求明确(2)。failure_messages:测试覆盖 auth 失败(provider-auth-required 事件与恢复指引)、未知平台退出码、禁用 provider 的明确报错(2)。扣分:未见核心服务器代码,无法核实运行时错误处理的广度。
audience_and_scenarios:覆盖本地、VPS、手机、GitHub/Jira/Linear 触发等多场景(2)。capability_boundaries:自主模式、子任务预算、不自动合并等边界有说明(2)。environment_fit:Node 20+、Ubuntu VPS 与 macOS+ngrok 指南、CEZ_HOME 隔离(2)。扣分:trigger_precision 仅一句'Preview event filters before enabling them',无过滤语义细节(1)。
install_notes 完整(npx、headless、server-install、dry-run),得 3。license 为完整 MIT 文本并署名,得 3。information_architecture、naming_stability(有 #851 事故及守护测试)、examples_and_faq、versioning_changelog(dist-tag 体系但未见 CHANGELOG 文件)得 2。扣分:known_limitations 仅 SECURITY.md 提到 pre-1.0,README 未列局限(1);maintenance_responsibility 有支持版本表与响应 SLA,但未说明核心维护者更替路径(2)。
output_usability:diff 审查、变体对比、实时流、使用/成本面板(2)。marginal_value:多 agent 并行编排 + worktree 隔离是相对单 agent CLI 的真实增量(2)。cost_benefit:无数据库、纯文件状态、token/成本跟踪(2)。扣分:所有效用均为静态声明,无执行验证。
claim_traceability:核心声明(包内容、bin 映射、provider 禁用、server-install 步骤)有 e2e 测试与 CI 指向(2)。cross_source_corroboration:README、package.、CI、SECURITY.md、测试相互印证(2)。扣分:fact_inference_separation——README 含营销化表述('hundreds of agents'、24/7)与事实陈述混杂,且 docs/reference.md 等关键文档未随证据提供,无法核对(1)。
- 发布者为未验证身份(open-mercato / Patryk Lewczuk),企业场景采用前请自行核实供应链。
- 项目为 pre-1.0,仅最新 minor 版本线获得安全修复;生产使用需锁定具体版本。
- 敏感数据处理(tracker token、登录凭据)仅有威胁模型描述,无存储/加密实现细节,部署前应审查源码。
- 自主模式(Autonomous)会不经确认执行到底,仅靠人工 diff 审查兜底;对关键仓库请关闭或限制使用。
- server-install 会配置 nginx、HTTPS 与系统服务(sudo),属于高影响系统变更,建议先在隔离环境验证。
- 本评审为静态审查,未执行任何测试;README 的营销性声明(如 'hundreds of agents'、24/7)未经独立验证。