开发与工程 agent-orchestrationmulti-agentcode-reviewquality-gatesworkflow-automationautonomous-loop

OPC —— 一人公司

把 21 个角色、6 套流程模板塞进一个 Claude Code skill,用代码强制的质量门禁替你完成构建、审查与验收。

FollowAgents 评估 · FARS-2.1
不推荐
48/ 100 五分制 2.4 / 5
1 2 3 4 5 6
按维度查看评分与理由
1信任安全12 / 29 · 2.1/5

README 描述了 write nonce、原子写入、plan 完整性哈希、审查独立性、tick 上限、震荡检测等代码级守卫,方向正确;但仓库未提供任何权限清单或最小权限声明,`/opc pass` 可强制通过门禁、`/opc loop` 可无人值守运行 10+ 小时并调度持久 cron,属于高外部影响能力却缺少显式确认与影响范围说明;数据流(会话写入 ~/.opc/sessions、扩展 hook 执行)仅在 README 层面提及,无敏感数据处理策略;依赖面较小(核心运行时无 npm 依赖,Node>=18),但 postinstall 脚本自动复制文件到 ~/.claude/skills 属隐式外部写入,且 npm 默认拦截脚本的说明本身即承认该副作用。扣分点:无权限模型、无确认机制、无数据流/敏感数据文档、外部副作用与回滚仅靠 README 断言。

2可靠稳定8 / 14 · 2.9/5

CI 在 Node 18/20 上跑 test/run-all.sh,测试文件覆盖 init-loop、complete-tick、审查独立性、JSON 崩溃恢复、backlog 累积等,且 test-audit.sh 用真实 git 仓库与伪造会话验证审计输出,说明失败路径有被测试;README 对 quick 与 build-verify 的取舍、brief 节点局限(必须测实际代码而非简报理想)有明确说明,自洽性较好。但失败信息质量无直接证据(测试脚本只断言 PASS/FAIL 计数),依赖可用性仅靠 engines 字段与“无 npm 依赖”声明,未列出可选 jq、memex、私有 opc-extensions 的缺失降级行为。扣分点:failure_messages 无证据,依赖可用性为声明而非验证。

3适用触发10 / 18 · 2.8/5

README 明确列出 5 个 flow 模板及各自适用场景(quick 仅限单文件、非 UI、无逻辑分支),并给出触发示例(review/implement/loop/-i/显式角色),触发精度描述较细;能力边界也点明 brief 节点描述的是预期行为、test-design 必须测实际代码。但环境适配仅覆盖 Claude Code + Node>=18,扩展目录、runbook 目录、模型路由均绑定 Claude Code 生态,其他宿主仅以一句“可替换模型 ID”带过,缺少跨环境验证。扣分点:environment_fit 证据薄弱。

4规范维护9 / 18 · 2.5/5

README 结构清晰(中英双语、安装、用法、守卫表、flow 表、角色、测试、要求),LICENSE 为完整 MIT 文本,package.json 有 version 0.11.0 与 files 白名单,信息架构与安装说明达标。但 CHANGELOG.md 仅被引用未在证据中呈现,版本历史不可核;命名稳定性无证据(无 API/CLI 兼容性承诺);examples 仅指向 examples/runbooks 与扩展模板,FAQ 缺失;known_limitations 只有零散提示(quick 限制、brief 局限),无集中章节;维护责任仅靠作者字段与 Discussions 链接,发布者身份未验证。扣分点:versioning_changelog、naming_stability、examples_and_faq、known_limitations、maintenance_responsibility 均证据不足。

5有效结果6 / 13 · 2.3/5

输出可用性有支撑:机械门禁(red=FAIL/yellow=ITERATE/green=PASS)、backlog.md 自动累积发现、结构化 eval 文件、审计 JSON 输出,产物形态明确;lookbook 展示 6 个真实站点作为效果佐证。但边际价值难以静态判定——21 角色、6 模板、扩展体系与 Claude Code 原生能力重叠度未说明,且核心扩展(design-intelligence 等 6 个)位于私有仓库,公开仓库单独使用时能力缩水;成本方面,多 agent 并行派发与 10+ 小时无人值守循环的 token/时间开销无任何量化。扣分点:marginal_value 与 cost_benefit 缺乏可核证据。

6证据核验3 / 8 · 1.9/5

README 的多数强主张(10+ 小时无人值守、可量化提升首次构建保真度、100+ 测试文件、零信任四层架构)均无对应证据文件或数据支撑,属断言;测试脚本本身可读且断言具体,但未在证据中展示运行结果;lookbook 链接指向外部站点,无法在静态审查中核验其由该流水线生成。事实与推断的分离尚可(README 区分了“代码强制”与“prompt 层”),但 claim_traceability 与 cross_source_corroboration 薄弱:无基准数据、无第三方复现、无版本化证据链。扣分点:核心性能与质量主张不可追溯。

证据充分度: 评估于 2026年9月18日 审查版本 f36f4838f782
使用前请注意
  • `/opc pass` 可强制通过质量门禁,`/opc loop` 可无人值守运行 10+ 小时并调度持久 cron;在授予该技能前应确认其外部影响范围与中断方式。
  • postinstall 脚本会自动向 ~/.claude/skills 写入文件;npm 默认拦截安装脚本,README 建议使用 --allow-scripts,安装前应审查 scripts/postinstall.mjs。
  • 核心扩展(design-intelligence、dataviz-x 等 6 个)位于私有仓库,公开仓库单独使用时能力与 README 展示效果可能不一致。
  • README 中“10+ 小时无人值守”“可量化提升构建保真度”“100+ 测试文件”等主张缺少可核证据,不应作为选型依据。
  • 发布者身份未经 FollowAgents 企业注册表验证,维护责任与更新路径不明确;CHANGELOG 未在证据中呈现。
评估证据 [1][2][3][4][5][6][7]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

OPC(One Person Company)是一个以 Claude Code skill 形式分发的多 agent 编排器。它内置 21 个角色(pm、designer、frontend、backend、security、tester、a11y、devil-advocate 等),按 digraph 流水线把任务分配到类型化节点(discussion / build / review / execute / gate)上执行。核心原则是「做事的 agent 永不评判自己的工作」:build 节点产出 commit,review 节点并行派发 2–5 个独立角色 subagent,gate 节点则由 opc-harness synthesize 按机械规则计算裁决(任意 red = FAIL,任意 yellow = ITERATE,全 green = PASS)。运行时分发、裁决、模型路由全部由 opc-harness 这个 Node 命令行工具承担,state 写入走 write→rename 原子操作,并通过 write nonce、plan SHA256 哈希、tick 上限、震荡检测等代码级守卫防止伪造。安装后 skill 文件落在 ~/.claude/skills/opc/,使用时用 /opc 斜杠命令调用,支持交互式、显式角色、流程跳转与无人值守 loop 模式。

一次典型运行从 /opc <自然语言需求> 开始:OPC 先做任务推断,从 quick、review、build-verify、full-stack、pre-release 五个 flow 模板中选一个,并从对齐的节点进入。build-verify 的入口是 brief 节点,产出结构化构建简报(解析后的设计令牌、文件计划、组件清单、约束);随后 build 节点实现代码并提交,code-review 节点并行派发若干独立角色 agent,test-design 与 test-execute 分别生成并执行测试,最后 gate 节点调用 opc-harness synthesize 给出 PASS / ITERATE / FAIL。ITERATE 会路由到 hotfix 再回到 test-execute;每条边最多循环 3 次,每个节点最多重入 5 次,全程 20–30 步。loop 模式(/opc loop build features F1–F4 from PLAN.md)会先用 opc-harness runbook match 在 --dir、OPC_RUNBOOKS_DIR、~/.opc/runbooks/ 中查找配方,未命中则把任务拆成 spec/implement/review/fix/e2e 原子单元,建立 done 标准,注册可跨进程重启存活的 cron,每 10 分钟跑一个单元,并在 plan 完成、tick 上限或 24 小时墙钟截止时终止。扩展方面,~/.claude/skills/opc-extension/<name>/ 下的 ext.json 与 hook.mjs 可挂载 promptAppend / verdictAppend / executeRun / artifactEmit 钩子,每个扩展有独立超时与熔断。模型路由由 opc-harness model-route 在每次 Agent 调用前解析 economy/standard/premium 三层,默认映射到 haiku/sonnet/inherit。

  1. 独立开发者想用一句话需求拿到完整可交付页面:运行 /opc build 一个带数据可视化的 SaaS 分析仪表盘,build-verify 流程会补齐 brief、独立 review 与测试环节。
  2. 需要在不熟悉的代码库里做安全审查:运行 /opc review the auth changes,OPC 并行派发 security、backend、a11y、devil-advocate 等角色,再由 gate 给出机械裁决。
  3. 想在睡觉时推进一个已有 PLAN.md 的功能批次:/opc loop build features F1-F4 from PLAN.md 会拆解单元、注册持久 cron,并在无人干预下连续推进。
  4. 小改动但不想省略质量门禁:使用 quick 模板(build → review → gate)处理单文件、非 UI、无逻辑分支的修改。
  5. 发布前的多重验收:/opc verify before release 跑 acceptance、audit、e2e 三类门禁后才允许上线。
  6. 团队想在 OPC 流程里接入自家检查:编写 opc-extension,通过 hook.mjs 注入 prompt 片段、追加裁决或产出 artifact。

这个 Agent 有哪些优点和局限?

优点
  • 机械门禁由 opc-harness synthesize 计算而非 LLM 判断,裁决规则(any red = FAIL / any yellow = ITERATE / all green = PASS)可预测、可复现。
  • 自主循环的防线写在代码里:write nonce、plan SHA256 校验、必须 git commit、UI 单元必须产出截图 artifact、并发 tick 互斥、JSON 崩溃恢复,都超出 prompt 层约束。
  • 扩展面不 fork 不重建:ext.json + hook.mjs 挂 promptAppend / verdictAppend / executeRun / artifactEmit,且有独立超时与熔断,坏扩展不会拖垮 harness。
  • 模型分层派发避免 premium 模型意外扩散:economy/standard/premium 默认映射 haiku/sonnet/inherit,inherit 与 opus 需显式批准,并会报告 CLAUDE_CODE_SUBAGENT_MODEL 覆盖。
  • 测试覆盖较厚:100+ 测试文件覆盖 init-loop、complete-tick、审查独立性、JSON 崩溃恢复、scope registry、发布打包与编排器级 E2E。
局限
  • 运行时绑定 Claude Code:文档中的安装、斜杠命令、CLAUDE_CODE_SUBAGENT_MODEL 检测都围绕 Claude Code,换宿主需要自行改造。
  • 无人值守 loop 有明确硬上限:maxTotalTicks(units×3)加 24 小时墙钟截止,长任务可能被自动终止。
  • quick 模板适用范围很窄(单文件、非 UI、无逻辑分支),带逻辑分支或多文件的改动必须走 build-verify,节点更多、开销更大。
  • 配套扩展 opc-extensions(含 design-intelligence、dataviz-x、quality-reality 等 6 个)是私有仓库,未公开就无法复用其能力。
  • npm 安装可能因默认拦截 install 脚本而跳过 skill 复制,需要手动加 --allow-scripts 或补跑 opc install,有踩坑成本。
  • 跨会话记忆依赖可选的 memex 外部项目,不装就只有单次会话内的上下文。

如何安装或部署这个 Agent?

前置条件:Claude Code(CLI、桌面应用或 IDE 扩展均可)、Node.js >= 18;核心运行时无 npm 依赖、无 MCP server、无构建步骤。npm 安装:npm install -g @touchskyer/opc,skill 文件会自动复制到 ~/.claude/skills/opc/。较新版本 npm 默认拦截 install 脚本,若 opc --version 有输出但 ~/.claude/skills/opc/SKILL.md 不存在,改用 npm install -g --allow-scripts=@touchskyer/opc,或安装后手动执行一次 opc install。不用 npm 的手动方式:git clone https://github.com/iamtouchskyer/opc.gitcp -r opc ~/.claude/skills/opc。可选:opc install-hooks 始终安装 Node 版 auto-flow guard;额外安装 jq 可启用上下文压缩 hook。可选搭配 npm install -g @touchskyer/memex 获得跨会话记忆。

如何使用这个 Agent?

安装后在 Claude Code 会话中用 /opc 斜杠命令调用:/opc review the auth changes(并行代码审查)、/opc implement user authentication with email/password(实现 + 独立 review + gate)、/opc loop build features F1-F4 from PLAN.md(无人值守循环)、/opc -i redesign the onboarding flow(先反问澄清)、/opc security devil-advocate(显式指定角色)。流程控制命令:/opc skip 跳过当前节点、/opc pass 强制通过 gate、/opc stop 终止并保留 state、/opc goto build 跳转节点。自定义角色只需往 roles/ 目录加一个带 tags/Identity/Expertise/When to Include 的 .md 文件,即刻生效无需配置。其他宿主若想替换模型,可在 agentRouting.models 中把 economy/standard/premium 换成自己的模型 ID。

常见问题

OPC 需要联网或额外服务吗?
核心运行时没有 npm 依赖、没有 MCP server、没有构建步骤,只在本地作为 Claude Code skill 运行;但 npm 安装与可选的 memex 搭配都需要网络。仓库没有说明存在自建的远端服务。
无人值守跑一整晚安全吗?
loop 有代码级守卫兜底:plan 完整性用 SHA256 校验、state 由 harness 独占写入、must-commit 与截图要求、4–6 tick 内的 A↔B 震荡检测、并发 tick 互斥,以及 maxTotalTicks 和 24 小时墙钟截止。触发任一硬边界会自动停止。
gate 裁决会不会被 LLM 说情感化?
不会。裁决由 opc-harness synthesize 按固定规则计算——任意 red 记 FAIL、任意 yellow 记 ITERATE、全绿记 PASS,LLM 不参与判断某个发现是否够重要。
能不用 Claude Code 吗?
仓库文档把 Claude Code 列为必需环境,安装路径、斜杠命令和 subagent 模型覆盖都是围绕它写的。模型分层可以在 agentRouting.models 里换成你自己的模型 ID,但换宿主仍属于需要自行适配的改造工作。
怎么接入自己团队的检查规则?
写一个扩展目录放在 ~/.claude/skills/opc-extension/<name>/,包含 ext.json 声明能力并让 hook.mjs 导出 promptAppend / verdictAppend / executeRun / artifactEmit 中的任意钩子,不需要 fork 或重新构建,单一扩展出错会被超时与熔断隔离。参考 docs/extension-authoring.md 与 examples/extensions/_starter/。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents