自动化与运维 devopsopencodegit-worktreesclimcpmulti-agent-orchestrationsecurity-hardeningmodel-routing

AI DevOps 框架(aidevops)

为 OpenCode 提供插件化的 AI DevOps 自动化:让 AI 跨代码、基础设施、业务与内容项目持续交付成果,而不只是一次性对话。

FollowAgents 评估 · FARS-2.1
谨慎使用
65/ 100 五分制 3.3 / 5
1 2 3 4 5 6
1信任安全18 / 29 · 3.1/5

证据显示较强的安全设计:source-access 的 sudo 签名审批绑定会话与内容摘要、ai-approved 标签的 admin 权限门、secretlint 依赖扫描、gopass 加密密钥管理。但整体能力面极大(凭证访问、基础设施修改、pulse 自动合并 PR、auto-update),README 自己承认"强大的基础设施访问"且责任转嫁给用户;external_effects 仅按文档声明 dry-run/回滚,无法静态验证自动派发与合并守卫的实际强度,故扣分。

2可靠稳定9 / 14 · 3.2/5

测试文件存在且具确定性隔离(tempdir、无网络分支的 characterisation 测试),CLI 输出有结构化约定(OK:/ERROR:/SKIP:),AGENTS.md 字节棘轮与引用校验工作流保证自洽。但依赖 dspy==3.1.0b1(beta 版)且已知 diskcache 无补丁版本的传递依赖悬而未决,扣分。

3适用触发10 / 18 · 2.8/5

受众明确(使用 OpenCode 的开发者/业务用户),安装与平台约束清楚(darwin/linux、node>=20),触发通过斜杠命令与 agent picker,边界较精确。但框架声称覆盖"每个业务领域",capable 边界过宽而证据只覆盖部分域文档路径,"100x"目标被自己标注为未证实,capability_boundaries 扣分。

4规范维护14 / 18 · 3.9/5

信息架构极佳:AI-CONTEXT 块、purpose.md、DESIGN.md、精确 inventory 计数与可审计脚本、SPDX 头、LICENSE、SECURITY.md、语义版本 3.32.335 与多渠道发布徽章。install_notes 有 npm/Homebrew 路径但针对如此复杂系统(OpenCode 插件+CLI+模型路由)的安装先决条件描述较薄;维护责任仅指向单一作者与邮件漏洞报告渠道,扣分。

5有效结果9 / 13 · 3.5/5

输出可用性有证据(报告渲染管线、证据徽章 verified/partial/inferred/missing、结构化 CLI 输出);边际价值主张(token 效率、模型分层路由、上下文压缩控制)具体且可操作;成本收益被诚实处理("订阅节省不保证"、"非保证结果")。但所有这些均未经执行验证,且学习成本巨大(2000+ 脚本、100+ 命令),保守扣分。

6证据核验5 / 8 · 3.1/5

主张大量绑定到具体文件路径与行号、inventory 可用脚本审计、README 明确区分"measured"与"ambition to substantiate, not a guaranteed result"、评测声明自我限定"不是排行榜优越性主张",事实与推断分离做得好。但仓库内无法交叉验证外部徽章数据与封存回放结果,静态审查无法确认引用文档内容的准确性,扣分。

证据充分度: 评估于 2026年9月7日 审查版本 6c2ff012a206
使用前请注意
  • 框架授予 AI 对凭证、基础设施和外部 API 的广泛访问权;请在隔离环境小范围试用,先审阅 pulse/自动合并与 auto-update 的默认行为再启用。
  • dspy 依赖为 beta 版且存在已知的未修复传递依赖(diskcache),生产使用前自行评估供应链风险。
  • 静态审查未执行任何命令或测试;README 中的"100x"、模型路由收益等性能主张均未经本评估验证。
  • source-access 审批依赖 sudo 与 12 小时过期机制,部署前请自行核对其脚本逻辑与主机加固策略匹配。
  • 仅支持 macOS/Linux;维护高度依赖单一作者,企业采用应有应急分叉预案。
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

aidevops(marcusquinn/aidevops,MIT 许可,npm 包名 aidevops)是一个 OpenCode 插件和 AI DevOps 框架,于 2025 年 11 月 9 日由 Marcus Quinn 创立。它包含 14 个主代理(Build+、Automate、Product、SEO、Marketing-Sales 等)、2,200+ 个可单独调用的 Markdown 子代理模块、2,000+ 个辅助脚本和 100+ 个斜杠命令。技术栈以 Bash 脚本和 TypeScript(Bun)为主,配合 20 个 MCP 服务器和 30+ API 服务集成。框架强调令牌效率(按任务层级路由模型)、秘密管理(gopass 加密,不进聊天上下文)、worktree 隔离并行工作、以及 Pulse 监督循环(每 2 分钟调度 worker、合并就绪 PR、恢复卡死任务)。部署边界在本地:安装到 ~/.aidevops/agents/,通过 aidevops CLI 管理项目注册、更新与安全扫描。作者声明"让用户能力提升 100 倍"是需要验证的目标而非保证结果。

核心操作包括: aidevops init 在任意 git 仓库中初始化特性集(planning、git-workflow、code-quality、security、beads 等),生成 .aidevops.、.agents/AGENTS.md、TODO.md、PLANS.md 等文件; aidevops secret 通过 gopass 加密管理凭据,aidevops security 执行安全态势、明文秘密检测与供应链扫描; aidevops model-accounts-pool 管理 OpenAI、Anthropic、Cursor、Google 的 OAuth 账户池,支持轮换与冷却恢复; /pulse 运行自主监督循环,/mission 将高层目标拆为里程碑并自动派发、验证、推进; /cross-review 将同一提示并行发给多模型并对比结果,破坏性操作由第二家提供商的模型复核; 工作通过 git worktree 隔离,任务状态存于 SQLite 与 Markdown 源文件,Beads 提供任务依赖图可视化。报告能力可将证据包渲染为带 verified/partial/inferred/missing 标记的 HTML/PDF 报告。

  1. 独立开发者希望 AI 在多个仓库中并行完成功能开发、代码审查与发布,同时保护 main 分支并自动管理 PR
  2. 单人运营者需要 AI 代管 DNS、部署、监控、SEO 与邮件送达性检查等网站运维事务
  3. 团队希望用预算跟踪与多模型复核来控制 AI 任务的 token 成本与破坏性操作风险
  4. 内容与营销从业者想让 AI 定期生成 SEO 评分卡、营销活动报告并导出为 PDF 交付客户
  5. 已有 Claude Pro/Max 或 ChatGPT 订阅、想通过 OAuth 账户池复用订阅额度而非购买 API key 的用户
  6. 需要将重复性浏览器操作、报告渲染或移动端模拟器测试固化为可复用工作流的开发者

这个 Agent 有哪些优点和局限?

优点
  • 规模化设计有据可查: 精确清点 14 个主代理、2,236 个子代理、2,017 个辅助脚本、106 个斜杠命令,并公开计数审计脚本(readme-helper.sh counts --inventory)
  • 安全设计深入: gopass 加密秘密、12 小时过期的精确路径源码读取审批、供应链依赖锁定(== 固定版本)、.pth 供应链攻击审计器、跨提供商多模型复核破坏性操作
  • 成本与上下文工程: 按任务层级路由模型(Luna 限界任务 / Terra 常规实现 / Astra 高后果推理)、300K 上下文窗口控制、每会话令牌使用报告与 API 成本重定价对比
  • 工程化执行闭环: worktree 隔离、Pulse 每 2 分钟监督、mission 预算跟踪、SQLite 可观测性记录与因果 worker 谱系
局限
  • 强依赖 OpenCode 运行时: 所有功能"为 OpenCode 优先设计和测试",其他 AI 编码工具仅通过指针文件(.cursorrules 等)被引导,并未被安装或配置
  • 推荐模型组合为 OpenAI GPT-5.6 Luna/Terra 与 GPT-6 Astra——文档中这些模型名的真实性需自行核实;Claude 模型仅作为受支持的后备
  • 安装与运行面广: 需要本地 shell、gopass、gh、Git worktree、可选 launchd 定时器等,setup 还会主动安装推荐工具链(Tabby、Zed、Oh My Zsh 等),对现有环境侵入较大
  • README 明确声明"100x 能力提升"是未经验证的雄心而非测量结果;本地 harness 评估也只是"试点"而非排行榜级证据
  • Claude Code 集成包含跳过权限提示的别名(claude --dangerously-skip-permissions),需要用户自行评估风险

如何安装或部署这个 Agent?

推荐方式: npm install -g aidevops && aidevops update(npm 安装不执行 postinstall 输出,update 会把代理部署到 ~/.aidevops/agents/)。 备选: bun install -g aidevops && aidevops update; brew install marcusquinn/tap/aidevops && aidevops update; bash <(curl -fsSL https://aidevops.sh/install); 或 git clone https://github.com/marcusquinn/aidevops.git ~/Git/aidevops 后运行 ~/Git/aidevops/setup.sh。setup 脚本会安装 aidevops CLI、配置 AI 助手,并默认安装 RTK 等令牌效率工具。需要 OpenCode 运行时;认证用 aidevops model-accounts-pool add openai 或 add anthropic(浏览器 OAuth,无需 API key),添加后重启 OpenCode。

如何使用这个 Agent?

  1. 安装后运行 aidevops status 和 aidevops doctor 检查安装健康。 2. 在目标项目中运行 aidevops init(可选 planning、git-workflow、beads 等特性参数)。 3. 启动 OpenCode,输入 /onboarding 交互式配置服务;之后在新仓库运行 /setup-git 配置 per-repo 平台秘密(如 SYNC_PAT)。 4. 日常通过斜杠命令工作: /pulse 运行监督循环、 /mission 拆解项目、 /review 与 /cross-review 做审查、 /skills recommend "TASK" 发现能力、 /report-render 渲染报告。 5. 维护命令: aidevops update 更新框架并检查注册项目,aidevops auto-update 管理自动轮询,aidevops security 定期做安全扫描。若遇"Anthropic Key Missing"等认证问题,用 aidevops model-accounts-pool status/check/rotate 排查。

这个 Agent 与同类方案有什么区别?

README 将自己定位为超越"单任务 AI harness"的方案——普通 AI 工具只擅长单个任务,aidevops 专注周边纪律:上下文管理、路由、安全、git 卫生、协作、验证与记忆。它与 Claude Code 的关系是兼容而非竞争:Claude 模型仍是受支持的后备提供商,且 aidevops 会在安装 Claude Code 时添加权限跳过别名。文档未点名其他具体竞品。

常见问题

我必须订阅哪些模型服务?
无强制。推荐 OpenCode + OpenAI GPT-5.6 Luna/Terra 和 GPT-6 Astra 路由;已有 Claude Pro/Max 订阅者可零边际成本通过 Anthropic OAuth 使用;OpenCode Zen 提供免费模型无需任何 API key。Cursor Pro 和 Google AI Pro/Ultra/Workspace 也可通过账户池接入。
它会动我的凭据吗?
凭据通过 gopass 加密管理,aidevops 的设计目标是让秘密不进入聊天上下文。security scan 只报告明文凭据的位置和键名,绝不暴露值本身。Vault 通行短语丢失不可恢复,需自行备份;所有修复命令应在 AI 聊天之外的终端运行。
如果 AI 任务卡死或失败会怎样?
Pulse 监督循环每 2 分钟检查一次,会终止卡死进程、检测孤儿 PR、识别 review-bot 陷阱并做恢复。worker 诊断有失败分类体系,运行时可观测性数据库记录生命周期状态与因果谱系。
可以在自己的商业项目中使用吗?
可以。MIT 许可允许包括商业用途在内的复用,条件是保留版权与许可声明;构建衍生框架或商业产品需按 ATTRIBUTION.md 提供声明的署名。
需要长期人工值守吗?
设计目标是最小化值守:Pulse 可自动派发、合并、恢复,mission 可多日自主推进。但源码读取审批、破坏性操作复核、安全修复等环节仍明确要求人工在附端终端确认,且安全命令不得在 AI 聊天会话内运行。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents