开发与工程 hermes-agentmodel-routinglong-term-memoryparallel-worktreescoding-workflowscli-pluginevidence-gatesprompt-calibration

Oh My Hermes(OMH)

为 Hermes Agent 加装专业运行层:按模型调优的路由、并行编码、108 个专家技能与可审计的长期记忆,一次安装即用。

FollowAgents 评估 · FARS-2.1
推荐
78/ 100 五分制 3.9 / 5
1 2 3 4 5 6
1信任安全19 / 29 · 3.3/5

证据显示较完善的权限边界:SECURITY.md 声明不静默改写 Hermes 内部、CI 权限按 job 最小化、install --dry-run、toolcall rules 与 approval tier。扣分点:这些多为声明与文档,未提供安装脚本本体供核实;数据流(模型路由到哪些 provider)依赖用户配置,README 只说保存 provider ID 不存 credential,缺乏第三方审计。记忆系统需评审人批准写入是好设计,但批准机制细节未见。

2可靠稳定14 / 14 · 5.0/5

自洽性强:多套生成文档 drift gate(docs workflows/roles/ulw --check)防止文档漂移;运行时零依赖、多渠道安装(brew/bun/npm/脚本)并互相验证;失败语义分层明确(reported done ≠ verified、cost unknown 而非 $0、拒绝静默降级)。给满分的依据是 CI 与测试文件本身证明了这些约束被强制执行。

3适用触发15 / 18 · 4.2/5

面向场景覆盖广(多语言 README、macOS/Linux/Windows、PowerShell 5.1 专项解析测试);扣分点:能力边界与触发精度主要靠文档主张(108 个技能、路由语料、negative cases),提供的文件只能看到框架性描述,无法核实语料与触发匹配的真实质量。

4规范维护15 / 18 · 4.2/5

信息架构优秀(文档地图、INSTALLATION/CAPABILITIES/WORKFLOWS/ARCHITECTURE 分层);安装说明覆盖五种渠道与卸载/回退;MIT 许可证完整;维护责任有 SECURITY.md、issue 编号与 policy owner。扣分点:无独立 CHANGELOG 文件证据、命名稳定性仅由 'never OMO' 测试间接暗示曾有改名、FAQ 与已知局限以'early'一笔带过。

5有效结果9 / 13 · 3.5/5

输出可用性有 HUD 状态分层与证据状态设计支撑;边际价值主张清晰(模型路由、长期记忆、并行 fanout)。扣分点:核心效果主张($4.29→$0.66、23→5 分钟)是静态不可验证的数字,成本收益只在 benchmark 框架内有防伪造门,未在提供文件中看到可复核的原始数据。

6证据核验6 / 8 · 3.8/5

事实/推断分离是该仓库的亮点:明确区分 preference 与 benchmark、reported done 与 verified、provider 可用性与配置结果。扣分点:关键性能数字无附带的原始 run 数据可追溯,跨源印证只覆盖机制层面(CI、schema、测试),效果层面仍依赖自报。

证据充分度: 评估于 2026年9月7日 审查版本 03f806a609e1
使用前请注意
  • 安装脚本推荐通过 curl | sh 直接执行,静态审查未能看到脚本本体;建议先下载审阅再执行。
  • README 中的成本/耗时对比数字(如 $4.29→$0.66)为自报数据,静态审查无法复核,不应作为采购依据。
  • 未验证的发布者身份:在引入企业环境前应自行审查安装器对 Hermes 配置与 PATH 的写入行为。
  • 能力主张(108 个技能、路由语料)未见原始清单,实际触发质量需实际安装后验证。
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

oh-my-hermes 是 NousResearch Hermes Agent 的一个 MIT 许可插件(GitHub: rlaope/oh-my-hermes),定位为 Hermes 原生技能之上的“运行层”,而非替代品。它把每次请求路由到九个可编辑的模型类别(如 ultrabrain、deep、quick),每类是一串“模型+推理强度”的链,并在提供商拒模型时沿链回退。编码侧提供按 13 个模型家族校准的提示词、ulw-work 并行工作流(互不相交的文件分区、固定 SHA 派生的 worktree、类型化结果),以及 108 个 omh-* 专家技能自动注入运行。它还提供带 HUD 的终端界面、阶段式 TODO,以及一个评审门控的文件型长期记忆系统,Hermes 自身记忆不被改动。核心原则是“证据先于声明”:执行器说完成只是 reported done,只有测试/评审/CI 门通过才显示 verified。

OMH 通过 omh CLI 命令安装并配置(omh setup 交互式采集本机可用的提供商并重排模型链,omh update 升级,omh doctor 体检)。运行时它在分派前对每个请求打分并选择类别链;ulw-* 工作流(ulw-interview、ulw-research、ulw-plan、ulw-work、ulw-maestro、ulw-loop、ulw-qa、ulw-perf、ulw-context)由聊天触发并由 Hermes 路由。ulw-work 将计划拆为不共享文件的单元,各自在独立 worktree 上并行执行并返回四态类型化结果。ulw-maestro 可把任务委派给 Claude Code 或 Codex CLI,每条泳道在 HUD 上单独显示模型、强度、轮次、token 与成本。模型链由 ~/.omh/routing/model-chains. 管理,可用 omh model-chains set quick "kimi-k3-ultrafast:low, glm-5.2-ultrafast:low" 直接修改;Maestro 泳道用 omh coding category-maestro set/interview 配置。长期记忆按候选捕获→评审卡→批准/拒绝写入,记录带溯源与复审到期日,下次会话获得按 token 预算裁剪的召回包。另含 codebase-uml/omh codegraph uml 结构图、refactor-plan 分阶段重构、ast-grep 结构化搜索和可自定义的 toolcall 守门规则。

  1. 已经使用 Hermes Agent、想获得更强路由与工作流而非更换智能体的开发者
  2. 需要把长任务拆成互不冲突的并行泳道并要求验证证据后才算完成的编码团队
  3. 同时持有 Claude Code 订阅、Codex 或多家模型 API、想让每个类别自动用最合适模型的用户
  4. 希望项目决策与上下文跨会话保留、且每次写入都经人工评审的长期项目维护者
  5. 需要画出仓库架构图并生成行为锁定、按 PR 分阶段落地的重构计划的工程师
  6. 想通过 Maestro 泳道在 Hermes 内显式调度 Claude Code 或 Codex 执行编码任务的用户

这个 Agent 有哪些优点和局限?

优点
  • 按请求复杂度评分路由并可沿类别链回退,README 引用的同任务对照数据显示 GPT-6 Astra 在相同答案质量下成本从 $4.29 降到 $0.66、时间从 23 分钟降到 5 分钟
  • 针对 13 个模型家族逐族校准提示词,且校准块有基准对照、无效即删(如 Astra 初版块因多花 10% 被裁)
  • 证据分级明确:reported done 与 Test · verified 分开显示,杜绝“说了完成就算完成”
  • 108 个 omh-* 专家技能随请求自动注入,无需手动调用专家
  • 长期记忆文件型、评审门控、带溯源与到期复审,且不读写 Hermes 自身记忆
  • 模型链全部用户可编辑,集中在单一 JSON 文件或通过 CLI 命令修改
局限
  • 核心依赖 NousResearch Hermes Agent 这一特定宿主,没有 Hermes 则整个运行层无用
  • README 中的模型名称(GPT-6 Astra、Claude Fable 5.1、Kimi K3 等)与成本数据仅出自项目自述,缺乏独立验证
  • Maestro 泳道、并行 fanout、校准块等高级能力带来显著配置面,omh setup 面谈与多文件(model-chains、providers、category-maestro、dispatch-models)需理解后才能掌控
  • README 自述推荐链是“可编辑偏好,不是基准结果”,实际效果依赖用户所持提供商与订阅
  • 安装脚本使用 curl | sh 远程执行,需信任仓库;智能体安装协议要求固定 commit SHA 并逐项审批,流程较重

如何安装或部署这个 Agent?

macOS/Linux: curl -fsSL https://raw.githubusercontent.com/rlaope/oh-my-hermes/main/install.sh | sh。Windows PowerShell 5.1+: irm https://raw.githubusercontent.com/rlaope/oh-my-hermes/main/install.ps1 | iex。也可用 Homebrew brew install rlaope/tap/omh、Bun bun install -g oh-my-hermes 或 npm npm install -g oh-my-hermes。安装后必须运行 omh setup 完成交互式模型与提供商配置;用 omh doctor 验证。也可将仓库提供的英文安装提示粘贴给 AI 智能体,让其先以 git ls-remote 解析 main 的完整 commit SHA,再仅执行该固定 SHA 下的 INSTALL_FOR_AGENTS.md。

如何使用这个 Agent?

运行 omh 即以 OMH 身份打开 Hermes 终端(与 hermes 同一门)。在聊天中说出触发语即可路由工作流,如让 Hermes 逐步澄清需求(ulw-interview)、做带来源的研究(ulw-research)、制定评审过的计划(ulw-plan)、并行执行(ulw-work)、循环到目标通过(ulw-loop)。用 omh model-chains show 查看生效链、omh model-chains set 修改;用 omh coding run --owner codex --category ultrabrain --goal ... 走 Maestro 泳道。让 Hermes “set up my models” 可随时审查模型配置。可编辑 ~/.omh/routing/model-chains. 覆盖默认链;OMH 只存提供商 ID,不存凭据。

这个 Agent 与同类方案有什么区别?

README 明确提及 Claude Code 和 Codex:OMH 不隐藏或取代编码执行器,而是通过 ulw-maestro 将它们作为可选的第二条委派泳道(有就绪探测、能力快照、按次模型/强度),且强调这不是默认路径;OMH 本身是 Hermes Agent 之上的运行层,与这两个 CLI 属于协作而非同类替代。

常见问题

必须先安装 Hermes Agent 吗?
是。OMH 定位为 Hermes Agent 之上的插件与运行层,omh 打开的就是 Hermes 终端;没有 Hermes 它无法作为智能体运行。
费用如何产生?
费用来自所路由模型的 API 调用。OMH 在 HUD 每行显示 token 与美元成本,成本数据引自可溯源的费率表;无法定价的调用显示 unknown 而非 $0。OMH 自身 MIT 许可、免费。
它会修改或读取我现有的 Hermes 配置和记忆吗?
安装与更新只应用文档声明的托管配置变更并保留无关现有配置;Hermes 自身记忆从不被读取或修补,OMH 的长期记忆是其独立文件型存储。
如果提供商拒绝某个模型怎么办?
调度沿该类别的模型链回退;若某个分派会继承一个无法服务该模型的提供商,请求会被拒绝而不是静默降级。
“执行器说完成”和真正的完成有什么区别?
OMH 显示 Code · reported done 表示执行器自述完成但无人复核;只有测试、评审或 CI 门实际通过才显示 Test · verified。无证据的 exit 0 会保持 reported done 直到门检查。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents