Harness for Codex

为 OpenAI Codex、Claude Code 和 Cursor 提供统一的仓库级代理指引与自动化脚本,让每次 AI 辅助开发都从可预测的基线开始。

Star 数
★ 48
最近更新
4 个月前
License
MIT
主语言
Shell

30 秒速览

运行形态
Agent 插件 / 技能命令行工具
可在哪里用
通用 · 跨平台Codex · Claude Code
费用
免费,无需付费服务
上手难度
低 · 几分钟可跑通
开始前需要
pre-commit(可选钩子)Docker(可选 dev container)Shell / 命令行
典型场景
用 Codex 起新仓库的开发者,希望从第一天就有就绪的代理指令和标准命令
不适合
  • 需要一个能直接完成编码任务的独立 AI 产品的用户
  • 希望仓库自带语言栈、测试或 CI 实现的团队
  • 需要图形界面或云端托管服务的工作流

这个 Agent 能做什么,适合哪些场景?

Harness for Codex 是一个语言无关的仓库脚手架,为编码代理提供统一的操作约定。它以 AGENTS.md 作为共享的代理指令中心,并通过 CLAUDE.md 桥接 Claude Code,使 Codex、Claude Code 和 Cursor 读取同一套规则。仓库提供 scripts/bootstrap、scripts/check、scripts/test、scripts/eval、scripts/doctor 和 scripts/hooks 六个标准入口点,外加 justfile 中的等价命令和记录规范命令名的 harness.yml。工作流围绕任务简报(tasks/TEMPLATE.md)、持久决策记录(docs/decisions.md)和完成前的 scripts/check 验证展开。可选的 dev container 会在创建后运行 scripts/bootstrap,但本地开发无需 Docker。它本身不实现 AI 代理,也不包含任何语言栈——它是一个被代理读取和执行的流程契约。

安装后,该仓库向编码代理暴露一套固定入口:scripts/bootstrap 在检测到已知技术栈时准备依赖;scripts/check 依次运行格式化、lint、类型检查和测试(如可用);scripts/test 运行测试套件;scripts/eval 作为交接门禁依次执行 doctor、bootstrap 和 check;scripts/doctor 打印仓库与工具就绪状态;scripts/hooks 通过 pre-commit 安装可选的本地钩子。OpenAI Codex 直接读取 AGENTS.md,Claude Code 读取导入同一指引的 CLAUDE.md,Cursor 可将 AGENTS.md 用作共享项目指引。harness.yml 记录规范命令名、预期文档文件和任务循环阶段,需要与 AGENTS.md 保持一致。使用者通过 tasks/TEMPLATE.md 撰写任务简报,在 docs/decisions.md 记录持久决策,并在收尾前运行 scripts/check。

  1. 用 Codex 起新仓库的开发者,希望从第一天就有就绪的代理指令和标准命令
  2. 团队同时使用 OpenAI Codex、Claude Code 和 Cursor,需要一套共享规则避免各工具行为漂移
  3. 自动化代理需要稳定的 setup/check/test/handoff 入口以便无人值守运行
  4. 维护者希望把项目决策和任务简报固定在可预测的位置,供未来代理读取
  5. 早期或空仓库想在以后接入任意语言栈时不必更换流程契约

如何安装或部署这个 Agent?

没有独立的安装步骤:将仓库克隆或复制为你的项目基底即可。

bash

git clone https://github.com/ganimjeong/Harness-for-codex.git your-project
cd your-project

可选:如需本地钩子,运行 scripts/hooks 通过 pre-commit 安装;如需容器化环境,可用附带的 .devcontainer/devcontainer.(它会在创建后运行 scripts/bootstrap),本地开发无需 Docker。

如何使用这个 Agent?

首次运行建议先体检再验证:

bash

scripts/bootstrap
scripts/check
scripts/doctor

日常工作中:需要上下文时在 tasks/ 用 TEMPLATE.md 写任务简报;实现改动;在 docs/decisions.md 记录持久决策;收尾前运行 scripts/check。交接前的完整评估用:

bash

scripts/eval

如果你使用 just,可以用等价命令:

bash

just check
just eval

这个 Agent 有哪些优点和局限?

优点
  • 一套 AGENTS.md 同时覆盖 Codex、Claude Code 和 Cursor,通过 CLAUDE.md 桥接避免规则重复维护
  • doctor/bootstrap/check/eval 的分层脚本设计让 eval 成为完整交接门禁,适合无人值守代理流程
  • harness.yml 显式记录规范命令与任务循环阶段,使契约可审计、可对齐
  • 语言无关设计:以后接入任何语言栈都无需更换 harness 约定
局限
  • 仓库本身不含任何语言栈或测试实现——脚本只是空仓库的安全默认值,需自行扩展
  • 价值依赖于所用代理(Codex/Claude Code/Cursor)是否遵守 AGENTS.md 约定,没有强制执行机制
  • 可选钩子依赖 pre-commit,容器路径依赖 Docker,均为额外环境要求
  • 没有缓存到额外的仓库级指引,适配细节需读者自行从 README 与脚本推断

这个 Agent 与同类方案有什么区别?

与相关度最高的同类 agent 并排比较关键指标。

Agent 源码审查 形态 / 费用 Star 最近更新 主语言 完整支持的平台
Harness for Codex 当前 47 · 缺口较多 Agent 插件 / 技能免费 ★ 48 4 个月前 Shell Codex · Claude Code
CoCo Super Intelligence 69 · 存在缺口 Agent 插件 / 技能免费 + 模型费 ★ 538 今天 HTML Codex · Claude Code
Self-Learning Skills 56 · 缺口较多 Agent 插件 / 技能免费 + 模型费 ★ 959 13 天前 — Codex · Claude Code
Loop Library: 可复用 AI Agent 工作流库 61 · 存在缺口 Agent 插件 / 技能免费 ★ 3.2k 16 天前 JavaScript Codex · Claude Code

FollowAgents 如何评估这个 Agent?

FollowAgents 源码审查 · FARS-2.1
缺口较多
47/ 100 五分制 2.4 / 5
信任安全 10/29
可靠稳定 5/14
适用触发 9/18
规范维护 10/18
有效结果 9/13
证据核验 4/8
查看各维度的扣分理由
信任安全10 / 29 · 1.7/5

证据仅含 README、LICENSE 与 CI 工作流。CI 权限最小化(contents: read、超时、并发取消)值得肯定,但 scripts/bootstrap、scripts/check、pre-commit 钩子等会执行任意命令的脚本源码未提供,最小权限、敏感数据处理、回滚等只能按'有声称无验证'记 1。未发现恶意行为,无红线。

可靠稳定5 / 14 · 1.8/5

README 声称脚本在空仓库也是'安全默认',但脚本实现不可见,无法核实失败信息、依赖缺失时的行为或文档与实现的自洽性,各记 1。

适用触发9 / 18 · 2.5/5

受众与场景说明较清晰(Codex/Claude/Cursor、多语言通用、可选 devcontainer、justfile),记 2;但能力边界、触发精度仅靠'随项目增长自行扩展'一句带过,记 1。

规范维护10 / 18 · 2.8/5

目录结构、命令命名、安装说明、harness.yml 元数据在 README 中描述清楚,记 2;许可为完整 MIT 文本,记 3;但无 CHANGELOG/版本策略、无 FAQ/示例、无已知限制文档、维护者责任与更新路径无说明,均记 1。

有效结果9 / 13 · 3.5/5

统一入口命令、任务模板、决策日志对多智能体工作流有实际边际价值,可用性尚可,各记 2;但本仓库主要为脚手架,收益依赖下游团队落地,未给出更充分的证据支持更高分。

证据核验4 / 8 · 2.5/5

README 引用 harness.yml、AGENTS.md、scripts/ 等文件均不在提供的证据中,交叉印证不可行,记 1;陈述基本为可验证的事实性描述而非营销渲染,事实与推断区分尚可,记 2;关键命令行为无法追溯到源码,记 1。

风险与缓解建议
  • 仅基于静态 README/LICENSE/CI 证据评审,未看到脚本与 AGENTS.md 实际内容,核心安全属性(权限、副作用、回滚)未经验证。
  • 使用前请人工审阅 scripts/bootstrap、scripts/check、scripts/hooks 与 harness.yml,确认其不会执行不可信网络内容或修改仓库外文件。
  • 该仓库无版本发布、变更日志与维护承诺说明,采用时应有锁定 revision 的策略。
  • 发布者未经验证,身份未知;生产使用前应另行核验来源。
证据充分度:低 评估于 2026年9月27日 审查版本 5f9f63b23af5
查看完整评分方法 →

常见问题

它是免费的吗?需要 API 密钥吗?
仓库以 MIT 许可发布,harness 本身免费且无需密钥;但它只是流程脚手架,实际的编码能力来自你选择的代理(Codex、Claude Code、Cursor),这些工具自身的费用与本仓库无关。
我必须用 Docker 吗?
不需要。dev container 是可选项;本地开发无需 Docker 即可运行所有脚本。
它支持哪些 AI 工具?
README 明确列出 OpenAI Codex(读 AGENTS.md)、Claude Code(读导入同一指引的 CLAUDE.md)和 Cursor(可将 AGENTS.md 用作共享指引)。
scripts/check 在空仓库里会做什么?
脚本是为空仓库或早期仓库设计的安全默认值:当检测到可用的格式化、lint、类型检查或测试工具时才运行对应检查,否则静默通过。随着项目增长再扩展。
如何保证代理行为一致?
把共享规则集中在 AGENTS.md,让各工具读取同一份指引;仅在工具需要不同桥接时添加工具专属文件,并用 harness.yml 对齐命令名和文档约定。
在 GitHub 查看 ↗ 安装 ↓

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents