Harness for Codex
为 OpenAI Codex、Claude Code 和 Cursor 提供统一的仓库级代理指引与自动化脚本,让每次 AI 辅助开发都从可预测的基线开始。
- Star 数
- ★ 48
- 最近更新
- 4 个月前
- License
- MIT
- 主语言
- Shell
- FA 评分
- 47/100 · 缺口较多
30 秒速览
- 运行形态
- 可在哪里用
- 通用 · 跨平台Codex · Claude Code
- 费用
- 免费,无需付费服务
- 上手难度
- 低 · 几分钟可跑通
- 开始前需要
- 典型场景
- 用 Codex 起新仓库的开发者,希望从第一天就有就绪的代理指令和标准命令
- 不适合
- 需要一个能直接完成编码任务的独立 AI 产品的用户
- 希望仓库自带语言栈、测试或 CI 实现的团队
- 需要图形界面或云端托管服务的工作流
- 源码审查
- 47/100 · 缺口较多
这个 Agent 能做什么,适合哪些场景?
Harness for Codex 是一个语言无关的仓库脚手架,为编码代理提供统一的操作约定。它以 AGENTS.md 作为共享的代理指令中心,并通过 CLAUDE.md 桥接 Claude Code,使 Codex、Claude Code 和 Cursor 读取同一套规则。仓库提供 scripts/bootstrap、scripts/check、scripts/test、scripts/eval、scripts/doctor 和 scripts/hooks 六个标准入口点,外加 justfile 中的等价命令和记录规范命令名的 harness.yml。工作流围绕任务简报(tasks/TEMPLATE.md)、持久决策记录(docs/decisions.md)和完成前的 scripts/check 验证展开。可选的 dev container 会在创建后运行 scripts/bootstrap,但本地开发无需 Docker。它本身不实现 AI 代理,也不包含任何语言栈——它是一个被代理读取和执行的流程契约。
安装后,该仓库向编码代理暴露一套固定入口:scripts/bootstrap 在检测到已知技术栈时准备依赖;scripts/check 依次运行格式化、lint、类型检查和测试(如可用);scripts/test 运行测试套件;scripts/eval 作为交接门禁依次执行 doctor、bootstrap 和 check;scripts/doctor 打印仓库与工具就绪状态;scripts/hooks 通过 pre-commit 安装可选的本地钩子。OpenAI Codex 直接读取 AGENTS.md,Claude Code 读取导入同一指引的 CLAUDE.md,Cursor 可将 AGENTS.md 用作共享项目指引。harness.yml 记录规范命令名、预期文档文件和任务循环阶段,需要与 AGENTS.md 保持一致。使用者通过 tasks/TEMPLATE.md 撰写任务简报,在 docs/decisions.md 记录持久决策,并在收尾前运行 scripts/check。
- 用 Codex 起新仓库的开发者,希望从第一天就有就绪的代理指令和标准命令
- 团队同时使用 OpenAI Codex、Claude Code 和 Cursor,需要一套共享规则避免各工具行为漂移
- 自动化代理需要稳定的 setup/check/test/handoff 入口以便无人值守运行
- 维护者希望把项目决策和任务简报固定在可预测的位置,供未来代理读取
- 早期或空仓库想在以后接入任意语言栈时不必更换流程契约
如何安装或部署这个 Agent?
没有独立的安装步骤:将仓库克隆或复制为你的项目基底即可。
bash
git clone https://github.com/ganimjeong/Harness-for-codex.git your-project
cd your-project可选:如需本地钩子,运行 scripts/hooks 通过 pre-commit 安装;如需容器化环境,可用附带的 .devcontainer/devcontainer.(它会在创建后运行 scripts/bootstrap),本地开发无需 Docker。
如何使用这个 Agent?
首次运行建议先体检再验证:
bash
scripts/bootstrap
scripts/check
scripts/doctor日常工作中:需要上下文时在 tasks/ 用 TEMPLATE.md 写任务简报;实现改动;在 docs/decisions.md 记录持久决策;收尾前运行 scripts/check。交接前的完整评估用:
bash
scripts/eval如果你使用 just,可以用等价命令:
bash
just check
just eval这个 Agent 有哪些优点和局限?
- 一套 AGENTS.md 同时覆盖 Codex、Claude Code 和 Cursor,通过 CLAUDE.md 桥接避免规则重复维护
- doctor/bootstrap/check/eval 的分层脚本设计让 eval 成为完整交接门禁,适合无人值守代理流程
- harness.yml 显式记录规范命令与任务循环阶段,使契约可审计、可对齐
- 语言无关设计:以后接入任何语言栈都无需更换 harness 约定
- 仓库本身不含任何语言栈或测试实现——脚本只是空仓库的安全默认值,需自行扩展
- 价值依赖于所用代理(Codex/Claude Code/Cursor)是否遵守 AGENTS.md 约定,没有强制执行机制
- 可选钩子依赖 pre-commit,容器路径依赖 Docker,均为额外环境要求
- 没有缓存到额外的仓库级指引,适配细节需读者自行从 README 与脚本推断
这个 Agent 与同类方案有什么区别?
与相关度最高的同类 agent 并排比较关键指标。
| Agent | 源码审查 | 形态 / 费用 | Star | 最近更新 | 主语言 | 完整支持的平台 |
|---|---|---|---|---|---|---|
| Harness for Codex 当前 | 47 · 缺口较多 | Agent 插件 / 技能免费 | ★ 48 | 4 个月前 | Shell | Codex · Claude Code |
| CoCo Super Intelligence | 69 · 存在缺口 | Agent 插件 / 技能免费 + 模型费 | ★ 538 | 今天 | HTML | Codex · Claude Code |
| Self-Learning Skills | 56 · 缺口较多 | Agent 插件 / 技能免费 + 模型费 | ★ 959 | 13 天前 | — | Codex · Claude Code |
| Loop Library: 可复用 AI Agent 工作流库 | 61 · 存在缺口 | Agent 插件 / 技能免费 | ★ 3.2k | 16 天前 | JavaScript | Codex · Claude Code |
FollowAgents 如何评估这个 Agent?
查看各维度的扣分理由
证据仅含 README、LICENSE 与 CI 工作流。CI 权限最小化(contents: read、超时、并发取消)值得肯定,但 scripts/bootstrap、scripts/check、pre-commit 钩子等会执行任意命令的脚本源码未提供,最小权限、敏感数据处理、回滚等只能按'有声称无验证'记 1。未发现恶意行为,无红线。
README 声称脚本在空仓库也是'安全默认',但脚本实现不可见,无法核实失败信息、依赖缺失时的行为或文档与实现的自洽性,各记 1。
受众与场景说明较清晰(Codex/Claude/Cursor、多语言通用、可选 devcontainer、justfile),记 2;但能力边界、触发精度仅靠'随项目增长自行扩展'一句带过,记 1。
目录结构、命令命名、安装说明、harness.yml 元数据在 README 中描述清楚,记 2;许可为完整 MIT 文本,记 3;但无 CHANGELOG/版本策略、无 FAQ/示例、无已知限制文档、维护者责任与更新路径无说明,均记 1。
统一入口命令、任务模板、决策日志对多智能体工作流有实际边际价值,可用性尚可,各记 2;但本仓库主要为脚手架,收益依赖下游团队落地,未给出更充分的证据支持更高分。
README 引用 harness.yml、AGENTS.md、scripts/ 等文件均不在提供的证据中,交叉印证不可行,记 1;陈述基本为可验证的事实性描述而非营销渲染,事实与推断区分尚可,记 2;关键命令行为无法追溯到源码,记 1。
- 仅基于静态 README/LICENSE/CI 证据评审,未看到脚本与 AGENTS.md 实际内容,核心安全属性(权限、副作用、回滚)未经验证。
- 使用前请人工审阅 scripts/bootstrap、scripts/check、scripts/hooks 与 harness.yml,确认其不会执行不可信网络内容或修改仓库外文件。
- 该仓库无版本发布、变更日志与维护承诺说明,采用时应有锁定 revision 的策略。
- 发布者未经验证,身份未知;生产使用前应另行核验来源。