开发与工程 spec-driven-developmenttest-driven-developmentcode-reviewslash-commandscursorcodex

Agent Skills — 生产级工程技能包

为 AI 编码代理提供结构化工作流、质量门禁和资深工程师实践,覆盖开发全生命周期。

FollowAgents 评估 · FARS-2.1
谨慎使用
71/ 100 五分制 3.6 / 5
1 2 3 4 5 6
1信任安全18 / 29 · 3.1/5

证据显示技能包主要提供指导性工作流,不直接执行高风险操作。技能如 incremental-implementation 强调小步提交、回滚友好,security-and-hardening 强调最小权限和秘密管理,但未明确要求用户确认每个操作。数据流透明度有限,未详细说明技能如何收集或处理用户数据。依赖安全方面,使用 npx 和外部工具,但未提供依赖审计。外部影响方面,技能可能触发 git 提交、部署等,但未明确限制。回滚方面,git-workflow 和 shipping 技能提及回滚程序。来源归属方面,README 明确列出创建者和贡献者。

2可靠稳定9 / 14 · 3.2/5

技能内容自洽,各技能结构一致,但未提供运行时测试结果。依赖可用性方面,依赖外部工具如 Claude Code、npx,但未说明版本兼容性。失败消息方面,技能包含调试和错误恢复流程,但未提供具体错误消息示例。

3适用触发15 / 18 · 4.2/5

受众明确为 AI 编码代理,场景覆盖开发全生命周期。能力边界清晰,技能描述使用场景。触发条件在技能 frontmatter 中定义,但未提供精确的触发词。环境适配良好,支持多种代理和 IDE,并提供安装指南。

4规范维护14 / 18 · 3.9/5

信息架构清晰,README 提供完整目录和技能列表。安装说明详细,覆盖多种工具。命名稳定,技能名称一致。示例和 FAQ 部分存在,但未提供常见问题解答。已知限制在 README 中提及(如单技能安装的路径问题)。许可证为 MIT,版本控制通过 git 和 changelog 未明确。维护责任明确,列出团队。

5有效结果10 / 13 · 3.8/5

输出可用性高,技能提供结构化工作流和验证步骤。边际价值高,提供生产级工程实践。成本效益方面,技能为静态文件,安装和使用成本低,但需要代理支持。

6证据核验5 / 8 · 3.1/5

声明可追溯,README 引用 Google 工程实践和外部资源。跨来源佐证有限,未提供独立验证。事实与推断分离,技能区分验证步骤和推断。

证据充分度: 评估于 2026年8月9日 审查版本 7676817c12a1
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
使用前请注意
  • 技能包未明确要求用户确认每个操作,可能自动执行 git 提交等操作,需谨慎使用。
  • 依赖外部工具和 npx 安装,未提供依赖审计,存在供应链风险。
  • 数据流透明度不足,未说明技能如何处理用户数据。
评估证据 [1][2][3][4]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

Agent Skills 是一个包含 24 个技能(23 个生命周期技能 + 1 个元技能)的集合,以 Markdown 格式封装了资深工程师的工程实践。每个技能都有步骤、验证门禁和反合理化表格,通过 '定义-规划-构建-验证-审查-发布' 六个阶段组织。提供 8 个斜杠命令(如 /spec、/plan、/build、/test、/review、/webperf 等)作为入口,按需自动激活对应技能。可通过 skills CLI 安装到 70+ 代理(Claude Code、Cursor、Codex、Copilot 等),也支持原生集成。除此之外还包含 4 个代理角色(如代码审查员、测试工程师)和 7 个参考清单(如完成定义、安全清单等)。许可证为 MIT。

Agent Skills 为 AI 编码代理提供一整套可执行的工程工作流。它读取用户的请求或当前上下文,根据活动自动触发相应技能,或通过斜杠命令显式调用。例如,/spec 启动规范驱动开发技能,引导代理编写 PRD(目标、命令、结构、代码风格、测试和边界),然后 /plan 将规范分解为小任务,/build 执行增量实现(每个垂直切片实现、测试、验证、提交),/test 强制红-绿-重构测试驱动开发(80/15/5 测试金字塔),/review 进行五轴代码审查,/ship 执行发布前检查清单。技能通过 SKILL.md 文件定义,支持渐进式披露,可引用 references/ 目录下的补充清单。每个技能都有明确的验证要求,如测试通过、构建输出、运行时数据。

  1. 在开始新项目或功能时,使用 /spec 编写 PRD,确保在写代码前明确需求和边界。
  2. 当需要分解复杂任务时,使用 /plan 将规范拆分为小的、可验证的任务,并定义验收标准和依赖顺序。
  3. 在实现逻辑或修复 bug 时,使用 /build 和 /test 强制执行测试驱动开发,确保红-绿-重构循环。
  4. 在合并代码前,使用 /review 进行五轴审查,检查代码质量、尺寸和审查速度规范。
  5. 当需要审计 Web 性能时,使用 /webperf 调用 Web 性能审计员角色,测量 Core Web Vitals 并进行优化。
  6. 在准备生产发布时,使用 /ship 执行发布前检查清单、功能标志生命周期和分阶段回滚。

这个 Agent 有哪些优点和局限?

优点
  • 包含 24 个结构化技能,覆盖从规范到发布的完整生命周期,每个技能都有步骤和验证门禁。
  • 内嵌 Google 工程文化最佳实践(如 Hyrum's Law、Chesterton's Fence、trunk-based development),提供反合理化表格防止代理跳过步骤。
  • 通过 skills CLI 支持 70+ 代理,并提供多种原生集成(Claude Code、Cursor、Codex、Gemini CLI 等),易于安装和采用。
  • 提供 4 个专家代理角色(如代码审查员、安全审计员)和 7 个参考清单,增强特定场景的深度。
局限
  • 安装单个技能时,不会复制 repo 级别的 references/ 目录,导致补充清单不可用(见 issue #361),需要手动处理。
  • 对于已有大量遗留代码的团队,完整生命周期采用可能过于激进,需要渐进式采用(文档中提供了替代方案)。
  • 某些技能(如 doubt-driven-development)可能需要跨模型升级,可能增加外部 API 成本或延迟。
  • 主要面向 JavaScript/TypeScript 生态(测试模式、代码示例),其他语言可能需要自行调整。

如何安装或部署这个 Agent?

最快的方式是使用 skills CLI(支持 70+ 代理):

npx skills add addyosmani/agent-skills            # 安装全部 24 个技能
npx skills add addyosmani/agent-skills --list     # 浏览后安装

也可以单独安装:

npx skills add addyosmani/agent-skills --skill code-review-and-quality

对于 Claude Code,使用市场安装:

/plugin marketplace add addyosmani/agent-skills
/plugin install agent-skills@addy-agent-skills

对于 Cursor,将技能文件夹复制到 .cursor/skills/;对于 Codex,使用 codex plugin marketplace add addyosmani/agent-skillscodex plugin add agent-skills@agent-skills;对于其他代理,查看 docs 中的详细指南。

如何使用这个 Agent?

安装后,技能会基于活动自动触发,或通过斜杠命令使用。例如,在 Claude Code 中输入 /spec 开始规范阶段,/build auto 可自动生成计划并执行所有任务(需一次批准)。技能是纯 Markdown,可被任何接受系统提示或指令文件的代理使用。建议阅读 docs/getting-started.md 和 docs/adoption-guide.md 了解完整工作流和采用策略。

这个 Agent 与同类方案有什么区别?

与 Superpowers(obra/superpowers)和 Matt Pocock's skills(mattpocock/skills)并列。文档 docs/comparison.md 提供了诚实的对比,包括三者形状差异、适用场景,以及一个受控的 head-to-head 实验链接。

常见问题

这些技能与普通的提示词或规则文件有何不同?
技能是结构化工作流,包含步骤、验证门禁和反合理化表格,强制代理遵循特定流程,而不是空泛建议。它们还支持渐进式披露,按需加载补充参考。
我能否只安装部分技能,而不是全部?
可以,使用 npx skills add addyosmani/agent-skills --skill <skill-name> 安装单个技能。但注意,单个安装不包含 references/ 目录,可能导致某些技能功能不完整。
这些技能是否会强制代理执行许多额外步骤,拖慢开发?
设计目标是平衡严格性和效率。例如,/build auto 允许你一次性批准计划,然后代理自动执行所有任务,减少了人工干预点,但每个任务仍保持测试驱动和单独提交。
是否有任何许可或商业限制?
没有,仓库使用 MIT 许可证,你可以自由用于个人或商业项目。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents