开发与工程 security-auditvulnerability-scanningmulti-agentstructured-findingscode-analysispenetration-testing

Cloudflare 安全审计技能

将编码代理转变为安全审计员,通过多阶段流水线发现可利用漏洞。

FollowAgents 评估 · FARS-2.1
不推荐
52/ 100 五分制 2.6 / 5
1 2 3 4 5 6
1信任安全10 / 29 · 1.7/5

证据显示:技能设计为只读审计,不修改代码,但未明确声明权限边界;要求用户确认输出目录,但未明确要求对高风险操作确认;数据流描述清晰(输入代码库,输出报告),但未说明是否上传外部;未明确处理敏感数据(如密钥);依赖极少(仅Node.js),但未提供依赖清单或漏洞扫描;外部影响限于生成文件,但未明确文件写入范围;无回滚机制;来源归属仅通过README和LICENSE,未验证发布者。扣分:权限边界未明确,用户确认不充分,敏感数据处理未说明,无回滚。

2可靠稳定8 / 14 · 2.9/5

证据显示:文档内部一致,各阶段描述清晰;依赖仅Node.js,但未指定版本,可用性一般;失败消息未详细说明,仅提及验证器。扣分:失败消息不充分。

3适用触发12 / 18 · 3.3/5

证据显示:面向安全审计场景,受众明确;能力边界清晰(只报告可利用漏洞);触发词明确;环境要求明确(支持工具和并行子代理的编码代理)。扣分:无重大扣分。

4规范维护9 / 18 · 2.5/5

证据显示:文件结构清晰,有信息架构;安装说明详细;命名稳定;有示例和FAQ(通过README);已知限制提及(单次运行覆盖一半);MIT许可证;无版本控制或变更日志;维护责任通过联系邮箱明确。扣分:无版本控制/变更日志。

5有效结果9 / 13 · 3.5/5

证据显示:输出为结构化JSON和报告,可用性高;边际价值高(自动化安全审计);成本效益合理(零依赖,仅需Node.js)。扣分:无重大扣分。

6证据核验4 / 8 · 2.5/5

证据显示:声称基于博客和测试,但未提供具体证据;无跨源验证;事实与推断分离良好(验证阶段)。扣分:声称缺乏可追溯性,无跨源验证。

证据充分度: 评估于 2026年8月9日 审查版本 8bac42001ddd
源码中未见的安全控制:回滚或恢复路径
使用前请注意
  • 该技能会生成文件并可能覆盖现有文件,请确保在隔离环境中运行。
  • 技能未明确说明是否将代码库内容发送到外部服务,请审查其数据流。
  • 发布者身份未验证,请谨慎使用。
评估证据 [1][2]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

security-audit-skill 是 Cloudflare 发布的一个编码代理技能,用于自动化安全审计。它通过六个阶段编排多个并行代理:侦查、狩猎、验证、报告、结构化输出和独立验证。每个阶段有专门的提示文件(如 RECONNAISSANCE.md、HUNTING.md),支持多种攻击类别,包括 Web、客户端、AI/LLM 和内存安全。输出包括人类可读的报告和符合 JSON Schema 的 findings.json,并通过零依赖 Node.js 验证器 validate-findings.cjs 进行校验。该技能是 Cloudflare 漏洞发现工具的基础,强调实际可利用性和对抗性验证。它需要支持工具使用和并行子代理的编码代理。

该技能通过一系列提示文件(SKILL.md、RECONNAISSANCE.md 等)指导编码代理执行六阶段审计。首先,侦察阶段生成架构图;然后,狩猎阶段并行运行多个代理,从不同角度攻击代码库,并允许子代理深入探索;验证阶段使用独立的代理试图反驳每个发现;报告阶段生成 REPORT.md 和 FINDINGS-DETAIL.md;结构化输出阶段生成遵循 report-schema.json 的 findings.json,并用 validate-findings.cjs 进行验证;最后,独立验证阶段使用全新代理验证每个事实声明。它还支持多次运行累积,通过读取之前的 findings.json 来跳过已知问题。

  1. 安全工程师需要快速审计大型代码库,寻找可利用的漏洞。
  2. 开发团队在发布前对 Web 应用进行例行安全审查。
  3. 安全研究者对开源项目进行深入审计,并希望结果结构化且可验证。
  4. 需要以机器可读格式(如 findings.json)集成安全发现到 CI/CD 工作流。
  5. LLM 应用开发者检查其应用中与提示注入、代理或工具相关的漏洞。

这个 Agent 有哪些优点和局限?

优点
  • 对抗性验证阶段使用独立代理来消除误报,提高结果可信度。
  • 六阶段流水线系统化,覆盖多种攻击类别,包括传统和 LLM 特定漏洞。
  • 结构化输出 (findings.json) 符合 JSON Schema,便于机器解析和集成。
  • 多次运行累积,提高漏洞发现覆盖率。
局限
  • 需要支持工具使用和并行子代理的高级编码代理,可能不适用于所有模型。
  • 需要 Node.js 来运行验证脚本。
  • 文档要求每个发现必须有具体攻击场景,可能增加人工审核成本。
  • 作为技能,它依赖于宿主代理平台,不提供独立执行环境。

如何安装或部署这个 Agent?

使用 Skills CLI 安装:

npx skills add https://github.com/cloudflare/security-audit-skill --skill security-audit

如需全局安装,添加 --global 标志。需要 Node.js 用于验证脚本。

如何使用这个 Agent?

在目标代码库中启动您的编码代理,然后发出类似“security audit this codebase”的命令。技能将自动触发,并引导您指定输出目录(默认为 ~/security-audit-skill/<repo-name>/run-<N>)。确保您的代理模型支持工具使用和并行子代理。

常见问题

这个技能需要付费 API 吗?
不直接,但它需要支持工具使用和并行子代理的编码代理,这通常涉及使用商业模型 API,可能会产生成本。
它可以在任何代码库上使用吗?
技能设计为通用,但需要编码代理能够访问代码库并执行命令,因此适用于本地或远程代码库,只要代理有访问权限。
如果单个代理不支持并行子代理怎么办?
技能依赖于并行执行,如果代理不支持,将无法完整运行。可能需要在支持该功能的平台上使用。
多次运行真的会找到更多漏洞吗?
是的,测试表明单次运行只能发现多次运行总漏洞的一半左右,因此建议多次运行。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents