Featured image of post GitHub Trending 榜首:security-audit-skill

GitHub Trending 榜首:security-audit-skill

Cloudflare 开源的编码智能体安全审计 Skill:六阶段多智能体工作流,产出经过独立验证、机器可读的安全发现,单日新增 3100+ Star 登顶 Trending。

项目简介

cloudflare/security-audit-skill 是 Cloudflare 官方开源的"编码智能体 Skill",能把你的 AI 编码助手变成一名安全审计员。它通过编排一组相互隔离的智能体,完成侦察、覆盖度驱动的漏洞挖掘、候选验证、结构化输出、独立复核与中立报告六个阶段,最终产出经过独立验证、机器可读的安全发现。项目以 MIT 协议开源,当前 17,100+ Star、940+ Fork,单日新增 3,155 Star,登顶今日 Trending 榜首。它也是 Cloudflare 官方博客《Build your own vulnerability harness》中漏洞发现系统的单仓库起点——那套系统已演化为多阶段、面向整个基础设施的规模化体系,而这个 Skill 是它最初的形态。

六阶段工作流

  1. 侦察:梳理架构、信任边界、输入面与既有证据,写入 architecture.md 与 coverage-ledger.json;
  2. 覆盖度驱动挖掘:按账本单元派出隔离的 hunter 并记录检查项,由"覆盖度批评者"持续查找盲区;
  3. 候选验证:每个候选漏洞交给一个全新的 verifier,专门尝试证伪;
  4. 结构化输出:将 confirmed / needs_validation / rejected 三类判定写入 findings.json,并用 JSON Schema 校验;
  5. 独立复核:全新智能体验证最终记录中的源码断言,被实质性改写的结论再追加一次独立验证;
  6. 中立报告:基于已验证记录生成 REPORT.md、FINDINGS-DETAIL.md 与 NEEDS-VALIDATION.md。

判定语义非常严格:confirmed 必须有完整源码链路和有界的实际观察结果;needs_validation 只记录精确的未决事实,不带严重级别;rejected 则记录被证伪的候选。针对同一仓库的多次运行是叠加式的——Skill 会利用历史账本瞄准盲区、复验已变更的源码。

设计原则

该项目最有价值的是其克制的判定哲学:只确认"已被实证的边界破坏",源码有据但未闭环的线索一律保持 needs_validation;验证者永远不是发现者(对抗性验证);严重级别必须来自"可能性 × 影响",而非偏离清单的程度;纵深防御缺口只算加固建议,不算漏洞。官方测试数据还显示:单次运行大约只能发现重复运行累计漏洞的一半——多轮运行才是完整打开方式。

安装与使用

基于 Skills CLI 一行安装:

1
npx skills add https://github.com/cloudflare/security-audit-skill --skill security-audit

在目标代码库启动支持工具调用与并行子智能体的编码智能体后,直接说"security audit this codebase"即可触发。运行依赖 Node.js(用于零依赖的 findings/coverage 校验脚本)和一个 OS 级沙箱:必须禁用外部网络、使用净化白名单环境、限制资源且只允许写入指定临时目录——没有沙箱时,涉及目标代码执行的部分会保持 needs_validation,不会真的运行。

一句话点评

在"AI 找洞"普遍停留在演示层面的当下,Cloudflare 把规模化实战中沉淀的流程控制、证据链与证伪机制做成了人人可复用的 Skill,登顶并不意外。