文章总结: 本文介绍Cloudflare开源的security-audit-skill项目,将编码代理转化为多阶段可验证的安全审计流水线,包含侦察、覆盖率驱动狩猎、候选验证、结构化输出、独立复核与去偏报告六阶段,每条结论带证据链。项目提供十余份专项狩猎手册覆盖多类攻击面,支持累加式审计。建议通过SkillsCLI安装使用,适合需要严格空值控制与可验证审计流程的安全团队。
综合评分: 75
文章分类: 代码审计,AI安全,安全工具,安全开发
Cloudflare开源的安全审计skill|附项目分析|已获18K star
原创
道一安全
道一安全
道一安全
2026年9月21日 11:47
北京
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
#
免责声明
道一安全(本公众号)的技术文章仅供参考,此文所提供的信息只为网络安全人员对自己所负责的网站、服务器等(包括但不限于)进行检测或维护参考,未经授权请勿利用文章中的技术资料对任何计算机系统进行入侵操作。利用此文所提供的信息而造成的直接或间接后果和损失,均由使用者本人负责。本文所提供的工具仅用于学习,禁止用于其他!!!
这是什么
security-audit-skill 是 Cloudflare 开源的一个编码智能体技能(skill)。它的核心思想是:不再让 AI “顺手看看代码安不安全”,而是把它编排成一套多阶段、可验证、产出机器可读结论的安全审计流水线。
它会把你的编码代理(coding agent)变成一名安全审计员,通过多个相互隔离的子代理(isolated agents),依次完成侦察、覆盖率驱动的漏洞挖掘、候选漏洞验证、结构化输出、独立复核与去偏报告。最终的每条结论都带“证据链”,并且能被程序化校验,而不是一段主观的“我觉得这里有问题”。
这个项目正是 Cloudflare 漏洞挖掘 Harness 的种子。Cloudflare 在《Build your own vulnerability harness》一文中描述的整套系统,就是由这个单仓库版本逐步演化、扩展成多阶段、面向全代码库(fleet-wide)的平台。换句话说,你拿到的是这套工业级系统的“最小可运行起点”。
六阶段审计流程
整个审计被严格拆成六个阶段,阶段之间有明确的产物(artifact)交接:
- 侦察(Reconnaissance)——绘制架构图、信任边界、输入面、历史证据,以及确定性覆盖率,产出
architecture.md与coverage-ledger.json(覆盖台账)。 - 覆盖率驱动的狩猎(Coverage-led hunting)——从台账中的覆盖单元派发相互隔离的“猎人”(hunter)代理,各自记录检查项,再由“覆盖率批评者”(coverage critics)专门找遗漏。
- 候选验证(Candidate validation)——每一个去重后的候选漏洞,都交给一个全新的验证者,这个验证者的唯一任务是设法推翻它。
- 结构化输出(Structured output)——把结论写入
findings.json,分成confirmed(已确认)、needs_validation(待验证)、rejected(已驳回)三类,并用report-schema.json做模式校验。 - 独立记录复核(Independent record verification)——由新的代理对最终结论里引用的源码声明做独立核验。凡是被大幅改写的记录,必须再经一轮独立验证。
- 去偏报告(Target-neutral reporting)——基于已核验的记录和覆盖台账,派生出
REPORT.md、FINDINGS-DETAIL.md和NEEDS-VALIDATION.md。
流程上有两个关键校验点:负责人在第 1 阶段建立台账后、以及此后每次更新台账后,都要运行 validate-coverage-ledger.cjs;在第 4 阶段以及第 5 阶段每次替换记录之后,都要运行 validate-findings.cjs。也就是说,覆盖率台账和发现记录都不允许“脏数据”流入下一阶段。
三种结论的判定标准是明确区分的:
confirmed:有完整的源码追溯链(source trace),且观测到的结果是有边界的;needs_validation:存在一个精确的、尚未解决的事实(exact unresolved fact),不带严重性评级;rejected:记录一个已被证伪的候选。
值得一提的是,对同一仓库的多次审计是累加式的。技能会利用此前的台账与发现结果来定位盲区、重新验证改动过的源码,并沿用仍然有效的证据;但它不会把已经过时(stale)或尚未解决的工作算作“已覆盖”。
文件结构与攻击面覆盖
这个技能的厚度主要体现在攻击面分类上。除了核心的 SKILL.md(安装、核心原则、平台术语、工作流与反模式),它还按目标类型拆出了十余份专项“狩猎手册”:
| 文件 | 用途 |
| — | — |
| SKILL.md | 安装、核心原则、平台术语、工作流总览与审计反模式 |
| RECONNAISSANCE.md | 第 1 阶段侦察提示词与综合指令 |
| HUNTING.md | 第 2 阶段编排、狩猎方法论与验证规则 |
| ATTACK-CLASSES.md | 核心、通配与“显而易见问题”的攻击提示 |
| MEMORY-SAFETY-AND-BINARY.md | 面向原生目标的内存安全、二进制与内核狩猎类别 |
| AI-AND-LLM.md | 面向 LLM 支撑系统的提示注入、Agent/工具、输出处理狩猎类别 |
| WEB-PROTOCOL-AND-AUTH.md | 面向 HTTP 协议与认证目标的请求分帧、缓存、认证协议狩猎类别 |
| CLIENT-SIDE.md | 面向客户端/浏览器目标的 DOM 注入、消息信任、UI 重定向、原型污染狩猎类别 |
| SUPPLY-CHAIN-AND-RELEASE.md | 依赖、CI、发布、签名、更新、插件与扩展狩猎类别 |
| CLOUD-AND-DEPLOYMENT.md | IAM、基础设施即代码、容器、Serverless、入口与运行时配置狩猎类别 |
| PROTOCOLS-RPC-AND-MESSAGING.md | RPC、序列化、队列、Broker、Webhook 与流协议狩猎类别 |
| RESOURCE-EXHAUSTION-AND-AVAILABILITY.md | 共享资源、配额、队列、Worker 与运营者成本狩猎类别 |
| DATA-ISOLATION-AND-LIFECYCLE.md | 租户隔离、缓存、搜索、导出、备份、迁移、删除与恢复狩猎类别 |
| DESKTOP-MOBILE-AND-LOCAL-IPC.md | 原生应用、深链、WebView、导出组件、辅助进程、守护进程与本地 IPC 狩猎类别 |
| VALIDATION-AND-REPORTING.md | 第 3–6 阶段:候选验证、结构化输出、记录复核与报告 |
| report-schema.json | 三种 findings.json 结论的 JSON Schema |
| validate-findings.cjs | 零依赖的 findings.json 校验器(第 4、5 阶段使用) |
| validate-findings.test.cjs | 发现校验器测试与生产者兼容的固件检查 |
| validate-coverage-ledger.cjs | 零依赖的覆盖台账校验器(第 1–5 阶段使用) |
| validate-coverage-ledger.test.cjs | 覆盖台账校验器测试 |
安装与使用
通过 Skills CLI 安装:
npx skills add https://github.com/cloudflare/security-audit-skill \ --skill security-audit
用户级安装加 --global:
npx skills add https://github.com/cloudflare/security-audit-skill \ --skill security-audit \ --global
在你的代码库里启动编码代理,然后直接下指令即可:
security audit this codebasefind security vulnerabilities in ./srcdo a security review, output to ~/audits/my-project
技能会在请求匹配到触发词(security audit、find vulnerabilities、pen-test the code 等)时自动激活。直接针对代码库的审计/渗透请求会进入完整审计模式;而一般性的安全问题或聚焦的漏洞工作,则默认进入指导模式,除非你明确要求产出报告工件。完整审计模式下,若未指定输出目录,默认写到 ~/security-audit-skill/<repo-name>/run-<N>。工作流只会在你显式选择某个被版本控制忽略的目录时,才会把结果写入目标仓库内部。
设计原则
这几条是整套系统的“灵魂”:
- 只确认已确立的边界破坏。 如果一条线索有源码依据但被阻塞,就保留为
needs_validation,并注明那个精确的未解决事实。 - 对抗性验证。 检查发现的代理,永远不是当初发现它的那个代理。
- 严重性必须来自影响。 评级依据是“可能性 × 影响”,而不是偏离了某张检查清单的程度。
- 纵深防御的缺口不等于漏洞。 如果 A 层已经挡住了攻击,B 层的缺失只能算加固建议(hardening note)。
- 多轮运行提升覆盖率。 在他们的测试中,单次运行大约只能发现多次运行累计发现漏洞的一半。
项目网址:
https://github.com/cloudflare/security-audit-skill
低价 AI 聚合站
网址:https://ai.daoyivip.com/sign-up?aff=cFs6
注册送余额,可免费试用
国模最低 0.1 折起,GPT 最低 0.15 折起,Claude 最低 0.01 折起
国模:
国模分组(0.35折)最稳定,其他的国模分组不保证稳定,后续也可能会删除
GPT:
Claude Opus5 网安专用:
kiro:
这个分组实际是 0.12 左右的倍率,模型基础价格设置的低 所以要用高倍率来拉价格,实际倍率可以复制价格给 AI 查询
Freebuf限时优惠充值:
https://wiki.freebuf.com/storeThroughTrain/shopHomepage?shop_id=36
点分享
点收藏
点在看
点点赞
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:道一安全 道一安全
道一安全《Cloudflare开源的安全审计skill|附项目分析|已获18K star》