文章总结: cyberstrike是一款开源自主红队操作员工具,通过智能层注入OWASP方法论和7600+签名技能,支持13个领域agent、hackbrowser及8个并行测试器,采用三道确认协议减少误报,可远程执行bolt组件。实测领先模型在基准测试中通过率仅31.5%,适合加速工作流而非替代人工判断,仅限授权测试。
综合评分: 82
文章分类: ai安全,渗透测试,红队,安全工具
别再把LLM当扫描器用了:CyberStrike把Claude订阅变成了一个会自己思考的红队操作员
原创
klsec
klsec
昆仑AI安全实验室
2026年9月24日 00:57
广东
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
大多数所谓“AI渗透测试工具”做的事情,是把你的提示词包装一下,转发给GPT,然后把回复打印出来。你问它“下一步做什么”,它告诉你“可以运行nmap -sV”。然后你手动复制粘贴,跑完再回来问它。这不是自动化,这是把聊天窗口搬到了终端里。
CyberStrike不一样。2026年2月开源,2026年9月已经在GitHub上积累了近2000颗星。它的定位很明确:不是聊天机器人的包装器,是一个直接在终端运行的自主红队操作员。你插上自己的Claude或GPT订阅,它就接管侦察、漏洞发现、利用和报告生成的全流程,不需要你反复敲“下一步”。
智能层:让不懂安全的模型变成安全专家
CyberStrike最核心的差异化设计,是开发者所称的“智能层”。
传统的做法是写一段很长的系统提示词,告诉模型“你是渗透测试专家,你应该先扫端口再测漏洞”。但模型本身不懂安全,它只是在模仿你提示词里的语气。
CyberStrike的智能层做的事情完全不同。它在每一次模型交互中注入OWASP测试方法论、漏洞模式和攻击链推理逻辑。模型不需要内置安全知识,CyberStrike教它。具体来说,智能层提供四项能力:schema normalization让任何模型都能输出结构化结果;context guard防止提示词泄露并保持Agent聚焦在当前测试阶段;provider auto-detection自动识别LLM端点并配置最优传输;tool orchestration根据发现结果智能串联安全工具,而不是跑固定脚本。
这意味着你用DeepSeek也好,用本地Ollama跑一个开源模型也好,接上CyberStrike之后,它都会用同一套安全方法论来工作。模型本身的能力边界还在,但它的“安全操作框架”是统一的。
13个领域专属Agent:不只是“Web测试”
CyberStrike内置了13个以上领域专属Agent。但“13个”这个数字本身不说明什么,关键是每个Agent背后绑定了什么方法论。
Web应用测试Agent遵循的是OWASP WSTG。移动端测试Agent遵循MASTG和MASVS。云安全Agent围绕CIS基准构建。内网测试Agent覆盖Active Directory和横向移动,Kerberoast、NTLM relay、DCSync这些技术被内置为可调用的技能,从初始立足点到Domain Admin的路径是自动化的。
支撑这些Agent的是超过7600个经Ed25519签名的安全技能文件。签名这件事很重要——它意味着技能文件有完整性校验,不会被篡改或注入恶意逻辑。技能覆盖的范围从JWT滥用、SSRF、SSTI、GraphQL利用,到AWS/Azure/Kubernetes/Windows/macOS的后期利用技术。
这些技能采用延迟加载机制,用到的时候才注入,不会一次性吃掉你的上下文窗口。
HackBrowser + 8个并行测试器:IDOR和业务逻辑漏洞的自动化探测
这是CyberStrike最实用的功能,也是我测试下来觉得最有价值的设计。
HackBrowser是一个内置的Chromium浏览器。你可以手动浏览目标,也可以让它用多个凭据自主爬取——先用admin权限爬一遍,再用普通用户权限爬一遍,把两次的HTTP流量对比。差异在哪里,漏洞可能就在哪里。
每一个经过代理的HTTP请求,会被路由到8个并行运行的子测试器。这8个测试器分别针对IDOR、授权绕过、批量赋值、注入、认证、业务逻辑、SSRF和文件攻击。
它不是“把所有请求扔给一个大模型让它判断有没有漏洞”。它是先由proxy-analyzer做架构分析——提取对象、角色、功能、对象ID、凭证声明,然后由proxy-agent作为编排器,根据每个请求的特征,动态选择该跑哪些测试器。
一个包含数字ID的路径会触发IDOR测试器。一个带JSON body的POST请求会触发注入和批量赋值测试器。一个带url=参数的请求会触发SSRF测试器。如果会话里有多个不同权限的凭据,授权测试器的权重会被提高。
IDOR测试器的具体操作很实在:改路径参数里的数字ID、改查询参数里的对象ID、改POST body里的字段、用另一个用户的凭据重放请求、猜测UUID、试负数ID和常见ID(1、100、admin)。
每个测试器都采用三道确认协议来避免误报。 这是我觉得最值得说的设计。很多AI安全工具的问题不是“漏报”,是“误报太多”——它看到一个接口返回了数据就报“越权”,但那个接口本来就是设计为公开可读的。三道确认协议要求:可达性(这个接口真的能被未授权用户访问吗)、脆弱性(这个具体点真的脆弱吗)、可利用性(能构造出最小化PoC证明利用成功吗)。三道全过才报。
Bolt:把工具跑在远程服务器上
Bolt是CyberStrike的一个远程执行组件。它允许安全工具在远程服务器上运行,而不是在你的本地笔记本上。通过Ed25519密钥配对,一个CyberStrike实例可以控制数十个Bolt服务器,每个服务器持有各自独特的工具包。
实际场景是什么?你在本地终端跑CyberStrike,Agent需要跑一个重型扫描任务。它自动把任务分发到配置好的Bolt服务器上,结果回传,你本地什么都不用装。对于需要隔离测试环境、或者不想在本地机器上跑Metasploit和Mimikatz的场景,这个设计很实用。
安装与定价:一条命令,永久免费
安装就是一条命令:
npm i -g @cyberstrike-io/cyberstrike@latest && cyberstrike
首次运行会启动终端界面,让你选择LLM提供商并输入API密钥。支持150+ AI提供商、5300+模型,包括Anthropic、OpenAI、Google、Amazon Bedrock、Azure,以及Ollama和LM Studio等完全离线的选项。
定价:AGPL-3.0许可证,个人使用、研究、教育完全免费,永久免费。 企业部署需要商业许可证。项目明确声明仅适用于已获授权的安全测试,并有配套的伦理使用政策。
诚实说一句:它有多强,以及它不够强的地方
Turing Frontier Research Lab在2026年8月发布了一个同名的CyberStrike基准测试,包含200个专家编写的安全任务。结果值得参考:领先的模型配置(GPT-5.6 Sol)在200个任务中达到了31.5%的平均通过率。72个任务没有任何一个模型能解决,只有2个任务被所有六个配置都解决了。
这个数据说明什么?说明AI在真实安全工作中的完成度仍然有限。它能识别问题,但经常无法满足完整的安全要求——找到漏洞但漏掉同类的另一条路径、写出可用的补丁但破坏了正常功能、生成一份看似合理的报告但缺少关键证据。
CyberStrike的8个并行测试器和三道确认协议,正是为了应对这个问题。它不追求“找到一个看起来像漏洞的东西就报”,它追求“每一个报出来的漏洞都经过了完整验证”。这个设计取向是对的。但Turing的数据也提醒我们:AI是加速器,不是替代品。 它帮你更快地跑完覆盖、更快地排除误报、更快地生成报告。但最终判断“这个发现有没有业务影响”的人,还是你。
适合谁,不适合谁
适合: 做SRC或众测的猎人,尤其是需要覆盖大量端点、测试IDOR和业务逻辑漏洞的场景。HackBrowser的自动爬取+8个并行测试器,在信息收集和初筛阶段能省大量时间。做企业SDL安全测试的团队,13个领域Agent + OWASP WSTG方法论覆盖,适合做系统化的攻击面扫描。
不太适合: 指望“一键打穿”的人。它不是自动化exploit框架,它是一个自动化测试编排框架。它的产出是“经过验证的漏洞发现”,不是“已经拿到的Shell”。
最后一句实在话:CyberStrike是目前开源生态里,把“AI自主安全测试”这件事做得最像样的一个。它的智能层设计、多Agent编排、三道确认协议,都比大多数“LLM包装器”高了一个层级。但Turing基准测试的31.5%通过率也在提醒你:用它来加速你的工作流,不要用它来替代你的判断力。
严正声明
CyberStrike采用AGPL-3.0许可证,个人使用、研究、教育免费。项目明确要求仅用于已获授权的安全测试。本文所述功能基于CyberStrike公开文档和GitHub仓库,所有测试场景应在SRC平台或客户明确授权的资产范围内进行。未授权扫描、测试、攻击行为均属违法。
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:昆仑AI安全实验室 klsec
klsec《别再把LLM当扫描器用了:CyberStrike把Claude订阅变成了一个会自己思考的红队操作员》