文章总结: 夜安团队开源AI渗透测试平台strikeagent_atkbrain-flash以97.89分登顶tsecbenchv1榜单。产品面向红队、CTF、蓝队与SRC等授权场景,采用攻击图驱动自循环机制,支持自监督与自进化,具备漏洞二次验证、红队评级及报告交付能力。项目已开源,遵循AGPL3.0协议,个人和开源使用免费,商业需联系。
综合评分: 82
文章分类: 产品介绍,ai安全,渗透测试,红队,安全工具
夜安团队StrikeAgent登顶TSecBench榜单
Soufaker
Soufaker
夜安团队SEC
2026年9月20日 14:59
美国
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
夜安团队 SEC 开源项目深度介绍
StrikeAgent 登顶 TSecBench
从公开榜首到产品能力全景
StrikeAgent_AtkBrain-Flash 以 97.89 分位列 TSecBench v1 Agentic 跑分榜第一
#
| | | |
| — | — | — |
| 评测榜单 | 综合得分 | 当前排名 |
| TSecBench v1 | 97.89 / 100 | 第 1 名 |
TSecBench v1 Agentic 跑分榜 StrikeAgent_AtkBrain-Flash 位列第一
01 产品定位
面向真实授权场景的 AI 渗透测试平台
StrikeAgent_AtkBrain-Flash 是夜安团队开源的 AI Agent 渗透测试平台,围绕自循环、自监督和自进化三条主线构建。它不是简单地让大模型连续调用工具,而是把任务目标、攻击图、执行轨迹、监督决策、漏洞复核和交付报告组织在同一套工作流中。
产品面向红队打点、CTF、蓝队与 SRC 等授权安全场景,可按单目标或资产集群创建任务。控制台持续呈现攻击图、时间线、漏洞与对话状态,让自动化过程可观察、可干预、可复盘。
根据项目公开说明,团队自用 Pro 版本已在几十个项目、上千个外网真实授权环境中落地。Flash 版本将其中经过多轮实战打磨的流程与关键机制开源,重点解决 AI 渗透中常见的方向跑偏、上下文断裂、误报夸大和结果难交付等问题。
一张表看懂 StrikeAgent
| | |
| — | — |
| 任务类型 | 红队 getshell CTF flag 蓝队和 SRC |
| 执行模式 | 攻击图驱动自循环 轮次边界自监督 人工指令可随时介入 |
| 运行与工具 | Pi 运行时 deepseek flash Yakit MITM Yak MCP |
| 结果管理 | 漏洞二次验证 红队评级 攻击路径 资产画像 交付报告 |
| 开源协议 | AGPL 3.0 only 个人和开源使用免费 商业使用需单独联系 |
02 核心架构
控制台调度 攻击图自循环 经验持续沉淀
StrikeAgent 的控制台负责项目、猎面、攻击图、时间线、漏洞、对话和报告管理。API 与调度层通过轮次事件持续向控制台推送进展,执行层则围绕攻击图推进目标发现、服务识别、漏洞验证和立足点获取。
StrikeAgent_AtkBrain-Flash 架构图
02A 运行机制
自循环 自监督 自进化
自循环
每一轮执行都会重新建立 Pi 会话,但保留攻击图与监督简报。这样既能控制长上下文成本,又不会丢失关键目标、服务、漏洞和已取得立足点之间的关系。
自监督
监督器不在每一个工具调用后打断执行,而是在轮次边界或当前验证结束后复盘,输出下一阶段方案。对未执行的约束会继续保留,避免同一问题在后续轮次反复出现。
自进化
任务结束后,系统把可迁移的攻击手法蒸馏为经验条目,剥离具体 IP、URL 和题目路径,仅保留方法链条。经验可以按指纹召回,并通过成功或失败结果调整权重,为后续项目提供参考。
03 任务与控制台
从目标创建到攻击路径 全流程集中管理
创建任务时可以选择单目标或集群,并按红队、CTF、蓝队或 SRC 设定赛道。目标、端口、授权身份等信息在任务入口明确配置,有助于把执行边界和任务目标在开始前固定下来。
首页与新建任务 支持单目标和集群任务以及多种安全赛道
03A 攻击图工作台
让自动化过程可观察 可干预 可复盘
进入项目后,攻击图成为核心工作视图。目标、服务、危险点、漏洞、凭证和立足点在图中建立关系,时间线记录执行过程,右侧面板呈现发现的服务与验证状态。人工可以通过对话直接下达指令并立即中断当前轮次,监督器随后在下一轮接管。
项目控制台 攻击图 时间线 漏洞 对话和报告出口集中呈现
04 漏洞质量
不止发现漏洞 更强调复核与可交付
AI 安全测试的难点不只是发现候选漏洞,更在于如何降低误报、确认可利用性,并把结果转化为可以复核和交付的证据。StrikeAgent 为此加入漏洞二次验证与红队评级流程。
漏洞管理 支持分类筛选 二次验证与红队评级
二次验证:针对候选漏洞重新执行验证,确认漏洞是否真实存在以及利用条件是否成立。
红队评级:从实际攻击价值角度重新评估风险,避免仅依赖模型描述或单一扫描结果。
攻击图关联:把漏洞与目标、服务、凭证、立足点和横向路径关联,形成可复盘的完整链路。
报告交付:输出关键攻击路径、资产画像、漏洞证据和修复建议,减少从测试过程到正式报告之间的整理成本。
05 产品优势
StrikeAgent 的六个关键优势
一 攻击图维持全局上下文
相比只依赖聊天上下文的 Agent,攻击图把目标、服务、漏洞、凭证和立足点显式建模。即使执行轮次重启,关键关系仍然保留,减少遗忘、重复探测和路径断裂。
二 自动化与人工控制并存
系统允许 Agent 连续推进,同时保留人工 steering。操作者可以随时纠正方向、补充约束或暂停当前轮次,兼顾自动化效率与红队人员的判断。
三 监督节奏更贴近实战
监督器在轮次边界复盘,而不是对每一个动作频繁干预。这样既能让执行者完成一段完整验证链,又能在阶段结束后及时调整策略。
四 二次验证降低误报
候选漏洞需要经过二次验证和红队评级,重点确认可利用性、实际影响与证据完整度,让结果更接近“拿着就能复核和使用”的交付标准。
五 经验蒸馏支持跨项目复用
任务结束后,系统把有效手法抽象为可迁移经验,并根据后续结果动态调整权重,使每次授权测试都能为下一次任务积累方法。
六 执行链路与平台安全并重
红队、蓝队与 SRC 的 HTTP 第一跳接入本机 Yakit MITM,便于统一观察和控制流量。平台同时采用随机入口、一次性 ticket、RSA OAEP 登录加密、Argon2id 口令存储、HttpOnly Cookie 和默认 HTTPS 等机制,降低控制台自身暴露风险。
06 交付能力
把攻击过程沉淀为可复核的安全报告
StrikeAgent 不把终点停留在“Agent 已完成”。项目可以形成包含执行摘要、关键结论、攻击路径、漏洞证据、资产画像和修复建议的交付报告,使技术过程能够被安全团队、研发团队和管理者共同理解。
授权测试交付报告示例 已脱敏且不包含真实单位 地址或账号
攻击图负责还原从入口到高价值目标的链路,漏洞条目保留验证证据,报告则将这些信息重新组织为面向交付的叙事。对红队项目而言,这种从执行到报告的一体化能力,能够减少大量手工整理与路径复述工作。
07 榜单与开源
97.89 分登顶 TSecBench v1
TSecBench 面向智能攻防 Agent 开展公开评测,覆盖 Web、二进制、漏洞利用、渗透、云安全与规避等多类安全任务,并通过综合得分与可观测的 Agent Trace 展示评测表现。StrikeAgent_AtkBrain-Flash 以 97.89 分位列榜单第一。
这项结果为 StrikeAgent 在多类安全任务中的综合表现提供了公开量化参考。更重要的是,项目已经开源,安全研究者可以直接查看架构、部署方式和产品实现,并在明确授权的环境中进行测试与共建。
TSecBench v1 榜单成绩 综合得分 97.89 当前排名第一
项目地址
GitHubgithub.com/Yean-Sec/StrikeAgent_AtkBrain-Flash
榜单tsecbench.zc.tencent.com
项目仅限在已获得明确授权的环境中使用。个人和开源使用遵循 AGPL 3.0 only;商业许可请通过项目公开联系方式与夜安团队沟通。
08 关注我们
关注夜安团队SEC
持续关注 StrikeAgent 的开源进展、产品更新与安全研究实践。欢迎安全研究者在明确授权和合规的前提下试用项目、提交建议并参与共建。
关注公众号 夜安团队SEC
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:夜安团队SEC Soufaker
Soufaker《夜安团队StrikeAgent登顶TSecBench榜单》