夜安团队StrikeAgent登顶TSecBench榜单

admin 2026-09-22 05:31:58 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: 夜安团队开源AI渗透测试平台strikeagent_atkbrain-flash以97.89分登顶tsecbenchv1榜单。产品面向红队、CTF、蓝队与SRC等授权场景,采用攻击图驱动自循环机制,支持自监督与自进化,具备漏洞二次验证、红队评级及报告交付能力。项目已开源,遵循AGPL3.0协议,个人和开源使用免费,商业需联系。 综合评分: 82 文章分类: 产品介绍,ai安全,渗透测试,红队,安全工具


夜安团队StrikeAgent登顶TSecBench榜单

Soufaker Soufaker

夜安团队SEC

2026年9月20日 14:59 美国

在小说阅读器读本章

去阅读

在公众号小说中沉浸阅读

夜安团队 SEC  开源项目深度介绍

StrikeAgent 登顶 TSecBench

从公开榜首到产品能力全景

StrikeAgent_AtkBrain-Flash 以 97.89 分位列 TSecBench v1 Agentic 跑分榜第一

#

| | | | | — | — | — | | 评测榜单 | 综合得分 | 当前排名 | | TSecBench v1 | 97.89 / 100 | 第 1 名 |

TSecBench v1 Agentic 跑分榜  StrikeAgent_AtkBrain-Flash 位列第一

01  产品定位

面向真实授权场景的 AI 渗透测试平台

StrikeAgent_AtkBrain-Flash 是夜安团队开源的 AI Agent 渗透测试平台,围绕自循环、自监督和自进化三条主线构建。它不是简单地让大模型连续调用工具,而是把任务目标、攻击图、执行轨迹、监督决策、漏洞复核和交付报告组织在同一套工作流中。

产品面向红队打点、CTF、蓝队与 SRC 等授权安全场景,可按单目标或资产集群创建任务。控制台持续呈现攻击图、时间线、漏洞与对话状态,让自动化过程可观察、可干预、可复盘。

根据项目公开说明,团队自用 Pro 版本已在几十个项目、上千个外网真实授权环境中落地。Flash 版本将其中经过多轮实战打磨的流程与关键机制开源,重点解决 AI 渗透中常见的方向跑偏、上下文断裂、误报夸大和结果难交付等问题。

一张表看懂 StrikeAgent

| | | | — | — | | 任务类型 | 红队 getshell  CTF flag  蓝队和 SRC | | 执行模式 | 攻击图驱动自循环  轮次边界自监督  人工指令可随时介入 | | 运行与工具 | Pi 运行时  deepseek flash  Yakit MITM  Yak MCP | | 结果管理 | 漏洞二次验证  红队评级  攻击路径  资产画像  交付报告 | | 开源协议 | AGPL 3.0 only  个人和开源使用免费  商业使用需单独联系 |

02  核心架构

控制台调度  攻击图自循环  经验持续沉淀

StrikeAgent 的控制台负责项目、猎面、攻击图、时间线、漏洞、对话和报告管理。API 与调度层通过轮次事件持续向控制台推送进展,执行层则围绕攻击图推进目标发现、服务识别、漏洞验证和立足点获取。

StrikeAgent_AtkBrain-Flash 架构图

02A  运行机制

自循环  自监督  自进化

自循环

每一轮执行都会重新建立 Pi 会话,但保留攻击图与监督简报。这样既能控制长上下文成本,又不会丢失关键目标、服务、漏洞和已取得立足点之间的关系。

自监督

监督器不在每一个工具调用后打断执行,而是在轮次边界或当前验证结束后复盘,输出下一阶段方案。对未执行的约束会继续保留,避免同一问题在后续轮次反复出现。

自进化

任务结束后,系统把可迁移的攻击手法蒸馏为经验条目,剥离具体 IP、URL 和题目路径,仅保留方法链条。经验可以按指纹召回,并通过成功或失败结果调整权重,为后续项目提供参考。

03  任务与控制台

从目标创建到攻击路径  全流程集中管理

创建任务时可以选择单目标或集群,并按红队、CTF、蓝队或 SRC 设定赛道。目标、端口、授权身份等信息在任务入口明确配置,有助于把执行边界和任务目标在开始前固定下来。

首页与新建任务  支持单目标和集群任务以及多种安全赛道

03A  攻击图工作台

让自动化过程可观察  可干预  可复盘

进入项目后,攻击图成为核心工作视图。目标、服务、危险点、漏洞、凭证和立足点在图中建立关系,时间线记录执行过程,右侧面板呈现发现的服务与验证状态。人工可以通过对话直接下达指令并立即中断当前轮次,监督器随后在下一轮接管。

项目控制台  攻击图 时间线 漏洞 对话和报告出口集中呈现

04  漏洞质量

不止发现漏洞  更强调复核与可交付

AI 安全测试的难点不只是发现候选漏洞,更在于如何降低误报、确认可利用性,并把结果转化为可以复核和交付的证据。StrikeAgent 为此加入漏洞二次验证与红队评级流程。

漏洞管理  支持分类筛选 二次验证与红队评级

二次验证:针对候选漏洞重新执行验证,确认漏洞是否真实存在以及利用条件是否成立。

红队评级:从实际攻击价值角度重新评估风险,避免仅依赖模型描述或单一扫描结果。

攻击图关联:把漏洞与目标、服务、凭证、立足点和横向路径关联,形成可复盘的完整链路。

报告交付:输出关键攻击路径、资产画像、漏洞证据和修复建议,减少从测试过程到正式报告之间的整理成本。

05  产品优势

StrikeAgent 的六个关键优势

一  攻击图维持全局上下文

相比只依赖聊天上下文的 Agent,攻击图把目标、服务、漏洞、凭证和立足点显式建模。即使执行轮次重启,关键关系仍然保留,减少遗忘、重复探测和路径断裂。

二  自动化与人工控制并存

系统允许 Agent 连续推进,同时保留人工 steering。操作者可以随时纠正方向、补充约束或暂停当前轮次,兼顾自动化效率与红队人员的判断。

三  监督节奏更贴近实战

监督器在轮次边界复盘,而不是对每一个动作频繁干预。这样既能让执行者完成一段完整验证链,又能在阶段结束后及时调整策略。

四  二次验证降低误报

候选漏洞需要经过二次验证和红队评级,重点确认可利用性、实际影响与证据完整度,让结果更接近“拿着就能复核和使用”的交付标准。

五  经验蒸馏支持跨项目复用

任务结束后,系统把有效手法抽象为可迁移经验,并根据后续结果动态调整权重,使每次授权测试都能为下一次任务积累方法。

六  执行链路与平台安全并重

红队、蓝队与 SRC 的 HTTP 第一跳接入本机 Yakit MITM,便于统一观察和控制流量。平台同时采用随机入口、一次性 ticket、RSA OAEP 登录加密、Argon2id 口令存储、HttpOnly Cookie 和默认 HTTPS 等机制,降低控制台自身暴露风险。

06  交付能力

把攻击过程沉淀为可复核的安全报告

StrikeAgent 不把终点停留在“Agent 已完成”。项目可以形成包含执行摘要、关键结论、攻击路径、漏洞证据、资产画像和修复建议的交付报告,使技术过程能够被安全团队、研发团队和管理者共同理解。

授权测试交付报告示例  已脱敏且不包含真实单位 地址或账号

攻击图负责还原从入口到高价值目标的链路,漏洞条目保留验证证据,报告则将这些信息重新组织为面向交付的叙事。对红队项目而言,这种从执行到报告的一体化能力,能够减少大量手工整理与路径复述工作。

07  榜单与开源

97.89 分登顶 TSecBench v1

TSecBench 面向智能攻防 Agent 开展公开评测,覆盖 Web、二进制、漏洞利用、渗透、云安全与规避等多类安全任务,并通过综合得分与可观测的 Agent Trace 展示评测表现。StrikeAgent_AtkBrain-Flash 以 97.89 分位列榜单第一。

这项结果为 StrikeAgent 在多类安全任务中的综合表现提供了公开量化参考。更重要的是,项目已经开源,安全研究者可以直接查看架构、部署方式和产品实现,并在明确授权的环境中进行测试与共建。

TSecBench v1 榜单成绩  综合得分 97.89  当前排名第一

项目地址

GitHubgithub.com/Yean-Sec/StrikeAgent_AtkBrain-Flash

榜单tsecbench.zc.tencent.com

项目仅限在已获得明确授权的环境中使用。个人和开源使用遵循 AGPL 3.0 only;商业许可请通过项目公开联系方式与夜安团队沟通。

08  关注我们

关注夜安团队SEC

持续关注 StrikeAgent 的开源进展、产品更新与安全研究实践。欢迎安全研究者在明确授权和合规的前提下试用项目、提交建议并参与共建。

关注公众号 夜安团队SEC


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。

本文转载自:夜安团队SEC Soufaker Soufaker《夜安团队StrikeAgent登顶TSecBench榜单》

评论:0   参与:  0