当红队的“同事”变成了AI:渗透测试与攻防演练正在被重写,谁会被淘汰?

admin 2026-09-29 04:51:29 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: 本文分析AI对渗透测试与攻防演练的深刻影响。核心观点是AI正替代重复性基础测试工作,但业务逻辑漏洞挖掘等创造性工作仍是人类护城河。文章引用多个实测数据说明AI在理想环境表现优异但实战差距明显,并给出从业者提升方向与企业落地建议,强调人机协同是未来趋势。 综合评分: 72 文章分类: 渗透测试,红队,AI安全,安全运营,安全建设


当红队的“同事”变成了 AI:渗透测试与攻防演练正在被重写,谁会被淘汰?

北京路劲科技有限公司

2026年9月28日 18:03 北京

在小说阅读器读本章

去阅读

在公众号小说中沉浸阅读

当红队的“同事”变成了 AI:渗透测试与攻防演练正在被重写,谁会被淘汰?

三个真实瞬间,先给各位压压惊——

2024 年 11 月,谷歌 Project Zero 的 AI 系统「Big Sleep」在 SQLite 里挖出了人类团队多年没发现的可利用内存漏洞,这是公开报道中首个由 AI 在生产软件中发现的零日漏洞。

2025 年 6 月,一个叫 XBOW 的自主智能体登顶 HackerOne 全球漏洞赏金榜第一,靠的是 1060 多条真实有效的漏洞提交——它把成千上万的人类赏金猎人甩在了身后。

2025 年 12 月,在约 8000 台主机、12 个子网的真实企业网络上,AI 智能体 ARTEMIS 正面击败了 10 名人类渗透测试员中的 9 名。算账更扎心:它每小时成本约 18 美元,而人类专家收费 60 美元起步。

于是圈内那个灵魂拷问又来了:渗透测试是不是要被 AI 端掉了? 作为一个看了 9 年攻防演练、也亲手写过无数份渗透报告的人,我的答案比较反直觉:

AI 确实在抢渗透测试的工作——但它抢走的,恰恰是那些本来就不该由最贵的人类去干的部分。真正值钱的人类技能,反而因为 AI 变得更值钱了。

下面用数据和趋势,把这事说透。

01|渗透测试的“三代进化”:从扫描器到智能体

先看历史坐标,你会理解现在到底站在哪里:

·扫描器时代(2023 年前):Nmap 扫端口、Nuclei 打已知 CVE、Metasploit 发射模块。没有推理、没有适应,任何需要临场判断的活儿都得人来干。

· 副驾时代(2023):以 PentestGPT 为代表,LLM 能读扫描结果并“建议下一步”,但每条命令仍要人类敲键盘。

· 智能体时代(2024—2025):AI 自己执行命令、读输出、提假设、失败换路。多智能体集群(规划者—执行者、角色专精、MCP 化等)成为主流——目前全球已有 39 个以上开源 AI 渗透智能体、6 种架构模式,这个赛道吸引的风险投资超过 6.65 亿美元。

用一句话概括:过去工具是“剧本执行器”,现在 AI 是会思考的“执行者”。

而架构演进也在加速变强:分层多智能体在零日漏洞利用上比单体方案强 4.3 倍;DARPA 的 AIxCC 网络挑战赛中,AI 系统对漏洞的检测率一年内从37% 跃升到 86%。

聚力同行  勇往直前

02|先泼盆冷水:实验室神话 vs 现实落差

很多厂商宣传“AI 打穿一切”,但你得学会看数字背后的条件。一组被反复引用的关键数据,能帮你避开营销话术:

·给 GPT-4 提供漏洞公告描述,它能自主利用 87% 的已披露漏洞;把描述拿掉,立刻掉到 7%——同场测试的其他所有模型和扫描器全是 0%。

· 换成贴近实战的 CVE-Bench,面对真实 CVE,最先进水平只有 13%;在 HackTheBox 高难度靶机上,几乎为 0%。

· AutoPenBench 的全自主模式只完成了 21% 的任务,而人类在中途给点提示,成绩立刻跳到 64%。

规律很清楚:条件越真实,AI 表现越差。 87% 是理想环境的天花板,不是实战能力的地板。别被一句“AI 渗透测试达成率 87%”忽悠了——先问一句:漏洞描述是不是已经喂给它了?

聚力同行  勇往直前

03|AI 到底擅长什么,人类凭什么还值钱?

把各基准和 ARTEMIS 的真人对决掰开看,双方的分工其实非常清晰:

AI 稳定擅长的(正在变成“大宗商品”):

· 已知 CVE 与扫描结果的匹配(几乎完美)

· SSRF、注入类缺陷

· 配置错误、默认口令、暴露管理面板

· 标准 Web 漏洞(SQLi、XSS 等)

· 7×24 不间断、方法论一致、覆盖面广、成本低

AI 目前搞不定的(人类真正的护城河):

· 业务逻辑缺陷——注意这个数字:约 70% 的关键 Web 漏洞藏在业务逻辑里,需要理解应用“应该做什么”而不是“在做什么”,当前没有任何自主智能体能可靠检测。

· 需要 5 步以上、带条件分支的复杂攻击链

· 依赖图形界面的操作

· 全新的、没人记录过的攻击向量

在 ARTEMIS 那场对决里,顶尖的那位人类渗透测试员仍然以 13 个有效漏洞胜出——差距不在速度(AI 更快),而在于创造性地构造利用链、验证奇怪边界情况、发现智能体根本没当成 bug 的业务缺陷。

所以结论不是“AI 取代渗透测试员”,而是岗位价值重排:

“找已知漏洞、扫配置错误的活儿,AI 做得更好更便宜;人类应该腾出手去干“理解业务、设计攻防、拍板整改”的活儿。”

聚力同行  勇往直前

04|攻防演练(护网)里,AI 改变的远不止红队

如果说渗透测试是“单兵作战”,那实战攻防演练就是 AI 影响最激烈的主战场。2025 年国家级攻防演习走到第 10 年,奇安信总结的五大趋势,每一条都跟 AI 有关:

1. 从“定时定点”到“全天候”。 演习时间从往年“12×5”直接升级为 “24×6”全天候不间断,贴近真实网络战节奏——因为真实攻击者从不上班。

2. 攻击强度更大,“AI+人工”协同攻击成为常态。 AI 能自动分析目标防御模式、流量特征,快速识别防守薄弱点并生成多样化攻击,降低被特征库识别的概率;攻击队规模也在扩大,0day、APT、勒索专项攻击纷纷登场。

3. 大模型本身成为“新靶子”。 通用大模型、垂直应用、知识库、智能体都成了攻击目标,大模型提示词注入已成为护网新增科目;云原生(K8s 容器逃逸)、AI 钓鱼等也进入演练范围。

4. 防守端被倒逼“以 AI 对抗 AI”。 面对 AI 化的饱和式攻击,蓝队不能再靠人肉盯告警。AI 辅助研判正在把告警降噪做到 90% 以上,安全运营专家 + AI 的“人机协同”值守,成为 7×24 高强度演习的标配。

5. 攻防进入“智能体级”对抗。 红队用 AI 智能体打“侦察—验证—利用—后渗透—横向—报告”的全自主链路,蓝队用 AI 做自动研判和联动响应——护网已经从“技术 PK”升级为“体系 + AI 的博弈”。

一句话:以前的攻防演练拼人海战术,现在拼的是“谁的 AI 调教得好、谁的人更会指挥 AI”。

聚力同行  勇往直前

05|算一笔账:AI 把渗透的成本打到多低?

这是最让甲方心动、也让部分乙方焦虑的部分。

· ARTEMIS 每小时 约 18 美元,人类专家 60 美元起——AI 便宜三倍以上,还不用睡觉。

· 国内同样在卷:某云厂商的自主渗透智能体在第二届智能渗透挑战赛里拿到 90.7% 的解题率(49/54),全程 Token 成本不到 2000 元;另一支队伍平均解题成本约 13 元/题。这项赛事吸引国内外 610 支战队同场竞技。

对甲方(尤其中小企业)来说,这是史诗级利好:以前一年一次、动辄几十万的人工渗透测试请不起,现在可以做到近乎 7×24 的持续暴露面验证。a16z 的判断是:传统一年一两次的渗透已经追不上软件迭代的速度——2025 年 Verizon 数据泄露报告显示,超过三分之二的泄露事件涉及的漏洞已存在 90 天以上未修复,哪怕企业刚做完安全评估。

“传统渗透测试,就像一年才检查一次门窗,而一伙 AI 化的小偷正在不分昼夜地试探你家。”

聚力同行  勇往直前

06|坏消息也要说:AI 同样在武装“坏人”

攻防两端从来是同步进化的。HackerOne 2025 年报告给出了两个扎眼数字:

· 有效的 AI 漏洞报告激增 210%

· 提示词注入类报告激增 540%,560 多份有效漏洞由完全自主的 AI 智能体提交。

更值得警惕的是“攻击能力民主化”:APT 组织把 LLM 嵌入了钓鱼邮件和恶意代码生产的全流程,AI 写的钓鱼邮件已经能精准匹配目标的语言习惯、模仿高管的用词风格,让“初级黑客也能发起 APT 级攻击”。

这对防御方的启示是冰冷的: AI 把 CVE 从“披露到被利用”的窗口从数天压缩到了分钟级,你的补丁管理必须比过去快得多——请默认自己正处于“被某台 AI 持续扫描”的状态,哪怕你没雇它。

聚力同行  勇往直前

07|给从业者和企业的几点实在建议

如果你是甲方/负责人:

1. 请把自己当“正在被持续扫描”——快补丁(高危 90 天内还是太慢)、清弱口令、收暴露面,这是所有 AI 都帮不了的底线工程。

2. 人机混合落地:让 AI 智能体做暴露面验证和已知漏洞排查(成本约人工 1/3),把最贵的人类工时留给业务逻辑审计和整改决策。

3. 合规别裸奔:AI 智能体测出来的结果,目前多数合规框架(等保测评、渗透测试服务要求)仍需持证人工交付兜底;而你自己的大模型应用,本身也要做安全评估、按等级保护定级备案。

如果你是渗透测试/安服从业者(划重点):

1. 别再做“人肉扫描器”——脚本化、流程化的基础测试工作会被 AI 快速替代,这是趋势,不是吓唬。

2. 往上走三层:① 会编排、约束、验证 AI 智能体(范围控制、防幻觉、结果复核);② 深耕业务逻辑挖掘(AI 的硬伤,你的活路);③ 学 AI 安全本身(提示词注入、模型攻防、大模型红队)——这已经是护网的新增科目。

  1. 把 AI 当队友而非对手:真正的高手,是那种“AI 干 80% 重复活、自己盯 20% 关键决策”的人。

聚力同行  勇往直前

这一轮 AI 对渗透测试与攻防演练的冲击,本质不是“机器淘汰人”,而是会用 AI 的人,淘汰不会用 AI 的人”。攻防的天平从未真正倾斜——AI 给了攻击者更低的门槛,也给了防守者更强的武器,关键在于谁进化得更快。

未来的安全战场,比的不是谁的工具多,而是谁的 AI 更听话、谁的人更会思考。

本文所有数据来源于公开研究报告与行业实测,仅供技术交流与学习;任何攻防技术仅限授权环境使用,严禁未授权攻击。

聚力同行  勇往直前

关注路劲科技,关注网络安全!

END

关于我们:

北京路劲科技有限公司(Beijing Lujin Technology Co. , Ltd.)成立于2019年1月4日,是一家提供全面系统集成与信息安全解决方案的专业IT技术服务公司。公司秉承“为网络安全保驾护航”的企业愿景及“提升国家整体安全”的使命,依据风险评估模型和等级保护标准,采用大数据等技术手段,开展网络安全相关业务。公司致力于为各个行业的业务信息化提供软件和通用解决方案、系统架构,系统管理和数据安全服务、以及IT咨询规划、系统集成与系统服务等专业化服务。公司立足北京,走向全国,始终坚持“换位、细节、感恩”的核心价值观,以“共赢、共享、共成长”的经营理念为出发点,集合了一批敢于创新、充满活力、热衷于为IT行业服务的优秀人才,致力于成为您身边的网络安全专家。

关注路劲科技,关注网络安全!

公司:北京路劲科技有限公司

地址:北京市昌平区南邵镇双营西路78号院2号楼5层504


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。

本文转载自:北京路劲科技有限公司 《当红队的“同事”变成了 AI:渗透测试与攻防演练正在被重写,谁会被淘汰?》

评论:0   参与:  0