文章总结: Anthropic将ClaudeMythosPreview应用于281个开源项目,发现23019个候选漏洞,但仅1900个经外部审核,其余21119个无人复核。已审核部分90.8%被确认为真实漏洞。严重性评级存在偏差,8个Critical中仅1个成立。模型利用能力较前代提升约90倍,成本不到2000美元。审核能力不足成为软件供应链安全最大障碍。 综合评分: 85 文章分类: 漏洞分析,AI安全,安全工具
Claude Mythos发现2.3万条漏洞线索,超2.1万条无人复核
FreeBuf
2026年9月5日 18:00 上海
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
Part01
漏洞发现多但审核不足
Anthropic 将 Claude Mythos Preview 应用于 281 个开源项目,收集到 23,019 个候选漏洞。外部安全公司审核了其中 1,900 个。维护者收到 1,596 份报告,确认了 1,451 份;97 个修复已合入上游,88 项发现成为已发布的安全公告,以上数据截至 2026 年 5 月 22 日。其余 21,119 个候选漏洞未经 Anthropic 以外的任何人审核。
Anthropic 将审核数量的急剧下降归因于缺乏足够人手来核查这些结果,而已审核部分的数据也印证了这一点:1,900 个中有 1,726 个(即 90.8%)被确认为真实漏洞。
汇总这些数据的软件供应链公司 Echo 附加了一条说明:送审的 1,900 个样本不太可能是从全部候选中随机抽取的,因此 90.8% 这个数字可能只反映了最优候选的质量,而说明不了其他问题。Anthropic 尚未公布其余 21,000 余个候选的准确率。
Part02
严重性评级未能经受审核检验
88 份安全公告中有 27 份已获得 CVE 编号。Mythos 将其中 8 个评为 Critical(严重)、15 个评为 High(高危)、4 个评为 Medium(中危),0 个为 Low(低危)。
独立的 CVSS 评分和相关维护者的评估则给出了不同分布:1 个 Critical、16 个 High、8 个 Medium、2 个 Low。8 个 Critical 评级中仅有 1 个成立。
两个降级案例展示了模型无法感知的信息。对于 Temporal Server,Mythos 评为 Critical,并描述攻击者可以跨命名空间控制工作流。
Temporal 维护者将该问题评为 2.3 分,即 Low,因为利用该漏洞需要攻击者控制一个已持有特权内部凭据的命名空间,且影响范围仅限于已知工作流。
在 MinIO 的案例中,Mythos 同样评为 Critical,外部安全公司评为 High,MinIO 最终定为 Medium:攻击需要已有的集群 root JWT,且仅允许读取访问。严重性取决于部署假设、权限边界和攻击前置条件,而这些很难仅凭源代码判断。
带有预评级的结果对安全团队而言只是分流输入。在 27 个漏洞中,14 个存在严重性偏差,其中 13 个被高估,1 个被低估——后者是 jq 命令行 JSON 工具中的一个缺陷。按模型自身评级排序的队列,会把本不该优先处理的工作排到最前面。
Part03
利用能力跃升但仍受限
Anthropic 基于 Firefox 147 内置的 SpiderMonkey JavaScript 引擎中 50 个此前已发现的漏洞构建了一个基准测试,每个漏洞给予模型 5 次尝试机会,共 250 次试验。Claude Mythos Preview 在 181 次试验中(即 72.4%)将一个已知崩溃转化为可用的任意代码执行漏洞,并在另外 29 次试验中实现了部分寄存器控制。
Claude Opus 4.6 仅成功 2 次,成功率不足 1%。这就是两代模型之间约 90 倍的跃升,但伴随三个条件:每次试验都从一个已被发现的崩溃点出发,测试框架剥离了 Firefox 的浏览器沙箱及其他纵深防御保护,且该评估由 Anthropic 设计并执行,尚未经过独立复现。
成本同样发生了变化。Anthropic 将一个已知的 Linux 内核释放后使用(use-after-free)漏洞转化为可用的 root 漏洞利用,推理成本不到 2,000 美元,运行时间不到一天,并将其与在内核流量控制调度器中发现的第二个释放后使用漏洞串联利用。发现一个值得利用的漏洞仍需花费数千美元,且无法保证结果是高危或严重级别的缺陷。
Echo 在 2026 年 7 月对 80 余位美国高级安全负责人进行了调查。其中 37% 将“检测到的漏洞数量超过修复能力”列为改善软件供应链安全的最大障碍,11% 表示下一笔投资将用于加强检测或扫描。Anthropic 已人工确认了更多漏洞,但尚未发送给维护者,因为其内部团队和外部合作伙伴均缺乏足够的审核能力来处理这些漏洞。
参考来源:
Most of the bugs Claude Mythos found have never been checked by a human
https://www.helpnetsecurity.com/2026/09/04/echo-claude-mythos-vulnerability-findings/
#
推荐阅读
#
电报讨论
#
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:FreeBuf 《Claude Mythos发现2.3万条漏洞线索,超2.1万条无人复核》
版权声明
本站仅做备份收录,仅供研究与教学参考之用。
读者将信息用于其他用途的,全部法律及连带责任由读者自行承担,本站不承担任何责任。










评论