黑客冒充OpenAI、Anthropic和DeepSeek等AI爬虫,窃取凭据与机密

admin 2026-09-06 04:54:29 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: 攻击者伪造OpenAI、Anthropic、DeepSeek等AI爬虫身份,利用伪造User-Agent标头扫描网站,窃取.env、云凭据等敏感文件。GreyNoise发现824个IP地址参与活动,攻击者不请求robots.txt且来源IP与官方不匹配。建议组织验证源IP、监控敏感路径请求,并轮换暴露的云密钥。 综合评分: 75 文章分类: 威胁情报,漏洞分析,安全意识,安全运营


黑客冒充OpenAI、Anthropic和DeepSeek等AI爬虫,窃取凭据与机密

FreeBuf

2026年9月2日 18:00 上海

在小说阅读器读本章

去阅读

在公众号小说中沉浸阅读

Part01

伪造AI爬虫扫描

攻击者正在冒充OpenAI、Anthropic、DeepSeek及其他主要组织的网络爬虫,扫描网站以查找暴露的凭据和敏感配置文件。他们的目标是可能泄露云密钥、API令牌、密码和私钥的配置错误服务器。

GreyNoise观察到,一个更大规模的攻击集群使用了来自8家公司的13个AI爬虫身份。这些扫描器请求了诸如.env、/.aws/credentials、私钥位置和密码存储等文件。.env文件通常包含应用程序机密,包括数据库密码、云访问密钥和API令牌。

该活动依赖一种简单但有效的欺骗手法:伪造HTTP User-Agent(用户代理)标头。网络爬虫通过此标头标识自己,例如Googlebot、ClaudeBot或GPTBot。然而,客户端可以自行提供该标头,因此它无法证明请求确实来自标头所称的组织。

这给那些仅根据爬虫名称授予访问权限、绕过控制或抑制安全告警的组织带来了风险。攻击者可以逐字符复制官方爬虫字符串,使基于User-Agent的检测失效。

Part02

扫描规模与行为特征

GreyNoise识别出六个伪造的AI爬虫名称,分别关联到Anthropic、OpenAI、Google和Perplexity。2026年7月28日至8月23日期间,这些名称出现在一个HTTP客户端指纹上,来自824个不同的IP地址。

该指纹在过去90天内使用了超过1500个User-Agent字符串,其中大多数声称是正常的网络浏览器。涉及这六个爬虫名称的活动几乎全部发生在8月,8月23日记录到的单日数量最高。

研究人员还发现,相关活动分布在795个不同的/24网段中。这种分布使得简单的网络封禁变得不切实际,因为防御者无法仅通过封禁单个托管服务商或少量IP段来可靠阻止该活动。

各User-Agent的会话数,2026年7月28日至8月23日。ClaudeBot为琥珀色;其他三个以爬虫命名的User-Agent字符串体量更大

GreyNoise表示,这824个源地址无一与上述合法爬虫已发布的IP段匹配。该公司将这些地址与Anthropic、OpenAI、Google、Perplexity和Amazon公布的列表进行了比对,未发现任何重叠。

一个关键指标是扫描器的请求模式。合法的搜索和AI爬虫通常会检查/robots.txt,该文件告知自动化客户端网站允许它们访问哪些内容。

在观察到的活动中,这六个伪造爬虫身份从未请求过/robots.txt。相反,它们试图访问暴露的机密文件和云凭据,请求路径包括:/.env、/app/.env、/api/.env、/backend/.env、/.env.production、/.env.bak和/.aws/credentials。

GreyNoise将可疑活动与Anthropic合法的ClaudeBot在同一时期的流量进行了对比。真实爬虫请求/robots.txt的频率超过任何其他路径,占其流量的12%,并且没有请求凭据文件。

这种区别很重要,因为合法的AI爬虫旨在检索公开网络内容以用于索引、搜索或引用相关功能。它没有理由请求环境文件、云凭据存储或私钥。

Part03

身份验证与防护建议

组织绝不应将User-Agent字符串作为爬虫身份的证据。任何允许爬虫访问或为其豁免控制的服务,都应依据厂商官方发布的爬虫IP段验证源IP地址。

安全团队还应针对 /.env、/.aws/credentials和/.git/config 等敏感路径的请求进行调查并产生告警。这些文件绝不应通过公共Web服务器暴露。

Web管理员应确保.env和.git目录、云凭据文件以及私钥位于Web根目录之外。如果任何云密钥可以通过公共URL访问,应立即轮换,因为暴露应被视为潜在的失陷。

该活动并不能证明攻击者已成功从任何特定受害者处获取文件。然而,它突显了威胁行为者可以多么轻易地滥用人们对知名AI品牌的信任,将凭据收集扫描隐藏在普通的Web流量中。

参考来源:

Hackers Pose as OpenAI, Anthropic and DeepSeek to Steal Credentials and Secrets

Hackers Pose as OpenAI, Anthropic and DeepSeek to Steal Credentials and Secrets

#

推荐阅读

#

电报讨论


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我

本文转载自:FreeBuf 《黑客冒充OpenAI、Anthropic和DeepSeek等AI爬虫,窃取凭据与机密》

评论:0   参与:  0