众力资讯网

伪装 ClaudeBot扫网站漏洞,AI名字成了 网站日志里看到一堆 Claud

伪装 ClaudeBot扫网站漏洞,AI名字成了
网站日志里看到一堆 ClaudeBot 的访问记录,密度比平时高三四倍。

我当时没太在意,以为是 Anthropic 那边加大了抓取频率。过了两天看监控,发现这些请求全在扫后台路径——/admin、/wp-login、/config.php 这种明显的漏洞探测路径。ClaudeBot 官方文档里写得很清楚,它只抓公开内容,不会去碰这些敏感路径。

我把 User-Agent 拉出来对比了一下,发现请求头里虽然写着 ClaudeBot,但 IP 段跟 Anthropic 公布的地址池完全不匹配。有几个 IP 甚至来自东欧某个以前因为 DDoS 被我们拉黑过的 ASN。这不是 ClaudeBot,是有人披着它的皮在扫。

去年我碰到过类似的事,当时是 Googlebot 被人冒充。那次对方还算克制,只是在测某个表单注入点。这次不一样,扫的路径覆盖了十几个常见 CMS 的默认后台、API 密钥泄露路径、还有几个冷门框架的历史漏洞入口。明显是有人拿着一个现成的漏洞字典在批量扫,用 AI 机器人的名义只是为了降低被 WAF 拦截的概率——很多防火墙对已知的 AI 爬虫都有白名单策略。

我查了一下,最近三个月里,伪装成 AI 机器人的扫描流量占比从 0.1% 涨到了 0.8%。不算高,但增速很快。用得最多的伪装对象是 ClaudeBot、GPTBot、还有 Googlebot-Image。估计是因为这几个名字听起来人畜无害,容易过安全设备。

我们现在的做法是直接验证 IP:凡是声称自己是某个 AI 爬虫的请求,先反查它的 PTR 记录,再跟官方公布的 IP 段做匹配。不在范围内的全部按可疑流量处理,扔到单独的队列里人工看。麻烦是麻烦,但比被扫穿一个未修补的洞要好。

最让我多想的是另一件事:如果以后 AI Agent 真的开始大规模自主访问网站,安全团队怎么区分哪些是正常 Agent、哪些是攻击?现在还能靠 IP 白名单,等到 Agent 数量上来,各家都在用代理池、动态 IP,这套验证逻辑估计撑不了多久。
网络安全 AI伪装 漏洞扫描 ClaudeBot 技术防御 爬虫识别 安全运维