五、其他常见垃圾爬虫(社区长期反馈的"流氓 UA")(11 条)

邮箱收割、内容盗取、无视 robots.txt 的口碑恶劣爬虫。上游库内描述明确含有 spam / harvest / fake / abusive 等特征词,或被社区长期反馈。表格中的:"匹配正则"可直接用于做访问日志分析或 WAF 拦截规则。

#匹配正则典型 UA 实例说明
1antibotAntibot web crawler for content discovery
2AP3A\.240617\.008Mozilla/5.0 (Linux; Android 15; CPH2557 Build/AP3A.240617.008; wv) AppleWebKit/537.36 (KHTML, like …80legs web scraping service
3AspiegelBotMozilla/5.0 (Linux; Android 7.0;) AppleWebKit/537.36 (KHTML, like Gecko) Mobile Safari/537.36 (comp…Aspiegel web crawler for content discovery
4Bark[rR]owlerBarkrowler/0.5.1 (experimenting / debugging - sorry for your logs ) http://www.exensa.com/crawl - a…Barkrowler web crawler for content discovery
5binlarbinlar_2.6.3 binlar2.6.3@unspecified.mailBinlar web crawler for content discovery
6EmailWolfEmailWolf 1.00Email address extraction and contact scraping crawler bot
7ip-web-crawler\.comIP Web Crawler web crawler bot
8PetalBotMozilla/5.0 (compatible;PetalBot;+https://webmaster.petalsearch.com/site/petalbot)Petal search engine web crawler bot
9TombaPublicWebCrawlerMozilla/5.0 (compatible; TombaPublicWebCrawler/1.0; +https://tombascraper.com)Tomba web crawler for email discovery
10YisouSpiderYisouSpiderYisou search engine web crawler bot
11ZoominfoBotZoominfoBot (zoominfobot at zoominfo dot com)ZoomInfo web crawler for business intelligence