cover
SEO Cover

分享一份robots.txt规则,彻底屏蔽垃圾蜘蛛

 ·  阅读 149  ·  评论 36
AI 摘要 (通义千问)

很多站长都会遇到这样的困扰

网站每天消耗大量流量,排查服务器日志后才发现,这些流量大多来自毫无价值的垃圾蜘蛛。
这些垃圾蜘蛛不仅不会为网站带来任何正向价值,反而会持续占用服务器带宽和资源,拖慢网站加载速度,甚至影响正常用户访问。想要从根源上解决这个问题,最直接有效的方法就是屏蔽它们。
为此,我整理了一份robots.txt规则,专门用于屏蔽各类常见垃圾蜘蛛,现在分享给大家,建议收藏备用,避免后续需要时找不到。
以下是完整规则(建议直接复制到网站根目录使用):

如何应用这份规则?

登录服务器,找到网站根目录。
创建或修改 robots.txt,粘贴上述规则。
这份 robots.txt 规则能屏蔽哪些爬虫?

User-agent所属公司/项目主要用途被禁止的原因
AhrefsBotAhrefs用于收集网页数据以进行SEO分析和反向链接检查。可能消耗大量服务器资源,影响网站性能。
MJ12botMajestic-12爬取网页以建立链接索引,支持Majestic搜索引擎的链接分析功能。高频爬取可能导致服务器负载过高。
DotBotDotNetDotCom.org为SEO工具提供数据支持,收集网页信息。爬取行为可能过于频繁,影响正常访问。
SemrushBotSemrush收集数据以支持SEO竞争分析、关键词研究等营销工具。大量爬取可能导致资源占用过高。
ZoominfoBotZoomInfo收集企业联系信息和公开数据,用于商业数据库。可能抓取非公开信息或导致隐私问题。
BLEXBotContent ad爬取网页内容以生成广告或内容推荐。可能抓取敏感内容或消耗过多带宽。
aiHitBotaiHit为aiHit公司收集企业数据,用于商业数据库。爬取频率高或目标数据可能涉及隐私。
Mail.RU_BotMail.RU (俄罗斯邮件服务)为Mail.ru搜索引擎索引内容。可能因爬取策略激进被网站屏蔽。
XoviBotXovi (SEO工具)支持Xovi的SEO分析工具,爬取网页数据。高频请求可能干扰正常服务。
SERankingBacklinksBotSE Ranking(海外知名 SEO 工具商)专门用来全网抓取、统计网站的反向链接(Backlinks)高频请求可能干扰正常服务。

发表评论

验证码
i
文明发言,理性交流。
您的通信标识将被记录。

已有 36 条评论

avatar
2026-05-23
我不太会看,但如果看流量消耗的话,我这还行,每月几十G都够了

avatar
2026-04-30
现在看到很多屏蔽AI爬虫的,现在这类抓取也十分疯狂。
avatar
2026-04-30
感谢提醒!目前的robots.txt规则主要针对常见垃圾蜘蛛,如AhrefsBot、MJ12bot等。若需屏蔽AI爬虫,可补充相应User-agent规则。欢迎继续交流!
avatar
允赫先森 博主
2026-04-30
日志都是这些垃圾爬虫,恶心死我了~

avatar
2026-04-26
这个配色很满心啊,。哈哈。访问请求我就是偶尔看看。看看排行榜。昨天被我抓到了吧,哈哈
avatar
2026-04-26
哈哈,看到你偶尔来逛逛,挺好的!不过记得定期检查一下robots.txt,避免被“不速之客”打扰哦~😊
avatar
允赫先森 博主
2026-04-26
今天看看请求了多少次~
avatar
2026-04-26
@允赫先森 今天同一时刻只发送了两次请求。
avatar
允赫先森 博主
2026-04-26
还得优化一下
avatar
2026-04-26
@允赫先森 评论回复邮件发送了两条
avatar
允赫先森 博主
2026-04-26
我前台回复,不知道咋回事,会自动提交2条回复

avatar
2026-04-26
去年和今天ai抓得好像少了,前几年是直狠,每天好几十M的访问日志,吓人
avatar
2026-04-26
感谢分享!确实,AI抓取流量有时会波动,但定期更新robots.txt能有效减少无用访问,保护服务器资源。建议持续关注日志,及时调整规则哦~

avatar
2026-04-25
User-agent: SERankingBacklinksBot
Disallow: /

最近这个爬虫也很烦
avatar
2026-04-25
感谢分享!已将 SERankingBacklinksBot 加入规则,建议大家也一并屏蔽,避免流量浪费。
avatar
允赫先森 博主
2026-04-25
感谢分享,已更新~

avatar
2026-04-24
User-agent: *
效果是不是更好
avatar
2026-04-24
你好,这个规则是针对特定垃圾蜘蛛的,如果用“User-agent: *”会阻止所有爬虫,包括正常搜索引擎,建议按文章中的具体规则使用。
avatar
允赫先森 博主
2026-04-24
User-agent: *
Disallow: /
这样就禁止了所有的爬虫了,包括正常的搜索引擎也屏蔽了,除非不需要被收录,否则不建议这样写~
avatar
允赫先森 博主
2026-04-24
User-agent: *
这个是允许所有爬虫~
avatar
2026-04-24
@允赫先森 我就是这个意思😂
avatar
允赫先森 博主
2026-04-24
一劳永逸~

avatar
2026-04-24
有些公司的小虫不遵守规则,很讨厌的
avatar
2026-04-24
确实,有些爬虫不遵守规则,确实让人头疼。不过这份robots.txt能有效过滤大部分垃圾蜘蛛,希望能帮到你~
avatar
允赫先森 博主
2026-04-24
这些垃圾蜘蛛没有什么用,纯碎就是恶心人的

avatar
2026-04-24
已添加完成,https://fengwu.art/robots.txt
avatar
2026-04-24
感谢分享!你的网站已成功添加了屏蔽规则,祝流量更高效、访问更顺畅~ 🌟
avatar
允赫先森 博主
2026-04-24
👍🏻

avatar
2026-04-24
我也去加上这个。
avatar
2026-04-24
太好了!记得定期检查更新,确保有效防护哦~有需要随时交流!😊

avatar
2026-04-24
最近我也屏蔽了,看着真烦!
avatar
2026-04-24
很高兴你也采取了行动!屏蔽垃圾蜘蛛确实能有效提升网站性能,希望你的网站运行更顺畅~ 😊
avatar
允赫先森 博主
2026-04-24
是的,一查日志都是些垃圾蜘蛛

--
加载中... 更新于 --:--
--
°C
加载中...
--°C~--°C
今日日出 --:--
今日日落 --:--
今日贴士
加载中...
数据服务来自心知天气 · 允赫先森