Nginx 配置禁止蜘蛛抓取网站无用页面教程

Nginx 配置禁止蜘蛛抓取网站无用页面教程

2026-08-17 14:30

Meta 描述:Nginx 配置规则屏蔽搜索引擎抓取搜索页、分页、下载跳转页,减少无效收录,节省服务器爬虫带宽资源。

网站很多页面不希望被搜索引擎收录,例如搜索结果页、卡密弹窗页、下载中转页面,如果被大量抓取,会消耗服务器带宽,还会产生大量垃圾收录,影响网站权重。除了 robots.txt,Nginx 可以直接返回 http 状态码拒绝蜘蛛抓取。


操作步骤


  1. 登录宝塔,网站设置,点击配置文件,找到 server {} 区块
  2. 在 server 内部添加规则,区分百度蜘蛛 UA,匹配不希望收录的 url 路径
  3. nginx
if ($http_user_agent ~* "Baiduspider") {
    if ($request_uri ~* "/search|/download-jump|/cardmi") {
        return 403;
    }
}



  1. 保存配置,点击重载 Nginx,确认没有报错。

补充 robots.txt 配合写法

plaintext


User-agent: *
Disallow: /search
Disallow: /download-jump
Disallow: /admin



验证是否生效


  1. 使用 curl 模拟百度蜘蛛 UA 访问页面,查看返回状态码
  2. 百度资源平台抓取诊断工具,测试对应 url 返回码

注意事项


  • 不要直接屏蔽真实资源详情页面,只屏蔽中转、搜索、后台地址
  • 规则写错会造成全站无法访问,修改配置一定要重载测试。
小结:robots 只是建议,部分爬虫会无视 robots,Nginx 直接返回状态码,拦截效果更强,减少服务器无效抓取压力。


©
资源发布网 © 2026

1 本网站名称:资源发布网
2 本站永久网址:http://zyfbw.com
3 本网站的文章部分内容来源于网络,仅供大家学习与参考,如有侵权,请联系站长 QQ进行删除处理。
4 本站资源仅供学习和交流使用,版权归原作者所有,请在下载后24小时之内自觉删除。
5 本站大部分下载资源收集于网络,不保证其完整性以及安全性,不提供技术支持,请下载后自行研究。
6 若作商业用途,请购买正版,由于未及时购买和付费发生的侵权行为,使用者自行承担,概与本站无关。