apache禁止搜索引擎收录、网络爬虫采集的配置方法-6ren

apache禁止搜索引擎收录、网络爬虫采集的配置方法

转载作者：qq735679552 更新时间：2022-09-29 22:32:09

CFSDN坚持开源创造价值，我们致力于搭建一个资源共享平台，让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章apache禁止搜索引擎收录、网络爬虫采集的配置方法由作者收集整理，如果你对这篇文章有兴趣，记得点赞哟.

Apache中禁止网络爬虫，之前设置了很多次的，但总是不起作用，原来是是写错了，不能写到Dirctory中，要写到Location中。

。

复制代码代码如下:

 
 <Location /> 
 
 SetEnvIfNoCase User-Agent "spider" bad_bot 
 
 BrowserMatchNoCase bingbot bad_bot 
 
 BrowserMatchNoCase Googlebot bad_bot 
 
 Order Deny,Allow 
 
 #下面是禁止soso的爬虫 
 
 Deny from 124.115.4. 124.115.0. 64.69.34.135 216.240.136.125 218.15.197.69 155.69.160.99 58.60.13. 121.14.96. 58.60.14. 58.61.164. 202.108.7.209 
 
 Deny from env=bad_bot 
 
 </Location>

。

这是禁止了所有包含spider字符的爬虫。如果要针对性的禁止爬虫，改成精确匹配的爬虫字符串，如果bingbot、Googlebot等等。

最后此篇关于apache禁止搜索引擎收录、网络爬虫采集的配置方法的文章就讲到这里了,如果你想了解更多关于apache禁止搜索引擎收录、网络爬虫采集的配置方法的内容请搜索CFSDN的文章或继续浏览相关文章，希望大家以后支持我的博客！。

文章推荐：使用apachetop实时监控日志、动态分析服务器运行状态

文章推荐： iOS实现联系人列表功能

文章推荐： iOS实现从通讯录中选择联系人

文章推荐： VPS CentOS-6 下 LNMP HTTP web服务器的搭建步骤

Filebeat 采集 Nginx 日志的方法
Nginx 日志可用于分析用户地址位置，行为画像等，如何通过 Elastic Stack 进行一站式的数据采集，数据清洗，数据落地，数据可视化，让数据发挥真正的价值呢？架构设计涉及到 El
c++ - 采集 NTSC 模拟板时 DirectShow 像素乱序
我正在为 Directshow 编写自定义视频渲染过滤器。我的渲染器假定传入像素一次组织一行像素(正确的假设？)并使用 DirectX 纹理将它们 blits 到其他地方的另一个 DirectX 显示

qq735679552

个人简介

我是一名优秀的程序员,十分优秀！

作者热门文章

滴滴打车优惠券免费领取

全站热门文章

首页

博学

6Ren·AI

商城

apache禁止搜索引擎收录、网络爬虫采集的配置方法