科技常识:apache禁止搜索引擎收录、网络爬虫采集的配置方法

2021-03-17 19:40:39
导读 今天小编跟大家讲解下有关apache禁止搜索引擎收录、网络爬虫采集的配置方法 ,相信小伙伴们对这个话题应该也很关注吧,小编也收集到了有关

今天小编跟大家讲解下有关apache禁止搜索引擎收录、网络爬虫采集的配置方法 ,相信小伙伴们对这个话题应该也很关注吧,小编也收集到了有关apache禁止搜索引擎收录、网络爬虫采集的配置方法 的相关资料,希望小伙伴会喜欢也能够帮助大家。

Apache中禁止网络爬虫,之前设置了很多次的,但总是不起作用,原来是是写错了,不能写到Dirctory中,要写到Location中

复制代码 代码如下:<Location />SetEnvIfNoCase User-Agent"spider"bad_botBrowserMatchNoCase bingbot bad_botBrowserMatchNoCase Googlebot bad_botOrder Deny,Allow#下面是禁止soso的爬虫Deny from 124.115.4. 124.115.0. 64.69.34.135 216.240.136.125 218.15.197.69 155.69.160.99 58.60.13. 121.14.96. 58.60.14. 58.61.164. 202.108.7.209Deny from env=bad_bot</Location>

这是禁止了所有包含spider字符的爬虫。如果要针对性的禁止爬虫,改成精确匹配的爬虫字符串,如果bingbot、Googlebot等等

来源:爱蒂网

免责声明:本文由用户上传,如有侵权请联系删除!

猜你喜欢

最新文章