最新下载
热门教程
- 1
- 2
- 3
- 4
- 5
- 6
- 7
- 8
- 9
- 10
apache如何禁止网络爬虫采集的配置方法
时间:2022-06-25 00:11:58 编辑:袖梨 来源:一聚教程网
Apache中禁止网络爬虫,其实也挺简单的,只要把下面的代码配置到apache的httpd.conf文件中的Location中,就可以了。
SetEnvIfNoCase User-Agent "spider" bad_bot
BrowserMatchNoCase bingbot bad_bot
BrowserMatchNoCase Googlebot bad_bot
Order Deny,Allow
#下面是禁止soso的爬虫
Deny from 124.115.4. 124.115.0. 64.69.34.135 216.240.136.125 218.15.197.69 155.69.160.99 58.60.13. 121.14.96. 58.60.14. 58.61.164. 202.108.7.209
Deny from env=bad_bot
这是禁止了所有包含spider字符的爬虫。
如果要针对性的禁止爬虫,改成精确匹配的爬虫字符串,如果bingbot、Googlebot等等
相关文章
- 哔咔漫画app官网入口-哔咔漫画网页版官方直达 03-12
- 苹果18手机什么时候上市-预计价格多少-苹果18手机图片 03-12
- b站网页版登录入口-哔哩哔哩官网登录入口 03-12
- twitter官网网页版-twitter官方登录界面 03-12
- 谜漫画最新版下载安卓安装包-谜漫画安卓版官方下载地址入口 03-12
- manwa2漫蛙漫画官网-漫蛙manwa2漫画站 03-12