2020年,你需要一个全网通用的网站平台

方山建站谈网站优化之防止网站被采集

编辑:方山新城建站 关注: 时间:2019-12-11 11:19:55


温馨提示:专业网站建设、小程序制作、APP开发,尽在新城建站,详询 15544599750(手机、微信、QQ同号)

采集就是使用程序通过自动化操作复制数据。

首先说明,只要是能让浏览器访问的,就没有不能采集的。

但是可以通过一定的手段让采集变得非常麻烦,进而在大量数据的情况下延迟采集完成时间,加大采集难度。

一般的情况略过不说,几种情况比较特别的:

1、验证来路,cookie,session这些,比如PHP可以用fsockopen自定义HTTPHeader,基本上这些方法没什么效果。

2、限速,限制某段时间内打开页面数量。这个只是推迟了下,大部分时间效果一般。比如某站限制一分钟之内只能打开30个网页,页面大小平均30K,则用迅雷批量下载就OK了,设置限速为2K,一觉醒来什么都好了。这个方法效果也基本没有。

3、比较特别的方法,设置一个数量级的阀值,达到这样数量后,必须验证方能继续,比如打开10个页面需要输入验证码,这个时候只需要保证验证码不可识别,分配一个session,以后的浏览过程中用session保证用户合法性,这样不影响后续访问,同时可以有效防止采集。

4、第三条对蜘蛛是致命的,此时可通过手机蜘蛛IP段,放行,其它的按照严格规则来。

5、3+4真是无敌的吗?远非可以高枕无忧,比如此站有10万个页面,则设置100个代理,在阀值前循环使用代理,这样实际上绕过了3的限制。

6、还有别的办法吗?不能,因为你的网站能用浏览器打开。


拓展阅读:

方山建站谈做好3点实现网站的盈利目的

方山小程序开发谈怎样建立一个优秀的网站

方山建站分享网页设计中优化代码重要性

方山小程序谈网站换程序后要怎么进行网站优化

方山网络优化谈关于网页设计的专业性

方山建站公司分享做定制网站建设需要注意的6个要点

方山网站推广谈网站网页快照被删除了如何解决?

方山小程序开发分享网站页脚界面应该怎样设计?

本文由新城建站整理发布,喜欢请收藏,转载请保留链接 方山建站谈网站优化之防止网站被采集https://www.nccpu.net/shanxi/lvliang/fangshan/14210.html

服务支持

我们珍惜您每一次在线询盘,有问必答,用专业的态度,贴心的服务。

让您真正感受到我们的与众不同!