【官方说法】百度蜘蛛抓取流量暴增的原因_威海佰年网络技术有限公司_网站建设_软件开发_私有云_商标注册_公众号_小程序_APP_物联网

【官方说法】百度蜘蛛抓取流量暴增的原因

威海Spider 威海Baiduspider
1114

Spider对网站抓取数量突增往往给站点带来很大烦恼，纷纷找平台想要Baiduspider IP白名单，但实际上BaiduSpider IP会随时变化，所以并不敢公布出来，担心站长设置不及时影响抓取效果。百度是怎么计算分配抓取流量的呢？站点抓取流量暴增的原因有哪些呢？

总体来说，Baiduspider会根据站点规模、历史上网站每天新产出的链接数量、已抓取网页的综合质量打分等等，来综合计算抓取流量，同时兼顾站长在抓取频次工具里设置的、网站可承受的最大抓取值。

从目前追查过的抓取流量突增的case中，原因可以分为以下几种：

1， Baiduspider发现站内JS代码较多，调用大量资源针对JS代码进行解析抓取

2，百度其他部门（如商业、图片等）的spider在抓取，但流量没有控制好，sorry

3，已抓取的链接，打分不够好，垃圾过多，导致spider重新抓取

4，站点被攻击，有人仿冒百度爬虫（推荐阅读：如何正确识别百度蜘蛛）

如果站长排除了自身问题、仿冒问题，确认BaiduSpider抓取流量过大的话，可以通过反馈中心来反馈，切记一定要提供详细的抓取日志截图。

来源：百度搜索资源平台百度搜索学堂

Public @ 2011-07-18 15:38:37

8月份百度Spider升级了对HTTPS数据的抓取力度，HTTPS数据将更快被Spider抓取到。如网站还在做HTTPS的改造，且网站数据未搭建好，建议网站采取以下措施，避免Spider抓取，以免造成网站流量损失1、把HTTPS的协议封掉，可把443端口关掉；2、做HTTPS到http的301；3、建议站点在改HTTPS没改造好之前，不要提供超链接指向，以免被Spider抓到HTTPS。4、针对一

Public @ 2011-03-28 15:38:47

360搜索蜘蛛IP段及蜘蛛ip被拦截的问题解决方法

威海Spider 威海360Spider
1315

360搜索蜘蛛IP段：以下是360搜索的蜘蛛IP段： - 101.226.68.0/24 - 101.227.0.0/16 - 106.12.0.0/15 - 114.113.192.0/18 - 115.238.0.0/17 - 117.121.0.0/17 - 117.122.0.0/15 - 119.147.128.0/17 - 119.188.0.0/16 - 120.204.0.0

Public @ 2023-03-31 17:50:44