Categories


Tags


【院长帮帮忙】页面无用时间信息导致网页不被爬虫抓取(第一期)

在【院长帮帮忙】栏目露过面的站点是编织汇(www.bianzhihui.com),该站点通过反馈中心反馈页面内容迟迟不被抓取,经百度工程师追查,原来是因为页面上的无用时间信息——没有想到是不是?同学们快来看看这个案例吧。也想让院长帮助追查吗?快来看看这里!

站点求助:现象

编织汇网站内容发布后几个礼拜都未曾收录。案例如下:

http://www.bianzhihui.com/t/6717(教程详细页面举例)

http://www.bianzhihui.com/u/12306 (用户页面举例)

http://www.bianzhihui.com/h/154 (编织花样页面举例)

我们已将这些url放入sitemap,并使用了百度统计的集成的JS推荐,但是未曾有改善。

站点求助:自查

根据反馈中心的回复,使用抓取异常工具诊断:未发现异常

院长出手,内部追查

工程师结论: spider抓取很及时,但因为该网站没有设置内容产出时间,网站底部却有个老旧时间日期,导致spider误以为网页内容老旧(具体策略较复杂,在此不做赘述)。建议增加页面内容产生时间,去掉没有必要的时间信息

*以上为旧页面截图,“2014年9月9日”对时间识别造成干扰。

站点总结:

1,网页上切忌勿乱加时间,如我们网站的(始于2014年9月9日)这种时间是一个大忌

2,网页内容尽可能加上产出时间,也就是发布时间

3,百度site的结果时间和权重并无太多关系

4,跟百度沟通的时候,一定要条例清晰,证据确凿。自身的问题一定要先排查准确。

来源:百度搜索资源平台 百度搜索学堂


Public @ 2015-07-21 15:22:04

百度Spider渲染UA在移动端全流量上线

百度Spider在2017年3月同时推出渲染UA在移动端和PC端进行内测(《百度Spider新增渲染UA抓取公告》),内测期间分析了多个抓取量异常的case,均非渲染UA造成。本周百度Spider渲染UA在移动端全流量上线,PC端还未全部覆盖。特提醒PC站长,截止目前,对搜索引擎和用户有价值的内容,还是尽量不要使用JS加载的方式,以免造成不能索引等损失。来源:百度搜索资源平台

Public @ 2014-04-27 15:38:47

【官方说法】百度蜘蛛抓取流量暴增的原因

百度官方表示,造成蜘蛛抓取流量暴增的原因主要有以下几个方面: 1. 站点更新频繁:如果站点内容更新频繁,蜘蛛会更加积极地抓取页面,从而带来流量的上涨。 2. 站点质量提高:如果站点内容质量得到提高,搜索引擎会更加青睐,从而增加蜘蛛的抓取频率,进而带来流量的上涨。 3. 站点结构优化:如果站点结构调整得当,蜘蛛能够更好地抓取页面,从而提高流量。 4. 站点权重提高:如果站点的权重得到提高,蜘

Public @ 2023-06-12 09:50:20

【院长帮帮忙】第三期:无效搜索结果页是个祸害

上一期在【院长帮帮忙】里露面的是和讯网,由于他们的服务器限制外网访问,造成主动推送失败。本期这个站点的SEO负责人希望不要暴露身份,院长同意了。我们来看看无效搜索结果页是如何祸害站点、尤其是新站点的吧。也想让院长帮助追查吗?快来看看这里!站点求助:现象B2B新站上线有一个月,一开始的时候收录还是不错的,在百度里直接搜索网站名能排到首页第5位的样子,但是在百度站长平台认证了我们的站,修改了一下rob

Public @ 2010-09-15 15:22:03

【院长帮帮忙】我的网站排名为什么突然下降?(第十期)

近期,院长收到许多站长的反馈,说自己运营的站点排名突然下降。有站长对照近期公布的细雨算法分析,认为是细雨算法的惩罚生效,影响了网站的流量。但情况真的是这样吗?现在就让院长来给你个说法吧!院长对近期反馈的case集中进行了分析,从反馈的问题来看,问题多集中在网站标题作弊,明确的说,是网站页面标题堆砌的行为导致的。自2017年9月起,百度搜索资源平台发布了清风算法、清风算法2.0 ,主要是针对标题作弊

Public @ 2021-03-04 15:22:02

更多您感兴趣的搜索

0.407852s