Categories


Tags


ETag使用效果对比&;经验分享

提起向百度提交数据,大家基本都会想到sitemap,最近又推出的ETag是什么东东?真的能有效果吗?其实在ETag推出之初,我们平台的非技术人员对效果也是没有预期的,于是请智联招聘SEO负责人桃李重点关注数据变化,就是希望能给各位同学看到最真实的效果。

sitemap是解决网站收录至关重要的途径之一,而通常sitemap的更新都不是很及时,并且体量都相对较大,,此时也消耗了相应的网站流量及带宽。而ETag可以用来标示网页是否发生了变化,如果没有变化返回304状态码,就不用再重新传输整个网页了。

在我们的sitemap配置了ETag之后,对日志一段时间的监测发现,其sitemap响应时间以及耗时的平均时间均大幅度下降,爬虫访问sitemap文件的次数有所增加,对于收录而言,通过图表也能看出相对的增长曲线,我们的整体收录率大致提升范围在2% – 5%左右。所以在此,强烈建议大家设置sitemap的ETag,简简单单的一个小动作就能看到相对明显的效果还是很不错的。

ETag全称EntityTags,HTTP协议规格说明中定义“ETag”为“被请求变量的实体值”。我们也可以把ETag理解为是一个客户端与服务器关联的记号。这个记号告诉客户端,当前网页在上次请求之后是否有发生变化,当发生变化时,ETag的值重新计算,并返回200状态码。如果没有变化,返回304状态码。从而不会重新加载整个页面信息。

如下,是我司站点的sitemap文件的头信息:

我们看到,ETag中包含了一连串的数据,这就是计算出来的一个值,如果它发生变化,说明其页面内容一定发生了变化。如果页面没有发生变化时,头信息应该如下:

在我们与技术沟通配置ETag时,需要通过此种方式进行验证。第一次访问200状态码,有ETag的一行文本,再次访问该页面时,状态码为304,ETag的值不变。至此,我们就可以确定ETag配置成功。

另外,sitemap启用Etag后:

1、  百度可以更及时地响应sitemap的更新;

2、  页面没有更新的情况下,对流量的消耗极小;

3、  百度更加及时的抓取sitemap,便于更好的收录;

但多数情况下,ETag会与Last-Modified一起使用,这样可利用客户端(例如浏览器)的缓存。因为服务器首先产生Last-Modified/Etag标记,服务器可在稍后使用它来判断页面是否已经被修改。本质上,客户端通过将该记号传回服务器要求服务器验证其(客户端)缓存。

对于如何配置ETag站长学堂有很详细的文章指南:对站点服务器如何配置ETag,最好是对全站进行配置ETag,这样对于站点而言,在带宽消耗、爬虫抓取上的提升还是会有很大收益的。

来源:百度搜索资源平台 百度搜索学堂


Public @ 2016-07-31 16:09:45

网站结构有哪些类型1:什么是树状结构

网站结构有以下类型: 1. 线性结构:网页按照线性顺序呈现,用户只能按照给定的路径进行操作。 2. 并列结构:网页中的多个页面并列展示,用户可以按照自己的意愿任意选择。 3. 分层结构:根据主题或类别将网页分成不同的层次,并且每一层都有相应的子页链接。 4. 网状结构:网页中的所有页面都可以互相连接,没有明确的层次结构。 5. 混合结构:以上几种结构的组合。 树状结构是一种分层结构,也称为层次

Public @ 2023-04-16 03:50:18

禁止搜索引擎收录的方法

1. 什么是robots.txt文件?搜索引擎使用spider程序自动访问互联网上的网页并获取网页信息。spider在访问一个网站时,会首先会检查该网站的根域下是否有一个叫做 robots.txt的纯文本文件,这个文件用于指定spider在您网站上的抓取范围。您可以在您的网站中创建一个robots.txt,在文件中声明 该网站中不想被搜索引擎收录的部分或者指定搜索引擎只收录特定的部分。请注意,仅当

Public @ 2015-10-28 16:08:55

搜狗资源平台-Sitemap提交帮助

功能说明提交Sitemap工具可以向搜狗提交网站Sitemap文件,帮助搜狗spider抓取您的网站。目前Sitemap采用邀请制,您可在此工具下选择已验证的站点,并观察站点是否已被邀请。Sitemap提交后,搜狗搜索会根据Sitemap了解网站中的网址及关于每个网址的其他元数据(上次更新的时间、更改的频率等)。注意事项1.sitemap采用邀请制,当您的网站存在原创或不可替代内容或不能被搜狗sp

Public @ 2021-11-12 16:09:46

什么是ETag?ETag作用有哪些

ETag是HTTP协议提供的一种用于判断资源是否发生变化的机制。ETag是一个字符串,由服务器生成,在资源被更新时会发生变化。客户端请求资源时,服务器会将资源的ETag值一起返回,客户端可以缓存资源,并记录ETag值。当客户端再次请求该资源时,会将上次记录的ETag值一同发送给服务器。如果此时服务器返回的ETag值与客户端记录的值相同,就说明资源没有变化,客户端可以直接使用缓存的资源,减少网络请求

Public @ 2023-03-25 23:50:19

更多您感兴趣的搜索

0.523701s