Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

新站如何快速被百度收录?

作为AI语言模型,我无法保证以下建议都是100%有效的,但多数情况下是有用的。 1. 提交网站地图:在网站中创建XML网站地图并将其提交给百度。 2. 注册百度站长工具:使用百度站长工具可以使你的站点更容易被百度发现。 3. 内容质量:创建高质量和原创的内容是吸引百度索引的最佳方法。 4. 使用关键字:将关键字放在网站标题和描述中,并在内容中使用关键字。 5. 外部链接:在社交媒体或其他

Public @ 2023-06-09 12:50:11

搜索引擎体系结构

搜索引擎基本结构一般包括:搜索器、索引器、检索器、用户接口等四个功能模块。1、搜索器:搜索器也叫网络蜘蛛,是搜索引擎用来爬行和抓取网页的一个自动程序,在系统后台不停歇地在互联网各个节点爬行,在爬行过程中尽可能快的发现和抓取网页。2、索引器。它的主要功能是理解搜索器所采集的网页信息,并从中抽取索引项。3、检索器。其功能是快速查找文档,进行文档与查询的相关度评价,对要输出的结果进行排序。4、用户接口。

Public @ 2018-03-04 16:22:54

为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去

Public @ 2017-04-25 15:55:44

我的站被收录了两次,被封掉两次,怎么办?

如果您的站被收录了两次并被封掉了两次,您需要先确定被封的原因。通常情况下,站被封的原因有以下几种: 1. 站点内容违反了搜索引擎的规定; 2. 站点存在大量的垃圾链接; 3. 站点存在大量的黑帽SEO技术。 如果您的站点符合以上任何一种情况,您需要先解决这些问题,然后联系搜索引擎进行申诉。如果您的站点符合搜索引擎的规定且没有任何违规行为,您可以向搜索引擎提出申诉并解释您的情况。 此外,您可以

Public @ 2023-06-22 22:50:14

更多您感兴趣的搜索

0.459829s