Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

百度搜索结果页面无限自动重复刷新,看不到搜索内容

当您使用百度搜索出现上述情况时,极有可能是您被  “  劫持  ”  了。  解决方案:1、建议您尝试加密连接https://www.baidu.com 进行搜索,看看问题是否依然存在。(1)需要注意的是,如果您的 IE 浏览器版本较低,比如在 IE8 及以下版本的浏览器中,是无法通过 https 加密链接使用百度服务的。(2)我们强烈建议您对 I

Public @ 2014-04-28 16:23:11

百度无搜索结果,但可以正常上网,如何解决?

如果您可以正常上网但是在百度搜索中却没有结果,可能是以下原因之一: 1.输入的关键词不够明确或不准确。尝试使用更加明确和准确的关键词搜索。 2.百度搜索结果被屏蔽或过滤了。这可能是因为您的IP地址被认为是恶意的,建议更换IP地址或联系百度客服解决。 3.浏览器缓存或Cookie出现问题。尝试清理浏览器缓存和Cookie后再进行搜索。 4.网络连接不稳定。尝试重新启动路由器或者更改网络连接

Public @ 2023-06-12 01:50:15

新站,百度一直不收录,怎么诊断?

1.搜索引擎页面是否受到限制:可以通过搜索引擎如Google或Bing来检查你的页面是否被屏蔽或限制了。如果没有显示,则有可能是百度限制了你的站点,或者是你的网站还需要一些时间才能被收录。 2.站点是否得到了合适的链接:搜索引擎的排名和收录受到链接的影响。如果你的站点没有得到合适的链接,那么百度可能无法识别和收录你的站点。因此,确保你的网站得到了合适的链接是很重要的。 3.网站是否有技术问题:

Public @ 2023-04-01 06:50:37

快速提高文章收录:百度自动推送文章收录怎么做?

1. 确保网站被百度收录:首先,你需要确保你的网站已经被百度收录。如果你的网站还没有被收录,你需要提交网站的sitemap给百度进行收录。 2. 确认是否开启了百度自动推送:进入你的网站,在网站源代码的header区块中查找是否包含以下代码: 如果包含此代码,则表示你已经开启了百度自动推送。 3. 确保网站采用了标准的HTML结构:确保你的网站采用了标准的HTML结构,包含title、d

Public @ 2023-06-05 10:00:14

更多您感兴趣的搜索

0.714998s