Categories


Tags


为什么我的网站内一些不设链接的私密性网页,甚至是需要访问权限的网页,也会被搜狗收录?

sogou spider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

搜狗Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被搜狗收录,原因有两点:

A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化。

B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容。

如果您不希望这些私密性内容被搜狗收录,一方面可以通过robots协议加以限制;另一方面,也可以通过删除快照反馈给我们进行解决或者通过站长平台使用死链提交告知我们对其进行删除。


Public @ 2017-04-25 15:55:44

百度快照为什么会更新?

百度快照会更新是因为搜索引擎会定期抓取并更新网页的内容,当网页的内容发生了变化,搜索引擎会更新快照以反映最新的页面信息。同时,搜索引擎也会根据网页的更新频率和重要性等因素,对网页进行不同频率的抓取和更新,这也会影响到快照的更新。另外,如果网站使用了网站地图、RSS订阅等技术,也能够促进快照的更新。

Public @ 2023-04-04 18:00:10

怎么样让我的网页不被360搜索收录?

360搜索支持善意的搜索引擎Robots协议。您可通过在网站根目录下放置Robots.txt 文件以建议360搜索搜爬虫不收录您网站的全部或部分内容。如果希望360搜索搜尽快删除涉及您隐私/名誉的网页内容,可以通过我们的意见反馈页面进行提交,我们会尽快为您处理。

Public @ 2009-11-13 15:55:46

备案和不备案收录一样快吗?

备案和不备案收录一样快吗?回答:原则上不应该有区别,但是根据A5这里了解到的实际情况。XXX各大搜索引擎都接到了通知,没有备案的站点会被做一些限制,比如:抓取频率方面,以及网站的‘考察期’都会有所不同,所以站点还是备案吧!2021年审查更严格了!来源:A5营销

Public @ 2016-02-20 15:55:26

搜索引擎收录机制是什么?

搜索引擎收录机制就是搜索引擎系统执行网页抓取、URL分析、文本链接分析、内容分析及网页排序等一系列操作而形成的一种机制。这个机制由爬虫、索引和查询构成,爬虫存储所有网络上数据、分析搜索引擎索引,而搜索引擎索引就像物理上的索引一样,能让搜索引擎定位到目标页面;最后查询的时候则是让搜索引擎根据索引定位相应的页面,最终完成数据的展示。

Public @ 2023-03-03 13:00:15

更多您感兴趣的搜索

0.486611s