Categories


Tags


为什么我的网站中的一些私密网页也会被百度收录?

Baiduspider对网页的抓取,是通过网页与网页之间的链接实现的。

网页之间的链接类型,除了站点内部的页面链接之外,还有不同网站之间的互相链接。因此,某些网页即便通过您的网站内部链接无法访问到,但是,如果别人的网站上有指向这些页面的链接,那么这些页面还是会被搜索引擎所收录。

百度Spider的访问权限,和普通用户是一样的。因此,普通用户没有权限访问的内容,Spider也没有权限访问。之所以看上去某些访问权限限制内容被百度收录,原因有两点:

  A. 该内容在Spider访问时是没有权限限制的,但抓取之后,内容的权限发生了变化

  B. 该内容有权限限制,但是由于网站安全漏洞问题,导致用户可以通过某些特殊路径直接访问。而一旦这样的路径被公布在互联网上,则Spider就会循着这条路径抓出受限内容

如果您不希望这些私密性内容被百度收录,一方面可以通过Robots协议加以限制;另一方面,也可以通过反馈中心反馈给我们进行解决。


Public @ 2020-06-19 15:55:52

我想从搜索结果中彻底删除某个网页

为确保永久删除您的内容,请进行以下某项操作。如果您没有进行相应操作,那么您的网站稍后可能会重新显示在搜索结果中。A.如果网页已不存在,请确保服务器返回 404(未找到)或 410(不存在)。这样可让搜狗知道该网页已不存在,无需再在搜索结果中显示。B.如果网页仍存在,但您不想让其显示在搜索结果中,请使用 robots.txt 阻止 sogou spider 进行抓取。请注意,在通常情况下,即使您已通

Public @ 2010-05-25 15:35:25

原创的文章被同行抄袭,该怎么办?

如果你的原创文章被同行抄袭了,以下是一些可能的应对措施: 1.与抄袭者直接联系。你可以尝试联系抄袭者并要求他们删除抄袭内容。如果他们没有回应或拒绝合作,你可能需要采取其他措施。 2.通知抄袭网站管理者。如果抄袭者将抄袭内容发布在任何网站上,你可以通知该网站的管理者。他们可能会采取行动,从网站上删除抄袭内容。 3.向你的雇主或学校报告。如果你的文章被抄袭,特别是如果你在公司或学校工作,你可能需

Public @ 2023-04-19 12:50:24

为什么同样类型或相近的网站,有的可以被收录,有的则不被收录?

可能有以下几个原因: 1. 网站内容原创度不高或者与其他网站雷同 如果一个网站的内容与其他网站雷同度很高,搜索引擎就会认为这个网站没有什么独特的价值,就会被忽视。或者该网站内容被搜索引擎判定为抄袭,那么网站就很难被收录。 2. 网站页面结构不规范或者技术手段识别不到 搜索引擎是通过机器算法来解析网页的,所以如果网站的页面结构乱七八糟、没有良好的代码风格或者技术手段容易被误判,那么该网站就难

Public @ 2023-06-10 17:50:28

更多您感兴趣的搜索

0.403640s