为什么我的网站已经加了robots.txt，还能在百度搜索出来？_威海佰年网络技术有限公司_网站建设_软件开发_私有云_商标注册_公众号_小程序_APP_物联网

为什么我的网站已经加了robots.txt，还能在百度搜索出来？

威海Spider 威海Baiduspider
1601

因为搜索引擎索引数据库的更新需要时间。虽然Baiduspider已经停止访问您网站上的网页，但百度搜索引擎数据库中已经建立的网页索引信息，可能需要数月时间才会清除。另外也请检查您的robots配置是否正确。

如果您的拒绝被收录需求非常急迫，也可以通过投诉平台反馈请求处理。

Public @ 2020-06-13 15:56:47

我不想我的网站被Baiduspider访问，我该怎么做？

威海Spider 威海Baiduspider
967

1. 在robots.txt文件内添加一行禁止Baiduspider访问的指令：User-agent: Baiduspider；Disallow: / 2. 添加http协议头，指示不要访问网站的任何网页：X-Robots-Tag: noindex，noarchive，nosnippet，nofollow 3. 将任何和Baiduspider相关的IP地址拉黑。

Public @ 2023-02-24 17:36:11

如何用程序识别Baiduspider ua

威海Spider 威海Baiduspider
1587

近日，Baiduspider针对移动抓取user agent（以下简称ua）进行了升级，与PC端的抓取ua做到版本统一，均称为Baiduspider/2.0。从此次更新的移动ua和PC ua来看，不管是移动ua还是PC ua都包含有关键字Baiduspider，我们可以由此判断访客ua是不是来自百度。与PC ua不同的是，移动ua包含有关键字android和mobile，再通过这两个关键字，我们

Public @ 2016-12-20 15:38:45

如何判断是否冒充Baiduspider的抓取？

威海Spider 威海Baiduspider
1005

判断是否冒充Baiduspider的抓取，可以通过以下方法： 1. 查看User-Agent（用户代理）字段：Baiduspider爬虫的User-Agent是固定的，一般为“Baiduspider+版本号”或“Baiduspider-image+版本号”，如果抓取请求中的User-Agent与Baiduspider爬虫的格式不一致，那么就可能是伪装的爬虫。 2. 查看IP地址：Baidusp

Public @ 2023-03-30 01:50:26

目前百度Spider抓取新链接的途径有两个，一是主动出击发现抓取，二就是从搜索资源平台的链接提交工具中获取数据，其中通过主动推送功能“收”上来的数据最受百度Spider的欢迎。对于站长来说，如果链接很长时间不被收录，建议尝试使用主动推送功能，尤其是新网站，主动推送首页数据，有利于内页数据的抓取。那么同学们要问了，为什么我提交了数据还是迟迟在线上看不到展现呢？那涉及的因素可就多了，在Spider抓取

Public @ 2012-08-02 15:38:46

Categories

Tags