【干货】简单两步，教你识别百度蜘蛛_威海佰年网络技术有限公司_网站建设_软件开发_私有云_商标注册_公众号_小程序_APP_物联网

【干货】简单两步，教你识别百度蜘蛛

威海Spider 威海Baiduspider
2166

”

近期，小编经常收到开发者关于“哪些蜘蛛是百度搜索的”、“如何才能正确识别百度蜘蛛”的提问。

今日干货带你简单两步即可识别百度蜘蛛

一、查看UA信息

如果UA信息不对，可以直接判断该蜘蛛为非百度搜索的蜘蛛。

目前UA分为移动、PC、和小程序三个应用场景，分别如下：

【移动UA】

1、Mozilla/5.0(Linux;u;Android 4.2.2;zh-cn;) AppleWebKit/534.46 (KHTML,like Gecko)Version/5.1 Mobile Safari/10600.6.3 (compatible; Baiduspider/2.0;+http://www.baidu.com/search/spider.html)

2、Mozilla/5.0 (iPhone;CPU iPhone OS 9_1 like Mac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko)Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0;+http://www.baidu.com/search/spider.html)

【PC UA】

1、Mozilla/5.0(compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html)

2、Mozilla/5.0(compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html)

【小程序UA】

Mozilla/5.0 (iPhone;CPU iPhone OS 9_1 like Mac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko)Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0;Smartapp; +http://www.baidu.com/search/spider.html)

二、双向DNS解析认证

第一步：DNS反查IP

开发者可以对日志中访问服务器的IP地址进行反向DNS查找，判断某只spider是否来自百度搜索引擎，Baiduspider的hostname以*.baidu.com或*.baidu.jp 的格式命名，非*.baidu.com或*.baidu.jp即为冒充。

在Linux/Windows/OS三种平台下，验证方法分别如下：

1) 在Linux平台下，可以使用host IP命令反解IP来判断该抓取是否来自Baiduspider。

2) 在Windows平台或者IBM OS/2平台下，可以使用nslookup IP命令反解IP：打开命令处理器，输入nslookup xxx.xxx.xxx.xxx（IP地址）就能解析IP，判断该抓取是否来自Baiduspider。

3) 在macOS平台下，可以使用dig命令反解IP：打开命令处理器输入dig -x xxx.xxx.xxx.xxx（IP地址）就能解析IP，判断该抓取是否来自Baiduspider。

第二步：对域名运行正向DNS查找

对第一步中通过命令检索到的域名运行正向DNS查找，验证该域名与日志中访问服务器的原始IP地址是否一致，IP地址一致可确认spider来自百度搜索引擎，IP地址不一致即为冒充。

【示例】

> host 111.206.198.69

69.198.206.111. in-addr.arpa domain name pointer baiduspider-111-206-198-69.crawl.baidu.com.

>hostbaiduspider-111-206-198-69.crawl.baidu.com

baiduspider-111-206-198-69.crawl.baidu.com has address 111.206.198.69

以上就是识别百度蜘蛛的方法，有需要的同学速速收藏哦！

来源：百度搜索资源平台百度搜索学堂

Public @ 2019-09-16 15:38:37

Baiduspider如何区分PC与移动网页搜索的UA

威海Spider 威海Baiduspider
2251

PC搜索完整UA：Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html）移动搜索完整UA：Mozilla/5.0 (Linux;u;Android 4.2.2;zh-cn;) AppleWebKit/534.46 (KHTML,like Gecko) Version/5.1 Mobile

Public @ 2011-05-14 15:56:50

吸引蜘蛛抓取的影响因素

威海Spider 威海Spider
2257

1、网站和页面权重。质量高，资格老的网站被认为权重比较高，这种网站上的页面被爬行的深度也会比较高，所以会更多内页被收录。2、与首页点击距离。一般来说网站上权重最高的是首页，大部分外部链接是指向首页的，蜘蛛访问最频繁的也是首页。离首页点击距离近，页面权重越高，被蜘蛛爬行的机会也越大。3、导入链接。无论是外部链接还是同一个网站的内部链接，要被蜘蛛抓取，就必须有导入链接进入页面，否则蜘蛛根本没有机会知道

Public @ 2017-12-02 16:22:35

我不想我的网站被Baiduspider访问，我该怎么做？

威海Spider 威海Baiduspider
1978

您可以在网站的 robots.txt 文件中添加以下内容，以阻止 Baiduspider 访问您的网站： User-agent: Baiduspider Disallow: / 这会告诉 Baiduspider 不要访问您的整个网站。请注意，这也可能会阻止其他搜索引擎的访问。如果您只想阻止 Baiduspider 的访问，可以使用以下代码： User-agent: Baiduspider D

Public @ 2023-05-31 13:50:13

百度Spider新增渲染抓取UA公告

威海Spider 威海Baiduspider
2223

为了给搜索用户更好的体验、对站点实现更好地索引和呈现，百度搜索需要访问网站的CSS、Javascript和图片信息，以便更精准地理解页面内容，实现搜索结果最优排名，百度搜索会全面启用最新UA来访问站点的上述资源。从3月24日（2017）开始，百度搜索抽取了部分优质站点进行抓取内测，可能会对站点服务器造成一定压力影响，请尽量不要对UA进行封禁，以免造成不可逆转的损失。最新UA如下：PC：Mozill

Public @ 2020-05-17 15:56:38

Categories

Tags