当前位置:首页 > SEO网站 > 正文内容

建网站后正确快速识别百度蜘蛛只需从两方面下手

admin4年前 (2022-07-26)SEO网站809

我们在建网站后都比较关注网站的收录,跟网站收录息息相关的因素就是百度蜘蛛的抓取,因为我们更新网站内容后,只有被百度蜘蛛抓取后才有可能被收录。

那么,什么是百度蜘蛛?

在我们运营网站时又如何快速识别百度蜘蛛呢?

其实,我们可以把百度蜘蛛就是用来抓取网站链接的IP,经常会听到有站长朋友反馈百度蜘蛛来的太频繁,服务器要被抓爆了,如果你无法识别百度蜘蛛,你怎么知道是百度蜘蛛抓爆的呢?也有出现百度蜘蛛都不来了的情况,还有很多站点想得到百度蜘蛛的IP段,想把IP加入白名单,但IP地址范围动态变化不固定,无法识别百度IP。

一、双向DNS解析认证

第一步:DNS反查IP

开发者通过对日志中访问服务器的IP地址运行反向DNS查找,判断某只spider是否来自百度搜索引擎,Baiduspider的hostname以*.baidu.com或*.baidu.jp 的格式命名,非*.baidu.com或*.baidu.jp即为冒充。

根据平台不同验证方法不同,如linux/windows/os三种平台下的验证方法分别如下:

1).在linux平台下,您可以使用host ip命令反解ip来判断是否来自Baiduspider的抓取。

2).在windows平台或者IBM OS/2平台下,您可以使用nslookup ip命令反解ip来 判断是否来自Baiduspider的抓取。打开命令处理器 输入nslookup xxx.xxx.xxx.xxx(IP地址)就能解析ip,来判断是否来自Baiduspider的抓取。

3).在macos平台下,您可以使用dig命令反解ip来判断是否来自Baiduspider的抓取。打开命令处理器输入dig -x xxx.xxx.xxx.xxx(IP地址)就能解析ip,来判断是否来自Baiduspider的抓取。

第二步:对域名运行正向DNS查找

对第一步中通过命令检索到的域名运行正向DNS查找,验证该域名与您日志中访问服务器的原始IP地址是否一致,IP地址一致可确认spider来自百度搜索引擎,IP地址不一致即为冒充。

示例1:

> host 111.206.198.69

69.198.206.111. in-addr.arpa domain name pointer baiduspider-111-206-198-69.crawl.baidu.com.

> host baiduspider-111-206-198-69.crawl.baidu.com

baiduspider-111-206-198-69.crawl.baidu.com has address 111.206.198.69

二、查看UA信息

如果UA信息不对,可以直接判断为非百度搜索的蜘蛛。目前UA分为移动、PC、和小程序三个应用场景,这三个渠道UA分别如下:

移动UA:

Mozilla/5.0(Linux;u;Android 4.2.2;zh-cn;) AppleWebKit/534.46 (KHTML,like Gecko)Version/5.1 Mobile Safari/10600.6.3 (compatible; Baiduspider/2.0;+http://www.baidu.com/search/spider.html)

Mozilla/5.0 (iPhone;CPU iPhone OS 9_1 like Mac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko)Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0;+http://www.baidu.com/search/spider.html)

PC UA:

Mozilla/5.0(compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html)

Mozilla/5.0(compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html)

小程序UA:

Mozilla/5.0 (iPhone;CPU iPhone OS 9_1 like Mac OS X) AppleWebKit/601.1.46 (KHTML, like Gecko)Version/9.0 Mobile/13B143 Safari/601.1 (compatible; Baiduspider-render/2.0;Smartapp; +http://www.baidu.com/search/spider.html)

总之,正确快速的识别百度蜘蛛是我们做网站运营时必须要掌握的技能之一。

因为,只有了解的百度蜘蛛抓取网站的情况,我们才好进行针对性的完善网站。

扫描二维码推送至手机访问。

版权声明:本文由老苏SEO转载并发布,如侵权可联系删除。

本文链接:https://www.laosuseo.com/?id=3091

标签: 百度蜘蛛
分享给朋友:

“建网站后正确快速识别百度蜘蛛只需从两方面下手” 的相关文章

保持网站关键词排名稳定的方法技巧

保持网站关键词排名稳定的方法技巧

现在由于搜索引擎算法的不断更改,很多站长朋友都反映网站排名很不稳定。有时候我们把网站排名做上去相对来说比较容易,但是当我们网站进行到一定的时期时,获得了好的排名后,我们应该如何去维护网站排名稳定就成了一个很大的问题,正所谓“打江山容易,守江山难”。今天笔者就跟大家分享一下保持网站关键词排名稳定的方法...

HTML5中的meta标签到底是什么

HTML5中的meta标签到底是什么

做响应式网站的时候,我们经常看到什么HTML5黑科技,独特的meta标签独得搜索引擎喜爱,收录快之类的宣传语,不少用户都是云里雾里。其实这个HTML5中的meta标签到底是何方神圣,为什么直接影响网站优化?今天给大家解答一下。Meta标签的解释Meta标签用来描述一个HTML网页文档的属性,例如作者...

八个基础的SEO代码优化方法

八个基础的SEO代码优化方法

很多人把SEO当成了工程师,其实SEO是一门技术型营销,准确的来说应该称呼技术营销师才对。之所以被误以为是工程师是因为SEO需要跟代码打交道,那么哪些代码是SEO基础代码呢?一、A标签A标签也叫链接标签,A标签中经常用到的是title属性,白帽SEO的操作手法一般是将A标签开始标签和结束标签之间的内...

要想做好企业网站推广需要掌握的技能

要想做好企业网站推广需要掌握的技能

关于2023年如何做好网站推广一直是广大站长朋友关心的话题,现在随着互联网的飞速发展,搜索引擎算法调整的频率也在加大,比如说前段时间搜索引擎又增加了一系列的算法,让很多站长朋友受到了不小的打击。今天就跟大家分享一下2023年要想做好企业网站推广需要掌握的技能,希望大家通过掌握常用的技能不断提升网站排...

如何有效保护自己更新的原创网站内容?

如何有效保护自己更新的原创网站内容?

我们在做网站运营时都知道,网站内容是一个网站血液灵魂,网站内容的重要性自不多言,每个从事网站建设和网络推广营销的人都非常明白。很多时候我们为了使网站获得更好的排名,坚持不懈的用心原创,但是自己辛苦做的原创文章,被其他网站抄袭,抄袭后,排名还在自己网站的前面。面对这种情况作为站长朋友应该如何面对呢?今...

怎样才能使网站快照经常更新

怎样才能使网站快照经常更新

大家都知道百度快照给网站带来的影响很多,所谓百度快照就是网站被百度蜘蛛爬行后在搜索引擎数据库中留下数据,当判断收录的内容达到用户要求质量时,网站的快照才会被释放出来,而快照的时候很多时候都是最初的爬行时间。所以快照影响网站的收录,是衡量网站质量和权重的标准之一,也是百度蜘蛛是否经常爬行网站的一个很好...