如何查询百度蜘蛛ip真假?百度蜘蛛ip大全及真假查询工具
如何判断百度蜘蛛ip真假?百度蜘蛛ip真假查询工具http://stool.chinaz.com/baiduspider 伪百度IP,比如:出现了 *.baidu.abc.com ,这个乍一看像极了,但是仔细一看,就看出来了,这个域名其实是abc.com。Baiduspider ip的hostname以 *.baidu.com的格式命名,非 *.baidu.com即为冒充,建议使用DNS反查方式来确定抓取来源的ip是否属于百度。
$ host 123.125.66.120
120.66.125.123.in-addr.arpa domain name pointer
baiduspider-123-125-66-120.crawl.baidu.com.
点击“开始”-“运行”-“cmd”-“输入nslookup IP地址”-“回车”
C:\Documents and Settings\Administrator>nslookup 123.125.66.120
查询结果如下:
Name: baiduspider-123-125-66-120.crawl.baidu.com
Address: 123.125.66.120
提示:
1、Baiduspider绝对不会以匿名的方式抓取网页。
2、Baiduspider的hostname以 *.baidu.com 或 *.baidu.jp 的格式命名,非*.baidu.com或*.baidu.jp即是冒充。
3、Nslookup(name server lookup)( 域名查询):是一个用于查询internet域名信息或诊断DNS服务器问题的工具。
上图名称为:220.181.108.105这样的以名称中带有baiduspide,和crawl.baidu.com是属于百度自己服务器的蜘蛛,除此之外,都属于假蜘蛛。
发现假蜘蛛就要及时的在服务器上屏蔽这个IP。
下面的百度蜘蛛IP造访,准备抓取你东西,抓取网页的百度蜘蛛。
60.172.229.61
61.129.45.72
61.135.162.*
百度竞价蜘蛛
61.135.165.134
117.34.74.66
118.122.188.194
119.63.196.9
125.39.78.185
(百度联盟爬虫),说白了就是百度统计。
61.135.186.*
站长工具模仿的百度蜘蛛。
61.147.98.146
61.188.39.16
113.98.254.245
117.21.220.245
117.28.255.42
114站长工具箱(这个是你的网站不稳定时常来的)
119.147.114.213
121.10.141.*
百度图片爬虫
123.15.**.**
这个蜘蛛经常来,别的来的少,表示网站可能要进入沙盒了,或被者降权。
123.125.68.*
抓取内页收录的,权重较低,爬过此段的内页文章暂时被收录但不放出来(意思也就是说待定),因不是原创或采集文章。(百度网页爬虫(百度图片爬虫)
123.125.71.*
搜外站长工具蜘蛛。
124.248.34.52
也属于百度蜘蛛IP 主要造成成分,是新上线站较多,还有使用过站长工具,或SEO综合检测造成的,没有多大用。
125.90.88.*
百度蜘蛛
159.226.50.*
180.76.5.*
180.76.5.87
220.181.158.107
伪装百度蜘蛛IP
180.149.130.*
这个ip段出现在新站及站点有不正常现象后。
183.91.40.144
203.208.60.*
这个ip段不间断巡逻各站,就是路过一下。
210.72.225.*
降权蜘蛛
每天这个IP 段只增不减很有可能进沙盒或K站
218.30.118.102
220.181.68.*
123.125.68.*
220.181.68.*
主要是抓取首页占80%,内页占30%,这此爬过的文章或首页,绝对24小时内放出来和隔夜快照的!一般成功抓取返回代码都是 200 0 0返回304 0 0代表网站没更新,蜘蛛来过,如果是 200 0 64别担心这不是K站,可能是网站是动态的,所以返回就是这个代码。
220.181.108.*
代表百度蜘蛛IP来访准备抓取你东西
220.181.7.*
123.125.66.*
这个ip段作为度过新站考察期
121.14.89.*
这个ip段出现在新站或站点有不正常现象后
203.208..60.*
这个ip段不间断巡逻各站
210.72.225.*
这个是百度抓取首页的专用IP如是220.181.108段的ip来的话基本来说网站会天天隔夜快照,绝对错不了的
220.181.108.95
98%抓取首页可能还会抓取其他「不是指内页)属于权重IP段此段爬过的文章或首页基本24小时放出来.
220.181.108.92
抓取内页收录的 权重较低 爬过此段的内页文章不会很快放出来,因不是原创或采集文章
123.125.71.106
属于综合的。主要抓取首页和内页或者其它页面。属于权重IP段, 抓过的文章或首页基本24小时放出来
220.181.108.91
重点抓取更新文章的内页达到90%,8%的抓取首页,2%其他权重ip段,抓过的文章或首页基本24小时放出来
220.181.108.75
专用抓取首页ip 权重段,一般返回代码304 0 0代表未更新
220.181.108.86
抓取内页收录的,权重较低,爬过此段的内页文章不会很快放出来,因不是原创
123.125.71.95
123.125.71.97
专用抓取首页ip 权重段,一般返回代码304 0 0代表未更新
220.181.108.89
220.181.108.94
220.181.108.97
220.181.108.80
220.181.108.77
抓取内页收录的, 权重较低,爬过此段的内页文章不会很快放出来,因不是原创
123.181.108.77
专用抓取首页ip 权重段,一般返回代码304 0 0代表未更新
220.181.108.83