yandexbot ip 地址段

yandexbot ip 地址段

YandexBot 是 Yandex 的搜索引擎的爬虫。Yandex 是一家俄罗斯互联网公司,在俄罗斯经营最大的搜索引擎,在该国拥有约 60% 的市场份额。截至 2012 年 4 月,Yandex 排名全球第五大搜索引擎,每天有超过1.5 亿次搜索,访客超过 2550 万。

经常有网友问我如何屏蔽 yandexbot,或者如何查询 yandexbot ip range(yandex ip 地址段)?

这篇文章中我详细介绍一下这两个问题。

如何屏蔽 yandexbot

我们可以通过 robots.txt 屏蔽 yandexbot 的爬虫,下面是示例:

User-agent: Yandex

Disallow: /

这样我们就屏蔽了 yandexbot 抓取所有页面。

如果我们只想 yandexbot 抓取部分页面,下面是写法示例:

User-agent: Yandex

Allow: /public

Disallow: /

上面除了 /public 页面允许被 yandexbot 访问之外,其他都禁止 yandexbot 爬虫抓取。

通过 IP 地址段屏蔽 yandexbot

yandexbot 的 ASN 是 AS13238AS208722 这两个,我们可以通过 ASN 查询获取 ASN 的 IP 地址段。

将查询的 IP 地址加入到黑名单中就可以屏蔽 yandexbot 的目的了。

同时我们可以找到爬虫查询这个工具,直接输入 IP 地址,就可以判断 IP 是否属于 yandexbot 的。

总结

这篇文章主要介绍了屏蔽 yandexbot 的两种方法,一种是:通过 robots.txt 协议,一个是通过 yandexbot ip range 的方法来屏蔽

当然由于 yandexbot 属于搜索引擎爬虫,可以为我们带来流量,所以在 yandexbot 没有影响到你服务器性能的情况下,尽量不要屏蔽它。

©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

  • 通过 IP 判断爬虫 如果你查看服务器日志,看到密密麻麻的 IP 地址,你一眼可以看出来那些 IP 是爬虫,那些 ...
    pdflibr阅读 4,187评论 0 0
  • 在网络上,可以查看本机 IP 地址的方式很多,可以在电脑上通过输入命令来查看,但对于一般人,并不知道这些命令该怎么...
    pdflibr阅读 2,695评论 0 0
  • 这篇文章我们将详细介绍如何识别爬虫 ip。 我们在网站运营的时候,经常有各种各样的爬虫来光顾,有好的爬虫,例如:搜...
    pdflibr阅读 3,863评论 0 0
  • 通常,当任何人想要检测IP是否是代理时,这是因为他们正试图决定减少对该代理的访问,并因此禁止使用代理的人。 那是你...
    ProxyWorld阅读 9,829评论 0 0
  • 通常,当任何人想要检测IP是否是代理时,这是因为他们正试图决定减少对该代理的访问,并因此禁止使用代理的人。 那是你...
    爬虫用户阅读 4,476评论 0 0

友情链接更多精彩内容