yandexbot ip 地址段

YandexBot 是 Yandex 的搜索引擎的爬虫。Yandex 是一家俄罗斯互联网公司,在俄罗斯经营最大的搜索引擎,在该国拥有约 60% 的市场份额。截至 2012 年 4 月,Yandex 排名全球第五大搜索引擎,每天有超过1.5 亿次搜索,访客超过 2550 万。

经常有网友问我如何屏蔽 yandexbot,或者如何查询 yandexbot ip range(yandex ip 地址段)?

这篇文章中我详细介绍一下这两个问题。

我们可以通过 robots.txt 屏蔽 yandexbot 的爬虫,下面是示例:

User-agent: Yandex

Disallow: /

这样我们就屏蔽了 yandexbot 抓取所有页面。

如果我们只想 yandexbot 抓取部分页面,下面是写法示例:

User-agent: Yandex

Allow: /public

Disallow: /

将查询的 IP 地址加入到黑名单中就可以屏蔽 yandexbot 的目的了。

当然由于 yandexbot 属于搜索引擎爬虫,可以为我们带来流量,所以在 yandexbot 没有影响到你服务器性能的情况下,尽量不要屏蔽它。

Original: https://www.cnblogs.com/pdflib/p/16478169.html
Author: 爬虫程序大魔王
Title: yandexbot ip 地址段

原创文章受到原创版权保护。转载请注明出处:https://www.johngo689.com/596242/

转载文章受原作者版权保护。转载请注明原作者出处!

(0)

大家都在看

亲爱的 Coder【最近整理,可免费获取】👉 最新必读书单  | 👏 面试题下载  | 🌎 免费的AI知识星球