SEO 百科
Yandex
本页目录
Yandex 指的是 Yandex 搜索引擎,它通过自己的抓取工具把网页载入数据库,并以此给出搜索结果[1]。也就是说,抓取工具要先访问网页,网页才有可能出现在结果里[1]。
爬虫群
Yandex 的抓取工具不止一个,其中最核心的叫 YandexBot,负责主要的索引工作[2]。
除了 YandexBot,还有一批分工不同的机器人,分别负责这几件事[2]:
有一部分并不遵守 robots.txt 的通用规则[2]。
这里有一处与 Google 类似的提醒。抓取工具的标识可以被冒充,所以带 Yandex 名字的请求未必真的来自 Yandex[2]。官方建议用反向 DNS 查询来核对来源[2]。
收录的路径
让网页进入 Yandex 的索引,有几条常见路径[1]。
| 途径 | 做法 |
|---|---|
| 站点地图 | 把站内网址一次性告知抓取工具 |
| 重新索引 | 单独提示抓取工具去访问某个重要页面 |
| IndexNow | 批量上报新增、更新和删除 |
不过这些都不是保证。抓取工具也可能从外部链接发现网页,但那要花时间,而且不保证抓到你希望展示的全部页面[1]。
面向 AI 的答案
Yandex 也提供了一个 AI 搜索功能,用来给出简洁的回答[3]。
这些回答由已经收录的页面自动生成[3]。页面的信息越结构化、越有信息量、语法越规范,就越容易被采用[3]。
如果不想让内容进入这类回答,可以通过 robots.txt 对特定的抓取工具设置禁止[3]。
语言范围
Yandex 的抓取工具里,有一个专门面向俄语之外的语言,叫 YandexComBot[2]。
它会索引这类内容,前提是网站没有对它单独设限[2]。也就是说,面向非俄语地区的内容,也在这套收录体系的覆盖范围里[2]。
附录
参见
参考资料
官方(境外)
- 《How can I add a site to search?》,Yandex 网站管理员帮助。
- 《How to check that a robot belongs to Yandex》,Yandex 网站管理员帮助。
- 《Search with Yandex AI》,Yandex 网站管理员帮助。
外部链接
无。