SEO 百科

规范化

本页目录

规范化指的是从一组内容相同或相似的网页中,选出最有代表性的那个网址的过程[2]。选中的网址叫规范网址,这个过程也叫重复信息删除,作用是让搜索结果只显示重复内容的一个版本[2]。

重复内容的来源

网站出现重复内容,原因有好几类[2]。

变体类型 例子
区域变体 面向不同国家、但实际内容语言相同的网址[2]
设备变体 同一网页的移动版和桌面版[2]
协议变体 网站的 HTTP 版和 HTTPS 版[2]
网站自身功能带来的变体 排序和筛选产生的网址
意外变体 本不该被访问的演示版本[2]

选择的方式

Google 选择规范网址,是从理解每个网页的主要内容开始的[2]。

当 Google 发现多个网页的主要内容相同或非常相似时,会把这些网页归为一组[2]。在索引过程中,Google 还会收集各种信号,并以此挑出对用户最完整、最实用的那一个,作为规范网页[2][3]。为了节省抓取,Google 会更频繁地抓取规范网页,重复网页则抓得少一些[2]。

提示与规则的区分

网站可以告诉 Google 自己更希望用哪个网址,但这不是命令[2]。

官方说明,指明首选规范网页是一个提示,而不是规则[1][2]。也就是说,Google 仍可能因为其他原因,另选一个网页作为规范网页[2]。

语言与地区的处理

在语言和地区方面,判断规则有明确的前提[2]。

只有主要内容采用同一种语言的网页,才算作重复网页;如果只翻译了页眉页脚,正文没变,也算重复[2]。同语言的地区变体,官方建议同时使用规范化和 hreflang,帮助 Google 判断该显示哪个地区的网址[2]。

附录

参见

参考资料

官方(境外)

  1. 《Partnering to help solve duplicate content issues》,Bing 网站管理员博客。
  2. 《什么是规范化》,Google 搜索中心。

第三方

  1. 《Canonical Tag: Definition, Examples & Best Practices》,Moz。

外部链接

无。