SEO 百科

用户生成内容的防滥用

本页目录

用户生成内容的防滥用指的是网站与平台为抑制用户提交垃圾内容而采取的一类措施[1]。

垃圾内容发布者通常利用开放的评论表单和其他用户生成内容,攻击没有设防的网站[1][2]。托管平台同样面临风险,因为他们会批量创建不合规的网站,并生成没有价值的内容[1]。因为门槛越低的地方越容易被利用,所以防范的重点在于提高滥用的成本[1]。

滥用的两种对象

官方指出,垃圾内容发布者的目标有两类[1]。

对象 做法
未设防的网站 借助开放表单直接投放垃圾内容
托管平台 创建大量不合规的网站

因为两者的共同点是内容由外部用户产生,所以防范的手段也有相通之处[1]。

官方也提醒,防范往往并不容易,但一些简单的障碍就能拦住发布者[1]。

可用的信号

平台可以通过记录注册与互动情况,识别典型的垃圾模式[1]。

官方列举的信号包括:

  • 表单填写时间
  • 来自相同 IP 地址范围的请求数
  • 注册时使用的用户代理
  • 注册时选择的用户名等值[1]

因为垃圾发布者的行为往往有规律,所以这些痕迹能聚合成判断依据[1]。

声誉与索引的关系

许多垃圾评论发布者的目的,是让内容出现在搜索引擎里[1]。

一种做法是把尚无声誉的新用户内容排除在索引之外,等到其累积声誉之后再允许收录[1]。另一种做法是对不受信任内容里的链接加上 nofollow 或 ugc 属性[1]。因为这两种办法都削弱了垃圾内容的收益,所以发布者的积极性才会下降[1]。

把新用户的内容排除在索引之外,再给其中的链接加上 ugc,可以这样写。

<meta name="robots" content="noindex">
<a href="https://example.com/thread/1" rel="ugc">数控机床</a>

人工审核与屏蔽

对部分用户互动采用人工审核,可以阻止垃圾内容立即发布[1]。

官方指出,审核会增加日常开销,但效果显著,所以多数内容管理系统内置了评论审查功能[1][3]。至于反复出现的垃圾来源,可以把相应 IP 地址加入长期屏蔽名单[1]。因为一份垃圾资料往往能牵出更多同类,所以屏蔽的效率很高[1]。

自动化注册的抑制

垃圾发布者常借助脚本批量创建账号[1]。

官方建议在注册表单中使用验证码一类的工具,只让真人提交[1]。因为自动化脚本正是批量内容的源头,所以卡住注册环节就卡住了很大一部分滥用[1]。

滥用迹象的监控

平台还可以主动发现自己的服务是否被滥用[1]。

官方提到的迹象包括:

  • 重定向
  • 大量广告块
  • 特定垃圾关键词
  • 大段编码过的脚本代码
  • 服务器日志里的流量突增
  • 钓鱼页面
  • 恶意软件页面[1]

因为这些迹象出现得较早,所以能在损失扩大之前给出提示[1]。

附录

参见

参考资料

官方(境外)

  1. 《防止网站和平台存在用户生成的垃圾内容》,Google 搜索中心。

第三方

  1. 《Is User-Generated Content (UGC) A Google Ranking Factor?》,Search Engine Journal。
  2. 《Google Research: UGC Spam and User Experience》,Search Engine Journal。

外部链接

无。