搜索引擎作弊

隐藏文字、门页与欺骗性重定向是什么?

四类做法的共同点是让搜索引擎看到与用户不同的东西,但手法与判定口径并不相同。本页用对照表区分 Cloaking、隐藏文字、门页与欺骗性重定向,并给出各自的官方依据。

搜索引擎作弊概念示意图:违规内容被筛选治理
本页目录
  1. 四类做法对照表
  2. 逐一说明
  3. 为什么它们常被混为一谈
  4. 自查时怎么区分
  5. 常见问题
  6. Cloaking 和隐藏文字是同一件事吗?
  7. 门页是不是内容很短的页面?
  8. 用了跳转就一定是欺骗性重定向吗?
  9. 官方资料与参考来源

这四类做法的共同点是:展示给搜索引擎的与用户最终得到的并不一致。 区别在于不一致发生在哪个环节——内容本身(隐藏文字)、页面与查询的对应关系(门页)、访问地址(欺骗性重定向),还是访问者身份(Cloaking)。

四类做法对照表

做法不一致发生在哪里用户的直观感受官方归类
Cloaking访问者身份:爬虫与用户看到不同内容点进来发现内容与搜索结果不是一回事Google 垃圾内容政策中单列
隐藏文字内容可见性:文字对用户不可见,对搜索引擎可见页面看起来正常,但读不到那部分“内容”Google 政策中与 Cloaking 并列列出
门页(doorway pages)页面与查询的对应关系:为特定查询批量生成的过渡页进入后被引向另一批页面同上
欺骗性重定向访问地址:用户被自动带离搜索结果中展示的地址地址栏跳到了别处同上

逐一说明

Cloaking 的核心是按访问者身份分流:搜索引擎与真实用户拿到的是实质不同的内容。它与其他三类的差别在于,另外三类并不必然依赖“判断访问者是谁”,而是直接把不一致做在内容、入口或跳转上。

隐藏文字 的核心是内容对用户不可见但被搜索引擎读取,例如用与背景相同的颜色、极小字号或隐藏层承载文字。它的判定口径不涉及身份识别,因此与 Cloaking 是并列关系而非包含关系——中文行业常把两者混为一谈,实际是两种不同的违规形态。

门页 的核心是为搜索引擎批量生成、而不是为访问者准备的入口页。它的问题在于页面本身没有独立价值,只是把用户搬运到真正的目标页;即便每一页内容都“一致”,也仍然属于被治理的对象。

欺骗性重定向 的核心是把用户带到与搜索结果不一致的地址。它常见于被篡改的站点或跳转链条较长的页面,与 SEO 意图和技术实现都可能是两回事。

在四类之上,百度侧的表述偏重页面与用户检索意图的一致性:《百度搜索违规低质页面问题说明》把“实际内容与标题/经营领域/专栏/配图不一致”以及低质采集、内容拼接、穿插不相关内容等列为违规低质情形。

为什么它们常被混为一谈

  • 结果相似:四者最终都会让用户觉得“搜索结果名不副实”,从结果反推手法时容易归为同一类。
  • 常常同时出现:一个页面同时使用多种手法的情况并不少见,因此行业讨论里往往一口气列出一串词。
  • 中文译法不统一:“斗篷”“伪装”“隐藏”“跳转”等译法在不同文章里指向不同对象。

判断时的实用原则是:回到官方文档的条目名,而不是中文行业词。Google 的垃圾内容政策把这些做法分别列出,逐条对照即可确认属于哪一类。

自查时怎么区分

  1. 看用户能否读到那段内容:读不到却是给搜索引擎准备的,属于隐藏文字
  2. 看这条 URL 是不是为某个查询临时造的:是,则属于门页
  3. 看地址栏是否被换掉:被换掉,属于欺骗性重定向
  4. 看同一 URL 是否按访问者身份给出不同内容:是且无正当理由,属于 Cloaking

这四问可以直接接到 内容一致性自查清单 的流程里使用。分类的完整背景见 搜索引擎作弊的分类与判定口径,两家搜索引擎的口径差异见 Google 与百度如何界定 Cloaking

常见问题

Cloaking 和隐藏文字是同一件事吗?

不是。它们常被并列讨论,但指向不同:隐藏文字是让内容对用户不可见却被搜索引擎读取;Cloaking 是按访问者身份返回不同内容。官方政策把两者分别列出。

门页是不是内容很短的页面?

不是以长度判断。门页的关键在于它是否为搜索引擎批量生成、是否缺少独立价值,而不是字数多少。内容完整但只为搬运流量而存在的页面同样属于门页。

用了跳转就一定是欺骗性重定向吗?

不是。正常的 301、302 跳转是站点结构的一部分。判定针对的是让用户到达的地址与搜索结果中展示的地址不一致,且这种不一致并不服务于用户的情形。

官方资料与参考来源

说明:以上链接均为可公开访问的一手资料,本文的分类与措辞以这些文档为依据,未对具体实现方式作任何描述。