SEO

规模化内容滥用:Google 实际惩罚什么

Google 的定义只有一句话,而几乎每一份概述都遗漏了其中真正重要的半句。该政策描述的是为操纵排名而生成、而非帮助用户的页面,这使得目的成为触发因素,而数量只是副作用。以下是原文措辞、Google 列出的五种做法,以及在起草任何内容之前测试发布计划的方法。

5 min
Table of the five scaled content abuse Google examples from its spam policy and what each one tests

一个本地服务品牌发布了 ninety 个城市页面,并在接下来的一个季度里担心自己是否越界。就在不远处,一家竞争对手用同一种模板运行着 four thousand 个页面。两支团队都在计算数量。Google 的政策没有衡量的一件事,就是数量。

Google 在其垃圾内容政策中所称的 scaled content abuse 只有一句定义,而其中每一个关键措辞都在描述意图。该页面的原文写道: "Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users." 请慢慢读。必须同时满足两个条件,而单纯的页面数量并不能单独满足这两个条件中的任何一个。

这一区别决定了一个发布计划究竟是商业决策还是垃圾内容模式,而对该政策的大多数解释都直接跳过这一点,转而讨论内容多少才算过量。Google 对 AI 生成内容的更广泛立场 也位于同一份文档体系中,并遵循相同的逻辑。下面讨论的是垃圾内容政策本身, 即其措辞、Google 在其中列出的做法,以及在起草任何文字之前你可以对一项计划进行的测试。

Google 惩罚的 Scaled Content Abuse, 其准确表述

Google 给出的定义分为三个分句,三者都在发挥作用。Many pages are generated, 这对应数量部分,也是大多数摘要引用的唯一部分。For the main purpose of manipulating search rankings, 这是一项关于这些页面为何存在的主张。And not helping users, 这是一项关于当有人访问这些页面后它们实际作用的主张。承载这句话的页面最后一次更新是在 May 2026,因此这是一种当前措辞,而不是 2024 年公告的截图。

Primary 是起主要作用的词。几乎每个商业页面都部分是出于排名考虑而构建的,而该政策并不要求出版者假装并非如此。它要求判断页面主要是为了什么。如果明天搜索引擎全部关闭,这个页面仍然值得发布,那么它的主要目的就能轻松通过这一检验。如果同一天下午就会被删除,那就不能。

Google 列出的五种做法

Google 在该政策下列出了五种做法,其中只有一种提到了生成式 AI。其余四种描述的是抓取、拼接、隐藏的卫星站点,以及无人能读的关键词页面,这些都不需要语言模型。列表中的每一项都以同样的限定语结尾,即对用户的价值,这一部分告诉你 Google 实际上在衡量什么。

做法,按 Google 的原话该条目在测试什么
"Using generative AI tools or other similar tools to generate many pages without adding value for users"是否添加了任何内容,而不是由哪个工具输入的
"Scraping feeds, search results, or other content to generate many pages (including through automated transformations like synonymizing, translating, or other obfuscation techniques), where little value is provided to users"源材料是被转化成了新的内容,还是仅仅被重新标记
"Stitching or combining content from different web pages without adding value"拼接是否算作作者身份
"Creating multiple sites with the intent of hiding the scaled nature of the content"发布者是否已经表现得像一个预期会被抓到的人
"Creating many pages where the content makes little or no sense to a reader but contains search keywords"人类读者是否曾经是预定受众

五种做法中有四种早在生成式 AI 出现十年前就已存在。抓取的源流、同义改写、塞满术语的门页,以及拼接式聚合,在模型能够写出可用段落之前就已经是垃圾内容了。但现在它很便宜。过去,第五百个页面的成本大致和第一个页面相同,所以现在我们有了一条 Google 多年来以某种形式一直执行的规则。它听起来像一种新的威胁。

将你自己的论文人性化

改写你的 AI 辅助文本,使其听起来更像人工撰写,同时不改动重要词语或引文。

免费开始

为什么仅仅是数量并不是触发因素

Google 没有公布页面数量阈值,也没有任何页面数量会单独触发该政策。一家拥有二十万产品页面的零售商,一个为每个空缺职位都保留实时列表的招聘网站,一个每种化合物都有条目的参考网站, 它们都以极大的规模发布内容,但没有一个符合这样一句话, 即页面是为了操纵排名而生成,却未能帮助用户。规模是目录的结果,而不是项目的原因。

反过来的情况同样成立。如果四十个页面全都是把地名替换掉的同一页面,而且其中没有任何内容能让该地的读者觉得有用,那么这四十个页面完全可能违反该政策。大规模会让稀薄模式更容易被发现,也更容易被系统性识别,这就是为什么该政策会提到规模。规模是问题出现的环境,而问题才是这些页面的用途。

如何判断一个方案落在界线的哪一侧

在起草任何内容之前,先问每个页面会包含什么,而这一批中的其他页面都不包含什么。如果答案是从电子表格中提取出来的名称、数字和邮政编码,那么这一批就是带有变量的单一模板,Google 的这句话对它的描述是准确的。

  1. 在第一版草稿存在之前,为每个页面命名其所拥有、批量中其他任何页面都没有的输入。电子表格中的一列不算作输入。
  2. 询问如果每个页面永远不可能在任何内容上获得排名,它是否仍会被委托制作。若答案是肯定的,说明主要目的问题已经得到回答。
  3. 检查落到任一单独页面上的读者,是否能找到他们无法从你上方的结果中获得的内容。
  4. 确认这些页面位于同一个站点下,并使用同一个名称。将它们分散到卫星域名上,出现在 Google 自己的示例列表中。

Google 的五项条目中的最后一项涉及这样一些页面, 它们在包含正确搜索词的同时, 对读者而言内容几乎没有意义, 甚至完全没有意义, 而且这是最便宜的测试失败项。从一个批次的中间抽取三页,像客户一样大声读出来。用免费的可读性检查器运行其中一页,会对这些句子是否曾经是为人而写给出一个直白的第二意见。

如果一个批次在实质上确实彼此不同,而只是语气上通用,那么修正应当是编辑性的,而不是结构性的。AI humanizer会改变一组页面在整个批次中的阅读方式,而逐步指南,教你如何使 AI 文本更像人写的则涵盖了同样的手工操作。两者都不能解决输入问题。这个问题必须在写作之前,上游环节解决,也就是在某个人决定每个页面用途的时候解决。

Scaled Content Abuse 与 Site Reputation Abuse 是同一回事吗?

不是,而且这两者经常被混淆,因为 Google 在 2024 年 3 月将它们一并公布。Scaled content abuse 指的是网站自身大规模生产的低价值页面。Site reputation abuse 是 Google 对第三方内容的称呼,这些内容发布在宿主网站上,主要是因为该宿主已经从其第一方工作中获得了排名信号,附加在新闻网站上的优惠券版块就是人人都能认出的典型模式。一项政策描述的是网站滥用自身的发布能力。另一项描述的是网站把它为完全不同的事情建立起来的权威出租出去。

Google 所说它想要的内容,则在 E-E-A-T, which has its own page 下作了说明。在制作方面,humanizing an AI blog post for SEO 则另行说明。

把 Google 的这句话放在下一份内容简报的最上方,并在任何人开始起草之前,先就整个批次以书面形式作答。一个无法说明每个页面增加了什么的团队,往往会在规划阶段才发现这一点,而那正是发现它的最低成本时刻。

XLinkedInFacebook

常见问题

Google 将其定义为,为了操纵搜索排名而生成大量页面,并且并非为了帮助用户。这个句子的两部分都必须成立。Google 所描述的规模化内容滥用,是关于页面为何存在以及它们对读者做了什么的陈述,政策本身并未规定一个单独触发它的页面数量。

Mark

Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.

获取 AI 人性化最新动态

获取有关学术写作、AI 检测和人性化的技巧,直接发送到您的收件箱。

不发垃圾邮件。可随时取消订阅。