有报道指出,谷歌最近的反垃圾邮件更新主要针对大规模生成的SEO AI内容。


网上报道显示,谷歌八月份的反垃圾邮件更新至少有一部分内容是关于移除那些专门为了提升搜索引擎排名而创建的AI生成的SEO内容。谷歌最近还发布了一篇关于如何识别这类垃圾邮件的研究报告,这或许也是一个线索。

谷歌的可扩展集群终止系统

众所周知,人工智能生成的内容并不一定就是垃圾信息。但或许人们不太了解的是,任何旨在提升关键词排名的内容,往往都游走在正常内容和垃圾信息的边缘,甚至可能已经越过了这条界限。

网上报道似乎表明,谷歌已经实施了一项新措施来拦截越界的AI生成内容。鲜为人知的是,谷歌最近发表了一篇名为《可扩展集群终止系统》(S-CTS)的研究论文,旨在“终止”大规模生成的AI垃圾信息网络。

但这并不意味着谷歌八月份的反垃圾邮件更新完全针对人工智能生成的内容。但如果报道属实,这类人工智能生成的内容可能是许多网站排名下降的原因。

@OkaTakuma1 发推文如下

“关于谷歌的垃圾邮件更新,似乎所有使用 Claude Code、编解码器等自动发布内容的网站都会被全面过滤和删除。

他们有可能通过附加某种人工智能信用来自动检测,类似于生成的图像或视频。

然而,有些网站最初是手动一点一点发布的(如附图所示),后来转向 LLM 自动化,这些网站似乎在某些情况下得以生存下来。

从一开始就完全自动化创建的网站在谷歌那里没有“信任信号”,而早期手动运营的网站则积累了域名信任(信任节省)和过去的互动数据。

因此,即使他们之后改用LLM自动发帖,现有的域名评估也能起到缓冲作用,使他们更难立即收到垃圾邮件判定(或自动处罚)……

样本量很小,所以这绝不是最终结论——只是一种趋势——但在如今这个时代,你甚至都不需要打开 WordPress 编辑器屏幕了,他们很可能也使用 AI 积分来判断文本是否应该受到人工处罚或自动处罚,对吧?”

用户信任网站。这不是信任信号,而是用户信号。

谷歌并不直接使用“信任信号”,但它确实会使用用户生成的信号来表明某个网站是否受到用户的信任。我认为区分用户生成的信号和抽象的“信任信号”很有帮助,因为后者并不能告诉你信任信号的具体含义。

同一个人随后又发了一条推文,称一家发布人工智能生成内容的日本期刊在最近的垃圾邮件更新中没有被拦截,但他们也指出,所有内容在发布前都会经过人工审核。

他们解释说:

“……但到目前为止,它还没有受到任何处罚(当然,我们在发布文章之前会进行人工目视检查)。

在初期阶段,利用社交媒体和新闻稿来提高知名度、改善搜索引擎抓取能力和吸引曝光量可能是行之有效的方法。

当然,并非所有人都同意这篇文章的观点,因为它只是个例。

这不是人工智能,这是批量生成的人工智能。

@seiichi_satoweb 认为,问题不在于内容是由人工智能生成的,而在于人工智能被用来生成操纵搜索结果的内容。

他们发推文说:

“媒体运营公司应查看 8 月 18 日至 21 日的排名。

……如果销量下降,我认为首先应该怀疑的不是商品的质量,而是“批量生产的方法”。

Google 将恶意使用批量生成的内容定义为生成大量页面,其主要目的是为了操纵搜索排名,而不是为了支持用户。

他们关注的不是它是否是用生成式人工智能创建的,而是它的创建目的。

那些利用人工智能提升业务量的公司绝对应该仔细了解一下这一点。


人工智能的粗糙之处是个问题

就连 Blackhat World 论坛的成员们也在抱怨,人工智能的垃圾程序占据了搜索结果,这令人非常沮丧。

一位成员写道

“他们终于意识到人工智能的垃圾正在占据主导地位。”

我最近搜索了一个关于如何在应用程序中更改设置的快速教程,结果发现有 4 个网站连续出现,显然都是用人工智能生成的,用来回答这个问题——所有文章看起来都一模一样,同样的人工智能粗糙的副标题和项目符号格式,章节之间的间距也很差,基本上 3 句话就扩展成了 500 字。

AI 垃圾页面成了新的入口页面,谷歌正努力控制它。

另一位成员回应说,他们倾向于为人工智能生成的内容添加独特的品质,使其不至于完全由模板驱动。

实际里程可能有所不同

当然,也有其他人表示,更新后他们的 AI 生成的内容有所改进,正如Google SEO Mastermind Facebook私人群组中所述。

然而,无论内容是如何创作的,每个人都应该遵循一条经验法则:过去几年里,过度注重关键词的内容效果不佳。利用搜索引擎优化趋势自动生成内容的做法,可能正是近期反垃圾邮件机制更新的目标之一。

谷歌最近发表了一篇关于名为S-CTS(可扩展集群终止系统)的新系统的研究论文。该系统用于识别和终止人工智能生成的垃圾邮件网络。