如何优化我的网站,使其不仅能被谷歌收录,还能被 ChatGPT 和 Perplexity 收录?
如何确定人工智能机器人是否真的在抓取我的网站?
我的技术SEO策略应该如何调整以适应AI搜索?
到 2026 年,您网站的大部分搜索展示次数将由机器代表人类进行搜索产生。
这些机器并不关心你的关键词排名。它们关心的是你的:
HTML 加载速度很快,不到 200 毫秒。
只需点击四次即可访问产品详情页
内容回答了一个具体的九字问题,这个问题在你职业生涯中的任何关键词研究工具中都从未出现过。
这并非猜测,而是我们从2025年中期以来,数百家企业网站的服务器日志数据持续显示的结果。
你的网站上到底发生了什么?
我的同事 Stan 在一条 Slack 消息中发现了一个模式:查询长度的增长速度与人类行为不符。
10个词的查询量同比增长161%,这并非源于用户突然变得更加冗长,而是由于人工智能代理将单个用户提示分解成数十个并行子查询,研究人员将这一过程称为“扇出”。
2025 年查询长度增长

梯度变化是关键。人类搜索行为并不会像机器搜索那样,简单地按词数缩放。到2025年10月,包含7个及以上单词的搜索查询量将占总查询量的近1%,约为历史占比的三倍。
比流量更能说明问题的是点击率。虽然10个字搜索词的展示次数飙升了161%,但点击率却暴跌至2.26%,低于2023年的8%至11%。
人工智能会读取你的页面,提取答案,并将其综合呈现给用户。你的网站将不会获得任何访问量。
我们称这些为“虚拟曝光”。它们是真实存在的信号,表明你的内容正在人工智能推理链中进行评估。如果你因为它们无法带来流量而将它们从报告中过滤掉,那就如同盲人摸象。
访问您网站的三大机器人及其对搜索引擎排名可见性的影响
并非所有人工智能爬虫都一样,将它们视为单一类别是大多数技术SEO人员犯的第一个错误。
训练机器人会广泛抓取网页内容,而忽略点击深度。训练访问意味着人工智能知道你的内容存在,但并不代表用户一定会看到它。
AI 搜索机器人从首页点击两三次后就会迅速停止访问,而且通常每个页面每月只访问一次。
当真人用户在 ChatGPT、Perplexity 或 Claude 等平台上提问时,AI 用户机器人就会启动,并代表用户搜索答案。只有这类访问才能真正转化为 AI 的可见性。
| 机器人类型 | 什么触发了它 | 爬行深度 | 对人工智能可见性的影响 |
| 训练机器人 | 教育周期模型 | 深度 — 忽略点击距离 | 没有直接作用。只有意识层面。 |
| 人工智能搜索机器人 | 发现新的网址和新鲜内容 | 浅层访问——每月访问量约1次,点击次数不超过2-3次 | 关键的守门员。如果它漏掉了某个页面,用户机器人也找不到它。 |
| 人工智能用户机器人 | ChatGPT / Claude / Perplexity 中的真实用户查询 | 选择性——受速度和结构驱动 | 高。最接近人工智能印象的指标。 |
即使你的网站受到大量训练机器人和搜索机器人的抓取,也可能完全没有出现在人工智能生成的答案中。如果你没有在日志分析中按类型细分人工智能机器人流量,那么你根本不知道你衡量的是冰山的哪三分之一。
法学硕士(LLM)会关注哪些SEO信号?
robots.txt 是你的主要控制手段。
大多数主流人工智能平台(例如 ChatGPT、Claude 和 Gemini)都遵循 robots.txt 指令。Perplexity 是个例外:PerplexityBot 遵守 robots.txt,但用户触发的机器人 Perplexity-User 却不遵守。Cloudflare 在一项调查中证实了这一点。大多数网站都没有针对人工智能访问情况审核其 robots.txt 文件。请尽快审核。
网站地图功能得到了广泛支持。
ChatGPT、Claude 和 PerplexityBot 都使用 XML 站点地图进行 URL 发现。请确保其准确性。
最适合用于搜索引擎优化和排名工作的信号
以下这些信号似乎不会影响 AI 的可见性,但对于仍然会触发传统 SERP 的查询的排名来说,它们仍然至关重要。
规范标签和 noindex 指令对 AI 机器人没有任何作用。
AI爬虫不会构建搜索索引,因此它们无法利用这些元信号。使用noindex标签对Google隐藏的内容,对ChatGPT的爬虫来说完全可见。
LLM.txt 文件没有任何作用。
我们的日志数据显示,主流人工智能机器人不会读取此文件。请勿在此浪费时间。
JavaScript渲染是一个严重的盲点。
大多数人工智能爬虫(例如 ChatGPT、Claude 和 Perplexity)不会渲染 JavaScript。如果您的产品页面在客户端加载关键内容,这些爬虫读取的将是一个空壳。服务器端渲染是唯一通用的架构。例外情况是 Google Gemini,它使用与 Googlebot 相同的 Web 渲染服务。
如何确保 ChatGPT、Perplexity 和 LLM 能够触达您的内容
AI搜索机器人每月大约只会访问一次深度页面,而且在距离首页点击三次之后访问量就会急剧下降。那些包含最具体、最易回答信息的页面,往往是代理商最难触达的。
解决方法:通过内部链接提升最有价值的深层页面,确保只需点击四次即可访问这些页面。
那些被训练机器人抓取但从未被用户机器人访问过的页面,才是你最优先考虑的目标。而那些人工智能用户机器人频繁访问的页面,则告诉你应该扩展哪些内容:更多涵盖相同主题和深度的内容。
针对更长、扇出式查询优化内容
驱动 AI 引文的查询中,95% 的月搜索量为零。它们是 AI 模型生成的合成子查询。但它们却出现在 Google Search Console 中:有展示次数,但没有点击量,查询长度也是你永远不会主动选择的。
如何找到扇出查询机会
要挖掘值得跟进的分流查询,请将您的 Google Search Console API 连接到 JetOctopus(以绕过1000 行的 UI 限制),并筛选以下条件:查询长度大于 7 个字、展示次数少于 50 次、点击次数为 0,且在过去 3 个月内发布。这就是您的分流机会矩阵,它精确地反映了 AI 代理针对您的内容提出的问题。
最容易扩散的提示类型

如果你的内容结构没有针对列表和比较查询进行优化,没有明确的排名、优缺点和并排规格,那么你就没有优化最大的传播表面区域。
“产品评论”意向查询量从2025年6月的239次激增至2025年9月的4万多次。这16000%的增长源于人工智能代理系统性地收集结构化的意见数据。如果你的产品页面缺乏这种深度,你就无法参与到这些数据收集中。
技术审计:从哪里开始
第一步:识别日志中的人工智能用户机器人流量
提取原始服务器日志(Apache/Nginx),并导出所有包含以下用户代理的行:OAI-SearchBot 和 ChatGPT-User、PerplexityBot 和 Perplexity-User、Claude-SearchBot 和 Claude-User。然后,在电子表格中手动按用户代理模式和端点对命中结果进行分组。为了区分训练机器人和用户机器人,您需要维护自己的分类列表——该列表经常变化且没有标准化。
JetOctopus 日志分析器内置了这种细分功能:只需点击几下即可按机器人类型(训练、搜索和用户)进行筛选,并立即查看 AI 用户机器人访问的页面(您的 AI 可见内容,可随时扩展)与训练机器人访问但用户机器人从未访问的页面(您的最高优先级修复目标)。
步骤二:审核深层页面的技术可访问性
选取一些深度 URL 样本,检查 HTML 有效载荷大小,通过查看原始 HTML 确认关键内容并非通过 JavaScript 注入,通过统计首页点击次数来模拟抓取深度,并在 Chrome 开发者工具或 Lighthouse 中测试加载时间。同时,检查重要内容是否隐藏在折叠面板或“查看更多”元素之后——这些都需要执行 JavaScript,而 AI 机器人会完全忽略它们。对于拥有数千个深度页面的大型网站,这种抽样方法会遗漏很多信息。AI 代理不会点击页面。如果信息仅在用户交互后才出现,那么对于这些爬虫来说,这些信息并不存在。
步骤 3:清理 robots.txt 文件
打开 robots.txt 文件,逐行检查每个用户代理的 Disallow 和 Allow 指令。AI 机器人会遵循 Disallow 规则,因此请确保您没有意外屏蔽重要的 URL。手动测试关键 URL,确认它们未被屏蔽。花 30 分钟进行审核,可以避免您屏蔽了想要访问的爬虫,或者泄露了您不想公开的内容。
第四步:绘制你的幻影印象
从 Google Search Console (GSC) 效果报告中导出按点击次数为零的展示次数筛选的数据。由于用户界面 (UI) 最多只能显示 1000 行,您需要使用 GSC API 或按日期和查询分批导出,然后在电子表格或 BigQuery 中合并数据集。此外,还要考虑查询频率:每天出现的长查询很可能不是扇出广告。
将您的 GSC API 连接到JetOctopus,即可绕过行数限制并自动构建您的扇出机会矩阵——AI 代理正在询问有关您的内容的确切问题,随时准备采取行动。
第五步:监测变化
设置定期导出流程——每月提取 Google Search Console 数据,比较不同时间段的展示次数,重新运行日志分析脚本并比较机器人活动,在 PageSpeed Insights 或 CrUX 中单独跟踪核心网页指标。最终,你会发现自己需要将多个数据源拼接在一起,却没有统一的告警机制,这使得及早发现性能下降问题变得困难。
JetOctopus Alerts正好涵盖了这一点:统一通知 AI 机器人活动变化以及 Googlebot 行为、核心网页指标、页面 SEO 问题和SERP 效率下降,以便您在问题恶化之前发现并解决它们。
新的关键绩效指标:技术可访问性
2026 年的 SEO 将围绕一个限制条件进行重组:人工智能代理能否在 200 毫秒内抓取、访问并从您的第 50,000 个产品页面中提取事实?
如果答案是否定的,那么在越来越多的搜索互动中,你的排名、反向链接和内容质量将变得无关紧要。机器正在搜索。问题在于,你能多快发现实际情况。