"排到第一页就会被 AI 引用"这个假设,在 2026 年已经不成立了。 Ahrefs 对 86.3 万关键词、400 万条 AI Overviews URL 的追踪显示,来自自然前十的引用份额从 2025 年 7 月的约 76% 降到 2026 年 3 月的约 38%。Moz 分析近 4 万条查询后得到更极端的结果:Google AI Mode 的引用中有 88% 不在同一查询的自然前十里。
这是所有平台里唯一有官方文档可依的一个。下面把官方说法、可观测事实、第三方数据和未知区域分开写。
一、官方声明层(最强证据,一手来源)
Google 于 2026 年 5 月 15 日发布《Optimizing your website for generative AI features on Google Search》,并把它放进 Search Central 的"生成式 AI 基础"栏目——与 SEO 入门指南同级。这是 Google 迄今最明确的公开表态。
核心结论:
| 议题 | Google 的立场 |
|---|---|
| AEO / GEO 是什么 | 从 Google 搜索的角度,为生成式 AI 搜索做优化就是为搜索体验做优化,仍属于 SEO |
| 机制 | 生成式功能植根于核心排序与质量系统,通过 RAG(grounding)与 query fan-out 从搜索索引中调取内容 |
| llms.txt | 不需要。爬虫可能发现该文件,但会当成普通文本文件处理,无特殊通道 |
| 内容分块 | 不需要。系统能理解一页多主题并展示相关部分;不存在理想页面长度 |
| 为 fan-out 建页 | 明确不建议为每个可能的 fan-out 子查询单独建页 |
| 专用 schema | 不存在面向 AI 的专用标记;但仍建议做 schema 以获得富媒体结果资格 |
| 购买品牌提及 | 追求不真实的"提及"没有想象中有用;核心排序关注高质量内容,另有系统拦截垃圾 |
| 展示前提 | 页面须被索引、具备 snippet 资格,且站点在 Search Console 中被纳入生成式 AI 功能范围 |
| 内容质量 | 独特、非大路货(non-commodity)的内容,对长期表现的影响可能超过指南里其他所有建议 |
| 测量 | 用 Search Console 的 Generative AI performance 报告;警惕声称使用 Google 内部指标的第三方工具 |
Google 举的"非大路货"例子很具体:《首次购房者的 7 个建议》是大路货,《我们为什么放弃验房还省了钱:一次下水道管线的实录》不是。对外贸企业翻译一下就是:产品参数页人人都有,你的失败案例、退货数据、验厂实录才是别人抄不走的。
指南结尾还留了一句常被忽略的话:不必做到文档里的每一件事;有大量内容在完全没有刻意做 SEO 的情况下也表现良好。智能体相关的建议被明确标注为"如果与你的业务相关且有余力再看"。
二、可观测层
1. AI Overviews 和 AI Mode 是两个东西,要分开测。 Ahrefs 的对比研究显示两者的信源结构有系统性差异:YouTube 在 AI Overviews 中居首,被引次数超过百科类来源;维基百科在 AI Mode 中的出现率高出约 10 个百分点;Quora 在 AI Mode 中的出现频率约为 AI Overviews 的 3.5 倍;健康类网站和 Facebook 在 AI Mode 中都约为两倍。结论是 AI Mode 更依赖百科与详实的专业来源,AI Overviews 更偏好视频与社区内容。
2. 唯一的官方测量入口是 Search Console。 Generative AI performance 报告是你能拿到的第一方数据。任何第三方工具都是从外部模拟提问反推,与 Google 内部口径不同——这一点 Google 自己在指南里点名提醒过。
3. 模型换代会直接重排信源池。 Google 于 2026 年 1 月把 AI Overviews 的默认模型升级为 Gemini 3。SE Ranking 对 10 万关键词的追踪显示,此后此前被引用过的 AIO 域名中有 42.4% 掉出了引用池。这意味着任何"AIO 信源榜单"的保质期是以月计的,包括本文这一节。
三、第三方研究层
排名与引用的脱钩(三组数字,方法不同,不可直接比较)
| 研究方 | 样本 | 结论 |
|---|---|---|
| Ahrefs | 86.3 万关键词 / 400 万 AIO URL | 自然前十占引用比例 76%(2025-07)→ 38%(2026-03);仅计纯自然结果为 37.1%;其余在 11–100 位(31.2%)与 100 位以外(31.0%)几乎对半 |
| BrightEdge | 未公开 | 2026 年 2 月报告重合约 17% |
| Moz | 约 4 万条查询 | AI Mode 引用中 88% 不在自然前十 |
| Ahrefs | 1.5 万条长尾查询 | AI 助手引用与 Google/Bing 前十平均重合约 11% |
同时给出 38% 和 17% 并说明方法不同,比只挑一个数字更可信。 两家用的关键词集和统计口径不一样,谁也不是"真值"。
引用结构
- 88% 的 AI Overviews 会引用 3 个以上来源,只有 1% 只引用单一来源
- 头部 1% 的域名(约 12 个站点)拿走了约 47% 的引用份额
- YouTube 在 AIO 引用中的份额约为 21%–23%(不同研究口径不同),且其中相当部分来自自然结果前 100 名以外
关于 schema 的一个反直觉结果
Ahrefs 在 2026 年 3 月做了一项双重差分(difference-in-differences)研究,1,885 个页面对照约 4,000 个控制组:AI Mode +2.4%(不显著)、ChatGPT +2.2%(不显著)、AI Overviews −4.6%(显著为负)。
这不等于"schema 有害"。合理的读法是:schema 不是 AI 引用的直接杠杆,它的价值在富媒体结果资格上——这与 Google 官方指南的表述完全一致。任何以"加 schema 提升 AI 引用率 37%"作卖点的服务商,请他出示方法论。
四、目前无法确证的部分
- query fan-out 具体展开成哪些子查询。 Google 确认了机制存在,但不公开展开过程。市面上的"fan-out 关键词工具"都是猜测。
- 引用位的选择逻辑。 索引 + snippet 资格是必要条件,官方从未说明充分条件是什么。
- AI Overviews 触发率的真实分布。 各家追踪给出约 48%–50% 的量级,但取决于关键词集,无官方数字。
五、可执行清单
- Search Console 里确认站点已被纳入生成式 AI 功能范围,并开始记录 Generative AI performance 报告的基线
- 确认核心页面已被索引且具备 snippet 资格(检查有无
nosnippet、max-snippet限制) - 把 AI Overviews 与 AI Mode 分开监测,不要合并成一个"Google AI 可见度"指标
- 停止为 fan-out 变体批量建页——官方明确不建议
- schema 继续做,但目标写清楚是富媒体资格,不是 AI 引用
- 内容层面唯一有长期复利的动作:产出只有你有的一手信息(实测数据、失败案例、客户验厂记录)
- 若品类有视频空间,认真做 YouTube——它在 AIO 引用中的权重与它在自然结果中的可见度不成比例
FAQ
我 Google 排第一,为什么 AI Overviews 不引用我? 因为两者已经脱钩。约六成以上的 AIO 引用来自自然前十以外的页面,其中约三分之一甚至在 100 名以外。
要不要为 AI 单独做一个版本的页面? 不要。Google 明确表示系统能理解一页多主题,也不需要为 AI 重写内容或覆盖每个长尾变体。
第三方 AI 可见度工具的数据可信吗? 可以用来做趋势对比,不能当成 Google 的口径。Google 在官方指南中专门提醒警惕声称使用其内部指标的工具。
AI Overviews 和 AI Mode 要分别优化吗? 不需要分别优化,但必须分别测量——它们的信源结构有系统性差异。
结论失效风险:本文第一节绑定 Google 官方指南(发布 2026-05-15),第三节数据受模型换代影响极大。下次复核计划:2026 年 11 月。
