返回技术文章
Google AI OverviewsAI Mode引用机制GEO

Google AI Overviews / AI Mode 引用规则解析(2026 年 8 月版)

"排进自然前十就会被 AI 引用"在 2026 年已经不成立:Ahrefs 追踪显示前十贡献的引用份额从约 76% 降到约 38%,Moz 发现 AI Mode 有 88% 的引用不在同一查询的前十里。本文分层解析官方文档、可观测事实与第三方数据。

妙蛙 GEO 研究团队8 分钟

"排到第一页就会被 AI 引用"这个假设,在 2026 年已经不成立了。 Ahrefs 对 86.3 万关键词、400 万条 AI Overviews URL 的追踪显示,来自自然前十的引用份额从 2025 年 7 月的约 76% 降到 2026 年 3 月的约 38%。Moz 分析近 4 万条查询后得到更极端的结果:Google AI Mode 的引用中有 88% 不在同一查询的自然前十里。

这是所有平台里唯一有官方文档可依的一个。下面把官方说法、可观测事实、第三方数据和未知区域分开写。


一、官方声明层(最强证据,一手来源)

Google 于 2026 年 5 月 15 日发布《Optimizing your website for generative AI features on Google Search》,并把它放进 Search Central 的"生成式 AI 基础"栏目——与 SEO 入门指南同级。这是 Google 迄今最明确的公开表态。

核心结论:

议题Google 的立场
AEO / GEO 是什么从 Google 搜索的角度,为生成式 AI 搜索做优化就是为搜索体验做优化,仍属于 SEO
机制生成式功能植根于核心排序与质量系统,通过 RAG(grounding)与 query fan-out 从搜索索引中调取内容
llms.txt不需要。爬虫可能发现该文件,但会当成普通文本文件处理,无特殊通道
内容分块不需要。系统能理解一页多主题并展示相关部分;不存在理想页面长度
为 fan-out 建页明确不建议为每个可能的 fan-out 子查询单独建页
专用 schema不存在面向 AI 的专用标记;但仍建议做 schema 以获得富媒体结果资格
购买品牌提及追求不真实的"提及"没有想象中有用;核心排序关注高质量内容,另有系统拦截垃圾
展示前提页面须被索引、具备 snippet 资格,且站点在 Search Console 中被纳入生成式 AI 功能范围
内容质量独特、非大路货(non-commodity)的内容,对长期表现的影响可能超过指南里其他所有建议
测量用 Search Console 的 Generative AI performance 报告;警惕声称使用 Google 内部指标的第三方工具

Google 举的"非大路货"例子很具体:《首次购房者的 7 个建议》是大路货,《我们为什么放弃验房还省了钱:一次下水道管线的实录》不是。对外贸企业翻译一下就是:产品参数页人人都有,你的失败案例、退货数据、验厂实录才是别人抄不走的。

指南结尾还留了一句常被忽略的话:不必做到文档里的每一件事;有大量内容在完全没有刻意做 SEO 的情况下也表现良好。智能体相关的建议被明确标注为"如果与你的业务相关且有余力再看"。


二、可观测层

1. AI Overviews 和 AI Mode 是两个东西,要分开测。 Ahrefs 的对比研究显示两者的信源结构有系统性差异:YouTube 在 AI Overviews 中居首,被引次数超过百科类来源;维基百科在 AI Mode 中的出现率高出约 10 个百分点;Quora 在 AI Mode 中的出现频率约为 AI Overviews 的 3.5 倍;健康类网站和 Facebook 在 AI Mode 中都约为两倍。结论是 AI Mode 更依赖百科与详实的专业来源,AI Overviews 更偏好视频与社区内容。

2. 唯一的官方测量入口是 Search Console。 Generative AI performance 报告是你能拿到的第一方数据。任何第三方工具都是从外部模拟提问反推,与 Google 内部口径不同——这一点 Google 自己在指南里点名提醒过。

3. 模型换代会直接重排信源池。 Google 于 2026 年 1 月把 AI Overviews 的默认模型升级为 Gemini 3。SE Ranking 对 10 万关键词的追踪显示,此后此前被引用过的 AIO 域名中有 42.4% 掉出了引用池。这意味着任何"AIO 信源榜单"的保质期是以月计的,包括本文这一节。


三、第三方研究层

排名与引用的脱钩(三组数字,方法不同,不可直接比较)

研究方样本结论
Ahrefs86.3 万关键词 / 400 万 AIO URL自然前十占引用比例 76%(2025-07)→ 38%(2026-03);仅计纯自然结果为 37.1%;其余在 11–100 位(31.2%)与 100 位以外(31.0%)几乎对半
BrightEdge未公开2026 年 2 月报告重合约 17%
Moz约 4 万条查询AI Mode 引用中 88% 不在自然前十
Ahrefs1.5 万条长尾查询AI 助手引用与 Google/Bing 前十平均重合约 11%

同时给出 38% 和 17% 并说明方法不同,比只挑一个数字更可信。 两家用的关键词集和统计口径不一样,谁也不是"真值"。

引用结构

  • 88% 的 AI Overviews 会引用 3 个以上来源,只有 1% 只引用单一来源
  • 头部 1% 的域名(约 12 个站点)拿走了约 47% 的引用份额
  • YouTube 在 AIO 引用中的份额约为 21%–23%(不同研究口径不同),且其中相当部分来自自然结果前 100 名以外

关于 schema 的一个反直觉结果

Ahrefs 在 2026 年 3 月做了一项双重差分(difference-in-differences)研究,1,885 个页面对照约 4,000 个控制组:AI Mode +2.4%(不显著)、ChatGPT +2.2%(不显著)、AI Overviews −4.6%(显著为负)

这不等于"schema 有害"。合理的读法是:schema 不是 AI 引用的直接杠杆,它的价值在富媒体结果资格上——这与 Google 官方指南的表述完全一致。任何以"加 schema 提升 AI 引用率 37%"作卖点的服务商,请他出示方法论。


四、目前无法确证的部分

  • query fan-out 具体展开成哪些子查询。 Google 确认了机制存在,但不公开展开过程。市面上的"fan-out 关键词工具"都是猜测。
  • 引用位的选择逻辑。 索引 + snippet 资格是必要条件,官方从未说明充分条件是什么。
  • AI Overviews 触发率的真实分布。 各家追踪给出约 48%–50% 的量级,但取决于关键词集,无官方数字。

五、可执行清单

  1. Search Console 里确认站点已被纳入生成式 AI 功能范围,并开始记录 Generative AI performance 报告的基线
  2. 确认核心页面已被索引且具备 snippet 资格(检查有无 nosnippetmax-snippet 限制)
  3. 把 AI Overviews 与 AI Mode 分开监测,不要合并成一个"Google AI 可见度"指标
  4. 停止为 fan-out 变体批量建页——官方明确不建议
  5. schema 继续做,但目标写清楚是富媒体资格,不是 AI 引用
  6. 内容层面唯一有长期复利的动作:产出只有你有的一手信息(实测数据、失败案例、客户验厂记录)
  7. 若品类有视频空间,认真做 YouTube——它在 AIO 引用中的权重与它在自然结果中的可见度不成比例

FAQ

我 Google 排第一,为什么 AI Overviews 不引用我? 因为两者已经脱钩。约六成以上的 AIO 引用来自自然前十以外的页面,其中约三分之一甚至在 100 名以外。

要不要为 AI 单独做一个版本的页面? 不要。Google 明确表示系统能理解一页多主题,也不需要为 AI 重写内容或覆盖每个长尾变体。

第三方 AI 可见度工具的数据可信吗? 可以用来做趋势对比,不能当成 Google 的口径。Google 在官方指南中专门提醒警惕声称使用其内部指标的工具。

AI Overviews 和 AI Mode 要分别优化吗? 不需要分别优化,但必须分别测量——它们的信源结构有系统性差异。


结论失效风险:本文第一节绑定 Google 官方指南(发布 2026-05-15),第三节数据受模型换代影响极大。下次复核计划:2026 年 11 月。

继续阅读

相关技术文章

Google垃圾更新Google 8 月垃圾内容更新已完成:GEO 内容团队现在该停掉什么、保留什么

Google 于 2026 年 8 月 18 日启动全球垃圾内容更新,21 日完成。本文把官方已确认事实放回 AI Overviews 与 AI Mode 的 RAG 链路,说明为何批量低价值页面同时伤害 SEO 与 GEO,以及更新后应该怎样排查而不误判因果。

ChatGPTChatGPT 搜索与引用机制完整拆解(2026 年 8 月版)

OpenAI 用三个独立 user-agent 分担训练抓取、检索和用户点击,只有其中两个与"被引用"有关。本文按官方声明、服务器日志可观测、第三方研究和未知区域四层,拆解 ChatGPT 的检索与引用机制。

PerplexityPerplexity 信源体系与优化要点(2026 年 8 月版)

Perplexity 的品牌提及率约为 ChatGPT 的 22 倍,单次回答平均引用约 8.2 个来源,是对中小品牌最友好的平台;但它的信源结构在过去一年被一场诉讼重构过一次。本文拆解官方规则、争议、自有索引与可执行清单。