结论先讲:Schema 结构化数据对 GEO 有用,但不是通过你以为的路径起作用的。Google 在 2026 年 5 月的官方指南中明确写明——结构化数据不是生成式 AI 搜索的必需项,也不存在需要额外添加的"AI 专用 schema"。它仍然值得做,但理由是富媒体结果资格和品牌实体消歧,不是"让 AI 更容易读懂你"。任何向你兜售"GEO 专用 schema"的服务商,卖的是不存在的东西。
这篇文章要拆解的是一个混淆:"结构化"和"结构化数据"是两件不同的事,行业里长期把它们混为一谈,导致大量预算投错了地方。
一、先把三个问题分开
讨论 Schema 时,实际上有三个独立的问题被搅在一起:
- Schema 能不能让我在 Google 传统搜索里拿到更好的展示?
- Schema 能不能让我更容易被 AI 引用(AI Overviews、ChatGPT、Perplexity)?
- Schema 能不能让 AI 正确认识我的公司是谁?
这三个问题的答案完全不同:能、不能(至少无直接证据)、能。
大部分 GEO 内容之所以说不清,是因为把第 2 个问题的否定答案,和第 1、3 个问题的肯定答案混在一起讲了。
二、Google 官方怎么说:明确的否定
2026 年 5 月 15 日,Google 在 Search Central 发布了首份关于生成式 AI 搜索的官方优化指南,其中的辟谣章节直接点名了结构化数据。
Google 的原文表述是:结构化数据不是生成式 AI 搜索的必需项,也不存在你需要添加的特殊 schema.org 标记;不过继续把它作为整体 SEO 策略的一部分仍是好主意,因为它有助于获得 Google 搜索富媒体结果的资格。
这段话有两层意思,缺一不可:
- 否定的是:"AI 专用 schema"这个概念,以及"不上 schema 就进不了 AI 回答"的说法。
- 肯定的是:schema 在传统 SEO 体系内的既有价值没有改变。
同一份文档还有一个更根本的说明:Google 的生成式 AI 功能植根于其核心搜索排序与质量系统,依靠 RAG(检索增强生成,也称 grounding)从搜索索引中检索相关、最新的网页,再由系统审阅这些页面的具体信息来生成回答。
理解这句话,整件事就通了:AI Overviews 的候选池就是 Google 的搜索索引。 你的页面要先被正常索引、有资格展示摘要,才谈得上被 AI 引用。Schema 影响的是"在传统搜索里长什么样",而不是"在 AI 那一层被不被选中"。
三、那为什么这么多人觉得 Schema 对 GEO 有用?
有三个原因,其中两个是真的、一个是假的。
真原因一:相关性被误读成因果性。 多份第三方研究观察到"被 AI 引用的页面里,有 schema 的比例更高"。这个观察本身是真的,但解释是错的。有 schema 的站通常也是技术 SEO 做得更规范、内容更完整、权重更高的站——这些才是被引用的原因。Schema 是"好网站"的伴随特征,不是它的成因。这是典型的混杂变量问题。
真原因二:Schema 确实在品牌实体上起作用。 这是第 3 个问题的答案,下一节展开。这个作用是真实且重要的,但它不是"帮 AI 读懂这篇文章",而是"帮知识图谱确认你是谁"。
假原因:把"内容结构化"的收益记在了"结构化数据"头上。 清晰的标题层级、一个小标题只回答一个问题、开头直接给结论、用表格承载对比信息——这些做法确实提升被引用概率。但它们是内容组织方式,和 JSON-LD 标记毫无关系。你把一篇文章的段落结构改好了,效果来自结构本身;你在这篇文章上加一段 Article schema,效果来自别处。
顺带说明,Google 在同一份指南里还否定了另一个相关做法:不需要把内容切成很小的块来让 AI 更好地理解,Google 的系统能够理解一个页面上多个主题的细微差别并向用户展示相关的那一部分;页面没有理想长度,应该为受众而不是为生成式 AI 搜索做页面。所谓"chunking 优化"同样是伪需求。
四、Schema 真正的 GEO 价值:品牌实体消歧
这是本文最重要的一节,也是绝大多数中文 GEO 文章没讲对的地方。
AI 在回答"XX 公司怎么样"这类问题时,需要先确定"XX 公司"指的是哪个实体。如果你的公司叫"宁波华盛机械",而全国有七家名字相近的公司,模型的第一个任务是消歧,第二个任务才是评价。消歧失败的后果不是不被提及,而是被张冠李戴——这比不被提及更糟。
Organization schema 在这个环节是有实际作用的,因为它提供了机器可直接读取的实体标识:
{
"@context": "https://schema.org",
"@type": "Organization",
"name": "宁波华盛精密机械有限公司",
"alternateName": ["华盛机械", "Huasheng Machinery"],
"url": "https://example.com",
"logo": "https://example.com/logo.png",
"foundingDate": "2008",
"address": {
"@type": "PostalAddress",
"addressLocality": "宁波",
"addressRegion": "浙江",
"addressCountry": "CN"
},
"sameAs": [
"https://www.linkedin.com/company/...",
"https://www.crunchbase.com/organization/...",
"https://zh.wikipedia.org/wiki/..."
]
}`sameAs` 字段是这段代码里唯一真正重要的部分。 它把你的官网和你在其他权威平台上的档案显式绑定成同一个实体。当 AI 从多个来源检索到关于你的信息时,这些绑定关系决定了它能不能把这些碎片拼成一个正确的公司画像。
对外贸企业,sameAs 里值得放的:LinkedIn 公司页、Crunchbase、维基百科(如果有)、行业协会会员页、阿里国际站/中国制造网店铺页、GitHub 组织页(技术型企业)。
注意:`sameAs` 只有在链接指向的页面真实存在且内容一致时才有意义。 填一堆空档案不会有任何帮助——这一点和 llms.txt 的教训一样,自我声明本身没有权重,可交叉验证的一致性才有。
五、2026 年的优先级排序
基于现有证据,我们给出的资源分配建议:
| 优先级 | 做什么 | 理由与证据强度 |
|---|---|---|
| 必做 | Organization + sameAs 全站统一 | 实体消歧,直接影响 AI 对"你是谁"的判断。证据:知识图谱机制 + 官方文档承认 schema 的 SEO 价值 |
| 必做 | 电商站 Product、本地服务 LocalBusiness | Google 明确说明生成式回答可包含商品信息与本地商户信息,Merchant Center 与 Google Business Profile 是对应入口 |
| 值得做 | Article / BreadcrumbList / FAQPage | 富媒体结果资格,属于常规 SEO 收益。注意 FAQ 富媒体展示资格近年已大幅收窄,做它的理由是内容组织而非展示位 |
| 不必做 | 所谓"GEO 专用 schema" | 不存在。任何声称有此物的服务商应被质疑 |
| 不要做 | 与页面可见内容不符的标记 | 违反 Google 结构化数据政策,有人工处罚风险 |
最后一行需要强调。为了"给 AI 看"而标记页面上并不存在的内容,是明确的违规行为,收益为零、风险为实。
六、怎么验证你的 Schema 真的在起作用
不要相信"上了 schema 之后 AI 引用涨了"这种没有对照的说法。可执行的验证方法:
- 技术正确性:用 Google Rich Results Test 和 Schema Markup Validator 跑一遍,确保无报错。这是及格线,不是效果验证。
- 实体识别测试:在 ChatGPT、Perplexity、DeepSeek、豆包各问一次"介绍一下 XX 公司",记录三件事——公司识别对不对、关键信息(成立时间、主营业务、所在地)准不准、引用了哪些来源。这是你的基线。
- 改动后复测:补齐
Organization和sameAs,等待索引更新(通常 2–6 周),用同一批问题复测。 - 控制变量:这段时间不要同时改内容、发外链、做投放。否则你测不出任何东西。
第 4 点是绝大多数"GEO 实测"不成立的原因——同时改了五件事,然后把功劳归给最想卖的那一件。
七、一句话总结
Schema 不是 GEO 的杠杆,是 GEO 的地基。 它不会让一篇平庸的内容被 AI 引用,但它能保证当 AI 想引用你的时候,知道"你"是谁。
把预算从"AI 专用 schema 服务"上撤回来,投到两个地方:一是 Organization + sameAs 的一次性正确配置(这是一天的工作量,不是持续付费项目),二是别人写不出来的原创内容。
常见问题
Q:Google 说 schema 不是必需的,是不是意味着可以全删了? 不是。官方的表述是"生成式 AI 搜索不要求它",同时明确建议继续作为整体 SEO 策略的一部分保留。删掉会损失富媒体结果资格。
Q:ChatGPT 和 Perplexity 读 schema 吗? 没有任何一家公开确认在检索或引用环节使用 schema.org 标记。它们主要处理页面的可见文本。所以对这两个平台,页面上写清楚永远比标记里写清楚重要。
Q:FAQPage schema 还值得加吗? 值得,但理由变了。它的富媒体展示资格已大幅收窄,现在做它的理由是:写 FAQ 会强迫你把内容组织成"一个明确问题 + 一个完整答案"的形式,而这种形式本身是易被引用的。收益来自写作过程,不来自标记。
Q:国内平台(DeepSeek、豆包、元宝)看 schema 吗? 没有公开技术文档说明这一点。市面上流传的"DeepSeek 偏好 JSON-LD 标记"等说法,我们目前没有找到可核查的一手来源,多数出自服务商的营销材料。建议对这类无出处的结论保持怀疑。
Q:那我应该把 schema 的预算转到哪? 按证据强度:确保 AI 爬虫可访问 > 原创数据与一手经验内容 > 品牌实体一致性(sameAs 是其中一环)> 高引用率第三方平台的真实存在。
本文数据来源:Google Search Central《Optimizing your website for generative AI features on Google Search》(2026-05-15 发布,2026-07-10 最后更新)。所有结论会随平台政策变化更新,本文最后核查日期:2026 年 7 月 31 日。
作者:妙蛙 GEO 研究团队
