一个 2026 年 8 月 9 日注册的新域名,在 8 月 12 日的观测中出现了这样一组状态:Bing 已经收到它的两份 sitemap、识别出 169 个 URL、零错误零警告,但固定抽取的七个页面全部停留在「已发现、未抓取」;与此同时,Perplexity 已经在 4 个不含品牌提示的问题里,把这个站的页面列为带链接的来源。
一个搜索引擎还没读过这些页面,一个 AI 已经在引用它们了。
这是研究手记的第二期。上一期我们拿自己的域名做了唯一的样本,最大的软肋是 n=1。这次补入第二个域名的同期数据——它同样由我们运营,出于该项目自身的中立性要求,本文公开它的数据与方法,但不公开它的身份。 这一点先说明,隐瞒共同运营关系比不点名更糟。
一、两个域名各自的情况
域名 A:miaowageo.com(本站)
中文站,内容以文章为主。观测环境为 Bing 国内版、未登录、无个性化历史。
| 日期 | 状态 |
|---|---|
| 08-07 | 搜品牌词返回汉字「妙」的字典页;精确搜首页标题原文返回 There are no results;后台显示 Indexed successfully,但 Discovered on 就是当天、Canonical 字段为空、Impressions 为 0 |
| 08-07 | 干预:手工提交 99 个 URL;配置 IndexNow 并推送 sitemap 全部 108 个 URL |
| 08-10 | 三个查询官网均排第 1,首页标题原文的搜索结果中官网是唯一一条 |
| 08-12 | 三个查询官网仍居第 1;/pricing 亦进入品牌词首页结果,说明进入排序的不再只有首页;站外发布的内容开始被第三方平台索引 |
域名 B:脱敏
英文站,内容为垂直领域的参考型资料。注册于 2026-08-09,以下为 08-12 的观测,距注册 3 天。
| 平台 | 结果 |
|---|---|
| sitemap 状态 Success,177 个 discovered pages;固定七页样本 7/7 已收录 | |
| Bing | 两份 sitemap 均 Success,169 个 URL,0 error、0 warning;固定七页样本全部为 discovered-but-not-crawled |
| Perplexity | 在 4 个无品牌提示问题中,将该站页面列为带链接来源 |
| Claude | 在指定账户、指定模型、逐题匿名模式下完成 30/30,0 次提及、0 个链接 |
观测方法:5 个平台,每个平台 30 道固定问题,共 150 条固定回答观察,保留 1081 个外部答案链接。
二、四个可以拿走的观察
观察一:收录与引用不是同一条链路,顺序可以颠倒
这是本文的核心。域名 B 在 Bing 尚未抓取其页面的同时,已被 Perplexity 引用。
这说明「先被搜索引擎收录,再被 AI 引用」这个隐含的先后假设不成立。 至少在部分 AI 平台上,页面进入可被引用的状态,不以某一家搜索引擎完成抓取为前提。
这个结论有直接的实践含义:如果你把「站长后台是否已收录」当作 AI 可见度的前置条件,你可能会在一个不必要的环节上等待。 反过来,某个搜索引擎显示收录良好,也不能推断 AI 已经能引用你。
观察二:同一个站在两大搜索引擎间的进入速度可以差到极端
域名 B 在 Google 是固定七页 7/7 已收录,在 Bing 是 0/7 已抓取——同一个站、同一批页面、同一天。
两边的 sitemap 都提交成功、都无错误,差别不在配置,在各自的处理节奏。这也解释了上一期我们在 miaowageo.com 上看到的现象:「已收录」和「有展现」之间隔着一段真实的处理时间,而这段时间的长短由平台决定,不由站点决定。
观察三:AI 平台之间的差异,大于 AI 与搜索引擎之间的差异
同一天、同一组固定问题、同一个站:Perplexity 4 次带链接引用,Claude 0 次提及。
这比「搜索引擎 A 收录了、搜索引擎 B 没收录」的差距更值得注意。它意味着「我的品牌被 AI 引用了吗」这个问题没有统一答案,必须按平台分别测量。 用一个平台的结果推断另一个平台,是这类观测中最常见的错误。
必须强调:Claude 的零提及是在特定账户、特定模型、逐题匿名的配置下取得的。换配置结果可能不同,因此这条数据只能读作「该配置下 30 题 0 提及」,不能读作「Claude 不引用该站」。
观察四:品牌词的进入速度,和内容页的收录速度是两件事
域名 A 三天内拿下 Bing 品牌词第一,但那是一个几乎没有竞争的词;域名 B 三天内在 Google 拿到七页样本全收录,但品牌词表现我们没有测。
这两件事经常被混为一谈。 品牌词排名反映的是实体识别,内容页收录反映的是抓取与索引处理,两者可以完全脱节。
三、这组数据不能说明什么
这一节比上面四节重要。
n=2,而且两个样本不可比。 域名 A 是中文站、内容以文章为主、面向国内;域名 B 是英文站、内容以结构化资料为主、面向海外。语言、行业、内容形态、目标市场全部不同——这些是混杂变量,不是控制变量。把它们放在一起,只能说明「差异存在」,不能说明「差异由哪个因素造成」。
不能推断因果。 两个域名在观测期内都做了主动提交与推送,我们没有设置「不提交」的对照域名,因此无法区分自然进入与人为加速。
平台配置强依赖。 上面已经说明的 Claude 情况同样适用于其他平台:AI 平台的回答受账户、模型版本、提问方式、时间影响,任何单次结果都不是稳定结论。这正是我们坚持固定问题集、固定配置、保留原始链接的原因。
只覆盖列出的平台与日期。 豆包、腾讯元宝、DeepSeek、夸克、百度 AI 搜索的基线我们尚未完成,本文任何结论都不适用于它们。
四、方法本身:让观测可复现的最低要求
如果你想自己做同样的观测,以下三件事是最低配置,缺一样结果就不可比:
- 固定问题集。 每个平台用同一组问题,且长期不变。问题一旦改动,前后两次的数据就失去了可比性。我们用的是每平台 30 题。
- 固定环境。 账户、模型、地区、语言、是否登录、是否匿名,每一项都要记录并在复测时保持一致。混用配置再直接比较,等于换了尺子量身高。
- 保留原始答案链接。 不只记录「有没有提到我」,要把该次回答引用的全部外部链接存下来。1081 个链接的价值不在于数量,在于它让「AI 那天到底读了谁」这个问题事后仍可回答。
第三点最容易被省略,也最不可补——答案不会重现,链接当时不存,之后就永远没有了。
五、下一步
上一期承诺过 08-14 与 08-21 各复测一次。本篇提前到 08-12 发布,因为域名 B 的「Bing 未抓取而 Perplexity 已引用」是一个随时会变化的状态——写下来的那一刻它就成了历史记录,等下去只会让这个观测消失。08-21 那次复测照常进行,并把品类词与行业词纳入观测。国内五个 AI 平台(豆包、腾讯元宝、DeepSeek、夸克、百度 AI 搜索)的固定问题基线正在建立,完成后会单独发布。
数据出来都会写,包括与本文判断相反的部分。
关于我们:妙蛙 GEO(Miaowa GEO)是天津思必得科技有限公司旗下的生成式引擎优化(GEO)产品,2026 年成立,统一社会信用代码 91120223MAKH9RTU1Q,网站备案号津ICP备2026010121号。我们做的是品牌在 AI 搜索中被提及与引用情况的监测与优化,服务外贸企业、跨境电商与国内中小企业。我们不代表任何第三方 AI 平台,也不承诺收录、固定排名、流量或收入。
本文所有观测数据来自妙蛙 GEO 研究团队的第一方实测,观测环境、时间、样本量与限制条件已在文中标注。文中域名 B 为我方同期运营的另一个项目,出于该项目自身的中立性要求不公开身份,其数据与方法已完整披露。
本文由妙蛙 GEO 研究团队撰写,使用 AI 辅助进行资料整理与语言校对,文中事实、来源和结论均经人工复核。
