返回技术文章
AI引用Perplexity方法论实测GEO

新站三天进入 AI 引用:妙蛙 GEO 的 AI 搜索方法论(附 150 条观察原始口径)

一个上线三天的新域名,在 Perplexity 的 30 道无品牌提示问题中被引用 4 次,同批测试的另外四个平台各为 0 次。本文公开完整口径、观测方法和这三天做过的十件事——以及为什么我们不能说是这些事带来了那 4 次引用。

妙蛙 GEO 研究团队更新于 10 分钟

一个 2026 年 8 月 9 日注册的新域名,在上线三天后的基线测试中,被 Perplexity 在 30 道无品牌提示的问题里引用了 4 次。同一批测试中,Google AI features、ChatGPT、Claude、Gemini 四个平台各为 0 次。

这篇文章把这次测试的全部口径、方法和期间做过的十件事写出来。同时会说清楚一件事:我们无法证明这十件事带来了那 4 次引用。

该域名同样由我们运营。出于该项目自身的中立性要求,本文公开它的全部数据与方法,但不公开身份、行业和链接——隐瞒共同运营关系比不点名严重得多,所以先在这里说明。


一、先把数字口径写全

五个平台各 30 道无品牌提示问题的命中对照:Perplexity 4 次,其余四个平台各 0 次
五个平台各 30 道无品牌提示问题的命中对照:Perplexity 4 次,其余四个平台各 0 次
平台30 题中被引用
Perplexity4
Google AI features0
ChatGPT0
Claude0
Gemini0
  • 平台数:5;每平台固定问题:30;观察总数:150(全部完成)
  • 被引用的回答数:4;带链接的引用:4
  • Perplexity 单平台命中率:4/30 = 13.3%
  • 五平台合计命中率:4/150 = 2.7%
  • 保留的外部答案链接:1081 个;回答字符总数:518,362

关于这两个百分比,需要明确两点:

第一,13.3% 是单平台数字,不是「AI 引用率」。 五个平台里四个是 0。把最好的那个平台的数字说成「AI 引用率」,是挑数据。

第二,这不是「提升」。 域名注册于观测前三天,没有前值,不存在增量。任何写成「引用率提升 X%」的表述,在这组数据上都不成立。

我们在别处批评过「引用率提升 300%」这类无口径的效果数字。既然批评了,自己的数字就得按同样标准写。


二、方法:这 150 条观察是怎么来的

2.1 问题集:只用无品牌提示问题

每个平台 30 道固定问题,每题有固定编号,长期不变。全部为无品牌提示问题——不问「这个站是什么」,只问该领域里的真实问题,看它会不会被主动提到。

这个设计不是细节,是这套测量能不能用的前提:

  • 含品牌名的问题只能检验模型是否知道你。模型知道你,不代表它会在别人没提你的时候推荐你。
  • 无品牌提示问题检验的才是有商业含义的那件事:客户问了一个行业问题,你会不会出现在答案里。

问题集不随观测结果调整。改题等于换尺子,前后两次数据立刻失去可比性。

2.2 固定环境:记录到「界面」一级

每条观察记录的不只是平台名,而是具体界面——例如同一平台要区分「已登录状态下的搜索 AI 概览」和其他入口,两者结果可能完全不同。

账户、模型、是否登录、是否新会话、是否逐题匿名,逐项固定并记录。复测前先核对配置,再提问。

2.3 每条观察记录 10 个字段

一条观察记录保存的 10 个字段,其中第 8 项为回答内容的 SHA-256
一条观察记录保存的 10 个字段,其中第 8 项为回答内容的 SHA-256

平台、界面、观测日期、问题编号、本站命中结果、该回答的外部链接数、回答字符数、回答内容的 SHA-256、完整回答是否内部留存、完整回答是否公开。

SHA-256 是这套方法里最关键的一项。 它让「这条回答我们事后没有改过」从一句需要读者相信的话,变成可以验证的事实。生成式回答不可重现,如果没有哈希,任何人(包括我们自己)都无法在事后证明记录的完整性。

2.4 公开边界:只发自己的结果

我们只发布本站自身的命中结果、各项计数和回答哈希。完整的平台回答内容与账户级会话 URL 保持内部,不公开——回答内容的版权归属不清晰,会话 URL 含账户信息。

2.5 「未运行」不记为「0 引用」

首轮测试时有两个平台没能跑起来:一个未登录,一个触发了人机验证。这两个平台当时被明确记为「未运行」,而不是「0 次引用」。

这一条看起来很小,实际影响很大:把跑不起来的平台记成 0,会缩小分母、抬高命中率。多数效果报告不会区分这两种情况,而它们的含义完全不同——一个是「测了,没有」,一个是「根本没测」。

2.6 搜索侧:状态不得混淆

搜索侧五级状态阶梯与 AI 引用侧独立链路的对照
搜索侧五级状态阶梯与 AI 引用侧独立链路的对照

搜索侧的状态是一条阶梯,每一级都不能跳:

提交 ≠ 被发现 ≠ 已抓取 ≠ 已收录 ≠ 有展现。

具体到操作上:

  • 站长平台的「已受理索引请求」只表示进入优先抓取队列,不是收录证据
  • 平台界面明确提示重复提交不改变优先级,因此我们不重复请求;
  • 请求配额耗尽时不发起无效请求,也不把失败的请求记成「已请求」;
  • IndexNow 只对实质新增或变更的 URL 提交,不对未变更内容重复推送。

AI 引用是另一条独立的链路,不在这条阶梯上。我们此前的观测中出现过一个站在某搜索引擎尚未抓取时,已被某 AI 平台引用的情况。


三、这三天实际做了十件事

以下按「与可被引用的相关性」排序。但顺序不代表因果——下面每一条我们都无法证明它起了作用,原因见第四节。

  1. 结构化数据:为可引用的资产输出 JSON-LD,包含数据集与列表类型,让机器能读懂页面上哪部分是数据、许可是什么。
  2. 证据分级:把「来源方自述」「独立核实结果」「推导结果」「信息冲突」「未知」分成不同等级,并在页面上显式标出每条信息属于哪一级。
  3. 未知与冲突不填充:某个字段没有可靠来源时,明确标为未知,不为了页面看起来完整而填造数值。这一条减少了页面的「完整度」,但保住了可核验性。
  4. 一手来源留存:为每条关键结论保留一手来源、核实时间、条件边界和更正历史。
  5. 可引用资产:提供版本化的 JSON / CSV / BibTeX 导出,配 SHA-256 完整性校验、旧版快照冻结和更正日志——让引用方能引用一个确定的版本,而不是一个会变的页面。
  6. 许可明确:自有内容与数据采用 CC BY 4.0,代码采用 MIT,第三方材料明确排除在外。引用者不需要猜自己能不能用。
  7. `llms.txt`:向 AI 侧声明站点结构与可引用资产的入口。
  8. 抓取许可:首年明确允许搜索、AI 检索、AI 引用及训练型爬虫抓取;同时写明抓取许可不等于第三方内容授权
  9. 搜索入口接入:Search Console、Bing Webmaster Tools、IndexNow 与站点分析全部接入并验证。
  10. 不发布综合评分与「最佳」排名:比较页只呈现可以逐项核对的字段差异,不给主观总分。

这十件事有一个共同点:它们都是在降低引用方的核实成本。 一个来源如果标明了信息等级、留了一手出处、给了确定版本和明确许可,引用它的风险就更低。这是我们做这些事的假设——它仍然只是一个假设。


四、为什么我们不能说这些动作带来了那 4 次引用

没有对照组。 我们没有另建一个「什么都不做」的域名做对比。因此这十件事里,没有任何一条能被单独证明起了作用,也不能证明它们合起来起了作用。

样本是 1 个站、1 次基线。 单次观测无法区分「方法有效」和「恰好被抽到」。

四个平台是 0,这本身就是反例。 如果这十件事是充分条件,那么在同一批问题、同一个站、同一个时间窗口下,另外四个平台不应该全是 0。同样的做法在四个平台上没有产生任何引用——这一点必须和那 4 次引用放在一起看。

问题集本身影响结果。 换一组无品牌提示问题,命中率会变。30 道题的覆盖面有限。

平台配置强依赖。 换账户、模型版本、登录状态或提问方式,结果都可能不同。

三天是观测窗口,不是「见效周期」。 我们不会据此对外承诺任何时间表。


五、可以直接拿走的部分

抛开这个具体案例,方法本身是可以复用的:

  1. 用无品牌提示问题建基线,而不是问「XX 品牌怎么样」;
  2. 固定问题集、固定环境,逐项记录到界面一级,改任何一项就说明清楚;
  3. 保存每条回答的哈希与外部链接,这是唯一能让观测事后可核验的做法,而且不可补做;
  4. 区分「未运行」与「0 结果」,不要用前者充当后者;
  5. 搜索侧按状态阶梯记录,不把「已提交」写成「已收录」;
  6. 建设动作按「降低引用方的核实成本」来设计,而不是按「增加页面数量」。

第 3 条最容易被省略:答案不会重现,链接和哈希当时不存,之后就永远没有了。


六、下一步

08-21 会做第二次基线复测,届时可以给出同一组问题在时间上的变化——那才谈得上趋势。国内五个 AI 平台(豆包、腾讯元宝、DeepSeek、夸克、百度 AI 搜索)的固定问题基线正在建立。

数据出来都会写,包括与本文假设相反的部分。


关于我们:妙蛙 GEO(Miaowa GEO)是天津思必得科技有限公司旗下的生成式引擎优化(GEO)产品,2026 年成立,统一社会信用代码 91120223MAKH9RTU1Q,网站备案号津ICP备2026010121号。我们做的是品牌在 AI 搜索中被提及与引用情况的监测与优化,服务外贸企业、跨境电商与国内中小企业。我们不代表任何第三方 AI 平台,也不承诺收录、固定排名、流量或收入。

本文所有观测数据来自妙蛙 GEO 研究团队的第一方实测,平台清单、问题数量、观测方法、样本量与限制条件已在文中标注。文中所述域名为我方同期运营的另一个项目,出于该项目自身的中立性要求不公开身份,其数据与方法已完整披露。

本文由妙蛙 GEO 研究团队撰写,使用 AI 辅助进行资料整理与语言校对,文中事实、来源和结论均经人工复核。

继续阅读

相关技术文章

AI引用被收录和被引用不是同一条链路:两个新域名、四个平台的同期观测

一个新域名在 Bing 尚未抓取其页面的情况下,已经被 Perplexity 在 4 个无品牌提示的问题中列为带链接来源。这篇记录两个同期新域名在四个平台上的观测数据、方法,以及这组数据不能说明的部分。

AI可见度86 个网站来测了 AI 可见度:近一半在配置 AI 不看的东西,三分之二栽在 AI 真正读的地方

86 个网站在我们的免费检测工具上跑了 99 次 AI 可见度检测。聚合数据里最扎眼的不是某一项失败率,而是一个反差:46% 的网站配置了对 AI 搜索没用的 llms.txt,同时 64% 的网站栽在 AI agent 真正用来读页面的可访问性树上。本文公开全部聚合口径:AI 读不到、读不懂、不确定三层问题的逐项分布与修法。

AI可见度新站可见性实测:从「零结果」到品牌词第一,中间的三天发生了什么

2026 年 8 月 7 日,我们在 Bing 上搜自己的品牌名,返回的是汉字字典页。8 月 10 日,同一个查询里官网排第一。这篇记录完整的观测方法、干预动作和限制条件——包括我们无法证明的部分。