数据是真实模型回答还是模拟数据?采购方怎么核验?
是真实回答:真实浏览器通过各 AI 产品的网页入口提问,不用 API 返回冒充网页结果,也不生成模拟数据;每次运行保存回答原文、截图与来源,原始记录以 SHA-256 校验,失败如实留痕。采购方可按截图、来源 URL、失败记录、任务 ID 四项抽查,并对照公开示例 /report。
当前版本:1.1 · 最近更新:是真实回答。妙蛙 GEO 的每一条观测都来自真实浏览器在各 AI 产品的正常网页入口上模拟真实用户提问得到的结果,不用 API 返回冒充网页结果,也不生成模拟数据。每次运行都保存回答原文、页面截图与引用来源,原始采集记录以 SHA-256 校验;失败的任务以失败状态留痕。采购方不必相信这段话,可以按文末清单逐项核验。
采集为什么是真实的
- 采集在境外浏览器环境执行,走 ChatGPT、Gemini、Perplexity、Google AI Overviews、Microsoft Copilot、Claude 各自的网页入口,抓到的页面就是海外买家看到的页面。
- 不用 API 返回替代网页结果:API 与网页产品在联网检索、来源展示上往往不同,用它冒充会让「买家到底看到了什么」失真。
- ChatGPT 使用临时会话并关闭个性化(记忆不生效)后才发问,每题独立会话,上一题不会污染下一题。
- 每题每平台默认执行一次;问题集在项目设置后冻结,轮次之间同口径可比。
为什么截图和原文可以当证据
每次运行保存回答原文、页面截图、引用来源(URL 与标题)、时间、地区、语言、平台入口、Prompt 版本与异常状态。原始采集记录以 SHA-256 校验,导出时优先取已校验的原始记录,所以报告里的每个数字都能回溯到一条带哈希的原始记录,而不是事后整理的汇总表。证据与报告分别经人工审核,只有审核后的观测计入分母;无法核实的内容标记为待核实。
失败不会被伪装
平台超时、验证码、登录态失效、界面改版都会让单次任务失败。失败、阻断、未知状态不进入业务指标分母,但会如实留痕;轮次结束后不在周期外补问。一份只有成功记录、没有任何失败记录的监测数据,反而值得追问它是怎么来的。
采购方核验清单
- 要截图:随机抽几条观测,同时看页面截图与回答原文,确认两者一致。
- 要来源 URL:核对回答附带的来源是否逐条保存了 URL 与标题,而不是只有一个引用数。
- 要失败记录:要求看某一轮的失败、阻断、未触发记录,确认它们没有被算进分母。
- 要任务 ID:确认每条观测有稳定任务编号,技术重试沿用原编号而不是另起一条。
- 对照 /report:公开示例报告用同一套状态口径,先看示例,再要求正式交付按同样的形态给。
- 用 API 跑更快更便宜,为什么不用?
- 因为监测对象是买家在网页产品里看到的回答。API 输出与网页产品不一致,用它替代会让提及率、引用率失去业务含义。
- 截图会不会被事后修改?
- 原始采集记录以 SHA-256 校验,导出时优先取已校验记录;截图与回答原文、来源、时间绑定在同一条任务记录上,改任何一项都会与哈希对不上。
- 能把采集环境改到国内吗?
- 不能。采集在境外浏览器环境执行,因为海外买家用的就是这些平台的海外入口。妙蛙 GEO 也不监测豆包、DeepSeek 等国内平台。
帮助中心
返回问题清单,或发邮件至 contact@miaowageo.com。
