检测案例2026年8月7日 – 2026年8月26日 · 外贸与出海企业网站

检测案例|五家外贸站的 AI 可见度基线切片:把 AI 拦在门外的,往往是自己的防火墙和模板

2026 年 8 月,五家外贸与出海企业先后把自己的网站提交到我们的免费检测工具。基线诊断发现的问题各不相同,却全部是站长自己看不见的:防火墙把 AI 爬虫整体误杀、robots.txt 模板化禁抓、中英双站互不声明、结构层机器不可读。本页公开五个匿名切片与外贸子集的整体口径。对象均非我们的客户,未获授权,因此全部不具名。

对象与授权说明,先讲清楚。 本页写的五家企业,都是 2026 年 8 月自己把网站提交到我们免费 AI 可见度检测工具的外贸与出海公司。检测是匿名的——不注册、不留邮箱、不留手机号——所以他们不是我们的客户,我们也没有任何一家的发布授权。因此本页与我们的实名客户案例不同:全部不具名,切片只写行业大类,不写地域;这延续我们此前公开过的承诺——检测数据用于聚合研究与匿名分析,不用于点名。

本页也没有效果数据。 我们与这五家企业的全部交集,是检测工具为它们各自动完成的一次基线诊断。诊断发现了什么、意味着什么、该从哪里改起——本页写的是这些;没有整改,自然没有前后对照。

那为什么值得写成案例?因为这五份诊断放在一起,构成了外贸网站 AI 可见度问题的一张相当完整的切面图:每一家栽的地方都不一样,但每一处都是站长自己看不见的。


一、这批企业是谁

检测工具 2026 年 8 月 7 日上线,到 8 月 26 日收到 107 个不同 URL 的检测。剔除我们自己为公开案例库做的 18 个、知名公共网站与测试域约 13 个之后,真实企业与个人站点的提交约 76 个 URL——其中外贸与出海方向 25 个 URL、对应约 19 家主体,约占三成。

更值得注意的是他们测试时的行为。检测记录的时间线里有四组非常专业的对照测试:同一个站 http 与 https 各测一遍(间隔 2 分钟);裸域名与 www 各测一遍;中英文两个站 4 分钟内连测;同一家公司两个品类站 1 分钟内连测。

样本构成漏斗与四组对照行为:107 个 URL,剔除自测 18 个与公共站 13 个后企业提交约 76 个,其中外贸/出海 25 个 URL、约 19 家主体;右侧为四组对照测试行为
样本构成漏斗与四组对照行为:107 个 URL,剔除自测 18 个与公共站 13 个后企业提交约 76 个,其中外贸/出海 25 个 URL、约 19 家主体;右侧为四组对照测试行为

这不是随手一测的流量。这是带着问题来的人——海外买家在用 AI 找供应商这件事,外贸站长已经信了,也动手自查了。下面五个切片说明的是:连最认真的这批人,也在为自己看不见的问题买单。

二、五个切片:每家的诊断

切片一:AI 看到的不是官网,是防火墙

第一家是做暖通舒适系统的制造商,测的是自己的英文站。诊断结果非常离奇:检测环境抓到的页面标题是「宝塔网站防火墙」,关闭 JavaScript 后正文只剩约 141 个字符——像一个从来没做过网站的公司。但用普通浏览器打开,产品线完整、英文流畅、设计在线。

两边都没错。检测节点(海外的自动化浏览器)看到的,和买家浏览器看到的,不是同一个页面。 服务器防火墙把海外自动化流量判成了威胁,返回拦截页;而 AI 爬虫的访问特征——数据中心 IP、自动化、海外出口——与检测节点几乎一样。也就是说,AI 每次来读这个站,读到的很可能都是那张防火墙页。站长不可能知情:他自己打开永远是正常的。

这不是孤例。我们此前发布的 86 站聚合分析里,探针成功的 48 个站中有 12.5%(6 个)对 AI 爬虫和普通浏览器返回不同内容。

切片二:robots.txt 把 AI 整站禁抓,传统 SEO 却做得不错

第二家是汽车底盘零部件制造商。它的传统指标相当健康:移动端 PageSpeed 81 分,标题、描述齐整。但 robots.txt 里,针对 ClaudeBot 的规则实质是整站不允许抓取,针对 Google-Extended 的规则同样如此——前者影响 Claude 的检索,后者影响 Gemini 的答案组织(不影响传统 Google 排名)。

我们的诊断判断:这类配置多数不是企业的主动决策,而是建站模板、安全插件或「防采集」教程的默认值。它的隐蔽之处在于,传统搜索流量完全正常,损失只发生在 AI 检索这条新链路上,任何报表都看不出异常。

切片三:模板建站的标配病,一个不落

第三家是一家橡塑机械厂的英文站,典型的外贸模板建站交付件:标题是「公司名+产品词+产品词」的堆叠样式;整站没有任何 JSON-LD 结构化数据;做了英文站却没有声明 hreflang;可访问性树不合格;页面加载中实测布局偏移(CLS)0.203。

单看每一项都不致命,合在一起就是:AI 能抓到这个站,但读出来的是一堆没有结构的文本块,而且不知道该把它推荐给说什么语言的买家。 这些项目没有一项出现在常规建站验收单上。

切片四:预算不是分界线

第四家是一家知名消费硬件出海品牌的东南亚官网:移动端 PageSpeed 33 分,整个首页没有一个 H1,可访问性树不合格。品牌大、预算足、设计精美,但在机器可读性这一层,它和上面那家模板站没有本质区别。AI 可见度不是花钱建漂亮站就能顺带获得的副产品,它是一层独立的、需要单独验收的工程。

切片五:中英双站,同一套毛病,还互不相认

第五个切片是两家企业——一家化工新材料厂商、一家网络连接器厂商——不约而同做的同一件事:把自己的中文站和英文站在几分钟内各测了一遍。

结果高度一致:四个站的可访问性树全部不合格;两家的双站都没有声明 hreflang——中英两个站在机器眼里是两个毫无关系的网站,AI 不知道它们是同一家公司,也不知道该向海外买家出示哪个语言版本。英文站还各有缺项:一个没有 H1,一个 Open Graph 不完整。双站是外贸企业的标准配置,双站互认几乎没人做——这是本批数据里最「外贸特有」的一个坑。

五个匿名切片与检测命中问题的矩阵:切片一命中防火墙差分;切片二命中 robots 禁抓 AI 与未声明 hreflang;切片三命中零结构化数据、未声明 hreflang 与可访问性树不合格;切片四命中可访问性树不合格与性能不及格;切片五命中未声明 hreflang、可访问性树不合格与 H1 缺失
五个匿名切片与检测命中问题的矩阵:切片一命中防火墙差分;切片二命中 robots 禁抓 AI 与未声明 hreflang;切片三命中零结构化数据、未声明 hreflang 与可访问性树不合格;切片四命中可访问性树不合格与性能不及格;切片五命中未声明 hreflang、可访问性树不合格与 H1 缺失

三、外贸子集的整体数字(全部带分母)

把约 19 家主体按每家一个主站合并成 18 个站点统计(中文姊妹站不重复计入;只有取得判定的站点进入分母):

  • 可访问性树:16 个有判定的站中 10 个不合格(62.5%)——与我们 86 站全样本的 64%(72 中 46)几乎一致,这是行业级问题,外贸站没有豁免;
  • hreflang:14 个有判定的站中 6 个未声明——做的就是多语言生意,却不告诉机器语言版本的对应关系;
  • Open Graph:14 个中 3 个完全缺失、3 个不完整H1:14 个中 3 个缺失JSON-LD:14 个中 2 个完全没有
  • 移动端 PageSpeed:16 个有分数的站中 2 个不及格(33 分、45 分),12 个处于警告区
  • robots 对 AI 爬虫:取得判定的 9 个站中 1 个对 ClaudeBot 整站禁抓
  • 关 JS 后无正文、canonical 缺失各 1 个(均为切片一的防火墙拦截页所致,不代表其官网真实配置)。

一句话:外贸站的基础病与全样本一致(结构层最重),但叠加了三种外贸特有病——防火墙对海外自动化流量的误杀、robots 对 AI 爬虫的模板化禁抓、多语言双站互不声明。共同点是站长自己永远看不到。

四、如果要改,从哪里开始

这五家不是我们的客户,所以下面不是交付记录,而是诊断给出的整改方向——同类企业不花钱就能先做五件事:

  1. 换个身份看自己:用海外节点(或请海外客户)访问一次自己的站,与国内浏览器对照——切片一那张防火墙页就是这样才能被发现的;
  2. 逐行读 robots.txt:找针对 GPTBot、ClaudeBot、PerplexityBot、Google-Extended 的 Disallow——有而不知原因的,多半是模板默认值;
  3. 关掉 JavaScript 打开首页:看还剩多少正文——多数 AI 爬虫不执行 JS;
  4. 查双站互认:中英文站源码里有没有互指的 hreflang;
  5. 数一数 H1:每个关键页面应有且只有一个。
外贸站十分钟自查清单:海外视角对照、逐行读 robots.txt、关 JS 看正文、查 hreflang 互认、数 H1,五个动作各附合格标准
外贸站十分钟自查清单:海外视角对照、逐行读 robots.txt、关 JS 看正文、查 hreflang 互认、数 H1,五个动作各附合格标准

清单之外的部分——可访问性树、结构化数据、UA 差分探测——需要工具化检测。这正是我们把检测工具免费开放的原因:不注册、不留联系方式,测完即得报告。

五、边界

按惯例写明本页不能证明什么:样本为自选样本(主动来测的站长偏关注 AI 可见度),全部比例不外推至外贸行业整体;检测衡量的是技术可读性,不预测也不承诺任何 AI 引用、收录或流量结果;单次检测只反映检测时点的状态;本页不点名任何被测网站,切片描述已做脱敏,每个切片的特征在同期外贸样本中均不止一例——如与任何具体企业情况相似,属行业共性问题所致;五家对象均非我们的客户,本页不构成其对我们的任何评价或背书。


关于我们:妙蛙 GEO(Miaowa GEO)是天津思必得科技有限公司旗下的生成式引擎优化(GEO)产品,2026 年成立,统一社会信用代码 91120223MAKH9RTU1Q,服务外贸企业、跨境电商与出海品牌方,业务为品牌在 AI 搜索中被提及与引用情况的监测与优化。我们不代表任何第三方 AI 平台,也不承诺收录、固定排名、流量或收入。

本页数据来源:妙蛙 GEO 免费检测工具 2026-08-07 至 08-26 的检测记录聚合,以及 Google PageSpeed Insights 与 Lighthouse 的公开检测能力。全样本口径见此前发布的 86 站聚合分析。

本页由妙蛙 GEO 研究团队撰写,使用 AI 辅助进行资料整理与语言校对,文中事实、来源和结论均经人工复核。

对象与授权说明

对象关系
五家对象均为免费检测工具的匿名用户,不是妙蛙 GEO 的客户;我们未取得任何一家的发布授权,因此全部不具名,切片只写行业大类。本页不构成任何一家对我们的评价或背书。
去识别口径
切片描述已去识别:只写行业大类、不写地域、不引用可识别的页面文字;每个切片呈现的特征在同期 25 个外贸站样本中均不止一例,描述的是一类问题,不是某一家。
检测窗口
2026年8月7日2026年8月26日