越南消费者问 ChatGPT「河内哪里买手机靠谱」「哪家母婴品牌可信」时,AI 会引用谁?我们用一个开源评分引擎,对越南 14 家头部零售与电商站做了一次完整实测。结论比预想的糟:9 家可评分站点无一达到「良好」档(68 分及以上),均分只有 51.0;另外 5 家对 AI 爬虫直接不可见。
为什么这件事值得越南品牌方重视?因为需求端已经迁移:越南 ChatGPT 覆盖率 81%、付费用户超过半数(Technode,2025 年 8 月);全球范围内传统搜索流量预计 2026 年下降 25%(Gartner,2024 年 2 月);80% 消费者至少 40% 的搜索依赖 AI 结果(Bain)。AI 答案里有没有你,正在取代搜索排名第几,成为新的流量分配机制。
1 实测方法与口径:先把可信度说清楚
市面上很多「AI 可见度报告」只给结论不给方法,数字无法复现。本次实测的全部参数公开如下:
- 评分引擎:Auriti-Labs geo-optimizer-skill v4.18.0(MIT 许可开源),0–100 分制,8 个维度加权,判据来自 Princeton KDD 2024 可引用性研究。
- 测量节点:新加坡云服务器(模拟 AI 爬虫的典型出海抓取路径)。中国大陆节点与海外节点结果差异见第 5 节。
- 测量时间:2026 年 9 月 20 日凌晨,单轮全量。
- 稳定性检验:抽 3 个站点各重复测 5 次,分数极差为 0(完全可复现);同一 URL 从广州节点与新加坡节点对比,差异 ±1 分。
- 交叉验证层:除评分引擎外,另用标准浏览器 UA 独立采集 robots.txt、llms.txt、首页 JSON-LD 与 hreflang,两层数据互相印证。
- 剔除规则:一个拼写错误的域名(shoppe.vn)已从统计中剔除;抓取失败与反爬壳页不计入均分,单独列出——把「没抓到」记成「0 分严重不足」是常见误导。
⚠️ 一个必须说明的测量陷阱:shopee.vn 返回 HTTP 200、页面体积 202 KB,评分引擎照样打出了 25 分「严重不足」。但拆开看,这个页面的可提取正文是 0 个词、没有 H1、含 captcha 标记——抓到的是反爬验证壳页,不是真首页。25 分是伪评分。我们在生产环境里为这类情况加了判据(正文词数 < 50 且无 H1 即判为「内容不可提取」,不出分),因为给客户一个冤枉的红色判定,比不给判定更糟。
2 结果一:9 家可评分站点,无一达到「良好」档
评分档位划分:0–35 严重不足(critical)、36–67 待建设(foundation)、68–85 良好(good)、86–100 优秀(excellent)。
| 排名 | 站点 | 行业 | 总分 | 档位 |
|---|---|---|---|---|
| 1 | goha.vn | GEO 服务商 | 62 | 待建设 |
| 2 | kidsplaza.vn | 母婴零售 | 56 | 待建设 |
| 3 | tiki.vn | 电商平台 | 54 | 待建设 |
| 3 | nguyenkim.com | 3C 零售 | 54 | 待建设 |
| 5 | cellphones.com.vn | 3C 零售 | 49 | 待建设 |
| 6 | masangroup.com | 消费集团 | 47 | 待建设 |
| 6 | mediamart.vn | 3C 零售 | 47 | 待建设 |
| 8 | lazada.vn | 电商平台 | 46 | 待建设 |
| 9 | bibomart.com.vn | 母婴零售 | 44 | 待建设 |
均分 51.0,中位数 49,区间 44–62。9 家全部落在「待建设」档,没有一家进入「良好」。排名第一的 goha.vn 本身是做 GEO 服务的同行,也只有 62 分——说明这不是「品牌大不大」的问题,而是整个越南零售电商行业都还没把 AI 爬虫当成一类需要专门伺候的访客。
3 结果二:失分高度集中在「AI 专属维度」
把 8 个维度按得分率排序,会看到一条清晰的分界线:给传统搜索引擎做的项目(Meta 标签 93.7%、robots.txt 83.3%、内容质量 75.0%)越南企业做得不错;专门为 AI 设计的项目(AI 发现端点 7.4%、llms.txt 13.6%)几乎是空白。
| 维度 | 满分 | 9 家均分 | 得分率 | 0 分站数 |
|---|---|---|---|---|
| AI 发现端点(ai_discovery) | 6 | 0.4 | 7.4% | 7 / 9 |
| llms.txt | 18 | 2.4 | 13.6% | 7 / 9 |
| 品牌实体(brand_entity) | 10 | 3.9 | 38.9% | 0 / 9 |
| 结构化数据(schema) | 16 | 7.3 | 45.8% | 2 / 9 |
| 技术信号(signals) | 6 | 3.0 | 50.0% | 1 / 9 |
| 内容质量(content) | 12 | 9.0 | 75.0% | 0 / 9 |
| AI 爬虫访问(robots) | 18 | 15.0 | 83.3% | 0 / 9 |
| Meta 标签 | 14 | 13.1 | 93.7% | 0 / 9 |
三个最值得注意的数字:
- AI 发现端点 7.4%:7/9 家在这个维度直接拿 0 分。这是给 AI 智能体调用的标准化接口,目前整个越南市场基本无人部署。
- llms.txt 13.6%:7/9 家为 0 分。llms.txt 是 2024 年 9 月提出的提案(不是官方标准),用于告诉大模型「本站哪些内容最值得引用」。15 家站点里只有 3 家部署:lazada.vn、vinfastauto.com,以及我们自己的 yuezhitong.com。
- FAQPage 结构化数据 0/15:交叉验证层显示,15 家站点无一家在首页部署了 FAQPage JSON-LD。而 FAQ 问答对恰恰是 AI 最容易直接摘取的内容形态。
结构化数据整体也偏弱:15 家里只有 6 家部署了 Organization schema、6 家有 WebSite schema;hreflang 多语言标注只有 goha.vn(4 条)和 yuezhitong.com(3 条)做了,其余全部为 0——对一个面向中越双语市场的地区来说,这是明显的缺口。
4 结果三:5 家对 AI 爬虫「直接不可见」
这是本次实测最刺眼的发现。以下 5 家站点,对人类访客完全正常,但 AI 爬虫抓不到内容——在 AI 答案里,它们等于不存在:
| 站点 | 行业 | 实测表现 | 说明 |
|---|---|---|---|
| fptshop.com.vn | 3C 零售 | HTTP 403 | 对数据中心来源直接拒绝 |
| vinamilk.com.vn | 食品饮料龙头 | HTTP 403 | 对数据中心来源直接拒绝 |
| thegioididong.com | 3C 零售龙头 | 连接超时 | 191 秒未建立连接 |
| vinfastauto.com | 汽车与电动车 | 首页 403 | robots.txt 与 llms.txt 可访问,首页拒绝 |
| shopee.vn | 电商平台 | 200 但 0 正文 | 返回反爬验证壳页 |
关键细节:我们用标准 Chrome 浏览器 UA 重测 fptshop.com.vn 与 vinamilk.com.vn,依然返回 403——说明拦的不是「UA 像不像爬虫」,而是IP 是否来自数据中心。这类防护对人类用户毫无影响,但 AI 引擎的抓取基础设施全在云上,等于把自己对 AI 关在门外。
vinfastauto.com 的情况最可惜:它是 15 家里唯二部署了 llms.txt 的品牌方,robots.txt 里也规范声明了 GPTBot、PerplexityBot、ClaudeBot、Amazonbot 四个 AI 爬虫——态度是对的,但首页对数据中心返回 403,前面的准备工作全部落空。
📌 这一条对越南品牌方的启示最实在:「AI 可见性」的第一道门槛不是内容写得好不好,而是爬虫进不进得来。WAF 规则里给已知的 AI 爬虫网段(OpenAI、Anthropic、Perplexity、Google-Extended 公布的 IP 段)开白名单,是零成本、当天可完成的动作。做不做,直接决定你在 AI 答案里存在与否。
5 一个方法论提醒:测量节点位置会改变结论
同一批站点,我们从中国大陆节点与新加坡节点分别测过,结果差异显著:fptshop.com.vn 与 thegioididong.com 从大陆节点连接直接失败(返回码 000),从新加坡节点则分别返回 403 与超时——虽然两者都归为「不可见」,但失败原因不同。
更重要的是 bibomart.com.vn:大陆节点与新加坡节点都测到 44 分,一致;但整体抓取耗时差异巨大(大陆 5.4 秒 vs 新加坡 29.1 秒)。做越南市场的 AI 可见性监测,测量节点必须放在海外(新加坡 / 雅加达这类位置),否则会把「大陆出口到越南站点的网络问题」误判成「站点对 AI 不可见」。
6 对照组:同样的引擎,我们自己的站点做了什么
为了证明这套测量方法有效(而不是一律打低分),把同一引擎对准我们自己的站点 yuezhitong.com:68 分,「良好」档,是本次全部 15 个目标中唯一进入该档位的站点。分差来自三件具体的事:
- robots.txt 显式声明 5 个 AI 爬虫:OAI-SearchBot、ChatGPT-User、PerplexityBot、Claude-SearchBot、Claude-User(15 家里只有 5 家做了声明,中位数是 0)。
- 部署了 llms.txt(15 家里仅 3 家),内含站点定位、服务清单与内容中心索引。
- Organization + WebSite JSON-LD 与 3 条 hreflang 多语言标注,中英越三语页面互相指认。
即便如此,我们也只有 68 分,距离「优秀」(86 分)还差 18 分——失分同样集中在 AI 发现端点(0/6)与品牌实体(5/10)。这个行业目前没有人做到 86 分以上,先行者的窗口还在。
7 给越南零售电商品牌的 5 条修复清单
- 先开门(0 成本,当天完成):在 WAF / CDN 规则里为已公布网段的 AI 爬虫加白名单——OpenAI(GPTBot、OAI-SearchBot、ChatGPT-User)、Anthropic(ClaudeBot、Claude-User)、PerplexityBot、Google-Extended。用真实浏览器 UA 复测首页仍返回 403 的站点,优先处理这一条。
- 写清楚(1 天):robots.txt 里为每个 AI 爬虫单独声明 User-agent 段落,明确允许抓取的内容路径;保留 sitemap 声明。
- 补结构化数据(3–5 天):首页至少部署 Organization + WebSite JSON-LD;把客服高频问题做成 FAQPage JSON-LD——本次 15 家全部缺失这一项,是竞争最空的一块。
- 加 llms.txt(1 天):15 家里只有 3 家部署。注意它是 2024 年 9 月的社区提案、非官方标准,价值在于「先行者少」,不要期待立刻带来引用量。
- 建基线并持续测(长期):用固定问题集每月测一次品牌在 ChatGPT / Perplexity / Google AI Overviews 答案中的出现情况。本次实测 3 站点各重复 5 次极差为 0,说明技术评分可作为稳定基线;但 AI 答案侧的品牌提及率需要持续采样,不能测一次就下结论。
总结:越南零售电商的 AI 可见性,还停在「开门」这一步
把本次实测压缩成三句话:
- 能评分的 9 家,均分 51.0,无一达到「良好」档——传统 SEO 功课(Meta 93.7%、robots 83.3%)做得不错,AI 专属项目(发现端点 7.4%、llms.txt 13.6%)几乎空白。
- 14 家里有 5 家对 AI 爬虫直接不可见(403 / 超时 / 反爬壳页),拦的是数据中心 IP 而不是 UA,对人类访客无感,对 AI 引擎致命。
- FAQPage 结构化数据 0/15、llms.txt 3/15——竞争最空的两个位置,也正是 AI 最容易摘取的内容形态。
越南市场的需求端已经迁移到 AI(ChatGPT 覆盖率 81%),供给端的网站却大多还没为 AI 爬虫开门。这个差距不会长期存在——被 AI 理解,即是被世界看见。