一、为什么「排名」衡量不了 GEO

过去两个月里,我们被问得最多的一个问题不是「GEO 怎么做」,而是「做完怎么证明有效」。这个问题的答案,恰恰是 GEO 与传统 SEO 最大的分水岭。

SEO 的度量对象是「位置」:同一个关键词,搜索引擎返回的是一份固定排序的链接列表,位置是可复现的。GEO 的度量对象是「引用」:AI 每次生成答案都是一次新的推理,同一个问题在不同时间、不同会话里,答案的措辞、提到的品牌、引用的来源都可能不同。

这意味着两件事:第一,任何声称「我们帮你排到 AI 答案第 1 位」的说法都不成立,因为 AI 答案没有稳定的位置;第二,GEO 并非不可度量——度量对象要从「位置」换成「引用」,并且必须用「多次采样 + 固定口径」的方式来抵消生成式输出的天然波动。

为什么现在必须补上度量这一课(数据均标注来源):
• 传统搜索流量:Gartner 预测 2026 年下降 25%(Gartner 2024-02)
• 用户习惯:80% 消费者至少 40% 的搜索行为依赖 AI 结果(Bain & Company)
• 中国 GEO 市场:2025 年 349.3 亿元 → 2026 年预计 942 亿元(艾媒咨询 2026-02)
• 越南:ChatGPT 覆盖率达 81%,付费率超半数(Technode 2025-08);越南 AI 采用率 23.5%,全球第 38 位(台湾外贸协会)

市场预算在往 GEO 迁移,但验收标准还没跟上。谁先把口径立起来,谁就能在预算复审时把项目留下来。

二、五个核心指标:把「被引用」拆成可记录的数字

五个指标覆盖「有没有被提到 → 说得对不对 → 相对竞品多少 → 靠什么被引用 → 带来什么结果」这条完整链路。

指标 1:品牌提及率(Brand Mention Rate)

口径:在目标 query 清单中,AI 答案提到品牌的 query 数 ÷ query 总数。
回答的问题:品牌在 AI 答案里的存在感,相当于「入场率」。
注意:分母必须固定。换一套 query,数字立刻不可比。

指标 2:引用正确率(Citation Accuracy)

口径:AI 提到品牌时,业务描述准确的条数 ÷ 提及总条数。
回答的问题:AI 眼里的你到底是不是你。
为什么关键:被 AI 提到,但把业务说成别的行业、把越南主体说成中国主体,这种「错误引用」比不被引用更危险——它会直接把错误信息规模化地推给客户。

指标 3:声量份额(Share of AI Voice,SoAV)

口径:品牌被提及次数 ÷(本品牌 + 指定竞品)被提及次数之和。
回答的问题:在同一个问题里,AI 把份额分给了谁。
注意:竞品集合要先固定(建议 3-4 家),中途换对手等于换尺子。

指标 4:信源占比(Source Mix)

口径:AI 引用来源中,自有站 / 越南或中国本地信源 / 第三方媒体与名录的占比结构。
回答的问题:你的引用是「自己说自己」,还是有外部证据。
为什么关键:信源结构是唯一能提前动手的领先指标。提及率是结果,信源占比是原因。

指标 5:AI 引荐流量与询盘(AI Referral)

口径:来自 AI 入口的会话数与有效询盘数。
回答的问题:GEO 有没有带来生意。
注意:目前 AI 入口的 referrer 大量丢失(用户在 AI 应用内点开链接,跳转时常检测不到来源),所以这一项只能作为参考下限,不能作为唯一依据(下文第七条给替代口径)。

三、怎么采样才可信:方法学比指标更重要

同一套指标,采样方法不同,结论可以差出一倍。经过越南市场的实际项目,我们固定了如下采样纪律:

记录字段示例
采样日期 / 引擎2026-09-14 / ChatGPT
query(含语种)越南胡志明市注塑件供应商推荐(中文)
是否提及品牌是(3 次采样中 2 次)
提及位置第 2 位
描述是否准确准确(业务、主体、地区均正确)
引用信源域名自有站 / 越南本地名录 / 行业媒体
竞品提及A、C 被提及
一条纪律:没有数据就留空,不要填估算值。一份有 3 项空白的真实报表,远比一份全部填满但来源不明的报表可信——这是任何时候都不能破的底线。

四、声量份额怎么算(含计算示例)

举一个 10 条 query 的简化示例(示例用于说明算法,不是行业标准值):

品牌被提及 query 数声量份额 SoAV
本品牌440%
竞品 A330%
竞品 B220%
竞品 C110%

40% 说明「在采购意图最强的这 10 个问题里,AI 有 4 次把本品牌放进了候选名单」。这个数字比「排名第几」有意义得多,因为它直接对应「客户在决策起点看到了谁」。

实操上,我们把 SoAV 分成三段来读:10% 以下=在 AI 答案里基本缺席(最高优先级);10%-30%=被看见但不在首选池;30% 以上=进入首选池,此时的工作重点从「进入答案」转为「提升引用正确率与信源质量」。

五、ROI 归因的三条路径

路径 1:流量侧归因(作为下限)

给所有对外页面加统一 UTM 参数,在 GA4 或自建统计里把 AI 入口单独分组;对 referrer 丢失的会话,用「落地页首次访问 + 无搜索 referrer」做辅助识别。得到的是下限值,不是全量。

路径 2:询盘自报(作为主口径)

在表单与客服话术里固定一问:「您是从哪里了解到我们的?」选项中把「AI 搜索(ChatGPT / DeepSeek / 豆包等)」单列。这是当前最可靠的一手数据,因为它绕过了所有 referrer 丢失问题。中越跨境的询盘,建议同时记录来源语种——越南语询盘里 AI 提及的占比通常显著高于中文询盘。

路径 3:增量对照(作为验证)

两种可行设计:其一,同期对照——同一公司内做了 GEO 的产品线/市场与未做的做对比;其二,前后同比——改造前后各 90 天的询盘量与结构对比。前者更干净,后者更快出结果。

不要做的归因:把品牌百度/Google 自然流量的自然增长、或行业旺季带来的询盘增长,整体算成 GEO 的功劳。归因报告的口径一定要能被客户复核,否则第一次复审就会失去信任。

六、汇报节奏与一页纸模板

一页纸结构推荐固定为四格:现状(基线)→ 目标 → 差距(哪个 query、哪个引擎没拿到)→ 本周期动作。四格写不满,说明这周的采样没做到位。

七、四个必须避开的统计陷阱

八、90 天基准表与验收标准

阶段核心动作验收物
第 1-30 天基线采样(5 指标全量跑一遍)+ 主体信息与结构化数据改造基线报告:提及率 / 正确率 / SoAV 三条起跑线
第 31-60 天本地信源建设 + 越南语内容补位(不是机翻)+ 错误引用修正信源占比结构变化 + 正确率提升记录
第 61-90 天效果复盘 + 扩量(把有效的 query 类别复制到新市场/新产品线)三条曲线均有基线对比 + 询盘自报数据

验收原则:任何一条指标都要能回答「跟 30 天前比、跟竞品比、这个数字是怎么采出来的」。答不上来,就不能算交付。

10 项度量自查清单:
  • ☐ 1. 有一份固定的 20-30 条 query 清单(含语种与写法规格)
  • ☐ 2. 采样覆盖 ≥4 个 AI 引擎,每周同频次
  • ☐ 3. 记录了原始回答文本,而非只有结论
  • ☐ 4. 品牌提及率、引用正确率、SoAV 三项均有基线值
  • ☐ 5. 竞品集合已固定并写明版本
  • ☐ 6. 「提及」与「引用」分开统计
  • ☐ 7. 信源占比按自有 / 本地 / 第三方分类
  • ☐ 8. 表单与话术里有「从哪里了解到我们」这一问题项
  • ☐ 9. 对外报告标注样本量、采样时间与引擎版本
  • ☐ 10. 无数据项留空,不填估算值

九、越智通中越 GEO 能做什么

越智通 GEO 的定位是技术同源、场景异质——平台能力与国内头部 GEO 服务商同源,但专攻中国—越南这条跨境走廊:中文与越南语双引擎的采样清单、跨引擎引用监测、本地信源建设,以及中越双主体(中国鼎麦 / 越南 VIETTRITHONG)的主体信息一致性工程。

你的品牌在 AI 答案里被正确引用了吗?

30 秒填表,24 小时内免费获取《AI 可见性诊断报告》

免费领取诊断报告 →

被 AI 理解,即是被世界看见

📎 数据来源:
• Gartner. (2024). Predicts 2026: Search Traffic Decline Due to AI. February 2024.(2026 年传统搜索流量下降 25%)
• Bain & Company. Consumer Search Behavior Study.(80% 消费者至少 40% 搜索依赖 AI 结果)
• 艾媒咨询. (2026). 中国生成式引擎优化(GEO)行业研究报告. 2026年2月.(2025 年 349.3 亿元 → 2026 年预计 942 亿元)
• Technode. (2025). ChatGPT Adoption in Vietnam. August 2025.(越南 ChatGPT 覆盖率 81%)
• 台湾外贸协会. 越南 AI 采用率调研.(23.5%,全球第 38 位)
• 声量份额(SoAV)计算示例为本文算法演示,非行业标准值。