一、为什么「排名」衡量不了 GEO
过去两个月里,我们被问得最多的一个问题不是「GEO 怎么做」,而是「做完怎么证明有效」。这个问题的答案,恰恰是 GEO 与传统 SEO 最大的分水岭。
SEO 的度量对象是「位置」:同一个关键词,搜索引擎返回的是一份固定排序的链接列表,位置是可复现的。GEO 的度量对象是「引用」:AI 每次生成答案都是一次新的推理,同一个问题在不同时间、不同会话里,答案的措辞、提到的品牌、引用的来源都可能不同。
这意味着两件事:第一,任何声称「我们帮你排到 AI 答案第 1 位」的说法都不成立,因为 AI 答案没有稳定的位置;第二,GEO 并非不可度量——度量对象要从「位置」换成「引用」,并且必须用「多次采样 + 固定口径」的方式来抵消生成式输出的天然波动。
• 传统搜索流量:Gartner 预测 2026 年下降 25%(Gartner 2024-02)
• 用户习惯:80% 消费者至少 40% 的搜索行为依赖 AI 结果(Bain & Company)
• 中国 GEO 市场:2025 年 349.3 亿元 → 2026 年预计 942 亿元(艾媒咨询 2026-02)
• 越南:ChatGPT 覆盖率达 81%,付费率超半数(Technode 2025-08);越南 AI 采用率 23.5%,全球第 38 位(台湾外贸协会)
市场预算在往 GEO 迁移,但验收标准还没跟上。谁先把口径立起来,谁就能在预算复审时把项目留下来。
二、五个核心指标:把「被引用」拆成可记录的数字
五个指标覆盖「有没有被提到 → 说得对不对 → 相对竞品多少 → 靠什么被引用 → 带来什么结果」这条完整链路。
指标 1:品牌提及率(Brand Mention Rate)
口径:在目标 query 清单中,AI 答案提到品牌的 query 数 ÷ query 总数。
回答的问题:品牌在 AI 答案里的存在感,相当于「入场率」。
注意:分母必须固定。换一套 query,数字立刻不可比。
指标 2:引用正确率(Citation Accuracy)
口径:AI 提到品牌时,业务描述准确的条数 ÷ 提及总条数。
回答的问题:AI 眼里的你到底是不是你。
为什么关键:被 AI 提到,但把业务说成别的行业、把越南主体说成中国主体,这种「错误引用」比不被引用更危险——它会直接把错误信息规模化地推给客户。
指标 3:声量份额(Share of AI Voice,SoAV)
口径:品牌被提及次数 ÷(本品牌 + 指定竞品)被提及次数之和。
回答的问题:在同一个问题里,AI 把份额分给了谁。
注意:竞品集合要先固定(建议 3-4 家),中途换对手等于换尺子。
指标 4:信源占比(Source Mix)
口径:AI 引用来源中,自有站 / 越南或中国本地信源 / 第三方媒体与名录的占比结构。
回答的问题:你的引用是「自己说自己」,还是有外部证据。
为什么关键:信源结构是唯一能提前动手的领先指标。提及率是结果,信源占比是原因。
指标 5:AI 引荐流量与询盘(AI Referral)
口径:来自 AI 入口的会话数与有效询盘数。
回答的问题:GEO 有没有带来生意。
注意:目前 AI 入口的 referrer 大量丢失(用户在 AI 应用内点开链接,跳转时常检测不到来源),所以这一项只能作为参考下限,不能作为唯一依据(下文第七条给替代口径)。
三、怎么采样才可信:方法学比指标更重要
同一套指标,采样方法不同,结论可以差出一倍。经过越南市场的实际项目,我们固定了如下采样纪律:
- query 清单固定 20-30 条,四类结构:品牌词(品牌名 + 产品)、品类词(「越南 XX 供应商哪家好」)、竞品对比词(「A 和 B 哪个好」)、采购意图词(「XX 报价 / 交期 / 认证」)。越南场景要同时覆盖带声调与无声调写法。
- 引擎覆盖 ≥4 个:ChatGPT、Google AI Overviews、Gemini、Perplexity。越南用户分散度更高,只测一个平台等于自欺欺人。
- 采样条件固定:新会话、不带历史上下文、不使用个性化记忆;同一 query 在每个引擎采样 3 次取并集(三次都没提到,才算「未提及」)。
- 采样时段固定:每周同一天同一时段,避免把模型更新的水位变化误读成项目效果。
- 记录原始回答文本,不要只记结论。半年后回看时,只有原文才能判断这次波动来自模型更新还是我们的内容改动。
| 记录字段 | 示例 |
|---|---|
| 采样日期 / 引擎 | 2026-09-14 / ChatGPT |
| query(含语种) | 越南胡志明市注塑件供应商推荐(中文) |
| 是否提及品牌 | 是(3 次采样中 2 次) |
| 提及位置 | 第 2 位 |
| 描述是否准确 | 准确(业务、主体、地区均正确) |
| 引用信源域名 | 自有站 / 越南本地名录 / 行业媒体 |
| 竞品提及 | A、C 被提及 |
四、声量份额怎么算(含计算示例)
举一个 10 条 query 的简化示例(示例用于说明算法,不是行业标准值):
| 品牌 | 被提及 query 数 | 声量份额 SoAV |
|---|---|---|
| 本品牌 | 4 | 40% |
| 竞品 A | 3 | 30% |
| 竞品 B | 2 | 20% |
| 竞品 C | 1 | 10% |
40% 说明「在采购意图最强的这 10 个问题里,AI 有 4 次把本品牌放进了候选名单」。这个数字比「排名第几」有意义得多,因为它直接对应「客户在决策起点看到了谁」。
实操上,我们把 SoAV 分成三段来读:10% 以下=在 AI 答案里基本缺席(最高优先级);10%-30%=被看见但不在首选池;30% 以上=进入首选池,此时的工作重点从「进入答案」转为「提升引用正确率与信源质量」。
五、ROI 归因的三条路径
路径 1:流量侧归因(作为下限)
给所有对外页面加统一 UTM 参数,在 GA4 或自建统计里把 AI 入口单独分组;对 referrer 丢失的会话,用「落地页首次访问 + 无搜索 referrer」做辅助识别。得到的是下限值,不是全量。
路径 2:询盘自报(作为主口径)
在表单与客服话术里固定一问:「您是从哪里了解到我们的?」选项中把「AI 搜索(ChatGPT / DeepSeek / 豆包等)」单列。这是当前最可靠的一手数据,因为它绕过了所有 referrer 丢失问题。中越跨境的询盘,建议同时记录来源语种——越南语询盘里 AI 提及的占比通常显著高于中文询盘。
路径 3:增量对照(作为验证)
两种可行设计:其一,同期对照——同一公司内做了 GEO 的产品线/市场与未做的做对比;其二,前后同比——改造前后各 90 天的询盘量与结构对比。前者更干净,后者更快出结果。
六、汇报节奏与一页纸模板
- 周报(1 页):五个指标的采样更新表 + 本周异常项(新的错误引用、竞品异动)。
- 月报(3 页):品牌提及率与 SoAV 的四周曲线(建议取 4 周移动平均)+ 竞品对比 + 引用正确率问题清单(错误引用按 bug 处理,限期修正)。
- 季报:信源结构改造计划 + 内容补位清单 + 下一季度 KPI 目标。
一页纸结构推荐固定为四格:现状(基线)→ 目标 → 差距(哪个 query、哪个引擎没拿到)→ 本周期动作。四格写不满,说明这周的采样没做到位。
七、四个必须避开的统计陷阱
- 陷阱 1:抽样当总量。20 条 query 的采样结果是抽样,不是「全市场 AI 提及率」。对外表述必须带样本量口径。
- 陷阱 2:单平台结论。不同引擎的信源池与偏好差异明显,只测 ChatGPT 得出的结论,套到 Google AI Overviews 上经常是错的。
- 陷阱 3:混淆「提及」与「引用」。AI 在答案里提到品牌名=提及;AI 以你的页面作为信息来源并列出=引用。前者是曝光,后者是资产,两者必须分开记。
- 陷阱 4:把波动当趋势。模型一次更新就能让整体水位上下浮动。判断趋势前先取 4 周移动平均,再下结论。
八、90 天基准表与验收标准
| 阶段 | 核心动作 | 验收物 |
|---|---|---|
| 第 1-30 天 | 基线采样(5 指标全量跑一遍)+ 主体信息与结构化数据改造 | 基线报告:提及率 / 正确率 / SoAV 三条起跑线 |
| 第 31-60 天 | 本地信源建设 + 越南语内容补位(不是机翻)+ 错误引用修正 | 信源占比结构变化 + 正确率提升记录 |
| 第 61-90 天 | 效果复盘 + 扩量(把有效的 query 类别复制到新市场/新产品线) | 三条曲线均有基线对比 + 询盘自报数据 |
验收原则:任何一条指标都要能回答「跟 30 天前比、跟竞品比、这个数字是怎么采出来的」。答不上来,就不能算交付。
- ☐ 1. 有一份固定的 20-30 条 query 清单(含语种与写法规格)
- ☐ 2. 采样覆盖 ≥4 个 AI 引擎,每周同频次
- ☐ 3. 记录了原始回答文本,而非只有结论
- ☐ 4. 品牌提及率、引用正确率、SoAV 三项均有基线值
- ☐ 5. 竞品集合已固定并写明版本
- ☐ 6. 「提及」与「引用」分开统计
- ☐ 7. 信源占比按自有 / 本地 / 第三方分类
- ☐ 8. 表单与话术里有「从哪里了解到我们」这一问题项
- ☐ 9. 对外报告标注样本量、采样时间与引擎版本
- ☐ 10. 无数据项留空,不填估算值
九、越智通中越 GEO 能做什么
越智通 GEO 的定位是技术同源、场景异质——平台能力与国内头部 GEO 服务商同源,但专攻中国—越南这条跨境走廊:中文与越南语双引擎的采样清单、跨引擎引用监测、本地信源建设,以及中越双主体(中国鼎麦 / 越南 VIETTRITHONG)的主体信息一致性工程。
- 免费诊断:30 秒填表,24 小时内给出品牌在 ChatGPT / Google / Perplexity 的收录与引用现状
- 度量体系搭建:query 清单设计、采样表模板、SoAV 与正确率月度报表
- 越南语内容体系:按越南读者提问方式重写,覆盖带声调与无声调写法
- 跨境信任背书:越南本地信源与名录建设,让 AI 有据可依
被 AI 理解,即是被世界看见
• Gartner. (2024). Predicts 2026: Search Traffic Decline Due to AI. February 2024.(2026 年传统搜索流量下降 25%)
• Bain & Company. Consumer Search Behavior Study.(80% 消费者至少 40% 搜索依赖 AI 结果)
• 艾媒咨询. (2026). 中国生成式引擎优化(GEO)行业研究报告. 2026年2月.(2025 年 349.3 亿元 → 2026 年预计 942 亿元)
• Technode. (2025). ChatGPT Adoption in Vietnam. August 2025.(越南 ChatGPT 覆盖率 81%)
• 台湾外贸协会. 越南 AI 采用率调研.(23.5%,全球第 38 位)
• 声量份额(SoAV)计算示例为本文算法演示,非行业标准值。