2026 年上半场,AI 搜索这块地形的变化不是「多了一个入口」,而是默认入口被换掉了。对品牌来说,这意味着两件事同时发生:你被用户「看到」的位置从蓝色链接挪进了答案正文;而决定谁被写进答案的那套机器,正在被平台一次次悄悄升级。
这篇文章做两件事:先把平台侧的关键变化摆清楚(每条都有出处),再把我们在同一时间窗口里观察到的一手数据摊开——9 天 76,473 条有效服务器日志里,搜索型 AI 爬虫的行为恰好在这个窗口里发生了一次明显跃迁。
一、变化一:Google 把搜索框重做了,25 年来第一次
2026 年 5 月 19 日,Google 在 I/O 大会上把搜索框改成了「提问框」:输入框会随查询变长而自动扩展,除了文字,还能接收图片、文件、视频和已打开的 Chrome 标签页——Google 称这是搜索框 25 年来最大的一次改版。同一场发布会上,AI Mode 的默认模型换成 Gemini 3.5 Flash,官方口径的 AI Mode 月活突破 10 亿、AI Overviews 达到 25 亿。
为什么这条对品牌重要:当用户的「查询」可以是一张产品照片、一份 PDF、或几个已经打开的网页时,「能被 AI 读到」就不只是「网页能不能被爬」,而是「你站点上的信息能不能被当成上下文,塞进提问里」。SEO 时代我们优化关键词,现在多了一层——你的站点要能被机器当作「材料」使用。
二、变化二:AI 答案的「大脑」换了,而且不发公告
同一场 I/O 上更值得记录的细节是:对外产品名没变,里面的推理层换了。Google 在 2025 年 12 月把 Gemini 3 Flash 设为 AI Mode 的全局默认,2026 年 5 月又换成 Gemini 3.5 Flash。用户界面看不出区别,但「哪条来源会被拿去拼答案」,正是由这一层在做。
对品牌的直接含义:AI 可见度不是一次优化、长期有效的静态排名,而是一个会随模型换代而漂移的量。这也是我们把「按月复测」列为 GEO 常规动作、而不是一年做一次项目的原因。
三、变化三:中国侧的量级——AI 原生 App 月活 4.99 亿
把视线拉回中国。QuestMobile 在 2026 年 7 月发布的《2026 年上半年 AI 应用市场发展洞察报告》给出这样一组量级:截至 2026 年 5 月,AI 原生 App 月活跃用户规模达 4.99 亿,同比增长 85.4%,是增速最快的终端渠道。头部三席分别是:
| 应用 | 月活(2026-05 口径) | 赛道归属 |
|---|---|---|
| 豆包 | 3.82 亿 | AI 综合助手 |
| 千问 | 1.67 亿 | AI 综合助手 |
| DeepSeek | 1.30 亿 | AI 搜索引擎 |
| AI 原生 App 整体 | 4.99 亿(同比 +85.4%) | 多终端、未去重 |
读法:这已经不是「尝鲜工具」的规模。当一个 4.99 亿月活的入口同时承担「问答 + 推荐 + 引导购物」时,品牌的默认曝光位从搜索结果页第一屏,挪进了对话流里的那一段文字。
⚠️ 口径提示:QuestMobile 的月活是第三方测算(多终端、未去重),与本文使用的另外四条市场口径属不同来源,请勿混用对比。
四、变化四:答案面从「一个」变成「很多个」
第三个结构性变化是分散。品牌过去只需要盯一个搜索引擎,现在要面对的是:中国侧的 DeepSeek、豆包、Kimi、元宝,海外侧的 ChatGPT Search、Google AI Mode、Perplexity、Gemini、Copilot。各家的检索策略、引用偏好与答案组织方式都不一样。
| 引擎 | 公开可查的引用/检索特征 | 对品牌的含义 |
|---|---|---|
| Google AI Mode / AI Overviews | 建立在 Google 既有索引之上;AI Mode 的查询通常比传统查询更长 | 传统排名仍有基础作用,但只做 SEO 不够 |
| ChatGPT Search | 检索与对话合并,答案中的引用链接数量相对更少 | 内容要「易被摘要」,不是「字数多」 |
| Perplexity | 引用优先,答必附源,检索型爬虫与训练型分开声明 | 结构化、可溯源的页面占优 |
| 豆包 / DeepSeek / Kimi | 中国侧主要入口,月活量级见上表 | 中文内容与中文信源的权重更高 |
分散化有一个容易踩的副作用:「我在某个引擎里被引用」不等于「我在 AI 里被引用」。这也是我们的监测坚持多引擎并行、而不是只测一个入口的原因。
五、落到越南:81% 覆盖率市场里的三个本地变量
越南是本文最关心的市场,因为它同时具备「AI 采用快」和「本地生态自成一体」两个特征。Technode 在 2025 年 8 月的口径是 ChatGPT 覆盖率 81%、付费率超半数。在此之上,还有三个不能忽略的本地变量:
- 本地搜索引擎仍在场。Cốc Cốc 是越南本土搜索入口,本地用户的查询习惯与语言细节(声调、口语化写法)会直接影响答案层的召回。
- 本土大模型。越南已有 Viettel、Vin 系、FPT 等本土模型与本地化路线,越南语内容的处理能力与英文并不完全对等——「翻译过来的英文内容」未必拿到同等可见度。
- 法规环境。越南《人工智能法》已进入实施阶段,对 AI 系统的透明度与责任有明确要求。这对品牌既是约束也是机会:能证明「我的品牌信息在 AI 答案里是准确的」,本身就是一个可用的合规叙事。
六、一手观察:9 天 76,473 条日志里,搜索型 AI 爬虫完成了一次跃迁
上面是公开信息,下面是我们可以负责的部分——yuezhitong.com/geo/ 站点的 nginx 全量日志。取窗口 2026-09-23 03:32 至 2026-10-02 02:02(9 个日志文件,剔除内网健康检查后共 76,473 条有效请求)。爬虫身份按 UA 声明分类,请求数如下:
| 爬虫(UA 声明) | 请求数 | 命中路径重点 | 状态码分布 |
|---|---|---|---|
| Googlebot(传统搜索) | 1,374 | 中文文章 439 / 越南语文章 392 / 产业报告 253 | 200 为主 |
| GPTBot(训练) | 1,199 | 中文文章 447 / 越南语文章 400 / 产业报告 261 | 200 共 1,197 |
| OAI-SearchBot(ChatGPT 搜索) | 1,140 | 中文文章 439 / 越南语文章 392 / 产业报告 253 | 200 共 1,140 |
| PerplexityBot | 1,104 | 与搜索类同批抓取 | 200 共 1,104 |
| Claude-SearchBot | 1,101 | 与搜索类同批抓取 | 200 共 1,101 |
| meta-externalagent | 258 | 杂路径为主,含配置/凭证扫描 | 404 占 91 |
| ClaudeBot(训练) | 116 | robots.txt 50 / sitemap 50 | 200 |
| ChatGPT-User(用户触发) | 6 | 首页 4 | 200 |
真正的发现在时间分布里。把三个「搜索型」爬虫按天拆开:
| 日期 | OAI-SearchBot | PerplexityBot | Claude-SearchBot | Googlebot(对照) |
|---|---|---|---|---|
| 09-23 | 6 | 0 | 0 | 21 |
| 09-24 | 6 | 0 | 0 | 27 |
| 09-25 | 5 | 0 | 0 | 30 |
| 09-26 | 3 | 0 | 0 | 36 |
| 09-27 | 338 | 335 | 335 | 366 |
| 09-28 | 115 | 110 | 110 | 147 |
| 09-29 | 531 | 528 | 528 | 565 |
| 09-30 | 128 | 125 | 122 | 167 |
9 月 23–26 日这四天,OAI-SearchBot / PerplexityBot / Claude-SearchBot 只读 robots.txt,正文一次都没抓;9 月 27 日起,三家同时开始成批抓取正文,四天内每家把全站 1,101 个 URL 走了一遍(中文文章 439 + 越南语文章 392 + 产业报告 253 + 其他 17),且 200 占比 100%。作为对照,同一时期这四条路径集合也是 Googlebot 的抓取重点。
必须说清楚:这不能证明因果。9 月 27 日恰好是我们给全站补齐 JSON-LD 结构化数据、并把 4 个机器可读端点(ai.txt / summary.json / faq.json / service.json)上线的那一天。时间点接近,但一次观测不足以断言「是这些动作把搜索型爬虫招来的」。我们把它记下来,是因为这个窗口本身就是证据:爬虫行为会突变,而且可以在两天内发生。
七、品牌现在该做的五件事
- 先把「可被抓」补上。检索型与训练型 AI 爬虫是独立声明的 UA——放行检索型(OAI-SearchBot、PerplexityBot、Claude-SearchBot 等)与放行训练型(GPTBot、ClaudeBot、CCBot 等)是两件事。很多站点只想关掉后者,却顺手把前者一起关了。
- 别只做 SEO 排名。答案层引用的来源与搜索结果前十名,不是同一套名单;把排名当成唯一 KPI,会看不到自己在答案里的缺席。
- 给机器准备「材料」。llms.txt、ai.txt、summary.json、faq.json 这类文件的作用,是让引擎不用猜你的站点在讲什么。我们自己的站点补齐这一层后,6 分的「AI 发现端点」维度从 0 拿到满分。
- 结构化数据落到实体。JSON-LD 里写清组织名、品牌名、页面与组织的归属关系——AI 判断「这句话是谁说的」靠的就是这些标注。
- 按月复测,不要一次交付。模型换代、爬虫行为突变、平台改版,都会让上个月的可见度结论过期。
八、方法论与口径
本文数据分两类,请分开读。市场口径来自 Gartner(2024-02)、Bain、艾媒咨询(2026-02)、Technode(2025-08),以及 Google I/O 2026(2026-05-19)官方发布与 QuestMobile《2026 年上半年 AI 应用市场发展洞察报告》(2026-07-14,数据截至 2026-05)。站点数据来自我们对 yuezhitong.com/geo/ 的 nginx 全量日志统计:窗口 2026-09-23 03:32 至 2026-10-02 02:02,9 个日志文件,剔除内网健康检查后有效请求 76,473 条;爬虫身份按 UA 声明分类(未做反向 DNS 核验,厂商 IP 段会变动,因此只呈现窗口内特征,不外推为行业比例)。
窗口内包含 2026-09-30 20:38 至 10-01 上午约 14 小时的站点中断,会拉低当日基数,日均值不可直接外推;这也是本文只给窗口内计数、不给「日均增长」结论的原因。