Trong nửa đầu năm 2026, thay đổi lớn nhất của bản đồ tìm kiếm AI không phải là "có thêm một cửa vào mới", mà là cửa vào mặc định đã bị thay. Với thương hiệu, điều đó có nghĩa hai việc xảy ra cùng lúc: vị trí bạn được người dùng "nhìn thấy" đã dịch từ danh sách liên kết xanh sang phần thân của câu trả lời; và cỗ máy quyết định ai được viết vào câu trả lời đang được các nền tảng nâng cấp âm thầm theo từng đợt.

Bài này làm hai việc: trước hết dựng lại rõ những thay đổi phía nền tảng (mỗi mục đều có nguồn), sau đó trải ra dữ liệu gốc mà chúng tôi tự quan sát được trong cùng khoảng thời gian — trong 76.473 yêu cầu hợp lệ thu thập từ log máy chủ trong 9 ngày, hành vi của các crawler AI dạng tìm kiếm vừa có một bước nhảy rõ rệt.

📊 Bốn mốc số liệu đối ngoại được dùng trong bài (tổ chức + năm)
• Tìm kiếm truyền thống suy giảm: Gartner (2024-02) — lượng tìm kiếm truyền thống giảm 25% vào 2026
• Thói quen người dùng: Bain — 80% người tiêu dùng dùng AI cho ít nhất 40% nhu cầu tìm kiếm
• Thị trường GEO Trung Quốc: iiMedia Research (2026-02) — 349,3 tỷ CNY năm 2025 → dự kiến 942 tỷ CNY năm 2026
• Mức phủ AI tại Việt Nam: Technode (2025-08) — tỷ lệ phủ ChatGPT 81%, hơn một nửa đã trả phí
• Dữ liệu gốc: log nginx toàn bộ của site — cửa sổ 2026-09-23 đến 2026-10-02, 76.473 yêu cầu hợp lệ

Một, Google làm lại hộp tìm kiếm lần đầu sau 25 năm

Ngày 19-05-2026, tại hội nghị I/O, Google biến hộp tìm kiếm thành "hộp đặt câu hỏi": ô nhập tự giãn ra khi câu hỏi dài, và ngoài văn bản còn nhận hình ảnh, tệp, video và cả các thẻ Chrome đang mở — Google gọi đây là lần nâng cấp lớn nhất của hộp tìm kiếm trong hơn 25 năm. Cùng sự kiện, model mặc định của AI Mode được đổi sang Gemini 3.5 Flash; theo con số chính thức của Google, AI Mode vượt 1 tỷ người dùng hàng tháng, AI Overviews đạt 2,5 tỷ.

Vì sao điều này quan trọng với thương hiệu: khi "truy vấn" của người dùng có thể là một tấm ảnh sản phẩm, một tệp PDF hay vài trang web đang mở, thì "được AI đọc tới" không còn chỉ là "trang có bị crawler đọc hay không", mà là "thông tin trên site của bạn có được dùng làm ngữ cảnh để đưa vào câu hỏi hay không". Thời SEO tối ưu từ khóa; nay có thêm một lớp — site của bạn phải được máy dùng như "nguyên liệu".

Hai, "bộ não" của câu trả lời AI đã đổi mà không thông báo

Chi tiết đáng ghi lại hơn ở cùng kỳ I/O: tên sản phẩm đối ngoại không đổi, nhưng lớp suy luận bên trong đã thay. Tháng 12-2025 Google đặt Gemini 3 Flash làm mặc định toàn cầu cho AI Mode; đến tháng 5-2026 lại đổi sang Gemini 3.5 Flash. Người dùng không thấy khác biệt trên giao diện, nhưng "nguồn nào được lấy để ghép câu trả lời" chính là do lớp này quyết định.

Hàm ý trực tiếp cho thương hiệu: hiện diện trong AI không phải một thứ hạng tĩnh, tối ưu một lần là xong, mà là một đại lượng trôi theo từng thế hệ model. Đó cũng là lý do chúng tôi đặt "đo lại hàng tháng" vào quy trình GEO thường kỳ, thay vì làm dự án mỗi năm một lần.

Ba, quy mô phía Trung Quốc: ứng dụng AI gốc đạt 499 triệu MAU

Nhìn về Trung Quốc. Báo cáo "Triển vọng thị trường ứng dụng AI nửa đầu 2026" do QuestMobile công bố tháng 7-2026 cho biết: tính đến tháng 5-2026, quy mô người dùng hoạt động hàng tháng của ứng dụng AI gốc đạt 499 triệu, tăng 85,4% so với cùng kỳ — kênh tăng trưởng nhanh nhất. Ba vị trí dẫn đầu:

Ứng dụngMAU (số liệu 2026-05)Nhóm
Doubao382 triệuTrợ lý AI tổng hợp
Qianwen167 triệuTrợ lý AI tổng hợp
DeepSeek130 triệuCông cụ tìm kiếm AI
Toàn bộ ứng dụng AI gốc499 triệu (+85,4% so với cùng kỳ)Đa thiết bị, chưa khử trùng lặp

Cách đọc: đây không còn là quy mô của một công cụ "dùng thử". Khi một cửa vào 499 triệu MAU đồng thời gánh "hỏi đáp + gợi ý + dẫn tới mua hàng", vị trí hiển thị mặc định của thương hiệu đã dịch từ màn hình đầu của trang kết quả sang một đoạn văn trong luồng hội thoại.

⚠️ Lưu ý về cách đo: MAU của QuestMobile là số liệu bên thứ ba (đa thiết bị, chưa khử trùng lặp), khác nguồn với bốn mốc còn lại trong bài — không dùng để so trực tiếp.

Bốn, bề mặt câu trả lời từ "một" thành "nhiều"

Thay đổi cấu trúc thứ ba là sự phân tán. Trước đây thương hiệu chỉ cần nhìn một công cụ tìm kiếm; nay phải đối diện với: phía Trung Quốc có DeepSeek, Doubao, Kimi, Yuanbao; phía quốc tế có ChatGPT Search, Google AI Mode, Perplexity, Gemini, Copilot. Mỗi nền tảng có chiến lược truy xuất, sở thích trích dẫn và cách tổ chức câu trả lời khác nhau.

Nền tảngĐặc điểm truy xuất/trích dẫn (công khai)Hàm ý cho thương hiệu
Google AI Mode / AI OverviewsDựa trên chỉ mục sẵn có của Google; truy vấn trên AI Mode thường dài hơn truy vấn truyền thốngThứ hạng truyền thống vẫn có tác dụng nền, nhưng chỉ làm SEO là chưa đủ
ChatGPT SearchGộp truy xuất vào hội thoại, số liên kết trích dẫn trong câu trả lời ít hơnNội dung phải "dễ được tóm tắt", không phải "càng dài càng tốt"
PerplexityƯu tiên trích dẫn, trả lời luôn kèm nguồn; khai báo tách crawler tìm kiếm và crawler huấn luyệnTrang có cấu trúc rõ và nguồn kiểm chứng được sẽ chiếm ưu thế
Doubao / DeepSeek / KimiCửa vào chính phía Trung Quốc, quy mô MAU xem bảng trênTrọng số cho nội dung và nguồn tiếng Trung cao hơn

Một tác dụng phụ dễ vấp: "tôi được trích dẫn trên một engine" không đồng nghĩa với "tôi hiện diện trong AI". Vì vậy hệ thống theo dõi của chúng tôi chạy song song nhiều engine thay vì chỉ đo một cửa vào.

Năm, nhìn về Việt Nam: ba biến số bản địa trong một thị trường có mức phủ 81%

Việt Nam là thị trường bài này quan tâm nhất, vì hội đủ hai đặc điểm: "AI được tiếp nhận nhanh" và "hệ sinh thái bản địa tự thành một khối". Số liệu tháng 8-2025 của Technode: tỷ lệ phủ ChatGPT 81%, hơn một nửa người dùng đã trả phí. Trên nền đó còn ba biến số bản địa không thể bỏ qua:

  1. Công cụ tìm kiếm nội địa vẫn hiện diện. Cốc Cốc là cửa vào tìm kiếm bản địa của Việt Nam; thói quen truy vấn và chi tiết ngôn ngữ (dấu thanh, cách viết khẩu ngữ) ảnh hưởng trực tiếp tới khả năng truy hồi của lớp trả lời.
  2. Model bản địa. Việt Nam đã có các model và hướng bản địa hóa của Viettel, nhóm Vin, FPT; năng lực xử lý tiếng Việt không hoàn toàn tương đương tiếng Anh — nội dung "dịch lại từ tiếng Anh" không chắc đạt cùng mức hiện diện.
  3. Môi trường pháp lý. Luật Trí tuệ nhân tạo của Việt Nam đã bước vào giai đoạn thi hành, có yêu cầu rõ về tính minh bạch và trách nhiệm của hệ thống AI. Với thương hiệu, đây vừa là ràng buộc vừa là cơ hội: chứng minh được "thông tin thương hiệu của tôi trong câu trả lời AI là chính xác" tự nó đã là một câu chuyện tuân thủ có thể dùng được.

Sáu, quan sát gốc: trong 9 ngày và 76.473 dòng log, crawler AI dạng tìm kiếm đã có một bước nhảy

Phần trên là thông tin công khai; phần dưới là phần chúng tôi tự chịu trách nhiệm — log nginx toàn bộ của site yuezhitong.com/geo/. Cửa sổ đo 2026-09-23 03:32 đến 2026-10-02 02:02 (9 tệp log; sau khi loại bỏ kiểm tra sức khỏe nội bộ còn 76.473 yêu cầu hợp lệ). Danh tính crawler phân loại theo khai báo UA:

Crawler (theo UA)Số yêu cầuĐường dẫn trọng tâmMã trạng thái
Googlebot (tìm kiếm truyền thống)1.374Bài tiếng Trung 439 / bài tiếng Việt 392 / báo cáo ngành 253Chủ yếu 200
GPTBot (huấn luyện)1.199Bài tiếng Trung 447 / bài tiếng Việt 400 / báo cáo ngành 261200: 1.197
OAI-SearchBot (tìm kiếm ChatGPT)1.140Bài tiếng Trung 439 / bài tiếng Việt 392 / báo cáo ngành 253200: 1.140
PerplexityBot1.104Cùng đợt với nhóm tìm kiếm200: 1.104
Claude-SearchBot1.101Cùng đợt với nhóm tìm kiếm200: 1.101
meta-externalagent258Chủ yếu đường dẫn linh tinh, có quét tệp cấu hình/thông tin xác thực404: 91
ClaudeBot (huấn luyện)116robots.txt 50 / sitemap 50200
ChatGPT-User (do người dùng kích hoạt)6Trang chủ 4200

Phát hiện thật nằm ở phân bố theo ngày. Tách ba crawler "dạng tìm kiếm" ra theo từng ngày:

NgàyOAI-SearchBotPerplexityBotClaude-SearchBotGooglebot (đối chứng)
23-0960021
24-0960027
25-0950030
26-0930036
27-09338335335366
28-09115110110147
29-09531528528565
30-09128125122167

Bốn ngày 23 đến 26-09, OAI-SearchBot / PerplexityBot / Claude-SearchBot chỉ đọc robots.txt, không lấy một dòng nội dung nào; từ 27-09, cả ba đồng loạt bắt đầu lấy nội dung theo đợt, và trong bốn ngày mỗi crawler đi hết 1.101 URL của toàn site (bài tiếng Trung 439 + bài tiếng Việt 392 + báo cáo ngành 253 + khác 17), với tỷ lệ mã 200 là 100%. Đối chứng: cùng tập đường dẫn đó cũng là trọng tâm thu thập của Googlebot trong kỳ.

Phải nói rõ: điều này không chứng minh quan hệ nhân quả. Ngày 27-09 đúng là ngày chúng tôi bổ sung JSON-LD cho toàn site và đưa 4 điểm cuối máy đọc (ai.txt / summary.json / faq.json / service.json) lên. Thời điểm gần nhau, nhưng một lần quan sát không đủ để khẳng định "chính các thao tác đó kéo crawler tìm kiếm tới". Chúng tôi ghi lại vì bản thân cửa sổ này là bằng chứng: hành vi crawler có thể đột biến, và đột biến trong vòng hai ngày.

Bảy, năm việc thương hiệu nên làm ngay

  1. Bù phần "được crawl" trước. Crawler tìm kiếm và crawler huấn luyện là hai UA khai báo độc lập — cho qua nhóm tìm kiếm (OAI-SearchBot, PerplexityBot, Claude-SearchBot…) và cho qua nhóm huấn luyện (GPTBot, ClaudeBot, CCBot…) là hai việc khác nhau. Nhiều site chỉ muốn chặn nhóm sau nhưng lại chặn luôn nhóm trước.
  2. Đừng chỉ làm thứ hạng SEO. Nguồn được lớp câu trả lời trích dẫn không cùng danh sách với top 10 kết quả tìm kiếm; lấy thứ hạng làm KPI duy nhất sẽ khiến bạn không thấy mình vắng mặt trong câu trả lời.
  3. Chuẩn bị "nguyên liệu" cho máy. llms.txt, ai.txt, summary.json, faq.json tồn tại để engine không phải đoán site của bạn nói về điều gì. Sau khi site chúng tôi bù lớp này, hạng mục 6 điểm "điểm khám phá AI" đi từ 0 lên điểm tối đa.
  4. Đưa dữ liệu có cấu trúc về tới thực thể. Trong JSON-LD cần ghi rõ tên tổ chức, tên thương hiệu, quan hệ giữa trang và tổ chức — AI dựa vào các nhãn này để biết "câu này do ai nói".
  5. Đo lại hàng tháng, đừng giao một lần. Đổi thế hệ model, crawler đột biến, nền tảng cải bản — đều làm kết luận về mức hiện diện của tháng trước hết hiệu lực.

Tám, phương pháp và cách đo

Dữ liệu trong bài chia hai loại, xin đọc tách rời. Mốc thị trường lấy từ Gartner (2024-02), Bain, iiMedia Research (2026-02), Technode (2025-08), cùng thông báo chính thức của Google I/O 2026 (19-05-2026) và báo cáo của QuestMobile công bố 14-07-2026 (số liệu tính đến 2026-05). Dữ liệu site lấy từ thống kê toàn bộ log nginx của yuezhitong.com/geo/: cửa sổ 2026-09-23 03:32 đến 2026-10-02 02:02, 9 tệp log, 76.473 yêu cầu hợp lệ sau khi loại bỏ kiểm tra sức khỏe nội bộ; danh tính crawler phân loại theo khai báo UA (chưa đối chiếu reverse DNS, dải IP của nhà cung cấp thay đổi theo thời gian, vì vậy bài chỉ trình bày đặc điểm trong cửa sổ này, không suy rộng thành tỷ lệ toàn ngành).

Cửa sổ đo có khoảng 14 giờ site bị gián đoạn (từ 20:38 ngày 30-09 đến sáng 01-10), làm hạ thấp nền của ngày đó; vì vậy bài chỉ đưa con số đếm trong cửa sổ, không đưa kết luận về "tăng trưởng bình quân ngày".