Hằng ngày chúng tôi đo cho khách hàng câu hỏi “thương hiệu của bạn có được AI nhắc đến không”, nhưng hiếm khi quay thước đo về phía mình. Lần này làm điều ngược lại: đưa toàn bộ 104 trang nội dung của site — 39 bài tiếng Trung, 39 bài tiếng Việt, 13 báo cáo ngành bản tiếng Trung và 13 bản tiếng Việt — qua công cụ audit AI Readiness do chúng tôi tự xây, để xem mình mất điểm ở hạng mục nào.
Kết quả phân hóa hơn dự kiến: trung bình 67,62/100, cao nhất 70, thấp nhất 57; mức good (từ 68 điểm) có 72 trang, mức foundation 32 trang. Đáng chú ý nhất là một hạng mục mang tính hệ thống: “điểm khám phá AI” bằng 0 trên cả 104 trang. Sau khi bổ sung 4 tệp máy đọc được (tổng 10.522 byte), đo lại: trung bình 73,72, cao nhất 76, 98/104 trang đạt good và không còn trang nào dưới 60 điểm.
• Đối tượng đo: 104 trang nội dung (52 trang tiếng Trung / 52 trang tiếng Việt)
• Cấu thành: 78 bài viết song ngữ (zh 39 + vi 39) + 26 báo cáo ngành (zh 13 + vi 13)
• Công cụ: engine 8 hạng mục, thang 0-100 (dựa trên dự án mã nguồn mở Auriti geo-optimizer-skill, giấy phép MIT)
• Trước khi sửa: thấp nhất 57 / trung bình 67,62 / trung vị 69 / cao nhất 70; 72 trang mức good
• Hạng mục mang tính toàn site: 5 hạng mục có điểm giống nhau trên mọi trang (trong đó “điểm khám phá AI” = 0 ở cả 104 trang)
• Hành động: bổ sung 4 tệp máy đọc được, tổng 10.522 byte
• Sau khi sửa: thấp nhất 63 / trung bình 73,72 / trung vị 75 / cao nhất 76; 98 trang mức good
• Trang dưới 60 điểm: 2 trang trước khi sửa → 0 trang sau khi sửa
Một, coi mình như khách hàng thứ 105: cách đo
Công cụ audit dùng đúng engine mà khách hàng thấy trên trang chẩn đoán: 8 hạng mục, thang 100 điểm. Trọng số giữa các hạng mục rất chênh lệch — nhóm cấu hình toàn site chiếm 64 điểm, nhóm nội dung theo từng trang chỉ chiếm 36 điểm. Tỷ lệ này quyết định nên sửa ở đâu trước.
| Hạng mục | Điểm tối đa | Đo điều gì |
|---|---|---|
| Bot AI truy cập (robots.txt) | 18 | Bot tìm kiếm AI có được cho phép rõ ràng |
| llms.txt | 18 | Có tệp chỉ mục dành cho AI và có cấu trúc đầy đủ |
| Dữ liệu có cấu trúc | 16 | Chú thích thực thể JSON-LD / Schema.org |
| Thẻ Meta | 14 | Tiêu đề, mô tả, canonical và các metadata nền tảng |
| Chất lượng nội dung | 12 | Độ dày và khả năng trích xuất của nội dung |
| Tín hiệu kỹ thuật | 6 | Các tín hiệu kỹ thuật ở cấp trang |
| Điểm khám phá AI | 6 | ai.txt / summary.json / faq.json / service.json |
| Thực thể thương hiệu | 10 | Tên thương hiệu có nhất quán giữa tiêu đề, H1 và dữ liệu có cấu trúc |
Cách đo được chọn ở đường “sạch” nhất: gọi API audit ngay trên máy chủ (127.0.0.1), bỏ qua bộ giới hạn tần suất bên ngoài, tránh việc trang của mình bị đo thành “không truy cập được”. Cả 104 trang đều có điểm, không trang nào bị bỏ qua do lỗi thu thập. Ngưỡng phân mức theo định nghĩa của engine: từ 68 điểm là mức good, dưới 68 điểm là mức foundation — trong lần đo này, mức good thấp nhất là 68 và mức foundation cao nhất là 67, khớp với ngưỡng.
Hai, kết quả vòng một: trung bình 67,62, hai trang dưới 60 điểm
Điểm tổng tập trung rất cao — 86 trong 104 trang nằm trong dải hẹp 65-69 điểm, cho thấy vấn đề không phải “nội dung chênh lệch” mà là cấu hình toàn site đang đặt trần cho tất cả các trang.
| Dải điểm | Số trang (trước khi sửa) | Số trang (sau khi sửa) |
|---|---|---|
| Từ 75 điểm | 0 | 68 |
| 70-74 điểm | 9 | 29 |
| 65-69 điểm | 86 | 6 |
| 60-64 điểm | 7 | 1 |
| Dưới 60 điểm | 2 | 0 |
Theo nhóm, có hai kết luận ngược trực giác: trang tiếng Việt (trung bình 68,3) cao hơn trang tiếng Trung (67,0), và 13 báo cáo ngành dài (69,0) cao hơn 78 bài viết thường (67,2). Nhóm thấp nhất là bài viết tiếng Trung (66,2). Ý nghĩa thực tiễn: “dịch” không làm mất điểm, nhưng “viết nhanh cho có” thì có.
| Nhóm | Số trang | TB trước khi sửa | TB sau khi sửa |
|---|---|---|---|
| Tiếng Trung · bài viết thường | 39 | 66,2 | 72,5 |
| Tiếng Việt · bài viết thường | 39 | 68,2 | 74,2 |
| Tiếng Trung · báo cáo ngành | 13 | 69,3 | 75,3 |
| Tiếng Việt · báo cáo ngành | 13 | 68,6 | 74,6 |
| Toàn bộ | 104 | 67,62 | 73,72 |
Ba, bảng 8 hạng mục: đâu là điểm mạnh, đâu là điểm 0
Lấy điểm trung bình từng hạng mục trên 104 trang. Cột “tỷ lệ đạt” cho biết luôn thứ tự nên sửa:
| Hạng mục | Tối đa | TB trước | Tỷ lệ đạt | TB sau |
|---|---|---|---|---|
| Chất lượng nội dung | 12 | 9,98 | 83,2% | 10,08 |
| Bot AI truy cập | 18 | 15,00 | 83,3% | 15,00 |
| Dữ liệu có cấu trúc | 16 | 13,00 | 81,2% | 13,00 |
| Thẻ Meta | 14 | 9,65 | 69,0% | 9,65 |
| llms.txt | 18 | 12,00 | 66,7% | 12,00 |
| Tín hiệu kỹ thuật | 6 | 4,00 | 66,7% | 4,00 |
| Thực thể thương hiệu | 10 | 4,89 | 48,9% | 4,89 |
| Điểm khám phá AI | 6 | 0,00 | 0,0% | 6,00 |
Ba điểm đáng nói. Thứ nhất, tỷ lệ 81,2% của dữ liệu có cấu trúc vừa mới được bù trong cùng ngày: trước đó cả 104 bài đều không có JSON-LD, hạng mục này là 0/16 và kéo toàn site xuống 45-53 điểm; sau khi bổ sung chú thích thực thể, chính những trang đó lên 57-70 điểm. Đây là lý do vì sao phải “sửa Schema trước, bàn nội dung sau”. Thứ hai, chất lượng nội dung đạt 83,2% nghĩa là nội dung không phải nút thắt. Thứ ba, thực thể thương hiệu chỉ 48,9% — yếu nhất trong nhóm theo-từng-trang, do tên thương hiệu chưa thật nhất quán giữa tiêu đề, H1 và dữ liệu có cấu trúc.
Bốn, hạng mục bằng 0 trên cả 104 trang: 4 tệp, 10.522 byte
“Điểm khám phá AI” đo 4 đường dẫn cố định dành cho máy. Trước khi sửa, chúng tôi giống phần lớn website doanh nghiệp — không có đường dẫn nào. Vì vậy cả 104 trang đều 0 điểm ở hạng mục này, mất trắng 6 điểm toàn site. Sau khi bổ sung, cả 104 trang đạt 6/6.
| Đường dẫn | Điều kiện engine kiểm tra | Nội dung chúng tôi bổ sung |
|---|---|---|
| /.well-known/ai.txt | HTTP 200 và không rỗng | Định vị site, tên thương hiệu để trích dẫn, danh sách điểm vào cho máy, tuyên bố thu thập và trích dẫn |
| /ai/summary.json | JSON hợp lệ, name ≥3 ký tự, description ≥20 ký tự | Tên thương hiệu (Trung/Việt), danh sách dịch vụ, trang trọng yếu, chủ thể công bố và mã số doanh nghiệp |
| /ai/faq.json | JSON hợp lệ, question ≥10 ký tự, answer ≥20 ký tự | 12 cặp hỏi đáp (song ngữ), kèm nguồn số liệu và lối vào chẩn đoán miễn phí |
| /ai/service.json | JSON hợp lệ, name ≥3 ký tự, capabilities là danh sách không rỗng | Danh sách năng lực dịch vụ, hợp đồng đầu vào/đầu ra của API audit |
Toàn bộ chi phí của 4 tệp này là 10.522 byte văn bản thuần, không một dòng nào dành cho khách truy cập. Lợi ích thì mang tính toàn site: mỗi trang trong 104 trang được cộng 6 điểm. Đây cũng là kết luận quan trọng nhất của lần đo: phải phân biệt “điểm cấp site” và “điểm cấp trang” trước khi quyết định sửa gì.
Năm, đo lại sau khi sửa: trung bình 73,72, 98/104 trang đạt good
Kết quả đo lại gần như trùng khớp dự đoán: 99 trang tăng đúng +6 điểm (đúng bằng lợi ích ròng của sửa cấp site), 4 trang +8 và 1 trang +9.
| Mức tăng | Số trang | Nguyên nhân |
|---|---|---|
| +6 | 99 | Lợi ích ròng của sửa cấp site (điểm khám phá AI 0→6) |
| +8 | 4 | +6 cấp site, cộng 2 điểm hạng mục nội dung được tính dư (do cách đo, xem bên dưới) |
| +9 | 1 | +6 cấp site, cộng 3 điểm hạng mục nội dung được tính dư (cùng cách đo) |
5 trang được cộng thêm 2-3 điểm cần nói rõ, vì đó là cách đo chứ không phải nội dung tốt lên: ở lần đo lại, các trang đã mang huy hiệu “AI Readiness của trang này”, và phần chữ giải thích của huy hiệu (khoảng 40 ký tự đọc được) bị engine tính vào độ dày nội dung. Sau khi phát hiện, chúng tôi không ghi nhận phần này như thành tích — một hệ thống chấm điểm không giải thích vì sao điểm thay đổi thì chỉ là hộp đen. Đó cũng là lý do bài viết này công bố toàn bộ yếu tố: thời điểm đo, hành động sửa, điểm tối đa từng hạng mục, ngưỡng phân mức.
Thay đổi về phân mức cho thấy quy mô của việc sửa: mức good từ 72 lên 98 trang, mức foundation từ 32 xuống 6 trang, và không còn trang nào dưới 60 điểm. 6 trang còn lại không phải “nội dung kém” mà là hai nhóm bài cũ (mỗi nhóm 4 bản Trung và Việt) chỉ đạt 5-7/14 điểm thẻ Meta — đây là danh sách cần sửa từng trang ở bước tiếp theo.
Sáu, điểm cấp site và điểm cấp trang: sửa một lần, lợi cả site
Chia 8 hạng mục theo tiêu chí “mọi trang có cùng điểm không”, kết luận rất rõ: 5 hạng mục giống nhau trên toàn site (bot AI, llms.txt, dữ liệu có cấu trúc, tín hiệu kỹ thuật, điểm khám phá AI — tức phần lớn của 64 điểm thuộc cấp site), 3 hạng mục dao động theo từng trang (Meta 14 + nội dung 12 + thực thể thương hiệu 10 = 36 điểm). Việc 86/104 trang chen trong dải 65-69 điểm chính là hệ quả của trần cấp site.
Trong nhóm cấp trang, yếu nhất là 8 trang chỉ đạt 5-7 điểm Meta (hai bản Trung và Việt của cùng một nhóm bài “cập nhật dữ liệu”), cho thấy metadata mô tả từng bị xử lý theo mẫu hàng loạt. Một quy luật khác có thể tính lại: dung lượng trang và điểm nội dung tương quan thuận (r = 0,60; n = 104; dung lượng từ 8,1 đến 39,1 KB) — điểm nội dung không đến từ việc viết dài, nhưng trang quá mỏng chắc chắn thiệt.
Bảy, hai sự cố chúng tôi tự phát hiện: điều hệ thống chấm điểm sợ nhất không phải điểm thấp
Phần này lấy từ chính đợt kiểm tra cùng đêm, và có giá trị tham khảo hơn cả con số.
Sự cố một: biểu thức tách huy hiệu làm hỏng 104 trang. Huy hiệu hỗ trợ “đo lại và làm mới điểm mỗi tuần” bằng cách tách huy hiệu cũ rồi chèn huy hiệu mới. Biểu thức tách phiên bản cũ khớp không-tham-lam tới thẻ </div> đầu tiên, nhưng thẻ đó nằm trước khối bao ngoài — kết quả: 104/104 trang còn lại “đoạn chữ điểm cũ + một thẻ </div> dư”. Hệ quả: mỗi trang hiển thị hai con điểm mâu thuẫn nhau, và thẻ đóng/mở không cân bằng.
Sự cố hai: hai lỗi ở cấp trang. Đợt kiểm tra còn phát hiện 1 trang dư một thẻ </div> (tàn dư của mẫu cũ, HTML không hợp lệ) và 1 trang tiếng Việt vẫn còn nhãn tiếng Trung ở nút chuyển ngôn ngữ (đúng ra phải là ZH|VI). Cả ba điểm đã được sửa và kiểm tra lại.
Vì sao công bố hai sự cố này: điểm thấp thì sửa được, điểm giả thì không lấy lại được lòng tin. Với huy hiệu, điểm số hay bảng xếp hạng — những thứ trình diễn cho khách hàng — chỉ cần xuất hiện hai con số mâu thuẫn là khách hàng mất niềm tin vào cả phương pháp. Vì vậy nguyên tắc của chúng tôi là: trang không truy cập được hoặc nội dung không trích xuất được thì không hiển thị điểm thay vì hiển thị 0; và mọi con số hiển thị đều phải truy được về thời điểm đo và cách đo gốc.
Tám, năm hành động rút ra từ lần tự đo này
- Đo trước, viết sau. Vấn đề của phần lớn doanh nghiệp không nằm ở khối lượng nội dung mà ở cấu hình cấp site (điểm khám phá AI, robots, llms.txt, dữ liệu có cấu trúc).
- Bổ sung trước 4 tệp cấp site. ai.txt, summary.json, faq.json, service.json là 4 đường dẫn cố định, tổng khoảng 1 vạn byte, làm xong mỗi trang được cộng 6 điểm.
- Mỗi trang phải có JSON-LD. Đây là hạng mục 16 điểm; không có chú thích nào sẽ kéo toàn site về quanh 50 điểm.
- Rà lại thẻ Meta từng trang. Chúng tôi đang mất trắng 4,35 điểm ở hạng mục 14 điểm này (trung bình 9,65), tập trung ở các bài sản xuất hàng loạt trước đây.
- Đo lại định kỳ và công bố cách đo. Cùng một site, chênh lệch giữa các lần đo lặp là 0 (khác node ±1 điểm); khi điểm thay đổi, phải xác định đó là sửa cấp site hay do cách đo, rồi mới giải thích ra ngoài.
Chín, phương pháp, cách đo và miễn trừ
Toàn bộ số liệu phía site trong bài lấy từ lần đo toàn bộ 104 trang nội dung bằng engine audit tự xây của VIETTRITHONG GEO (thời điểm @DATE@, hai vòng trước và sau khi sửa, mỗi trang ghi điểm tổng và 8 hạng mục). Bộ dữ liệu gốc gồm 104 dòng × 8 hạng mục và có thể tính lại theo công thức “điểm tổng = tổng 8 hạng mục (trừ điểm tín hiệu tiêu cực)”; ngưỡng phân mức, điểm tối đa và điều kiện kiểm tra từng đường dẫn đều lấy từ mã nguồn của engine, không phải ước lượng.
Ghi chú về phạm vi: thời điểm đo là @DATE@, đối tượng là toàn bộ 104 trang nội dung có trên site khi đó; sau khi bài này được xuất bản, số trang nội dung tăng lên 106 (thêm hai bản Trung và Việt của chính bài này). Vì vậy con số “104 trang” trong bài là quy mô tại thời điểm đo, không phải quy mô site sau khi xuất bản.
Số liệu thị trường bên ngoài chỉ dùng làm bối cảnh và đều kèm nguồn: Gartner (2024-02, tìm kiếm truyền thống giảm 25% vào 2026), Bain (80% người tiêu dùng dùng AI cho ít nhất 40% nhu cầu tìm kiếm), iiMedia Research (2026-02, thị trường GEO Trung Quốc 349,3 tỷ CNY năm 2025 → dự kiến 942 tỷ CNY năm 2026), Technode (2025-08, tỷ lệ phủ ChatGPT tại Việt Nam 81%). Engine được xây dựng dựa trên dự án mã nguồn mở Auriti geo-optimizer-skill (giấy phép MIT); điều kiện kiểm tra các đường dẫn theo tiêu chuẩn công khai geo-checklist.dev. Trọng số và hạng mục của mỗi engine khác nhau, vì vậy điểm của cùng một site trên các công cụ khác nhau không so sánh trực tiếp được.