← Tất cả bài viết
17.08.2026

Grok 4.6: AI ngang tốp đầu ở mức giá rẻ nhất — và "bẫy giá" ẩn trong phần chữ nhỏ

Grok 4.6: AI ngang tốp đầu ở mức giá rẻ nhất — và "bẫy giá" ẩn trong phần chữ nhỏ
Nguyễn Ngọc Hải 5 phút đọc

Ngày 12/8/2026, xAI (hãng tạo ra Grok) phát hành Grok 4.6 — mô hình đạt trí thông minh ngang nhóm dẫn đầu ở mức giá thuộc hàng rẻ nhất thị trường. Nghe rất hấp dẫn. Nhưng điều thú vị nhất của bản cập nhật này lại nằm ở phần chữ nhỏ trong bảng giá — một chi tiết mà bất kỳ ai định dùng AI qua API đều nên biết.

Đây là tin mô hình, nhưng bài học rút ra thì áp cho tất cả: đừng đánh giá một công cụ AI chỉ qua con số tiêu đề.

Chuyện gì đã xảy ra

Grok 4.6 ra chỉ 35 ngày sau Grok 4.5. Đáng chú ý: đây không phải mô hình nền mới lớn hơn, mà là bản "hậu huấn luyện" (post-training) — xAI giữ nguyên nền tảng, dồn công vào huấn luyện bổ sung và học tăng cường trong các môi trường agent, với mục tiêu: giúp AI bám nhiệm vụ qua nhiều bước mà không "trôi" khỏi mục tiêu.

Về điểm số, Grok 4.6 đạt 61 điểm trên chỉ số Artificial Analysis Intelligence Index (một bảng xếp hạng độc lập) — tăng 5 điểm so với 4.5, ngang GPT-5.6 Sol Max và chỉ kém một điểm so với Claude Fable 5, trở thành mô hình rẻ nhất hiện đang ở nhóm "frontier" (tốp thông minh nhất). Nó có mặt ngay trên Cursor và Grok Build, và qua API xAI, thêm bậc suy luận mới "xhigh".

Điểm mạnh: làm việc dài hơi

Thế mạnh của Grok 4.6 là công việc tri thức và các tác vụ agent chạy dài: giữ hiệu quả qua nhiều lượt tương tác mà không lạc hướng. Ở một số bài kiểm tra lập trình theo hướng agent, mô hình cải thiện rõ (ví dụ điểm DeepSWE nhảy từ 54 lên 65,9). Nói cách khác, nó được tinh chỉnh cho "sức bền" hơn là cho một câu trả lời chớp nhoáng.

"Bẫy giá 200K" — phần quan trọng nhất

Đây là điểm cả team nên nhớ. Giá niêm yết của Grok 4.6 là 2 USD/6 USD mỗi triệu token (vào/ra) — nghe rất rẻ. Nhưng mức đó chỉ áp dụng cho các yêu cầu dưới 200.000 token. Một khi yêu cầu vượt ngưỡng 200K token, toàn bộ yêu cầu bị tính lại theo mức 4 USD/12 USD — tức gấp đôi, cho cả request chứ không chỉ phần vượt. Ngoài ra, giá "cached input" (dữ liệu đã lưu đệm) cũng âm thầm tăng khoảng 67%.

Vì sao điều này quan trọng? Vì các agent chạy dài tích luỹ ngữ cảnh rất nhanh (nội dung file, kết quả công cụ, log, chính phần suy luận của nó) — nên rất dễ "cán mốc" 200K mà không để ý, và hoá đơn đội lên bất ngờ. Bài học: với mô hình này, quản lý ngữ cảnh gọn gàng (cắt bớt dữ liệu thừa, dùng cache) trở thành một phần của quyết định chi phí.

Điểm yếu cần biết

Nhìn tỉnh táo, Grok 4.6 có mấy hạn chế thật:

  • Chậm. Thời gian ra chữ đầu tiên tăng vọt từ 8,7 giây (bản 4.5) lên khoảng 31 giây (bản 4.6) — khó chịu cho các ứng dụng tương tác trực tiếp.
  • Ngữ cảnh nhỏ nhất nhóm. 500K token, trong khi phần lớn mô hình frontier khác đã ở mức 1 triệu trở lên.
  • Lập trình/terminal tự chủ vẫn kém hơn GPT-5.6 Sol và Claude Fable 5 ở các bài khó nhất.
  • Bảng so sánh là của chính xAI, trộn cả số công khai lẫn số tự công bố — nên đọc như một tuyên bố của nhà sản xuất.

Ý nghĩa với chúng ta

Với đa số chúng ta — không trực tiếp mua API — giá trị của tin này không phải là "nên dùng Grok hay không", mà là hai bài học về cách đánh giá công cụ AI:

  • "Giá niêm yết" khác "giá thực". Con số 2/6 USD nghe rẻ, nhưng chi phí thật phụ thuộc cách dùng (ngưỡng 200K, cache…). Khi cân nhắc bất kỳ công cụ AI trả phí nào, hãy đọc kỹ toàn bộ bảng giá và ước tính theo tình huống dùng thật, đừng lấy con số tiêu đề.
  • "Điểm cao nhất" khác "hợp việc của bạn". Grok 4.6 mạnh về việc dài hơi nhưng chậm và ngữ cảnh nhỏ; một mô hình "đứng đầu benchmark" chưa chắc phù hợp nếu bạn cần phản hồi nhanh hay xử lý tài liệu rất dài. Cách đúng luôn là tự kiểm trên chính công việc của mình (tốc độ, độ chính xác, chi phí thực).

Bức tranh lớn cũng đáng mừng: ngày càng có nhiều mô hình đạt trình độ "frontier" ở mức giá rẻ, tạo áp lực giảm giá và cho người dùng nhiều lựa chọn hơn bao giờ hết. Nhưng như mọi tin AI, con số ấn tượng trên thông cáo và giá trị thực trong công việc là hai chuyện khác nhau — và khoảng cách đó chỉ khép lại khi bạn tự kiểm chứng.

(Mọi việc thử nghiệm mô hình bên thứ ba với dữ liệu công việc cần theo quy định dùng công cụ AI của VNPAY.)


References

  1. MarkTechPost — SpaceXAI Releases Grok 4.6: A 500K-Context Frontier Model Tuned for Long-Running Agents. Available at: https://www.marktechpost.com/2026/08/12/spacexai-releases-grok-4-6/ (Accessed: 16/08/2026).
  2. Codersera — Grok 4.6: Benchmarks, Pricing and What Changed (2026 Launch Guide). Available at: https://codersera.com/blog/grok-4-6-launch-guide-2026/ (Accessed: 16/08/2026).
  3. DigitalApplied — Grok 4.6 Lands: Same Price as 4.5, Frontier Parity. Available at: https://www.digitalapplied.com/blog/grok-4-6-launch-pricing-agentic-benchmarks-2026 (Accessed: 16/08/2026).
  4. Appwrite — What's new in Grok 4.6 from 500K context to pricing. Available at: https://appwrite.io/blog/post/whats-new-in-grok-46-from-500k-context-to-pricing (Accessed: 16/08/2026).
  5. Kingy AI — Grok 4.6: Price, Benchmarks, 500K Context & Access. Available at: https://kingy.ai/blog/grok-4-6-price-benchmarks-api-cursor-context-window/ (Accessed: 16/08/2026).
  6. apidog — What Is Grok 4.6? Features, Benchmarks, Pricing, and API. Available at: https://apidog.com/blog/what-is-grok-4-6/ (Accessed: 16/08/2026).