
Ngày phát hành Grok 4.6: Đã ra mắt vào ngày 12 tháng 8 với cùng mức giá $2/$6
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiMỚIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleMỚIGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenMỚIQwen: Qwen3.8 Max (0902)2026-09-0240Trí tuệ72Lập trình
- anthropicMỚIAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0340Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2134Trí tuệ69Lập trình
Vào thứ Tư, ngày 12 tháng 8 năm 2026, câu hỏi mà trang này được xây dựng xung quanh đã không còn là câu hỏi nữa: Grok 4.6 đã được phát hành. SpaceXAI — công ty đã vận hành Grok kể từ khi mua lại startup này vào tháng 2 năm 2026 và đổi thương hiệu vào tháng 7 — đã phát hành nó với mức giá $2/$6 giống như Grok 4.5, trên cùng nền tảng V9, với cùng cửa sổ ngữ cảnh 500K token, và Musk gọi nó là "một bản hit" trên X. Việc ra mắt đã giải quyết hai câu hỏi mà phiên bản trước của trang này đang theo dõi: mô hình tồn tại, và đây là một bản cập nhật hậu huấn luyện cùng quy mô chứ không phải một bản mở rộng quy mô. Điều duy nhất chưa được giải quyết là số lượng tham số, vốn vẫn chưa được tiết lộ chính thức.
Một tuần trước, dòng tít trung thực là mô hình vẫn chưa được phát hành: mục tiêu "khoảng ngày 7 tháng 8" mà Musk đặt ra vào ngày 27 tháng 7 đã bị trễ, và cách đọc cùng quy mô vẫn chỉ là một dự đoán. Trang này lập luận rằng mô hình tốt nhất nên được xem như một bản làm mới ở quy mô không đổi, và các bản làm mới ở quy mô không đổi thường được phát hành mà không tăng giá. Ngày ra mắt đã xác nhận chính xác phía kinh doanh của nhận định đó — $2/$6/$0.50 mỗi triệu token, giống hệt Grok 4.5 — và các phép đo độc lập đầu tiên hiện đã có. Dưới đây là những gì đã phát hành, những con số hiện tại cho thấy, và những gì vẫn do nhà cung cấp công bố.
Những gì đã được giao vào ngày 12 tháng 8
Grok 4.6 đã có mặt trên API SpaceXAI với mã mô hình grok-4.6, và có mặt trong Grok Build, Cursor, cùng ứng dụng Grok Bot; người dùng Cursor và Grok Build nhận được gấp đôi hạn mức sử dụng đi kèm trong tuần đầu tiên. Đây là mô hình lý luận với chuỗi suy nghĩ mở rộng, chấp nhận đầu vào văn bản và hình ảnh, tạo ra văn bản, đồng thời bổ sung cài đặt reasoning-effort mới ở mức xhigh, cao hơn mức mặc định.
API này giữ các endpoint tương thích với OpenAI và bổ sung ba công cụ ở phía máy chủ: tìm kiếm web, tìm kiếm X và thực thi mã. Đối với những ai đã đang kết nối với Grok 4.5 qua một endpoint tương thích OpenAI, điều đó có nghĩa là việc chuyển đổi chỉ là thay đổi chuỗi tên model chứ không phải viết lại client.
Trang này đã dự đoán điều gì — và điều gì đã thành hiện thực
Lập luận của phiên bản trước là câu nói của Musk về "mô hình 1,5T với SFT & RL được cải thiện đáng kể" chỉ đến một bản làm mới cùng quy mô, và rằng giá sẽ được giữ nguyên. Sự ra mắt đã xác nhận cả hai nửa của dự đoán kinh doanh:
• Giá: $2 / $6 / $0.50 (cache-hit) cho mỗi triệu token — giống hệt Grok 4.5. Dự đoán "không thay đổi giá" đã ứng nghiệm.
• Bối cảnh: 500K token, giống hệt Grok 4.5.
• Quy mô: vẫn chưa được công bố chính thức. Không có số tham số nào xuất hiện trong thẻ mô hình, vì vậy con số 1.5T của Musk vẫn là tuyên bố tốt nhất hiện có, không phải thông số đã được xác minh. Con số 2T lan truyền trong các bài đưa tin ban đầu là sự gán nhầm từ con số 2.1T của Grok 4.7.

Con số độc lập — 61 trên Artificial Analysis Intelligence Index
Kết quả đo lường độc lập đầu tiên đã có, và đó là một kết quả tốt. Artificial Analysis chấm Grok 4.6 ở mức 61 trên Intelligence Index của họ — ngang bằng với cấu hình suy luận tối đa của GPT-5.6 Sol, kém Claude Fable 5 một điểm (62), kém Claude Opus 5 hai điểm (63), và vượt Kimi K3 (60). Đó là mức tăng năm điểm so với 56 của Grok 4.5, một sự cải thiện lớn cho một bản làm mới sau huấn luyện.
Có hai lưu ý đi kèm với con số này. Index là một chỉ số tổng hợp, và các khía cạnh riêng lẻ thì trái chiều hơn. Và Grok 4.6 khởi động chậm: thời gian đến token đầu tiên là 42 giây, so với mức trung vị ~2,9 giây của phân khúc giá, cùng khoảng 68 token đầu ra mỗi giây, chậm hơn mức trung bình của nhóm. Với một agent chạy lâu dài, đó chỉ là nhiễu; còn với chat tương tác, đó là toàn bộ trải nghiệm.
Trên đường cong Pareto về tương quan giữa trí thông minh và chi phí, bức tranh khá tích cực: khoảng 0,84 USD mỗi tác vụ, hoàn thành khối lượng công việc AA-Briefcase điển hình trong khoảng 53 lượt và ~0,5B token đầu vào, so với ~103 lượt và ~2B token của Claude Opus 5 Max. Điều đó khiến mô hình này trở thành một lựa chọn tiết kiệm đáng giá ở biên giới hiệu năng, chứ không chỉ đơn thuần là rẻ.
Điều gì vẫn còn do nhà cung cấp công bố?
Các tuyên bố ra mắt của SpaceXAI — "trí thông minh tương đương GPT-5.6 Sol và Claude Fable 5," cải thiện so với Grok 4.5 trên mọi đánh giá được liệt kê, được cho là nhờ "một đợt huấn luyện bổ sung dài hơn, dữ liệu kỹ thuật mạnh hơn và học tăng cường mở rộng" — do nhà cung cấp công bố và chưa được xác minh độc lập. Bảng benchmark khi ra mắt (CursorBench, FrontierCode, APEX-Agents, Terminal-Bench, và con số 1.753 Elo được quảng bá trên GDPval-AA v2) là do xAI tự báo cáo; chưa con số nào trong số đó được tái lập bởi một phòng thí nghiệm không bán mô hình này.
Bản đọc (sơ bộ) đầu tiên từ bên thứ ba đã có.
Kết quả arena độc lập duy nhất cho đến nay là sơ bộ nhưng có thật. LMArena xếp Grok 4.6 (với tên grok-4.6-high) ở #43 trên bảng xếp hạng tổng thể Text với 1,464 Elo từ 2,448 phiếu bầu — được đánh dấu là sơ bộ, và thấp hơn 4 điểm so với màn ra mắt 1.468 của Grok 4.5. Mẫu này quá nhỏ để đưa vào bảng frontier được theo dõi của LMArena, vốn cần điểm số duy trì trong hai tuần.
Bảng xếp hạng Agent của các phiên trực tiếp vẫn chưa được công bố. Khi được công bố, đây sẽ là lần đọc đầu tiên không thể tối ưu hóa trước được.

Phép tính giá
Với mức giá $2/$6, Grok 4.6 là API tiên phong rẻ nhất của thế hệ hiện tại với biên độ lớn. So với GPT-5.6 Sol ở mức $5/$30, đầu vào rẻ hơn 60% và đầu ra rẻ hơn 80% — và vì khoảng cách lớn hơn ở đầu ra, cách tiếp thị "giá chỉ bằng một nửa" đã đánh giá thấp mức tiết kiệm cho các khối lượng công việc mã hóa nặng về đầu ra.
Điều khoản chi tiết: các yêu cầu trên 200K token đầu vào sẽ chuyển lên mức $4 / $12 / $1, và biến thể nhanh hơn có giá gấp đôi. Về việc chuyển đổi, phép tính hầu như không thay đổi — Grok 4.5 và Grok 4.6 có cùng mức giá và ngữ cảnh, nên việc chuyển giữa chúng chỉ là một thay đổi cấu hình, không phải quyết định ngân sách.
Vì OrcaRouter chuyển thẳng giá niêm yết của nhà cung cấp với mức chênh lệch 0%, mức $2/$6 trên một endpoint grok-4.6 là con số của riêng SpaceXAI, không phải giá bán lại — việc nhà cung cấp giảm giá sẽ được áp dụng ngay trong ngày, và chuyển dự phòng sang nhà cung cấp thứ hai là một quy tắc định tuyến chứ không phải một thủ tục mua sắm.
Grok 4.7 và Grok 5 vẫn dẫn trước.
Grok 4.7 là bước tiếp theo, và mô tả của Musk vẫn không thay đổi: "mô hình 2.1T", tốt hơn Grok 4.6 "ở mọi khía cạnh, ngoại trừ tốc độ phục vụ chậm hơn một chút". Ngày 5 tháng 8, ông cho biết sẽ ra mắt sau ba đến bốn tuần, tức là vào cuối tháng 8 hoặc đầu tháng 9. Mốc thời gian đó do Musk công bố, và nó đã bị trễ hơn qua mỗi lần phát biểu, vì vậy hãy coi đó chỉ là thông tin mang tính định hướng.
Grok 5 dự kiến ra mắt vào cuối năm, được huấn luyện — theo cuộc gọi báo cáo thu nhập ngày 4 tháng 8 — trên "về cơ bản là toàn bộ dữ liệu mà SpaceX từng tạo ra."
Kiểm tra gì tiếp theo
Bốn điều sẽ củng cố bức tranh, và hiện mỗi điều đều được coi là còn mở:
• Bảng xếp hạng Agent của LMArena, chưa được công bố tính đến ngày 13 tháng 8.
• Bản tái tạo bởi bên thứ ba về các số liệu lập trình và tác tử — DeepSWE, CursorBench, APEX-Agents từ một người không bán mô hình.
• Giá thực tế và độ trễ của biến thể nhanh hơn khi nó được phổ biến rộng rãi.
• Liệu mốc thời gian cuối tháng Tám của Grok 4.7 có được giữ vững hay không, khi mà mỗi ngày cụ thể cho đến nay đều đã bị trễ vài ngày.
Và điều thực sự quan trọng cho một quyết định: khối lượng công việc của chính bạn. Một vị trí trên bảng xếp hạng chỉ là một giả thuyết về nhiệm vụ của bạn, không phải là kết quả cho nó.
Các câu hỏi thường gặp
Grok 4.6 thực sự ra mắt khi nào? Ngày 12 tháng 8 năm 2026, trên API SpaceXAI và trong Grok Build, Cursor cùng ứng dụng Grok Bot. Mục tiêu "khoảng ngày 7 tháng 8" của Musk vào ngày 27 tháng 7 đã trượt năm ngày; cách diễn đạt "tuần tới" trong cuộc gọi báo cáo thu nhập ngày 4 tháng 8 mới là khoảng thời gian chính xác.
Grok 4.6 có giá bao nhiêu? $2 / $6 / $0.50 cho mỗi triệu token — giống hệt Grok 4.5 và thấp hơn nhiều so với mức $5/$30 của GPT-5.6 Sol. Trên 200K token đầu vào, giá tăng lên $4 / $12 / $1, và biến thể nhanh hơn có giá gấp đôi.
Grok 4.6 có phải là mô hình 2T không? Chưa có con số tham số nào được công bố. Con số 1.5T của Musk vẫn là tuyên bố tốt nhất hiện có (chưa được xác minh); con số 2T được lan truyền thực ra là 2.1T của Grok 4.7 bị gán nhầm cho 4.6.
Grok 4.6 có ngang bằng GPT-5.6 Sol không? Trên Artificial Analysis Intelligence Index, cả hai đều đạt 61 điểm (cấu hình suy luận tối đa). Nhà cung cấp tuyên bố nó tương đương với GPT-5.6 Sol và Claude Fable 5. Nó chậm hơn đáng kể về thời gian đến token đầu tiên và rẻ hơn nhiều; những lợi ích về tác nhân vẫn đang chờ xác minh độc lập.
Điều này đưa bạn đến đâu
Bước đi thực tế không thay đổi so với phiên bản trước khi ra mắt của trang này. Nếu mã của bạn đã kết nối với Grok 4.5 qua một endpoint tương thích OpenAI, thì Grok 4.6 chỉ là một thay đổi cấu hình cùng mức giá — đổi chuỗi model, giữ nguyên hạng mục ngân sách, và chạy lại các bài đánh giá của bạn vì bản build này là mới. Nếu chưa, một endpoint định giá truyền thẳng (pass-through pricing) duy nhất cho phép chuyển sang một mô hình tiên phong mới mà không cần đặt cược cả một đường vận hành sản xuất vào các benchmark tuần đầu của nó — đó chính xác là ý nghĩa của những con số thử nghiệm sơ bộ trên arena đó.

So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
