Thẻ tiêu đề chính cho bài giải thích Grok 4.5: dòng tít 'Grok 4.5 là gì?' phía trên dòng phụ đề 'Mẫu flagship V9 bán tính kinh tế token, không phải điểm số hàng đầu', sau đó là ba thẻ ghi 'Ngữ cảnh - 500K token', 'Giá niêm yết mỗi 1M - $2.00 / $6.00' và 'Điểm trí tuệ AA - 39', với dòng chân trang 'Grok 4.5 phát hành ngày 8 tháng 7 năm 2026. Giá theo tài liệu xAI; số liệu AA theo Artificial Analysis Intelligence Index v4.3.2.' và logo OrcaRouter ở góc dưới cùng bên phải.
Guides & Insights

Grok 4.5 là gì? Mẫu flagship V9 đã quảng bá khả năng tiết kiệm token thay vì điểm số hàng đầu

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Grok 4.5 là mô hình suy luận mixture-of-experts 1,5 nghìn tỷ tham số từ nhà cung cấp — công ty hiện phân phối và tiếp thị dưới thương hiệu SpaceXAI — được phát hành vào ngày 8 tháng 7 năm 2026. Mô hình nhận đầu vào là văn bản và hình ảnh, trả về văn bản, có cửa sổ ngữ cảnh 500.000 token, và có giá niêm yết 2,00 USD mỗi triệu token đầu vào và 6,00 USD mỗi triệu token đầu ra. Đây chính là mô hình đã đưa "token cho mỗi tác vụ hoàn thành" lên trang đầu của slide ra mắt, và là mô hình mà phòng thí nghiệm đã xây dựng thêm hai mô hình chủ lực mới hơn dựa trên nó.

Mệnh đề cuối cùng đó chính là toàn bộ lý do trang này cần được viết. Tìm "Grok 4.5" và bạn sẽ nhận được các bài đưa tin ra mắt từ tháng Bảy: quan hệ đối tác với Cursor, câu trích "đẳng cấp Opus", tuyên bố 80 token mỗi giây. Điều bạn không nhận được là câu trả lời thẳng thắn cho câu hỏi mà một nhà phát triển thực sự có vào cuối tháng Chín, đó là liệu Grok 4.5 có còn đáng để tích hợp vào bất cứ thứ gì khi Grok 4.6 và Grok 4.7 tồn tại ở cùng mức giá niêm yết hay không. Vì vậy, trang này là một mục tham chiếu, không phải một bài tin tức: mô hình là gì, nó nằm ở đâu, nó làm tốt một cách có thể đo lường được những gì, nó làm kém một cách có thể đo lường được những gì, và ai nên chọn thứ khác. Không có gì ở đây được trình bày như một buổi ra mắt, bởi vì nó không phải là một buổi ra mắt.

Về nguồn dữ liệu, vì điều này quan trọng hơn mức thông thường trên một trang như thế này: mọi số liệu dưới đây đều được ghi rõ nguồn gốc. Những con số mà xAI công bố về mô hình của chính mình được đánh dấu là do nhà cung cấp báo cáo. Những con số từ Artificial Analysis là các đo lường độc lập, được đọc trực tiếp từ trang mô hình vào ngày 23 tháng 9 năm 2026. Khi một con số không thể được xác nhận từ nguồn sơ cấp, trang sẽ nói rõ như vậy thay vì đưa ra ước tính.

Grok 4.5 nằm ở đâu trong gia đình của chính nó — và nó không phải là đứng đầu

Sai lầm phổ biến nhất trong các bài đưa tin về Grok 4.5 là coi nó như là mẫu flagship. Nó từng là như vậy, trong khoảng năm tuần. Kể từ đó, xAI đã phát hành Grok 4.6 vào ngày 12 tháng 8 năm 2026 và Grok 4.7 vào đầu tháng 9, cả hai vẫn có giá $2.00 và $6.00 mỗi triệu token. Grok 4.5 hiện là mẫu ở giữa trong dòng sản phẩm: có năng lực cao hơn phân khúc giá rẻ, nhưng lại chậm hơn hai thế hệ so với mẫu dẫn đầu, và — đây là điểm quan trọng — là mẫu duy nhất trong dòng Grok hiện tại có giá đầu vào cache rẻ hơn so với các mẫu kế nhiệm. Grok 4.5 lưu trữ ở mức $0.30 mỗi triệu token; Grok 4.6 và Grok 4.7 đều lưu trữ ở mức $0.50, theo bảng giá của chính xAI.

Đây là danh sách như tài liệu định giá của nhà cung cấp hiện đang liệt kê, mọi con số đều tính trên mỗi triệu token và đều do nhà cung cấp công bố:

• Grok 4.20 (ba biến thể: đa tác nhân, suy luận, không suy luận) — ngữ cảnh 1M, $1.25 đầu vào / $2.50 đầu ra, $0.20 lưu trữ, phát hành ngày 31 tháng 3 năm 2026

• Grok 4.3 — ngữ cảnh 1M, đầu vào $1,25 / đầu ra $2,50, lưu đệm $0,20, cộng thêm ưu đãi theo lô; cách rẻ nhất để có một triệu token ngữ cảnh Grok

• Grok 4.5 — ngữ cảnh 500K, $2,00 đầu vào / $6,00 đầu ra, $0,30 cho bộ nhớ đệm, phát hành ngày 8 tháng 7 năm 2026

• Grok 4.6 — ngữ cảnh 500K, 2,00 USD đầu vào / 6,00 USD đầu ra, 0,50 USD cho phần lưu đệm, phát hành ngày 12 tháng 8 năm 2026

• Grok 4.7 — ngữ cảnh 500K, $2.00 đầu vào / $6.00 đầu ra, $0.50 cho bộ nhớ đệm, phát hành đầu tháng 9 năm 2026

• Grok Build 0.1 — ngữ cảnh 256K, đầu vào $1.00 / đầu ra $2.00, một chuyên gia lập trình hơn là một mô hình tổng quát

Hai điều rút ra từ danh sách đó. Thứ nhất, Grok 4.5 không được giảm giá khi nó không còn là mẫu chủ lực — nó vẫn giữ mức giá chủ lực, nghĩa là Grok 4.6 giờ rõ ràng mang lại giá trị tốt hơn với cùng số tiền, trừ khi bạn đặc biệt muốn mức giá cache rẻ hơn hoặc bị ràng buộc vào snapshot 4.5. Thứ hai, Grok 4.5 chỉ có một nửa ngữ cảnh của Grok 4.3 và dòng 4.20 với mức giá đầu vào gấp đôi. Nền tảng V9 là lý do: 1,5 nghìn tỷ tham số, lớn hơn khoảng ba lần so với Grok 4.3, và một mô hình nền tảng lớn hơn chính là thứ đã đổi lấy năng lực đó bằng cái giá là cửa sổ ngữ cảnh.

Nếu điều bạn thực sự cần là ngữ cảnh dài với chi phí tiết kiệm, thì Grok 4.3 là câu trả lời trung thực trong dòng sản phẩm này, còn Grok 4.5 thì không. Sự đánh đổi đó — năng lực so với cửa sổ ngữ cảnh — là quyết định mang tính định hình trong dòng Grok, và đáng nói thẳng ra thay vì giả vờ rằng con số mới hơn thì giỏi hơn ở mọi thứ.

Bảng thông số kỹ thuật

Screenshot of the xAI developer documentation model page for grok-4.5, showing the model identifier and aliases grok-4.5-latest and grok-build-latest, the description 'intelligent coding model for agentic software, engineering, and workflow tasks', an At a glance block giving modalities 'Text, Image to Text' and a 500,000-token context window, capability rows for function calling, structured outputs and reasoning, and the pricing rows $2.00 input, $0.30 cached input and $6.00 output per million tokens, above a collapsed 'Higher context pricing' note about requests exceeding the 200K context window.

Đây là những thông số kỹ thuật mà xAI công bố trên trang mô hình của chính mình, không phải ước tính từ bên thứ ba:

• Mã định danh mô hình — grok-4.5, với các bí danh grok-4.5-latestgrok-build-latest

• Phương thức — đầu vào là văn bản và hình ảnh, đầu ra là văn bản. Hình ảnh được chấp nhận làm đầu vào; mô hình không tạo ra chúng

• Cửa sổ ngữ cảnh — 500.000 token, được chia sẻ giữa prompt và phản hồi thay vì 500K đầu vào cộng thêm một hạn mức đầu ra riêng biệt

• Giấy phép — độc quyền. Không có trọng số mở và không có checkpoint nào tải xuống được; bạn truy cập Grok 4.5 thông qua API hoặc thông qua chính các sản phẩm của nhà cung cấp

• Giá niêm yết — 2,00 USD cho mỗi triệu token đầu vào, 6,00 USD cho mỗi triệu token đầu ra, 0,30 USD cho đầu vào được lưu trong bộ nhớ đệm

• Giá cho ngữ cảnh dài — từ 200.000 token gợi ý trở lên, mức giá tăng lên 4,00 USD đầu vào / 12,00 USD đầu ra / 0,60 USD phần lưu đệm, và mức giá cao hơn áp dụng cho mọi token trong yêu cầu, chứ không chỉ những token vượt ngưỡng. Đây là chi tiết đắt giá nhất trên trang nếu bỏ sót

• Kiểm soát suy luận — bốn mức, low, medium, highxhigh, mặc định là high. Không thể tắt hoàn toàn suy luận và token suy luận được tính như token đầu ra

• Hỗ trợ công cụ và định dạng — gọi hàm và đầu ra có cấu trúc được hỗ trợ nguyên bản. Các công cụ tìm kiếm phía máy chủ được tính phí thêm ngoài mức sử dụng token; chúng tôi không thể xác nhận mức phí hiện tại cho mỗi lần gọi trên trang mô hình của nhà cung cấp, chỉ biết rằng chúng có tồn tại

• Giới hạn tốc độ — 150 yêu cầu mỗi giây và 50 triệu token mỗi phút

• API theo lô — không được hỗ trợ trên Grok 4.5, khác với Grok 4.3

• Khu vực phục vụ — us-east-1 và us-west-2 khi ra mắt. Tính khả dụng ở châu Âu đã được nêu rõ là không có trong ngày đầu tiên và được nhà cung cấp mô tả là dự kiến vào giữa tháng 7 năm 2026; chúng tôi không tìm thấy tuyên bố nguồn sơ cấp nào sau đó xác nhận chính xác ngày nó mở, vì vậy hãy coi mốc thời gian EU ở đây là chưa được xác nhận

Một điểm sai lệch đáng được ghi nhận thay vì lấp liếm: mục danh mục của chính OrcaRouter cho grok/grok-4.5 hiển thị mức giá đọc bộ nhớ đệm là 0,50 USD mỗi triệu, khớp với mức xAI tính cho Grok 4.6 và Grok 4.7 chứ không phải mức 0,30 USD mà bảng giá của nhà cung cấp hiển thị cho Grok 4.5. Tài liệu của nhà cung cấp là thẩm quyền về giá; trang của chúng tôi dường như đang mang mức giá bộ nhớ đệm của phiên bản kế nhiệm, và nó đã được gắn cờ thay vì bị lặp lại một cách âm thầm ở đây.

Grok 4.5 thực sự giỏi ở những gì có thể đo lường được

Tuyên bố chủ đạo khi ra mắt là tính tiết kiệm token, và đây là tuyên bố duy nhất trên trang ra mắt có một cơ chế đằng sau chứ không chỉ là một con điểm. Trên SWE-bench Pro, xAI báo cáo rằng Grok 4.5 trung bình dùng 15.954 token đầu ra cho mỗi tác vụ được giải quyết, so với 67.020 của Claude Opus 4.8 chạy ở mức nỗ lực tối đa — ít hơn khoảng 4,2 lần số token để hoàn thành cùng một công việc. Ít token đầu ra hơn cho mỗi tác vụ được giải quyết chính là khác biệt giữa một mô hình rẻ hơn và một mô hình rẻ hơn nhanh hơn về thời gian thực, bởi vì token đầu ra chính là thứ bạn phải chờ. Do nhà cung cấp tự báo cáo, trên chính bộ kiểm thử của nhà cung cấp, và chưa được bất kỳ ai độc lập tái lập — nhưng đây là một tuyên bố mang tính cấu trúc, không phải một con số phần trăm được chọn lọc có lợi.

Bảng đánh giá chuẩn của nhà cung cấp, được công bố cùng với mô hình và do đó toàn bộ đều do nhà cung cấp báo cáo, có nội dung như sau khi đối chiếu với chính các mô hình đó:

• DeepSWE 1.0 — Grok 4.5 đạt 62.0%, xếp sau Claude Fable 5 với 66.1% và GPT-5.5 với 64.31%, xếp trên Claude Opus 4.8 với 55.75%

• SWE Marathon, tỷ lệ giải quyết — Grok 4.5 29,0%, dẫn trước Claude Opus 4.8 ở 26,0% và Claude Fable 5 ở 24,0%. Đây là benchmark lập trình duy nhất mà Grok 4.5 dẫn đầu.

• Terminal-Bench 2.1 — Grok 4.5 83,3%, thực tế ngang bằng Claude Fable 5 ở 84,3% và GPT-5.5 ở 83,4%, vượt trên Claude Opus 4.8 ở 78,9%

• DeepSWE 1.1 — Grok 4.5 53%, xếp sau Claude Fable 5 ở 70% và GPT-5.5 ở 67%

• SWE-bench Pro — Grok 4.5 đạt 64,7%, xếp sau Claude Fable 5 với 80,4% và Claude Opus 4.8 với 69,2%

Cách diễn giải trung thực là Grok 4.5 thắng ở việc giải quyết tác vụ trong tầm xa và ở tính kinh tế của việc hoàn thành một tác vụ, còn thua trên các benchmark lập trình one-shot khó hơn. Đây là một mô hình tốt cho các vòng lặp agent và là một mô hình tầm thường cho các bài toán khó one-shot — và sự khác biệt đó chính xác là điều mà con số hiệu quả token dự đoán nó phải là.

A single-column scoreboard card for Grok 4.5 titled 'Grok 4.5 - the scoreboard' with six rows reading: AA Intelligence Index 39 (#52 of 212); Output speed 55.1 tok/s (#126 of 212); Time to first token 10.94 s; Context window 500K tokens; Price per 1M $2.00 / $6.00, $0.30 cached; SWE-bench Pro 64.7% (vendor). Footer: 'Price and spec rows per xAI docs; AA Index and speed per Artificial Analysis Intelligence Index v4.3.2; SWE-bench Pro vendor-reported.'

Bức tranh độc lập thì mỏng hơn, và đây là chỗ trang này phải cẩn thận. Artificial Analysis hiện xếp Grok 4.5 (high) ở điểm Chỉ số Thông minh là 39, xếp hạng #52 trong 212 mô hình, trên phiên bản chỉ số v4.3.2 — cao hơn trung vị 25 của các mô hình tương đương, nhưng không gần vị trí dẫn đầu. Nếu bạn đã thấy điểm 54 hoặc 56 được trích dẫn cho mô hình này trong các bài đưa tin tháng 7, đừng so sánh nó với 39: Artificial Analysis đã sửa đổi chỉ số kể từ khi ra mắt và hai con số đến từ các bản sửa đổi khác nhau. Đây chính xác là kiểu so sánh số liệu cũ khiến các bảng benchmark trở nên không đáng tin cậy, và đó là lý do trang này trích dẫn phiên bản chỉ số song song với điểm số.

Grok 4.5 kém ở những điểm nào có thể đo lường được

Artificial Analysis báo cáo tốc độ đầu ra 55,1 token mỗi giây, xếp hạng #126 trong số 212 mô hình và dưới mức trung vị 74 — còn cách xa 80 token mỗi giây mà xAI công bố khi ra mắt và thậm chí còn xa hơn nữa so với ~340 token mỗi giây mà các mô hình nhanh nhất hiện nay đạt được. Tổ chức này cũng báo cáo thời gian đến token đầu tiên là 10,94 giây so với mức trung vị 3,86 giây. Hai con số đó cùng nhau mô tả chi phí thực sự của một mô hình suy luận mặc định ở cao và không thể tắt: bạn phải chờ, rồi sau đó nó nói chậm. Để mức suy luận ở mặc định và Grok 4.5 sẽ giống như mô hình chậm nhất mà bạn có trên key.

Thêm ba điểm tiêu cực đã được cân nhắc kỹ, xếp theo mức độ chúng nên ảnh hưởng đến một quyết định:

• Artificial Analysis đã đánh dấu Grok 4.5 là không còn được khuyến nghị và cho biết họ chỉ tiếp tục chạy benchmark cho nó với khối lượng đầu vào mặc định 10.000 token. Đó là một bên thứ ba đang nói với bạn rằng họ đã ngừng đo lường đầy đủ mô hình mà bạn đang cân nhắc, và họ khuyến nghị dùng Grok 4.6 thay thế. Việc không còn được khuyến nghị trên bảng xếp hạng không có nghĩa là không khả dụng trên API — điều đó có nghĩa là cơ sở bằng chứng độc lập đã bị đóng băng

• Nó thua cả Claude Fable 5 lẫn GPT-5.5 ở hai benchmark gần giống nhất với kiểu lập trình khó, chỉ một lần thử: DeepSWE 1.1 và SWE-bench Pro, theo bảng của chính xAI

• Nó có ngữ cảnh bằng một nửa của Grok 4.3 với mức giá đầu vào gấp đôi, và không có API theo lô nào cả. Nếu khối lượng công việc của bạn là xử lý tài liệu dài hoặc suy luận theo lô ngoại tuyến, thì Grok 4.5 là mô hình sai trong chính gia đình của nó.

Về ảo giác và hiệu chuẩn, trang này không thể xác nhận một con số độc lập hiện tại. Các bài đưa tin hồi tháng 7 đã lan truyền mức tỷ lệ ảo giác khoảng 54%, nhưng chúng tôi không thể xác minh con số đó trên trang mô hình Artificial Analysis mà chúng tôi đã đọc, và nó cũng không xuất hiện trên trang của nhà cung cấp. Thay vì lặp lại một con số mà chúng tôi không thể xác minh nguồn, chúng tôi ghi nhận nó là chưa được đo lường ở đây.

Ai nên chọn Grok 4.5, và ai nên chọn thứ khác?

Chọn Grok 4.5 nếu bạn đang chạy các vòng lặp agentic, nơi chi phí cho mỗi tác vụ hoàn thành quan trọng hơn chi phí cho mỗi token, và bạn đã đo lường rằng hành vi tiết kiệm token của V9 vẫn đúng trên khối lượng công việc của bạn. Đây cũng là lựa chọn đúng nếu bạn cần một bản snapshot thuộc họ Grok với mức giá đầu vào được lưu trong bộ đệm là $0.30 trên một tiền tố lớn, ổn định, được truy cập lặp lại — mức giá cache đó thực sự rẻ hơn mức mà Grok 4.6 và Grok 4.7 tính, và trên một khối lượng công việc nặng về cache, sự khác biệt đó có thể lớn hơn hai thế hệ năng lực.

Thay vào đó, hãy chọn Grok 4.6 hoặc Grok 4.7 cho hầu hết mọi việc khác. Cùng giá niêm yết, cùng cửa sổ 500K, huấn luyện mới hơn, điểm số độc lập tốt hơn, và chính khuyến nghị của Artificial Analysis. Không có phiên bản nào của "tôi muốn Grok tốt nhất" mà câu trả lời ngày hôm nay lại là 4.5.

Chọn Grok 4.3 nếu ngữ cảnh là yếu tố giới hạn: 1 triệu token với mức giá $1,25 và $2,50, kèm ưu đãi giảm giá theo lô mà Grok 4.5 không có. RAG tài liệu dài và phân tích toàn bộ kho mã vẫn là lãnh địa của nó.

Hãy chọn một mô hình nằm ngoài dòng họ này nếu bạn đang tối ưu cho điểm số đỉnh cao thay vì chi phí trên mỗi tác vụ — Claude Fable 5 dẫn đầu mọi bài đánh giá lập trình trong bảng so sánh của chính xAI, và GPT-5.5 xếp trên Grok 4.5 ở DeepSWE 1.0 và 1.1. Nếu bạn muốn trọng số mở và có thể chấp nhận một mô hình nhỏ hơn, thì đó hoàn toàn là một lựa chọn mua khác, và không có mô hình Grok nào cạnh tranh ở phân khúc đó.

Gọi Grok 4.5 mà không cần hợp đồng thứ hai

Grok 4.5 đã hoạt động trên OrcaRouter với mức giá niêm yết của xAI, cùng mức phí của nhà cung cấp được chuyển nguyên vẹn, không cộng thêm đồng nào — nên mức $2.00 và $6.00 ở trên chính là số tiền bạn phải trả, và nếu nhà cung cấp thay đổi giá thì phía chúng tôi cũng cập nhật ngay trong cùng ngày họ cập nhật. Điều này còn quan trọng hơn mức thông thường đối với mô hình cụ thể này, bởi lựa chọn mà phần lớn độc giả đang đối mặt không phải là "Grok 4.5 hay không có gì", mà là "Grok 4.5 hay Grok 4.6 hay Grok 4.3", và việc so sánh ba mô hình trong cùng một dòng sản phẩm chính là thứ mà một endpoint duy nhất trên hơn 200 mô hình giúp thực hiện với chi phí rẻ. Một khóa duy nhất, không cần thêm hợp đồng thứ hai, và một bài kiểm tra A/B chỉ đơn thuần là đổi một chuỗi ký tự chứ không phải là tích hợp.

Lập luận về failover ở đây đặc biệt cụ thể. Grok 4.5 vẫn định tuyến được nhưng không còn được các đơn vị theo dõi độc lập đánh giá benchmark đầy đủ và không còn là mẫu chủ lực của nhà cung cấp — một mô hình mà bạn có thể muốn đưa vào chuỗi dự phòng thay vì coi đó là con đường duy nhất. Failover tự động giữa các nhà cung cấp là cơ chế cho phép bạn giữ nó cho những gì nó làm tốt mà không đặt cược một tuyến production vào một bản snapshot mà hệ sinh thái đã bắt đầu vượt qua.

Điều mà trang này sẽ không làm là giả vờ rằng lựa chọn ấy là hiển nhiên. Grok 4.5 là một mô hình tốt với một thế mạnh riêng, nằm trong một dòng mà cùng số tiền đó giờ mua được một bản mới hơn. Nếu hôm nay bạn bắt đầu từ con số không, khuyến nghị trung thực là Grok 4.6. Nếu bạn đang chạy Grok 4.5 trong một vòng lặp agent và nó hoàn thành nhiệm vụ ở mức token mà bạn đã dự trù, khuyến nghị trung thực là không thay đổi gì cả và đo lại sau một quý.

Screenshot of the OrcaRouter model page for Grok 4.5 (grok/grok-4.5), showing the SpaceXAI provider label, the Featured badge, capability tags for Vision, Tools, JSON and Reasoning, the 500K-token context window, the $2.00 per million input and $6.00 per million output pricing rows, and the benchmark table sourced from Artificial Analysis.

Grok 4.5 có thể định tuyến trên OrcaRouter ngay hôm nay, và Grok 4.6, Grok 4.7 cùng Grok 4.3 cũng vậy. OrcaRouterchuyển nguyên mức giá niêm yết của nhà cung cấp mà không cộng thêm phí, nên khi nhà cung cấp thay đổi giá thì phía chúng tôi nhận được thay đổi đó ngay trong cùng ngày họ nhận, và việc chuyển một khối lượng công việc giữa hai mô hình Grok chỉ là thay đổi một chuỗi ký tự thay vì phải ký thêm một hợp đồng thứ hai.

So sánh trong bài viết này4

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày