
Grok 4.7 là gì? Thông số kỹ thuật, Giá, Cửa sổ ngữ cảnh và Điểm chuẩn
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 300 tok/s
- openaiMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- openaiMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- anthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- grokMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 195 tok/s
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 112 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
Grok 4.7 là mô hình chủ lực hiện tại của SpaceXAI: một mô hình suy luận nhận đầu vào là văn bản và hình ảnh, trả về văn bản, sở hữu cửa sổ ngữ cảnh 500.000 token, và có giá niêm yết 2,00 USD cho mỗi triệu token đầu vào cùng 6,00 USD cho mỗi triệu token đầu ra, với mức độ suy luận có thể chọn qua bốn cấp. Nó kế nhiệm Grok 4.6, khớp chính xác với mô hình đó về giá và ngữ cảnh, và hướng tới những công việc dài hơi — lập trình kéo dài nhiều giờ, vòng lặp công cụ dạng tác nhân, công việc tri thức chuyên nghiệp — thứ mà công ty hiện đang xây dựng toàn bộ dòng sản phẩm của mình xoay quanh. Trang này là mục tham chiếu cho mô hình đó: mô hình là gì, nó nằm ở đâu, nó chấp nhận những gì, chi phí ra sao, và sau đó là hai điều được cố ý tách riêng — những gì SpaceXAI nói về mô hình của chính mình, và những gì một đơn vị đánh giá độc lập đo lường được.
Vì sao đây là trang tham chiếu chứ không phải bài đưa tin về màn ra mắt. Grok 4.7 ra mắt ngày 21 tháng 9 năm 2026, và màn ra mắt đó đã được đưa tin trên blog này (xem bài grok-4-7-release-date để có góc nhìn ngay trong ngày đầu tiên), nên ngày nêu bên dưới được dùng như một dữ kiện định vị mốc thời gian của mô hình, chứ không phải như một sự kiện được tường thuật lại. Độc giả mà trang này tồn tại vì họ chính là người gõ đúng tên trần của mô hình vào ô tìm kiếm và muốn có mô hình, chứ không phải tin tức: trong 28 ngày tính đến ngày 25 tháng 9 năm 2026, dữ liệu Search Console của chính chúng tôi ghi nhận 31.934 lượt hiển thị cho truy vấn chính xác "grok 4.7" và 34.160 lượt cho mọi cách viết quy về tên đó, với vị trí trung bình là 7,8 mà không có trang chuyên biệt nào để đáp ứng. Đó là phép đo những gì người ta gõ — nó không nói lên điều gì về việc mô hình tốt đến đâu — và đó là lý do trang này mở đầu bằng câu hỏi giản dị nhất có thể. Mọi số liệu trong bài đều được ghi rõ nguồn gốc: do nhà cung cấp báo cáo đối với bất cứ thứ gì từ tài liệu, bài đăng ra mắt hay trang giá của chính SpaceXAI, độc lập đối với Artificial Analysis, và của chính chúng tôi đối với những gì danh mục và dữ liệu tìm kiếm của chúng tôi cho thấy.
Vị trí của Grok 4.7 trong dòng sản phẩm Grok
Nhà cung cấp hiện viết tên mình là SpaceXAI trên cả tài liệu dành cho nhà phát triển lẫn trang tin tức, trong khi API vẫn được phục vụ từ api.x.ai và định danh mô hình vẫn thuộc dòng grok. Grok 4.7 đứng đầu dòng mô hình văn bản và cũng là khuyến nghị mặc định của chính nhà cung cấp: khi được hỏi nên chọn mô hình nào, trang mô hình trả lời rằng với mọi tác vụ ngoại trừ công việc về âm thanh, hình ảnh và video — "kể cả lập trình" — bạn nên dùng Grok 4.7, bởi vì "đây là mô hình mạnh mẽ nhất mà chúng tôi từng xây dựng." Các mô hình anh em của nó, theo mức giá mà chính nhà cung cấp công bố trên mỗi triệu token, là:
• Grok 4.6 — ngữ cảnh 500K, $2.00 đầu vào / $0.50 đã lưu đệm / $6.00 đầu ra, ra mắt tháng 8 năm 2026. Là phiên bản tiền nhiệm trực tiếp và là mô hình làm mốc định giá cho 4.7.
• Grok 4.5 — ngữ cảnh 500K, $2,00 đầu vào / $0,30 đã cache / $6,00 đầu ra, phát hành tháng 7 năm 2026. Cùng giá niêm yết như các phiên bản kế nhiệm nhưng có mức giá cache rẻ hơn, và đây hiện là lý do cụ thể duy nhất để vẫn chọn nó.
• Grok 4.3 — ngữ cảnh 1M, đầu vào $1,25 / bộ nhớ đệm $0,20 / đầu ra $2,50. Chỉ bằng một nửa giá của mẫu flagship hiện tại và gấp đôi cửa sổ ngữ cảnh của nó.
• Grok 4.20 (các biến thể suy luận, không suy luận và đa tác nhân) — ngữ cảnh 1M, $1.25 đầu vào / $0.20 đã lưu đệm / $2.50 đầu ra.
• Grok Build 0.1 — ngữ cảnh 256K, $1.00 cho đầu vào / $0.20 cho phần đã lưu đệm / $2.00 cho đầu ra. Đây là một chuyên gia về lập trình chứ không phải một mô hình đa dụng, và mô hình mặc định của agent Grok Build là Grok 4.7, chứ không phải mô hình này.
Vậy nên hình dạng của dòng sản phẩm hiện tại là một sự đánh đổi giữa năng lực và cửa sổ ngữ cảnh: mẫu flagship cho bạn 500K ngữ cảnh với mức giá $2/$6, còn bậc 4.3/4.20 cho bạn trọn một triệu token với giá đầu vào chỉ bằng khoảng một nửa và giá đầu ra chưa bằng một nửa. Không có gì trong tài liệu của nhà cung cấp cho thấy Grok 4.7 là một kiến trúc khác với Grok 4.6 — những gì bản phát hành mô tả là một mô hình nền lớn hơn, một quá trình học tăng cường dài hơn, nghiêng về các tác vụ mất nhiều giờ mới hoàn thành, khả năng tự kiểm chứng tốt hơn, xử lý ngữ cảnh dài tốt hơn, và huấn luyện trên harness Grok Bot để mô hình hành xử tốt hơn trong công việc hội thoại và tri thức tổng quát. Một tuyên bố cải tiến, chứ không phải một thiết kế mới. SpaceXAI không công bố số lượng tham số cho Grok 4.7 trên trang mô hình hay bảng giá của mình, và trang này sẽ không đoán một con số nào.
Khi nó được phát hành, và những gì được phát hành cùng với nó
Bài đăng ra mắt mang ngày 21 tháng 9 năm 2026, và trang mô hình dành cho nhà phát triển cũng ghi cùng ngày đó ở mục cập nhật lần cuối, đây là mức chính xác nhất có thể có — SpaceXAI không công bố dấu thời gian phát hành chi tiết hơn mức ngày. Thứ được phát hành ngày hôm đó không chỉ là một mã định danh mô hình. grok-4.7 định danh đã chính thức hoạt động trên cả Responses API và Chat Completions với cửa sổ ngữ cảnh 500.000 token, mốc kiến thức tháng 5 năm 2026, bốn mức suy luận bao gồm một thiết lập cao nhất mới, một biến thể Fast chỉ giới hạn ở hai bề mặt first-party, một endpoint theo khu vực chỉ dành riêng cho Hoa Kỳ, và mức giá niêm yết giống hệt mức giá của Grok 4.6. Đồng thời, nó được đặt làm mô hình mặc định của Grok Build coding agent và được cung cấp trong Cursor trên mọi gói. Nếu bạn muốn phản ứng ngay ngày đầu tiên thay vì bản thông số kỹ thuật, thì grok-4-7-release-date là bài viết đề cập đến nội dung đó; trang này coi ngày đó như một dữ kiện về mô hình và chuyển sang những gì nó thực sự sẽ làm cho bạn.
Phong bì: những gì bạn có thể gửi và gửi được bao nhiêu.
Tất cả nội dung sau đây đều lấy từ trang model riêng của SpaceXAI và trang models, được đọc vào ngày 28 tháng 9 năm 2026, trừ khi được ghi chú khác.

• Cửa sổ ngữ cảnh — 500.000 token. Tương tự như Grok 4.6, bằng một nửa so với mức mà Grok 4.3 và dòng 4.20 cung cấp.
• Thời điểm cắt kiến thức — tháng 5 năm 2026, muộn hơn ba tháng so với Grok 4.6. Bất cứ thứ gì gần đây hơn đều cần bật công cụ tìm kiếm; theo mặc định, mô hình không có nhận thức thời gian thực.
• Đầu vào — văn bản và hình ảnh. Hình ảnh có thể là JPG/JPEG hoặc PNG, tối đa 20 MiB mỗi ảnh, và nhà cung cấp không ghi giới hạn về số lượng ảnh trong một yêu cầu; hình ảnh và văn bản có thể xuất hiện theo bất kỳ thứ tự nào.
• Đầu ra — chỉ văn bản. Mô hình này không tạo hình ảnh, âm thanh hay video; đó là những mô hình riêng biệt trong dòng SpaceXAI.
• Giới hạn đầu ra — nhà cung cấp tuyên bố không có giới hạn đầu ra văn bản. Thẻ mô hình OrcaRouter của chúng tôi dành cho grok-4.7 ghi đầu ra tối đa 450.000 token, và hai con số này không khớp với nhau. Chúng tôi đang gắn cờ điều này thay vì lặng lẽ chọn một con số: tài liệu của SpaceXAI là nguồn có thẩm quyền về mô hình của SpaceXAI, và cách hiểu trung thực là nhà cung cấp không công bố mức trần đầu ra văn bản.
• Kiểm soát suy luận — reasoning_effort nhận các giá trị low, medium, high (mặc định của nhà cung cấp) hoặc xhigh. xhigh là mức mới trong thế hệ này; Grok 4.6 cũng cung cấp bốn mức, và các số liệu benchmark được công bố cho 4.7 đều được trích dẫn ở mức xhigh.
• Công cụ — gọi hàm, tìm kiếm web, tìm kiếm X và thực thi mã, tất cả đều được ghi tài liệu dưới dạng công cụ phía máy chủ.
• Đầu ra có cấu trúc — nhà cung cấp tài liệu hóa khả năng đầu ra có cấu trúc song song với việc tạo văn bản; trang của chúng tôi công bố nó dưới dạng response_format và structured_outputs.
• Các tham số mà trang của chúng tôi chấp nhận — include_reasoning, logprobs, max_tokens, reasoning, reasoning_effort, response_format, seed, structured_outputs, temperature, tool_choice, tools, top_logprobs và top_p. Một lưu ý đáng biết trước khi bạn xây dựng dựa trên logprobs: trang models của SpaceXAI nêu rằng logprobs và top_logprobs không được hỗ trợ bởi grok-4.20 và các mô hình mới hơn và "sẽ bị âm thầm bỏ qua nếu được đặt", điều này bao gồm cả Grok 4.7. Việc trang của chúng tôi liệt kê chúng không phải là lời hứa rằng upstream sẽ trả về chúng.
• Các endpoint — API Chat Completions tương thích với OpenAI và API Responses.
• Bộ nhớ đệm prompt — nhà cung cấp khuyến nghị đặt prompt_cache_key trên Responses API (header x-grok-conv-id trên Chat Completions) để các yêu cầu của một cuộc hội thoại rơi vào cùng một máy chủ; nếu không có nó, tài liệu cảnh báo, bạn thường phải trả giá đầu vào đầy đủ trên một máy chủ chưa có bộ nhớ đệm. Đầu vào được lưu trong bộ nhớ đệm được tính giá $0,50 mỗi triệu token dưới ngưỡng 200K.
• Suy luận được mã hóa — trên API Responses, Grok 4.7 luôn trả về reasoning.encrypted_content, ngay cả khi bạn không yêu cầu, nhờ đó các lời gọi nhiều lượt vẫn giữ được suy luận của mô hình mà không cần cấu hình thêm. Chat Completions không thay đổi.
Bảng giá, trong
Giá được chia theo bậc dựa trên kích thước prompt, và một khi vượt qua ngưỡng thì ngưỡng đó áp dụng cho toàn bộ yêu cầu, chứ không chỉ cho phần token vượt ngưỡng. Mọi con số ở đây đều do nhà cung cấp công bố, được đọc từ trang định giá của SpaceXAI vào ngày 28 tháng 9 năm 2026:
• Tiêu chuẩn, lời nhắc dưới 200K token — 2,00 USD đầu vào / 0,50 USD đầu vào đã lưu trong bộ nhớ đệm / 6,00 USD đầu ra mỗi triệu token.
• Ngữ cảnh dài, lời nhắc từ 200K token trở lên — 4,00 đô la đầu vào / 1,00 đô la đầu vào được lưu trữ / 12,00 đô la đầu ra mỗi triệu token.
• Grok 4.7 Fast — cùng một mô hình trên hạ tầng nhanh hơn với mức giá gấp đôi mức tiêu chuẩn: $4.00 / $1.00 / $12.00 cho dưới 200K, và $6.00 / $1.50 / $18.00 cho trên ngưỡng đó. Nó chỉ khả dụng thông qua Cursor và Grok Build, hoàn toàn không có trên API công khai, và gói miễn phí của Grok Build không bao gồm nó.
• US regional endpoint — https://us.api.x.ai/v1 keeps inference in the United States and bills at 1.1×, which works out to $2.20 / $0.55 / $6.60 per million below 200K and $4.40 / $1.10 / $13.20 above. Only grok-4.7 and grok-4.6 are served there today.
So với phần còn lại của thị trường, điều thú vị không nằm ở mức giá được nhấn mạnh — 2 USD đầu vào và 6 USD đầu ra đúng bằng mức Grok 4.6 từng tính và mức Grok 4.5 vẫn đang tính — mà nằm ở chiết khấu bộ nhớ đệm, thứ được nhà cung cấp công bố là giảm 75% cho đầu vào đối với các tiền tố prompt lặp lại. Đối với một vòng lặp agent dài, vốn gửi lại cùng system prompt và ngữ cảnh tệp sau mỗi lượt, khoản chiết khấu đó chính là khác biệt giữa giá niêm yết và hóa đơn. Đây cũng là điểm duy nhất mà Grok 4.7 kém hơn người anh em cũ hơn của nó: Grok 4.5 lưu đệm ở mức 0,30 USD mỗi triệu token, so với 0,50 USD của Grok 4.7.
Grok 4.7 đã có trên OrcaRouter với tên grok/grok-4.7 ở đúng mức giá niêm yết của chính SpaceXAI với 0% markup — giá của nhà cung cấp được chuyển nguyên vẹn, nên khi nhà cung cấp thay đổi giá thì tại đây đã cập nhật ngay trong cùng ngày thay vì phải chờ qua một lượt định giá lại. Điều đó còn quan trọng hơn bình thường ở một mô hình có ngưỡng prompt hai tầng và một mức giá cache, bởi cả hai yếu tố đó đều ảnh hưởng đến số tiền bạn thực sự phải trả. Đó là một khóa duy nhất và một endpoint tương thích OpenAI cho toàn bộ dòng Grok, nên việc chuyển một workload từ Grok 4.7 sang Grok 4.5 hoặc 4.3 để thử chênh lệch chi phí chỉ là thay đổi một chuỗi ký tự chứ không phải ký thêm một hợp đồng thứ hai.
Những gì SpaceXAI tuyên bố về nó
Mọi thứ trong phần này đều do nhà cung cấp tự báo cáo. Không có nội dung nào trong đó được tái lập một cách độc lập, và thiết lập effort rất quan trọng — bảng trong bài đăng ra mắt ghi Grok 4.7 ở xHigh, Grok 4.6 ở High, còn hai mô hình so sánh ở Max, đây không phải là một so sánh tương xứng.
• CursorBench 4.0 — 46,3% cho Grok 4.7 ở xHigh, so với 40,4% cho Grok 4.6 ở High. Cách bài đăng ra mắt tự diễn đạt là đây chính là nơi Grok 4.7 "ở vị trí tiên phong về hiệu năng trên giá".
• Terminal-Bench 4.0 — 37,6%, so với 20,3% của Grok 4.6. Mức chênh lệch đơn lẻ lớn nhất trong bản phát hành, và là mức khớp với tuyên bố “RL lâu hơn trên các tác vụ khó hơn”.
• DeepSWE v1.1 — 71.0%, được đánh dấu trong bảng của chính nhà cung cấp là điểm số đạt được với nỗ lực cao, so với 65.2% của Grok 4.6.
• AA Briefcase v1.1 — 1,657, so với 1,546 của Grok 4.6. Lưu ý sự trùng tên ở đây: đây là việc nhà cung cấp trích dẫn một benchmark mà Artificial Analysis cũng chạy, và kết quả độc lập sẽ được thảo luận ở phần tiếp theo.
• EEBench — 64,0%, so với 53,0% của Grok 4.6.
• Harvey Legal Agent Benchmark — 19,6%, so với 15,8% của Grok 4.6.
• HealthBench Professional — 56,7%, so với 48,5% của Grok 4.6.
• GDPval — 1.695 Elo ở mức xhigh, so với 1.605 của Grok 4.6 ở mức high.
Các tuyên bố về an toàn cũng do nhà cung cấp tự báo cáo, và cụ thể một cách bất thường: SpaceXAI nói rằng Grok 4.7 được xây dựng trên một chồng biện pháp bảo vệ mới, rằng nó đứng đầu benchmark an toàn sinh học của LatchBio với 62,4%, và rằng trên HackerBench v0.3 của chính mình, nó chỉ cho qua 3,3% các prompt dual-use rủi ro trong khi hiếm khi chặn công việc bảo mật hợp pháp. Công ty cũng nói rằng họ đã bắt đầu cấp cho một số đối tác an ninh mạng được chọn quyền truy cập chỉ theo lời mời vào các năng lực red-team của mô hình. Hãy coi tất cả những điều đó là việc nhà cung cấp tự kiểm nghiệm mô hình của chính mình — đó là một tập hợp tuyên bố đủ cụ thể để có thể kiểm chứng sau này, chứ không đồng nghĩa với việc đã được kiểm chứng ngay bây giờ. Dòng định vị một câu trong bài đăng ra mắt, "nhanh gấp đôi, với giá bằng một nửa so với các mô hình tương đương", là tiếp thị về các đối thủ hơn là một phép đo Grok 4.7, và con số tốc độ độc lập ở dưới không ủng hộ nửa "nhanh gấp đôi" của tuyên bố đó.

Những gì một đơn vị đánh giá độc lập đã đo lường
Artificial Analysis là nguồn duy nhất trong câu chuyện này không có lợi ích liên quan đến mô hình, và trang Grok 4.7 của nó ghi rõ là cấu hình xhigh. Đọc ngày 28 tháng 9 năm 2026:
• Trí tuệ — 46 trên Artificial Analysis Intelligence Index, phiên bản chỉ số v4.3.2, đứng thứ 21 trong số 211 mô hình trên bảng xếp hạng đó và cao hơn hẳn mức trung vị 26 của chỉ số. Chỉ số đó là tổng hợp của mười đánh giá: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience và AA-LCR v1.1.
• Chi phí — $3.74 để chạy Intelligence Index một lần, với cùng một đơn vị đánh giá công bố mức chiết khấu bộ nhớ đệm ở 75% và mức giá đầu vào/đầu ra khớp với nhà cung cấp ($2.00 / $6.00). Nhận xét của chính nó là mô hình này "có giá hợp lý khi so sánh với các mô hình khác có mức giá tương tự".
• Độ dài dòng — 240M token đầu ra được tạo ra trên toàn bộ Intelligence Index, so với mức trung vị là 88M. Artificial Analysis gọi đây là "rất dài dòng", và đây là con số hữu ích nhất ở đây đối với bất kỳ ai đang lập ngân sách: một mô hình suy luận theo chuỗi dài hơn sẽ tốn nhiều chi phí hơn cho mỗi tác vụ ngay cả khi mức giá token cố định.
• Tốc độ — 82,6 token đầu ra mỗi giây, đứng thứ 83 trong số 211 trên bảng đó, dù vậy đơn vị đánh giá vẫn gắn nhãn "chậm hơn mức trung bình". Có hai lưu ý trước khi bạn mang con số này đi bất cứ đâu. Artificial Analysis đã thay đổi khối lượng công việc đo chuẩn mặc định của mình thành đầu vào 10.000 token để phản ánh sát hơn việc sử dụng trong sản xuất, và chỉ số tốc độ đã công bố của họ cho mô hình này đã thay đổi đáng kể giữa các ảnh chụp nhanh, nên hãy coi đây là ảnh chụp nhanh của một khối lượng công việc chứ không phải một hằng số. Về phía nhà cung cấp API, cùng đơn vị đánh giá đó chỉ có một nhà cung cấp được liệt kê cho mô hình — chính SpaceXAI — nên độ trễ đo được và mức giá kết hợp của nó là số liệu của bên thứ nhất, không phải mức chênh lệch thị trường.
Danh mục của chúng tôi có thêm ba kết quả Artificial Analysis cho Grok 4.7, được đánh giá vào ngày 21 tháng 9 năm 2026: 43,1% trên Humanity's Last Exam, 76,7% trên bài đánh giá truy hồi ngữ cảnh dài và 57,4% trên SciCode. Những kết quả này được dán nhãn là độc lập vì chúng đến từ Artificial Analysis, và đáng để đọc song song với các tuyên bố tự xác minh của nhà cung cấp, chứ không phải như sự xác nhận cho những tuyên bố đó.
Ghi chú so sánh trung thực: Các con số của SpaceXAI và các con số của Artificial Analysis được tạo ra trên những khung đánh giá khác nhau với những thiết lập mức độ nỗ lực khác nhau, và hai bên chưa từng được chạy đối đầu trong một cấu hình khớp nhau. Khi cùng một tên benchmark xuất hiện ở cả hai phía — AA Briefcase, Terminal-Bench 4.0 — đó là một tên dùng chung, không phải một lần chạy chung. Bất kỳ ai trích dẫn một con số của nhà cung cấp bên cạnh một con số độc lập như thể chúng là một phép đo duy nhất đều đang thực hiện phép tính mà bằng chứng không ủng hộ.
Nơi bạn thực sự có thể gọi nó
Grok 4.7 đã có thể gọi được kể từ ngày ra mắt thông qua API riêng của SpaceXAI tại api.x.ai, bằng cách sử dụng Responses API hoặc Chat Completions, và thông qua endpoint khu vực chỉ dành cho Hoa Kỳ với mức giá cao hơn 10%. Đây là mô hình mặc định của agent lập trình Grok Build và có mặt trong Cursor trên mọi gói, trong khi biến thể Fast — cùng mô hình nhưng với mức giá gấp đôi — bị giới hạn ở hai bề mặt đó và không có trong API công khai. Ngoài quyền truy cập bên thứ nhất, nhà cung cấp mô tả nó có sẵn thông qua các coding harness, bộ định tuyến mô hình và nền tảng đám mây của bên thứ ba.
Cụ thể về phía chúng tôi: grok/grok-4.7 đã có mặt trong danh mục OrcaRouter ngay hôm nay, được định giá theo đúng mức giá niêm yết của chính xAI với mức cộng thêm 0% và có thể gọi trên một trong hai endpoint bằng cùng một key như phần còn lại của dòng Grok. Nếu bạn đang đánh giá nó so với Grok 4.6 — cùng giá, cùng cửa sổ ngữ cảnh, nhưng bên dưới là một mô hình khác — thì định tuyến cả hai qua một endpoint với chuỗi chuyển đổi dự phòng tự động là cách rẻ để tìm ra mô hình nào mà workload của bạn thực sự thích hơn, thay vì cam kết một đường production cho mô hình mới hơn chỉ dựa trên bảng của nhà cung cấp.

Những điều cần theo dõi, xét cho cùng thì hồ sơ vẫn còn quá mỏng. SpaceXAI chưa công bố số lượng tham số, và câu hỏi về giới hạn đầu ra thực sự vẫn còn để ngỏ — việc nhà cung cấp nói "không có giới hạn đầu ra văn bản" so với mức 450K mà trang của chính chúng tôi hiển thị là một mâu thuẫn chưa ai giải quyết. Không có so sánh đối đầu trên cùng một giàn kiểm thử với những mô hình mà nó được bán để cạnh tranh. Và chỉ số tốc độ ở trên là con số dễ biến động nhất, vì nó đã biến động rồi. Đó là ba chỗ mà trang này sẽ cần chỉnh sửa khi hồ sơ dần được điền đầy, và nói thẳng như vậy tốt hơn là giả vờ rằng thông số kỹ thuật đã ngã ngũ.
Grok 4.7 hiện đã có thể định tuyến trên OrcaRouter, và Grok 4.6, Grok 4.5, Grok 4.3 cùng dòng Grok 4.20 cũng vậy. OrcaRouter chuyển tiếp nguyên mức giá niêm yết của nhà cung cấp mà không thu thêm phụ phí, nên ngưỡng prompt hai bậc của SpaceXAI và mức giá cache của nó sẽ áp dụng ở phía chúng tôi ngay cùng ngày chúng thay đổi ở phía họ, còn việc thử nghiệm một khối lượng công việc với các mô hình Grok cũ hơn, rẻ hơn chỉ là đổi một chuỗi ký tự chứ không phải ký thêm một hợp đồng thứ hai.
So sánh trong bài viết này3
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
