
Grok 4.6 發布日期:已於8月12日發售,價格同為 $2/$6
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0241智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0340智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69程式
2026年8月12日星期三,這個頁面所圍繞的問題不再是問題:Grok 4.6 正式發布。SpaceXAI——自2026年2月收購該新創公司並於7月更名以來一直營運Grok的公司——以與Grok 4.5相同的$2/$6價格、相同的V9基礎、相同的50萬token上下文視窗發布,馬斯克在X上稱其為「神作」。這次發布解決了此頁面先前版本追蹤的兩個問題:該模型確實存在,而且是同規模的訓練後調整,而非規模升級。唯一沒有解決的是參數數量,官方仍未公開。
一週前,誠實的頭條標題是:該模型尚未出貨——馬斯克於7月27日設定的「大約8月7日」目標已經延後,而「規模不變」的解讀仍只是預測。本頁主張,將該模型視為在規模不變下的更新版本最為合理,而規模不變的更新版本通常出貨時不會調漲價格。發佈當天完全證實了該判斷的商業層面——每百萬個token的價格為2美元/6美元/0.50美元,與Grok 4.5完全一致——而首批獨立測量結果現已出爐。以下說明實際出貨的內容、目前數據顯示的結果,以及仍屬廠商單方面宣稱的部分。
8月12日發貨了什麼
Grok 4.6 已上線於 SpaceXAI API,以模型 ID grok-4.6 提供,同時也整合於 Grok Build、Cursor 與 Grok Bot 應用程式中;Cursor 和 Grok Build 使用者在第一週可獲得兩倍的內含用量。這是一個具有延伸思維鏈(chain-of-thought)的推理模型,接受文字與圖像輸入,並產生文字輸出,同時在預設之上新增了一個 xhigh 推理強度設定。
The API keeps OpenAI-compatible endpoints and adds three tools on the server side: web search, X search, and code execution. For anyone already talking to Grok 4.5 over an OpenAI-compatible endpoint, that means the switch is a model-string change rather than a client rewrite.
此頁面預測了什麼——以及最終成真的事
先前版本的主張是,馬斯克所稱「SFT 與 RL 顯著改善的 1.5T 模型」指向一次同規模的更新,且價格將維持不變。此次發布證實了這項商業判斷的兩個部分:
• 價格:每百萬個token為 $2 / $6 / $0.50(快取命中)——與 Grok 4.5 相同。「價格不變」的預測成立。
• 上下文: 500K tokens,與 Grok 4.5 相同。
• 規模:仍屬官方未公開。模型卡中並未列出參數數量,因此馬斯克的 1.5T 數字仍是目前可得的最佳說法,而非經證實的規格。早期報導中流傳的 2T 數字,是誤將 Grok 4.7 的 2.1T 歸因所致。

獨立分數 — 61 在 Artificial Analysis Intelligence Index 上
第一個第三方評測結果出爐了,而且成績相當亮眼。Artificial Analysis 在 Intelligence Index 上將 Grok 4.6 評為 61 分,與 GPT-5.6 Sol 的最大推理配置持平,落後 Claude Fable 5(62)一分,落後 Claude Opus 5(63)兩分,並領先 Kimi K3(60)。這比 Grok 4.5 的 56 分高出五分,對一次後訓練更新來說是很大的躍進。
關於這個數字,有兩點需要注意。該指數是綜合指標,而各別維度的表現則參差不齊。此外,Grok 4.6 啟動緩慢:首次生成 token 的時間為 42 秒,而其價格等級的中位數約為 2.9 秒;每秒輸出約 68 個 token,也低於同級平均。對於長時間運行的代理而言,這只是雜訊;但對互動式聊天來說,這卻主導了整體體驗。
在智慧與成本的帕累托前沿上,情況令人滿意:大約每個任務 0.84 美元,完成典型的 AA-Briefcase 工作量約需 53 輪和約 0.5B 輸入 token,而 Claude Opus 5 Max 則約需 103 輪和約 2B。這使它成為名副其實的前沿划算之選,而不僅僅是便宜貨。
什麼仍然是供應商陳述的?
SpaceXAI 的發布宣稱——「智慧可比 GPT-5.6 Sol 與 Claude Fable 5」,在所列出的每一項評測上都優於 Grok 4.5,並歸因於「更長時間的補充訓練、更強的工程數據,以及擴展的強化學習」——這些都是廠商自行陳述,尚未經獨立驗證。發布的基準測試表(CursorBench、FrontierCode、APEX-Agents、Terminal-Bench,以及宣傳的 GDPval-AA v2 上 1,753 Elo)為 xAI 所報告;這些數據至今尚未有任何不出售該模型的實驗室重現。
第一份第三方讀數已出爐(初步)
目前唯一一項獨立的競技場結果雖屬初步,但真實存在。LMArena 將 Grok 4.6(以 grok-4.6-high 為名)列入第#43名,於其文字總體排行榜上,獲得1,464 Elo(來自 2,448 票)——被標記為初步數據,且比 Grok 4.5 初次登場的 1,468 分低 4 分。這個樣本數對 LMArena 追蹤的前沿榜而言太小,因為該榜需要連續兩週的持續分數。
實盤時段的代理商排行榜尚未發布。一旦發布,它將是第一個無法提前針對性地優化的讀數。

價格計算
在 $2/$6 的定價下,Grok 4.6 是目前這一代中最便宜的前沿 API,而且差距非常大。對比 GPT-5.6 Sol 的 $5/$30,輸入便宜 60%,輸出便宜 80%——而且因為輸出端的差距更大,「半價」這類行銷說法反而低估了在輸出密集型程式設計工作負載上所能節省的成本。
細則:超過 200K 輸入 token 的請求會升至 $4 / $12 / $1 級別,而更快的版本價格為兩倍。至於切換,計算上幾乎沒有差別——Grok 4.5 和 Grok 4.6 價格與上下文相同,因此在兩者之間切換只是配置變更,而非預算決策。
因為 OrcaRouter 以 0% 加成直接傳遞供應商列表價格,grok-4.6 端點上的 $2/$6 是 SpaceXAI 自己的價格,而非轉售費率——供應商降價會在同一天反映在此,而故障轉移到第二家供應商是路由規則,而非採購流程。
Grok 4.7 和 Grok 5 仍然領先
Grok 4.7 是下一步,馬斯克的描述沒有改變:「2.1T 模型」,在「各方面」都比 Grok 4.6 更好,「只是提供服務的速度稍慢一些」。8 月 5 日他表示還要三到四週,也就是八月下旬或九月初。這個時間表是馬斯克說的,而且每次說法都往後延,所以請把它視為方向性的參考。
Grok 5 將於年底推出,根據8月4日的財報電話會議,其訓練數據為「SpaceX 迄今所產生的幾乎所有數據。」
接下來要檢查什麼
有四件事會使全貌更加明確,而每一件目前都顯示為未定狀態:
• LMArena Agent 排行榜,截至8月13日尚未發布。
• 第三方對 coding 與 agentic 評測數據的復現 — DeepSWE、CursorBench、APEX-Agents — 出自未販售該模型的人士。
• 更快的變體在廣泛普及後的實際價格與延遲。
考量到迄今為止每個具體日期都比預期晚了幾天,Grok 4.7 能否維持八月下旬的時程仍是未知數。
而真正對決策有影響的,是你自己的工作負擔。排行榜名次只是對你任務的一種假設,而非任務本身的成果。
常見問題
Grok 4.6 實際上何時發布?2026年8月12日,在 SpaceXAI API 和 Grok Build、Cursor 以及 Grok Bot 應用程式中發布。馬斯克在7月27日所說的「大約8月7日」的目標延遲了五天;8月4日財報電話會議上「下週」的說法才是準確的時間窗口。
Grok 4.6 的費用是多少?每百萬個 token 收費 $2 / $6 / $0.50,與 Grok 4.5 相同,且遠低於 GPT-5.6 Sol 的 $5/$30。當輸入超過 200K 個 token 時,費用會提高至 $4 / $12 / $1;而更快的變體則需雙倍費用。
Grok 4.6 是 2T 模型嗎?沒有公布參數數量。Musk 的 1.5T 數字仍是目前最佳(未經驗證)的說法;流傳的 2T 數字是 Grok 4.7 的 2.1T 被誤歸為 4.6。
Grok 4.6 是否與 GPT-5.6 Sol 一樣好? 在 Artificial Analysis Intelligence Index 上,兩者並列 61 分(最大推理配置)。供應商宣稱它可與 GPT-5.6 Sol 和 Claude Fable 5 相提並論。它的首次輸出延遲(time-to-first-token)明顯較慢,但價格遠為低廉;其代理能力的優勢仍有待獨立驗證。
這對你意味著什麼
實際做法與本頁發布前的版本相同。若您的程式碼已透過 OpenAI 相容端點與 Grok 4.5 對接,Grok 4.6 僅是同等價格的組態變更——切換模型字串、維持預算額度,並重新執行評估,因為這是一個全新版本。若尚未對接,單一的原價轉售端點即可讓新前沿模型輕鬆切換,無需將生產路徑押注在其首週的基準測試上,而那些初步的 arena 分數正是此類基準測試。

本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
