
Mercury 2.5 Preview 對決 Grok 4.6:每秒 1,107 token 的預覽版能否撼動性價比之王?
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-ai新Z.ai: GLM 5.3 Flash2026-08-2658智能72程式
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1860智能75程式
- obsidianQwen3.8 27B2026-08-1552智能68程式
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69程式
- grokSpaceXAI: Grok 4.62026-08-1261智能77程式
- metaMeta: Muse Spark 1.22026-08-0557智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
答案用一句話來說:Mercury 2.5 Preview 是目前正式上線中最便宜且可信的推理模型,每百萬 tokens 收費 $0.04 / $0.15;而 Grok 4.6 是智慧前沿最便宜的模型,每百萬 tokens 收費 $2.00 / $6.00——因此兩者之間的實際問題是:Inception 僅聲稱「可比擬」GPT-5.6 Luna (Low) 和 Claude Haiku 4.5 的預覽擴散模型,是否能勝任那些你原本願意為前沿等級付費的工作。Mercury 2.5 Preview 於 2026 年 8 月 31 日發布,可並行生成 tokens,並宣稱在標準 GPU 上每秒可處理 1,107 個 tokens;Grok 4.6 是於 2026 年 8 月 12 日發布的前沿旗艦,在 Artificial Analysis Intelligence Index 上獲得 61 分,與全球第 3 名並列,而且定價是前沿級別前所未見的。這個碰撞——價格曲線最底端的最快宣稱,遇上價格曲線最頂端的最佳性價比——正是本文要探討的重點。
關鍵要點
• Grok 4.6 以 $2.00 / $6.00 的定價與 61 的 AA Intelligence Index,成為前沿級別的性價比冠軍;Mercury 2.5 Preview 以 $0.04 / $0.15 的定價,賭的是「夠用就好」的品質只要五十分之一的價格,便能勝過你鮮少需要的頂尖品質。
Mercury 2.5 Preview 在速度與品質方面的說法完全來自 Inception;發布首日並不存在任何獨立的基準測試分數。
• Mercury 2.5 Preview 的 80% 上市折扣將於 2026 年 9 月 8 日到期,之後的定價為 $0.20 / $0.75——輸入方面仍比 Grok 4.6 便宜 10 倍,但就沒那麼引人注目了。
• Grok 4.6 目前已在 OrcaRouter 上以列表價格進行路由;Mercury 2.5 Preview 尚未被路由,目前透過 Inception 自家 API 及數個第三方平台提供服務。
計分板

• 智慧 — Mercury 2.5 Preview:沒有獨立指數;Inception 宣稱與成本最佳化等級相當。Grok 4.6:AA 智慧指數 61,全球並列第 3(根據 Artificial Analysis;實驗室自己的數字為廠商申報)。
• 價格 — Mercury 2.5 預覽版:每 1M 個代幣 $0.04 / $0.15(較 $0.20 / $0.75 便宜 80%,優惠至 2026 年 9 月 8 日)。Grok 4.6:每 1M 個代幣 $2.00 / $6.00;提示詞達到或超過 200K 個代幣時,價格加倍至 $4.00 / $12.00。
• 速度 — Mercury 2.5 Preview:宣稱 1,107 tokens/sec(廠商數據)。Grok 4.6:速度並非主打規格;此模型是為長時間的代理執行而設計,而非快速串流。
• 上下文 — Mercury 2.5 Preview:260K。Grok 4.6:500K。
• 代理式工作 — Mercury 2.5 Preview:沒有公開分數,但支援平行工具呼叫。Grok 4.6:APEX-Agents 57.5、DeepSWE v1.1 65.9、CursorBench v3.2 69.9(供應商回報,大多未經重現)。
• 權重 — Mercury 2.5 預覽版:封閉、專有。Grok 4.6:封閉、專有。
價值冠軍與價格跳過
Grok 4.6 的定位很不尋常。它在 Artificial Analysis 指數上名列智慧表現第三名,與 GPT-5.6 Sol Max 並列,同時比所有與它差距在十分以內的模型都更便宜;其發布報導也強調長時間執行的代理任務在一個供應商評測中平均每個任務成本約 0.84 美元。這就是價值冠軍的定義:接近前沿等級的能力,配上讓每個任務成本在試算表上一目了然的價格。Mercury 2.5 Preview 並不打算成為那樣的產品。Inception 將它定位為與 GPT-5.6 Luna (Low)、Gemini 3.5 Flash-Lite、Claude Haiku 4.5 等模型競爭——屬於成本最佳化等級,而非前沿等級。如果 Inception 是對的,那麼 Mercury 2.5 Preview 在能力上比 Grok 4.6 低一個等級,在價格上則低了數個等級,這是一個完全自洽的產品:對於那些使用前沿等級純屬浪費的工作負載,它提供了一個跳過高昂價格的選擇。
平行解碼實際上改變了什麼
架構本身才是真正值得理解的部分,因為它改變了「快」的意義。自迴歸模型每一步只產生一個 token,因此吞吐量受到序列延遲的天花板限制;而像 Mercury 2.5 Preview 這樣的擴散式 LLM 會平行產生一整塊 token,再透過去噪步驟逐步精煉,這使得吞吐量與所產生的 token 數量脫鉤。這就是為什麼 Inception 能在標準 GPU 上宣稱每秒 1,107 個 token——無需特殊加速器,也無需批次處理技巧——也是為什麼真正的產品賣點是互動式工作負載的 300 毫秒以內首 token 延遲。對語音代理、搜尋管線,或每一輪都會呼叫模型的編碼子代理來說,這個延遲差異就是產品本身:它決定了語音迴圈是感覺即時,還是會卡頓。問題在於,擴散式語言模型仍是個年輕的研究領域,1,107 這個數字出自 Inception,而且目前沒有任何獨立實驗室重現過這個速度,或測量過平行生成在長提示詞或對抗性提示詞上可能引入的品質漂移(如果有的話)。
在Grok 4.6仍然稱霸的領域
關於 Mercury 2.5 Preview 的一切,都無法觸及 Grok 4.6 實際勝出的市場區塊。Grok 相較於 Grok 4.5 的增長集中在代理式(agentic)與程式碼基準測試——DeepSWE 上升 11.9 個百分點、APEX-Agents 上升 10.4、Terminal-Bench 上升 10.3——而且其 500K 上下文視窗,是為了那些必須在上下文中掌握整個任務的長程代理(long-horizon agents)而存在。Mercury 2.5 Preview 提供平行工具呼叫,但一個沒有獨立代理式評分、輸出上限 65,536 個 token、上下文僅 260K 的模型,並不是用來執行 50 步驟軟體工程任務的工具。這兩個模型在使用上幾乎沒有重疊:Grok 4.6 是讓工作真正完成的引擎;Mercury 2.5 Preview 則是讓工作感覺即時、每次呼叫成本幾乎為零的引擎。
打二折的視窗
這裡的定價有到期日,而這會改變決策。Mercury 2.5 Preview 的 $0.04 / $0.15 費率,比 $0.20 / $0.75 的牌價便宜 80%,Inception 也表示這項促銷將持續到 2026 年 9 月 8 日。Grok 4.6 的 $2.00 / $6.00 是穩定且結構清晰的牌價——快取輸入 $0.50、優先層級為 2 倍,以及提示詞超過 200K tokens 時的長提示詞階梯收費,會以較高費率計費整個請求。若比較今天的數字,Mercury 在輸入端看似便宜 50 倍、輸出端便宜 40 倍;若折扣如期到期,真正的長期差距是輸入端 10 倍、輸出端 5 倍。兩種說法都不算誤導——只是時間跨度不同;以折扣價計價卻沒有重新評估點的管線,到了 9 月 9 日就會措手不及。Grok 4.6 的 $2.00 / $6.00 正是你在 OrcaRouter 上支付的價格:供應商的牌價以 0% 加價直接轉嫁——當供應商更改數字時,同一天就會在同一個 key 上即時生效;若任一供應商路徑發生速率限制,則會自動故障轉移。
一句話的結論
如果任務必須如期完成,而你想要在該級別以最佳價格取得前沿能力,那就買 Grok 4.6——它是經過實證的性價比冠軍,今天已在 OrcaRouter 上以 $2.00 / $6.00 上線。如果任務屬於高流量、對延遲敏感的文字推理,而且「夠好」的答案驗證起來很便宜,那麼 Mercury 2.5 Preview 的 $0.04 / $0.15 就是折扣期間內值得一試的價格跳級——只是請記住,它那一側的所有宣稱都出自 Inception,而證明仍然懸而未決。


OrcaRouter 以 0% 加價傳遞供應商列表價格,並配備自動故障轉移功能,因此供應商價格變更會在當天於同一個金鑰上即時生效。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
