
GPT-6 Sol 對比 Qwen 4 Max:輸入價格平分秋色,其他幾乎所有項目卻無法相提並論
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
這就是讓GPT-6 Sol與Qwen 4 Max這個組合格外值得單獨用一頁來討論的數字:兩者的定價都是每百萬輸入 token 2.00 美元。這正是這場比較中真正可用的部分起點,而對 Qwen 4 Max 來說,也幾乎就是終點。該公司於 2026 年 9 月 22 日在雲棲大會上宣布 Qwen 4 Max 這個層級——正是 GPT-6 Sol 發布的同一天——而截至本文撰寫時,它並沒有已發布的模型卡:沒有價格、沒有上下文視窗、沒有權重說明,也沒有任何評測者給出的分數。真正有實測數據、而且你今天就能呼叫的 Qwen 旗艦,是Qwen3.8 Max,於 2026 年 8 月 3 日發布,定價 $2.00 / $6.00。所以,實際的問題並不是 Qwen 4 Max 對上 GPT-6 Sol 的表現如何。問題在於,這個已宣布的層級透露了該公司旗艦產品的走向,以及你實際能路由使用的 Qwen 與今天的 GPT-6 模型相比表現如何。
這種區分並非吹毛求疵。一個已宣布但尚未具體說明的層級,可以吸納你想對它做出的任何假設;而一篇文章若悄悄假設 Qwen 4 Max 勝過 GPT-6 Sol——只因版本號更高——就是在提出一個廠商並未提出、證據也不支持的論點。
目前可以比較的三件事
• 輸入價格 — GPT-6 Sol 每百萬 $2.00 對比 Qwen3.8 Max 每百萬 $2.00,完全打平
• 輸出價格 — GPT-6 Sol 每百萬 $10.00 對比 Qwen3.8 Max 每百萬 $6.00
• 快取輸入 — GPT-6 Sol 每百萬 $0.20 對比 Qwen3.8 Max 每百萬 $0.25
• 上下文視窗 — GPT-6 Sol 1,050,000 個 token 對比 Qwen3.8 Max 1,000,000 個 token
• 輸入模態 — 兩者皆接受文字、圖像以及影片或檔案;GPT-6 Sol 為文字、圖像與檔案,Qwen3.8 Max 為文字、圖像與影片
• 長請求級距 — GPT-6 Sol 在輸入超過 272,000 個 token 時,會將整筆請求重新計價為 $4.00 / $15.00,對比 Qwen3.8 Max 在其定價卡上無此級距
• 智慧指數 — GPT-6 Sol 47.6 對比 Qwen3.8 Max 45.4
• 程式編寫指數 — GPT-6 Sol 在此修訂版本未公布,對比 Qwen3.8 Max 76.2
• GPQA Diamond — GPT-6 Sol 96.1 對比 Qwen3.8 Max 92.8
• Terminal-Bench 4.0 — GPT-6 Sol 43.9 對比 Qwen3.8 Max 38.9
其中有兩列值得細究。快取輸入那一列與這個模式相悖——Qwen3.8 Max 每百萬次快取讀取的收費比 GPT-6 Sol 高出五美分,而在以快取為主的代理迴圈中,這正是最先跳動的計費指標。至於長請求條款,則是輸入價格平手局面徹底打破之處:在輸入價格正好 $2.00 時,兩者看似可以互換,直到提示超過 272,000 個 token,此時 GPT-6 Sol 的整個請求會重新計價為 $4.00 / $15.00,而 Qwen3.8 Max 的方案卡上完全沒有對應的級距。在完整上下文的提示下,該公司的模型不只是輸出更便宜。它還是兩者之中唯一能從標題價格預測其公布費率的模型。
兩件不能相提並論的事,以及為什麼這個差異很重要
首先談的是 Qwen 4 Max 的能力。該公司把它呈現為產品陣容中的一個層級,而不是一款產品:沒有基準測試表、沒有上下文數字、沒有關於權重的說明、沒有費率。所有關於它將如何表現的內容,都是從 Qwen 產品線的發展軌跡推估而來,包括這句話。唯一清楚可辨的是目標——它取代的層級,以及後繼者正被打造來超越的模型——而這告訴你的是行進方向,而非目的地。
第二個是開放權重(open-weight)的問題,也是在您規劃以 Qwen 4 Max 部署之前,最值得先提出來的一點。該公司只公開 Qwen 系列部分成員的權重,其他部分則未公開。旗艦款 Qwen3.8 Max 被列為封閉 API 模型——沒有授權檔案,也沒有可下載的檢查點——儘管同一世代中較小的同系列模型是公開的。4 系列旗艦究竟會跟隨較小的同系列模型,還是維持封閉,目前尚無答案;而若團隊抱持開放權重的期待來制定自架計畫,等於是在押注一個當前旗艦並未立下的先例。
真正會拿來比的是 GPT-6 Sol 對上 Qwen3.8 Max,而這比世代數字所顯示的更接近:在 Intelligence Index 上分別是 47.6 對 45.4,兩個數字都是第三方在同一修訂版上的結果,而 GPQA Diamond 則是實實在在的 96.1 對 92.8。在輸出價格為四分之三的情況下,2.2 點的指數差距是這場對決目前最緊繃的版本,而在該公司為 4 系列發表任何東西之前,這正是應該據以推論的那一個。

這項公告本身究竟是什麼的證據
一個已宣布但尚未明確規格的等級並不是空洞的訊號。它告訴你,該公司打算讓其下一款旗艦產品位居產品線之巔,而且願意在它準備好之前就公開命名,這是一種溝通習慣的改變,而不是能力上的宣稱。它同時也設下了一個時鐘:九月宣布的等級會讓人預期出貨時程,而宣布與規格之間的落差,通常正是競爭定位發生的地方。
對於任何使用 Qwen3.8 Max 的人來說,實際結果是:這次遷移將是能力問題,而不是成本問題。Qwen 3 Max 準備切入的層級,價格已經落在 $2.00 / $6.00,而後繼者必須擊敗一個得分 45.4、輸出成本卻比 GPT-6 Sol 低三分之一的模型。它是否也能拉近與 47.6 的差距——以及何時拉近——是唯一值得追蹤的事,而公告中沒有任何內容能回答這一點。

路由一個尚不存在的模型
這段對話中的兩個 Qwen 模型,只有一個在我們的目錄中,而且不是 4 系列。Qwen3.8 Max 是透過 OrcaRouter 以模型 ID qwen/qwen3.8-max 進行路由,與 GPT-6 Sol 及 200 多個其他模型共用同一組金鑰;而這樣的搭配正是其價值所在:當該公司發布後繼型號時,這不過是路由變更,而不是整合專案。Qwen 4 Max 會在真的有東西可路由時——無論是一張卡、一個費率、一個端點——才會加入,而且不會提早,因為針對尚未寫定的規格來販售一個席次,沒有任何負責任的方式。
與此同時,之所以值得把這兩欄都留著,是因為這兩個模型對「哪裡便宜」的看法並不一致。Qwen3.8 Max 在輸入價格上分毫不讓,輸出費率則比 GPT-6 Sol 便宜三分之一,而且沒有長脈絡的斷崖;GPT-6 Sol 的指數略勝一籌,快取輸入折扣也優厚得多,代價是請求一旦超過 272,000 個 token,就得整筆重新計價。又長又偏重輸出的工作負載,和短小、對快取友善的工作負載,要的是不同答案,而兩者只差一條路由規則,不是兩場採購會談。
容錯移轉在這裡之所以重要,原因與這組對戰組合的特定情境有關。Qwen3.8 Max 是我們路由上的高流量模型——七天內超過 1.1 億個 token——而流量正是讓端點差異現形的關鍵。在其背後配置第二條路由,意味著主要端點效能下降時只需重試;而公司價目表上的費率變更——正是旗艦模型交棒會產生的那種事件——在我們這邊當天就會生效,因為我們的目錄以零加成直接傳遞供應商的定價。

這個月要怎麼處理這個?
如果你現在就需要一款 Qwen 旗艦,該選的是 Qwen3.8 Max,而它在推理上足以與 GPT-6 Sol 競爭,輸出費率卻明顯更低——這就是這場對決今日的真實情況。若論這組之中推理基準上最強的公開發表結果,GPT-6 Sol 的 47.6 就是那個數字,而且它的快取輸入折扣是本次比較中最便宜的。如果你在等 Qwen 4 Max,請等一個時程,而不是等一個日期,因為那則公告只給了你層級,其餘什麼都沒有。
而無論你選哪一個,在決定投入之前,先查看 GPT-6 那一邊。GPT-6 Sol 早已被 GPT-6.1 Sol 取代,價格同樣是 $2.00 / $10.00,快取輸入更減半至 $0.10,而且它自己的模型頁面現在會把讀者重新導向到後者。拿 GPT-6 Sol 來比較,等於是在跟一個後繼型號已經開賣的模型比較;同樣的告誡也適用於任何從 4 Max 發布消息衍生出的 Qwen 數字:兩者都是新聞的形態,而現在只有其中一個是可購買的產品。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
