
GPT-6 Sol Pro 對決 DeepSeek V4 Pro:固定費率對上時程表
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0345智能76程式
GPT-6 Sol Pro 與 DeepSeek V4 Pro 是目前透過 API 執行嚴肅推理工作負載最便宜的兩個可信選項,而且它們的定價原則截然不同。GPT-6 Sol——gpt-6-sol-pro 組態所執行的該廠商模型,自 2026 年 9 月 22 日起正式可用——每天每個小時的價格都是每百萬個輸入 token 2.00 美元、每百萬個輸出 token 10.00 美元。DeepSeek V4 Pro——其 0813 檢查點於 2026 年 8 月 13 日正式可用的開放權重旗艦模型——在一週中大多數時間的價格為 0.66 美元與 1.98 美元,而在平日早晨的兩個短暫時段則正好是兩倍。任何引用單一費率的比較,都只引用了半個價格。
時程才是關鍵。這場對決的其他一切——指數分數、上下文視窗、授權條款——都取決於一個事實:這兩家供應商之一已決定,其標價是時鐘的函數。
每一條價格線實際上究竟是什麼
GPT-6 Sol 的價目表只有一行。每百萬個 token 的輸入為 $2.00、快取輸入為 $0.20、快取寫入為 $2.50、輸出為 $10.00,且一旦超過某個輸入門檻,就會對整個請求套用長上下文重新計價。沒有時間維度,也沒有促銷期間。OpenAI 於 9 月 22 日將前代模型降價至這些數字,並稱其為永久價格。
DeepSeek 的費率表是一張表格。依據供應商自家的定價頁面所載:
• 離峰輸入 — 每百萬權杖 $0.66,快取未命中;每百萬權杖 $0.022,快取命中
• 離峰輸出 — 每百萬個 token 1.98 美元
• 峰值輸入 — 每百萬個權杖 $1.32,快取未命中;每百萬個權杖 $0.044,快取命中
• 峰值輸出 — 每百萬個 token $3.96
• 高峰時段 — UTC 01:00–04:00 與 06:00–10:00,週一至週五,中國法定假日除外
• 其餘所有時段——離峰時段,涵蓋整個週末;這項規定自北京時間 2026 年 8 月 23 日午夜起生效
一週168小時中,有七天裡的五天、每天七小時的尖峰時段,大約占整體時間的21%採較高費率,79%採較低費率。所以,DeepSeek V4 Pro 誠實的單一數字總結既不是 $0.66,也不是 $1.32——而是落在兩者之間,至於落在哪裡,取決於你流量的型態,而不是供應商的慷慨。
這份表格所出自的那次重新定價
值得了解的是,這個價格結構有多新,因為幾乎每個比較頁面仍然引用它所取代的數字。2026 年 5 月 22 日,DeepSeek 將 V4 Pro 的限時折扣改為永久價格——降幅約 75%,降至每百萬個 token 輸入約 $0.435、輸出約 $0.87。
2026年8月17日北京時間午夜,情況遭到逆轉,而且還不只如此。尖峰/離峰制度正式上路,受影響的價目列平均上漲約3.5倍,最高達12倍——這12倍正好落在快取命中的輸入費率上,該費率在尖峰時段從每百萬個token ¥0.025漲到¥0.30。快取未命中的輸入上漲約200%,輸出則約350%。六天後,週末例外優惠被加入,只要能把批次作業移到週末的人,都能藉此收回部分漲幅。
由此可得出兩個結果。第一,任何告訴你 DeepSeek V4 Pro 是低於一美元級別模型的頁面,引用的都是已被取代兩次的價目表。第二,這次漲價的形態是一個訊號,說明 DeepSeek 正在為哪些目標做最佳化:漲幅比例最大的是快取命中,而這正是對那種工作負載——長時間的代理迴圈不斷重新傳送穩定前綴——最關鍵的費率,而正是這種工作負載從一開始就讓這個模型具有吸引力。

每個人都在引用的那個指數數字已不再使用。
Artificial Analysis 是這項比較的中立評測框架,而它在 2026 年間已多次為其智慧指數改版。在目前的榜單上,GPT-6 Sol 以最高強度運行時得分為 48,每項指數任務成本為 1.06 美元。DeepSeek V4 Pro 在 0813 檢查點、最高強度下得分為 36,每項指數任務成本為 0.67 美元。
DeepSeek 廣為流傳的分數是 53。這個數字是真的,而且確實曾被公布——在該指數較早的修訂版中,也就是在一次重新版本化、改動了大多數模型分數之前。拿一篇 v4.3 之前文章中的 53 與現行的 48 相比,等於是把已退役的測量值拿來跟現行測量值比較,而這正是這場對決中最常見的錯誤:聲稱這兩個模型彼此只相差一分以內。在現行指數上,它們相差十二分,而且每完成一項任務的價格差距並非表面費率所暗示的 3 倍,而更接近 1.6 倍,因為 DeepSeek 會花費更多 token 才能得出答案。
另外兩個獨立資料點也應並列在那些旁邊,且兩者都按其本質加以標示。Vals AI 採用隔離的測試框架,測得 DeepSeek V4 Pro 在 SWE-bench Verified 上達到 96.40%,每項測試成本為 0.103 美元——在該排行榜上僅次於 Claude Opus 5 的 97.00%,而且每項測試成本低廉,差距懸殊。Artificial Analysis 的編碼代理排行榜顯示,它在 Terminal-Bench 4.0 上為 14%,而 GPT-6 Sol 為 44%。第一個數字顯示,DeepSeek 在一項狹窄且定義明確的編碼任務上具有競爭力。第二個數字則顯示,它在代理式終端機工作上不具競爭力。兩者皆為真,且它們衡量的是不同事物。
當兩個模型在結構上不同,而不只是定價不同時
• 授權 — GPT-6 Sol 是封閉式 API,不公開權重;DeepSeek V4 Pro 採用 MIT 授權,並在 Hugging Face 上公開檢查點,包括可供持續預訓練的基礎變體
• 最大輸出 — GPT-6 Sol 128,000 個 token 對比 DeepSeek V4 Pro 384,000 個 token,上限為其三倍,輸出費率僅為五分之一
• 上下文視窗 — GPT-6 Sol 1,050,000 個 token 對比 DeepSeek V4 Pro 1,048,576 個 token,實際上完全相同
• 模態——輸入與輸出皆為文字;兩者在 API 上皆不接受圖像
• 長上下文定價 — GPT-6 Sol 會對超過其輸入閾值的整個請求重新定價;DeepSeek V4 Pro 的尖峰/離峰時段計費表是它唯一的價格結構
• 規模 — DeepSeek V4 Pro 是一款擁有 1.6 兆參數的混合專家模型,每個詞元有 490 億個活躍參數;OpenAI 並未公布 GPT-6 Sol 的對等數據
關於該參數量,有一點要說明,因為這是經常引起混淆的地方:某些清單中出現的 1.7 兆這個數字,是包含選用 DSpark 推測解碼模組在內的 Hugging Face 套件大小,而不是更大型的目標模型。已公布的架構總計為 1.6T。用四捨五入過的標示數值相減來推斷草稿模組的大小,並不是有效的計算;把較大的數字解讀為模型變大的證據,同樣也不是。

那項撤回,才是支持開放權重的真正論據。
2026 年 9 月 9 日,DeepSeek 宣佈將逐步淘汰 V4 Pro,並表示自 9 月 14 日 04:00 UTC 起,所有對 deepseek-v4-pro 模型字串的請求都會被路由至 DeepSeek V4.1 Flash,並以 Flash 費率計費,這種情況將持續到 V4.1 Pro 模型推出為止。該模型字串仍會回應。但它背後的模型,不會是任何人曾做過基準測試的那一個。
開發者提出反對,這項重導措施隨即被撤回。DeepSeek 的更新日誌現在指出,V4 Pro API 服務在 9 月 14 日之後仍持續提供,計費維持不變;而定價表依然將 deepseek-v4-pro 列為現行項目,有其專屬費率,且沒有下線標記。較早的公告頁面仍保留那段導引用語,因此兩份文件彼此矛盾——而當你實際呼叫該服務時,真正描述會發生什麼情況的,是現行的定價頁面。
那段插曲是整場對決中最有力的論點,而且它不是價格論點。閉源模型可以依廠商時程重新定價、重新導向或淘汰,而唯一的補救方式就是遷移。一個在公開儲存庫上具有 MIT 權重的模型,可以從你自己的基礎設施提供服務,這意味著你評估過的那個檢查點,就是你會繼續提供服務的檢查點,無論廠商的路線圖在六週後怎麼說。DeepSeek 在同一個兩週期間展示了風險,並提供了緩解方案。
持平而論,必須考量的另一面是:自行託管一個1.6兆參數的模型,並非多數團隊會輕率做出的決定。這是一個伴隨真實固定成本的實際選項,而非免費的避險手段。
路由層改變運算方式之處
DeepSeek V4 Pro 已上架OrcaRouter不額外加價,就此例而言,這意味著尖峰/離峰的界線出現在你帳單上的時間點,與出現在 DeepSeek 帳單上的時間點完全相同。
GPT-6 Sol 並非我們的供應路線之一,因此此處並無任何內容是關於透過我們取得其價格的聲明。

排程正是讓單一端點在這裡特別值得擁有的原因。可挪移的工作負載,價值是無法挪移者的兩倍,而挪移它是一項路由決策,不是遷移——同一把金鑰、同樣的請求形態,只是換個時段,或背後換成不同的模型。在單一端點上同時搭配 DeepSeek V4 Pro 與 DeepSeek V4.1 Flash,就是這件事更犀利的版本:相較於 V4 Pro 的離峰費率,Flash 模型在輸入上便宜 4.4 倍、在輸出上便宜 3.3 倍,而上下文視窗與尖峰時段完全相同,這使它成為那些完全不需要更大模型的流量最自然的目的地。自動容錯移轉之所以重要,理由始終如一——你的管線所賴以建立的廉價層級,不該是單點故障。
決策規則
• 可排程的批次與離線作業 — DeepSeek V4 Pro,並將它排進排程。日曆中百分之九十五的時間落在 $0.66 與 $1.98,週末更是完全離峰,是這份比較表上最便宜且可信的費率,輸入價格僅為其三分之一,輸出僅為其五分之一。
• 落在尖峰時段的延遲敏感互動流量——GPT-6 Sol。$2.00 與 $10.00 的均一價比 DeepSeek 的離峰費率更貴,也比什麼都沒有便宜,但可以事先得知,而且每天有兩小時,就輸出而言它是兩者中較便宜的一方。
• 使用大型穩定前綴的 Agent 迴圈——在選擇之前,先算一下快取命中的數學。DeepSeek 的快取命中輸入在離峰時段為 $0.022,是 GPT-6 Sol 的 $0.20 的九分之一,但這也正是 DeepSeek 在尖峰時段調漲十二倍的那一項。這項優勢確實存在,但它取決於時鐘。
• 任何受監管的東西,或任何你承受不起被改道的東西——DeepSeek V4 Pro,從 MIT 檢查點自行託管。九月的撤出正是這個案例研究,而比起任何按 token 的比較,它更是接受固定成本的更好理由。
• 凡是需要達到代理式能力最頂端者——GPT-6 Sol。十二個指數點與 Terminal-Bench 的三十分並非四捨五入的差異,而 DeepSeek 自家回報的數字也無法弭平這些差距。
固定費率和時段定價都是誠實的定價設計。它們只是回答不同的問題:一個告訴你每枚代幣要多少錢,另一個告訴你在你需要代幣時,代幣要多少錢。
本文中的比較3
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
