技術部落格首圖的編輯式平面向量插圖,主題為模型定價:一顆深藍色的大型圓角模型晶片,帶有柔和的青色光芒;其角落夾著一張紙質價格標籤;三條 token 流流入圓形價格儀表;以及一張細長的日曆紙滑入畫面。背景為柔和的淺藍色,下方三分之一處留有充足的空白空間。無文字。
Guides & Insights

DeepSeek V4 Pro API 定價:離峰時段 $0.73/$2.18,以及 9 月 14 日的停機為何被取消

作者

Rowan Sterling

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

DeepSeek V4 Pro 不會退役。2026 年 9 月 11 日,DeepSeek 表示將在 9 月 14 日之後繼續透過其 API 提供該模型,計費方式不變——推翻了兩天前宣布的計畫,該計畫原本會將每一個 deepseek-v4-pro 請求重新導向至 DeepSeek V4.1 Flash並以 Flash 費率計費。對於任何依據 V4 Pro 調校提示詞、溫度設定與工具呼叫結構描述的人來說,這正是本週真正重要的事實:你所對接建構的模型仍會留在原處,而你原本可能安排在下週一進行的遷移,並不需要發生。

價格又是另一回事,而這個頁面把它寫錯了一個月。DeepSeek V4 Pro 不再以每百萬個 token $0.44/$0.88 的價格計費。在離峰時段,OrcaRouter 上的計費為每 1M 個 token 輸入 $0.726、輸出 $2.178;在尖峰時段內則加倍至 $1.452/$4.356,快取讀取則為 $0.024。週末現在完全屬於離峰時段。而廠商自家的價目表——也就是 Deep​Seek 的 API 說明文件上的那一份——將延續通知作為同一張價格表的註腳,這幾乎是定價頁面所能達到、最接近一手來源的程度了。

Deep​Seek 實際上說了什麼,以及它推翻了什麼

時間順序很重要,因為這三則宣布中有兩則是互相推翻的,而中間那一則才是大家記得的。

• 9月9日 — DeepSeek 向使用者表示,在 V4.1 Pro 推出前,對 V4 Pro 的請求將被轉送至 DeepSeek V4.1 Flash,並按 V4.1 Flash 的費率計費。

• 9月10日 — V4.1 Flash 上線,而 DeepSeek 將切換時間改到固定時刻:2026年9月14日北京時間 12:00,之後 V4 Pro 將下線,其流量將由 Flash 承接。

• 9 月 11 日——DeepSeek 態度逆轉。其原文如今一字不差地作為註腳,刊載於自家 API 文件的「模型與定價」頁面上:「因應用戶需求,我們決定在 2026 年 9 月 14 日之後繼續為 DeepSeek V4 Pro 提供 API 服務,計費方式維持不變。若有任何變更,我們將另行通知。」

那是供應商在談論自家產品,而這也是這裡能取得的最有力依據——但請看清楚它解決了什麼、又沒解決什麼。它解決了延續性與計費問題:V4 Pro 會保留,費率也照現行標準。它並沒有承諾任何時間表。我們將另行通知就是這項承諾的全部,而同一句話也為該方案日後回歸留下了一扇門。如果你要做的是橫跨數個季度的承諾,請以你能隨時遷離的模型來規劃,而不是以你能留住的模型。

迫使當局逆轉決定的反彈值得理解,因為它正好對應到你或許即將親自做出的決定。開發者反對的並不是 V4.1 Flash——DeepSeek 表示它在效能、價格、速度和總任務時間上都勝過 V4 Pro——而是自動替換這件事。在穩定的模型 ID 背後更換模型,會在不改動程式碼的情況下改變行為:調校好的提示詞、能正常運作的 temperature、能順利解析的工具呼叫 schema,全都是特定檢查點的屬性。CLS(科創板日報)、36Kr、IT之家與 ifeng 的報導,以及 TheBlockBeats 的英文報導,都描述了 DeepSeek 先是延後、接著放棄這項計畫;DeepSeek 自家的文件把這個對比呈現得很清楚,因為舊有的 deepseek-v4-flash 名稱已被淘汰,如今改為提供 V4.1 Flash,而那次切換維持了下來。Pro 的切換則沒有。

今天的價格,已對照供應商自家的價目表核對。

Price card titled 'DeepSeek V4 Pro — price per 1M tokens', sourced 'OrcaRouter directory, checked 2026-08-15'. Three highlight cells read Input $0.442, Output $0.884 and Cache read $0.060 USD at zero markup. A row reads DeepSeek official rate (CNY, today): ¥3 in, ¥6 out, cache hit ¥0.025. Two columns show the August 17 change: off-peak input ¥4.5, output ¥13.5, cache hit ¥0.15; peak input ¥9, output ¥27, cache hit ¥0.30. Footer: peak output is 4.5x today's ¥6, off-peak is half of peak, peak windows Beijing weekdays 09:00-12:00 and 14:00-18:00.

有兩個數字很重要,而它們是以兩種貨幣表示的相同定價。

• 離峰時段(下列尖峰時段以外的每個小時)——快取未命中時,輸入每 100 萬為 $0.726,或 ¥4.5;輸出為 $2.178,或 ¥13.5;快取命中輸入為 $0.024,或 ¥0.15。

• 峰值 —— 正好是兩倍。輸入 $1.452 / ¥9,輸出 $4.356 / ¥27,快取命中輸入 $0.048 / ¥0.30。

• DeepSeek 自家的美元換算——該供應商的文件列出同一組人民幣價格,換算為離峰時段輸入 $0.66/輸出 $1.98,尖峰時段 $1.32/$3.96,快取命中則為 $0.022 與 $0.044。與 OrcaRouter 美元數字之間的差距,在於雙方換算所用的匯率,而非加收的 token 費用:OrcaRouter 以零加成直接傳遞供應商費率,因此價目表上的數字就是你實際支付的數字。

• V4 Pro 沒有免費方案。目錄中有免費的 Flash 方案,但旗艦版僅限付費。

• 規格表,供參考——V4 Pro 是一款以 MIT 授權條款釋出的開放權重模型,總參數 1.6T,每個 token 啟用 49B 參數,上下文視窗達 1M token,輸出上限為 384K token,並行上限為 500。Artificial Analysis 列出每秒 72.3 個輸出 token。

這一切背後的模型版本是 DeepSeek-V4-Pro-0813,自 8 月 13 日正式發布以來未曾改變——而這正是重點。9 月 11 日當天,檢查點本身沒有任何變動;變動的只有對其未來的決定。

尖峰、離峰,以及改變計算方式的週末規則

本頁較早版本提到將於8月17日上路的尖峰/離峰方案,如今已實施滿一個月,且自那以來已修訂過一次。

• 尖峰時段 — 週一至週五 01:00–04:00 與 06:00–10:00 UTC。換算成北京時間,分別是 09:00–12:00 和 14:00–18:00,也就是 DeepSeek 自己的工作時段。離峰費率正好是尖峰費率的一半,而不是疊加在尖峰費率之上的折扣級距。

• 週末完全屬於離峰時段。自北京時間 2026 年 8 月 23 日 00:00 起,DeepSeek 不再於週六及週日套用尖峰費率。如果你的批次工作可以挪動,把它移到週末就能讓帳單減半——而對服務美洲使用者的團隊來說,大半個工作週本來就落在離峰時段,完全不需要做任何排程安排。

• 相較於該模型 8 月 13 日推出時的 ¥3/¥6,這次變更的代價是什麼——今日離峰輸出是推出時價格的 2.25 倍,尖峰輸出是 4.5 倍;尖峰快取命中輸入是舊價 ¥0.025 的 12 倍。

這裡存在一種不對稱,說明了為什麼即使在關閉服務已取消之後,遷移問題仍不斷被提出。V4 Pro 的價格在 8 月上漲,而其後繼產品的價格卻下跌:DeepSeek 自 9 月 10 日起將 Flash 系列 API 價格調降最多 60%。遷移的壓力從來就不是真的來自 9 月 14 日的通知;那則通知只是讓它變得急迫。

一個請求的實際成本

三個計算範例,以今日的離峰費率計算。每一個在尖峰時段內都會加倍。

• 100K 輸入 + 50K 輸出 — $0.0726 + $0.1089 ≈ $0.18。

• 100萬輸入 + 100萬輸出 — $0.726 + $2.178 = $2.90。同樣那次呼叫在尖峰時段是 $5.81,而在八月中時是 $1.32。

• Agentic 工作階段,500K 輸入 + 200K 輸出 — $0.363 + $0.4356 ≈ $0.80。

每月檢視位於模型頁面上,是檢驗那個舊標題是否仍能描述你的帳單的誠實測試:在每月 1,000 萬個 token、輸入佔 70% 的情況下,成本計算機算出 $11.62,若開啟提示快取則約為 $9.16。如果你的預算是依據 $0.44 編列的,那現在只能支應約 60% 的帳單。

快取是沒人擺上桌的槓桿。

當費率上漲時,提示快取變得更具價值,而不是更沒有價值——而這兩個數字的方向正是原因所在。在 OrcaRouter 上,快取讀取現在每 1M 個 token 收費 $0.024,而未快取的則為 $0.726,也就是說,你重新送出的任何輸入都能享有 96.7% 的折扣。在本頁先前的版本中,快取費率為 $0.060,而輸入價格為 $0.442,折扣幅度為 86%。快取讀取價格下跌了超過一半,而未快取的輸入價格則上漲了 64%,因此快取與未快取 token 之間的實際差距大幅擴大了。

對於每一輪都會重新送出大型系統提示與長脈絡的 agent 來說,快取輸入就是一道分水嶺:帳單究竟會隨對話長度成正比攀升,還是不會。實務原則始終沒變,也值得一再重申:把穩定的系統提示與參考資料放在最前面,把易變的內容放在最後,這樣你重新送出的前綴才會真正命中快取。在這款模型上,光是這一個結構性選擇,價值就勝過其下任何路由或排程決策。

V4 Pro 定價與業界其他方案的比較

Comparison table card titled 'USD per 1M tokens — the field', sourced to the OrcaRouter directory checked 2026-08-15, with an input/output column pair per model: DeepSeek V4 Flash $0.15/$0.29; DeepSeek V4 Pro $0.44/$0.88 highlighted with a 'THIS PAGE' tag; MiniMax M3 $0.30/$1.20; Gemini 3.6 Flash $1.50/$7.50; Grok 4.5 $2.00/$6.00; Qwen 3.8 Max $2.00/$6.00; GPT-5.6 Terra $2.00/$12.00; Kimi K3 $3.00/$15.00; Claude Opus 5 $5.00/$25.00; GPT-5.6 Sol $5.00/$30.00; Claude Fable 5 $10.00/$50.00. Footer: V4 Pro is the cheapest 1M-context flagship, roughly 23x cheaper on input and 57x cheaper on output than Claude Fable 5.

目錄定價:每 1M 詞元的輸入/輸出價格,查核日期為 2026-09-12,對照 V4 Pro 離峰時段的 $0.726/$2.178。自從本頁首次發布以來,其中兩項已經變動,而其中一項會改變結論。

• Claude Fable 5 — $10 / $50。V4 Pro 的輸入便宜 13.8 倍,輸出便宜 23 倍。

• Claude Opus 5 — $5 / $25。6.9× / 11.5×。

• GPT-5.6 Sol — 上下文達 272K 以內為 $4 / $20,超過則為 $8 / $30。較短層級為 5.5× / 9.2×,較長層級為 11× / 13.8×。

• Kimi K3 — $3 / $15。4.1× / 6.9×。

• Qwen3.8 Max — $2 / $6。2.8× / 2.8×。

• Grok 4.5 — $2 / $6。2.8× / 2.8×。

• Gemini 3.6 Flash — $0.75 / $3.75。輸入價格大致持平,為 1.03 倍,輸出則為 1.7 倍。自本頁撰寫以來,其價格已減半。

• MiniMax M3 — $0.30 / $1.20。在兩方面現在都比 V4 Pro 便宜:V4 Pro 的輸入成本高出 2.4 倍、輸出成本高出 1.8 倍,且同樣具備 100 萬 token 的脈絡視窗。

• DeepSeek V4 Flash — 在目錄上為 $0.242 / $0.726。兩項價格都便宜約 3 倍,同樣具備 1M 上下文。

所以,誠實的定位已經改變了,這一頁應該如實說明,而不是沿用舊有的最高級說法。DeepSeek V4 Pro 不再是市場上最便宜的 1M 上下文模型:Gemini 3.6 Flash 與 MiniMax M3 都比它更低價,而 MiniMax M3 還能在提供相同上下文視窗的前提下做到這點。V4 Pro 仍然保有的、而且差距超過一個數量級的是:前緣層級中最便宜的選擇——那份名單上每一款西方旗艦級模型,在輸入與輸出兩條計價上都貴上它好幾倍。如果問題是「盡可能最便宜的 1M 上下文呼叫」,答案已經不再是這個模型。如果問題是「表現得像前緣模型的最便宜模型」,目前為止仍然是它。

當 V4 Pro 是錯誤的選擇時

• 如果你的流量在北京時間白天最為繁忙。尖峰時段費率加倍,而尖峰時段正好落在中國的工作日。如果你的使用者位於美洲,你的多數流量本來就落在離峰時段,這是一項實質的結構性優勢。如果你是要為中國的使用者打造服務,請在投入之前明確試算尖峰帳單——並確認週末規則是否能幫你挪移任何用量。

• 如果你的提示詞很短,在大約 10K token 的上下文以下,旗艦等級就是浪費掉的容量。DeepSeek V4 Flash 在目錄上的價格為 $0.242/$0.726,能以大約三分之一的價格處理相同的 1M 上下文,而對於真正簡短的任務,更便宜的模型依然勝出。

• 如果你需要視覺能力。V4 Pro 僅支援文字——無法輸入影像或音訊——而 Artificial Analysis 將其輸入模態列為文字。若重點在於模態,Gemini 3.6 Flash 或 Claude Fable 5 會是更合適的選擇。DeepSeek 自家的 API 在這裡也值得一提:它現在以 V4.1 Flash 提供其舊版 flash 模型名稱,而 V4.1 Flash 確實接受影像。

• 如果你追求的是稱霸基準測試的原始分數,而不是每單位上下文的價格。在 Artificial Analysis 目前的量表上,V4 Pro 在 Intelligence Index 拿下 36 分——撰寫本文時在 113 個模型中排名第 8——而在 OrcaRouter 目錄所載的 Coding index 上則為 69 分。這具競爭力,但並非領先:Claude Fable 5、Claude Opus 5 和 GPT-5.6 Sol 在程式編寫方面得分全都更高。V4 Pro 的賣點是以一小部分的每 token 價格,提供接近前沿的能力,而不是每張榜單的榜首。

如何在OrcaRouter上呼叫它

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (model ID deepseek/deepseek-v4-pro): FLAGSHIP FEATURED badge, '1M tokens' context and 384K max output, input and output price per 1M tokens (output shown at $0.88), /v1/chat/completions and /v1/responses endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

DeepSeek V4 Pro 託管於 OrcaRouter,模型 ID 為 deepseek/deepseek-v4-pro,並透過 api.orcarouter.ai/v1 的 Open​AI 相容端點提供服務,採用供應商原定費率、零加成。從現有的 Open​AI 用戶端遷移,只需要更改基礎 URL 與模型 ID,別無其他。

這一逆轉改變了你應該如何應對。如果你的行事曆上原本排了 9 月 14 日的遷移——因為 V4 Pro 即將退場,而要把指向改為 DeepSeek V4.1 Flash——你可以把它從行事曆上移除,或至少把它從截止期限降級為一次測試。兩個模型都位於同一把 OrcaRouter 金鑰之後,因此比較兩者只是在請求中更改模型 ID,而不是多一份合約、多一套 SDK;而如果你確實想讓 V4.1 Flash 在真實流量上接受評估,卻不想把正式環境路徑押在它身上,自動容錯移轉正是低風險的做法,讓它接收即時請求,同時 V4 Pro 仍作為備援。這就是 9 月 11 日這項決定的實際樣貌:選擇權仍在你手上,而且隨時可以逆轉。

對定價頁面而言真正重要的誠實說明:我們把請求路由到模型,但價格不是我們訂的。$0.726/$2.178 的離峰數字是 DeepSeek 費率直接轉嫁而來,而當 DeepSeek 調整這些費率時,它們也會跟著變動——這正是為什麼本頁標有日期,也是為什麼你正在閱讀的版本是重寫而成,而非在舊版上增補。

來源與日期

本頁的價格與規格已於 2026-09-12 重新驗證。DeepSeek V4 Pro 及比較中每個模型的美元數字,均取自the OrcaRouter model directory,並於同日核對;參數數量、授權條款、上下文視窗、模態與速度數據則來自 Artificial Analysis 的 DeepSeek V4 Pro 0813 模型頁面。人民幣費率、尖峰時段以及 9 月 11 日的延續通知,均來自 Deep​Seek 自家的 Models & Pricing 文件,該文件在價格表腳註中逐字載明此聲明。三步驟的公告序列——9 月 9 日的路由通知、9 月 10 日延後至北京時間 9 月 14 日 12:00,以及 9 月 11 日的逆轉——由 CLS(科创板日报)、36Kr、IT之家與 ifeng 報導,並由 TheBlockBeats 以英文報導。8 月 23 日的週末計費規則與 9 月 10 日的 Flash 降價,則來自 Deep​Seek 的公告,並經 IT之家、The Paper 與 21st Century Business Herald 報導。

最後一點關於可信度的說明:因為這個特定價格在一個月內已經變動了三次——8月13日的上線價格、8月17日的尖峰/離峰價格、8月23日的週末修訂。任何沒有標上日期的「V4 Pro pricing」頁面,都請視為不可用。這一頁的較早版本標的是 $0.44/$0.88,以及 Artificial Analysis Intelligence index 44.3;兩者在寫下的當時都是正確的,但都沒能撐過這個月。

本文中的比較4

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新