
DeepSeek V4 評測:AI 中最便宜的真正 1M 令牌模型?
- anthropic新Anthropic: Claude Opus 52026-07-2461智能78程式
- google新Google: Gemini 3.6 Flash2026-07-2150智能69程式
- google新Google: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- meta新Meta: Muse Spark 1.12026-07-1651智能71程式
- kimi新MoonshotAI: Kimi K32026-07-1557智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0951智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0955智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0959智能77程式
- grokxAI: Grok 4.52026-07-0854智能72程式
- tencentTencent: Hy32026-07-0641智能59程式
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42程式
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39程式
- anthropicAnthropic: Claude Sonnet 52026-06-3053智能72程式
- klingKling: Kling 3.0 Turbo2026-06-1757智能52程式57數學
- z-aiZ.ai: GLM 5.22026-06-1651智能69程式60數學
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242智能61程式61數學
- anthropicAnthropic: Claude Fable 52026-06-0960智能77程式
- qwenQwen: Qwen3.7 Plus2026-06-0139智能56程式59數學
- minimaxMiniMax: MiniMax M32026-05-3144智能59程式59數學
- AnthropicAnthropic: Claude Opus 4.82026-05-2856智能74程式68數學
DeepSeek 在 2026 年 4 月 24 日發布了 V4 系列——兩個模型,V4-Pro 和 V4-Flash,在 API 上線並同步開源——並且悄悄重新定義了嚴肅 AI 能力的成本基準。兩個模型預設皆搭載 1M token 的上下文視窗,皆提供思考與非思考模式,而旗艦版 V4-Pro 的最高價格為每百萬輸出 token 0.87 美元:這個價格低於市場上所有具備 1M 上下文、可與之比較的模型,無論是開源還是閉源。
{{1}}而七月是決策月。{{/1}}在6月29日的一份通知中,DeepSeek確認V4正式版將於2026年7月中旬到來,承諾功能與效能改進——並引入高峰時段定價,在{{KEEP}}Beijing{{/KEEP}}商務時段費率加倍。十天後,即7月24日,舊版模型名稱 `deepseek-chat` 和 `deepseek-reasoner` 將永久退役。本評測涵蓋V4的實際內容、今日與正式發布後的價格、其優勢與明顯不足,以及在截止日前應採取的行動。
快速判決
如果你…,考慮 DeepSeek V4
- 運行高容量生產工作負載,其中單位成本決定可行性 — V4的定價獨樹一幟
- 需要長上下文且成本低廉:標準1M令牌,每次回應最多384K輸出令牌,並有積極的上下文快取折扣。
- 想要無縫整合 — 此API同時支援OpenAI ChatCompletions與Anthropic格式,因此現有工具大多可直接使用。
- 重視開放權重和自託管選項,尤其是較小的 V4-Flash
如果你……,請暫緩(或轉至別處)
- 執行長時程自主代理——在Z.ai發布的跨模型表格中,V4-Pro在馬拉松式基準測試上遠遠落後於GLM-5.2和封閉前沿模型。
- 需要图像輸入:V4 僅限文字
- 依賴全天候固定定價 — 自2026年7月中旬正式發布起,尖峰時段費率在北京辦公時段內翻倍(離峰時段維持現行費率)
什麼是 DeepSeek V4?
V4 是 DeepSeek 的第四代模型系列,以兩個混合專家模型的形式推出。DeepSeek-V4-Pro是旗艦型號:總參數 1.6 萬億,每個 token 活躍參數 490 億。DeepSeek-V4-Flash是效率層級:總參數 2840 億,活躍參數 130 億。兩者均在 DeepSeek 官方服務中預設運行 100 萬 token 的上下文窗口,並以模型 ID 提供雙模式——思考模式處理困難問題,非思考模式提升速度——deepseek-v4-pro 和 `deepseek-v4-flash`。
兩個定位細節很重要。首先,V4 推出時作為預覽版DeepSeek 將其視為可用於生產環境——且根據該公司6月29日的公告,正式版本於2026年7月中旬推出,並包含「功能優化與效能改進」。其次,它推出時是開源,延續了 DeepSeek 公開釋出權重的模式——這使得自託管和微調仍具可行性,實際上是針對 284B Flash 多於 1.6T Pro。
DeepSeek V4 有什麼新功能?

默认提供100万token上下文,而非追加销售。所有官方DeepSeek服务现在均标配完整的百万token窗口——没有单独的长上下文SKU,也没有溢价费率。
巨大的輸出裕量。兩個模型每次回應皆支援高達384K個輸出token——是大多數1M上下文競爭對手的三倍——這對整個文件程式碼生成、長結構化提取和報告編寫來說至關重要。
單一端點上的雙重模式。思考模式應對困難問題,非思考模式用於低成本快速呼叫,可依請求切換,而非依模型。
兩層架構,統一API形態。 Pro版注重能力,Flash版注重容量——相同上下文、相同模式、相同整合。
雙 API 相容性。 V4 原生支援 OpenAI ChatCompletions 和 Anthropic API 兩種格式,因此大多數現有代理工具無需重寫即可連接。
定價:實際成本

這就是讓 V4 成名的部分。V4-Pro 每百萬輸入 token 的費用為 0.435 美元,每百萬輸出 token 為 0.87 美元。 V4-Flash 的費用分別為 0.14 美元和 0.28 美元。重複上下文的快取命中費用遠低於每百萬 token 一美分——對於反覆讀取相同專案狀態的 agent 迴圈來說,幾乎是免費的。
作為參考:GLM-5.2 本身被譽為夏季的價值之選,報價為 $1.40 / $4.40。Claude Sonnet 5 報價 $3 / $15,Claude Opus 4.8 報價 $5 / $25。V4-Pro 的輸出價格是 GLM-5.2 的五分之一,約為 Opus 4.8 的 3%。即使 V4-Pro 在一些正面對決的品質較量中落敗——確實如此——但經濟效益改變了哪些問題值得向模型提出的考量。
一項變更將隨著正式發布而來。根據DeepSeek在6月29日的通知,從七月中旬起,所有代幣價格在尖峰時段——北京時間09:00–12:00和14:00–18:00——將翻倍,而離峰時段則維持目前費率。即使翻倍後,V4-Pro的尖峰輸出價格(約每百萬個1.74美元)仍低於GLM-5.2的標準費率,但固定價格時代隨著預覽版本而終結:如果你的流量在中國工作時間達到高峰,請模擬波動——或安排繞道而行。
評分
以下分數是根據DeepSeek官方文檔和Z.ai發布的跨模型基準測試表所做的編輯評估——請將跨供應商的數據視為第三方背景信息,而非DeepSeek自身的主張。

- 編碼能力:8/10 — 勝任日常工程工作;並非開放權重領域的領導者
- 代理/工具使用:7/10 — 紮實的工具編排,馬拉松長度的自主性較弱
- 推理:8/10 — 在這個價格類別中,數學和科學成績表現出色。
- 成本效益:10/10 — 無可比擬
- 上下文與長文件:9/10 — 1M 輸入,384K 輸出,近乎免費的快取命中
- 速度:8/10 — 精簡的活動參數計數,加上一個非思考模式以用於快速路徑。
整體評分:~8.3/10 — 2026年中期性價比之王,附帶長期考量星號。
優點
- 重塑曲線的定價:全系列每百萬代幣0.14至0.87美元
- 1M 上下文標準搭配 384K 輸出 — 同類產品中最高的輸出上限
- 單一端點上的思考與非思考模式,可依請求切換
- OpenAI 與 Anthropic API 的兼容性意味著近乎零的遷移阻力
- 開源權重保留了自托管和微調的選項。
缺點
- 長時程代理工作是明顯的弱點——在Z.ai公布的表格中,V4-Pro在FrontierSWE上得分29.0,而GLM-5.2取得74.4,Claude Opus 4.8取得75.1
僅文字:V4 API 中無圖像輸入
尖峰時段定價於七月中旬正式發布時上路——在北京商業時段內費率加倍,因此預算不再固定。
仍為預覽版直至七月中旬,因此行為可能隨正式版而變化。
- 2026年7月24日,deepseek-chat和deepseek-reasoner的退役迫使舊版用戶按照DeepSeek的時間表進行遷移。
- 自我托管1.6T參數的Pro版本對幾乎所有人來說都不實際(Flash版本,284B參數,是實際目標)
DeepSeek V4 的比較

V4-Pro 與 V4-Flash 的對比。相同的上下文、相同的模式、相同的 API——區別在於品質與吞吐量,價格差距達 3 倍。合理的預設:Flash 用於摘要、提取、分類和聊天;Pro 用於程式碼、分析以及任何需要人工審查的內容。
vs GLM-5.2.今年夏天的開放權重之戰,雙方在價值上確實非常接近。GLM-5.2 是更強的編碼模型——在 Z.ai 公布的表格中,它在 Terminal-Bench 2.1 上以 81.0 比 64.0 領先 V4-Pro,在長時程任務上更是佔據主導地位(FrontierSWE 上 74.4 比 29.0)——而 V4 則以低 3 到 5 倍的價格與三倍的輸出上限作為回應。大量管道傾向 V4;編碼代理傾向 GLM-5.2。
vs封闭的前沿。Claude Opus 4.8 和 GPT-5.5 仍然是硬基準測試中明顯更強的模型。但在與 Opus 4.8 相比 30–60 倍的輸出價格差距下,V4 並非試圖贏得那場戰鬥——而是試圖讓您 90% 的流量變得過於便宜,以至於沒有理由將其發送到其他地方。
7月24日截止日期:遷離舊有名稱

如果您的整合仍調用 `deepseek-chat` 或 `deepseek-reasoner`,這些名稱將在 2026 年 7 月 24 日 15:59 UTC 之後失效。它們目前會路由至 V4-Flash,這表示您的流量已按 V4 經濟模型運行—但在截止日期後,請求將直接失敗。遷移本身只需一行程式碼(`model: "deepseek-v4-pro"` 或 `"deepseek-v4-flash"`),因此實際工作是針對 V4 行為重新測試提示詞,並逐個端點決定每個工作負載應歸屬哪個層級—或在前端放置一個路由器,以便下次棄用時只需更改配置,無需更改程式碼。
誰應該使用DeepSeek V4?
高容量產品 — 支援、摘要、提取、分類 — 在這些領域中,V4定價使邊際功能變得有利可圖
長期文件與大量RAG工作負載,每日填滿百萬token視窗,並從近乎免費的快取命中中獲益。
產生長輸出的團隊:程式碼庫、報告、結構化資料 — 384K 輸出是類別天花板
注重成本的建造者想要一個能勝任的預設,並樂於將困難的10%部分轉移到其他地方。
誰應該另尋他處?
其核心工作負載為長期運行的自主代理的團隊 — GLM-5.2 或封閉式旗艦是更安全的途徑
依賴視覺的工作流程(V4 不擷取影像)
任何今天需要合約中標示為「穩定」的標籤而不是預覽的人
DeepSeek V4 值得嗎?
以價格而言,強烈推薦——作為一條賽道,而非一種信仰。V4在品質上並未超越最佳的開源權重編碼器(GLM-5.2)或前沿旗艦模型,且其長期代理的數字確實薄弱。它所做的是讓大量日常AI工作——諸如摘要、提取、草稿和對話輪次等佔據實際Token帳單的任務——成本幾乎為零。成功的模式是將V4作為量基底,其上設置升級賽道。
最終判決
DeepSeek V4 是價格性能的標竿,現在每個其他模型都以它為衡量標準——我們的評分:約 8.3/10。在重視量的場景使用 Flash,在重視品質但預算有限時使用 Pro,並將頂級工作導向更強的模型。當七月中旬高峰定價到來時重新計算你的成本——便宜的還是便宜,但不再固定。如果你仍在使用 deepseek-chat 或 deepseek-reasoner:你到 7 月 24 日為止。快行動。
通过 OrcaRouter 使用 DeepSeek V4
三車道策略 — V4負責流量,較強的開放或封閉模型處理困難任務,後備方案確保可靠 — 正是那種手動執行痛苦、放在閘道後卻輕而易舉的架構。OrcaRouter 透過一個 OpenAI 相容端點,以供應商列表價格、零 Token 加價,同時提供 DeepSeek V4、GLM-5.2、Claude、GPT、Gemini 及 200 多種模型:智慧路由依請求選擇車道,自動容錯涵蓋預覽階段的波動,每模型的可觀測性則顯示每條車道完成每個任務的實際成本。它也能化解供應端變動,例如 7 月 24 日的名稱退役或七月中旬的尖峰時段定價 — 當模型名稱失效或價格視窗開啟時,你只需更新路由規則,無需改動程式碼庫。


常見問題
DeepSeek V4 現在可用嗎?
是的——V4-Pro和V4-Flash自2026年4月24日起已在DeepSeek API上線,使用模型ID deepseek-v4-pro和deepseek-v4-flash,並開源了權重。官方稱之為預覽版;DeepSeek在6月29日的公告中指出,正式版本將於2026年7月中旬推出。
DeepSeek的尖峰時段定價是什麼?
正式發佈公告:自2026年7月中旬起,所有代幣價格在北京營業窗口(北京時間09:00-12:00及14:00-18:00)期間翻倍,離峰時段則維持現行費率。在中國營業時間之外達到高峰的流量——例如多數西方工作負載——基本上可避開此附加費。
DeepSeek-chat 和 DeepSeek-reasoner 會發生什麼事?
它們目前會自動路由到V4-Flash,但在2026年7月24日(15:59 UTC)之後,這兩個名稱將完全退役,請求將會失敗。請在截止日期前明確更新模型參數。
我應該使用V4-Pro還是V4-Flash?
Flash 適用於大量工作,人類無需逐行審查——摘要、提取、分類、聊天。Pro 適用於程式碼、分析與草稿,價格約為 Flash 的三倍,但仍遠低於所有同類模型。
DeepSeek V4 是否比 GLM-5.2 更好?
更便宜,但不一定更好。在 Z.ai 公布的表格中,GLM-5.2 在編碼方面明顯領先,並主導長期代理任務;V4 則以 3–5 倍更低的價格、384K 的輸出上限以及近乎免費的緩存命中來應戰。許多團隊兩者並用:V4 用於批量處理,GLM-5.2 用於編碼代理。
DeepSeek V4 能處理圖片嗎?
不——V4 API 僅支援文字。請將視覺任務(螢幕截圖、以像素呈現的 PDF、圖表)導向多模態模型,例如 Claude 或 Gemini。
我可以自行託管DeepSeek V4嗎?
權重已開源,但需現實看待規模:V4-Pro 是 1.6T 參數的 MoE(數據中心級別),而 284B 的 V4-Flash 才是資源充足團隊可實際自託管的目標。
V4 是否與我現有的 OpenAI 或 Claude 工具相容?
大致是的——API原生支援OpenAI ChatCompletions和Anthropic格式,因此为任一格式构建的代理框架和SDK通常只需要更改基础URL和模型名称即可连接。
我可以透過OrcaRouter使用DeepSeek V4嗎?
是的 — DeepSeek 模型可在 OrcaRouter 上以供應商列表價格(零加價)取得,與 GLM、Claude、GPT 和 Gemini 並列,因此您可以透過一個端點執行容量加升級拆分。
準備好讓您的代幣帳單變得無趣了嗎?建立您的 OrcaRouter 帳戶,將與 OpenAI 相容的用戶端指向一個端點,並將流量路由到 DeepSeek V4,同時由更強大的模型處理高峰——零代幣加價,且具備 July 24-proof 整合。
