
DeepSeek V4.1 Pro 正在開發中:路由通知、架構承諾,以及仍未知的部分
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0241智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82程式
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0340智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2123智能49程式
DeepSeek V4.1 Pro 尚未發布、列出、接受基準測試或定價。它沒有出現在任何型號頁面上,沒有模型卡,也沒有任何端點回應它的名稱——然而在2026年9月9日,DeepSeek 技術團隊的一名成員幾乎是順帶地在一則關於 DeepSeek V4 Pro 流量在此期間將如何處理的兩句通知中,公開將其記錄在案。以 @tianyi 帳號發文的崔天翼(Tianyi Cui)寫道,一旦 DeepSeek V4.1 Flash 正式推出——預計在北京時間9月10日左右——所有針對 DeepSeek V4 Pro 的 API 請求都將被重新路由至 DeepSeek V4.1 Flash,並以 Flash 較低的費率計費,而這項安排將持續到 DeepSeek V4.1 Pro 本身正式上線為止。
那句末尾條款才是新聞。到目前為止,V4.1 產品線僅通過一個為期兩天的「中間版本」測試版浮出水面——該測試版於9月8日開始以模型ID deepseek-v4.1-flash-expires-on-0910提供服務,外加一份反饋表單,詢問測試者V4.1 Flash是否能在生產環境中取代DeepSeek V4 Pro。將DeepSeek V4.1 Pro命名為路由窗口的終點,是這款旗艦產品首次獲得公司內部的承認。化名的DeepSeek觀察者teortaxesTex引述了這份通知,也作同樣解讀——然後補充了一個更強烈的說法:DeepSeek V4.1 Pro的存在,證明了DeepSeek已經「解決了V4家族的架構問題,正如他們在V4論文中所承諾的那樣。」
在細節之前,先說明一則消息來源。以下關於 DeepSeek V4.1 Pro 的所有內容都建立在兩件事上:一位 DeepSeek 技術團隊成員發布的單一則標註日期的社群貼文,在數小時內獲得數家中國媒體的佐證,以及一個追蹤者對它的解讀。目前沒有技術報告、沒有參數數量、沒有發布日期,也無法在今天呼叫該模型。路由通知是一個陳述;「架構已解決」的解讀則是推論。本文將兩者區分開來,因為它們是不同類型的證據。
9月9日的通知實際上說的是什麼
9月9日北京時間15:14左右,Tianyi Cui 在 X 上發文表示,繼續以溢價銷售舊版 DeepSeek V4 Pro 已不再合理。他的理由大致是:內部與外部測試顯示,V4.1 Flash 模型在性能、成本、速度與總處理時間上全面超越 DeepSeek V4 Pro,因此對較弱的模型向使用者收取更多費用、提供更慢速度與更高算力消耗並不恰當。因此,一旦 V4.1 Flash 正式上線,且在 V4.1 Pro 上線之前,V4 Pro 模型的請求將統一導向 V4.1 Flash,並按 Flash 定價計費。
所謂「全面超越」的說法是 DeepSeek 團隊自行宣稱的,並非經獨立驗證:該貼文沒有附上任何基準測試表格,V4.1 Flash 測試版也沒有模型卡。真正可以核實的是這項計畫的輪廓。DeepSeek 等於在 Flash 正式推出之際,就把目前的 Pro 層級視為過時,並在下一代 Pro 問世之前,將 Pro 流量導向較便宜的模型。
今天呼叫 DeepSeek V4 Pro 意味著什麼
對於任何運行目前旗艦模型——DeepSeek V4 Pro,這個在8月中旬達到GA(一般可用)的1.6兆參數MoE——的人來說,變更是自動且伺服器端的。一旦重新路由生效,指名V4 Pro模型的請求將由V4.1 Flash版本回應,並按Flash費率計價,呼叫方無需更改任何程式碼。計費方式的轉變是最尖銳的部分。報導此公告的中國媒體指出,從9月10日起,新的Flash費率的最高輸出價格為每百萬個tokens人民幣8元,而它所取代的Pro層級為每百萬個tokens人民幣27元——對於原本使用Pro的流量來說,大幅削減約70%,而且DeepSeek團隊表示這個模型更快。作為一項同時升級和降價的公告,即使以DeepSeek的標準來看,也相當激進。

一個關於時間點的提醒,因為敘述框架很重要:如果你今天持有 DeepSeek V4 Pro 的金鑰,在 V4.1 Flash 實際推出之前,一切都不會有變化,而且重新路由的描述來自團隊的文章及相關報導——尚不是來自更新日誌條目。截至上方九月九日的截圖,DeepSeek 官方模型頁面仍列出純粹的 V4 產品陣容——DeepSeek V4 Flash、DeepSeek V4 Pro 與 DeepSeek-V4-Flash-Vision-Exp——表格中沒有 V4.1 的條目。
為何「V4 文件」是洩漏的關鍵
teortaxesTex 的具體主張是,DeepSeek V4.1 Pro 正在開發中,這證實 DeepSeek 已解決 V4 家族的架構問題,「正如他們在 V4 論文中所承諾的那樣。」該引用是可以查證的。DeepSeek 的 V4 技術報告——《DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence》——異常坦率地說明其設計目前尚未做好的部分,以及未來迭代版本原本要解決的問題:
该报告称其自身架构“相对复杂”,并承诺“在未来的迭代中,我们将进行更全面、更有原则的研究,以将架构提炼到其最核心的设计。”
• 其兩種訓練穩定機制——Anticipatory Routing 和 SwiGLU Clamping——在實務上確實奏效,但報告指出,其背後原理仍「未被充分理解」。
• 長上下文檢索在超過 128K tokens 後仍會衰減。在報告引用的 8-needle 檢索測試中,V4-Pro-Max 在 128K 時得分約為 0.92,到 1M 時降至約 0.59——這就是「能載入一百萬 tokens」與「能真正運用它們」之間的差距。
• 而 V4 系列最初僅提供文字功能;視覺能力後來才以實驗性外掛編碼器 DeepSeek-V4-Flash-Vision-Exp 的形式加入,而非基礎模型的一部分。
對照那份清單來看,V4.1 的故事就變得清晰起來。DeepSeek 自己對 V4.1 Flash 測試版的描述,恰恰使用了那些問題所暗示的語言——「新的模型結構」以及從底層打造的原生多模態支援。基於相同已解決基礎所建構的 V4.1 Pro,是自然的下一步,而這正是 teortaxesTex 所推斷的。這是一項推斷,也應繼續標註為推斷:DeepSeek 尚未發表 V4.1 技術報告,而「正在開發中」除了團隊成員提及 Pro 最終會推出之外,並未獲得進一步證實。
證據清冊——哪些已獲證實,哪些尚未
將9月9日的信號疊加到9月8日的測試版上,會得到一份簡短的已確認事實清單,以及一份長長的未確認事項清單。

• 廠商聲明(數小時內獲多家中國媒體證實)——DeepSeek 有一個 V4.1 Flash 模型,計劃於北京時間 9 月 10 日左右推出;DeepSeek V4 Pro API 流量將路由至該模型,並以 Flash 費率計費,直到 V4.1 Pro 推出;DeepSeek 團隊認為 Flash 版本在成本、速度和總時間上均優於目前的 Pro。
• 有可能但未經證實——DeepSeek V4.1 Pro 目前正在訓練中或即將推出。teortaxesTex 所說的「in the works」沒有附帶日期,也沒有內部消息來源;唯一的佐證是路由窗口本身,而它預設 Pro 最終會存在。
• 解讀——Pro的存在證明V4論文在架構上的承諾已兌現。V4.1 Flash測試版宣稱的「新結構、原生多模態」指向相同方向,但目前尚無已發表的V4.1架構可供對照檢驗。
• 未知 — V4.1 Pro 的規格、參數數量、上下文視窗、定價、發布日期,以及它是否會像 DeepSeek V4 Flash 和 DeepSeek V4 Pro 那樣提供開放權重。目前的 V4.1 Flash 測試版僅限 API 使用且即將到期,因此開放權重的問題確實是懸而未決,而不只是尚未獲得回答。
看什麼
• 9月10日北京時間——V4.1 Flash 正式發布、其新的計價方案,以及 V4 Pro 重新調整的啟動。如果如所述那樣發生,從那天起,「DeepSeek V4 Pro」模型 ID 將開始以 Flash 價格回傳 V4.1 架構。
• V4.1 技術報告或模型卡——測試版兩者皆無,而第一張模型卡正是能將架構聲明轉化為審查者可核查內容的關鍵。
• 首批獨立基準測試——V4.1 基礎版是否真正修復了 V4 報告已知的差距:超過 128K 的檢索能力,以及報告本身指出的、落後前沿模型約三到六個月的推理落差。
• V4.1 Pro 的命名與時機 — teortaxesTex 所稱的 DeepSeek V4.1 Pro 是否以獨立卡片呈現,以及它在 Flash 之後多快推出。
與此同時該做什麼?
目前還沒有任何可呼叫的 API。DeepSeek V4.1 Pro 並未在任何 API 上,將生產環境接上一個僅有兩天的 Beta 模型 ID 本身就是個錯誤。不過,這則重新路由的消息確實改變了現有 DeepSeek V4 Pro 用戶的一項盤算:他們以旗艦級費率付費的模型即將被正式宣佈為已遭取代,這不利於現在簽下長期承諾,反而支持在下一次購買決策前先觀望 Flash 的推出。
這種觀望的姿態,正是路由層展現價值之處。在 OrcaRouter 上,DeepSeek V4 Flash、DeepSeek V4 Pro 與 DeepSeek-V4-Flash-Vision-Exp 可透過單一 API 存取,並以 DeepSeek 的列表價格原價轉傳,零加價——因此供應商端的價格變動或重新路由,會在當天同步反映在我們這邊,而不是等到費率表更新。當 V4.1 Flash 正式推出,之後若 V4.1 Pro 也出現,同一套設定就是以低成本切換來採用它們的方式:將一部分流量導向新模型,保留穩定模型作為自動容錯轉移,並讓路由 DSL 決定哪些呼叫值得嘗試未經驗證的模型,哪些應繼續留在主力模型上。

兩句路線圖的重點
解讀9月9日訊號最直接的方式,就是DeepSeek已用最漫不經心的態度告訴市場:其目前的旗艦產品只是過渡方案。V4.1 Flash是發佈的證明,改道等於承認目前市售的DeepSeek V4 Pro已遭取代,而「等到V4.1 Pro發佈」這一句話就是路線圖。那句話缺少的,是能將DeepSeek V4.1 Pro從傳聞變成產品決策的一切資訊:日期、規格、價格、基準測試數據,以及除了某個追蹤器的解讀之外,任何能證明V4論文中的架構承諾確實兌現的證據。在DeepSeek公佈任何正式資訊之前,理性的立場就是teortaxesTex所持的態度——將V4.1 Pro視為真實存在,將其所有細節視為未經證實,並將9月10日前後的Flash發佈視為V4.1架構第一個可驗證的落地版本。
雖然 DeepSeek V4.1 Pro 尚未推出,但您現今可透過單一 API 存取的旗艦版是OrcaRouter 上的 DeepSeek V4 Pro——按 DeepSeek 官方定價原價提供,0% 加價。
如果你想直接與其比較,DeepSeek 模型表示 V4 Pro 的流量將重新路由至:DeepSeek V4 Flash on OrcaRouter。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
