一張生成的主視覺卡片,標題為 MiniMax M3.1 Flash Preview 對比 DeepSeek V4 Flash,副標為「同樣的 1M token 視窗,兩套截然不同的銷售話術」。左側卡片寫著「MiniMax M3.1 Flash Preview:1M 上下文,價格未公布,僅限 Token Plan,無法停用思考」;右側卡片寫著「DeepSeek V4 Flash:1M 上下文,離峰時段 $0.15/$0.60,僅支援文字,已被 V4.1 Flash 取代」。頁腳寫著「MiniMax 數據依 platform.minimax.io;DeepSeek 數據依 DeepSeek 公布的費率表」。
Engineering & Research

MiniMax M3.1 Flash Preview 對決 DeepSeek V4 Flash:兩張便宜的 1M 上下文入場券,一個巨大的星號

作者

Gideon Frost

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

如果你正在尋找百萬 token 上下文視窗、而且每 token 價格低廉的方案,MiniMax-M3.1-Flash-Preview 和 DeepSeek V4 Flash 是兩個不斷被提起的名字——而它們其實並不是同一類產品。DeepSeek V4 Flash 是已退役的模型,但其識別碼仍會回應,棲身在一份你能精確讀到每一分錢的供應商價目表裡。MiniMax-M3.1-Flash-Preview 則是仍在使用中的預覽版,完全沒有公布費率。因此,下面的比較,一部分是規格比較,一部分則展示了這兩家供應商選擇用多麼不同的方式,來販售同一個級距。

這件事的兩面都值得精確陳述,因為決定它的數字散落在某家供應商的定價頁面、某家供應商的文件樹,以及我們自己的目錄中;而關於 DeepSeek V4 Flash 最常被重複的其中一項說法——它的價格——是 DeepSeek 後來已替換掉的那一項。

兩份規格表實際上相符的地方

主要規格已經夠接近,所以不是決定性因素,唯一的例外是沒有人會宣傳的那一點。

• 上下文視窗 — MiniMax-M3.1-Flash-Preview 為 1,000,000 個 token,而 DeepSeek V4 Flash 為 1,048,576 個:名義上相同,卻有 48,576 個 token 的差距
• 最大輸出 — MiniMax-M3.1-Flash-Preview 未公布;DeepSeek V4 Flash 為 384,000 個 token,這在此價位並不尋常,而且是應該左右許多採購決策的數字
• 輸入模態 — MiniMax-M3.1-Flash-Preview 支援文字、圖像與影片;DeepSeek V4 Flash 僅支援文字
• 思考控制 — 一個投入程度階梯,從低到最高,對 MiniMax-M3.1-Flash-Preview 而言,思考永久開啟;DeepSeek V4 Flash 則可思考或不思考,而非思考是真正可用的選項
• 協定支援 — MiniMax-M3.1-Flash-Preview 支援 Anthropic 相容、OpenAI 相容及 OpenAI Responses 端點;DeepSeek V4 Flash 則支援同樣三種,外加聊天前綴補全
• 權重 — MiniMax-M3.1-Flash-Preview 未提供;DeepSeek 的 V4 Flash 權重已發布,不過該模型本身已被取代
• 價格 — MiniMax-M3.1-Flash-Preview 未公布;DeepSeek V4 Flash 已公布且價格低廉

把那份清單讀兩遍,因為輸出上限才是那個不聲不響的關鍵。一百萬個 token 的上下文搭配 384,000 個 token 的輸出,是確實很長的單次生成視窗。一百萬個 token 的上下文搭配未公開的輸出上限,承諾的是讀取,而不是寫入。如果你的工作負載是「讀取一個儲存庫,產出遷移計畫」,那麼第二個數字才是決定這項任務能否在一次呼叫中完成的關鍵。

每一項的測量基準是什麼?

這是這篇比較中最令人不自在的部分,而且篇幅很短。

DeepSeek V4 Flash 有一份基準測試紀錄,而且它是獨立的。Artificial Analysis 在 Intelligence Index 上給它 34.3 分——在該指數的 145 個模型中排名第 42——Coding Index 為 69.1,GPQA Diamond 為 90.8%。我們自家目錄條目開頭所引的 τ²-Bench 95.0 分,與 DeepSeek 發布資料所載的數字相同,所以那是與獨立數據並列的廠商數字,而非經審計的數字。它的長上下文召回率是 79.7%,而在 v2.1 測試框架上的 terminal-bench 數字是 78.7%。這些都是對一個已知模型真實、可比較的測量結果。

MiniMax-M3.1-Flash-Preview 則完全沒有。MiniMax 在發布時並未公布任何評測表,第三方也沒有——該模型根本未出現在 Artificial Analysis 的指數中。這並非我們研究上的缺口;這是公開紀錄目前的狀態,而這意味著關於這款較新模型的每一項品質說法,在此刻都只是廠商的形容詞。今天若有人拿給你一份 MiniMax-M3.1-Flash-Preview 的基準測試表,那不是引用較舊的 MiniMax-M3,就是憑空捏造。

A generated two-column scoreboard titled 'MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash — the scoreboard'. The left column, MiniMax M3.1 Flash Preview, reads 'AA Intelligence: none published', 'Coding score: none published', 'Context window: 1M', 'Max output: not published', 'Weights: none', 'Price: not published'. The right column, DeepSeek V4 Flash, reads 'AA Intelligence: 34.3', 'Coding score: 69.1', 'Context window: 1,048,576', 'Max output: 384,000', 'Weights: published', 'Price: $0.15 / $0.60 off-peak'. A footer reads 'MiniMax figures per platform.minimax.io documentation, 27 September 2026; DeepSeek figures per DeepSeek's published rate card and Artificial Analysis. The MiniMax column is empty because nothing has been published, not because a result is pending.'

DeepSeek V4 Flash 並非以你記憶中的價格販售

陷阱就在這裡。針對 DeepSeek V4 Flash 被廣泛引用的數字——每百萬個輸入 token 為 0.14 美元、每百萬個輸出 token 為 0.28 美元——是該模型在 2026 年 9 月 10 日之前所掛的牌價。就在當天,DeepSeek 發布了 DeepSeek-V4.1-Flash,讓 V4 Flash 與 V4-Flash-Vision-Exp 實驗一併退役,並調降價格。deepseek-v4-flash 這個識別碼仍然有效,但 DeepSeek 的文件指出,它目前會暫時路由到 V4.1 Flash,並以 Flash 的價格計費。換句話說,你仍然可以輸入舊的模型名稱;但你呼叫的已經不是舊模型。

所以真正該拿來比較的方案,就是目前這個,以每 100 萬個 token 計算——而離峰時段是其中比較便宜的那一半:

• 快取未命中輸入 — 離峰 $0.15,尖峰 $0.30
• 快取命中輸入 — 離峰 $0.003,尖峰 $0.006
• 輸出 — 離峰 $0.60,尖峰 $1.20
• 尖峰時段 — UTC 週一至週五 01:00–04:00 與 06:00–10:00,不含中國國定假日;其餘時間(包括整個週末)均為離峰

相較之下,MiniMax-M3.1-Flash-Preview 完全沒有任何形式的按 token 計費費率。它的成本就是你的 Token Plan 席位費用——Plus、Max 與 Ultra 分別為每月 22、55 或 132 美元——並透過共享的額度池,依各模型的隨用隨付定價表逐步扣抵消耗,而供應商保留更改該額度池組成的權利。對於用量可預測的固定每月預算而言,這可能極具價值。但對於需要將成本歸屬於每次呼叫的專案來說,這不過是披著訂閱外衣的不透明。

在 DeepSeek 這邊,這件事比平常更重要的原因在於尖峰倍率。歐洲或亞洲的團隊在其工作日運作期間,有相當比例的流量落在尖峰時段內,並為此支付雙倍費用,這會讓表面上 $0.15 的輸入費率,在多數產品最繁忙的那些時段變成 $0.30。除非你的流量確實是在 UTC 夜間運行,否則請以尖峰欄位來編列預算。

什麼情況下 MiniMax M3.1 Flash Preview 會是錯誤的選擇

有三種情況,而前兩種很容易被漏掉,因為它們是被記載下來的,而不是被減去的。

輸出上限未知。如果你的任務最終會產生大量生成內容——一份完整規格、一份逐字稿改寫、一份附註報告——你就是在選擇一個你看不見的輸出預算。DeepSeek V4 Flash 公佈的是 384,000。這種不對稱有利於較舊的模型,只要任務涉及大量撰寫皆然。

思考無法關閉。傳送thinking: {"type": "disabled"} 至 MiniMax-M3.1-Flash-Preview,就會得到 HTTP 400:此模型需要自適應思考。在 DeepSeek V4 Flash 上,非思考模式確實存在,且是受支援的切換選項。對於高輸送量分類、路由,或簡短結構化擷取,一個總是先推理的模型,會耗費你未要求的延遲與 token——而你唯一能操作的槓桿,就是將 effort 調低至 low,而不是移除推理。

它無法以隨用隨付的方式呼叫。供應商的說明文件明確指出,MiniMax-M3.1-Flash-Preview 目前只能透過 Token Plan 與 MiniMax Code 使用,而且 Subscription Key 無法與隨用隨付的 API 金鑰互通。如果你已經持有席次,那只需改一行。如果沒有,要評估這個模型就意味著得購買訂閱。

在哪些情況下,DeepSeek 的數字是錯誤的判斷

鏡像情況是,DeepSeek V4 Flash 僅支援文字,而且已被取代。它從未接受圖像——那項工作需要有另一個實驗性組建,而該組建如今也已隨著它一同退役——而且這個模型識別碼現在所提供的權重,與名稱所暗示的並不相同。一條鎖定在deepseek-v4-flash以確保可重現性的管線,正依賴著 DeepSeek 稱為暫時性的重新導向。

MiniMax-M3.1-Flash-Preview 原生支援文字、圖像與影片,且是該廠商目前最頂尖的文字模型。在這個價位帶中,以 Flash 的價格提供影片輸入並不常見。

對任何在正式環境中處理流量的人來說,這兩個注意事項都指向同一個方向:帳單上的識別碼與實際回應的模型,不保證永遠會是同一個東西,而這正是路由層要處理的事,而不是等到被發現才處理。

A generated infographic titled 'The two Flash brackets, side by side' listing six paired rows: 'Sales motion — subscription seat vs per-token rate card', 'Effective input rate — Token Plan quota vs $0.15 off-peak / $0.30 peak', 'Peak surcharge — not applicable vs doubles 01:00-04:00 and 06:00-10:00 UTC', 'Cost attribution — pooled quota vs metered per call', 'Failure mode — no published output ceiling vs identifier now serves a successor', and 'Best fit — fixed-budget teams vs metered pipelines'. A footer reads 'Both models carry a 1M-token context window; neither figure is a quality claim.'

如何在一個下午內決定這件事

從任務的結尾開始,而不是從開頭。

如果任務是長篇生成——任何以寫出數萬個 token 作結的工作——DeepSeek V4 Flash 是這兩者中唯一公布的上限大到足以承諾這點的那一個,而它的價目表也小到讓尖峰倍率還撐得住。請以尖峰時段、而非離峰時段來估算成本,並把已停用的識別碼當成一場你還沒完成的遷移,而不是一份穩定的契約。

如果這項工作是為了在固定月度預算下,對多模態輸入進行閱讀與推理——螢幕錄影、掃描文件、影片審查——那麼 MiniMax-M3.1-Flash-Preview 是能力更強的選擇,而且在 Token Plan 席次內,這是在此上下文長度下取得影片輸入最便宜的方式。接受你買的是未經實測的模型,並控制影響範圍:把重要的工作負載放在有公開價目表的方案上,讓預覽版處理探索性的那一半。

如果這兩種描述都符合你的流程,那這是路由問題,而不是模型選擇問題,而這正是我們存在的目的。 OrcaRouter 上的 DeepSeek V4 Flash以供應商的費率提供,0% 加成——其目錄項目顯示每百萬輸入詞元 $0.22、每百萬輸出詞元 $0.66,這正是目前 Flash 價格卡的峰值欄位,直接原樣傳遞——同時在同一把金鑰上,MiniMax-M3 與 MiniMax M2.7 也位在相同價格帶。 一個端點即可觸及 200+ 個模型,背後還有自動容錯移轉,因此工作負載無須第二次整合就能在不同價格區間之間移動。MiniMax-M3.1-Flash-Preview 不在我們的目錄中;要使用它,得透過該廠商的 Token Plan 及其程式設計產品。

一句話版本:{{1}}DeepSeek V4 Flash{{/1}}是已知量,具備{{2}}已公布的輸出上限{{/2}}、可讀的{{3}}價目表{{/3}},以及{{4}}默默地名副其實{{/4}};{{5}}MiniMax-M3.1-Flash-Preview{{/5}}則是較新、多模態、{{6}}未經實測{{/6}}的那一款,得付訂閱費才能{{7}}使用{{/7}}。這兩者都不是選擇{{8}}另一者{{/8}}的理由——它們只是你從{{9}}按 token 計價的比較{{/9}}中得不到的事實,而那種比較引用的還是 DeepSeek 在{{10}}2025{{/10}}年已退役的價目卡。

A headless Chromium screenshot of the OrcaRouter model page for deepseek/deepseek-v4-flash, showing the model title 'DeepSeek: DeepSeek V4 Flash', a pricing row reading 0.22 US dollars per million input tokens and 0.66 per million output tokens, a context window of 1,048,576 tokens, and a maximum output of 384,000 tokens, captured 28 September 2026.

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新