
MiniMax M3.1 Flash Preview 已在 Token Plan 上線:你的訂閱方案實際解鎖了什麼
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 468 tok/s
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 192 tok/s
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
MiniMax-M3.1-Flash-Preview 於 2026 年 9 月 27 日正式上線,而它上線的方式本身才是重點。它不是按用量付費的模型。廠商將其最新的文字模型置於同一組 Token Plan Subscription Key 之下,而該金鑰早已涵蓋 MiniMax-M3、MiniMax M2.7 以及 M2.7-highspeed 版本,因此如果你已持有席位,就無需再開通新金鑰,也無需簽署第二份合約。同樣地,截至今日,也沒有按 token 計價的價格、模型卡、公開基準測試,或任何方法可以關閉該模型的思考功能。
那種組合——毫無阻礙的取用,搭配完全未公開的計價模式——罕見到值得在任何人把它接入正式生產流程之前,先好好拆解一番。本文接下來要談的是:廠商自家文件實際上說了什麼、又刻意避而不談什麼,以及那一行程式碼,能讓你在不到一分鐘內判斷這個模型是否契合你的工作方式。
究竟是什麼在9月27日著陸?
MiniMax 的開發者文件現在帶有一則常設註記,並在每個文字模型頁面上重複出現:MiniMax-M3.1-Flash-Preview 目前僅能透過 Token Plan 與 MiniMax Code 使用。該模型在該廠商自家的模型表中排在首位,位於 MiniMax-M3 之上,被描述為一款具備 1M 上下文視窗與可調思考深度的前沿多模態程式設計模型。
上下文視窗 — 1,000,000 個 token,與 MiniMax-M3 所承載的上限相同
• 輸入模態 — 文字、圖像與影片,回傳文字
• 思考深度 — 一個 effort 設定,接受 low、medium、high、xhigh 與 max,預設為 max(當省略時)
• 協定支援 — 同一個模型 ID 可在 MiniMax 的 Anthropic 相容端點、其 OpenAI 相容端點及 OpenAI Responses 端點上運作
• 可用性 — 僅限 Token Plan 與 MiniMax Code;不適用於隨用隨付
• 價格 — 未在任何地方公布每 token 費率
• 權重 — 無;MiniMaxAI 組織最近兩個公開儲存庫仍為 MiniMax-Music3 與 MiniMax-H3
• 獨立基準測試 — 無;該模型在 Artificial Analysis 的模型索引中沒有條目
該公司同日在自家的 MiniMaxAgent 帳號上宣布此事,將其定位為日常開發用途,而非前沿工作:快速且可靠,從快速修正錯誤到完整功能開發皆涵蓋在內。這是 Flash 層級的任務定位,而非旗艦級。來自 PANews 和 KuCoin 的第三方新聞報導也以相同措辭描述,並指出在該公司確認之前,開發者早已在 MiniMax Code 的選取器中發現這款模型。

你使用哪一把金鑰,比平常更為重要。
這就是最容易讓人踩雷的地方。MiniMax 採用兩種不同的憑證類型,而 M3.1-Flash-Preview 只會認其中一種。Token Plan Subscription Key 來自 Billing > Token Plan,涵蓋訂閱用量與已購買的 Credits。隨用隨付 API Key 則涵蓋以 token 計價的模型。供應商文件明確指出,這兩者不能互換,而且 Subscription Key 可以在任何付費資源附加到它之前就存在——在這種情況下,它是一把有效但背後沒有任何資源的金鑰。
所以實務上的判斷標準不是「我有沒有 MiniMax API 金鑰」,而是「我有沒有 Token Plan 席位」。既有的席位都已涵蓋在內。文件指出,當席位或 Credits 存取權獲指派後,Subscription Key 才能開始使用;而一旦訂閱配額用盡,Credits 超額部分便會自動動用。
還有一個值得知道的文件不一致之處,因為它會讓任何先閱讀定價頁面的人感到困惑。Token Plan 定價頁面的涵蓋範圍註腳仍將適用陣容列為 M3、M2.7、圖像與語音,並排除 H3——它尚未更新為列出 M3.1-Flash-Preview。模型頁面則說法相反:M3.1-Flash-Preview 可在 Token Plan 上使用,且別無其他。截至今日,這兩個頁面都是上線中的供應商頁面。只有你手上的金鑰才能定奪。
那個能告訴你這是哪種模型的 400
每個 MiniMax M 系列模型在回答之前都會先思考,但 M3.1-Flash-Preview 是第一個拒絕停下來的。送出thinking: {"type": "disabled"}或reasoning_effort: "none",API 就會回傳 HTTP 400,並附帶以下訊息:
模型「MiniMax-M3.1-Flash-Preview」需要自適應思考;不允許 thinking.type="disabled"(包括 reasoning.effort=none)(2013)
廠商自己的指引是調低 投入程度,而不是試圖停用思考;這個階梯就是調節延遲的槓桿:在 low 進行例行編輯,以及在 xhigh 進行全儲存庫變更,都是同一個模型做出不同的取捨。還有兩個細節是這個模型特有的。reasoning_effort 參數根據文件記載,僅對 MiniMax-M3.1-Flash-Preview 有效——它不是通用的 M 系列控制項。而 reasoning_split 輸出開關會將思考分離到 reasoning_content 欄位,目前在此模型上無法設為 false。
思考文字的落點取決於協定:Anthropic 相容端點會將它回傳為 thinking 內容區塊,OpenAI 相容端點會透過 reasoning_content 回傳,而 Responses 端點則會將它回傳為 reasoning 輸出項目。如果你過去是從 MiniMax-M3 的輸出中解析 <think> 標籤,在較新的模型上已不再需要這麼做——而對於交錯式工具使用對話,包含思考區塊的完整回應必須附加回訊息歷史中,否則推理鏈會中斷。
目前正在進行的促銷活動
MiniMax Code 正在舉辦簽到促銷活動,時間為 UTC+8 的 9 月 28 日至 10 月 7 日,每日登入所獲得的免費額度加倍,並同時開放給新舊用戶。所發放的額度適用於支援的模型,其中以 M3.1-Flash-Preview 與 H3 影片模型為例。另外,該公司表示 Token Plan 的額度已於活動上線時為所有用戶重置,並計劃在活動期間進一步重置,資格則顯示於應用程式內。
把這兩者視為經由上市報導轉述的供應商說法——它們是附有日期的宣傳條款,而非產品行為,而且同一篇報導也指出,該公告並未具體說明每次簽到可獲得的點數數量,或錯過天數的精確規則。穩定狀態下的經濟模式則較容易說明:Token Plan 的定價為 Plus 每月 22 美元、Max 每月 55 美元、Ultra 每月 132 美元,並設有 5 小時滾動與每週配額窗口,供應商估計分別約可支援 3 到 4 個、4 到 5 個,以及 6 到 7 個並行代理。購買的 Credits 匯率為每 1 美元兌 1,000 點,並依各模型按用量計費的定價表扣點。
這個模型仍然沒有的四件事
以下各點都不是對該模型的批評;每一項都是團隊必須事先規劃因應的漏洞,而且這四項在今天全都可驗證。
• 沒有價格。在任何 MiniMax 頁面上都找不到 M3.1-Flash-Preview 的每 token 費率,因此無法就每 token 成本與 M3 的每百萬輸入 $0.30、每百萬輸出 $1.20 相比,也無法與其他任何東西相比。
• 沒有基準測試。MiniMax 在此次發布中並未公布任何評估表。其他人也一樣:該模型未出現在 Artificial Analysis 的索引中,所以它的欄位是真的空白,而不只是資料尚早。
• 沒有權重。MiniMax-M3 以開放權重形式發布;M3.1-Flash-Preview 則沒有儲存庫,也沒有可下載的檢查點。
• 沒有獨立量測。沒有任何第三方提供輸出速度、延遲或錯誤率的數據,我們自家的路由遙測資料也沒有,因為該模型不在我們的目錄中。
相較於2026年6月的M3發布——當時首日就附上架構說明、基準測試表與價目表——這次是刻意低調的發布。合理的解讀——而這是解讀,不是明說的計畫——是MiniMax想先在自己的產品內取得實際使用情況,再決定該模型的價格以及是否開放。

外洩的預覽筆記說對了哪些事
發表前四天,一份轉錄自公開合作夥伴儲存庫的預覽文件開始流傳,內容描述了一個 MiniMax M3.1,具備稀疏注意力、Q8KV4 注意力量化、NVFP4 路由專家、DSpark 推測解碼頭,以及一個全新的 reasoning_effort 欄位,其取值範圍從 max 一路向下到 low。當時我們將其報導為未經證實,因為事實確實如此:沒有權重、沒有模型卡、沒有定價頁面,也沒有任何 API 模型 ID 存在。
這五項說法中,有一項現已由廠商自家文件證實,那就是 reasoning_effort 欄位——包括從 max 到 low 的階梯,與實際出貨值完全吻合。其餘四項仍未獲證實。MiniMax 對 M3.1-Flash-Preview 的公開說明僅指出,它是一個具備 1M 上下文視窗與可調思考深度的前沿多模態程式設計模型;並未描述其注意力機制、量化或解碼頭。任何人若將稀疏注意力與 NVFP4 的說法當成已定案的規格來複述,就只是在複述第三方的轉錄內容,而這正是該發布並未證實的事。
如果你想試試看,又不想把整條 pipeline 押上去
只提供 Token-Plan 的預覽版,尷尬之處在於:評估新模型最自然的方式——從你現有的技術堆疊呼叫它並進行量測——正是你無法乾淨俐落做到的事。沒有可供推算的每 token 費率、沒有公布的延遲概況,而且如果預覽版不穩,供應商自家產品內也沒有容錯移轉方案。
這正是路由層存在的意義。你今天能呼叫的一切,都位於單一 OpenAI 相容端點與一組 API 金鑰之後,而與這個模型相鄰的模型早已就位:MiniMax-M3 以供應商的費率每百萬輸入 token 0.30 美元、每百萬輸出 token 1.20 美元,MiniMax M2.7 同樣的標價,卻具備 200,000 token 的視窗與開放權重,還有同一價格帶的 DeepSeek 與 Qwen Flash 層級。我們這邊的價格,是供應商的定價以 0% 加價直接轉嫁,因此當廠商調降費率時,當天就會反映在這裡,而不是等到重新議價的週期。自動容錯移轉意味著預覽級依賴可以與正式生產路徑並行,而不是位於其下;而當 MiniMax 真的為 MiniMax-M3.1-Flash-Preview 公布價目表與端點時,問題就變成路由表中的一筆項目,而不是一項遷移專案。MiniMax-M3.1-Flash-Preview 本身並未收錄在我們的目錄中,今日要使用它的途徑,是供應商自家的 Token Plan 及其程式開發產品。
給在發布日讀到這篇的團隊一句誠實的總結:這個模型已經上線,如果你本來就付費購買了 Token Plan 席次,使用它的邊際成本是零,但若單就它本身而言,則完全沒有定價、也毫無衡量。在 MiniMax Code 裡試玩一下,把你所依賴的流程留在有價目表和實績的模型上,並留意兩件事,它們會讓這件事從一時好奇變成正式決策——公開的定價,以及第一批獨立評測分數。

