一張生成的主視覺卡片,標題為 MiniMax M3.1 Flash Preview,副標題為「已於 Token Plan 上線,2026 年 9 月 27 日」。三個標籤分別寫著「1M token 上下文」、「輸入文字 + 圖像 + 影片」,以及「僅限 Token Plan——不支援按用量計費」。左側卡片寫著「供應商已確認:與 M3 和 M2.7 使用相同的 Subscription Key,預設開啟 thinking,effort 可從 low 到 max」;右側卡片寫著「尚未公布:每 token 價格、模型卡、基準測試、權重、獨立量測」。OrcaRouter 標誌位於右下角。
Guides & Insights

MiniMax M3.1 Flash Preview 已在 Token Plan 上線:你的訂閱方案實際解鎖了什麼

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

MiniMax-M3.1-Flash-Preview 於 2026 年 9 月 27 日正式上線,而它上線的方式本身才是重點。它不是按用量付費的模型。廠商將其最新的文字模型置於同一組 Token Plan Subscription Key 之下,而該金鑰早已涵蓋 MiniMax-M3、MiniMax M2.7 以及 M2.7-highspeed 版本,因此如果你已持有席位,就無需再開通新金鑰,也無需簽署第二份合約。同樣地,截至今日,也沒有按 token 計價的價格、模型卡、公開基準測試,或任何方法可以關閉該模型的思考功能。

那種組合——毫無阻礙的取用,搭配完全未公開的計價模式——罕見到值得在任何人把它接入正式生產流程之前,先好好拆解一番。本文接下來要談的是:廠商自家文件實際上說了什麼、又刻意避而不談什麼,以及那一行程式碼,能讓你在不到一分鐘內判斷這個模型是否契合你的工作方式。

究竟是什麼在9月27日著陸?

MiniMax 的開發者文件現在帶有一則常設註記,並在每個文字模型頁面上重複出現:MiniMax-M3.1-Flash-Preview 目前僅能透過 Token Plan 與 MiniMax Code 使用。該模型在該廠商自家的模型表中排在首位,位於 MiniMax-M3 之上,被描述為一款具備 1M 上下文視窗與可調思考深度的前沿多模態程式設計模型。

上下文視窗 — 1,000,000 個 token,與 MiniMax-M3 所承載的上限相同
• 輸入模態 — 文字、圖像與影片,回傳文字
• 思考深度 — 一個 effort 設定,接受 low、medium、high、xhigh 與 max,預設為 max(當省略時)
• 協定支援 — 同一個模型 ID 可在 MiniMax 的 Anthropic 相容端點、其 OpenAI 相容端點及 OpenAI Responses 端點上運作
• 可用性 — 僅限 Token Plan 與 MiniMax Code;不適用於隨用隨付
• 價格 — 未在任何地方公布每 token 費率
• 權重 — 無;MiniMaxAI 組織最近兩個公開儲存庫仍為 MiniMax-Music3 與 MiniMax-H3
• 獨立基準測試 — 無;該模型在 Artificial Analysis 的模型索引中沒有條目

該公司同日在自家的 MiniMaxAgent 帳號上宣布此事,將其定位為日常開發用途,而非前沿工作:快速且可靠,從快速修正錯誤到完整功能開發皆涵蓋在內。這是 Flash 層級的任務定位,而非旗艦級。來自 PANews 和 KuCoin 的第三方新聞報導也以相同措辭描述,並指出在該公司確認之前,開發者早已在 MiniMax Code 的選取器中發現這款模型。

A headless Chromium screenshot of MiniMax's own model documentation page, showing the standing note that MiniMax-M3.1-Flash-Preview is available only through Token Plan and MiniMax Code for now, above the vendor's language-model table in which MiniMax-M3.1-Flash-Preview is listed first with a 1,000,000-token context window and the description 'Frontier multimodal coding model with 1M context window and tunable thinking depth', ahead of MiniMax-M3 with the same 1,000,000-token window, captured 28 September 2026.

你使用哪一把金鑰,比平常更為重要。

這就是最容易讓人踩雷的地方。MiniMax 採用兩種不同的憑證類型,而 M3.1-Flash-Preview 只會認其中一種。Token Plan Subscription Key 來自 Billing > Token Plan,涵蓋訂閱用量與已購買的 Credits。隨用隨付 API Key 則涵蓋以 token 計價的模型。供應商文件明確指出,這兩者不能互換,而且 Subscription Key 可以在任何付費資源附加到它之前就存在——在這種情況下,它是一把有效但背後沒有任何資源的金鑰。

所以實務上的判斷標準不是「我有沒有 MiniMax API 金鑰」,而是「我有沒有 Token Plan 席位」。既有的席位都已涵蓋在內。文件指出,當席位或 Credits 存取權獲指派後,Subscription Key 才能開始使用;而一旦訂閱配額用盡,Credits 超額部分便會自動動用。

還有一個值得知道的文件不一致之處,因為它會讓任何先閱讀定價頁面的人感到困惑。Token Plan 定價頁面的涵蓋範圍註腳仍將適用陣容列為 M3、M2.7、圖像與語音,並排除 H3——它尚未更新為列出 M3.1-Flash-Preview。模型頁面則說法相反:M3.1-Flash-Preview 可在 Token Plan 上使用,且別無其他。截至今日,這兩個頁面都是上線中的供應商頁面。只有你手上的金鑰才能定奪。

那個能告訴你這是哪種模型的 400

每個 MiniMax M 系列模型在回答之前都會先思考,但 M3.1-Flash-Preview 是第一個拒絕停下來的。送出thinking: {"type": "disabled"}或reasoning_effort: "none",API 就會回傳 HTTP 400,並附帶以下訊息:

模型「MiniMax-M3.1-Flash-Preview」需要自適應思考;不允許 thinking.type="disabled"(包括 reasoning.effort=none)(2013)

廠商自己的指引是調低 投入程度,而不是試圖停用思考;這個階梯就是調節延遲的槓桿:在 low 進行例行編輯,以及在 xhigh 進行全儲存庫變更,都是同一個模型做出不同的取捨。還有兩個細節是這個模型特有的。reasoning_effort 參數根據文件記載,僅對 MiniMax-M3.1-Flash-Preview 有效——它不是通用的 M 系列控制項。而 reasoning_split 輸出開關會將思考分離到 reasoning_content 欄位,目前在此模型上無法設為 false。

思考文字的落點取決於協定:Anthropic 相容端點會將它回傳為 thinking 內容區塊,OpenAI 相容端點會透過 reasoning_content 回傳,而 Responses 端點則會將它回傳為 reasoning 輸出項目。如果你過去是從 MiniMax-M3 的輸出中解析 <think> 標籤,在較新的模型上已不再需要這麼做——而對於交錯式工具使用對話,包含思考區塊的完整回應必須附加回訊息歷史中,否則推理鏈會中斷。

目前正在進行的促銷活動

MiniMax Code 正在舉辦簽到促銷活動,時間為 UTC+8 的 9 月 28 日至 10 月 7 日,每日登入所獲得的免費額度加倍,並同時開放給新舊用戶。所發放的額度適用於支援的模型,其中以 M3.1-Flash-Preview 與 H3 影片模型為例。另外,該公司表示 Token Plan 的額度已於活動上線時為所有用戶重置,並計劃在活動期間進一步重置,資格則顯示於應用程式內。

把這兩者視為經由上市報導轉述的供應商說法——它們是附有日期的宣傳條款,而非產品行為,而且同一篇報導也指出,該公告並未具體說明每次簽到可獲得的點數數量,或錯過天數的精確規則。穩定狀態下的經濟模式則較容易說明:Token Plan 的定價為 Plus 每月 22 美元、Max 每月 55 美元、Ultra 每月 132 美元,並設有 5 小時滾動與每週配額窗口,供應商估計分別約可支援 3 到 4 個、4 到 5 個,以及 6 到 7 個並行代理。購買的 Credits 匯率為每 1 美元兌 1,000 點,並依各模型按用量計費的定價表扣點。

這個模型仍然沒有的四件事

以下各點都不是對該模型的批評;每一項都是團隊必須事先規劃因應的漏洞,而且這四項在今天全都可驗證。

• 沒有價格。在任何 MiniMax 頁面上都找不到 M3.1-Flash-Preview 的每 token 費率,因此無法就每 token 成本與 M3 的每百萬輸入 $0.30、每百萬輸出 $1.20 相比,也無法與其他任何東西相比。
• 沒有基準測試。MiniMax 在此次發布中並未公布任何評估表。其他人也一樣:該模型未出現在 Artificial Analysis 的索引中,所以它的欄位是真的空白,而不只是資料尚早。
• 沒有權重。MiniMax-M3 以開放權重形式發布;M3.1-Flash-Preview 則沒有儲存庫,也沒有可下載的檢查點。
• 沒有獨立量測。沒有任何第三方提供輸出速度、延遲或錯誤率的數據,我們自家的路由遙測資料也沒有,因為該模型不在我們的目錄中。

相較於2026年6月的M3發布——當時首日就附上架構說明、基準測試表與價目表——這次是刻意低調的發布。合理的解讀——而這是解讀,不是明說的計畫——是MiniMax想先在自己的產品內取得實際使用情況,再決定該模型的價格以及是否開放。

A generated two-column infographic titled 'What the vendor confirms, and what it has not published', for MiniMax M3.1 Flash Preview. The left column, headlined 'Confirmed on day one', lists 'Listed first in MiniMax's own model table, above MiniMax-M3', '1,000,000-token context window', 'Text, image and video input returning text', 'An effort ladder from low to max, defaulting to max', 'Reachable over Anthropic-, OpenAI- and Responses-compatible endpoints', and 'Covered by the existing Token Plan Subscription Key'. The right column, headlined 'Still unpublished', lists 'Per-token price, anywhere on MiniMax's pages', 'A model card or evaluation table', 'Public weights or a downloadable checkpoint', 'Any entry on Artificial Analysis's model index', and 'Output-speed and latency figures from any third party'. A footer reads 'Per platform.minimax.io documentation and the launch announcement, 27 September 2026.'

外洩的預覽筆記說對了哪些事

發表前四天,一份轉錄自公開合作夥伴儲存庫的預覽文件開始流傳,內容描述了一個 MiniMax M3.1,具備稀疏注意力、Q8KV4 注意力量化、NVFP4 路由專家、DSpark 推測解碼頭,以及一個全新的 reasoning_effort 欄位,其取值範圍從 max 一路向下到 low。當時我們將其報導為未經證實,因為事實確實如此:沒有權重、沒有模型卡、沒有定價頁面,也沒有任何 API 模型 ID 存在。

這五項說法中,有一項現已由廠商自家文件證實,那就是 reasoning_effort 欄位——包括從 max 到 low 的階梯,與實際出貨值完全吻合。其餘四項仍未獲證實。MiniMax 對 M3.1-Flash-Preview 的公開說明僅指出,它是一個具備 1M 上下文視窗與可調思考深度的前沿多模態程式設計模型;並未描述其注意力機制、量化或解碼頭。任何人若將稀疏注意力與 NVFP4 的說法當成已定案的規格來複述,就只是在複述第三方的轉錄內容,而這正是該發布並未證實的事。

如果你想試試看,又不想把整條 pipeline 押上去

只提供 Token-Plan 的預覽版,尷尬之處在於:評估新模型最自然的方式——從你現有的技術堆疊呼叫它並進行量測——正是你無法乾淨俐落做到的事。沒有可供推算的每 token 費率、沒有公布的延遲概況,而且如果預覽版不穩,供應商自家產品內也沒有容錯移轉方案。

這正是路由層存在的意義。你今天能呼叫的一切,都位於單一 OpenAI 相容端點與一組 API 金鑰之後,而與這個模型相鄰的模型早已就位:MiniMax-M3 以供應商的費率每百萬輸入 token 0.30 美元、每百萬輸出 token 1.20 美元,MiniMax M2.7 同樣的標價,卻具備 200,000 token 的視窗與開放權重,還有同一價格帶的 DeepSeek 與 Qwen Flash 層級。我們這邊的價格,是供應商的定價以 0% 加價直接轉嫁,因此當廠商調降費率時,當天就會反映在這裡,而不是等到重新議價的週期。自動容錯移轉意味著預覽級依賴可以與正式生產路徑並行,而不是位於其下;而當 MiniMax 真的為 MiniMax-M3.1-Flash-Preview 公布價目表與端點時,問題就變成路由表中的一筆項目,而不是一項遷移專案。MiniMax-M3.1-Flash-Preview 本身並未收錄在我們的目錄中,今日要使用它的途徑,是供應商自家的 Token Plan 及其程式開發產品。

給在發布日讀到這篇的團隊一句誠實的總結:這個模型已經上線,如果你本來就付費購買了 Token Plan 席次,使用它的邊際成本是零,但若單就它本身而言,則完全沒有定價、也毫無衡量。在 MiniMax Code 裡試玩一下,把你所依賴的流程留在有價目表和實績的模型上,並留意兩件事,它們會讓這件事從一時好奇變成正式決策——公開的定價,以及第一批獨立評測分數。

A generated scorecard infographic titled 'The models you can call today, and what they cost'. Six rows read: 'MiniMax M3 — $0.30 in / $1.20 out per 1M tokens, 1,048,576-token context, open weights', 'MiniMax M2.7 — $0.30 in / $1.20 out per 1M tokens, 204,800-token context, open weights', 'DeepSeek V4 Flash — $0.22 in / $0.66 out per 1M tokens, 1,048,576-token context', 'DeepSeek V4.1 Flash — routed on the same key in the same price band', 'MiniMax M3.1 Flash Preview — no per-token rate published; Token Plan and MiniMax Code only', and 'One OrcaRouter API key reaches 200+ models with 0% markup on the provider's list price and automatic failover across providers'. A footer reads 'Catalogue figures per OrcaRouter's public model API, 28 September 2026; MiniMax M3.1 Flash Preview is not on the OrcaRouter catalogue.'