
Claude Haiku 5.5 vs MiniMax M3.1 Flash Preview:一個有價格,另一個有代幣方案
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
MiniMax M3.1 Flash Preview 並未公布任何按 token 計價的價格。不是偏高,也不是促銷價——而是完全沒有。它僅能透過供應商的 Token Plan 及其 Code 介面取得,開發者文件也毫不含糊地如此寫明。Claude Haiku 5.5 於 2026 年 10 月 7 日發布,在提示詞不超過 100,000 個 token 的範圍內,每百萬輸入 token 收費 $0.10,每百萬輸出 token 收費 $0.50。因此,關於這場對決,首先要說的是:這並不是一場價格比較,因為兩款模型中只有一款有價格。它實際上是一場計量制 API 與訂閱制之間的比較——而這個差異對你成本所造成的影響,遠比任何基準測試都來得大。
第二件要說的是,MiniMax M3.1 Flash Preview 沒有模型卡、沒有公開的基準測試、沒有權重,也沒有我們能找到的獨立評分。它於 2026 年 9 月 27 日出現,而且依廠商自身的標示,它是透過訂閱而非 API 取得的預覽版。這不是在批評該模型;而是在描述關於它,你能知道什麼、不能知道什麼。以下所有內容都會讓這條界線保持清楚可見。
每一個實際上是什麼
Claude Haiku 5.5 — Anthropic,ID claude-haiku-5-5,於 2026 年 10 月 7 日發布。文字與圖像輸入,文字輸出。1M token 上下文視窗,最大輸出 128,000 token(在 Batch API 上透過 beta 標頭可達 300,000),訓練截止時間為 2026 年 6 月,退役時間不早於 2027 年 10 月 7 日。可調整的投入程度,分為 Low、Medium、High、Xhigh 和 Max,預設為 Medium,並預設開啟自適應思考。按 token 計費,快取讀取每百萬 $0.01,Batch 半價。
MiniMax M3.1 Flash Preview — MiniMax,自 2026 年 9 月 27 日起上線。具備 100 萬詞元(token)的上下文視窗。輸入支援文字、圖像與影片,輸出為文字。思考功能恆常開啟,並提供從低到最高的強度控制。此 API 相容於 Anthropic、OpenAI 及 OpenAI-Responses,因此幾乎可直接替換任一款 SDK。僅能透過 Token Plan 與 MiniMax Code 存取;不提供依用量計費的方案,亦未公布費率。

• 比較,逐個維度
• 價格 — Claude Haiku 5.5:每百萬輸入代幣 $0.10、輸出 $0.50(最多 100K 代幣),之後為 $0.50 和 $2.50;MiniMax M3.1 Flash Preview 沒有公開的每代幣費率,只有 Token Plan 訂閱。
• 上下文視窗 —— 各 1,000,000 個 token。這是雙方真正勢均力敵的唯一一個面向。
• 最大輸出 — Claude Haiku 5.5 為 128,000 個 token,Batch 上另有 300,000 個 token 的 beta 途徑;MiniMax M3.1 Flash Preview 未公布此資訊。
• 輸入模態——文字與圖像 對比 文字、圖像與影片。影片輸入是真正的差異化優勢,而 MiniMax 勝出。
• 努力程度控制 — 五個等級,預設為 Medium,用於 Claude Haiku 5.5;MiniMax M3.1 Flash Preview 則從 low 到 max,且 thinking 一律開啟。
• 獨立評分 — Artificial Analysis 智慧指數 43,Max 配置為 43.40,Claude Haiku 5.5 在 182 個之中排名第二;MiniMax M3.1 Flash Preview 則未有任何已公布的評分。
• 每項完成任務的成本 — Claude Haiku 5.5 的每個 Artificial Analysis 指數任務為 $0.21;若沒有分數和費率,則無法計算 MiniMax M3.1 Flash Preview 的每項完成任務成本。
• 輸出速度 — Claude Haiku 5.5 為每秒 243.4 tokens;MiniMax M3.1 Flash Preview 未報告。
• 開放權重 — 兩者皆非。Claude Haiku 5.5 為專有模型;MiniMax 尚未釋出 M3.1 Flash Preview 的權重。
為什麼訂閱制比聽起來更不合適
這場對決中存在一種情境,是 Token Plan 更值得買,而我們也該公平地看待它。如果你是以互動方式使用 MiniMax Code 的人,訂閱會把你的成本上限固定在一個已知的月費金額,無論你用量多大;而按 token 計價則沒有同等的上限。對重度互動使用者而言,固定方案幾乎總是勝過按量計費。
那套邏輯在工作負載變成程式化驅動的那一刻就顛倒了。訂閱方案的定價是針對人類的使用模式——突發、互動、自我節制。但一個代理、批次工作或正式環境端點並沒有這種模式:佇列要求多少,它就跑多少。把這種流量放到以互動使用定價的方案上,意味著要嘛撞上一個你看不見的上限,要嘛在你需要的是吞吐量時,卻在為一個席位付費。而二階問題更糟:沒有公開的每詞元費率,就無法在用量成長時預估成本,無法與任何其他模型比價,也無法判斷一個更便宜的模型是否本來就能完成工作。算不出來的價格,是你無法捍衛的預算。
Claude Haiku 5.5 則以最好的方式呈現了相反的問題。費率是公開的,分級是公開的,快取折扣是公開的,唯一的陷阱是結構性的,而非隱藏式的:提示一旦超過 100,000 個 token,兩種費率都會乘以五。那是一座你可以事先設計因應的斷崖;未公開的費率則是你無法掌握的迷霧。
1M-token 平手,以及為何它並非表面上看起來那樣
兩款模型都宣稱具備 100 萬 token 的上下文視窗,而這也是兩家廠商主打的首要賣點。然而,這同時也是最容易產生誤導的比較維度,因為上下文視窗不等同於可用的上下文。Claude Haiku 5.5 在公布其視窗的同時,也公布了 128,000 token 的最大輸出量,並且在輸入超過 100,000 token 時,收取基本費率的五倍——這樣的定價設計明白告訴你:長提示詞雖然允許,但並非預設的預期用法。MiniMax 並未公布 M3.1 Flash Preview 的最大輸出量,也完全沒有公布長上下文定價,因為它根本沒有公布任何定價。
長上下文正是兩種架構之間成本差異最會清楚顯現的地方,也正是其中一種架構不給你任何數字的地方。如果你的工作負載確實是長上下文,那麼那個數字的缺席才是決定性的事實,而不是共通的 1M 數字。

如果你真正想要的是 MiniMax M3
MiniMax M3.1 Flash Preview 是預覽版本,需搭配特定方案才能取用,且未列入評分。MiniMax M3 則完全不是這麼回事。它是 MiniMax 於 2026 年 5 月 31 日推出的開放權重旗艦模型:具備 100 萬 token 的上下文視窗,原生支援多模態,可輸入文字、圖像與影片並輸出文字,以 MiniMax Sparse Attention 為基礎打造,價格為每百萬輸入 token 0.30 美元、每百萬輸出 token 1.00 美元。Artificial Analysis 給予它的評分為 Intelligence Index 29,每個指數單位的成本為 0.51 美元,輸出速度為每秒 91.7 個 token,首個 token 生成時間為 2.16 秒,並提供 80% 的快取折扣。它今天已收錄於 OrcaRouter 的目錄中,型號為 minimax/minimax-m3。
這具體說明了這場對決中規格表所隱藏的一項重點。你實際能按 token 購買的 MiniMax 模型比預覽版落後一代,在獨立指數上拿到 29 分,而 Claude Haiku 5.5 是 43 分;每完成一項任務的成本約為兩倍,為 0.51 美元對上 0.21 美元;輸出速度則約為三分之一。預覽版很可能勝過以上所有表現。MiniMax 之外無人知曉,而且無法從訂閱頁面得知。

從同一個地方呼叫這兩個
MiniMax M3.1 Flash Preview 可透過 MiniMax 的 Token Plan 與 MiniMax Code 取得。Claude Haiku 5.5 可透過 Anthropic 自家的 API 取得,並由此延伸至所有轉售 Anthropic 模型的地方。兩者都不在 OrcaRouter 的目錄中——我們從這組搭配中路由的是minimax/minimax-m3,以及anthropic/claude-haiku-4.5、anthropic/claude-sonnet-5.5、anthropic/claude-opus-5.5和anthropic/claude-fable-5.1,而我們不會暗示我們提供本文所談的這兩個模型。
路由層在此真正提供的,是擺脫兩種計費形態問題的一條出路。minimax/minimax-m3 是按用量計費且列在我們的型錄中;Claude Haiku 5.5 是按用量計費且列在 Anthropic 的型錄中。兩者都採用 OpenAI 相容介面,因此它們之間的 A/B 只是一個模型字串,而不是一次改寫;而 OrcaRouter 以 0% 加成將供應商定價原樣傳遞,意味著 MiniMax 一變價,當天就會反映到你的帳單上。Token Plan 模式則是唯一無法用那種方式標準化的一環——訂閱制沒有可供傳遞的每 token 價格,而這正是同一個問題從計費端陳述的版本。
如何在沒有分數的情況下做決定
如果你需要影片輸入,MiniMax M3.1 Flash Preview 是這兩者中唯一支援它的;如果你的工作負載是互動式而非程式化,Token Plan 是合理的購買選擇。若你需要一個能編進預算的數字、一個能查核的分數,以及一個能定價的窗口,Claude Haiku 5.5 是這兩者中唯一提供上述任何一項的。而如果你想在按用量計費、並附有獨立分數的 API 上使用 MiniMax 系列,誠實的建議是使用實際上可按 token 購買的那一代,而不是等待條款尚未公布的預覽版。
兩者都採用與 OpenAI 相容的介面,因此它們之間的 A/B 差異只在於一個模型字串,而不必改寫程式碼;而 OrcaRouter 以 0% 加成直接轉嫁供應商的定價,這意味著 MiniMax 的價格一有變動,當天就會反映在你的帳單上。
