一張生成的 hero card,標題為「Claude Haiku 5.5 vs MiniMax M3.1 Flash Preview」,引題為「一個有價格。另一個有代幣方案」,標籤顯示每 1M 為 $0.10 / $0.50,對比未公布;兩者皆為 1M 上下文;以及 AA Index 43,對比未公布任何數據。
Guides & Insights

Claude Haiku 5.5 vs MiniMax M3.1 Flash Preview:一個有價格,另一個有代幣方案

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

MiniMax M3.1 Flash Preview 並未公布任何按 token 計價的價格。不是偏高,也不是促銷價——而是完全沒有。它僅能透過供應商的 Token Plan 及其 Code 介面取得,開發者文件也毫不含糊地如此寫明。Claude Haiku 5.5 於 2026 年 10 月 7 日發布,在提示詞不超過 100,000 個 token 的範圍內,每百萬輸入 token 收費 $0.10,每百萬輸出 token 收費 $0.50。因此,關於這場對決,首先要說的是:這並不是一場價格比較,因為兩款模型中只有一款有價格。它實際上是一場計量制 API 與訂閱制之間的比較——而這個差異對你成本所造成的影響,遠比任何基準測試都來得大。

第二件要說的是,MiniMax M3.1 Flash Preview 沒有模型卡、沒有公開的基準測試、沒有權重,也沒有我們能找到的獨立評分。它於 2026 年 9 月 27 日出現,而且依廠商自身的標示,它是透過訂閱而非 API 取得的預覽版。這不是在批評該模型;而是在描述關於它,你能知道什麼、不能知道什麼。以下所有內容都會讓這條界線保持清楚可見。

每一個實際上是什麼

Claude Haiku 5.5 — Anthropic,ID claude-haiku-5-5,於 2026 年 10 月 7 日發布。文字與圖像輸入,文字輸出。1M token 上下文視窗,最大輸出 128,000 token(在 Batch API 上透過 beta 標頭可達 300,000),訓練截止時間為 2026 年 6 月,退役時間不早於 2027 年 10 月 7 日。可調整的投入程度,分為 Low、Medium、High、Xhigh 和 Max,預設為 Medium,並預設開啟自適應思考。按 token 計費,快取讀取每百萬 $0.01,Batch 半價。

MiniMax M3.1 Flash Preview — MiniMax,自 2026 年 9 月 27 日起上線。具備 100 萬詞元(token)的上下文視窗。輸入支援文字、圖像與影片,輸出為文字。思考功能恆常開啟,並提供從低到最高的強度控制。此 API 相容於 Anthropic、OpenAI 及 OpenAI-Responses,因此幾乎可直接替換任一款 SDK。僅能透過 Token Plan 與 MiniMax Code 存取;不提供依用量計費的方案,亦未公布費率。

A capture of the MiniMax developer documentation text-model page containing the line stating that MiniMax-M3.1-Flash-Preview is available only through Token Plan and MiniMax Code for now, alongside the subscription-key instructions and the supported API endpoint formats.

• 比較,逐個維度

• 價格 — Claude Haiku 5.5:每百萬輸入代幣 $0.10、輸出 $0.50(最多 100K 代幣),之後為 $0.50 和 $2.50;MiniMax M3.1 Flash Preview 沒有公開的每代幣費率,只有 Token Plan 訂閱。

• 上下文視窗 —— 各 1,000,000 個 token。這是雙方真正勢均力敵的唯一一個面向。

• 最大輸出 — Claude Haiku 5.5 為 128,000 個 token,Batch 上另有 300,000 個 token 的 beta 途徑;MiniMax M3.1 Flash Preview 未公布此資訊。

• 輸入模態——文字與圖像 對比 文字、圖像與影片。影片輸入是真正的差異化優勢,而 MiniMax 勝出。

• 努力程度控制 — 五個等級,預設為 Medium,用於 Claude Haiku 5.5;MiniMax M3.1 Flash Preview 則從 low 到 max,且 thinking 一律開啟。

• 獨立評分 — Artificial Analysis 智慧指數 43,Max 配置為 43.40,Claude Haiku 5.5 在 182 個之中排名第二;MiniMax M3.1 Flash Preview 則未有任何已公布的評分。

• 每項完成任務的成本 — Claude Haiku 5.5 的每個 Artificial Analysis 指數任務為 $0.21;若沒有分數和費率,則無法計算 MiniMax M3.1 Flash Preview 的每項完成任務成本。

• 輸出速度 — Claude Haiku 5.5 為每秒 243.4 tokens;MiniMax M3.1 Flash Preview 未報告。

• 開放權重 — 兩者皆非。Claude Haiku 5.5 為專有模型;MiniMax 尚未釋出 M3.1 Flash Preview 的權重。

為什麼訂閱制比聽起來更不合適

這場對決中存在一種情境,是 Token Plan 更值得買,而我們也該公平地看待它。如果你是以互動方式使用 MiniMax Code 的人,訂閱會把你的成本上限固定在一個已知的月費金額,無論你用量多大;而按 token 計價則沒有同等的上限。對重度互動使用者而言,固定方案幾乎總是勝過按量計費。

那套邏輯在工作負載變成程式化驅動的那一刻就顛倒了。訂閱方案的定價是針對人類的使用模式——突發、互動、自我節制。但一個代理、批次工作或正式環境端點並沒有這種模式:佇列要求多少,它就跑多少。把這種流量放到以互動使用定價的方案上,意味著要嘛撞上一個你看不見的上限,要嘛在你需要的是吞吐量時,卻在為一個席位付費。而二階問題更糟:沒有公開的每詞元費率,就無法在用量成長時預估成本,無法與任何其他模型比價,也無法判斷一個更便宜的模型是否本來就能完成工作。算不出來的價格,是你無法捍衛的預算。

Claude Haiku 5.5 則以最好的方式呈現了相反的問題。費率是公開的,分級是公開的,快取折扣是公開的,唯一的陷阱是結構性的,而非隱藏式的:提示一旦超過 100,000 個 token,兩種費率都會乘以五。那是一座你可以事先設計因應的斷崖;未公開的費率則是你無法掌握的迷霧。

1M-token 平手,以及為何它並非表面上看起來那樣

兩款模型都宣稱具備 100 萬 token 的上下文視窗,而這也是兩家廠商主打的首要賣點。然而,這同時也是最容易產生誤導的比較維度,因為上下文視窗不等同於可用的上下文。Claude Haiku 5.5 在公布其視窗的同時,也公布了 128,000 token 的最大輸出量,並且在輸入超過 100,000 token 時,收取基本費率的五倍——這樣的定價設計明白告訴你:長提示詞雖然允許,但並非預設的預期用法。MiniMax 並未公布 M3.1 Flash Preview 的最大輸出量,也完全沒有公布長上下文定價,因為它根本沒有公布任何定價。

長上下文正是兩種架構之間成本差異最會清楚顯現的地方,也正是其中一種架構不給你任何數字的地方。如果你的工作負載確實是長上下文,那麼那個數字的缺席才是決定性的事實,而不是共通的 1M 數字。

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs MiniMax M3.1 Flash Preview — the scoreboard'. Claude Haiku 5.5 reads price $0.10 / $0.50 per million, 1M-token context, 128K max output, text and image input, AA Index 43, billed per token; MiniMax M3.1 Flash Preview reads price not published, 1M-token context, max output not published, text image and video input, no published independent score, billed by subscription plan. A footer notes the Claude figures are per Artificial Analysis and the MiniMax figures are vendor-reported with no independent evaluation.

如果你真正想要的是 MiniMax M3

MiniMax M3.1 Flash Preview 是預覽版本,需搭配特定方案才能取用,且未列入評分。MiniMax M3 則完全不是這麼回事。它是 MiniMax 於 2026 年 5 月 31 日推出的開放權重旗艦模型:具備 100 萬 token 的上下文視窗,原生支援多模態,可輸入文字、圖像與影片並輸出文字,以 MiniMax Sparse Attention 為基礎打造,價格為每百萬輸入 token 0.30 美元、每百萬輸出 token 1.00 美元。Artificial Analysis 給予它的評分為 Intelligence Index 29,每個指數單位的成本為 0.51 美元,輸出速度為每秒 91.7 個 token,首個 token 生成時間為 2.16 秒,並提供 80% 的快取折扣。它今天已收錄於 OrcaRouter 的目錄中,型號為 minimax/minimax-m3。

這具體說明了這場對決中規格表所隱藏的一項重點。你實際能按 token 購買的 MiniMax 模型比預覽版落後一代,在獨立指數上拿到 29 分,而 Claude Haiku 5.5 是 43 分;每完成一項任務的成本約為兩倍,為 0.51 美元對上 0.21 美元;輸出速度則約為三分之一。預覽版很可能勝過以上所有表現。MiniMax 之外無人知曉,而且無法從訂閱頁面得知。

A capture of the OrcaRouter model page for minimax/minimax-m3 showing the MiniMax M3 listing with its Vision, Tools, JSON and Reasoning capability badges, the MiniMax byline and May 31, 2026 date, the 1M-token context description, the $0.30 and $1.20 per-million pricing and the Get the MiniMax M3 API call to action.

從同一個地方呼叫這兩個

MiniMax M3.1 Flash Preview 可透過 MiniMax 的 Token Plan 與 MiniMax Code 取得。Claude Haiku 5.5 可透過 Anthropic 自家的 API 取得,並由此延伸至所有轉售 Anthropic 模型的地方。兩者都不在 OrcaRouter 的目錄中——我們從這組搭配中路由的是minimax/minimax-m3,以及anthropic/claude-haiku-4.5、anthropic/claude-sonnet-5.5、anthropic/claude-opus-5.5和anthropic/claude-fable-5.1,而我們不會暗示我們提供本文所談的這兩個模型。

路由層在此真正提供的,是擺脫兩種計費形態問題的一條出路。minimax/minimax-m3 是按用量計費且列在我們的型錄中;Claude Haiku 5.5 是按用量計費且列在 Anthropic 的型錄中。兩者都採用 OpenAI 相容介面,因此它們之間的 A/B 只是一個模型字串,而不是一次改寫;而 OrcaRouter 以 0% 加成將供應商定價原樣傳遞,意味著 MiniMax 一變價,當天就會反映到你的帳單上。Token Plan 模式則是唯一無法用那種方式標準化的一環——訂閱制沒有可供傳遞的每 token 價格,而這正是同一個問題從計費端陳述的版本。

如何在沒有分數的情況下做決定

如果你需要影片輸入,MiniMax M3.1 Flash Preview 是這兩者中唯一支援它的;如果你的工作負載是互動式而非程式化,Token Plan 是合理的購買選擇。若你需要一個能編進預算的數字、一個能查核的分數,以及一個能定價的窗口,Claude Haiku 5.5 是這兩者中唯一提供上述任何一項的。而如果你想在按用量計費、並附有獨立分數的 API 上使用 MiniMax 系列,誠實的建議是使用實際上可按 token 購買的那一代,而不是等待條款尚未公布的預覽版。

兩者都採用與 OpenAI 相容的介面,因此它們之間的 A/B 差異只在於一個模型字串,而不必改寫程式碼;而 OrcaRouter 以 0% 加成直接轉嫁供應商的定價,這意味著 MiniMax 的價格一有變動,當天就會反映在你的帳單上。