
Claude Haiku 5.5 vs MiniMax M3.1 Flash Preview:片方には価格があり、もう片方にはトークンプランがある
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
MiniMax M3.1 Flash Preview には、公表されたトークンあたりの価格がない。高い価格がないのでも、プロモーション価格がないのでもない——価格そのものが存在しない。利用できるのはベンダーの Token Plan とその Code サーフェス経由のみで、開発者向けドキュメントにもそのとおり明記されている。2026年10月7日にリリースされた Claude Haiku 5.5 は、100,000トークンのプロンプトまで、入力100万トークンあたり $0.10、出力100万トークンあたり $0.50 のコストがかかる。したがって、この対決についてまず言えるのは、これは価格比較ではないということだ。2つのモデルのうち価格があるのは片方だけなのだから。代わりにこれは、従量課金制 API とサブスクリプションの比較であり、その違いは、どんなベンチマークよりもあなたのコストを大きく左右する。
2番目に言っておくべきことは、MiniMax M3.1 Flash Previewにはモデルカードがなく、公開されたベンチマークも、重みも、私たちが確認できる独立したスコアもないということだ。これは2026年9月27日に登場し、ベンダー自身の表記によれば、APIではなくサブスクリプションを通じて利用できるプレビュー版である。それはモデルへの批判ではない。モデルについて何が分かり、何が分からないかを述べたものだ。以下の内容はすべて、その一線を常に見えるようにしている。
それぞれが実際に何なのか
Claude Haiku 5.5 — Anthropic, ID claude-haiku-5-5、2026年10月7日リリース。テキストと画像を入力、テキストを出力。100万トークンのコンテキストウィンドウ、最大出力128,000トークン(Batch API のベータヘッダー経由で300,000)、2026年6月のトレーニングカットオフ、廃止は2027年10月7日より前には行われない。Low、Medium、High、Xhigh、Max にわたって調整可能なエフォートで、デフォルトは Medium、適応型思考はデフォルトで有効。トークン単位の従量課金で、キャッシュ読み取りは100万トークンあたり $0.01、Batch は半額。
MiniMax M3.1 Flash Preview — MiniMax、2026年9月27日より提供中。100万トークンのコンテキストウィンドウ。テキスト・画像・動画を入力し、テキストを出力。思考は常にオンで、エフォート制御はlowからmaxまで。APIはAnthropic互換、OpenAI互換、OpenAI Responses互換であり、どちらのSDKにもほぼそのまま組み込める。アクセスはToken PlanとMiniMax Code経由のみで、従量課金の手段も公開された料金もない。

• 観点ごとの比較
• 価格 — Claude Haiku 5.5 は入力100万トークンあたり$0.10、出力$0.50(10万トークンまで)、その後は$0.50と$2.50。MiniMax M3.1 Flash Preview には公開されたトークン単価がなく、Token Plan サブスクリプションのみです。
• コンテキストウィンドウ — 各1,000,000トークン。これが、両者が真に互角である唯一の側面だ。
• 最大出力 — Claude Haiku 5.5 では 128,000 トークン、Batch では 300,000 トークンのベータ経路を提供。MiniMax M3.1 Flash Preview では非公開。
• 入力モダリティ — テキストと画像 対 テキスト、画像、動画。動画入力は真の差別化要因であり、MiniMaxがその点で優位に立つ。
• エフォート制御 — Claude Haiku 5.5 では 5 段階、デフォルトは中。MiniMax M3.1 Flash Preview では低から最大まで、思考は常にオン。
• 独立系スコア — Artificial Analysis Intelligence Index 43、Max構成43.40、Claude Haiku 5.5は182中2位。MiniMax M3.1 Flash Previewについては未公表。
• 完了したタスクあたりのコスト — Claude Haiku 5のArtificial Analysisタスクあたり0.21ドル。Miniq M3.1 Flash Previewについては、スコアとレートの両方がないため計算できません。
・出力速度 — Claude Haiku 5.5では毎秒243.4トークン、MiniMax M3.1 Flash Previewは未報告。
• オープンウェイト — どちらも該当せず。Claude Haiku 5.5 はプロプライエタリであり、MiniMax は M3.1 Flash Preview のウェイトを公開していません。
なぜサブスクリプションは聞こえるほど相性が良くないのか
この対戦には Token Plan のほうが買い得になるバージョンがあり、それに対して公平である価値がある。あなたが MiniMax Code を対話的に使う人なら、サブスクリプションはどれだけ使ってもコストを既知の月額に上限を設けるが、トークン単位の課金には同等の天井がない。ヘビーな対話型ユーザーにとって、定額プランはほとんどの場合、従量課金に勝る。
その論理は、利用がプログラム的になった瞬間に反転する。サブスクリプションは人間の利用パターン——断続的で、対話的で、自己制限的——に合わせて価格設定されている。エージェント、バッチジョブ、本番エンドポイントにはそんな論理はない。キューが求めるだけ動き続ける。そのトラフィックを対話型利用向けに価格設定されたプランに載せると、見えない制限にぶつかるか、スループットが必要なときにシート分を払うかのどちらかになる。そして二次的な問題はもっと深刻だ。トークン単位の料金が公開されていなければ、量が増えるにつれてコストを予測する方法も、他のどのモデルとも価格を比較する方法も、より安いモデルで事足りたかどうかを判断する方法もない。計算できない価格は、防御できない予算である。
Claude Haiku 5.5 は、最良の意味で正反対の問題だ。料金は公開され、ティアも公開され、キャッシュ割引も公開されており、唯一の罠は隠されているのではなく構造的なものだ。プロンプトが100,000トークンを超えると、両方の料金が5倍になる。それは設計で回避できる崖だ。非公開の料金は、回避できない霧である。
1Mトークンの同点、そしてそれが見た目どおりの意味ではない理由
両モデルとも100万トークンのコンテキストウィンドウを宣伝しており、それは両ベンダーが前面に押し出す見出しだ。また、この点は引き分けが最も誤解を招く次元でもある。なぜなら、コンテキストウィンドウは使用可能なコンテキストと同じものではないからだ。Claude Haiku 5.5はウィンドウと併せて最大出力128,000トークンを公表し、入力トークンが100,000を超えると基本料金の5倍を課金する——長いプロンプトは許可されているが、想定されたデフォルトではないと明白に示す価格設計だ。MiniMaxはM3.1 Flash Previewの最大出力を公表しておらず、長文コンテキストの価格も一切公表していない。というのも、価格を一切公表していないからだ。
長いコンテキストこそ、2つのアーキテクチャ間のコスト差が最もはっきりと現れる場面であり、まさにそこで、そのうち一方は数字を何も示してくれない。あなたのワークロードが本当に長いコンテキストを扱うものであるなら、決め手となるのはその数字の不在であって、両者に共通する1Mという数字ではない。

もしあなたが本当に求めているのが MiniMax M3 なら
MiniMax M3.1 Flash Previewはプレビュー版であり、プランによる制限があり、スコアは付けられていません。MiniMax M3はそれらのいずれでもありません。これは、2026年5月31日にMiniMaxがリリースしたオープンウェイトのフラッグシップです:100万トークンのコンテキストウィンドウ、テキスト、画像、動画を入力として受け取り、テキストを返すネイティブなマルチモーダリティ、MiniMax Sparse Attentionを基盤とし、価格は入力100万トークンあたり$0.30、出力100万トークンあたり$1.20です。Artificial Analysisは、Intelligence Index 29、インデックスタスクあたりのコスト$0.51、出力毎秒91.7トークン、最初のトークンまでの時間2.16秒、80%のキャッシュ割引と評価しています。本日、OrcaRouterのカタログに、以下のモデルとして掲載されています:minimax/minimax-m3。
これは、スペックシートが隠してしまうこの対決についての具体的な点を突いている。トークン単位で実際に購入できるMiniMaxのモデルは、プレビューより1世代遅れており、独立系インデックスでは29点で、Claude Haiku 5.5の43点に対して劣り、完了タスクあたりのコストは約2倍で$0.51対$0.21、出力速度は約3分の1だ。プレビューはそれらすべてを上回る可能性が十分にある。MiniMaxの外部では誰も知らず、サブスクリプションページからそれを知る方法はない。

これら2つを1か所から呼び出す
MiniMax M3.1 Flash Previewは、MiniMaxのToken PlanとMiniMax Codeを通じて利用できます。Claude Haiku 5.5は、Anthropic自身のAPIを通じて、そしてそこからAnthropicのモデルが再販売されているあらゆる場所で利用できます。どちらもOrcaRouterのカタログには掲載されていません——この組み合わせから当社がルーティングするのはminimax/minimax-m3で、anthropic/claude-haiku-4.5、anthropic/claude-sonnet-5.5、anthropic/claude-opus-5.5、anthropic/claude-fable-5.1と並んでおり、本記事が扱う2つのモデルを取り扱っているかのような示唆は行いません。
ここでルーティングレイヤーが本当に提供するのは、2つの課金形態問題からの脱却です。minimax/minimax-m3は従量課金で当社のカタログに掲載されており、Claude Haiku 5.5は従量課金でAnthropicのカタログにあります。どちらもOpenAI互換インターフェースを話すため、両者のA/Bは書き直しではなくモデル文字列の違いであり、OrcaRouterはプロバイダーの定価を0%のマークアップでそのまま通すため、MiniMaxの価格変更はそれが起きた日に請求に反映されます。Token Planモデルは、そのようには正規化できない唯一の部分です。サブスクリプションには通過させるトークン単位の価格が存在せず、これは課金側から述べた同じ問題です。
スコアなしでどう決めるか
動画入力が必要なら、この2つのうちそれに対応しているのは MiniMax M3.1 Flash Preview だけであり、ワークロードがプログラムによる処理ではなく対話的なものであるなら、Token Plan は購入して妥当なものです。予算に組み込める数値、確認できるスコア、価格を見積もれるウィンドウが必要なら、そのいずれかを提供しているのはこの2つのうち Claude Haiku 5.5 だけです。そして MiniMax ファミリーを、独立したスコアが付いた従量制 API で使いたいなら、正直な推奨は、条件がまだ公開されていないプレビューを待つのではなく、実際にトークン単位で購入できる世代を使うことです。
どちらもOpenAI互換のインターフェースを使うため、両者間のA/Bは書き換えではなくモデル文字列の違いであり、OrcaRouterはプロバイダーの定価を0%のマークアップでそのまま通すので、MiniMaxの価格変更はそれが起きたその日に請求へ反映されることになります。
