
Claude Haiku 5.5 対 Xiaomi MiMo-V2.6-Flash:料金表と実測請求額が食い違うとき
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 57 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 345 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
料金表を額面通りに受け取れば、Claude Haiku 5.5 対 Xiaomi MiMo-V2.6-Flash は Xiaomi モデルの圧勝に見える。100万トークンあたり $0.14 と $0.28 対 $0.10 と $0.50、しかも 100,000 トークンを超えると段階的に上がる料金ではなく定額での出力において 1.8 倍の優位だ。だが、独立したタスク実行が実際にいくらかかるかを見ると順位は逆転する — MiMo-V2.6-Flash は、Haiku が $0.2128 で終えるタスクを $0.06231 で終える。それでも Haiku は同じベンチマークで 15 パーセント高いスコアを出し、そのタスクを実時間の 3 分の 1 で終える。これら 4 つの記述はどれも間違っていない。それぞれ異なるものを測っているのだ。本稿は、それらのうちどれがあなたの請求額を予測するのか、そしてそれぞれがどこで役に立たなくなるのかについてである。
2つの料金表
まずは各ベンダーが公表している数字から始めよう。それらは比較される数字であり、たいていの場合、重要な数字ではないからだ:
• 価格 — {{1}}Claude Haiku 5.5{{/1}} は 10万トークン未満で100万トークンあたり {{2}}$0.10 / $0.50{{/2}}、超過時は {{3}}$0.50 / $2.50{{/3}}({{4}}Anthropic{{/4}} の定価表);{{5}}Xiaomi MiMo-V2.6-Flash{{/5}} は {{6}}$0.14 / $0.28{{/6}} の一律料金(ベンダー定価表)
• コンテキストウィンドウ — Claude Haiku 5.5 は 1,000,000 トークン、MiMo-V2.6-Flash は 1,000,000 トークン、いずれもベンダー公表
• 最大出力 — Haikuでは128,000トークン(Batchでは300,000)。MiMo-V2.6-Flashについては別個の上限として公表されていない
• アーキテクチャ — Haikuでは非公開。MiMo-V2.6-Flashは総パラメータ数309B、うちアクティブ15BのMixture-of-Experts構成(ベンダー公表)
• ライセンス — Haiku はクローズドかつ API 専用、MiMo-V2.6-Flash は MIT(ベンダー公開)
• 独立系インデックス — Claude Haiku 5.5 は 43.395、MiMo-V2.6-Flash は 37.884(Artificial Analysis)
それらの行のうち3つが実際の購入の大半を左右し、しかも三つの異なる方向を指している。出力価格では、Xiaomiモデルのほうが安い——短いコンテキストでは$0.28 対 $0.50。入力価格では、Haikuは100,000トークン未満では安く、それより上でははるかに高い。コンテキストウィンドウでは、Xiaomiモデルが2倍の容量を主張している。その3つのうち、そもそも能力の主張と言えるのは最後の1つだけであり、Haikuの100,000トークンでの定額ステップは、価格比較には一対の数字が隠してしまう継ぎ目があることを意味している。

慎重に検討された請求書
料金表はトークンに値段をつける。作業にはコストがかかる。Artificial Analysisは両方のモデルを同じタスクスイートで実行し、各タスクを完了するのに実際いくらかかったかを公表している。これはトークンあたりの価格とは異なる量であり、しばしば異なるランキングにもなる:
• タスクあたりのコスト — MiMo-V2.6-Flash $0.06231 対 Claude Haiku 5.5 $0.2128
• タスクあたりの出力トークン数 — MiMo-V2.6-Flash 77,792 対 Claude Haiku 5.5 162,164
• タスクあたりの実時間 — MiMo-V2.6-Flash 1,320.08秒 対 Claude Haiku 5.5 426.26秒
• インテリジェンス指数 — Claude Haiku 5.5 43.395 対 MiMo-V2.6-Flash 37.884
• Terminal-Bench Hard — Claude Haiku 5.5 0.329 対 MiMo-V2.6-Flash 0.227
5つの数値はすべてArtificial Analysisのもので、2026年10月上旬にこのボード自身のモデルページから取得したものであり、誰かに確認されても耐えうる意思決定に使うべき数値だ。
タスクあたりのコスト差は料金表が示唆するより大きく、その理由は2行目にある。Claude Haiku 5.5は、MiMo-V2.6-Flashが77,792で完了するタスクを遂行するのに162,164出力トークンを使う。およそ2.1倍のトークン数であり、主な理由はデフォルトで長々と推論することだ。出力トークンあたり1.8倍安く、タスクあたりの出力トークン数が半分以下であるモデルは、結果として1.8倍安くなるわけではない。この特定のスイートでは、むしろ一桁に近い安さになる。これがこのページで最も重要な一点であり、どの料金表もそれを公表していない。
実時間の折れ線は逆方向に伸びており、それについては正直に認める価値がある。MiMo-V2.6-Flash はタスクあたり1,320秒を要し、Haiku の426秒に対して3倍の長さだった。毎秒56.69トークンというより高い測定出力速度にもかかわらず、である。Haiku の推論は、生のトークン速度が予測するような形でこのスイートのボトルネックにはなっていないからだ。ワークロードがコスト律速ではなくレイテンシ律速であるなら、安価なモデルが自動的に適切な選択となるわけではない。そして独立したボードこそ、これらの数値が存在する唯一の場所だ。

15のポイントが実際に存在する場所
43.395 対 37.884 は Intelligence Index における 15 パーセントの差であり、この対決において Haiku を推す最強の根拠です。それが重要かどうかは、完全にタスク次第です。Terminal-Bench Hard では両者は 0.329 と 0.227 です — 相対的な差はより大きく、しかもエージェント的で多段階の側面に位置しており、そこでは 15 パーセントのインデックス差がタスク完了におけるはるかに大きな差へと複合しがちです。一般的な推論と知識のサブベンチマークでは、両者の差は見出しのインデックスが示唆するよりも小さく、MiMo-V2.6-Flash がそのうちいくつかで上回っています。
実用的な読み方:難易度曲線の底では、2つのモデルは交換可能であり、コスト差が決定要因となるべきです。頂点では — 長期的なエージェント、コードベース、失敗したタスクを再実行しなければならないあらゆる場面 — Haikuの15ポイントは、完了するタスクと、同じコストを二度払うタスクとの差であり、安価なモデルのタスクあたりのコスト優位性は、ボードの平均が示すことのできない形で逆転し得ます。これは、誰か他の人のインデックスを読むのではなく、自分自身のevalを実行しなければならないケースです。なぜなら、公表された平均ではそれを解決できないからです。
MITライセンスにはどれほどの価値があるのか
MiMo-V2.6-FlashはMITで提供されている——オープンライセンスの中で最も制約が少なく、商用利用の上限もなく、シェアアライク条項もない。これはQwen Community Licenceよりも強い許諾であり、309B/15B MoEの重みを望む誰もがセルフホストし、ファインチューニングし、再配布できることを意味する。推論が自社ハードウェア上で行われることを制約とするチーム、あるいはGPUを所有する方がトークンをレンタルするより有利になるほど利用量が多いチームにとって、これは脚注ではない——Claude Haiku 5.5はあなたが実行することは一切できないため、比較において重要となる唯一の行なのだ。
障害時の特性も変える。単一のベンダーとそのクラウドパートナーによって提供されるクローズドモデルは、彼らがダウンすれば一緒にダウンする。複数の独立したホストを持つ MIT ライセンスのモデルは、それらの間でフェイルオーバーできる——ただし、フェイルオーバーを実行する何かが存在する場合に限る。API だけを求めて他に何も要らないチームにとって、これらはいずれも MiMo-V2.6-Flash を選ぶ理由にはならない。そうではないチームにとっては、どちらも決定的だ。
自分で確認する価値のあるベンダーの主張
MiMoシリーズはXiaomiのもので、Xiaomiは発表資料で自社の速度と品質の数値を報告している。これらはベンダーによる数値であり、本稿執筆時点では再現されておらず、独立系のボードは現在、このモデルをベンダーの位置づけが示す水準よりも低く測定している——インデックスでは37.884、Terminal-Bench Hardでは0.227で、Haikuの0.329と対照的だ。それは何かを告発するものではない。ベンダー自身のハーネスと第三者のそれとの間にある通常の隔たりであり、数値が繰り返し引用されるたびに、どちらがどちらかを明示すべき理由でもある。
自分のトラフィックでやる価値のある確認は、午後1回分で済み、どんな指標よりもその疑問を決着させる。同じ20件のタスクを、自分のプロンプトを使って両方のモデルで実行し、各タスクについて入力トークン、出力トークン、実時間を記録して、上記の料金率を掛ける。判断を決める4つの数値はすべて測定できるものだ。入力トークン、出力トークン、秒数、そしてタスクが成功したかどうか。独立系ボードのタスクあたりコストは汎用スイートについての全体像であり、自分の場合は異なる。そして両者の違いは通常、冗長さであり、それはまさに料金表が隠しているものだ。Haikuのデフォルト推論が、そうでなければ再試行に支払うことになるタスク完了を買ってくれているなら、タスクあたり価格が3.4倍でも安い。そうでなければ、答えを変えなかったトークンに金を払っていることになる。
両方を1つのエンドポイントで取得する
Claude Haiku 5.5 も Xiaomi MiMo-V2.6-Flash も OrcaRouter では提供されていません。これらについては、ベンダー自身のAPIや複数のサードパーティプラットフォームから入手できます。当社が実際に提供しているのは、その周辺のラインナップです:qwen/qwen3.8-flash は100万トークンあたり $0.15 と $0.47、そして z-ai/glm-5.3-flash は $0.15 と $0.50、どちらもベンダーの定価で、パススルー価格と自動フェイルオーバーを備えた200以上のモデルカタログと同じキーと同じ請求で利用できます。
これはこの対決において、ある特定の形で重要になります。選ぼうとしている2つのモデルが、どちらもルーティングできないモデルである場合、決着は通常、実際のトラフィック上で両者を並べて動かすことでつきます。つまり、どちらについても2つ目の契約や2つ目のSDKを用意することなく、ルーティングしているモデルと並べて利用可能にしておく必要があります。候補を本番経路に置き、その背後にフォールバックとして稼働中のモデルを配置し、リクエストはルーティング層が選んだ方へ送り、料金表が教えてくれなかったタスクあたりコストの数値を、自社のトークンログから算出させましょう。独立系ボードのスイートは代理指標にすぎません。測定値となるのは、あなたのワークロードです。

その電話
ワークロードが大量で、出力が短く、時折のリトライを許容できるなら、Xiaomi MiMo-V2.6-Flash は、その料金表が謳うよりも大きな差で安価なモデルです — タスクあたり $0.06231 に対して $0.2128 — そして MIT ライセンスは、Haiku にはない逃げ道を提供します。ワークロードが長期的かつエージェント型なら、Claude Haiku 5.5 の15インデックスポイントと3倍速いタスク完了はその倍率に見合う価値があり、リトライを考慮に入れるとコスト差は縮まるか逆転します。
絶対にやってはいけないのは、料金表だけで選ぶことだ。ここにある2つのモデルは、トークンあたりでは価格差が2倍以内に収まっているのに、完了したタスクあたりでは桁が1つ違う。そして、その数字のうちベンダーがあなたに見せるページに載っているのは片方だけだ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
