
Claude Haiku 5.5 vs GLM-5.3-FlashX:同じ重みに2.5倍を支払う価値はあるのか
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 57 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 345 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
GLM-5.3-FlashXをClaude Haiku 5.5と比較する前に知っておくべき最も役立つ事実は、GLM-5.3-FlashXがGLM-5.3-Flashと同じ重みで動作し、呼び出しコストが2.5倍かかるということだ。Z.aiは2026年9月18日、自社APIでFlashXをローンチした。入力トークン100万あたり$0.37、出力トークン100万あたり$1.25で、派生元のベースモデルでは$0.15と$0.50だった。モデル自体は何も変わっていない。変わったのは、それがどこで動作し、そこでどれだけ高速に動作すると約束されているかだ。この組み合わせを理解することが、ここでのすべてだ。なぜなら、これは二つの能力レベルの比較ではなく、価格帯とサービング層の比較を意味しており、Haiku 5.5はまったく別の方向からその議論のただ中に位置するからだ。
2つのモデル、4つの価格、1つのしきい値
関連する4つのレートカードを並べると、意思決定の輪郭は、どんな単一のペアよりもはっきりしてくる:
• Claude Haiku 5.5、100,000トークン未満 — 100万トークンあたり入力$0.10、出力$0.50(Anthropicの料金表)
• Claude Haiku 5.5、100,000トークン超 — 入力100万トークンあたり$0.50、出力$2.50(Anthropicのリスト価格)
• {{1}}GLM-5.3-Flash{{/1}} — 100万トークンあたり入力$0.15、出力$0.50(Z.aiの料金表)
• GLM-5.3-FlashX — 入力100万トークンあたり$0.37、出力$1.25(Z.ai の料金表)
• コンテキスト — 4つすべてで100万トークン(ベンダー公表)
• オープンウェイト — GLM-5.3-Flash と FlashX はベースモデルの MIT ライセンスのウェイトを継承しています。Claude Haiku 5.5 はクローズド(ベンダー公開)です
• 独立系スコア — GLM-5.3-Flash は Artificial Analysis Intelligence Index で 41.807 を記録、Claude Haiku 5.5 は 43.395 を記録(Artificial Analysis)
最初に気づくべきなのは、FlashXの価格がClaude Haiku 5.5のロングコンテキスト・ティアのほぼ真上に位置していることだ——入力で$0.37対$0.50、出力で$1.25対$2.50。それは市場の偶然ではない。基盤モデルが中規模で、ベンダーが能力ではなくスループットに対して課金しているときに、プレミアムなサービング・ティアにかかるコストなのだ。第二に、GLM-5.3-FlashXは、Anthropicの新しいHaikuが短いコンテキストではより安く、長いコンテキストでは同等になるモデルの高価なバージョンだ。第三に、4つの数字はすべて互いに5倍以内に収まっており、それはほとんどの直接比較が示唆する「安価なモデル対高価なモデル」という枠組みよりも、はるかに狭い幅だ。

FlashXとは実際何なのか
GLM-5.3-FlashXは新しいモデルではありません。Z.ai自身のインフラストラクチャ上で提供されるGLM-5.3-Flashであり、ベースモデルの実測レートに対して、ピーク時で最大毎秒200出力トークンと宣伝され、価格はベースモデルの定価の2.5倍に設定されています。Z.aiの売り込みは単純明快です。同じ回答を、毎秒より多く、しかも支払うのは重みではなくサービングに対してです。スループット律速のワークロード——バッチ分類、大量抽出、コストではなくレイテンシが制約となるあらゆるもの——にとって、それは売る側にとっても買う側にとっても筋の通ったものです。
これが能力のアップグレードではないという点、そして価格設定はそのことを正直に反映している。もし FlashX がより優れたモデルだったなら、Z.ai はベースモデルの重みに対して別途料金を請求することはできなかっただろう。2.5倍というのはサービングに対する割増料金だ。その対価を支払う価値があるかどうかは、あなたのワークロードのボトルネックに関する問いであり、レイテンシに縛られたパイプラインとコストに縛られたパイプラインでは答えが異なる。
執筆時点で、Artificial Analysis には FlashX 専用のページは存在しない。これはごまかして覆い隠すのではなく、率直に述べておく価値がある。同サイトのボードが GLM-5.3-Flash について公表している独立した数値——Intelligence Index で 41.807、実測出力毎秒 52.14 トークン、Terminal-Bench Hard で 0.328——は、2.5 倍で提供されているバージョンではなく、ベースモデルの数値である。ベンダー自身による FlashX のスループット主張はピーク値であり、しかもベンダー報告だ。FlashX 自体のスループットを公表した独立系の情報源は存在しない。したがって、Haiku 5.5 の実測速度を FlashX のそれと比較するのは、Z.ai が自社の提供環境について示した数値との比較にほかならない。
Z.aiの2.5倍という倍率は、FlashXがベース価格に対して割高になる唯一の要因ではない。ベースとなる重みはMITライセンスで第三者がホストしているため、単一ベンダーのエンドポイントが提供する以上のスループットを真に必要とするワークロードは、あるプロバイダーのプレミアム階層に料金を払うよりも、同じ重みをベース価格またはそれに近い価格で提供する複数のプロバイダーに分散させることで、それを得られることが多い。これはFlashXの料金表が実際に競合している現実的な代替手段であり、Z.aiもそれを承知している——だからこそ、この売り込みは独自性ではなくピークスループットに頼っているのだろう。

Haiku 5.5とFlashXが袂を分かつところ
実際のワークロードを左右する軸で両者を突き合わせれば、どちらを選ぶか判断できるほど違いは明確になる:
• 100Kコンテキスト未満の価格 — Haiku 5.5 $0.10 / $0.50 対 FlashX $0.37 / $1.25、Haikuが両方で勝利
• 100K超のコンテキストでの価格 — Haiku 5.5 $0.50 / $2.50 対 FlashX $0.37 / $1.25;FlashX が両方で優位
• スループット — FlashX のベンダー公称ピーク 200 tok/s と、その種のピークを公称していない Anthropic 公開の Haiku 5.5 向けサービングの比較
• 独立系インデックス — Haiku 5.5 43.395 対 GLM-5.3-Flash 41.807(Artificial Analysis調べ、FlashX 自体の独立した数値はなし)
• ウェイト — FlashXはMITライセンスのオープンウェイトを継承しており、Haiku 5.5はクローズドでAPI専用です
• セルフホスティング — FlashX ではオープンウェイトにより可能、Haiku 5.5 では不可能
• ツール/エージェント機能セット — Haiku 5.5 では調整可能なエフォートダイヤル、GLM Flash ラインには非搭載
興味深いセルは2番目です。Claude Haiku 5.5 は、短いリクエストでは GLM-5.3-FlashX より5倍安いモデルで、長いリクエストではそれよりやや高価です。なぜなら、Haiku の価格表は100,000トークンの時点で5倍に跳ね上がるのに対し、FlashX は一律料金だからです。トラフィックの大半が短いリクエストなら、価格だけを見れば Haiku が明らかな選択です。大半が長いリクエストなら、FlashX は Haiku の短いリクエスト向け料金とはまったく競合しておらず、Haiku の長いリクエスト向け料金と競合していて、その比較では約3分の1の差で勝っています。
能力比較は、どちらのベンダーも望まないほど僅差だ。同じ独立系インデックスで41.807対43.395という差は4パーセント未満であり、ほとんどのアプリケーションレベルの評価におけるノイズの範囲内で、それだけで選定を正当化するにはあまりにも小さい。一般的な推論において、どちらのモデルも他方を圧倒していない。どちらがより賢いかではなく、料金表とスループットによって判断が下されている。

ライセンスの違いは実際の違いです
FlashXが元々オープンウェイトであることは、ある軸では価格差よりも重要だ。セルフホストでき、誰でも提供できる。Claude Haiku 5.5はどちらもできない。推論が自社ハードウェア上で行われることを求めるコンプライアンス要件を持つチーム、あるいはGPUを償却する方がトークン単位で支払うより安くなるほどの安定した利用量があるチームにとって、GLM系はこの2つのうちそもそもその問いに答える唯一のものだ。それ以外の全員――大多数であり、APIの背後にあるモデルを求め、サービング層を自分で運用したくない人々――にとって、ライセンスは脚注であり、価格が議論の決め手だ。
また、これはプロバイダーに障害が起きたとき、2つのモデルの故障モードが異なることも意味する。ベンダーとそのクラウドパートナーだけが提供するクローズドモデルは、それらがダウンすれば一緒にダウンする。複数の独立したホストを持つオープンモデルは、フェイルオーバーを行う仕組みさえあれば、それらの間でフェイルオーバーできる。これは実際の運用上の違いであり、本当に重要なその日になって初めて表面化する類のものだ。
2つ目の契約なしで両方をルーティングする
上記の判断があなたのトラフィックにとって単一の勝者に収束しない場合 — 通常は収束しません。2つのモデルは価格表の異なる部分で互いに勝るからです — 実用的な問題は、2つの統合を維持せずに両方をどう運用するかです。OrcaRouterはz-ai/glm-5.3-flashをベンダー定価で100万トークンあたり$0.15と$0.50で、qwen/qwen3.8-flashや200以上のモデルカタログの残りとともに、1つのキーと1つの請求で提供します。Claude Haiku 5.5に対するAnthropicの価格改定や、Flashラインに対するZ.aiの価格改定は、リセラーの独自のレートカードに遅れることなく、当日にゼロマークアップで反映されるため、上記の数字は実際に支払う数字のままです。
当社はClaude Haiku 5.5を提供しておらず、GLM-5.3-FlashXも提供していません。どちらも当社のカタログにはありません。これらについては、AnthropicとZ.aiに直接お問い合わせください。当社が提供しているのは、FlashXの土台となるベースモデルであるGLM-5.3-Flashです。2.5倍のサービングプレミアムが、誰も求めていないスループットを買うだけになる多くのワークロードにとって、これは適切な選択です。本番パスが、当社がホストしていない2つのモデルのいずれかに本当に依存している場合、パス全体をそれに賭けることなく試すための仕組みがフェイルオーバーです。リクエストをそのモデルに向け、動作するモデルをフォールバックとして保持し、どちらが応答するかはルーティングレイヤーに決めさせます。
どちらを選ぶべきですか
1リクエストあたり100,000トークン未満では、Claude Haiku 5.5が価格で優位に立ち、能力面でもFlashXに十分匹敵するため、どちらを選ぶかは明白だ。100,000トークンを超えると、GLM-5.3-FlashXはHaiku 5.5の長コンテキスト版よりも安く、リクエストサイズが選択ではなくタスクの性質によるものであるなら、頼るべきモデルとなる——ただしベースのGLM-5.3-Flashはさらに安く、2.5倍の価格を払う唯一の理由は、FlashXがうたうスループットを特に必要とする場合だけだ。
捨て去るべき思い込みは、一方が低価格オプションでもう一方が高性能オプションだという枠組みだ。両者はどちらも中価格帯のモデルで、一律でしっかり公開された料金表を備えている。興味深い変数は、どちらが優れているかではなく、あなたのトラフィックのどちらの半分に対してどちらが安くなるかである。まずリクエストサイズの分布を調べよう。上の2列の価格比較が、あとは教えてくれる。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
