「料金の10分の1は請求額の10分の1ではない」の生成ヒーローカードで、バッジは「ジェネレーションギャップ」、キッカーは「2つのHaikuモデル、11か月の隔たり」、サブタイトルは「価格、トークン、そして新たな10万トークンのステップで、Claude Haiku 5.5 対 Claude Haiku 4.5」。4つのチップには「$0.10 / $0.50」「$1.00 / $5.00」「100万コンテキスト」「トークン30%増」と表示されている。下の2枚のカードには「料金が示すもの」(「100,000トークン未満で入力・出力ともに90%低い」)と「請求書が示すもの」(「トークンが約30%多いのに、稼働コストは約75%少ない」)というラベルが付いている。フッターには「ベンダーの価格文書、2026年10月8日参照」とある。OrcaRouterのロゴが右下隅に合成されている。
Guides & Insights

Claude Haiku 5.5 vs Claude Haiku 4.5:90%の値下げは90%の節約ではない

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Claude Haiku 5.5は、100,000トークンまでのプロンプトで、入力100万トークンあたり$0.10、出力100万トークンあたり$0.50の価格です。Claude Haiku 4.5は、これまでどおりの200,000トークンのウィンドウ全体で、$1と$5の定額です。Anthropicは、その差をある脚注では「90%低い」とし、そのすぐ上の文では「実行コストは約75%少ない」としています——そして、2つのモデル間の11か月の隔たりは、まさにこれら2つの数字の隔たりなのです。

それはマーケティング上のごまかしではない。価格と同時にトークナイザー、思考のデフォルト、コンテキストウィンドウを変えたモデル世代の正直な姿であり、モデルIDを差し替えて請求額が10分の1になると期待する人は、製品ではなく算術に失望することになるという意味だ。

両モデルとも、出荷時のまま

以下はすべて100万トークンあたりの米ドル建ての価格で、特に断りのない限り、2026年10月8日時点でAnthropic自身の料金およびモデルに関するドキュメントから読み取ったものです。

A generated scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 - as shipped'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cache read $0.01 and $0.05, context 1M tokens, maximum output 128,000 tokens, thinking adaptive with an effort dial. Claude Haiku 4.5 reads input $1.00 flat, output $5.00 flat, cache read $0.10, context 200,000 tokens, maximum output 64,000 tokens, thinking manual with no effort dial. A footer reads 'Vendors' published list rates and model documentation.'

• 入力 — Claude Haiku 5.5 は100,000トークンまで$0.10、それを超えると$0.50、Claude Haiku 4.5 は長さに関係なく$1.00。

• 出力 — Claude Haiku 5.5:100,000トークンまで $0.50、それを超えると $2.50;Claude Haiku 4.5:長さに関係なく $5.00。

• キャッシュ読み取り — Claude Haiku 5.5 は 100,000 トークンまで $0.01、それを超えると $0.05、Claude Haiku 4.5 は $0.10。キャッシュ書き込み — $1.25 に対して $0.125 と $0.625。

• コンテキスト — 1M トークン(200,000 に対して)。最大出力 — 128,000 トークン(64,000 に対して)。

• Thinking — Claude Haiku 5.5 は適応型でデフォルトでオンになり、エフォートダイヤルはデフォルトで medium です。Claude Haiku 4.5 は従来の手動形式をとり、エフォートパラメータは一切ありません。

• 独立スコア — Artificial Analysis Intelligence Index v4.3.2 は、Claude Haiku 5.5 (Max) を 43.40 で182モデル中2位、Claude 4.5 Haiku を 16.88 で61モデル中30位に位置づけている — ただし評価元は、4.5のスコアを推定値としてフラグを立てている。

• 速度 — 同じ情報源の計測では、Claude Haiku 5.5 が毎秒242出力トークンであるのに対し、4.5世代は89.7だ。旧モデルがまだ余裕に見えるのは、ここだけだ。

価格が10分の1という話が崩れるのはどこか

削減をむしばむものが三つあり、そのうちAnthropic自身の警告と言えるのは最初の一つだけだ。

トークナイザーこそが最大のポイントです。Claude Haiku 5.5はClaude 4.7で導入された新しいトークナイザーを使用しており、Anthropicのドキュメントによれば、同じテキストが「Claude Haiku 4.5の場合よりも約30%多いトークンとしてカウントされる」とのことです。同じトークン数に対して10分の1の料金を支払っているのではありません。約1.3倍のトークン数に対して10分の1の料金を支払っているのです。ベンダー自身の移行ガイドでは、これがチェックリストの2番目の項目とされており、あらゆるコード変更よりも前に置かれています。プロンプトを数え直し、次にmax_tokensとコスト見積もりを見直してください。

思考トークンは出力トークンとして課金され、Claude Haiku 5.5はデフォルトで思考する。Anthropicのローンチページでは、このモデル自体がグラフ上で「非常に冗長」であると明言されており、独立した測定はベンダーよりも鋭くそれを裏付けている。Intelligence Indexを評価する際、Artificial AnalysisはClaude Haiku 5.5から4億4,000万の出力トークンを記録した(全体の中央値は1億トークン)。そして同モデルを非常に冗長であると指摘した。入力単価が安くても、請求の大部分が出力であるワークロードには役立たない。

100,000トークンの段階は3番目です。その上の料金は$0.50と$2.50で、同じリクエストに対してClaude Haiku 4.5が請求していた額の半分です。これはお得な条件であり、多くの読者が読んだことのある条件ではありません。Ant​hropicによると、しきい値未満のプロンプトは前のHaikuモデルへのリクエストの約90%を占めていました。これが、この値下げを見出しとして耐えうるものにする数字です。またそれはベンダー自身のトラフィック構成であり、あなたのものではありません。

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 row in the models table and the published rate card beneath it, with the input, output, cache read and cache write rates and the prompt-length thresholds set out per million tokens.

同じ作業がモデルにいくらかかるか

完了したタスクあたりのコストは、上記の3つの効果すべてをくぐり抜けて生き残る指標です。なぜなら、それはあなたが送った分だけでなく、モデルが出力したすべてに対して課金するからです。

Artificial Analysis は Claude Haiku 5.5 (Max) を Intelligence Index のタスクあたり $0.21 と評価している——これは、入力 $0.10、出力 $0.50 という料金と併記して公開している数字だ。4.5 世代については、タスクあたりのコストをまったく公開していない。タイルには unknown と表示されている。このモデルが推論設定で Index 上で実行されたことがないからだ。このページが公開しているのは、$1.00 と $5.00 という生の価格表示と、それとは異なる、より低い実測スコアである。

では、購入者にとって誠実な比較は、トークンで10倍ということではなく、次のようなものに近い。入力レートは10分の1でトークンは30%増、100Kを超えると出力レートは半分、そして1回答あたりに消費する出力トークンが前モデルより多いモデル——同じ独立系ボードで能力が16.88から43.40へ跳ね上がるのと引き換えに。Anthropicが平均的ワークロードについて挙げる75%という数字は、計画に用いるのに妥当な数値だ。それはまた、自分では制御できないトラフィック構成に対するベンダーの混合推定値でもある。

移行はモデルIDの差し替えではない

Anthropicの移行ガイドは、Claude Haiku 4.5からの移行を考える人向けに10項目に及び、そのいくつかは助言ではなく重大な障害となるものだ。

• Manual thinking は壊れます — thinking: {"type": "enabled", "budget_tokens": N} はエラーを返します。Adaptive thinking がそれを置き換えるため、thinking.display を "summarized" に設定する必要があります(推論を少しでも見たい場合)。

• サンプリングパラメータが壊れる — temperature、top_p、top_kはすべてリクエストから取り除く必要があります。

• アシスタントのプリフィルが壊れます — アシスタントのターンで終わる会話はエラーを返します。ユーザーのターンで終わらせてください。

• ブロックの順序の変更 — レスポンスが thinking ブロックで始まることがあるため、最初のコンテンツブロックを回答として読み取るコードは、type代わりに

• 拒否は新しい動作です — モデルは安全性分類器を実行し、stop_reason: "refusal"を返すことがあり、サーバー側のフォールバックはありません。

• リプレイは制約されています — thinkingブロックは、それを生成したアカウント、またはそれにリンクされたアカウントでのみ機能します。

• Priority Tierは引き継がれません — Claude Haiku 4.5でPriority Tier契約を保有している組織は、このティアがClaude Haiku 5.5ではサポートされていないため、容量を別途計画する必要があります。

そのうち2つは他よりも注目に値する。refusal の stop reason は、すべてのレスポンスに content があることを前提としたあらゆるループにおける制御フローの変更であり、アカウントに紐づく thinking ブロックは、会話を保存し、認証情報のプールを通して再生するあらゆるキューを壊す。どちらも本番環境に至るまで表面化しない。

両方のティアを1つのキーで運用する

多くのチームにとって実用的な問いは、これら2つのモデルのどちらが優れているかではない。なぜなら、その答えはどの呼び出しを行っているかによって完全に決まるからだ。問いは、カスケードの安価なレッグを、その周囲のすべてとは独立にアップグレードできるかどうかである。

Claude Haiku 4.5 は本日より OrcaRouter のカタログに Anthropic の定価、マークアップ 0% で掲載されています。つまりプロバイダーの料金がそのまま反映され、Anthropic が料金を変更すれば同日中にこちら側にも反映されます。Claude Sonnet 5.5 と Claude Opus 5.5 も揃っているため、定型的な大多数を小さなモデルで、エスカレーションを大きなモデルで処理する二層構成のパイプラインを、今すぐ1 つのキー、1 つの SDK と その下での自動フェイルオーバーを使って構築でき、後から小さな側を Claude Haiku 5.5 へ差し替えるのも、書き直しではなくモデル ID の変更だけで済みます。

Claude Haiku 5.5はまだカタログにありません。そして、それをほのめかすだけにせず、はっきり言っておく価値があります。モデルが出荷されることと、そのモデルがルーティング可能になることの間にリリース当日のギャップが生じるのは普通のことですし、それがいつ解消するかについての約束ではありません。今朝、当社から呼び出せるモデルは上記に挙げたとおりです。

A screenshot of the OrcaRouter catalogue page for Claude Haiku 4.5, showing the model identifier, the provider Anthropic, the model description and a stat strip carrying the $1.00 per million input and $5.00 per million output rates alongside the context window and maximum output.

誰が切り替えるべきか、そしてどの呼び出しを先に切り替えるべきか

Haiku 4.5 のトラフィックが、10万トークン未満のプロンプトによる分類、抽出、ルーティング、コンパクション、要約であれば、移行してください。料金は10分の1、ウィンドウは5倍広く、エフォートダイヤルは旧モデルにはなかったコストレバーを提供します。予算は約75%削減し、1週間後にご自身のトークン数と突き合わせて調整してください。

プロンプトが日常的に10万トークンを超えるなら、あなたが手にしているのは90%の削減ではなく50%の削減であり、第2の料金ティアは比較の構図を変えてしまうため、他社も検討する価値があります。10万トークン超の出力料金である$2.50は、競合するいくつかの小型モデルがウィンドウ全体に対して請求する額を上回っています。

そして、20万トークンの文書に収まる唯一の安価な選択肢だったから Haiku 4.5 を使っているなら、何が変わったのかに注目してほしい。ウィンドウは今や100万トークンで、それは別の製品であり、旧モデルを使い続ける理由は、それが安かった理由とともに、いつの間にか静かに消え去っている。