
Claude Haiku 5.5が100万トークンあたり0.10ドルで提供開始:75%という主張と、その2つの脚注
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
AnthropicはClaude Haiku 5.5を2026年10月7日に一般提供開始した。入力100万トークンあたり0.10ドル、出力100万トークンあたり0.50ドル——OpenAIがGPT-6 Lunaで課金するのと同じ2つの数字であり、またClaude Haiku 4.5が2025年以降ずっとかかってきた価格の5分の1にあたる。2025年の登場時の価格は1.00ドルと5.00ドルだった。Anthropicのローンチ記事の見出しは、新モデルは前世代より平均で「実行コストが約75%低い」というもので、以降のあらゆる要約がこの数字を繰り返してきた。それは、そうした要約の多くが省いてしまった2つの脚注を伴っている。10万トークン未満では削減幅は90%、それを超えると50%であり、さらにClaude Haiku 5.5はClaude 4.7以降と共通の新しいトークナイザーを使うため、同じテキストはおよそ30%多いトークンと比べてClaude Haiku 4.5として数えられる。したがって75%というのは請求額についての話であり、料金表についての話ではない。プロンプトが長い人にとって、この両者は別物だ。ベンダー自身の比較表でも、その隣にGPT-6 LunaとClaude Sonnet 5.5が列として並んでおり、それだけにこのローンチ資料は異例なほど反論しやすい。
「75%引き」の裏側にある算数
まず料金表を確認してください。一律ではないからです。入力は100,000トークンまで100万トークンあたり$0.10、それを超えると100万トークンあたり$0.50 — 5倍です。出力は$0.50、続いて$2.50です。キャッシュも同じ段階に従います。5分間のキャッシュ書き込みは、しきい値以下で100万トークンあたり$0.125、超えると$0.625、1時間の書き込みは$0.20と$1.00、キャッシュ読み取りは$0.01と$0.05です。Message Batches APIは両方のメーターで50%割引し、バッチパスでは、モデルは最大300,000出力トークンをサポートします。その際に使用するのは output-300k-2026-03-24ベータヘッダーです。
ここでトークナイザーをその上に載せてみましょう。なぜなら、そこが見出しの主張が面白くなるところだからです。Claude Haiku 4.5のトークナイザーで90,000トークンと測定されたプロンプトは、新しいトークナイザーではおよそ117,000トークンと測定されます。サイズは変わっていませんが、100,000トークンのラインを超えたため、入力100万トークンあたり$0.10ではなく$0.50で請求されます。Claude Haiku 4.5では、同じコンテンツの入力コストは$0.09でした(入力100万トークンあたり$1.00 × 0.09百万)。Claude Haiku 5.5では$0.0585かかります。これは35%の削減です——実際にそうであり、90%には程遠いものです。90%という数字は、トークナイザーが拡張した後もラインを下回るリクエストに当てはまります。そこには大量のショートコールトラフィックが存在します。つまり、20,000トークンの分類呼び出しは26,000トークンになり、第1ティアにとどまり、そこでは入力価格は実際に以前の10分の1になります。
そこから三つのことが導かれる。それらは平均化するのではなく、切り分けて論じる価値がある:
• 短い呼び出しには最大の割引が適用されます。規定のラインに収まる文書の抽出、ルーティング、分類、要約 — これらは入力と出力で90%の数値が適用され、トークナイザーの拡張分を差し引いたものになります。
• 長い呼び出しは約3分の1引きで、4分の3引きではない。 再トークン化後に100,000トークンを超えるリクエストは、100万トークンあたり$0.50と$2.50を支払う — それでもClaude Haiku 4.5の料金の半分だが、それが属する階層は、表示価格がうたう階層の5倍である。
• 「平均で75%削減」はトラフィックで重み付けされた数値であり、Anthropicによるものである。これはベンダー自身が自社の想定構成比について述べたものであり、Anthropicは、しきい値未満のプロンプトが以前のHaikuへのリクエストの約90%を占めていたと明言している。あなたの構成比がその構成比と似ていなければ、あなたの平均もその平均とは似たものにならない——どちらなのかを知る唯一の方法は、予算を設定する前に、新しいトークナイザーで自分のトラフィックのトークンを数えることだ。

他に何が一緒に出荷されましたか
そのモデルは価格だけの話ではない。ローンチにあたっての詳細のいくつかは、それに対してコードを書く方法を変えるものであり、そのうちの1つは既存のクライアントを壊してしまう。
• アダプティブ思考はデフォルトで有効になっています。エフォートのダイヤルは低から最大まで設定でき、デフォルトは中です。これは調整可能なエフォート設定を備えた初のHaikuクラスのモデルであり、回答ごとの品質とコストの両方を左右する主要なレバーとなります。
• サンプリングパラメータは拒否されます。をデフォルト以外の値で送信するとtemperature、top_pまたは top_k400 が返ります。それらの引数を引き継いだ移行は、最初のリクエストで静かに劣化するのではなく、明示的に失敗します。これは少なくとも正直な失敗モードです。
• 100万トークンのコンテキストと最大128,000の出力トークンを同期Messages APIでご利用いただけます。ナレッジカットオフは2026年6月で、2027年10月7日より前に廃止しないことをお約束します。
• 初日から5つのプラットフォーム:Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、AWS上のClaude Platform。これは、こうしたローンチでよくある段階的な提供ではなく、同日での一斉展開だ。
• ツールも前進した。AnthropicのPythonおよびTypeScript SDKがベータ版でcomputer useとbrowser useをサポートするようになり、同社はMax 5x(100ドル)、Max 20x(200ドル)、Team(最大500ドルのプール制)の各サブスクライバー向けに月額APIクレジットを追加した。
• 安全性への姿勢は、価格が示唆するよりも狭い範囲にとどまる。 Anthropicによると、Claude Haiku 5.5のサイバーセーフガードはClaude Haiku 4.5のものより制限が厳しいが、最近のフロンティアモデルよりは緩い——Claude Sonnet 5.5が許可するよりも広い防御的用途を認めるが、ペネトレーションテストは依然としてブロックされている——また、生物学のセーフガードはClaude Sonnet 5、Claude Sonnet 5.5、Claude Opus 5と同等だという。アラインメント評価は、Anthropic自身のスイートにおいて前世代モデルより全般的に改善した。
ベンダーの表が示していることと、独立した委員会が示していること
Anthropicは3つの比較列を備えたベンチマーク表を公開したが、これはベンダーがどのように論争するかについての文書として読む価値がある。以下のすべての数値はベンダー報告によるもので、Anthropicのハーネス上で生成されたものであり、そのいずれも独立に再現されていない。GPT-6 Lunaが登場する箇所では、Anthropicが競合他社のモデルに対して自社の評価を実行しているものである。
• ナレッジワーク — GDPval-AA v2.1 は Claude Haiku 5.5 で 1620、Claude Haiku 4.5 で 735、GPT-6 Luna で 1437、Claude Sonnet 5.5 で 1840。AA-Briefcase v1.1 は 1578、614、1336、1824。
• コンピュータ操作 — OSWorld 2.1 はオフラインで 72.4%、対して 15.7%、48.9%、83.9%。
• 推論 — Humanity's Last Exam ではツールなしで45.9%、ツールありで57.4%であるのに対し、Claude Haiku 4.5は10.2%と18.7%、Claude Sonnet 5.5は56.9%と64.5%です。
• エージェント型コーディング — Terminal-Bench 4.0は39.2%で、0.0%、16.4%、70.6%に対して。FrontierCode 1.1(Main)は46.4%で、GPT-6 Lunaの42.4%、Claude Sonnet 5.5の52.1%に対して。
• チャート読解 — ツールなしのChartographyが46.4%であるのに対し、6.4%、29.1%、61.6%。
その表では、Claude Haiku 5.5は前世代のHaikuとGPT-6 Lunaの両方に対してすべての行で勝利し、そのほとんどでClaude Sonnet 5.5に敗れている。これこそ小規模ティアの正直な姿だ。世代をまたいで大きく飛躍しつつ、最も難しい作業ではミッドモデルの1つ下のティアにとどまる。Anthropicもその投稿で同様のことを述べており、複雑なエージェント型コーディングにはClaude Sonnet 5.5とClaude Opus 5.5を推奨する一方で、Haikuは圧縮、要約、分類、サブエージェントの役割向けに位置づけている。
独立系の見方はより微妙で、より多くの注意を要する。Artificial Analysisは Claude Haiku 5.5 を Max effort で、自社の Intelligence Index v4.3.2 において43と測定しており、182モデル中2位、そして毎秒241.9出力トークン——宣伝どおりの速さだ。また、完了した Index タスク1件あたり0.21ドルというコストも測定している。これは、このモデルがスイートを実行する際に、中央値1億トークンに対して4億4000万出力トークンを生成したためであり、評価者はこれを非常に冗長だと表現している。同じインデックスで38の GPT-6 Luna は、タスク1件あたり0.07ドルだ。同じ定価で、請求額は3倍。これはローンチ時の主張と矛盾するものではない——むしろ、その主張が扱っているのと同じ現象を、反対側から見たものだ。料金表はトークンあたりいくら払うかを示すもので、実際に払う額は料金×トークン数であり、Claude Haiku 5.5 は回答1件あたりライバルより多くのトークンを費やす。エフォートがそのレバーであり、モデルのデフォルトはmediumであって Max ではなく、それをより低く固定したチームは、請求額もスコアも小さくなるのを目にするだろう。
一箇所から呼び出している
このリリースが生む移行の論点は「どちらが優れているか」ではなく「自分のトラフィックにはいくらかかるか」であり、その答えはプロンプトの長さ、キャッシュヒット率、そして選ぶエフォート設定にかかっている。そこにたどり着くには、自分のプロンプトセットを両世代で走らせる必要がある——単一のエンドポイントの裏でやれば安く済むが、二つに分けてやるのは面倒だ。
Claude Haiku 5.5 自体はまだ OrcaRouter のカタログには載っていません。そして、そうでないかのようにほのめかすよりも、はっきりそう言うほうが役に立ちます。Anthropic のラインナップの残り、つまり Claude Haiku 4.5、Claude Sonnet 5.5、Claude Opus 5.5 はすべて、本日から当社を通じてプロバイダの定価で呼び出せます。マークアップ 0% でのパススルーなので、移行テストの「before」レッグは、その後も使い続ける同じキーで実行され、そのレッグに対するベンダーの値下げは当社側でもその日のうちに反映されます。「after」レッグは、新しいモデルが当社がルーティングするランタイムに到達するまでは Anthropic の API です。その間、共有エンドポイントがあなたにもたらすのは、呼び出しの下層での自動フェイルオーバーであり、これにより新しいモデルはそのパスに依存することなく本番トラフィックを処理でき、さらに Haiku から Sonnet へのエスカレーションをアプリケーションコードではなくルートに置くべきケースのためのルーティング DSL も得られます。

ローンチに含まれる2件の顧客事例は、証拠としてよりもリードとして引き継ぐ価値がある。Asanaはレイテンシが30%以上削減され、エージェントのターンあたりの推論が最大2.5倍高速になったと報告している。HubSpotは自社のCRMスイートで3回の実行の平均92.8%を報告している。AlphaSenseは400件のクエリで0.76に対して0.84を報告している。これらはベンダー自身の発表に載った、ベンダーが選んだ顧客の数値であり、その価値は、どのワークロードを最初にテストすべきかを教えてくれることにあり、あなたが何を得られるかを教えてくれることにはない。
何が状況を変えるでしょうか
75%という数字は、あらゆるトラフィック加重のベンダー主張が決着するのと同じ方法で決着する。つまり、あなた自身の請求書によってだ。独立系の側で本当に未確定なのは、タスクあたりのコストという数字である。より多くの実行が積み重なるにつれてこれが維持されるなら、このローンチについての正直な要約はこうなる——Anthropicは料金表を80%引き下げ、回答あたりにより多くのトークンを消費するモデルを構築した。したがって実効的な節約は、現実的で、大きく、ワークロードに依存し、ポスターに載っている数字であることはまれだ。もしエフォート設定とキャッシュによってこの数字が下がるなら、このティアはさらに良く見える。いずれにせよ、カットオーバー前に確認すべき数字は、新しいトークナイザーの下でのあなた自身のタスクあたりトークン数だ——それが、ローンチ記事が与えることのできない唯一の数字である。

この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
