
Claude Haiku 5.5:90%の値下げ、新しいトークナイザー、そしてAnthropicが投稿しなかった動画
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
誰かが一文をClaude Haiku 5.5に入力しただけで、完成したローンチフィルムが返ってきた。2026年10月7日の夜にXへ投稿されたプロンプトは、全文こうだ。「あなたのローンチ用に、あなたがどれほど優れたモーションデザイナーかを示す、10倍イケてる動画を作って」。投稿のキャプションは三語だけ——「One shotted this video」——で、クリップが添付されている。リトライも、絵コンテも、編集者もいない。もしClaudeシリーズで最も安いモデルが今やそんなことをするなら、そのティアはもはや妥協ではなくなった。
それがこのローンチの興味深い半分です。もう半分は算数であり、そこにこそ実際のニュースがあります:Claude Haiku 5.5は、10万トークンまでのプロンプトで、入力100万トークンあたり$0.10、出力100万トークンあたり$0.50であるのに対し、Claude Haiku 4.5は一律$1と$5です。Anthropic自身の脚注はそれを一般的なケースで90%低いと述べ、しかも同じ注記の中で、購入者が計画の基準とすべき数字は75%に近いと述べています。どちらの数字も正しく、その差こそがこのリリースで最も重要な点です。
Anthropicが10月7日に公式に記録したこと
ベンダーのローンチ記事と価格ドキュメントは、その内容の輪郭において一致しており、それは通常の値下げに伴うものよりも大きな一歩である。

• 価格 — 最大100,000トークンのプロンプトの場合、入力トークン100万あたり$0.10、出力トークン100万あたり$0.50です。そのしきい値を超えると、同じリクエストには$0.50と$2.50が課金されます。キャッシュ読み取りは100万あたり、100Kまでが$0.01、それを超えると$0.05です。キャッシュ書き込みは$0.125と$0.625です。
• コンテキスト — 1Mトークン、最大出力は128,000トークン。これは Claude Fable 5.1、Claude Opus 5.5、Claude Sonnet 5.5 が備える同じウィンドウと同じ出力上限を、最も安価なティアで再現したものです。
• 思考 — effortパラメータによる適応的思考で、デフォルトはmediumです。Anthropicは、これが調整可能なeffort設定を備えた初のHaikuクラスのモデルであると述べており、つまり同じモデルIDを、他に何も変更することなく、安く実行することも慎重に実行することもできるということです。
トークナイザー — Claude 4.7以降と共有されている新しいトークナイザーで、「同じテキストに対して約30%多くのトークンを生成する」とされています。Anthropicのドキュメントによると、正確な増加量はコンテンツとワークロードの形状によって異なります。
• ライフサイクル — ナレッジカットオフは2026年6月、および「2027年10月7日より早くはない」という提供終了の確約。
• 提供状況 — Claude API、Amazon Web Services、Google Cloud、Microsoft Azure、そしてAWS上のClaude Platformが、初日からすべて同時に利用可能です。
10xステッカーと75%の現実
10分の1の安さは、最も遠くまで広まる数字であり、誰かの予算モデルの中で誤った場所に入り込む可能性が最も高い数字でもある。それは最大10万トークンのプロンプトに適用される。Haiku 5.5は、その料金をウィンドウ全体にわたって維持しているわけではない。
最大100,000トークンで、入力$0.10、出力$0.50。Haiku 4.5の$1と$5に対して。これが90%削減であり、Anthropicは以前のHaikuモデルへのリクエストの90%がこの価格帯に該当したと述べている。
• 100,000トークン超 — 入力$0.50、出力$2.50。同じリクエストで、依然としてHaiku 4.5の請求額のちょうど半分。上限にぶつかることもない。
• トークナイザー — 同じテキストが Haiku 4.5 のときより約30%多くトークン化されるため、トークンあたりの削減はそのまま請求額の削減にはならない。
• ベンダー自身の平均値 — Anthropic はこの組み合わせを「実行コストが約75%少ない」と表現している。これは同社の数字であり、独立した測定値ではないが、予測に盛り込むべきなのはこれだ。
• キャッシュの経済性 — 一般的な価格帯では、キャッシュ読み取りが100万あたり$0.10から$0.01に下がっており、これは長い共有プレフィックスを再送信するあらゆるパイプラインにとって、入力単価よりも重要である。
75%という数字は、読者がそうでなければ矛盾と受け取るかもしれないことも説明している。主要な2つの数値は対立していない。一方はリクエスト形状に対する率であり、もう一方は100K超の少数派とトークナイザーの追加トークンを含む実際のトラフィック構成全体にわたる混合推定値である。支出をモデル化しているなら、75%を使い、より良いと信じる前に自分のプロンプト長分布を確認するべきだ。
動画が主張していること、そして主張していないこと
そのクリップは本物で、プロンプトは上に一字一句そのまま引用されており、タイムスタンプ——10月7日19:49 UTC、モデルが公開されたのとほぼ同じ日——は確認可能だ。帰属先はAnthropicではなく、一人のユーザーである。
その区別はここでは重要だ。なぜなら、Anthropic自身のClaude Haiku 5.5の製品ページには埋め込み動画が一切ないからだ。プレイヤーもメディアファイルもなく、あるのは同社のYouTubeチャンネルへのリンクだけだ。もしこのモデルでローンチ映像が作られたのなら、ベンダーはそう言っていない。したがって正確な言明は限定的だ。あるユーザーがClaude Haiku 5.5でローンチ動画を一発で生成したと報告し、そのプロンプトを公開した。それが一発だったのか、いくらかかったのか、編集を経てどれだけ残ったのかは、すべて単一の情報源による主張だ。このクリップはベンチマークではなくデモとして扱うべきだ。
ともあれ言及する価値があるのは、動画生成がモデルの仕様に含まれていないからだ。Haiku 5.5はテキストと画像を入力として受け取り、返す。あの品質のモーションデザインの結果は、モデルがフレーム自体を生成していたのではなく、何か別のもの—コード生成パス、レンダリングパイプライン、ツールループ—を駆動していたことを示唆している。それは$0.10の入力におけるエージェント的オーケストレーションについての言明であり、これが実際に驚くべき点なのだ。
Anthropicが公開した数字
ベンダーのローンチ表は、Haiku 4.5 とのビフォーアフターであり、GPT-6 Luna と Claude Sonnet 5.5 が規模感を示すために同じ列に並べられている。以下のすべての数値は、Anthropic 自身が報告した評価結果で、Anthropic のハーネスで実行されたものであり、ここに再掲しているが、独立した検証は行われていない。

• ナレッジワーク — GDPval-AA v2.1 は1620で、Haiku 4.5の735、GPT-6 Lunaの1437、Sonnet 5.5の1840に対して。AA-Briefcase v1.1 は1578で、614、1336、1824に対して。
• コンピュータ使用 — OSWorld 2.1はオフラインサブセットで72.4%、対してHaiku 4.5は15.7%、GPT-6 Lunaは48.9%、Sonnet 5.5は83.9%。
• 学際的推論 — Humanity's Last Examでツールなし45.9%、ツールあり57.4%に対し、Haiku 4.5は10.2%と18.7%。
• エージェント型コーディング — Terminal-Bench 4.0 は 39.2% で、0.0%、16.4%、70.6% と対比。FrontierCode 1.1(Main)は 46.4% で、GPT-6 Luna の 42.4%、Sonnet 5.5 の 52.1% と対比。
• 視覚的推論 — ツールなしでのChartographyは46.4%で、6.4%、29.1%、61.6%に対して。
Anthropicはまた、小型ティアが勝てない領域についても異例なほど率直だ。Terminal-Benchのチャートに関する同社自身の解説では、Sonnet 5.5とOpus 5.5は「複雑なエージェント型コーディングタスクには引き続きより良い選択肢」だと述べ、代わりにHaiku 5.5を圧縮、要約、サブエージェント作業向けに位置づけている。投稿内の顧客の引用も同じ方向を指し、同じ注意書きを伴っている——これらは早期アクセスパートナーが自社の評価を説明したものであり、監査ではない。Asanaはタスク完了のレイテンシが30%超低下し、エージェントのターンあたりの推論が最大2.5倍高速だと報告している。HubSpotはCRMポータルスイートで3回実行の平均92.8%を報告している。AlphaSenseは週約800万コールを処理するワークロードで、400クエリにわたり0.84対0.76を報告している。BoxはHaiku 4.5より11ポイント高く、レイテンシは約半分だと報告している。RogoはHaiku 5.5のサブエージェントが10-Kからセグメント売上高の行を抽出すると説明している。そしてCognitionは、Devin FusionがFrontierCodeスコア66.2を維持し、Haiku 5.5がサイドキックとして機能していると報告している。
独立した取締役会が述べていること
ベンダーの表はベンダーのものだ。あるティアが本番パイプラインを変えるに足るほど動いたかどうかを判断したい人にとって、より役立つ数字は、外部が最初に付けた位置づけである。

Artificial Analysisは、モデルのMax構成において、Claude Haiku 5.5をIntelligence Index v4.3.2で43と評価している。これはそのランキングの182モデル中2位で、同ランキングの中央値13を大きく上回る。同じページでは、毎秒242出力トークン(182中9位)と、Intelligence Indexタスクあたり0.21ドルのコストが測定されている。
そのページには、見出し以上に価値のあることが2つある。1つ目は冗長さだ。Indexを評価するにあたり、Artificial Analysisは出力トークンを4億4,000万と記録した。これは中央値の1億に対してであり、モデルを「非常に冗長」と評している。料金はトークンごとに課金されるため、長々と考えるモデルはその分を払う。まさにそれが、タスクあたりのコストがほぼゼロではなく0.21ドルにとどまる理由であり、入力の90%削減だけでは話が済まない理由でもある。2つ目はエフォートの階段だ。同じページにはMaxからLowまでの設定が示されており、Anthropicのデフォルトはmediumで、maxではない。リーダーボードの43はその階段の頂点であり、何もしなければ得られる設定ではない。
すでに呼び出せるティアの、その1つ下のティアを実行する
Claude Haiku 5.5はOrcaRouterのカタログに掲載されていません。そして、そうでないかのようにほのめかすのではなく、そのことを率直に言う価値があるでしょう。モデルが存在することと、そのモデルがルーティング可能になることの間にあるローンチ時点のギャップは、通常は数日、時にはそれ以上です。
現在 Anthropic のカタログに並んでいるのは Claude Haiku 4.5、Claude Sonnet 5.5、Claude Opus 5.5 で、いずれもプロバイダーの定価に 0% のマークアップを乗せずそのまま渡される価格なので、Anthropic が行う値下げは、彼らの側に反映されたその当日にこちら側にも反映されます。これは、サブエージェントパターンを今すぐ試したい人にとって実用的な橋渡しになります。定型的なターンは Haiku 4.5 に送り、難しいターンは上位モデルへエスカレーションするカスケードは、今日 1 つのキーと 1 つの SDK で機能し、後から小さい方のレッグを Haiku 5.5 に差し替えるのは移行作業ではなくモデル ID の変更で済みます。選んだレッグの下には自動フェイルオーバーが備わっているので、あるプロバイダーの不調な午後がパイプライン全体を道連れにすることはありません。
まったく待ちたくない場合は、同じ$0.10の入力帯はすでにGPT-6 Lunaが占めています。当社は実際にそちらへルーティングしており、272,000トークンまでその料金を維持し、その後段階的に引き上げます。
誰が引っ越すべきで、誰が引っ越すべきでないのか
ワークロードが大量の分類、抽出、ルーティング、圧縮、要約で、プロンプトが100,000トークン未満なら、話は簡単です。料金は以前の10分の1、ウィンドウは5倍広く、エフォートダイヤルを使えば、リクエストが必要とするときには逆方向のトレードオフもできます。およそ75%の削減を見込んで予算を組んでおけば、驚くことはありません。
プロンプトが日常的に100,000トークンを超えるなら、あなたが手にしているのは90%割引ではなく50%割引であり、長いコンテキスト向けの比較検討には今でも午後を丸ごと費やす価値がある——このティアの100K超の料金と同等かそれ以下のモデルが、この分野には複数あるのだから。
そして、あなたの eval が Terminal-Bench 型の作業で依然として失敗するなら、これを修正するモデルはこれではない。Anthropic 自身がそう言っており、Sonnet 5.5 の 70.6% に対して 39.2% という数字が、この投稿の中で最も明快な証拠だ。10月7日について正直に要約すれば、有用な知能の下限は大きく下がり、上限はまったく動かなかったということだ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
