「アメリカの小型モデルが今や安い方だ」のために生成されたヒーローカード。バッジは「価格下限」、キッカーは「2026年10月7日」、サブタイトルは「Claude Haiku 5.5が$0.10と$0.50、DeepSeek V4 Flashと比較して — 100,000トークンまで」。4つのチップは「入力 $0.10 対 $0.15」「出力 $0.50 対 $0.60」「100Kステップ」「ピーク時間帯」と表示している。下の2枚のカードには「100,000トークン未満」(「Anthropicは両方のメーターで安い」)と「それを超える場合」(「DeepSeekは3〜4倍安い」)というラベルが付いている。フッターには「ベンダー各社の公表リスト料金は2026年10月8日時点」とある。OrcaRouterのロゴが右下隅に合成されている。
Guides & Insights

Claude Haiku 5.5 対 DeepSeek V4 Flash:Anthropicが価格の下限をついに下回った

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

ここ2年間、市場の低価格帯には誰もが知る構図があった。アメリカのラボはより高く、中国のラボはより安く請求し、それに応じてどちらの側につくかを選ぶ——というものだ。Claude Haiku 5.5は2026年10月7日、入力トークン100万あたり0.10ドル、出力トークン100万あたり0.50ドルで提供を開始し、その構図を打ち破った。これはDeepSeek V4 Flashの公表価格を下回っている。同モデルは夏以降、安さの基準点であり続けてきた。

それは聞こえほど大きな勝利ではなく、その理由は見出しよりも価値がある。Anthropicの料金は最大100,000トークンのプロンプトにしか適用されない。それを超えると$0.50と$2.50になり、これはDeepSeekの価格の数倍だ。そしてDeepSeek自身の料金表には誰も真似しない形がある。平日の2つの時間帯に倍になるのだ。2社のベンダー、そして「安い」という意味についてまったく異なる2つの考え方。

各ベンダーが実際に公開している内容

100万トークンあたり、米ドル表示。Anthropicの数値はAnthropicの料金ドキュメントによるもので、DeepSeekの数値はDeepSeek自身の「Models & Pricing」ページによるもので、これはこのモデルに関する権威ある料金表です。

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• 入力 — Claude Haiku 5.5 は10万トークンまで $0.10、それを超えると $0.50。DeepSeek V4 Flash はオフピーク時 $0.15、ピーク時間帯 $0.30。

• 出力 — Claude Haiku 5.5 は100,000トークンまで $0.50、それを超えると $2.50。DeepSeek V4 Flash はオフピーク時 $0.60、ピーク時 $1.20。

• キャッシュ済み入力 — Claude Haiku 5.5 は最大100,000トークンまで$0.01、それを超えると$0.05。DeepSeek V4 Flash はオフピーク時$0.003、ピーク時$0.006で、3倍以上安い。

• ピーク時間帯:Ant​hropicにはなし。料金はプロンプトの長さによって変動し、それ以外の要因はない。De​pSeekは、月曜日から金曜日のUTC 01:00から04:00の間、および06:00から10:00の間に料金が2倍になる。ただし中国の祝日を除く。

・コンテキストと出力 — {{1}}Claude Haiku 5.5 では100万トークン、最大出力128,000{{/1}}、{{2}}DeepSeek V4 Flash では100万トークン、最大出力384,000{{/2}}。

• モダリティ — Claude Haiku 5.5 はテキストと画像を扱えます。DeepSeek V4 Flash はテキスト専用で、視覚機能はこのモデルではなく兄弟モデル側が担っています。

• 独立系スコア — Artificial Analysis Intelligence Index v4.3.2 では、Claude Haiku 5.5 (Max) が 43.40 で 182 モデル中 2 位、DeepSeek V4 Flash 0731 (Max) が 34.33 で 117 モデル中 10 位となっています。

• 速度 — 同じ情報源による計測では、Claude Haiku 5.5 が毎秒 241.9 出力トークン、DeepSeek V4 Flash が 222.0 で、自身のボードでは2番目に速い。

クロスオーバーこそがすべてだ

2枚のカードを単一のリクエスト上に並べると、比較は二度反転する。

10万トークン未満では、Anthropic のほうが入力と出力の両方のメーターで、しかも本当に重要な価格表示でも安い。入力は $0.10 対 $0.15、出力は $0.50 対 $0.60 だ。Anthropic の小型モデルが同条件で DeepSeek Flash の料金を下回るのはこれが初めてで、ローンチ投稿が真っ先に掲げているのもこの事実だ。

100,000トークンを超えると、形勢は大きく逆転する。Anthropicの入力$0.50はDeepSeekのオフピーク料金の3倍以上で、出力$2.50はその4倍以上だ。日常的に150,000トークンのプロンプトを組み立てる検索や長文書パイプラインは、Claude Haiku 5.5の顧客ではまったくない。それはすでに使っていたモデルの顧客なのだ。

そして、Dee​pSeek の平日の2つの時間帯では、2番目の比較が逆方向から差を縮めます。というのも、Dee​pSeek 自身の料金は2倍になる一方で、Ant​hropic はまったく動かないからです。どちらのベンダーの仕組みも、抽象的には優れているわけではありません。一方は送信量によって価格が決まり、もう一方は送信するタイミングによって価格が決まります。そして、リクエスト時に自分で制御できるのは、そのうち片方だけです。

完了したタスクにかかるコスト、それが唯一公平な数字だ

ステッカー料率はトークン単位であり、両モデルは同じ作業でも同じ数のトークンを出力するわけではない。まさにそこが、Ant​hropicにとって打ち上げ時の計算が居心地の悪くなる点である。

Artificial Analysis は、Claude Haiku 5.5(Max)を Intelligence Index タスク1件あたり0.21ドル、DeepSeek V4 Flash 0731(Max)をタスク1件あたり0.22ドルと算出している。入力単価は10分の1、コンテキストウィンドウはより広く、Intelligence Index の差は26ポイント——43.40対34.33——それでも、1件のタスクをこなす実測コストは、本来なら価格で下回るはずだったモデルと1セント以内に収まっている。

理由は同じページにある。Indexの評価で、Claude Haiku 5.5は中央値1億に対して4億4,000万の出力トークンを生成し、評価者はそれを非常に冗長と評している。DeepSeek V4 Flashは中央値1億4,000万に対して2億4,000万を生成し、これも非常に冗長と評される。どちらのモデルも長々と考え、どちらも思考を出力として課金し、出力こそが請求額を決めるメーターだ。90%の入力削減は実在し、それは請求書の小さい方の半分に課金される。

さらに控えめな、第二の効果がある。Ant​hropic 自身のドキュメントによれば、Claude Haiku 5.5 は Claude 4.7 以降と共通の新しいトークナイザーを使用しているため、同じテキストは Claude Haiku 4.5 の場合より約30%多くトークンとして数えられる。料金は10分の1に下がったが、トークン数はまったく減らず、同じテキストではむしろ増えた。

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Dee​pSeekという名前の背後にあるモデルも変わった。

何か月も前のベンチマーク表を頼りにこの2つを比較しようとしている人は、そうする前にこれを知っておくべきだ。

DeepSeekの料金ページでは現在、deepseek-flashをモデル名として掲載しており、基盤はDeepSeek-V4.1-Flashで、従来のdeepseek-v4-flash IDも引き続き受け付けられるものの、「対応するモデルは廃止されました」と記載されています — 旧名でのリクエストは新しいモデルによって処理され、Flash価格で請求されます。言い換えれば、そのIDは名前も価格もラインナップ内の位置もそのままに、その下の重みが移ったのです。

それは批判ではない。ベンチマーク表がどの時点に日付付けられているかについての警告だ。この記事が引用している Artificial Analysis のエントリは、DeepSeek V4 Flash の Max 構成における 0731 リリースを対象としたもので、それはこのボードが測定したモデルであり、今日その id を名乗っているものが何であれ、それについて自動的に述べたものではない。対照的に、Ant​hropic の Claude Haiku 5.5 は日付接尾辞もエイリアスもない固定 id であり、その Index 上の位置づけは自身のローンチ週に日付付けされている。

2つのモデル、1つのエンドポイント

この比較がスペック表の上ではなく自分で簡単に決着をつけられるのは、両方とも同じ場所から呼び出せるからだ——ただし、述べておく価値のある例外が一つある。

DeepSeek V4 Flash は本日 OrcaRouter のカタログに掲載されています、そしてその下には自動フェイルオーバーが組み込まれています。そのため、この比較における DeeSeek の部分は、読んで知るのではなく、今朝から私たちが呼び出せます。ひとつ、あなたに気づかれる前に明言しておくべき注意点があります。私たち自身が掲載しているこのモデルの料金は、100万トークンあたり入力 $0.22、出力 $0.66 で、これは DeeSeek のオフピーク料金より高く、ピーク料金より低い水準にあります。ピークとオフピークの構造については、私たちのページではなく DeeSeek のページを権威として扱い、私たちのページの数値は、従量制の実行を始める際の単一の統合値として扱ってください。Claude Sonnet 5.5 と Claude Opus 5.5 もカタログに掲載されています。したがって、DeeSeek Flash の部分と Claude の部分の A/B は、1つのキーと1つの SDK で済み、エスカレーションのロジックがアプリケーションではなくルートに属するのであれば、ルーティング DSL がそれらを単一の呼び出しに構成します。

Claude Haiku 5.5 はまだカタログにありません。これは逃げではありません — つまり、この比較の Ant​hropic 側は現在 Ant​hropic に直接アクセスする必要があり、Dee​pSeek 側はそうではありません。今日時点で、Dee​pSeek ラインの安価なティアをスタックの残りと同じキーで使いたいなら、その部分はすでに利用可能です。

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

どちらを選ぶべきですか

呼び出しが短く——分類、抽出、ルーティング、要約、サブエージェントのターン——100,000トークン未満に収まるなら、Claude Haiku 5.5 は今や両方のメーターでより安価なモデルであり、独立系リーダーボードではより強力なモデルであり、判断は明快です。また、2つのうち画像を扱えるのはこれだけです。

呼び出しが長い場合、大きな共有プレフィックスを再送する場合、またはスケジュールを組める場合、計算は逆方向を指し、しかも大差でそうなる:Dee​pSeek のオフピーク時のキャッシュ済み入力 $0.003 は Ant​hropic の $0.01 より一桁低く、その出力上限は 3 倍高く、オフピーク割引は製品の制限ではなくスケジューリングの問題である。

ローンチが実際に決着させたのは、「Anthropicは今や安い」というより狭い話だ。決着したのは、アメリカのラボが短いプロンプトの場合において中国のラボより安く価格を付けるということ、そしてその短いプロンプトの場合こそが本番トラフィックの大半が存在する場所だということだ。100,000トークンを超える部分は依然として別のモデルの市場である。