「Claude Haiku 5.5 vs DeepSeek V4.1 Flash」というタイトルの生成されたヒーローカード。キッカーは「2つのモデル、2つの安さの思想」で、Claude Haiku 5.5 は入力 $0.10、出力 $0.50、インデックス 43.40、DeepSeek V4.1 Flash は入力 $0.30、出力 $1.20、インデックス 39.46 と対比して示し、下部のバーには「完了タスクあたりのコスト $0.21 vs $0.27」と表示されている。
Engineering & Research

Claude Haiku 5.5 vs DeepSeek V4.1 Flash:安い値札が安いモデルとは限らない

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

料金表の上では、これは僅差ではない。Claude Haiku 5.5は、ベンダーが2026年10月7日に提供開始したもので、入力トークン100万あたり0.10ドル、出力トークン100万あたり0.50ドルで掲載されている。DeepSeek V4.1 Flashは、2026年9月10日にリリースされ、独立系の料金ボードでは0.30ドルと1.20ドル、ベンダー自身のオフピーク料金表では0.15ドルと0.60ドルで掲載されている。ベンダーは両方の計量項目で2倍から3倍安く、HaikuクラスのモデルがDeepSeek Flashの料金を下回ったのはこれが初めてだ。

次に、完了したタスクにかかるコストを測ると、その差は消える。同じ評価実行では、Intelligence Index のタスク1件のコストは Claude Haiku 5.5 では $0.21、DeepSeek V4.1 Flash では $0.27 — 200%の優位ではなく、20%の優位だ。理由は同じページにある。Claude Haiku 5.5 はタスクあたり162,164の出力トークンを生成したのに対し、DeepSeek は88,574だった。トークン単価は安いのに、ほぼ2倍のトークン数を買っているのだ。

その逆転こそが比較のすべてであり、以下に述べることはすべて、あなたのワークロードがそのどちら側に落ち着くかについての議論だ。

両方の料金表、記載どおりに読んだ場合

100万トークンあたりの米ドル価格。Anthropicの数値はAnthropic自身の料金ドキュメントによるもので、DeepSeekの数値はDeepSeekのModel & Pricingページによるもので、これは同社のピーク・オフピーク構造に関する権威ある料金表である。独立した測定値はArtificial Analysis Intelligence Index v4.3.2(2026年10月8日閲覧)。

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs DeepSeek V4.1 Flash — the scoreboard' with rows Index v4.3.2 43.40 against 39.46, cost per task $0.21 against $0.27, output tokens per task 162,164 against 88,574, Terminal Bench 4.0 0.3283 against 0.2677, AutomationBench 0.3541 against 0.6889 and open weights 'no' against 'yes, MIT', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; prices per vendor documentation.'

• 入力 — Claude Haiku 5.5 は10万トークンまで$0.10、それを超えると$0.50。DeepSeek V4.1 Flash は掲示板のカードで一律$0.30、または DeepSeek のオフピーク時間帯なら$0.15。

• 出力 — Claude Haiku 5.5 は 100,000 トークンまで $0.50、それを超えると $2.50。DeepSeek V4.1 Flash は一律 $1.20、またはオフピーク時 $0.60。

• キャッシュ入力 — Claude Haiku 5.5 は10万トークン未満で$0.01、それ以上で$0.05、90%割引。DeepSeek V4.1 Flash は$0.006、98%割引。これは、絶対額でDeepSeekのカードのほうが安くなる唯一のメーターであり、その差は多くの人が思う以上に大きい。

• 時間帯別料金 — Anthropicにはありません。DeepSeekは平日の01:00〜04:00、および06:00〜10:00 UTCの間、両方のメーターを2倍にします(中国の祝日を除く)。それ以外のすべての時間帯は、週末全体を含め、オフピークです。

• コンテキストと出力の上限 — それぞれ100万トークン。Claude Haiku 5.5 は1回の応答を128,000トークンに制限し、DeepSeek V4.1 Flash は384,000トークンに制限します。

• 重み — Claude Haiku 5.5 はプロプライエタリかつ API 専用で、モデル ID は claude-haiku-5-5。DeepSeek V4.1 Flash は MIT ライセンスでオープン、総パラメータ数 552B、アクティブ 16B、Hugging Face で公開されています。

• モダリティ — どちらもテキストと画像を入力として受け取り、テキストを返す。どちらもビデオネイティブではない。

・独立スコア — Claude Haiku 5.5 (Max) が43.40、DeepSeek V4.1 Flash (Max) が39.46。182モデルのボード上で3.94ポイントの差。

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the pricing lines $0.10/$0.50 up to 100,000 tokens and $0.50/$2.50 over it, and the release line 'Released October 7, 2026'.

なぜタスクごとの数値がトークンごとの数値に勝るのか

表示単価はトークンあたりで示される。課金がトークン単位で計測されるからだ。だがそれは、ワークロードにかかるコストを知る手がかりとしては頼りにならない。推論モデルがタスクに必要なトークン数を決めるのであり、ここに挙げた2つのモデルではその数が1.8倍も食い違うからだ。

Claude Haiku 5.5 は Intelligence Index のタスクあたり 162,164 出力トークンを生成し、内訳は推論 129,047、回答 33,118 です。DeepSeek V4.1 Flash は 88,574 を生成し、内訳は推論 62,670、回答 25,904 です。どちらも思考を出力として課金します。つまり、出力レートが 60% 低いモデルのほうが、高価なメーターをほぼ 2 倍消費し、計算上、両者の差は 6 セント以内に収まります。

同じ方向に作用する第2の効果もある。ハーネスがコンテキストを再送信するため、インデックスの実行は出力だけでなく入力にも大きく左右される。Claude Haiku 5.5のタスクあたり$0.2128は、入力$0.1317と出力$0.0811に分解され、入力の内訳では、そのうち$0.0954がキャッシュ読み取り、$0.0337がキャッシュ書き込みで、新規入力はわずか$0.0026に過ぎない。DeepSeekの$0.2652は、入力$0.1589と出力$0.1063に分かれ、入力のうち$0.0966がキャッシュ書き込みに充てられている。2つのモデルはほぼ同じ量のキャッシュ済みコンテキストを読み取っているが、DeepSeekは同じ読み取りと書き込みに対してより多く支払っている。

Anthropic自身の発表記事は、逆方向からの同様の注意喚起で始まっている。そこでは、Haiku 5.5は「最大100,000トークンのプロンプトを伴うタスクに使う場合に特にコストパフォーマンスが高い。そうしたタスクは、以前のHaikuモデルへのリクエストのおよそ90%を占めている」と述べられている。この限定条件は実際に効いている——下の崖を見てほしい。

100,000トークンの崖こそが本当の分岐点だ

AnthropicはClaude Haiku 5.5を一律価格で設定しているわけではない。0.10ドルと0.50ドルの料金は10万トークンまでのプロンプトに適用され、それを超えると0.50ドルと2.50ドルになる——入力で5倍、出力で5倍の跳ね上がりであり、それは超過分ではなくリクエスト全体に適用される。

DeepSeekの構造はまったく異なります。その料金は、いつ送るかによって決まり、どれだけ送るかには左右されません。15万トークンのプロンプトも500トークンのプロンプトも、トークンあたりの料金は同じで、平日の2つの時間帯では2倍になります。

両方に長いプロンプトのパイプラインを載せると、比較は大きく逆転する。入力150,000トークン、出力20,000の場合、Claude Haiku 5.5は入力に$0.125、出力に$0.05、つまり呼び出しあたり$0.175を請求する。一方、DeepSeekはオフピークで$0.0225と$0.012、つまり4セント未満だ。これは、ショートプロンプトの場合にはAnthropicが3倍で勝っていた同じ2つのモデルで、DeepSeekが約4.5倍で勝っているということだ。

どちらの構造も、抽象論としては一方がより優れているわけではない。片方は送る量に応じて課金し、もう片方は送るタイミングに応じて課金する。そして、その2つの変数のうち、リクエスト時に自分で制御できるのは片方だけだ。

DeepSeekの誰も織り込んでいないもう一つの武器

キャッシュラインは独自に注目する価値がある。なぜなら、この比較の中ではどこよりも安価なメーターであり、縮小するどころか本番のボリュームとともに増えていくものだからだ。

DeepSeekのキャッシュヒット率は100万トークンあたり$0.006で、公称98%割引 — Anthropicの$0.01のおよそ6分の1であり、どちらの側でも新規入力にかかるコストのごく一部だ。安定したプレフィックス — 長いシステムプロンプト、取得した文書セット、ツールスキーマ — を再送するものは、最初のターン以降の毎ターンでそのレートが適用される。上記のインデックス実行は、その割合がどれほどかをすでに示している。Claude Haiku 5.5のタスクあたり入力コストのうち$0.0954は、わずか$0.0026の非キャッシュ入力によるキャッシュ読み取りである。

つまり、実際の棲み分けは「Anthropic のほうが安い」よりも狭い。リクエストが短く、単一ターンで、キャッシュが温まっているなら、Claude Haiku 5.5 は価格で優位に立ち、能力でも 3.94 インデックスポイント上回り、複合エージェント行でも優位だ。リクエストが長い場合、プレフィックスが多い場合、または DeepSeek のオフピーク時間帯にスケジュールできる場合は、DeepSeek V4.1 Flash がコストで圧倒しており、特に接戦というわけではない。

今日実際に電話できる相手

どちらのモデルも到達可能ですが、対称的ではなく、その非対称性はあなた自身に見つけさせるのではなく、明言しておく価値があります。

DeepSeek V4.1 FlashがOrcaRouterのカタログに登場しました。プロバイダーの定価のまま、マークアップ0%でパススルーしています。これはここでは通常以上に重要な意味を持ちます。DeepSeekの料金にはピーク構造があるからです。当社は入力$0.15、出力$0.60、キャッシュ読み取り$0.003として掲載し、平日の2つの倍率ウィンドウも料金レコードに反映しているため、DeepSeekレッグにルーティングされたリクエストは、平均化された料金ではなく、DeepSeekが課金するのと同じ方法で課金されます。ルートの下層には自動フェイルオーバーがあり、ピーク時間帯の429やプロバイダーの一時的な不調が発生しても、呼び出しを失敗させるのではなく別ルートへ振り替えます。

Claude Haiku 5.5はカタログに載っていません。Anthropicのモデルは、Anthropicから直接、そして同社の3つのクラウドパートナー — 発表記事が挙げているAWS、Google Cloud、Microsoft Azure — を通じて利用できます。そして、それが正直に言える唯一の言い方です。カタログがAnthropicのラインから実際に扱っているのは、Claude Sonnet 5.5とClaude Opus 5.5であり、これにより、安価な分類呼び出しから中間層のエージェント呼び出しへのエスカレーションパスが、2つ目の統合ではなくルーティング設定になります。

A capture of the OrcaRouter model page for DeepSeek V4.1 Flash under deepseek/deepseek-v4.1-flash, showing a 1M-token context, a 384K maximum output, text and image input, public benchmarks dated 2026-09-10, a p50 time to first token of 1.74 seconds, and the page's own description of the model as the smallest in DeepSeek's new architecture family, released September 10, 2026.

どちらを選ぶべきですか

あなたのトラフィックが分類、抽出、ルーティング判断、要約、サブエージェントのターン——短いプロンプト、大量、画像が混在——であれば、Claude Haiku 5.5 がより優れたモデルであり、100,000トークン未満ではより安価なものです。インデックススコアは3.94ポイント高く、画像も扱え、Anthropicは調整可能なエフォートダイヤルを提供しているので、モデルを変更せずに呼び出しごとのコストと引き換えに能力を調整できます。

トラフィックが長文ドキュメント中心であったり、検索負荷が高かったり、スケジュールを組めるのであれば、DeepSeek V4.1 Flash はコスト面で軍配が上がります。長い呼び出しあたり3〜4倍安く、キャッシュ料金は Anthropic の6分の1、応答上限は384,000トークン、そしてトークン単位のモデルがいつか採算に合わなくなっても手元に置いておけるオープンウェイトを備えています。

この比較が実際に決着させるのは、「今や Anthropic が安価な選択肢だ」というより狭い話だ。決着するのは、小型の Anthropic モデルが、表示価格では DeepSeek Flash の料金を下回りながら、請求額ではその 20% 以内に収まりうること — そして、その二つの事実の隔たりが冗長度設定であるということだ。

200以上のモデルに対応する1つ、キーも1つ、自動フェイルオーバーがその基盤にあり、ピーク時間帯の429やプロバイダーの一時障害が起きても、呼び出しは失敗せずに別の経路へ回されます。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新