
Claude Haiku 5.5 対 DeepSeek V4 Flash:Anthropicが価格の下限をついに下回った
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
ここ2年間、市場の低価格帯には誰もが知る構図があった。アメリカのラボはより高く、中国のラボはより安く請求し、それに応じてどちらの側につくかを選ぶ——というものだ。Claude Haiku 5.5は2026年10月7日、入力トークン100万あたり0.10ドル、出力トークン100万あたり0.50ドルで提供を開始し、その構図を打ち破った。これはDeepSeek V4 Flashの公表価格を下回っている。同モデルは夏以降、安さの基準点であり続けてきた。
それは聞こえほど大きな勝利ではなく、その理由は見出しよりも価値がある。Anthropicの料金は最大100,000トークンのプロンプトにしか適用されない。それを超えると$0.50と$2.50になり、これはDeepSeekの価格の数倍だ。そしてDeepSeek自身の料金表には誰も真似しない形がある。平日の2つの時間帯に倍になるのだ。2社のベンダー、そして「安い」という意味についてまったく異なる2つの考え方。
各ベンダーが実際に公開している内容
100万トークンあたり、米ドル表示。Anthropicの数値はAnthropicの料金ドキュメントによるもので、DeepSeekの数値はDeepSeek自身の「Models & Pricing」ページによるもので、これはこのモデルに関する権威ある料金表です。

• 入力 — Claude Haiku 5.5 は10万トークンまで $0.10、それを超えると $0.50。DeepSeek V4 Flash はオフピーク時 $0.15、ピーク時間帯 $0.30。
• 出力 — Claude Haiku 5.5 は100,000トークンまで $0.50、それを超えると $2.50。DeepSeek V4 Flash はオフピーク時 $0.60、ピーク時 $1.20。
• キャッシュ済み入力 — Claude Haiku 5.5 は最大100,000トークンまで$0.01、それを超えると$0.05。DeepSeek V4 Flash はオフピーク時$0.003、ピーク時$0.006で、3倍以上安い。
• ピーク時間帯:Anthropicにはなし。料金はプロンプトの長さによって変動し、それ以外の要因はない。DepSeekは、月曜日から金曜日のUTC 01:00から04:00の間、および06:00から10:00の間に料金が2倍になる。ただし中国の祝日を除く。
・コンテキストと出力 — {{1}}Claude Haiku 5.5 では100万トークン、最大出力128,000{{/1}}、{{2}}DeepSeek V4 Flash では100万トークン、最大出力384,000{{/2}}。
• モダリティ — Claude Haiku 5.5 はテキストと画像を扱えます。DeepSeek V4 Flash はテキスト専用で、視覚機能はこのモデルではなく兄弟モデル側が担っています。
• 独立系スコア — Artificial Analysis Intelligence Index v4.3.2 では、Claude Haiku 5.5 (Max) が 43.40 で 182 モデル中 2 位、DeepSeek V4 Flash 0731 (Max) が 34.33 で 117 モデル中 10 位となっています。
• 速度 — 同じ情報源による計測では、Claude Haiku 5.5 が毎秒 241.9 出力トークン、DeepSeek V4 Flash が 222.0 で、自身のボードでは2番目に速い。
クロスオーバーこそがすべてだ
2枚のカードを単一のリクエスト上に並べると、比較は二度反転する。
10万トークン未満では、Anthropic のほうが入力と出力の両方のメーターで、しかも本当に重要な価格表示でも安い。入力は $0.10 対 $0.15、出力は $0.50 対 $0.60 だ。Anthropic の小型モデルが同条件で DeepSeek Flash の料金を下回るのはこれが初めてで、ローンチ投稿が真っ先に掲げているのもこの事実だ。
100,000トークンを超えると、形勢は大きく逆転する。Anthropicの入力$0.50はDeepSeekのオフピーク料金の3倍以上で、出力$2.50はその4倍以上だ。日常的に150,000トークンのプロンプトを組み立てる検索や長文書パイプラインは、Claude Haiku 5.5の顧客ではまったくない。それはすでに使っていたモデルの顧客なのだ。
そして、DeepSeek の平日の2つの時間帯では、2番目の比較が逆方向から差を縮めます。というのも、DeepSeek 自身の料金は2倍になる一方で、Anthropic はまったく動かないからです。どちらのベンダーの仕組みも、抽象的には優れているわけではありません。一方は送信量によって価格が決まり、もう一方は送信するタイミングによって価格が決まります。そして、リクエスト時に自分で制御できるのは、そのうち片方だけです。
完了したタスクにかかるコスト、それが唯一公平な数字だ
ステッカー料率はトークン単位であり、両モデルは同じ作業でも同じ数のトークンを出力するわけではない。まさにそこが、Anthropicにとって打ち上げ時の計算が居心地の悪くなる点である。
Artificial Analysis は、Claude Haiku 5.5(Max)を Intelligence Index タスク1件あたり0.21ドル、DeepSeek V4 Flash 0731(Max)をタスク1件あたり0.22ドルと算出している。入力単価は10分の1、コンテキストウィンドウはより広く、Intelligence Index の差は26ポイント——43.40対34.33——それでも、1件のタスクをこなす実測コストは、本来なら価格で下回るはずだったモデルと1セント以内に収まっている。
理由は同じページにある。Indexの評価で、Claude Haiku 5.5は中央値1億に対して4億4,000万の出力トークンを生成し、評価者はそれを非常に冗長と評している。DeepSeek V4 Flashは中央値1億4,000万に対して2億4,000万を生成し、これも非常に冗長と評される。どちらのモデルも長々と考え、どちらも思考を出力として課金し、出力こそが請求額を決めるメーターだ。90%の入力削減は実在し、それは請求書の小さい方の半分に課金される。
さらに控えめな、第二の効果がある。Anthropic 自身のドキュメントによれば、Claude Haiku 5.5 は Claude 4.7 以降と共通の新しいトークナイザーを使用しているため、同じテキストは Claude Haiku 4.5 の場合より約30%多くトークンとして数えられる。料金は10分の1に下がったが、トークン数はまったく減らず、同じテキストではむしろ増えた。

DeepSeekという名前の背後にあるモデルも変わった。
何か月も前のベンチマーク表を頼りにこの2つを比較しようとしている人は、そうする前にこれを知っておくべきだ。
DeepSeekの料金ページでは現在、deepseek-flashをモデル名として掲載しており、基盤はDeepSeek-V4.1-Flashで、従来のdeepseek-v4-flash IDも引き続き受け付けられるものの、「対応するモデルは廃止されました」と記載されています — 旧名でのリクエストは新しいモデルによって処理され、Flash価格で請求されます。言い換えれば、そのIDは名前も価格もラインナップ内の位置もそのままに、その下の重みが移ったのです。
それは批判ではない。ベンチマーク表がどの時点に日付付けられているかについての警告だ。この記事が引用している Artificial Analysis のエントリは、DeepSeek V4 Flash の Max 構成における 0731 リリースを対象としたもので、それはこのボードが測定したモデルであり、今日その id を名乗っているものが何であれ、それについて自動的に述べたものではない。対照的に、Anthropic の Claude Haiku 5.5 は日付接尾辞もエイリアスもない固定 id であり、その Index 上の位置づけは自身のローンチ週に日付付けされている。
2つのモデル、1つのエンドポイント
この比較がスペック表の上ではなく自分で簡単に決着をつけられるのは、両方とも同じ場所から呼び出せるからだ——ただし、述べておく価値のある例外が一つある。
DeepSeek V4 Flash は本日 OrcaRouter のカタログに掲載されています、そしてその下には自動フェイルオーバーが組み込まれています。そのため、この比較における DeeSeek の部分は、読んで知るのではなく、今朝から私たちが呼び出せます。ひとつ、あなたに気づかれる前に明言しておくべき注意点があります。私たち自身が掲載しているこのモデルの料金は、100万トークンあたり入力 $0.22、出力 $0.66 で、これは DeeSeek のオフピーク料金より高く、ピーク料金より低い水準にあります。ピークとオフピークの構造については、私たちのページではなく DeeSeek のページを権威として扱い、私たちのページの数値は、従量制の実行を始める際の単一の統合値として扱ってください。Claude Sonnet 5.5 と Claude Opus 5.5 もカタログに掲載されています。したがって、DeeSeek Flash の部分と Claude の部分の A/B は、1つのキーと1つの SDK で済み、エスカレーションのロジックがアプリケーションではなくルートに属するのであれば、ルーティング DSL がそれらを単一の呼び出しに構成します。
Claude Haiku 5.5 はまだカタログにありません。これは逃げではありません — つまり、この比較の Anthropic 側は現在 Anthropic に直接アクセスする必要があり、DeepSeek 側はそうではありません。今日時点で、DeepSeek ラインの安価なティアをスタックの残りと同じキーで使いたいなら、その部分はすでに利用可能です。

どちらを選ぶべきですか
呼び出しが短く——分類、抽出、ルーティング、要約、サブエージェントのターン——100,000トークン未満に収まるなら、Claude Haiku 5.5 は今や両方のメーターでより安価なモデルであり、独立系リーダーボードではより強力なモデルであり、判断は明快です。また、2つのうち画像を扱えるのはこれだけです。
呼び出しが長い場合、大きな共有プレフィックスを再送する場合、またはスケジュールを組める場合、計算は逆方向を指し、しかも大差でそうなる:DeepSeek のオフピーク時のキャッシュ済み入力 $0.003 は Anthropic の $0.01 より一桁低く、その出力上限は 3 倍高く、オフピーク割引は製品の制限ではなくスケジューリングの問題である。
ローンチが実際に決着させたのは、「Anthropicは今や安い」というより狭い話だ。決着したのは、アメリカのラボが短いプロンプトの場合において中国のラボより安く価格を付けるということ、そしてその短いプロンプトの場合こそが本番トラフィックの大半が存在する場所だということだ。100,000トークンを超える部分は依然として別のモデルの市場である。
