「Claude Haiku 5.5 vs GPT-5.6 Luna」というタイトルで、キッカーが「値札は半分、1回答あたりはもっと」の生成ヒーローカード。Claude Haiku 5.5は入力$0.10、出力$0.50、インデックス43.40、GPT-5.6 Lunaは入力$0.20、出力$1.20、インデックス37.32で、「完了タスクあたりのコスト $0.21 vs $0.18」と表示されたバーの上に示されている。
Engineering & Research

Claude Haiku 5.5 対 GPT-5.6 Luna:定価は半分、完了タスクあたり19%増

著者

Magnus Corvin

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

みんなが書いていた価格の一致は本当で、それはこのモデルとの間のものではありません。Claude Haiku 5.5は、ベンダーが2026年10月7日にリリースしたもので、最大10万トークンのプロンプトまで、入力100万トークンあたり$0.10、出力100万トークンあたり$0.50の価格です。GPT-5.6 Lunaは、2026年7月9日からのコスト最適化ティアで、価格は$0.20と$1.20です。つまり、ベンダーは両方のメーターで旧モデルの料金のちょうど半分であり、しかも以下のモデルとまったく同じです:GPT-6 Lunaこれは、2026年9月22日にそれを置き換えた後継で、ベンダー自身のローンチ投稿がベンチマークの比較対象としているモデルです。

そこから比較を書くのは奇妙な場所なので、この対決が何のためのものなのかを正確にしておく価値がある。GPT-5.6 Luna は、二者のうち独立系ボードで非推奨になっている唯一の方であり、もはや OpenAI の主力料金表にある Luna ではなく、それでも今日多くの統合コードで見つかる Luna だ。それを Claude Haiku 5.5 と比較することは、すでに負っているかもしれない移行についての問いであり、現行の二つのモデルのどちらを呼び出すかという問いではない。

そして、当然の疑問への答えこそが興味深い部分だ。同じ独立評価の実行では、Intelligence Indexのタスクを1件完了するコストはClaude Haiku 5.5で0.21ドル、GPT-5.6 Lunaで0.18ドルトークン価格は半分、それでいて回答あたりは19%増。

2つの料金表

100万トークンあたりの米ドル建て。AnthropicとOpenAIの料金は各社のドキュメントに基づく。共通のスコアはArtificial Analysis Intelligence Index v4.3.2(2026-10-08時点)。

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs GPT-5.6 Luna — the scoreboard' with rows Index v4.3.2 43.40 against 37.32, cost per task $0.21 against $0.18, input price $0.10 against $0.20, output price $0.50 against $1.20, Terminal Bench 4.0 0.3283 against 0.1162 and status 'current, API only' against 'superseded by GPT-6 Luna', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; prices per vendor documentation.'

• 入力 — Claude Haiku 5.5 は 100,000 トークンまで $0.10、それ以上は $0.50。GPT-5.6 Luna は $0.20 で、272,000 トークンを超えるリクエストでは $0.40 に倍増。

• 出力 — Claude Haiku 5.5 は100,000トークンまで$0.50、それを超えると$2.50。GPT-5.6 Luna は$1.20、ロングコンテキスト経路では$1.80に上昇。

• キャッシュ済み入力 — Claude Haiku 5.5 は $0.01 と $0.05、90% 割引。GPT-5.6 Luna は $0.02、こちらも 90%、さらにキャッシュ書き込み料金 $0.25。

• コンテキスト — Claude Haiku 5.5は100万トークン、GPT-5.6 Lunaは1,050,000トークン。どちらも1回の応答を128,000トークンに制限しており、OpenAIは自社モデルの知識カットオフを2026年2月16日と公表している。

• 推論制御 — Claude Haiku 5.5 は Low から Max までのエフォートダイヤルを備え、デフォルトは medium。GPT-5.6 Luna は6つの設定を備えています:none / low / medium(デフォルト)/ high / xhigh / max。

• 独立スコア — Claude Haiku 5.5 (Max) が43.40、GPT-5.6 Luna (Max) が37.32で、182モデルのボード上で6.07ポイント差。

• ステータス — Claude Haiku 5.5 は現行で、プロプライエタリ、API専用です。GPT-5.6 Luna は独立系ボードで非推奨フラグが付いており、OpenAI のフラッグシップ価格表にもはや行を持っていません。

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the two-tier pricing lines and 'Released October 7, 2026'.

価格は半分でも、回答あたりのコストはより高い

ここでの料金表の計算は Anthropic にとって異常なほど有利だ — 短いプロンプトの領域内では両方のメーターできっちり2倍 — だから、説明が必要なのはタスクごとの結果の方だ。

Claude Haiku 5.5はIntelligence Indexのタスク1件あたり162,164出力トークンを生成し、その内訳は推論129,047、回答33,118です。GPT-5.6 Lunaは41,235を生成し、内訳は推論28,098、回答13,136です。Anthropicのモデルは、3.9倍のトークンを同じ作業で使い、しかも出力速度が半分であるため、完了したタスク1件あたりのコストは19%高くなります。速度面の優位と冗長性の不利は互いに2倍以内に収まっているため、ほぼ相殺されます—そして残差はOpenAIに有利に働きます。

タスクあたりの2つのコストは近いが、その構成は異なる。GPT-5.6 Lunaのタスクあたり0.1783ドルは、およそ半分がキャッシュ書き込みで、4分の1が出力だ。Claude Haiku 5.5の0.2128ドルは、入力が0.1317ドル——大半はキャッシュ読み取り——に、出力0.0811ドルを加えたものだ。どちらのモデルも絶対額では高くなく、高コストになる部分が異なる。だからこそ、料金表が2倍離れている一方で、タスクあたりの合計は収束するのだ。

これは、推論モデルのトークン単位の比較を一般に信頼できなくさせるのと同じ効果であり、率直に言っておく価値がある。安い従量単価は大量のトークン予算とかけ合わされ、支払うのはその積なのだ。Anthropic自身の発表ノートもこの点について率直で、Claude Haiku 5.5は「最大100,000トークンのプロンプトを伴うタスクに使用する場合に特に費用対効果が高く、そうしたタスクは当社の以前のHaikuモデルへのリクエストの約90%を占めている」と述べている。

ブレンドの計算は、別の方向から同じ話を語っている。Artificial Analysisの7:2:1の入力重視ブレンド——実際の本番トラフィックの大半が持つ形——では、Claude Haiku 5.5は100万トークンあたり0.077ドルで、GPT-5.6 Lunaの0.174ドルと対比される。これは、表示価格から予想される2.26倍だ。推論ワークロードがするように出力側のメーターを重く見積もって初めて、両者は収束し、10万トークンを超えると交差する。

100,000トークンの崖 対 272,000トークンのもの

両ベンダーとも長いリクエストの価格を再設定しており、そのしきい値は2.5倍以上離れている。

Anthropic の区分点は入力 100,000 トークンです。それを超えると、Claude Haiku 5.5 の料金は入力 $0.50、出力 $2.50 になり、これは短いプロンプトの料金の 5 倍で、リクエスト全体に適用されます。OpenAI の区分点は入力 272,000 トークンです。それを超えると、GPT-5.6 Luna の料金は入力 $0.40、出力 $1.80 になり、入力は 2 倍、出力は 1.5 倍で、これもリクエスト全体に適用されます。

つまり、クロスオーバーは緩やかな収束ではなく、段差だ。120,000トークンの検索プロンプトは Anthropic のロングティア料金が適用され、OpenAI のショートティアには余裕をもって収まる。これにより、Anthropic の2倍の優位は、入力では OpenAI の1.25倍の優位へ、出力では1.39倍の優位へと逆転する。そして Anthropic のしきい値は、ドキュメントの多いパイプラインが日常的に超えるほど低く、OpenAI のしきい値は、そのようなパイプラインの大半が決してそこに達しないほど高い。

100,000トークン未満では、これによって順序が変わることは一切ない。272,000を超えると順序は反転し、反転したままになる。

あなたが比較しているモデルに取って代わったものは何ですか?

これは、比較にどれだけ時間をかけるべきかを決める部分です。

OpenAIは2026年9月22日にGPT-6 Lunaをリリースした——AnthropicがClaude Haiku 5.5をリリースする15日前——入力$0.10、出力$0.50で、100万トークンのコンテキスト、128,000トークンの応答上限、そして同じ6段階の推論エフォート制御を備えている。これは、短いプロンプトの領域において、両方のメーターで、Claude Haiku 5.5と同一の料金表である。

独立系のボードでは、両者は十分に僅差で、総合順位では決着がつかない。Claude Haiku 5.5 は 43.40 を記録し、GPT-6 Luna の 38.12 を上回る — 依然として 5.28 ポイントの Anthropic のリードだ — しかし、完了タスクあたりのコストは 0.21 ドル対 0.068 ドルである。これは、実際に請求される数字において 3倍の OpenAI の優位であり、それが生じる理由は上記と同じ冗長性にある。GPT-6 Luna は Index タスクあたり 50,012 の出力トークンを生成するのに対し、Claude Haiku 5.5 は 162,164 である。

Anthropicのローンチ投稿は、自ら比較を行っており、その表ではHaiku 5.5を「GPT-6 Luna」と、GDPval-AA v2.1(1620対1437)、AA-Briefcase v1.1(1578対1336)、OSWorld 2.1オフラインサブセット(72.4%対48.9%)、Terminal-Bench 4.0(39.2%対16.4%)で比較している。これらはAnthropic自身の数値であり、ベンダー報告によるものだが、対戦相手の選択が示唆的だ。Anthropicが打ち負かすために選んだモデルは、この記事のタイトルに出てくるモデルの次のモデルである。

旧Lunaが依然として勝る点

三つのこと、そしてそのどれもが能力ではない。

動画と音声。どちらのモデルも動画には対応していない — Claude Haiku 5.5 はテキストと画像を読み、GPT-5.5 Luna もテキストと画像を読む — したがってこの行は引き分けで、メディアパイプラインを備えたものにはどちらも及ばない。

キャッシュ書き込み。OpenAIはGPT-5.6 Lunaについて100万あたり$0.25のキャッシュ書き込み料金を公表しており、AnthropicはClaude Haiku 5.5について何も公表していない。つまり正直に言えば、書き込みコストが存在しないのではなく、Anthropicの$0.10の入力メーターの内側にあるということだ。プレフィックスの多いワークロードでキャッシュの寿命が短い場合、その差を毎ターン支払うことになる。

そして、長いコンテキストを扱う道そのものでは、OpenAIのより高いしきい値が、どちらのモデルがより賢いかとは何の関係もない、真の構造的優位性となっている。

A capture of the OrcaRouter model page for GPT-5.6 Luna under openai/gpt-5.6-luna, showing a 128K maximum output, text, image and file input, public benchmarks by OpenAI dated 2026-07-09, a p50 time to first token, and the page's own description of the model as the fast, cost-efficient tier of OpenAI's GPT-5.6 series with a 1.05M-token context window.

どちらも呼び出し可能だが、そのうちの一つは我々のものではない。

GPT-5.6 Luna は本日 OrcaRouter のカタログに登場、openai/gpt-5.6-luna にて — 入力 $0.20、出力 $1.20、キャッシュ書き込み $0.25、1,050,000トークンのコンテキスト、128,000トークンの応答上限、そして272,000トークンの長コンテキスト階層は、価格記録の中で平均化されるのではなく別個のステップとして扱われます。OpenAI の定価で 0% のマークアップでパススルーされ、自動フェイルオーバーがその下にあり、これは意図的に旧世代化されたモデルにとって具体的な価値があります。OpenAI 自身のその容量が逼迫すれば、あなたのエラーバジェットが動く前にルートが移動します。

Claude Haiku 5.5はカタログには掲載されていません。AnthropicのAPI経由、そしてAWS、Google Cloud、Microsoft Azure経由で利用可能であり、それが正確な言い方です。Anthropicからカタログに掲載されているのはClaude Sonnet 5.5とClaude Opus 5.5なので、安価な分類ティアからミッドティアのエージェント型ティアへとエスカレーションする経路は、統合ではなくルーティング設定ということになり、同じカタログにはGPT-6 LunaがClaude Haiku 5.5とまったく同じ料金表で掲載されています。つまり、この価格帯における誠実なA/Bテストは、調達の作業ではなく2つの文字列の変更で済むのです。

この比較をどうするか

もしあなたの統合がgpt-5.6-lunaを採用しているなら、有用な結論は、Claude Haiku 5.5 がそれを6インデックスポイント上回っているということではない。そうではなく、あなたが使っているモデルは、ベンダー自身のフラッシュ階層内ですでに二度取って代わられている、ということだ——最初は Terra の世代によって、次に GPT-6 Luna によって。そして Anthropic 自身が、この価格帯における現行の競合相手として扱っているのが、その GPT-6 Luna である。GPT-6 Luna への移行は料金表上の同等であり、同じ独立した測定において、完成したタスクあたりのコストが3分の1に下がる。

能力面で Claude Haiku 5.5 と Luna シリーズのどちらを選ぶかというなら、Anthropic は総合スコア、ターミナルおよびコードの行、コンピュータ操作で勝っており、Anthropic 自身のベンダー表がそう示している。請求額で選ぶなら、Luna シリーズはこの比較のあらゆるバージョンで大差で勝っており、その理由は一つの数字にある。タスクあたりの出力トークン数が 162,164 対 41,235 だ。

この対決が実際に決着させるのは、2倍安いメーターは4倍軽量なモデルよりも価値が低いということだ。AnthropicはClaude Haiku 5.5をGPT-6 Lunaに合わせた価格に設定し、実際に合わせた——両方のメーターで正確に——それでも、そこから回答を引き出すには3倍のコストがかかる。