
OpenCode GoのClaude Haiku 5.5:月額10ドルで実際に何が手に入るのか
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
Anthropicが投入したClaude Haiku 5.5は2026年10月7日のこと。そして1日も経たないうちに、OpenCodeのGoおよびZenカタログに掲載された——トークン単位の課金ではなく、月ごとのドル利用枠を計測するコーディングエージェント向けサブスクリプションだ。この2番目の掲載こそ、少し立ち止まって見る価値がある。なぜなら、OpenCodeがClaude Haiku 5.5向けに公開している利用枠は、このモデルの割引ではないからだ。それはAnthropic自身の定価に設定された予算メーターであり、その背後にあるすべての数字は、それを公開している2つのページと照合できる。Claude Haiku 4.5の代わりに何を呼び出すかまだ決めかねているなら、判断すべきは利用枠であり、値札ではない。
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Anthropicが10月7日に公式に記録したこと
ベンダーはこれをひっそりと出荷したわけではない。Anthropicのニュースルームには、日付の入った発表、ベンチマーク表を載せた製品ページ、システムカード、価格表、そして6件の名前入り顧客引用が掲載されている。検査できるリポジトリも重みの公開も存在しない。なぜなら、公開すべきものなど何もないからだ:Claude Haiku 5.5をArtificial Analysisはプロプライエタリとして記録しており、パラメータ数は非公開とされている。これをリークされた、あるいは未発表のモデルだと表現する人は、存在しないリポジトリを読んでいるのだ。
Anthropic自身の位置づけは、フロンティアモデルではなくボリュームモデルである:
• ポジショニング —「これまでにリリースした中で最も安価で、最速、かつ最高性能の小型モデル」。要約、圧縮、データベースクエリ、分類を用途とし、コーディング作業で Claude Opus 5.5 や Claude Sonnet 5.5 と組み合わせるサブエージェントとして売り込まれている。
• 料金 — 100,000トークンまでのプロンプトの場合、入力トークン100万あたり$0.10、出力トークン100万あたり$0.50。それを超える場合は$0.50と$2.50。キャッシュ読み取り $0.01 / $0.05、キャッシュ書き込み $0.125 / $0.625。
• コンテキストと出力 — 100万トークンのウィンドウ、128,000トークンの出力。より大きな5ティアモデルが備えるのと同じエンベロープを、最安ティアで再現。
• エフォート — 調整可能なエフォート設定を備えた初のHaikuクラスモデルで、LowからMaxまで動作し、デフォルトはmedium。Anthropicは単一の数値ではなく、各設定における精度対コストの曲線を公開している。
• ベンチマークはベンダー申告値であり、独立して再現されたものではない — GDPval-AA v2.1 は 1620 対 Claude Haiku 4.5 の 735、AA-Briefcase v1.1 は 1578 対 614、OSWorld 2.1 は 72.4% 対 15.7%、Humanity's Last Exam はツールなしで 45.9%、ツールありで 57.4% 対 10.2% と 18.7%、Terminal-Bench 4.0 は 39.2% 対 0.0%、Chartography は 46.4% 対 6.4%。
• ベンダー自身が示す上限 — Anthropicの自社Terminal-Benchチャートに関する解説では、Claude Sonnet 5.5とClaude Opus 5.5は「複雑なエージェント型コーディングタスクには、依然としてより良い選択肢であり続ける」と述べている。同じ投稿内の顧客の引用は、早期アクセスパートナーが自社の評価について述べたものであり、監査ではない。Asanaは、エージェントのターンあたりのレイテンシが30%超低下し、推論が最大2.5倍高速になったと報告。HubSpotは3回の実行の平均で92.8%。AlphaSenseは、週およそ800万回の呼び出しというワークロードで、400件のクエリにおいて0.76に対して0.84。Boxは約半分のレイテンシで11ポイント高い。CognitionはHaiku 5.5を相棒としてFrontierCodeスコア66.2。

Anthropicはこのローンチを利用して、関連する2つの価格も動かした。Claude Sonnet 5.5のキャッシュ読み取りは100万トークンあたり$0.10へ半減し、同社によればこれによりSonnet 5.5はほとんどのエージェント型作業で約20%安くなる。さらに、Claude MaxおよびTeamの加入者向けに新しい月次APIクレジットも用意した。どちらも一段上のティアに対する変更であり、小型モデルを検討している人よりも、すでにSonnetを標準採用しているチームにとって、より重要なものだ。
許容額はドル建ての予算であり、割引ではありません
発表ツイートが触れていない部分はこちらです。OpenCode の Go ドキュメントには、「利用上限は月額ドル金額として定義される」こと、トークン価格は両プランで同じであること、各モデルの許容量は固定スケジュールで漸減すること(5時間あたり月間上限の20%、週あたり50%、月あたり100%)が記載されています。このドキュメントでは、このモデルに対して前提としているリクエストあたりのトークンプロファイルも公開しています — 入力トークン1,100、キャッシュ済みトークン55,000、出力トークン240。
それらをAnthropicの定価に当てはめてみると、公表されているリクエスト数はもはや恣意的な配分には見えなくなる:
• 定価でのリクエストあたりのコスト — 入力1,100($0.10/M)+キャッシュ読み取り55,000($0.01/M)+出力240($0.50/M)で、$0.00078になります。
• 月間リクエスト数 — $15 を $0.00078 で割ると 19,230 となり、これがドキュメントに記載されている数値です。$40 プランの $60 分の割り当てを割ると 76,923 になりますが、ドキュメントには 76,920 と記載されています。
• テーパー — 19,230の20%は3,846で、5時間あたり3,850と表示されます。50%は9,615で、週あたり9,620と表示されます。Go Plusも同じ計算に従い、15,380と38,460となります。
• ドル換算で何を意味するか — この許容量は、$10プランではAnthropic価格のトークン$15分、$40プランでは$60分に相当します。したがって、$10のサブスクリプションでは、許容量をすべてClaude Haiku 5.5だけに使い切った場合、1か月あたり最大$15分のこのモデルのトークンを購入できることになります。
Goページの「New」バッジを読むなら、それが正直な読み方だ。サブスクリプションは安く、モデルも安く、この2つの事実は互いに独立している。許容量はベンダー自身の料金による従量制の予算なので、このプランが縛るのは、モデルのコストがどれだけ安いかではなく、あなたがいくら使えるかだ。ヘビーユーザーは上限に達してAnthropicに直接支払う——あるいは自分でモデルをルーティングする。

90パーセント、75パーセント、そして5倍の崖
アンソロピックの見出しは、Claude Haiku 5.5のコストが約90%安い、Claude Haiku 4.5と比べて、10万トークンまでのプロンプトで、平均では「実行コストが約75%安くなった」というものだ。どちらの数字もベンダーによるものだ。そしてどちらも正しく、その差こそが価格設定リスクのすべてである。
• このバンド内では — 入力$0.10、出力$0.50で、Haiku 4.5の一律$1と$5に対する。Anthropicによると、以前のHaikuモデルへのリクエストの約90%がこのバンドに収まっており、90%という数字はここから来ている。
・帯域を超えると — 同じリクエストには入力 $0.50、出力 $2.50 が課金され、入力では5倍の跳ね上がりとなる。それでも Haiku 4.5 の料金の半分ではあるが、90% 削減にはほど遠い。
• ブレンド値についての主張 —— 75%という数字は、実際のトラフィック構成に基づくAnthropic自身の見積もりであり、料金表ではない。そして、それは予測に入れるべき数字である。
• トークナイザー — Claude 4.7 以降と共通の新しいトークナイザーは、Anthropic 自身のドキュメントによると、同じテキストに対して約30%多いトークンを生成するため、トークン単価の削減が請求額の削減に1対1で結びつくわけではありません。
エフォートダイヤルはそのすべてを倍加させる。デフォルトはmediumで、公開されている曲線はMaxまで及ぶため、ほとんどの呼び出し元が設定しないパラメータ次第で、同じプロンプトのコストが数倍高くなる可能性がある——しかもOpenCodeのリクエスト見積もりは、1つの暗黙的な設定における単一の固定トークンプロファイルを前提としている。プロンプトが100,000トークン付近にある場合、使用量を制限したサブエージェントを実行する場合、またはエフォートダイヤルを動かす場合、90%という見出しの数字は、あなたが目にする数字ではない。
独立委員会はスコアに合意し、自らの計算に問題を指摘する
Artificial Analysis のスコアでは、Claude Haiku 5.5は、モデルの Max 構成において Intelligence Index v4.3.2 で43を記録しており(ボードの中央値は13)、毎秒241.9出力トークンを計測している(同等モデルの中央値は110.9)。同じページでは、コストを Intelligence Index タスクあたり$0.21とし、評価中にモデルが4億4,000万出力トークンを生成したと報告している(中央値は1億)——これを「非常に冗長」と表現している。
冗長性こそが、この2つのボードが交わるポイントだ。上記の許容量の計算はトークン単位で課金されるため、長々と推論するモデルは、リクエスト数から想像されるよりも速く予算を消費する。また、OpenCode のリクエストあたり55,000キャッシュトークンというプロファイルは、プロンプトキャッシュに関するひとつの前提であり、サブスクリプションユーザーがそれを再現できるかどうかは分からない。Artificial Analysis のページにある2件の開示は、その見出しの数字よりも価値がある。43 という数字は、何もしない場合に得られるエフォート設定ではなく Max 構成のものであり、さらに同ページには、Claude Haiku 5.5 について「より長いコンテキストの入力では5倍の価格設定となっており、それは現時点ではコスト数値に反映されていない」という明示的な注記が添えられている。ロングコンテキストの崖は実在しており、その独立系ボードは、それがまだ自身の数字には含まれていないと告げている。

ほとんどの買い手が飛ばしてしまうリテンションライン
OpenCodeのGoドキュメントにはモデルごとのプライバシー表があり、ここがClaude Haiku 5.5がカタログの大半と異なる行です。ベンダー自身の説明は「例外付きゼロ保持」です。そのGoの表にあるほとんどのモデルは「0日」と記載されています。これに対してこのモデルは「30日」と記載され、Anthropicのデータポリシーに従ってリクエストが30日間保持されるという注記が付いています。これはGPT-6 LunaとGPT-5.6 Lunaにも同じ扱いをしており、リストの大部分を占めるゼロ日保持の行とは正反対です。
コーディングエージェントにとって、それはプロンプト、ファイルパス、貼り付けたソースが、マーケティング文言ではゼロ保持とされているプランで、上流ベンダーのもとに1か月間留まる可能性があることを意味する。それはそのモデルを避ける理由ではない。バナーではなく行を読む理由である。一方、Anthropicの発表資料のいずれもAPI側の立場を変えるものではない。Claude APIはゼロデータ保持を提供してきており、直接統合を規定するのはモデルカードの保持条件である。
確認されていることと、確認されていないこと
確認済みの集合は広く具体的で、これはこれほど新しいモデルとしては異例だ。確認されていない事柄はより限定的であり、曖昧にごまかすのではなく明示する価値がある:
• 確認済み — モデルは存在し、ID claude-haiku-5-5 で API 専用であり、10月7日に Claude API と Amazon Web Services、Google Cloud、Microsoft Azure で提供開始され、上記の価格で、100万トークンのウィンドウ、調整可能なエフォート、公開されたシステムカードを備えています。
• 確認済み — 2つのサードパーティプラットフォームが、同じ日にモデルID、エンドポイント、従量制の許容量を記載して掲載している。
• 未確認 — 私たちが確認できる限り、ベンダーの表を再現した独立系ベンチマークは存在しません。Anthropicのローンチ投稿にある精度の数値はすべて、Anthropic自身のハーネスから出たものであり、顧客の声はすべて、パートナーが自己申告した初期テストによるものです。
• 未確認 — 検査すべき重み、リポジトリ、チェックポイント、ライセンスは存在しない。モデルはクローズドであり、そのアーキテクチャや規模に関するいかなる主張も推測にすぎない。
• 未確認 — プラットフォームのリクエスト見積もりが、その想定トークンプロファイル以外でも成り立つかどうか、また、5倍のロングコンテキスト料金が独立系ボードのコスト数値に(いつ、あるいはそもそも)反映されるかどうか。
すでにあなたが呼んでいるものの隣でそれを実行する
このローンチが生み出す実務上の問いは、「Haiku 5.5は優れているのか」ではない——ベンダーの表はそうだと示しているし、Anthropicの外で確認した者はいない。問いは、「請求額はいくらで、この特定の呼び出しにとって安価なティアが適切なティアでないとき、何が起こるのか」である。どちらの半分もルーティングの問題だ。
コスト面では、メーターが示すのはステッカー価格ではなくトークン請求額だ。入力の90%削減に、30%大きいトークナイザー、冗長な推論モデル、5倍の長文コンテキスト料金段階が加われば、自分自身のプロンプト長分布を測定しない限り、予測する数値と支払う数値は乖離する。100,000トークンを超えると5倍高価になるモデルはコンパクションを促す——そしてHaiku 5.5自体がコンパクション用モデルとして売り込まれており、これは注目に値するループだ。
リスクの話で言えば、実績のないティアに本番パスを賭けないというのは、まさにそのための判断だ。Claude Haiku 4.5 はすでに OrcaRouter 上で Anthropic の定価、マークアップ0%で提供されているので、旧ティアに新しい契約は不要であり、新しいモデルから既知のモデルへフォールバックするルートは書き直しではなく設定変更で済む。effort パラメータは呼び出しごとなので、同じエンドポイントで低い effort の要約と高い effort の難しい抽出を、2つの統合を維持することなく実行できる——ルーティング DSLはまさにこの形の意思決定のために存在しており、自動フェイルオーバーがあればこそ、独立した数値をまだ持たないうちに、数日前のモデルを実際のトラフィックの前に置けるのだ。まだ当てはまらないのは明白な点だ:Claude Haiku 5.5は今日時点で当社のルートにはなく、今週それが欲しいなら Anthropic に直接コールするか、それを発表したプラットフォームを経由することになる。
移行すべきなのは、ボリュームの中心が要約、分類、コンパクション、サブエージェント作業であり、90%バンドが当てはまり、トークナイザーの30%が吸収できる計算であるチーム。待つべきなのは、プロンプトが日常的に100,000トークンを超える人、コミットする前に独立したベンチマークを必要とする人、コードを30日間の保持ウィンドウに置けない人。ローンチは本物で、価格設定も本物だ。証明はまだベンダーのものだ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
