生成されたタイトルカードには「Claude Sonnet 5.5」と表示され、サブタイトルは「中位ティアのデフォルト、完全に仕様化」、3つのバッジには「2026-09-28 リリース」「100万トークンあたり入力$2 / 出力$10」「インテリジェンス指数 56.00 対 57.62」と書かれている。OrcaRouterのロゴが右下隅に合成されている。
Guides & Insights

Claude Sonnet 5.5:ミッドティアのデフォルト、完全に仕様化

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Claude Sonnet 5.5はClaudeシリーズの中位モデルで、2026年9月28日にリリースされました。そして、これが1ページを割く価値がある理由はひとえにその価格にあります。入力100万トークンあたり$2、出力100万トークンあたり$10で、Claude Opus 5.5の$4/$20と対比されます。後者は6日前に出荷されたフラッグシップです。出力価格は半分でありながら、Artificial Analysis Intelligence Indexの差は1.62ポイント——中位モデルが56.00、フラッグシップが57.62で、いずれもArtificial Analysisがインデックス改訂版v4.3.2で測定した数値であり、当社によるものでもベンダーによるものでもありません。その両者の上に位置するのがClaude Fable 5.1で、同じ改訂版で$10/$50、53.35——フラッグシップより高価でありながら、その背後にあります。Claude Sonnet 5.5と同じ$2/$10の定価に並ぶのがOpenAIのGPT-6.1 Solで、51.83——ラインの反対側に417インデックス百分の一、これは中位モデルを検討する読者が実際に下さなければならない比較です。

このページはリファレンスであり、日付が示すのは鮮度ではなく理由だ。Claude Sonnet 5.5 は 2026-10-08 時点で登場から十日であり、このブログがニュースを扱う七日間の窓の外側にある。その窓の内側にあるのは、六日前の出来事だ。2026-10-02 付の X への2件の投稿で、このファミリーの後継モデルが、自らのベンダーが完成させながら公表しなかった競合製品を上回るという主張だ。その主張にはモデル ID も、料金表も、コンテキストウィンドウも、ここから到達できるいかなるレジストリにも裏付けとなるベンチマークもなく、そもそもこのページの主題ではない——出典の連鎖、ベンダー表面での不在確認、5モデルのインデックススプレッドはすべて、このブログがすでに「Claude Fable 5.5 は存在する前に GPT-6.1 Astra を打ち負かした——そしてそこが面白いところだ」というタイトルで公開した記事が全面的に担っている。同記事の日付は 2026-10-03 だ。その主張が実際に生み出したのは、待つ間にどの出荷済み Claude モデルを標準にすべきかと問う読者の行列であり、その問いには実在するモデルについてのページが必要だ。これがそれだ。

2026年9月28日にリリースされたもの

ベンダー自身のドキュメントが仕様を直接示しており、それは新しい形ではなく、そのティアの続きである。以下はすべて2026年10月8日にAnthropicのClaude Platformドキュメントから読んだものであり、したがってAnthropicの仕様であって、それを独自に検証したものではない。

• リリース — 2026年9月28日。モデル自身のドキュメントページは、「最新。2026年9月28日リリース。」という一文で始まっています。

• ポジショニング — 「スピードと知能の最高の組み合わせ」。比較レイテンシは、Claude Opus 5.5 が「Moderate」であるのに対し「Fast」、Claude Fable 5.1 は「Slower」、スモールティアは「Fastest」と記載されています。

• モデル ID — claude-sonnet-5-5Claude API、Google Cloud、Microsoft Foundry、AWS 上の Claude Platform ではanthropic.claude-sonnet-5-5は Amazon Bedrock で使用します。Claude のモデル ID はすべて固定されたスナップショットであるため、この文字列は勝手にずれるポインタではありません。

• コンテキストと出力 — Messages API では 1,000,000 トークンのコンテキストと 128,000 トークンの同期出力。output-300k-2026-03-24ベータヘッダーを Message Batches API で指定すると、300,000 トークンまで拡大します。

• Thinking — 適応型で、デフォルトで常に有効、デフォルトのエフォートは high。最低の設定は between_tools、これは事前の思考をオフにし、以下で受け入れられます: high エフォート以下です。設定 temperature、top_p または top_k をデフォルト以外の値に設定すると 400 エラーが返されるため、チューニングされた温度で古い Claude モデルから移行されたリクエストは、静かに失敗するのではなく、明示的に失敗します。

• 知識カットオフ — 信頼できるカットオフとトレーニングデータのカットオフの両方とも、2026年6月です。

• ライフサイクル — アクティブ(最新)。Anthropic のプラットフォームでは、廃止は早くとも 202年9月28日より前には行われません。Amazon Bedrock と Google Cloud はそれぞれ独自のスケジュールを設定しています。

ベンダーのローンチ時の言い回しは引用に値する。なぜならそれは測定結果ではなく主張だからだ。Anthropicの発表では、Claude Sonnet 5.5は「Sonnet 5からの明確なアップグレードであり、30%高速に動作し、ほとんどの作業で最大30%コストを削減する」と説明されている。この一文はベンダーのもので、当社が再現したものではなく、どのような作業を評価させるかによって完全に左右される類の主張だ。また、このリリースには移行コストも伴うが、それはこのページで扱うべき話題ではない。5つの破壊的変更が、Claude Sonnet 5上ですでに稼働しているコードに影響を与え、6つ目は、いかなるリクエストも失敗させることなくレスポンスの形を変える。その内訳は、このブログがリリース週に公開したロールアウト記事に属するものであり、今日Sonnet 5を本番環境で運用しているなら、まず最初に読むべきものだ。

A screenshot of Anthropic's Claude Platform documentation page for Claude Sonnet 5.5, headed with the line 'Latest. Released September 28, 2026', showing the model ID claude-sonnet-5-5, pricing of $2 per input MTok and $10 per output MTok, a 1M-token context window, 128K max output, adaptive thinking with a default effort of high, a June 2026 knowledge cutoff and a retirement commitment of not sooner than September 28, 2027.

1.62ポイント、そして半額

このモデルの独立系スコアは一つの情報源から出ており、議論を決着させるたった一つの数値を伴っている。Artificial AnalysisはClaude Sonnet 5.5をIntelligence Index(リビジョンv4.3.2)で56.00と測定しており、これはページが「Claude Sonnet 5.5 (Max, Default Fallback)」と記す構成での値である。当該ページは2026-10-08に確認した。同じリビジョン、同じ日について:

• Claude Opus 5.5 — 57.62、2026-09-22 リリース、$4 / $20

• Claude Sonnet 5.5 — 56.00、2026-09-28リリース、$2 / $10

• Claude Fable 5.1 — 53.35、2026-09-01 リリース、$10 / $50

• GPT-6 Astra — 52.67、2026年9月3日リリース、$10 / $50、272,000プロンプトトークンを超えるロングコンテキストティアは$20 / $75

• GPT-6.1 Sol — 51.83、2026年9月29日リリース、$2 / $10

どのリビジョンに基づくものかを明示することは重要です。というのも、インデックスのあるバージョンのスコアは、別のバージョンのスコアとは比較できないからです。v4.3.2 には 10 件の評価 — AA-Briefcase v1.1、GDPval-AA v2.1、AutomationBench-AA、Terminal-Bench 4.0、SciCode、Humanity's Last Exam、GDP.pdf、CritPt、AA-Omniscience、AA-LCR v1.1 — が組み込まれており、そのセットの構成はリビジョンごとに変化してきました。上記の 5 つの数値はすべて同じリビジョンに由来しています。だからこそ、これらは互いに比較して読むことができ、そのいずれも、以前のバージョンから引用された数値とは比較して読むことはできません。

価格比較は行動を決める部分だ。Claude Sonnet 5.5の出力レートはClaude Opus 5.5の半分で、入力レートもまた半分である。ベンダー自身の料金表では、ミッドティアは$2 / $10、フラッグシップは$4 / $20だ。公表された2つの数値を並べると、その比率は際立っている。出力リスト価格1ドルあたり、Claude Sonnet 5.5は5.60インデックスポイント、Claude Opus 5.5は2.88——Anthropic自身の料金表とArtificial Analysis自身の測定によれば、出力1ドルあたりのインデックスはほぼ2倍である。それは何かを測定したものではなく、公表された2つの数値に対する算術であり、ミッドティアを支持する議論の正直な形だ。またそれは評決でもない。インデックスポイントは正しさの単位ではなく、このページの残りの要点は、1.62が何で構成され、何で構成されていないかにある。

A generated two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Opus 5.5 - the scoreboard'. The left column, Claude Sonnet 5.5, reads: Released September 28, 2026; Intelligence Index v4.3.2: 56.00; Price per 1M tokens: $2.00 / $10.00; Context window: 1M tokens; Max output: 128K tokens; Default effort: high. The right column, Claude Opus 5.5, reads: Released September 22, 2026; Intelligence Index v4.3.2: 57.62; Price per 1M tokens: $4.00 / $20.00; Context window: 1M tokens; Max output: 128K tokens; Default effort: medium. The footer reads 'Index figures per Artificial Analysis v4.3.2, read 2026-10-08; prices and specifications per Anthropic.' The OrcaRouter logo is composited in the bottom-right corner.

料金表、そして最も動く2行

Anthropicの完全な価格表(2026-10-08時点)。このセクションの数値はすべてベンダーによるものです。

• 入力 — 100万トークンあたり$2.00。出力 — 100万トークンあたり$10.00で、思考トークンは出力として課金されます。ここではアダプティブ思考がデフォルトで有効になっているため、これを抑制することはできません。

• キャッシュ読み取り — 100万トークンあたり$0.10で、Anthropicはこれをベース入力価格の5パーセントと記載しています。これはClaude Opus 5.5が適用する割引率と同じであるため、キャッシュ利用によって両者の順位が変わることはなく、また、安定したプレフィックスを維持する長時間のエージェント実行では、再読み取りするすべてに対して入力レートの10分の1を支払うことになります。

• キャッシュ書き込み — 5分キャッシュは100万トークンあたり$2.50、1時間キャッシュは$4.00。キャッシュ可能なプロンプトの最小長は512トークンなので、短いプロンプトではこの割引をまったく利用できません。

• Batch API — 双方向とも50パーセント割引。つまり、待てる作業なら入力$1.00、出力$5.00です。

• 長コンテキスト割増なし — Anthropicはこのモデルにおいて、100万トークンのウィンドウ全体を標準のトークン単価で請求するため、900,000トークンのリクエストでも9,000トークンのリクエストと同じトークン単価になります。これはGPT-6 Astraとの実質的な違いです。GPT-6 Astraでは272,000プロンプトトークンを超える長コンテキスト層で$20 / $75に引き上げられます。これは挙げておく価値があります。プロンプトが長くなると、両ベンダーの見出し数字がここだけ大きく乖離するからです。

ほとんどの請求額を決めるのは、見出しの料金ではなく、実際には2つの行項目です。長時間のエージェント実行全体に効くキャッシュ読み取り割引と、非同期処理向けのバッチ割引です。リーダーボードで比較されるのは見出しの$2 / $10ですが、毎月の請求書が実際に積み上がるのはキャッシュとバッチの行項目からです。

ギャップが意味することと、意味しないこと

Intelligence Indexは固定されたタスク構成に対する単一の数値であり、その単一の性質が、この指標をめぐる混乱のほとんどを説明している。v4.3.2の背後にある10の評価には、エージェント型コーディングとターミナル作業、大学院レベルの科学推論、ソフトウェアエンジニアリングのセット、エージェント型自動化のセット、長文コンテキスト検索のセットが含まれ、合成値として重み付けされている。あるモデルが別のモデルより1.62ポイント劣っている場合、それはその合成値において劣っているのであって、あなたのワークロードにおいてではない。あなたのワークロードでは、これら10の評価がまったく異なる比率で重み付けられているかもしれず、またそのどれも代表していないタスクが含まれているかもしれない。

実務上それが意味するのは、階層の威信ではなく、仕事の形による区分だ。Anthropic自身のモデル選択ツールはその区分を明示しており、ミッドティアにおもねらないので読む価値がある。ドキュメントは読者に「ほとんどのワークロードではClaude Opus 5.5から始める」よう促し、「要求の厳しい推論や長期的なエージェント作業、またはより高いエフォートでClaude Opus 5.5の評価がなお不十分な場合」にはClaude Fable 5.1に手を伸ばすよう勧めている。Claude Sonnet 5.5は、その文が最初に挙げるモデルではない。同じドキュメントが速度と知能の最良の組み合わせと説明するモデルであり、小規模ティアを除けば比較レイテンシが最速だ——それは別の主張であり、より狭い主張である。

では、正直な読み方はこうだ。ミッドティアは、範囲が明確な作業を大量にこなす場合には通常正解だ。既知のコードベースに対する機能追加とバグ修正、出力形式が定義された抽出と分類、難しい部分が推論ではなくハーネスにあるツール呼び出しループ、そして高速な最初のトークンと低い呼び出しあたりコストが、能力の最後の2パーセントより重要なあらゆる作業だ。フラッグシップは、作業が真に長期的な場合にその料金に見合う。数時間に及ぶエージェント実行、プロンプトに一度に収められないファイルにまたがるリファクタリング、そしてより高いエフォートでは測定可能なほど不足するミッドティアでの評価などだ。その最後の条件はベンダー自身が示したもので、検証可能でもある。ミッドティアのエフォートレベルを上げ、自分で評価を実行し、それが差を埋めるか見てみるのだ。もし埋めるなら、1.62はあなたにとって不可欠ではなかった。もし埋めないなら、あなたは他人の合成スコアではなく、自分の数値で答えを買ったことになる。

この差は、1.62ポイントが取るに足らないという意味ではない。それは2つのモデル間の差のすべてであり、同一条件下で評価される固定ハーネス上では、実際の順位付けである。それは単に、特定のタスク構成を、最大エフォートかつデフォルトのフォールバックで順位付けしたものにすぎず、どちらもベンチマークされていないワークロードにとって、2つのうちどちらがより良い買い物かを何も語らない。

名前の罠:これがどの Claude Sonnet 5.5 のページなのか

このモデル名で検索した読者は、このブログで、これと似て見えるが実際にはそうではないいくつかのページに出会う。2026-09-24付のものは予告ページだ。モデルの出荷前に書かれ、その主題はステルステストを主張する単一のX投稿であり、それが置き換えることになるモデルの数値に照らして再構成されていた。リリース週に公開されたものはロールアウト記事だ。その主題は、Claude Sonnet 5ですでに実行されているコードに影響する5つの破壊的変更と、エラーを発生させずにレスポンス形状を変える6番目の変更である。また、このモデル名を他のベンダーのモデルと対戦させて掲げるマッチアップページの一群もあり、リリースのプロモーションが何を対象としているかについての応用ページもある。

どれもモデルページではなく、その空白をこの記事が埋める。このページは、読者がモデル自身の名前で検索した後にたどり着くリファレンスだ。それが何であり、いくらかかり、何を測定し、どの仕事がそれに属するのか。ロールアウトページの移行の詳細と、アンティシペーションページのソーシング批評はそれぞれの場所にとどまる。本番環境でSonnet 5のコードを動かしているなら、最初にクリックすべきはロールアウトページであり、このページは、移行先のモデルが本当に自分が望むものかどうかを教えてくれる。

ここでついでに直しておく価値のある命名慣習がひとつある。それ自体が誤解を招くからだ。5.5 という接尾辞は、順位ではなく世代を示す。Claude Sonnet 5.5 と Claude Opus 5.5 は同じファミリーの同じ世代であり、ドットの前の数字がティアだ。接尾辞のどこを見ても、どちらがベンチマークで勝つかはわからない。

可用性、日付付き

Claude Sonnet 5.5 は、出荷された当初から OrcaRouter 上にanthropic/claude-sonnet-5.5として、Anthropic 自身の定価のまま、上乗せ一切なしで掲載されています。入力 $2.00、出力 $10.00(100万トークンあたり)で、この2つの数値は 2026-10-08 に当社自身のモデルエンドポイントから読み取ったものであり、ベンダーの料金表と行単位で一致しています。同モデルの当社ページには、同じ 100万トークンのコンテキストウィンドウと最大 128K の出力が記載され、受け付ける入力タイプとしてテキスト・画像・ファイル、出力としてはテキストのみが挙げられ、リリース日は 2026-09-28 で非推奨ではないと記され、OpenAI 互換の chat-completions エンドポイントと Anthropic 独自の messages エンドポイントの両方から到達可能であることが示されています。これにより、どちらか一方に既に対応している統合であれば、そのまま差し替えるだけで済みます。

同じカタログ内のその他すべては同じキーから到達できます:200以上のモデルに対応する単一のAPIを備え、プロバイダーの定価をマークアップ0%でそのまま反映するので、ベンダーの値下げは発表された当日に顧客へ届きます。自動フェイルオーバーはエンドポイントが劣化したときに働き、特定のモデルを固定したい場合や複数のモデルを組み合わせて1つの回答にまとめたい場合のためのルーティングDSLもあります。この組み合わせがあるからこそ、このページの問いは高くつくどころか安く答えられるのです。上の比較に出てくる両モデルは同じ認証情報の背後にあるため、比較対象となる価格は再販業者のものではなくベンダー自身が公表した価格であり、バージョンのテストは移行プロジェクトではなく評価を1回走らせるだけで済みます。トラフィックの一部をanthropic/claude-sonnet-5.5に向け、残りはフラッグシップに載せたまま、自社の「完了タスクあたりのコスト」の数値にどちらをデフォルトにすべきかを決めさせましょう。

A screenshot of the OrcaRouter model page for anthropic/claude-sonnet-5.5, attributed to Anthropic and dated 2026-09-28, showing a 1M-token context window, 128K maximum output, text image and file inputs with text output, an input price of $2.00 per million tokens and an output price of $10.00 per million tokens, the model id claude-sonnet-5-5, and an OrcaRouter performance panel.

短いバージョン

Claude Sonnet 5.5は、フラッグシップにも迫る数値とフラッグシップの半分の出力価格を併せ持つミッドティアモデルであり、これが既定の選択肢になるかどうかを決める事実は次の3つです。Artificial Analysisのv4.3.2インデックスでは、Claude Opus 5.5に1.62ポイント差で後れを取っており、56.00対57.62です。どちらの数値も同じリビジョンで、デフォルトフォールバック付きの同一のmax-effort構成で測定されています。価格はフラッグシップの$4 / $20に対して$2 / $10で、キャッシュ割引とバッチ割引は異なるものではなく比例して適用されるため、どちらのモデルが提供する割引においても価格差は変わりません。そして、既定のエフォートは高ですが、フラッグシップの既定は中です。つまり、フラッグシップから引き継いだ設定は、ここでは低くなるのではなく1段階高く動作し、そのコストは想定するのではなく測定する必要があります。

Anthropic自身のピッカーは、ほとんどのワークロードで依然としてClaude Opus 5.5から始まっており、何かを標準化する前に知っておく価値があります。しかし、このモデルの名前を検索してこのページにたどり着いたほとんどの読者にとっては、中間ティアが妥当なデフォルトであり、フラッグシップは自社の評価がそれを求めたときに買う例外です — 大量の、範囲を明確にした作業、高速なレイテンシ、長コンテキスト割増なしの100万トークンウィンドウ、そして出力価格を半減させる料金。どちらもOrcaRouterではキー1つで切り替えられ、両者を選別する評価は移行ではなく午後ひとつ分の手間で済みます。

この記事で比較したモデル4

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新