
Claude Sonnet 5.5、ClaudeとAPIで提供開始 — 既存コードを壊す5つの変更を伴う
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 348 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2237知能
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- xAINEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- xAISpaceXAI: Grok 4.62026-08-1244知能77コーディング
Claude Sonnet 5.5が提供開始。ベンダーの発表は2026年9月28日付で、Claude Platformのモデルページでは「Latest」として掲載されており、識別子はclaude-sonnet-5-5です。Claude API、Amazon Bedrock、各種クラウドコンソール、Microsoft Foundry、AWS上のClaude Platformで共通です。Claude本体とAPIへの展開は今週行われている部分です。1日を費やすことになる部分は、同じドキュメントの別の箇所にあります。5つの破壊的変更が、既に実行中のコードに影響します。その実行環境はClaude Sonnet 5、そして6つ目は、1件のリクエストも失敗させることなくレスポンスの形状を変更します。
それがこのリリースの形だ。料金表は動かなかった。Claude Sonnet 5.5は入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、これはClaude Sonnet 5とまったく同じであり、キャッシュ読み取りは0.20ドル、5分間のキャッシュ書き込みは2.50ドルだ。能力はずっと先へ進んだ。Artificial Analysisの現行リビジョンでは、新しいモデルはそれが置き換えるモデルを18ポイント上回っており、これは同ボード上で連続する2つのSonnetモデル間の差として最大だ。移行コストもそれに応じて最大になる。そのどれも不満ではない——高くならずに良くなるモデルは良いケースだ——しかし、その2つの事実は同時にやってくるし、あなたの一週間が大丈夫かを決めるのはリリースノートのほうだ。
9月28日に実際にリリースされたのは何ですか?

仕様は新しい形というよりも、その階層の直接の延長線上にあります:
• モデル ID — claude-sonnet-5-5Claude API、AWS 上の Claude Platform、Microsoft Foundry ではanthropic.claude-sonnet-5-5Amazon Bedrock では
• 価格 — 入力 $2 / MTok、出力 $10 / MTok、5分キャッシュ書き込み $2.50、1時間キャッシュ書き込み $4、キャッシュ読み取り $0.20
• Batch — 双方向とも50%オフ、つまりMTokあたり$1 / $5
• コンテキストと出力 — 入力1Mトークン、同期で出力128Kトークン、Message Batches API ではoutput-300k-2026-03-24 ベータヘッダー
• 思考 — 適応型、デフォルトのエフォートは高;知識とトレーニングのカットオフはいずれも2026年6月
• ライフサイクル — 開始時点からデータ保持ゼロ、および公表された廃止予定日の下限は2027年9月28日より前にはならないこと
見落としやすく、重要な点が2つある。第一に、長いコンテキストに対する割増料金は存在しない。Anthropicは1Mトークンのウィンドウ全体を標準料金で請求するため、900,000トークンのリクエストは9,000トークンのリクエストと同じトークン単価になる。第二に、前モデルの$2 / $10という料金はもともと導入価格であり、2026年9月1日に$3 / $15へ値上げされる予定だった。Anthropicの料金ページは現在、その値上げは行われないと明記しており、これによりSonnetティアの現在の価格はプロモーションではなく恒久的な確約となる。これらはいずれもベンダーによる表明であり、独立した検証結果ではない。
問題が発生する順に並べた移行リスト
AnthropicのSonnet 5.5の概要は、この点について異例なほど率直だ。5つの破壊的変更が、Claude Sonnet 5ですでに実行されているコードに影響を与える。それらはスタイル上のものではない。それぞれがエラーを返すか、動作を黙って変えてしまう。
• 強制的なツール使用は拒否されます。 tool_choice が "any"、または特定のツール名である場合、モデルを制約するのではなくエラーを返すようになりました。エージェントループでツールを固定して構造化呼び出しを保証している場合、そのループは最初のリクエストで動作しなくなります。代替策は、モデルに選択させて結果を検証するか、保証を構造化出力に移すことです。
• thinking: {"type": "disabled"} は拒否されます。thinking を完全にオフにすることは、もはやサポート対象の設定ではありません。代替は between_tools で、事前の thinking をオフにし、high エフォート以下で動作します。これはモデル上の最も低い thinking 設定であり、オフスイッチではありません。
• 思考ブロックはモデルと会話に紐付けられています。以前のターンが生成した推論は、Claude Sonnet 5 から Claude Sonnet 5.5 へ引き継がれますが、別のファミリーへ持ち出されることはなく、アカウントをまたぐこともありません。モデルバージョンをまたいでトランスクリプトを再生するアプリケーションでは、以前は受け入れられていた思考ブロックが拒否されるようになります。
• computer_20251124 は Claude API または Google Cloud では受け付けられません以前の computer-use ツールのバージョンを宣言していたコードは、現在のツールセットに移行する必要があります。
• アドバイザーツールは自身のファミリーを拒否します。Claude Opus 4.8、Claude Opus 4.8、Claude Sonnet 5 はアドバイザーとして拒否されるため、より小さな Claude モデルをより大きなモデルに対するチェッカーとして使用していたパイプラインはすべて再ペアリングが必要です。
次に、何も失敗させない変更があります。モデルがツール呼び出しの合間に出力するテキストは、通常の出力としてではなく、thinking ブロック内に届くようになりました。ユーザーにテキストをストリーミングするアプリケーションは、ツール呼び出しの合間に沈黙します — エラーも例外もなく、UI が停止しているように見えるだけです。テキストを返す display 値を設定するか、between_tools に切り替えるまで。これが、テストスイートでは何も例外を投げないため、本番環境に到達する可能性が最も高い障害モードです。
念のため、もう一つ付け加えておきます:temperature、top_pまたはtop_k をデフォルト以外の値に設定すると 400 が返されます。ゲートウェイやクライアントライブラリが意図ではなく習慣で temperature を設定しているなら、その習慣は今や障害となります。
30%という主張、独立した数値と比較して

AnthropicによるClaude Sonnet 5.5のマーケティング上のうたい文句は、トークンあたり料金が同一でありながら「タスクあたりのコストが前身モデルより最大30%低い」という点と、Claude Sonnet 5より「出力を30%以上速く生成する」という点だ。どちらも価格ではなくトークンに関する主張で、どちらもベンダーによる報告である。最初の主張のからくりは、ベンダー自身のベンチマーク表にはっきりと表れている。Terminal-BenchのMedium effortでは、AnthropicはClaude Sonnet 5.5がClaude Sonnet 5の最高スコアを「タスクあたりコスト10分の1未満」で上回ると述べており、CursorBenchのLow effortとAA-BriefcaseのMediumについても同様の主張をしている。
独立した見解は方向性では一致しているが、規模では一致していない。Artificial Analysisのv4.3.2 Intelligence Indexでは — 10件の評価を、すべてのモデルにわたって単一の構成で実行 — Claude Sonnet 5.5は56を記録し、ページでは216中3位に位置づけられている。Claude Sonnet 5は同じボードで38を記録。これは同じ価格帯の同じティアに属する連続した2つのモデル間の18ポイントの変動であり、Anthropicが今年Sonnetライン内で開けた最大のギャップである。
コストの数字こそ、ベンダーの主張が成り立ちにくくなる点だ。Artificial Analysisの測定では、Claude Sonnet 5.5は完了したIntelligence Indexタスク1件あたり$7.60だ。この数字は、同クラスのどのモデルよりも30%低いというわけではない。なぜなら、このモデルは極めて冗長だからだ。Index評価を完了するのに4億1000万の出力トークンを生成しており、これは同等モデル全体の中央値8800万に対しての数字だ。トークンあたりの効率とタスクあたりの効率は別物であり、Claude Sonnet 5.5は前者では際立って優れているが、後者では平均的なだけだ。
今回のリリースに関するAnthropic自身のベンチマーク数値はすべてベンダー報告であり、第三者による再現は行われていない。そのうち2つには、繰り返す価値のある脚注が付いている。GDPval-AA v2.1とAA-Briefcase v1.1の数値は、スコアを過小評価している可能性のあるバグを抱えたリリース前デプロイ上でArtificial Analysisによって実行されたものだ。そして、AnthropicのFrontierCode 1.1の数値に関する注記は、その評価においてClaude Sonnet 5.5がXhighよりもMax effortで低いスコアを出す理由を説明している。より低いエフォート設定でモデルが自分自身を上回る表は、そのベンチマーク構成が固まっていないことを告げている表だ。
本番パスを賭けずにそれをテストする方法
移行に際して、ベンダーのエンドポイントへ直接ではなくルーター経由でClaude Sonnet 5.5を実行するのには、はっきりした理由があります。それは、どちらが良いかを見極めている間、旧モデルと新モデルのどちらかを選ばずに済むことです。OrcaRouterでは、Claude Sonnet 5は6月30日からAnthropic自身の$2 / $10でルーティング可能で、マークアップは一切なく、単一のOpenAI互換エンドポイントの背後にある200以上のモデルの1つであり、今もなおClaude APIトラフィックの大半が流れるモデルです。Claude Sonnet 5.5はまだ当社のカタログにはないため、現時点でそれへのルートはAnthropic自身のAPIです。
その間に機能するパターンは、トラフィックの一部を新しいモデルに送り、残りはフェイルオーバーに任せる——というものだ。フォールバックをClaude Sonnet 5にしておけば、5つの破壊的変更のいずれかによる400は、リクエストの失敗ではなく、より遅い応答へと縮退する。これはまた、ベンダーの主張では分からないもの、つまり同じエフォート設定における両モデルのタスクあたりトークン数を測定する最も安価な方法でもある。30%という数字はAnthropic自身の評価における平均であり、あなたのトラフィックはその平均ではない。
次に何が届くのか
Anthropicの発表によれば、Claude Haiku 5.5は「今後数週間のうちに」ファミリーに加わり、これでスモールティアの5.5世代が完成することになる。それまでは、本番環境でSonnetを運用しているチームが直面する2つの決定は切り離せる。移行はスケジュールできる1日仕事であり、モデルの入れ替えは後回しにできる計測だ。逆の順序で行うこと——先に差し替えて本番環境で強制ツール使用エラーを発見すること——は、週末を潰すことになるこのロールアウトのやり方だ。

この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
