
Claude Sonnet 5.5:すでに存在する4つの数字から組み立てられたステルステストのリーク
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 36 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 181 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
9月24日、Claude Sonnet 5.5が「すでにステルステストされている」証拠として、4つの数字がXに投稿された。1Mトークンのコンテキストウィンドウ、128Kトークンの最大出力、入力100万トークンあたり$2、出力100万トークンあたり$10。この4つはすべて今現在Anthropic自身の価格表に載っており、Claude Sonnet 5に紐づいている。5.5が置き換えるはずのモデルで、2026年6月30日から一般提供されている。同じ$2 / $10という見出しは、OpenAIが9月22日に投入したGPT-6 Solにも当てはまり、この重なりによってこの投稿は、定例のティア更新というよりOpenAIへの回答として読める。「これは私にはGPT-6-Solへの直接の応答に読める。同じ価格設定で、おそらく同様のパフォーマンスだろう。」
そんなことはどれも、その主張を誤りにはしない。それは主張を反証不可能にするのであり、書き留めるべき問題としては別物で、より有用なものだ。ステルステストの目撃は、その背後にあるアーティファクト以上の価値はない。そして今回の背後にあるアーティファクトは、Anthropicが12週間にわたって提供してきたモデルと見分けがつかない仕様書である。
実際に投稿されたのは何ですか?
情報源は、アカウント @kimmonismus による2026年9月24日付の単一のX投稿です。それにはコンテキストウィンドウ、出力上限、および2つの価格が記されており、価格を GPT-6 Sol と比較し、Sonnet 5.5 がテスト中であると結論づけています。スクリーンショットも、モデル文字列も、APIレスポンスも、コンソール一覧も、テスターによる挙動の説明も、これに付随する第二の観測者もありません。この投稿は数字を含む主張であり、その数字はそのティアの公開上限です。
それは、Anthropicの別種のリリース前の話から切り離して考える価値がある。2026年はその両方を生み出したが、両者はまったく似ていないからだ。8月の早期アクセス識別子 claude-marshmallow-eap と claude-melon-eap は、リクエスト内に存在した文字列だった——不格好で、地味で、検証可能だった。9月を通して流れているOpus 5.2の話は、ルーティングに関する報告だ。開発者たちが、「Opus 5」というラベルの背後のバックエンドが異なる応答を返したことに気づき、その挙動を説明している。どちらも具体的な痕跡だ。痕跡が一切添えられていない「すでにステルステストが行われている」は、Sonnetティアがすでに売っているものの要約にすぎない。
情報源そのものにも注目すべきパターンがある。同じアカウントが9月20日に投稿したまとめ記事は、「すでにテストが確認されている」とされる4つのモデル——Claude Sonnet 5.2、Claude Opus 5.2、Claude Fable 5.2、Gemini 4 Pro——を冒頭に挙げていた。これら4つの名前のうち、OpusとFableの項目には別途、裏付けの取れた報道があり、Geminiの項目にも独自の目撃情報がある。Sonnetの項目は、リストの一項目にすぎなかった。4日後、Sonnetの主張にはスペックシートが加わり、そのスペックシートはすでに存在するモデルのものだ。
その4つの数字はClaude Sonnet 5の数字です
これは確認するのに30秒しかかからない部分なのに、ほとんど誰も確認していない。今日読んだAnthropicのモデル概要ページには、Claude Sonnet 5が100万トークンのコンテキストウィンドウ、最大出力128K、100万トークンあたり$2 / $10と記載されている。このリークをそれと照らし合わせると:
• コンテキストウィンドウ — Claude Sonnet 5.5 では 1M トークンと主張、Claude Sonnet 5 では 1M トークンが公表
• 最大出力 — 128Kトークンと公称、128Kトークンを公開
• 入力価格 — 100万あたり$2(主張値);100万あたり$2(公表値)
• 出力価格 — 請求ベースで100万件あたり10ドル、公開ベースで100万件あたり10ドル
• モデルID — Claude Sonnet 5.5 については何も公開されていません。Claude Sonnet 5 には claude-sonnet-5
• 独立したスコア — 主張されているモデルについてはなし。Artificial Analysis は Claude Sonnet 5 を、適応的推論・最大エフォート構成において、測定対象の210モデル中54位、Intelligence Index 38に位置づけている

リークが逆に捉えている価格の論点には、もう一つの層がある。Claude Sonnet 5の登場時、$2 / $10は2026年8月31日まで続く導入価格として発表され、9月1日には$3 / $15へ引き上げられる予定だった。その値上げは実施されなかった。Anthropicの価格ページには現在、$2 / $10は「現在は標準価格である」、そして「2026年9月1日に予定されていた、100万入力/出力トークンあたり$3 / $15への値上げは実施されない」と記した脚注がある。つまり、リークが新モデルの競争武器として提示している価格は、現行モデルの恒久料金だ。ということは、$2 / $10で登場するSonnet 5.5は、まったく割引なしで、すでにGPT-6 Solに対抗した価格設定がなされているティアに投入されることになる。
Anthropicが実際に言った唯一のこと
匿名のリーカーからの情報をすべて取り除くと、一次情報源による一文だけが残る。Anthropicが2026年9月22日にClaude Opus 5.5をローンチしたとき、同社は、Claude Sonnet 5.5とClaude Haiku 5.5が「今後数週間で」続き、性能、効率、安全性において同程度の向上をもたらすと述べた。その一文が、確認された記録のすべてである。そこにはモデルIDも、コンテキストウィンドウも、価格も、ベンチマークも、日付もない——そして特に、ステルステスト、グレールート、いかなる種類のテストについても何も述べていない。
Anthropicの公開情報の残りの部分も、その読み方と一致している。モデルの概要には依然として4つのモデル——Claude Fable 5.1、Claude Opus 5.5、Claude Sonnet 5、Claude Haiku 4.5——が記載されており、5行目も、価格項目も、Sonnet後継モデル向けの「近日公開」マーカーもない。もしSonnetティアのチェックポイントが、開発者が到達できるどこかで提供されていたなら、識別子が最初に表面化するはずだ。提供されるモデルはリクエスト内で名前を持たなければならないからである。何も表面化していない。
9月の発表で一つだけ確定したことがある。それは、Haikuラインが廃止され、5.5世代がラインナップを再編するという以前のリークを否定した。Anthropicによれば、Haiku 5.5が登場する。つまり、再編話はリーカーが滅多に外さない方向で外れていた——安価なティアは存続するのだ。
8月のリークでは200万トークンとされていた。今回のものは100万トークンとしている。
9月24日の投稿の6週間前、8月9日に、別のXアカウントが「SONNET 5.5 LEAK」という仕様表を投稿し、はるかに大胆な主張をしていた。200万トークンのコンテキストウィンドウ、Sonnet 5の2倍、より高速な推論、ブラウザとターミナルツールの使用の改善、Claude Fable 5に迫る性能、そして「来月」のリリース。そのリークには、Anthropicのプレビューカードに見えるようにスタイルされた画像が添えられていた。また、批評家たちがすぐに注目した致命的な詳細もあった。それが付けたコードネーム「Fennec」は、6月30日にClaude Sonnet 5とともにすでに出荷されていたコードネームだった。コードネームは、それを使用したモデルの後継機であることの新たな証拠にはなり得ない。
つまり、2つのリークの波は、最もよく引用されるたった一つの数字で食い違っている。8月は2Mコンテキストと言った。9月は1Mと言う。両方が同じビルドについて述べているはずがない。最もありそうな読み方は、退屈なものだ。9月の投稿はSonnetティアの公表済み上限を説明している。なぜなら、それがSonnetティアのモデルを外部から見た姿だからであり、8月の投稿は、リフレッシュがもっともらしく倍にするであろうものについての推測だった。数字がどちらの方向へ動いたかに注目してほしい——下へ、すでに存在するものへと向かって。
では、GPT-6 Solの比較は合っていますか?
おおむねその通りで、それが崩れる箇所こそが興味深い部分だ。GPT-6 Solは2026年9月22日にリリースされ、Claude Opus 5.5と同じ日だった。その定価は100万入力トークンあたり$2、100万出力トークンあたり$10から始まる——まさにSonnet 5の料金であり、リーク情報がSonnet 5.5について主張している額そのものだ。105万トークンのコンテキストウィンドウと128Kの出力上限を備え、いずれもClaude Sonnet 5の数値とはわずかに異なる。より安価な兄弟モデルであるGPT-6 Lunaは、$0.10 / $0.50に位置している。
分かれ目はロングコンテキストだ。GPT-6 Solは2段階の料金体系を採用している。入力トークン272,000までが$2 / $10、それを超えると$4 / $15だ。AnthropicはSonnetラインでそんなことはしていない。Claude Sonnet 5は100万トークンのウィンドウ全体を標準料金で課金するため、90万トークンのリクエストでもトークンあたりのコストは9千トークンのものと同じになる。したがって、実際のSonnet 5.5と実際のGPT-6 Solを比べると、通常のプロンプトでは価格は互角であり、両モデルが売りにしている長文書や大規模リポジトリのワークロードでは2倍の差がつく。「同じ価格」は見出しでは正しいが、その料金階層が選ばれるワークロードでは誤りだ。
2つ目の注意点は、この比較全体の根底にある。Claude Sonnet 5 は Anthropic の新しいトークナイザーを使用しており、同じテキストに対して以前のものより約30%多くのトークンを生成する。見出しの料率は請求額ではない。請求額はタスクあたりのトークン数であり、それはどのリークもこれまで示してこなかった数字だ。
Sonnet 5.5が重要になるには、何が必要だろうか
それが存在するかどうかは脇に置いて、トークンにお金を払っている人にとって何が変わるのかを問おう。4つのこと、そしてそのどれも仕様書ではない。
第一は、$2 / $10 を下回る価格だ。9月1日の値上げが取り消されたことで、現行の料金は恒久的になった。したがって、同じ料金を維持する後継は横ばいの動きであり、資金を動かす唯一の Sonnet ティアのニュースは値下げである。
2つ目は100万を超えるコンテキストだ。それが8月のリークの実際の提案であり、現行モデルがまだカバーしていない、リークが挙げられる唯一の能力ギャップである。
第三は、タスクあたりのトークン数です。Claude Sonnet 5の適応型思考はデフォルトで有効になっており、独立した分析によれば、前世代よりもタスクあたりの出力トークンを大幅に多く生成していることが測定されています。$2 / $10の料金体系を維持しつつ、その膨張を止めるバージョンなら、表向きの価格引き下げよりも実際の請求額をさらに削減できるでしょう。
第四は識別子だ。APIモデル文字列、ドキュメントの行、価格設定の項目、モデルカード——そのどれか一つでもこの議論に決着をつける。そして、これほど露骨なリークの後にその四つすべてが欠けていること自体が、この話の中で最も多くを語る事実なのだ。
今日電話できる相手
Claude Sonnet 5は、ティアの整理がつくまでの一時的なつなぎ役ではない。すでにClaude APIトラフィックの大半が稼働しているモデルであり、100万トークンのコンテキストウィンドウ、128K出力、そして今やプロモーションではなく標準となった$2 / $10の料金体系を備えている。

6月からOrcaRouter上でAnthropic自身の$2 / $10で提供されている、プロバイダーの定価のままマークアップなしでパススルーされている。そのためSonnetラインのベンダー価格変更は、次の請求サイクルではなく当日中にここで反映される。同じキーはすでに$2 / $10でGPT-6 Solにも到達でき、この種の記事ではいつも以上に重要な点だ。漏洩情報が頼りにしている比較は、2つの契約ではなく1つの認証情報で自分自身で実行できる比較なのだから。

それは、このリークが提起する問いに答えるための最も安価な方法でもある。もし Sonnet 5.5 が本当に登場すれば、ほかと同じようにカタログに並び、トラフィックの一部をそこへ振り向けるだけでいいClaude Sonnet 5 への自動フェイルオーバーを背後に備えて — 二つ目の統合も、再交渉も、誰も独立してベンチマークしていないモデルに本番経路を委ねることもない。未検証のティアを試すのは、移行プロジェクトではなくルーティングの判断だ。
次のリーク記事の代わりに観るべきもの
3つのシグナルを、あなたに教えてくれる情報量が多い順に示す。識別子は決定的だ。提供されるモデルはリクエスト内に名前を持たなければならず、2026年の検証可能なAnthropicのリリース前情報がすべて検証可能になったのは、まさにこの理由による。ベンダーによる確認 — モデルカード、ドキュメントの1行、価格表の1行、あるいはモデルがAnthropic自身のリストに単に現れること — は、それを即座に終わらせる。「数週間以内」という一文は、それらのうちの1つが本当に約束されていることを意味する。仕様ではなく挙動を記述したテスター報告は、3つの中で最も弱いが、それでも今日存在するものよりは情報量が多い。
それらのどれかが実現するまでは、正直な要約はこうだ。Anthropicは今後数週間でSonnetの刷新を約束しており、ある観測者は、それが置き換えるモデルの数値を使ってそれを説明した。あなたのスタックがすでにclaude-sonnet-5を動かしているなら、待つものは何もなく、それを前提に計画するものも何もない。Claude Sonnet 5とGPT-6 Solを比較検討しているなら、あなたが行動に移せる数値はすでに公表されているものであり、それは漏洩情報がニュースとしてあなたに売り込もうとしているのと同じ数値だ。
この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
