
Claude Opus 5.5のリーク:「claude-wafer-eap」と呼ばれるチェックポイントと、火曜日リリースの噂
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
今週末に出回っているその主張は、検証するには十分に具体的であり、検証にかければ崩れてしまうほど薄いものでもある。次のOpusアップデート——今ではClaude Opus 5.5と名付けられている——に向けた新しいチェックポイントが、すでに手元にあると報じられており、内部コードネームは「claude-wafer-eap」、リリースは早ければ9月22日火曜日に実現する可能性があるという。情報源は、Lyraという名のリーカーを伝えるXアカウント@kimmonismusだ。モデルカードも、API識別子も、価格表も、ベンチマークもなく、同じチェックポイント文字列を報じる第二の媒体も存在しない。しかし、この主張の下にあるのは、現実的で十分に裏付けられた出来事である。Claude Opus 5.2——9月中旬まで「Opus 5」という変わらぬラベルの下で一部のトラフィックに配信されていた未リリースのOpusビルドで、ベンダーが9月17日の夜に一時的に遮断したものだ。ここまでは複数の媒体で裏付けが取れている。その上に載っているものはすべて、一つのアカウントの言葉にすぎない。そして注目に値する第三の点がある。それは、このリークがバージョン番号そのものに及ぼす影響だ。Claude Opus 5は7月24日に100万トークンあたり$5.00/$25.00で提供開始され、今なおベンダーが一般提供しているOpusの中で最上位である。Claude Fable 5.1は9月1日に登場した。次のOpusが本当に5.5であるなら、命名は5.3と5.4を飛び越えたことになる——そしてこの話において、その数字はどんなベンチマークよりも大きな役割を果たしている。
リークが実際に主張している内容
パッケージを剥がすと、4つの主張が現れる。第一に、チェックポイントが存在すること——あるモデルが訓練され、保存され、どこかでステージングされている。第二に、そのバージョン番号が5.5であり、5.2や5.3ではないこと。第三に、コードネーム「claude-wafer-eap」を帯びており、「eap」はベンダーが通常使う略記ではアーリーアクセスプログラムを意味すること。第四に、リリースが間近で、可能性としては火曜日であること。
それらはそれぞれ異なる種類の主張であり、同じようには裏付けられていない。4番目は外部の証拠に支えられているもので、その証拠が指し示すのは日付であり、コードネームではない。次のClaude Opusのリリースに関する予測市場は9月16日に開設され、そのインプライド確率の大半を9月21日から24日にかけて集中させていたが、相当な割合の出来高は依然として「9月30日までにリリースなし」を支持していた。この市場の解決ルールは狭く限定されている:モデルは一般にアクセス可能でなければならず、明示的にOpusと名付けられていなければならない。Fable、Mythos、Sonnet、Haikuのリリースは該当しない。「Claude Opus 5.5」はその市場自身の適格名称リストに載っている——この文字列が最ももっともらしく出回り始めたのはそこであり、それは可能性のリストであって、目撃情報の報告ではない。
コードネームは最も弱い環だ。「claude-wafer-eap」はシグナルテキストに現れるが、我々が確認できる限り、他にはどこにもない。リポジトリの参照も、APIスラッグも、設定の漏洩も、裏付けるアカウントもない。コードネームはまさに、検証可能に聞こえるために広まる類の詳細だ。二つ目の独立した情報源が同じ文字列を出すまで、これは未検証として扱え。同じことは「Lyra」の帰属にも当てはまる。我々が照合できる実績のない漏洩者のハンドル名だ。
実際に何が検証されるのか
検証済みのベースラインは Claude Opus 5 であり、これが異例なほど詳細に文書化されていることが、基準尺として有用である理由だ。Anthropic はこれを 2026年7月24日にリリースした——その間に 5.1 は存在しない——100万トークンのコンテキストウィンドウ、最大128K出力トークン(Batch API のベータヘッダー経由なら300K)、デフォルトで有効な適応型思考、そして low から max までの5段階の推論エフォートレベルを備えている。料金は、プロンプト長にかかわらず、入力100万トークンあたり5.00ドル、出力100万トークンあたり25.00ドルで一律であり、これは前身の Opus 4.8 と同じで、Batch API ではその半額になる。Artificial Analysis はこれを自社の Intelligence Index の首位に置いているが、正確なスコアはどのエフォート変種を見るかによって変わる——これは覚えておく価値のある細部だ。というのも、「5.5」のスコアボードは、エフォート設定が一致しない限り「5」のスコアボードとは比較できないからだ。

さらにその上に、裏付けの取れた9月の出来事がある。おおよそ9月14日から15日にかけて、開発者たちは、名目上Opus 5宛てとされたリクエストのごく一部が、確率的に別のバックエンドモデルによって応答されており、リクエストのメタデータが未リリースのclaude-opus-5.2——5.1を完全に飛ばしたバージョン番号——を指していると報告した。報告された挙動には、より簡潔な出力と、促されていない自己反復が含まれていた。つまり、コードを書き、テストを実行し、失敗を修正し、テストが通るまで繰り返すのであって、中途半端なところで止まることはなかった。それとともに広まった検出の裏技——検索とメモリを無効にした状態で、モデルが知るはずのない人物について特定の質問をする——は、どちらのバックエンドが応答したのかを見分ける方法だった。9月17日の夜、Anthropicは予告なくこのチャネルを切断し、開発者コミュニティはこの出来事を「真夜中の衝撃」と名付けた。チャネルは約1日後に復活し、それらの報告によれば、Claude Codeからチャットおよびcoworkの各サーフェスへと対象を広げた。これらいずれにも、モデルカードも、価格表も、API識別子も、公式声明も添えられなかった。
バージョン番号こそが物語だ
ここが、たとえ個々の細部がすべて間違っていても、そのリークが構造的に正しく捉えている部分だ。Anthropicは今年すでに二度、ローンチイベントなしでOpus層を反復することを示している——5月下旬の4.8、5.1を飛ばして7月24日の5、そして公開版としては存在しないまま本番環境に存在した5.2。バックエンドルーティング経由で出荷し、ロールアウト比率を制御するベンダーは、箱に印刷する数字を土壇場で決めることもできる。次のOpusが5.2ではなく5.5として発表されるなら、それは技術的な作業の後に行われたマーケティング上の決定であり、リークする者が遅く、不正確に耳にする類の決定だ。
それは、これを読む誰にとっても諸刃の剣だ。流出したバージョン番号は、能力についての証拠としては弱く、ポジショニングについての証拠としては強い。もしその番号が本当に5.5なら、それは5.2だった場合よりも大きな飛躍を意味する——そして、伝えられるところでは同社が11月に向けて前倒ししたIPOを前に、Anthropicが市場にそう受け取ってほしいと考えていることを意味する。ロイターは9月18日、3人の情報提供者を引用し、AnthropicがGPT-6 Astraのエンタープライズ分野での勢いに対抗するため専用の新モデルを投入するかどうかを検討している一方、同社の最高経営責任者は公の場で業界に減速を呼びかけていると報じた。同じチェックポイントで番号を大きくするのは、コストがかからず、見出しを手に入れられる。それはリークを信じない理由にはならない。その数字を意思決定に織り込まない理由なのだ。
火曜日には何が真でなければならないだろうか
9月22日のリリースなら、約5分で検証できるはずだ。そして、発表が——もし来るのなら——ただ飲み込まれるのではなく読み解けるよう、今のうちに検証項目を明示しておく価値がある。
• 利用可能性 — 公開されたモデルカード、コンプリーションを返すAPIのモデル識別子、または誰でも参加できる随時受付のウェイトリスト。クローズドベータは該当せず、予測市場は概ね「該当なし」として決済される。これが「出荷済み」と「一部のアカウントでテスト済み」を分ける境界線だ。
• 価格 — 新しいOpusが$5.00/$25.00の価格帯を維持するのか、変更するのか、それともプロモーション料金で登場するのか。Opus 5はOpus 4.8の価格をまったくそのまま据え置いた。これは予想されるパターンであり、だからこそ確認すべきポイントである。
• コンテキストと出力の上限 — Opus 5 の 1M コンテキストと 128K 出力(Batch では 300K)は現在の最低ラインです。それより少ない状態で登場する新しい Opus は、ローンチの衣をまとったダウングレードにほかなりません。
• 独立したスコアリング — 記載されたエフォートレベルにおける{{1}}Artificial Analysis{{/1}}のエントリーであり、ベンダーのチャートではない。リーク内のあらゆる能力に関する主張は現時点で再現されておらず、モデルカードだけではその状況は変わらない。
• ルーティング挙動 — グレーテストの報告で述べられていた、あの簡潔で自己反復的な挙動が公開ビルドでもまだ存在するのか、それともテスト上のアーティファクトだったのか。この挙動の変化は、開発者が実際に観察した最も具体的なものであり、リリース前に密かに調整されて消される可能性が最も高いものでもある。

実運用の道を賭けることなく、実績のないClaudeを試す
こうした週に生じる気まずいギャップは、誰もが評価したいモデルが、誰も呼び出せないモデルだという点にある。今日呼び出せるのは Claude Opus 5 であり、もし 5.5 が実際に登場すれば、実務上の問いは、統合を書き換えることも、独立したベンチマークのないモデルにクリティカルパスを委ねることもなく、実トラフィックの一部をどうやってそれに向けるか、ということになる。
まさにルーティングがそのために作られたケースです。OrcaRouterは現在のClaudeラインナップを、プロバイダーの定価・マークアップ0%で、1つのAPIキーの背後にまとめます — Claude Opus 5はAnthropic自身の$5.00/$25.00、ベンダーが公表しているのと同じ数字なので、ベンダーの価格変更は同期を待たずに当社側で当日から反映されます。新しいOpusが登場したとき、それは2つ目の契約ではなく、もう1つのルートにすぎません。トラフィックの一部をそちらに送り、すでに特性を把握しているモデルに自動フェイルオーバーを向けたままにして、漏洩したベンチマークではなく自分のプロンプトで出力を比較できます。複数のモデルにまたがって呼び出しを構成する — あるモデルで下書きを、別のモデルで検証パスを — のは、新しいサービスではなくルーティングDSLの1行です。

はっきり言っておくと、私たちが言っていないことについて明確にしておく。OrcaRouter 上に Claude Opus 5.5 は存在しない。ルーティングすべき Claude Opus 5.5 が存在しないからだ。Anthropic がそれを出荷するまで、私たちにそれは存在しないし、この記事は製品ページの予告ではない。この記事における 5.5 に関する内容はすべて、報告の報告である。
注目すべきこと、無視すべきこと
モデル識別子を注視せよ。機能するAPIスラッグは、正式リリースと噂の分かれ目であり、リークが長く偽装できない唯一の証拠だ。価格表を注視せよ。そこは、Anthropicがそのモデルをどのティアに属すると考えているかを教えてくれる場所だからだ。発表前にグレー・テストのルーティングが再開するかどうかを注視せよ — 再び広げられたチャネルは、ツイートよりもはるかに強いシグナルであり、9月17日の遮断と復旧は、そのチャネルが外部からどう見えるかをすでに示していた。
今のところ、コードネームは無視しよう。「claude-wafer-eap」は裏付けのない単一ソースの文字列であり、その背後にある「Lyra」という帰属も同様だ。バージョン番号は、ポジショニング以外の何かの証拠として無視しよう。そして、最初の48時間に現れる、公開された Opus 5 と、誰も独立に実行していない 5.5 を比較するスコアボードも無視しよう——私たちが作るとしても、それを含めて、比較の両側に本物の何かがあるまでは。
火曜日がリリースなしで過ぎても、それによってリークが反証されるわけではない。9月のOpus 5.2の件自体、誰も名前を付けられないままモデルが数日間本番環境に存在していた事例だった。それまでの誠実な立場は、証拠が支持するものだ。つまり、実際に未リリースのOpusビルドが1週間前に静かに提供されていたこと、実際のリリース期間が今週の市場に織り込まれていること、そして1つのアカウントが、他に誰も確認していない数字・コードネーム・日付をそれに結びつけていることだ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
