
Claude Opus 5.5のデモは3~26ドル:ビルド初期の数日をどう読み解くか
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 495 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 186 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
最初の1週間のClaude Opus 5.5に関する2つの数字は、同じモデルを指しているのに桁が1つ食い違っている。ある開発者は、完成したインタラクティブなレンズラボ —— フォーカスリングをドラッグすると、光るピント面が谷を掃引していくページ —— を$25.66の API 支出と実時間1時間26分で作り上げたと報告している。ローンチデモをまとめた広く共有された記事は、花火と湖面の反射まで備えた手続き的に生成された Blender の城のアニメーションを$13.30と35分と見積もっている。r/ClaudeAI のトップページに載ったスレッドは $3.21 だと言う。ベンダーはClaude Opus 5.5を2026年9月22日に投入し、入力100万トークンあたり $4、出力100万トークンあたり $20 という価格を設定している。そしてこれらの3つの数字はどれも間違っていない。それぞれ別のものを測っているのであり、それを前提に予算を立てるなら、どれが何を測っているのかを知っておく必要がある。
そのギャップはノイズではない。それは、エージェント実行が生み出すものと、それが消費するものとの差であり、過去4日間は、それについてほとんど説明がないまま、後者を驚くほど大量に生み出してきた。そこで、デモと並べて誰も投稿しなかった計算をここに示す。次に、実際に料金表に載っていて確認できるローンチの部分だ。
$25.66で実際に買えたもの
高額な側こそが最も有用な側だ。なぜなら、ビルダーは成果物と請求書の両方を公開しているからである。
Ryan Saelのレンズラボ「The Plane of Focus」は、1つのプロンプトから1回のセッションで作られた単一のインタラクティブページです。画面にカメラレンズを表示し、フォーカスリングをドラッグできるようにして、写真家なら誰でも知っているのにほとんど誰も見たことがないもの、つまり写真が実際にピントの合う現実世界の薄い面を見せてくれます。リングを回すと面が動き、ガラス素子が鏡筒内を前後にスライドしてその理由を示し、コンソールには距離、絞り、合焦ゾーンが表示されます — ページを開いたときの設定では60 cm、f/2、被写界深度1.9 cmです。絞りをf/2からf/16まで絞ると、光の円錐が狭くなるにつれて合焦ゾーンが広がります。分解表示ではガラスが分離されます。パイプラインのどこにも画像モデルはなく、ダウンロードされたアセットもありません。すべての要素はコードで描画され、アニメーション化されています。だからこそ、錯乱円の実演全体が図ではなくライブシミュレーションなのです。
それは本当に優れた解説記事で、それに付随する主張は異例なほど具体的だ。ワンショット、1時間26分、API使用額25.66ドル、そして私が読んだ時点でそのページはlens.lab.sael.netで公開されていた。この数字は自己申告で検証不能だが、同時に、割るべきセッション長が付いている、世に出回っている唯一のデモコストでもある。
料金表で計算してみよう。Claude Opus 5.5の公表レートは入力100万トークンあたり$4、出力100万トークンあたり$20なので、$25.66は構成比に応じて128万トークンから640万トークンの間に収まる——すべて入力なら上限側、すべて出力なら下限側だ。このようなエージェント型ビルドは中間あたりに位置するが、下限側に寄る理由は、多くの人が見落とす料金項目にある。Claude Opus 5.5のキャッシュ読み取りは100万トークンあたり$0.20で、入力レートの40分の1だ。だから、同じ増え続けるコードベースを何度も読み直す長いセッションでも、そのトラフィックにはほとんど支払わない。キャッシュされた入力1000万トークンで$2だ。出力側こそ、モデルがコードを書き、考え、書き直す1時間半で積み上がる部分だ。100万トークンあたり$20なら、出力100万トークンは$20であり、思考トークンも出力として課金される。Saelの数字は、大量で安価なキャッシュ済み入力側に対して、およそ100万出力トークンを生み出した実行と整合する——まさに、無人で86分間のビルドがそう見えるものだ。
ここから2つのことが導かれる。第一に、ローンチ当日に注目を集めた表示価格の値下げ、$5/$25から$4/$20への変更は、トークンあたり20%の変化であり、それ単独でこの実行を安くしたわけではない。90分のループを手頃なものにしたのは、キャッシュ読み取りの$0.50から$0.20への値下げのほうだ。第二に、あまり心地よくはない話だが、$25.66のレポートには、この実行がうまくいったかどうかを教えてくれるものは何もない。うまく実行された一発勝負と、1時間半もがき続けてからようやく成功したセッションは、同じ請求額を生み出す。
$13.30という数字は、それ自体の計算に耐えられない
その範囲の中間は、別の理由で示唆に富む。9月23日に公開されたローンチデモのまとめは、Claude Opus 5.5が1つのプロンプトから10秒のBlenderアニメーション——城、湖の反射、花火——を手動編集なしで手続き的に構築するよう求められた、GPT-6 Astraとの直接対決を報告しており、Claude Opus 5.5については35分と199,600出力トークンで約13.30ドル、GPT-6 Astraについては28分と約14.50ドルだったと報告している。興味深いのはトークン数だ。というのも、それは価格と整合しないからである。
199,600出力トークンをClaude Opus 5.5の100万あたり$20で計算すると$3.99であり、$13.30ではない。出力だけで$13.30に到達するには665,000トークン必要になる。足りない金額は他の列にある。入力が100万あたり$4、キャッシュ書き込みが5分のブレークポイントで100万あたり$5、1時間で100万あたり$8、そしてあらゆる再試行だ。これはレポートの矛盾ではない — 一つのものを数えるトークン数と、四つのものを数える請求額について、レポートが正直であるということだ。これはローンチ週のコスト談義で最もよくある混乱である。公開デモから一つの数字を取るなら、ドル額を取り、その横のトークン数はその実行の部分的な説明として扱うこと。
低コスト側では、会計はさらに薄くなる。完成したビルドに対して $3.21 分の API 利用を報告している r/ClaudeAI のスレッドは、この手の典型だ。タイトル、動画、そして内訳なし。もっともらしいのは、より短いセッション、より小さな成果物、あるいは大量のキャッシュ済み入力だ。これをもとに予算を立てるべきではないし、その1ドルたりとも私には検証できなかった。
なぜこれらの数の一つ一つが下界なのか
ここでの失敗の様態は、作り手が本心を隠すことではない。選別だ。出回っているデモはうまくいったものだけであり、それが役立った人たちによって公開されている。そして、壊れたページを生み出した4回の試行にも、そうならなかった1回と同じコストがかかっている。Blender比較をまとめたラウンドアップは、このことをずばり言っている——誰も失敗は投稿しない、と——そして、それ自身の最も詳細な項目がまさに好例だ。ある腕時計ブランドのサイトは要件を外し、最初のパスでは読めないフォントを使い、2回目を経てようやく公開された版になった。
「ワンショット」はその語彙の中でも静かに効いている。それは単一のセッションを指し、単一の試行を指すものではない。そしてセッションには、モデルが生成できる限りの自己修正が含まれていてかまわない——86分の実行では、それはかなりの量になる。モデルが1つのコンテキストウィンドウ内で自分のコードを2回書き直すのは、1回のワンショットであり、2回の試行だ。
したがって、最初の4日間を正直に読めば、証拠は3つの層に分かれており、それらを平均してはならない:
• セッション長を伴う自己申告コスト — 桁感をつかむには使えるが、検証不能。Sael の 1時間26分での $25.66 が、この階層で最も有力な項目です。
• トークン数を伴う自己申告コスト — $13.30 の数字が示すように、多くの場合、内部的に不整合である。
• 何の裏付けもないドル金額 — 誰かが何かを作ったというシグナルにすぎず、それ以上ではない。
ローンチのうちレートカードに記載されている部分
デモの主張を剥ぎ取れば、検証可能な姿は狭く明確だ。以下の数値はすべて、Anthropicが公表した料金であり、2026年9月25日の同社自身のモデルドキュメントと発表から読み取ったものである:
• 入力 — 100万トークンあたり$4。出力 — 100万トークンあたり$20で、思考トークンは出力として課金され、Claude Opus 5.5の適応的思考は常にオンで切り替え不可。
• キャッシュ — 100万トークンあたり$0.20、乗数は0.05x。キャッシュ書き込み — 5分のブレークポイントでは100万トークンあたり$5、1時間では100万トークンあたり$8。Batch API — 入出力ともに50%オフで、$2と$10。
• 高速モード — 入力$8、出力$40(100万トークンあたり)、速度は最大2倍、そしてAnthropicは依然としてこれを研究プレビューと呼んでいる。
• エンベロープ — 1Mトークンのコンテキスト、同期で128K出力トークン、ベータヘッダー付きBatch APIでは300K、信頼できる知識は2026年6月時点、エフォートはClaude Opus 5がデフォルトとしていたhighではなくmedium。
• 提供状況 — Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、およびClaude Platform on AWS。退役は2027年9月22日より前には行わないと確約。
ベンダー自身による性能主張(主張として明示): Claude Opus 5.5はほとんどの作業でClaude Fable 5.1と同水準の性能を発揮し、実行コストはClaude Opus 5より約40%低く、出力生成速度は30%以上速い。この40%はベンダーが選んだワークロード平均であり、料金表の数値ではない。両者を同じ種類の事実であるかのように引用してはならない。
独立したチェックはベンダー表より小規模で、同じ方向をより小さな差で指している。Artificial Analysis は、その Intelligence Index で Claude Opus 5.5 を 57.6 と評価し、モデルページに掲載されている数値では、Humanity's Last Exam で 61.4、SciCode で 66.9、長文脈リコールで 84.7 としている。同じ媒体のコーディングエージェント測定では、トークンあたりのコストではなくタスクあたりのコストが報告されており、数字は逆方向に動く。最大エフォート時には、タスクあたりのコストは約 $13.04 に上昇し、同じハーネスでの Claude Opus 5 の $10.79 と対比される。モデルがより多く消費する安価なトークンは、安価なタスクではない。これは、デモの請求書が教えているのと同じ教訓が、第三者から届いたものだ。
2週目に違うやり方で取り組むこと
$25.66 という数字がこれを試してみたくなったきっかけなら、役に立つのは $25.66 を予算に入れることではなく、自分自身の実行で説明できる数字を出すことです。
effort はデフォルトを受け入れるのではなく明示的に設定してください。タスクあたりのトークン数を左右するのは、モデル選択よりもこのダイヤルのほうが大きいからです。そして、このモデルではデフォルトが Claude Opus 5 から変わっています。安定したプレフィックスは意図的にキャッシュしてください。Claude Opus 5.5 でキャッシュ可能な最小プロンプトは 1,024 から 512 トークンに下がったため、以前はキャッシュされなかった短い共有プレフィックスも今ではキャッシュされます。長時間実行されるジョブには max_tokens の余裕を確保してください。thinking はその予算の一部であり、もうオフにできないからです。Anthropic 自身の移行ガイダンスでは、最高の effort レベルでの作業では 64K から始めて、そこから調整することを推奨しています。また、実行の計測は開始時ではなく終了時に行ってください。すべてのレスポンスでトップレベルの model フィールドを読み取ってください。Anthropic の分類器がフラグを立てたプロンプトでは、Anthropic が同じ呼び出し内でリクエストを再ルーティングするため、送信したモデル文字列は実際に応答したモデルを表しません。
その最後の点こそ、ルーターが単なる便利ツールでなくなる瞬間です。セーフガード境界を越えて1時間半にわたって無人で走り続けたビルドが、戻ってきたときには気づかないうちにいくつかのターンをより小さなモデルで処理し終えている、ということが起こり得ます。そしてそれを知る唯一の方法は、実際に見て確認することです。Claude Opus 5.5 はOrcaRouter で Anthropic 自身の定価、マークアップ 0% で提供されています — プロバイダーの料金がそのまま渡されるため、ベンダーの価格変更は公開されたその日にここでも反映されます — これはここでのルーティングが行うことの中で最も面白みのない部分です。面白いのは、200 以上のモデルに対応する単一の APIによって実験全体が 1 つのキーに乗るため、「フロンティアモデルで実行し、失敗させるのではなくフォールバックする」が、2 つ目の契約と書き直しではなく設定 1 行で済むことです。自動フェイルオーバーこそが、馴染みのないモデルを、あなたが重視するパスに安全に載せられるようにするものであり、回避できる拒否は、70 分の時点であなたの実行を終わらせない拒否なのです。
次に動く数字
Anthropicは、Claude Sonnet 5.5とClaude Haiku 5.5が「今後数週間のうちに」登場すると述べており、それによってこれらのデモはどれも、形を変えることなく価格が再設定されることになる。つまり、誰にも事前に予測できないトークン数に対して、より安いトークン単価が適用されるということだ。最初の週の数字を使い物にならなくしたのと同じ不確実性が、次世代の数字にも当てはまる。だからこそ、値下げが再び実施されてからではなく、今のうちに習慣を身につけておくべきなのだ。
現時点で、正直な要約は短い。Claude Opus 5.5 は実在し、一般提供されており、価格は $4 と $20、キャッシュ読み取りはこの系統がこれまで提供してきた中で最安だ。最初の4日間に生成されたデモは目覚ましく、その価格表示は逸話にすぎない。自分のワークロードのコストを知りたいなら、それを読み取れる唯一の計器は、上限を設定した自分の実行であり、後から請求書を読むことだ。



この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
