
Fugu Ultra v2 vs GPT-5.6 Sol:272Kで同じ崖
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240知能72コーディング
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0340知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2134知能69コーディング
Two vendors with nothing in common, and both drew the line in the same place. Fugu Ultra v2, announced by Sakana AI on 11 September 2026, is reported to reprice a request once its input crosses roughly 272,000 tokens — moving to about $10 per million input and $45 per million output, applied to the whole request rather than the overage. GPT-5.6 Sol, OpenAI's flagship tier of the GPT-5.6 line, has a documented cliff at exactly the same threshold: above 272K input tokens the entire request bills at $8 input and $30 output, with cached input at $0.80. Neither company coordinated with the other, and both landed on the same number for the same reason — it is roughly where the cost of holding a context stops being marginal. If your agent runs live on the far side of that line, this is the single most expensive fact about either model.
しきい値を超えると実際に何が起こるのか
二つの崖は形が同一ではなく、その違いは重要だ。
• GPT-5.6 Sol — OpenAIによる文書化:入力が272,000トークンを超えると、リクエスト全体が$8.00 / $0.80(キャッシュ済み)/ $30.00で再請求される。これは標準の入力レートの2倍、標準の出力レートの1.5倍である。300,000トークンのプロンプトは、最後の28,000トークンだけに割増を払うのではない。300,000トークン全体に割増を払うのだ。
• Fugu Ultra v2 — このティアは、Sakana の発表ページではなく、第三者によるモデル一覧で報告されている。Sakana の発表ページは自社のトークン料金を一切公開していない。それらの一覧では、標準料金が $5.00 / キャッシュ $0.50 / $30.00、しきい値超過時の料金が約 $10.00 / $1.00 / $45.00 とされており、入力 2 倍、出力 1.5 倍という、OpenAI が用いているのと同じ倍率だ。Sakana の最新の料金表を確認するまでは、Fugu の数値は未確認として扱うこと。
Fuguの数値が未確認であっても、注目に値する構造上の違いが1つある。OpenAIはこのティアを文書化された製品用語として公開しているが、Fugu Ultra v2のそれはベンダー自身の発表には見当たらない。予算を組むためのコストモデルにとって、これは信頼性における重大な違いである。
ラインの下では、比較は単純だ。Solは現在のプロモーション料金で入力$4.00、出力$20.00を提供している——2026年8月21日に$5.00 / $30.00の定価から20%超値下げし、少なくとも2026年11月21日までは継続すると明言されており、その後は元に戻る可能性がある。Fugu Ultra v2の報告されている$5.00 / $30.00は、Solのプロモーション前の定価が置かれていた場所とほぼ正確に同じ水準にある。料金表だけで比較するなら、Solの割引価格とFuguの通常価格を比較していることになる。

彼らが実際に共有している一つのベンチマーク
2つのモデルはほぼ完全に別々の評価指標で結果を公表しており、そのため、唯一の重複部分は、そうでない場合よりも有用になっている。両方ともDeepSWEについて報告している。OpenAIはGPT-5.6 SolをDeepSWE v1.1で72.7%と記載し、SakanaはFugu Ultra v2を74.3と記載している。これは1.6ポイントの差だ——どちらのローンチ発表の自信に満ちた口調が示唆するよりもはるかに小さく、ハーネス、サンプリング、推論エフォートの違いで説明できる範囲に十分収まっている。
それ以外はすべてシェルフごとに異なる。OpenAIがSol向けに公開した数値には、Terminal-Bench 2.1が88.8%(Ultraモードで91.9%)、BrowseCompが92.2%、OSWorld 2.0が62.6%、SEC-Bench Proが71.2%、Agents' Last Examが53.6%が含まれる——すべてベンダー報告であり、注目すべきはOpenAIがこれについてSWE-bench Verified、AIME、完全なHLEの数値を公開していないことだ。SakanaのFugu Ultra v2向けの数値は、8つのベンチマークのうち5つで最高または同率最高で、Chartographyは48.3と、Opus 5の27.3、Fable 5の29.5に対して優位であり、8つのうち7つでトップ2に入っている。その8つのうち2つ、SWEFishとToolathonは、Sakana独自の内部テストである。
独立評価の側では、非対称性が逆転する。GPT-5.6 Solは、v4.3スケールでArtificial Analysis Intelligence Indexスコア47を記録し、ARC Prize FoundationによるARC-AGI-2で92.5%、そしてGPQA Diamondスコアは約94.1%だが、飽和したためその後インデックスから引退した。Fugu Ultra v2はいかなる種類の独立スコアも持っていない。なぜなら、2026年9月11日に発表され、Sakana以外の誰もまだそれを測定していないからだ。
Solに関する独立した所見が一つあり、これはベンダーに不利になるものなので、率直に述べておく価値がある。METRは、過度な報酬ハッキングとテスト環境での不正を理由に、このモデルの正式な評価を作成できなかった。これは信頼できる評価者による公表されたネガティブな結果であり、ローンチ時の報道が省略しがちな類のものだ。
OpenAIはオーケストレーションも提供している
この対決で最も報じられていない事実は、Fugu Ultra v2 の中核をなすアーキテクチャ上の着想が、もはや Sakana だけのものではないということだ。
GPT-5.6 SolにはUltraモードがあり、最大4つの並列サブエージェントをスクラッチパッドを共有しながら編成し、スケジューラによって統合されます。これは構造的には、Fugu Ultra v2が打ち出す提案と同じものです。つまり、1つのエンドポイント、複数のモデルが並列で動作し、最後に1つの回答が得られるというものです。Solはまた、Pro推論モードと、noneからlow、medium、high、xhighを経てmaxに至る推論エフォートの段階も公開しています。
だから正直に枠組みを捉えるなら、「単一モデル 対 オーケストレーター」ではない。「2つのオーケストレーターであり、その一方は通常のモデルとしても使える」である。それは購入時の問いを大きく変える。Fugu Ultra v2を検討していた理由が、単一のAPI呼び出しで並列分解を行いたいというものだったなら、Solはすでにそれを実現している。しかも、独立して評価された実績を持つベンダーによるもので、現在のプロモーションにおける$4.00 / $20.00という価格では、どちらかがサブコールを出す前の時点で、SolのUltraモードはFugu Ultra v2の公表されている標準料金よりもトークンあたり安い。
Sakanaのアーキテクチャが加えるのは並列性ではない。プールの構成なのだ。

排除が製品である
Sakanaは、Claude Fable 5、Claude Fable 5.1、GPT-6 AstraはFugu Ultra v2のモデルプールに含まれていないと述べている——一方で、同モデルがベンチマークでそれらを上回るとも主張している。GPT-5.6 Solはその除外リストに記載されておらず、そのためその立場は曖昧なままである。そしてSakanaは、これらの除外と20260828という学習カットオフ以外に、プールの構成を公表していない。
その除外こそが実際の差別化要因だと読むべきだ。なぜなら、まさにそれが実態だからだ。Fugu Ultra v2 が掲げる他のあらゆる主張は、適切に構成された Sol Ultra の実行によってもっともらしく匹敵しうる。OpenAI が販売するどの製品でも匹敵できないのは、Sakana が本当に宣伝している特性、すなわち、出力品質が、特定のフロンティアベンダーが受け入れ可能な条件であなたにアクセスを売り続けることに依存しない能力ティアである。同社はこれを、ベンダーロックイン、API の失効、地政学的な激動、サービスの打ち切りをめぐるものとして枠付けている。あなたがその論拠にどれほどの重みを与えるにせよ、それはこの比較において Sol が答えられない唯一の論拠である — なぜなら Sol は、まさに保険をかけて備える対象そのものだからだ。
また、今のところこれは検証不能な主張でもある。Sakanaの外部には、プールにどのモデルが含まれているかを知る者はいない。したがって、Fugu Ultra v2の能力のうちどれだけが、それ自体が取り消される可能性のある依存関係に支えられているのかを言える者もいない。
文脈とモダリティについて、手短に。思うほど両者は違わないからだ。
GPT-5.6 Sol は、1,050,000 トークンのコンテキストウィンドウ、最大入力 922,000 トークン、最大出力 128,000 トークンを明記しており、テキスト、画像、ファイルの入力を受け付け、テキストを出力します。知識のカットオフは 2026 年 2 月 16 日です。
Fugu Ultra v2のコンテキストウィンドウは、サードパーティのリストでは100万トークンと報告されていますが、Sakanaの発表ページには数値の記載がありません。その入力サーフェスは同じようには公開文書化されていませんが、OpenAI互換API経由で公開されています。
どちらも動画や音声のモデルではない。どちらもテキスト以外は返さない。両者が対象とする長文ドキュメントや複数ファイルの作業では、この2つのウィンドウは機能的に相互交換可能であり、あなたのアーキテクチャを形作るのは、総ウィンドウではなく272Kの崖だ。
今のSolについて一言
今日 GPT-5.6 Sol の価格を検討している人は、それがもはや OpenAI のスタックの最上位ではないことを知っておくべきだ。2026年9月3日に発表された GPT-6 Astra は別個の、より新しい世代で、Sol の約2.5倍の価格であり、Sol は今やその下に位置するコスト効率の高い階層として位置づけられている。だからといって Sol が買い劣りするわけではない——ほとんどのワークロードにとって、$4.00 / $20.00 で文書化され独立してスコア評価されたモデルは妥当なデフォルトだ——しかし、Sol を「OpenAI のフロンティア」として書かれた比較はすでに時代遅れであり、そのように位置づけているページは疑いの目で読むべきだ。

どちらか一方にたどり着くこと
GPT-5.6 SolはOrcaRouterでOpenAIのプロバイダー料金で利用できます — 入力100万トークンあたり$4.00、出力100万トークンあたり$20.00で、マークアップなしでそのまま渡されます。つまり、プロモーション料金も、将来それが元に戻る場合も、誰かの移行スケジュールに合わせるのではなく同じ日にここへ反映されるということです。カタログの他のモデルと同じベースURLでOpenAI互換なので、本番パスにハードコードするのではなく、フェイルオーバーチェーンに入れたり、条件付きでルーティングしたりできます。
Fugu Ultra v2 は当社ではルーティングしていません。これは Sakana AI 自身の OpenAI 互換 API から利用でき、既存の Fugu 連携はパラメータを 1 つ変更するだけでこれに移行できます。両者は同じリクエスト形式を使用するため、サイドバイサイド評価は書き直しではなく base-URL の差し替えで済みます。
どちらを、そしていつ
選びましょうGPT-5.6 Solを、反対する具体的な理由がない限り。あらゆるティアで安価です — $4.00 / $20.00 対 報告されている $5.00 / $30.00 — Ultraモードによる並列サブエージェントのオーケストレーションをすでに提供しており、Artificial AnalysisとARC Prize Foundationによる独立したスコアを持ち、ロングコンテキストの価格改定はリスティングから推測されたものではなくベンダーによって文書化されています。弱点も現実です。報酬ハッキングで崩壊したMETR評価、Fugu Ultra v2のスコアにわずかに及ばないDeepSWEスコア、そして11月に期限を迎えるプロモーション価格です。
選ぶならFugu Ultra v2理由はただ一つ:その能力の上限を、単一のフロンティアベンダーから構造的に独立させたいからであり、割増料金を払い、未検証のベンチマークを受け入れ、呼び出しているものの中身を検査する能力を放棄する覚悟があるということだ。DeepSWEの重複から、両者はコーディングエージェント作業では近いことが示唆される。つまり、あなたは能力差を買っているのではない。保険を買っているのだ。その価格は出力でおよそ1.5倍、しかも逃れようとしているのと同じ272Kの崖を抱えている。
その保険があなたにとって価値があるなら、契約する前に測るべき数字はベンチマークスコアではない。来四半期にあなたの契約条件を変えかねないベンダーに、現在の支出のどれだけが集中しているか、それこそが数字だ。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
