
Fugu Max 対 GPT-5.6 Sol:価格に関する主張はファミリーの中間層を狙ったものだった
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240知能72コーディング
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0340知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2134知能69コーディング
Fugu Max's price justification names a GPT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same OpenAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.
主張をそれが指し示すファミリーと照らし合わせて確認する
Sakanaの40〜60パーセントという数字は検証可能だ。それが名指しするモデルには公表された料金があるからだ。GPT-5.6 Terraは100万トークンあたり入力$2.00、出力$12.00で掲載されている。Fugu Maxは入力$2.00、出力$6.00で掲載されている。比較を実行すると、2つのことが浮かび上がる。出力では、$6.00対$12.00はちょうど50パーセントの削減であり、提示された40〜60の幅のまさに中心だ。これは、その幅がこの比較を中心に描かれたのであって、そこから発見されたものではないことの兆候だ。入力では、両者の料金は1セントの違いもなく同一だ。
That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the GPT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.
• 入力価格 — Fugu Max は100万トークンあたり2.00ドル、GPT-5.6 Sol は100万トークンあたり4.00ドル
• 出力価格 — Fugu Max は100万トークンあたり$6.00、GPT-5.6 Sol は100万トークンあたり$20.00
• キャッシュされた入力 — Fugu Max は100万トークンあたり$0.25、GPT-5.6 Sol のキャッシュは基本入力レートに対する割引として価格設定
• コンテキスト — Fugu Max は未公開、GPT-5.6 Sol は100万トークン
• 出力上限 — Fugu Max は非公開、GPT-5.6 Sol は128Kトークン
• 入力モダリティ — Fugu Max は未公開 vs GPT-5.6 Sol のテキスト、画像、ファイル
• 機能タグ — Fugu Max は公開なし 対 GPT-5.6 Sol は vision、tool use、JSON mode、reasoning
• エンドポイント — Fugu Max の1つの OpenAI 互換サーフェス 対 GPT-5.6 Sol のチャット補完と Responses API
• ベンチマーク数値 — Fugu Maxの6勝はスコアなしの主張である一方、GPT-5.6 SolはTerminal-Bench 2.0で91.9%、SWE-bench Proで64.6%を含むベンダー公表値を公開している
なぜ中間の段こそ名指しするのに適した段なのか
Sakanaの選択には擁護できる版があり、それは批判の前に述べておく価値がある。各タスクを、能力を満たす中で最も軽量なモデルにルーティングするオーケストレーターは、フラッグシップの仕事でフラッグシップと競合しているのではない。それはミッドティアの仕事でミッドティアモデルと競合しており、その一部をより安く行うと申し出ているのだ。もし売り文句が「あなたのトラフィックの大半はSolを必要としない」というものなら、Terraが正しい比較対象である。なぜなら、Solの価格を払いたくないときにほとんどのチームが実際に手を伸ばすのはTerraだからだ。顧客がそうでなければ買うであろうティアと比較して測ることは、利用可能な中で最も高価なモデルと比較して測るよりも誠実である。
困難なのは、同じ文が「エリートモデルの射程圏内」の性能も主張していることだ。そのピッチの二つの半面は、相反する方向に引っ張り合っている。もしFugu MaxがTerraの代替品なら、エリートモデルという枠組みは、それが支えられないマーケティング上の役割を果たしていることになる。なぜならTerraは、明示的にエリートとして位置づけられているわけではなく、「これで十分」な層として位置づけられているからだ。もしFugu Maxが本当にSolの射程圏内にいるなら、価格比較はSolに対して行われるべきだった。そこでは隔たりが最も大きく、最も有利に見えるからだ。同じ段落で攻めの能力主張と保守的な価格比較を並べる発表は、いいとこ取りをしているのであり、読者にはどちらの半面が実際に主張を支えているのか知る術がない。

6つのベンチマーク、数字は一切なし、そして疑問を抱くべき1つの名前
売り込みの能力面の半分は、あるリストに依拠している。Fugu MaxはTerminal Bench 2.1、GPQAD、AA-LCR、GDP.pdf、AutomationBench、SWEFishで「総合最高スコアを達成」している。しかし、そのいずれについてもスコアは記載されていない。SWEFishはSakana自身の社内コーディングベンチマークであり、つまり6つの勝利のうち1つは、ベンダーが作成し、まだ公開していないテストでスコア付けされていることになる。
GPT-5.6 Sol が数値を報告している。第三者の比較データでは、Sol は Terminal-Bench 2.0 で 91.9%、SWE-bench Pro で 64.6% と記載されている。ターミナルベンチマークにおけるバージョンの不一致に注意が必要だ。Sol の公表値は Terminal-Bench 2.0 のものであり、Sakana は 2.1 での勝利を主張しているが、これは別の評価であり、それと対置することはできない。見出しでは両者の主張が隣り合って見えるものの、実際には比較できないため、これは指摘する価値がある。
この対戦に関して適切な比較となるのは、共通の評価上でSolをFuguモデルと比べたものだろう。第三者による比較ページには、GPT-5.6 SolをベースのSakana Fugu世代と比較したものは確かにある——SolがTerminal-Bench 2.0では91.9%対80.2%、SWE-bench Proでは64.6%対59%で先行している——が、それらはFugu Maxではなく、より前の世代の数値であり、同じ情報源も、共通ベンチマークの網羅範囲が薄すぎるとして、総合的な勝者を明言することを明確に避けている。Fugu MaxとGPT-5.6 Solの間には、いかなる種類の公表された比較も存在しない。存在すると主張する者は、外挿しているにすぎない。
Fugu Maxを評価した独立した第三者機関はなく、Fugu Maxについても、いかなるFuguモデルについてもArtificial Analysisの項目は存在しない。発表資料に含まれるあらゆる数字は、6つの勝利を含め、すべてベンダーに由来する。これに対しSolは、2026年7月9日から一般提供されており、サードパーティのリーダーボードにも掲載されている。これは、Fugu Maxがまだ受ける機会のなかった外部からの精査の水準である。
それぞれの側で実際にあなたが買っているもの
GPT-5.6 Sol の設定は既知のものです。1M トークンのコンテキストウィンドウ、128K の出力上限、テキスト・画像・ファイル入力、ビジョン、ツール使用、JSON モード、推論が文書化された機能として備わり、2 つのエンドポイント — chat completions と responses API — があるため、既存の統合にも移行先があります。当社が処理するトラフィック全体で、p50 の初回トークンまでの時間は 6.68 秒です。これは当社のカタログ内で最速のモデルより遅く、これを使ってインタラクティブな製品を構築する前に知っておく価値があります。
Fugu Max の構成は、モデルを買うというよりサービスレベルを買うことに近い。OpenAI 互換のエンドポイントが 1 つ手に入り、以前の Fugu からそれへ移行するには 1 行のパラメータ変更で済み、どのモデルを呼び出すかを決めるコーディネーターも得られる。一方、リリースページからは得られないものがある。コンテキストウィンドウ、出力上限、モダリティ一覧、レイテンシ値、ベンチマークスコアだ。コーディネーターのルーティング判断は、設計上公開されていない。今回のリリースでプールは拡大し、オープンウェイトモデルや特化型モデルを含むようになった。NVIDIA との協業を通じて名前が挙がっている NVIDIA Nemotron ファミリーも含まれるが、それ以外は非公開だ。
Sakanaがその不透明さについて示した根拠は擁護できる——交換可能なベンダー非依存のプールは、非推奨化や価格変更、地域からの撤退に対する防御になる。それは実際のヘッジであり、$0.25のキャッシュ入力レートは、Sakanaがそのヘッジを最も必要とする長文脈・高反復のワークロードを想定していることを示唆している。しかし、それはあなたが購入している仕様が製品の説明ではなく、サプライチェーンに関する約束であることを意味する。

テストの実行方法
これを決着させる正しい方法は、どちらかのベンダーのページを読むことではない。自分のトラフィックのサンプルを取る — 数百件の実際のリクエスト、理想的にはチームが現在エスカレーションしているものも含めて — そしてトークン計測をオンにして両方のエンドポイントに対して実行する。コストは呼び出しあたりのトークンではなく、完了したタスクあたりのトークンで算出し、開始前に出力予算を設定して、ファンアウトで不意を突かれないようにする。そして品質は、別の人がその回答を許容できると同意するかどうかで測る。その実験は1週間で問いに答えを出し、ほとんどコストもかからない。
The friction is that Fugu Max is not on OrcaRouter. It reaches you through Sakana's own OpenAI-compatible API and several third-party platforms, which means a second integration, a second credential set and a second invoice. GPT-5.6 Sol is on our catalogue at OpenAI's list price with 0% markup — the provider's rate passed through rather than marked up, so a change to OpenAI's pricing is live on your existing key the same day, with automatic failover across provider paths when one is rate-limited or unavailable. It sits behind the same key as more than 200 other models, so when the pilot ends you keep the integration and change one string.
結論
GPT-5.6 Solは、Sakanaが描くことを拒んだ比較で勝利を収める。入力コストは2倍、出力コストは3倍以上かかる。その代わりに得られるのは、公開されたコンテキストウィンドウ、128Kの出力上限、文書化されたマルチモーダル入力、名前付きのケイパビリティタグ、2つのエンドポイント、そして第三者が何か月も検証してこられたベンダーによるベンチマークだ。あなたの仕事がSolの想定する種類のもの——深い多段推論、大規模ソフトウェアエンジニアリング、長期的なエージェントタスク——であるなら、価格差は、仕様を明示できるものを買うためのコストだ。
Fugu Max は、より対象を絞った、それでいて実に興味深い賭けを制しており、しかも価格は圧倒的に安い方だ。出力では GPT-5.6 Terra より50パーセント低く、Sol より70パーセント低く、どちらの料金表でも最も低いキャッシュ料率を備えている。あなたのトラフィックが大量で、テキストのみで、検証可能で、その大半がフラッグシップ級の推論を必要としないなら、十分な性能を持つ中で最も軽量なモデルへルーティングするオーケストレーターは首尾一貫した設計であり、$6.00 という出力料金にこそ価値がある。このリリース自身の位置づけを額面どおりに受け止め、Sol の代替ではなく Terra の代替として試験導入しよう。そして、プロバイダーの定価がそのまま何も変わらずに適用されるフラッグシップを望むなら、OrcaRouter では GPT-5.6 Sol まであとキー1つだ。

この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
