Una card del titolo principale per "Fugu Max vs GPT-5.6 Sol" con il sottotitolo "L'affermazione sul prezzo era rivolta alla fascia media della famiglia", tre badge a pillola che recitano "$6.00 vs $20.00 in output", "affermazione del 40-60% vs Terra", "Sei vittorie, nessun punteggio", una riga di piè di pagina che recita "Sakana AI vs OpenAI - settembre 2026", e il logo OrcaRouter nell'angolo in basso a destra.
Guides & Insights

Fugu Max vs GPT-5.6 Sol: l'affermazione sul prezzo era mirata alla fascia media della famiglia

Autore

Magnus Corvin

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Fugu Max's price justification names a G​PT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same Ope​nAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.

Verificando l'affermazione rispetto alla famiglia a cui fa riferimento

La cifra del 40-60 percento di Sakana è verificabile, perché il modello che nomina ha una tariffa pubblicata. GPT-5.6 Terra ha un prezzo di listino di $2,00 per l'input e $12,00 per l'output per milione di token. Fugu Max ha un prezzo di listino di $2,00 per l'input e $6,00 per l'output. Esegui il confronto e saltano fuori due cose. Sull'output, $6,00 contro $12,00 è un taglio esattamente del 50 percento — proprio al centro della finestra dichiarata del 40-60, il che è un segno che la finestra è stata tracciata attorno a questo confronto anziché ricavata da esso. Sull'input, le due tariffe sono identiche al centesimo.

That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the G​PT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.

• Prezzo di input — Fugu Max 2,00 $ per 1 milione di token rispetto a GPT-5.6 Sol 4,00 $ per 1 milione di token

• Prezzo dell'output — Fugu Max 6,00 $ per 1M token vs GPT-5.6 Sol 20,00 $ per 1M token

• Input in cache — Fugu Max 0,25 $ per 1 milione di token rispetto al caching di GPT-5.6 Sol, prezzato come sconto sulla tariffa di input di base

• Contesto — Fugu Max non pubblicato vs GPT-5.6 Sol 1M token

• Limite di output — Fugu Max non pubblicato vs GPT-5.6 Sol 128K token

• Modalità di input — Fugu Max non pubblicata vs GPT-5.6 Sol testo, immagine e file

• Tag di capacità — Fugu Max nessuno pubblicato vs GPT-5.6 Sol visione, uso degli strumenti, modalità JSON, ragionamento

• Endpoint — Fugu Max: un'unica superficie compatibile con OpenAI vs GPT-5.6 Sol chat completions e la responses API

• Dati di benchmark — sei vittorie dichiarate per Fugu Max senza punteggi rispetto ai dati pubblicati dal fornitore per GPT-5.6 Sol, inclusi Terminal-Bench 2.0 al 91,9% e SWE-bench Pro al 64,6%

Perché il gradino di mezzo è il gradino giusto da nominare

Esiste una versione difendibile della scelta di Sakana, e merita di essere esposta prima delle critiche. Un orchestratore che instrada ogni attività verso il modello più snello in grado di svolgerla non compete con un flagship sui compiti da flagship. Compete con un modello di fascia media su lavori di fascia media, e offre di svolgerne un sottoinsieme a un costo inferiore. Se la proposta è «la maggior parte del vostro traffico non ha bisogno di Sol», allora Terra è il termine di paragone corretto, perché Terra è ciò a cui la maggior parte dei team ricorre effettivamente quando non vuole pagare i prezzi di Sol. Misurarsi rispetto alla fascia che il vostro cliente acquisterebbe altrimenti è più onesto che misurarsi rispetto al modello più costoso disponibile.

La difficoltà sta nel fatto che la stessa frase rivendica anche prestazioni «a un passo dai modelli d'élite». Quelle due metà del messaggio promozionale tirano in direzioni opposte. Se Fugu Max è un sostituto di Terra, allora l'inquadramento da modello d'élite sta svolgendo un lavoro di marketing che non può sostenere, perché Terra non è esplicitamente posizionato come élite — è posizionato come il livello del buono e basta. Se Fugu Max si colloca davvero a un passo da Sol, allora il confronto di prezzo avrebbe dovuto essere fatto con Sol, dove il divario è più ampio e più lusinghiero. Un lancio che fa la rivendicazione aggressiva sulle capacità e il confronto di prezzo conservativo nello stesso paragrafo vuole la botte piena e la moglie ubriaca, e il lettore non ha modo di capire quale delle due metà sia quella portante.

A two-column scoreboard titled "Fugu Max vs GPT-5.6 Sol - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Context not published, Modality not published, Benchmarks six wins with no figures. Right column GPT-5.6 Sol: Output price $20.00 / 1M, Input price $4.00 / 1M, Cached input discount on base rate, Context 1M tokens with 128K output, Modality text, image and file, Benchmarks 91.9% on Terminal-Bench 2.0. Footer reading "Fugu Max figures vendor-reported by Sakana AI. Sakana's 40-60% output claim names GPT-5.6 Terra at $2.00 / $12.00, not Sol.", with the OrcaRouter logo bottom-right.

Sei benchmark, nessun numero, e un nome che dovrebbe far sorgere una domanda

La metà del pitch dedicata alle capacità si basa su un elenco. Fugu Max "ottiene il miglior punteggio complessivo" su Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench e SWEFish. Per nessuno di essi viene riportato alcun punteggio. SWEFish è un benchmark di coding interno di Sakana, il che significa che una delle sei vittorie è valutata su un test scritto dall'azienda e non reso pubblico.

GPT-5.6 Sol riporta cifre. Sol è indicato al 91,9% su Terminal-Bench 2.0 e al 64,6% su SWE-bench Pro nei dati di confronto di terze parti. Si noti la discrepanza di versione sul benchmark terminale: il numero pubblicato di Sol è per Terminal-Bench 2.0 e Sakana rivendica una vittoria su 2.1, che è una valutazione diversa e non può esservi confrontata. Vale la pena segnalarlo perché le due affermazioni sembrano adiacenti in un titolo e non sono di fatto comparabili.

Il confronto pertinente per questa sfida sarebbe Sol contro un modello Fugu su una valutazione condivisa. Le pagine di confronto di terze parti riportano effettivamente GPT-5.6 Sol contro la generazione base Sakana Fugu — Sol in vantaggio su Terminal-Bench 2.0 con il 91,9% contro l'80,2% e su SWE-bench Pro con il 64,6% contro il 59% — ma quelli sono dati relativi alla generazione precedente, non a Fugu Max, e le stesse fonti si astengono esplicitamente dal dichiarare un vincitore complessivo perché la copertura di benchmark condivisi è troppo scarsa. Non esiste alcun confronto pubblicato di alcun tipo tra Fugu Max e GPT-5.6 Sol. Chiunque ne affermi l'esistenza sta estrapolando.

Nessuna parte indipendente ha valutato Fugu Max, e non esiste alcuna voce di Artificial Analysis per esso o per qualsiasi modello Fugu. Ogni numero nel comunicato, incluse le sei vittorie, proviene dal fornitore. Sol, al contrario, è generalmente disponibile dal 9 luglio 2026 e compare in classifiche di terze parti — un livello di scrutinio esterno che Fugu Max non ha avuto la possibilità di ricevere.

Cosa stai effettivamente acquistando su ciascun lato

Configurare GPT-5.6 Sol è una cosa nota. Dispone di una finestra di contesto di 1M token, un tetto di output di 128K, input di testo, immagini e file, vision, uso degli strumenti, modalità JSON e ragionamento come capacità documentate, e due endpoint — chat completions e l'API responses — così un'integrazione esistente ha una destinazione. Mostra un time-to-first-token p50 di 6,68 secondi su tutto il traffico che serviamo, il che è più lento dei modelli più veloci del nostro catalogo e vale la pena saperlo prima di costruirci sopra un prodotto interattivo.

Configurare Fugu Max assomiglia più all'acquisto di un livello di servizio che di un modello. Ottieni un endpoint compatibile con OpenAI, una modifica di parametro su una singola riga per passare a esso da un Fugu precedente, e un coordinatore che decide quali modelli chiamare. Ciò che non ottieni, dalla pagina di rilascio, è una finestra di contesto, un tetto di output, un elenco delle modalità, un valore di latenza o un punteggio di benchmark. Le decisioni di instradamento del coordinatore non sono esposte per scelta progettuale. Il pool è stato ampliato in questa release per includere modelli open-weights e specializzati, con la famiglia NVIDIA Nemotron menzionata tramite una collaborazione con NVIDIA, e per il resto non è reso noto.

La motivazione dichiarata di Sakana per quell'opacità è difendibile — un pool indipendente dal fornitore che può essere sostituito è una protezione contro deprecazioni, cambi di prezzo e ritiri regionali. È una vera copertura, e la tariffa di input in cache di $0,25 suggerisce che Sakana si aspetta i carichi di lavoro a contesto lungo e alta ripetizione in cui quella copertura conterebbe di più. Ma significa davvero che la specifica che si sta acquistando è una promessa su una catena di fornitura, piuttosto che una descrizione di un prodotto.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Come eseguire il test

Il modo giusto per risolvere questa questione non è leggere la pagina di nessuno dei due fornitori. Prendi un campione del tuo traffico — qualche centinaio di richieste reali, idealmente includendo quelle che il tuo team attualmente escala — e provale su entrambi gli endpoint con la contabilizzazione dei token attiva. Calcolane il costo in token per attività completata anziché in token per chiamata, imposta un budget di output prima di iniziare così che un fan-out non possa sorprenderti, e misura la qualità in base al fatto che una seconda persona concordi che la risposta era accettabile. Quell'esperimento risponde alla domanda in una settimana e costa poco.

The friction is that Fugu Max is not on OrcaRouter. It reaches you through Sakana's own OpenAI-compatible API and several third-party platforms, which means a second integration, a second credential set and a second invoice. GPT-5.6 Sol is on our catalogue at Ope​nAI's list price with 0% markup — the provider's rate passed through rather than marked up, so a change to Ope​nAI's pricing is live on your existing key the same day, with automatic failover across provider paths when one is rate-limited or unavailable. It sits behind the same key as more than 200 other models, so when the pilot ends you keep the integration and change one string.

Il risultato finale

GPT-5.6 Sol vince il confronto che Sakana non ha voluto fare. Costa il doppio in input e più del triplo in output, e in cambio ottieni una finestra di contesto pubblicata, un tetto di output di 128K, input multimodale documentato, tag di capacità con nome, due endpoint e benchmark del fornitore che le terze parti hanno avuto mesi per esaminare. Se il tuo lavoro è del tipo per cui Sol è stato costruito — ragionamento profondo a più passaggi, ingegneria del software su larga scala, attività agentiche a lungo orizzonte — la differenza di prezzo è il costo di acquistare qualcosa che puoi specificare.

Fugu Max vince una scommessa più ristretta e davvero interessante, ed è quella più economica di gran lunga: 50 percento in meno rispetto a GPT-5.6 Terra sull'output, 70 percento in meno rispetto a Sol, con la tariffa cache più bassa in entrambi i listini. Se il tuo traffico è ad alto volume, solo testo, verificabile e per lo più non necessita di ragionamento di punta, un orchestratore che instrada verso il modello sufficiente più snello è una progettazione coerente e la tariffa di output di $6,00 è dove risiede il valore. Prendi per buono l'inquadramento del rilascio stesso e testalo come sostituto di Terra anziché di Sol — e se vuoi il modello di punta con il prezzo di listino del fornitore passato attraverso invariato, GPT-5.6 Sol è a una chiave di distanza su OrcaRouter.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol, captured September 11, 2026, English UI), showing the Featured badge, the openai/gpt-5.6-sol model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-09, the /v1/chat/completions and /v1/responses endpoints, the pricing tiles reading INPUT $4.00 and OUTPUT $20.00 per 1M tokens with p50 TTFT 6.68s and 153.0M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno