
Fugu Max vs GPT-5.6 Sol: l'affermazione sul prezzo era mirata alla fascia media della famiglia
- deepseekNUOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiNUOVOOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleNUOVOGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenNUOVOQwen: Qwen3.8 Max (0902)2026-09-0240Intelligenza72Codice
- anthropicNUOVOAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1M di token
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligenza69Codice
Fugu Max's price justification names a GPT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same OpenAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.
Verificando l'affermazione rispetto alla famiglia a cui fa riferimento
La cifra del 40-60 percento di Sakana è verificabile, perché il modello che nomina ha una tariffa pubblicata. GPT-5.6 Terra ha un prezzo di listino di $2,00 per l'input e $12,00 per l'output per milione di token. Fugu Max ha un prezzo di listino di $2,00 per l'input e $6,00 per l'output. Esegui il confronto e saltano fuori due cose. Sull'output, $6,00 contro $12,00 è un taglio esattamente del 50 percento — proprio al centro della finestra dichiarata del 40-60, il che è un segno che la finestra è stata tracciata attorno a questo confronto anziché ricavata da esso. Sull'input, le due tariffe sono identiche al centesimo.
That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the GPT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.
• Prezzo di input — Fugu Max 2,00 $ per 1 milione di token rispetto a GPT-5.6 Sol 4,00 $ per 1 milione di token
• Prezzo dell'output — Fugu Max 6,00 $ per 1M token vs GPT-5.6 Sol 20,00 $ per 1M token
• Input in cache — Fugu Max 0,25 $ per 1 milione di token rispetto al caching di GPT-5.6 Sol, prezzato come sconto sulla tariffa di input di base
• Contesto — Fugu Max non pubblicato vs GPT-5.6 Sol 1M token
• Limite di output — Fugu Max non pubblicato vs GPT-5.6 Sol 128K token
• Modalità di input — Fugu Max non pubblicata vs GPT-5.6 Sol testo, immagine e file
• Tag di capacità — Fugu Max nessuno pubblicato vs GPT-5.6 Sol visione, uso degli strumenti, modalità JSON, ragionamento
• Endpoint — Fugu Max: un'unica superficie compatibile con OpenAI vs GPT-5.6 Sol chat completions e la responses API
• Dati di benchmark — sei vittorie dichiarate per Fugu Max senza punteggi rispetto ai dati pubblicati dal fornitore per GPT-5.6 Sol, inclusi Terminal-Bench 2.0 al 91,9% e SWE-bench Pro al 64,6%
Perché il gradino di mezzo è il gradino giusto da nominare
Esiste una versione difendibile della scelta di Sakana, e merita di essere esposta prima delle critiche. Un orchestratore che instrada ogni attività verso il modello più snello in grado di svolgerla non compete con un flagship sui compiti da flagship. Compete con un modello di fascia media su lavori di fascia media, e offre di svolgerne un sottoinsieme a un costo inferiore. Se la proposta è «la maggior parte del vostro traffico non ha bisogno di Sol», allora Terra è il termine di paragone corretto, perché Terra è ciò a cui la maggior parte dei team ricorre effettivamente quando non vuole pagare i prezzi di Sol. Misurarsi rispetto alla fascia che il vostro cliente acquisterebbe altrimenti è più onesto che misurarsi rispetto al modello più costoso disponibile.
La difficoltà sta nel fatto che la stessa frase rivendica anche prestazioni «a un passo dai modelli d'élite». Quelle due metà del messaggio promozionale tirano in direzioni opposte. Se Fugu Max è un sostituto di Terra, allora l'inquadramento da modello d'élite sta svolgendo un lavoro di marketing che non può sostenere, perché Terra non è esplicitamente posizionato come élite — è posizionato come il livello del buono e basta. Se Fugu Max si colloca davvero a un passo da Sol, allora il confronto di prezzo avrebbe dovuto essere fatto con Sol, dove il divario è più ampio e più lusinghiero. Un lancio che fa la rivendicazione aggressiva sulle capacità e il confronto di prezzo conservativo nello stesso paragrafo vuole la botte piena e la moglie ubriaca, e il lettore non ha modo di capire quale delle due metà sia quella portante.

Sei benchmark, nessun numero, e un nome che dovrebbe far sorgere una domanda
La metà del pitch dedicata alle capacità si basa su un elenco. Fugu Max "ottiene il miglior punteggio complessivo" su Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench e SWEFish. Per nessuno di essi viene riportato alcun punteggio. SWEFish è un benchmark di coding interno di Sakana, il che significa che una delle sei vittorie è valutata su un test scritto dall'azienda e non reso pubblico.
GPT-5.6 Sol riporta cifre. Sol è indicato al 91,9% su Terminal-Bench 2.0 e al 64,6% su SWE-bench Pro nei dati di confronto di terze parti. Si noti la discrepanza di versione sul benchmark terminale: il numero pubblicato di Sol è per Terminal-Bench 2.0 e Sakana rivendica una vittoria su 2.1, che è una valutazione diversa e non può esservi confrontata. Vale la pena segnalarlo perché le due affermazioni sembrano adiacenti in un titolo e non sono di fatto comparabili.
Il confronto pertinente per questa sfida sarebbe Sol contro un modello Fugu su una valutazione condivisa. Le pagine di confronto di terze parti riportano effettivamente GPT-5.6 Sol contro la generazione base Sakana Fugu — Sol in vantaggio su Terminal-Bench 2.0 con il 91,9% contro l'80,2% e su SWE-bench Pro con il 64,6% contro il 59% — ma quelli sono dati relativi alla generazione precedente, non a Fugu Max, e le stesse fonti si astengono esplicitamente dal dichiarare un vincitore complessivo perché la copertura di benchmark condivisi è troppo scarsa. Non esiste alcun confronto pubblicato di alcun tipo tra Fugu Max e GPT-5.6 Sol. Chiunque ne affermi l'esistenza sta estrapolando.
Nessuna parte indipendente ha valutato Fugu Max, e non esiste alcuna voce di Artificial Analysis per esso o per qualsiasi modello Fugu. Ogni numero nel comunicato, incluse le sei vittorie, proviene dal fornitore. Sol, al contrario, è generalmente disponibile dal 9 luglio 2026 e compare in classifiche di terze parti — un livello di scrutinio esterno che Fugu Max non ha avuto la possibilità di ricevere.
Cosa stai effettivamente acquistando su ciascun lato
Configurare GPT-5.6 Sol è una cosa nota. Dispone di una finestra di contesto di 1M token, un tetto di output di 128K, input di testo, immagini e file, vision, uso degli strumenti, modalità JSON e ragionamento come capacità documentate, e due endpoint — chat completions e l'API responses — così un'integrazione esistente ha una destinazione. Mostra un time-to-first-token p50 di 6,68 secondi su tutto il traffico che serviamo, il che è più lento dei modelli più veloci del nostro catalogo e vale la pena saperlo prima di costruirci sopra un prodotto interattivo.
Configurare Fugu Max assomiglia più all'acquisto di un livello di servizio che di un modello. Ottieni un endpoint compatibile con OpenAI, una modifica di parametro su una singola riga per passare a esso da un Fugu precedente, e un coordinatore che decide quali modelli chiamare. Ciò che non ottieni, dalla pagina di rilascio, è una finestra di contesto, un tetto di output, un elenco delle modalità, un valore di latenza o un punteggio di benchmark. Le decisioni di instradamento del coordinatore non sono esposte per scelta progettuale. Il pool è stato ampliato in questa release per includere modelli open-weights e specializzati, con la famiglia NVIDIA Nemotron menzionata tramite una collaborazione con NVIDIA, e per il resto non è reso noto.
La motivazione dichiarata di Sakana per quell'opacità è difendibile — un pool indipendente dal fornitore che può essere sostituito è una protezione contro deprecazioni, cambi di prezzo e ritiri regionali. È una vera copertura, e la tariffa di input in cache di $0,25 suggerisce che Sakana si aspetta i carichi di lavoro a contesto lungo e alta ripetizione in cui quella copertura conterebbe di più. Ma significa davvero che la specifica che si sta acquistando è una promessa su una catena di fornitura, piuttosto che una descrizione di un prodotto.

Come eseguire il test
Il modo giusto per risolvere questa questione non è leggere la pagina di nessuno dei due fornitori. Prendi un campione del tuo traffico — qualche centinaio di richieste reali, idealmente includendo quelle che il tuo team attualmente escala — e provale su entrambi gli endpoint con la contabilizzazione dei token attiva. Calcolane il costo in token per attività completata anziché in token per chiamata, imposta un budget di output prima di iniziare così che un fan-out non possa sorprenderti, e misura la qualità in base al fatto che una seconda persona concordi che la risposta era accettabile. Quell'esperimento risponde alla domanda in una settimana e costa poco.
The friction is that Fugu Max is not on OrcaRouter. It reaches you through Sakana's own OpenAI-compatible API and several third-party platforms, which means a second integration, a second credential set and a second invoice. GPT-5.6 Sol is on our catalogue at OpenAI's list price with 0% markup — the provider's rate passed through rather than marked up, so a change to OpenAI's pricing is live on your existing key the same day, with automatic failover across provider paths when one is rate-limited or unavailable. It sits behind the same key as more than 200 other models, so when the pilot ends you keep the integration and change one string.
Il risultato finale
GPT-5.6 Sol vince il confronto che Sakana non ha voluto fare. Costa il doppio in input e più del triplo in output, e in cambio ottieni una finestra di contesto pubblicata, un tetto di output di 128K, input multimodale documentato, tag di capacità con nome, due endpoint e benchmark del fornitore che le terze parti hanno avuto mesi per esaminare. Se il tuo lavoro è del tipo per cui Sol è stato costruito — ragionamento profondo a più passaggi, ingegneria del software su larga scala, attività agentiche a lungo orizzonte — la differenza di prezzo è il costo di acquistare qualcosa che puoi specificare.
Fugu Max vince una scommessa più ristretta e davvero interessante, ed è quella più economica di gran lunga: 50 percento in meno rispetto a GPT-5.6 Terra sull'output, 70 percento in meno rispetto a Sol, con la tariffa cache più bassa in entrambi i listini. Se il tuo traffico è ad alto volume, solo testo, verificabile e per lo più non necessita di ragionamento di punta, un orchestratore che instrada verso il modello sufficiente più snello è una progettazione coerente e la tariffa di output di $6,00 è dove risiede il valore. Prendi per buono l'inquadramento del rilascio stesso e testalo come sostituto di Terra anziché di Sol — e se vuoi il modello di punta con il prezzo di listino del fornitore passato attraverso invariato, GPT-5.6 Sol è a una chiave di distanza su OrcaRouter.

Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
