Um cartão de título de destaque para "Fugu Max vs GPT-5.6 Sol" com o subtítulo "A alegação de preços foi direcionada ao meio da família", três selos em formato de pílula com os dizeres "$6.00 vs $20.00 de saída", "alegação de 40-60% vs Terra", "Seis vitórias, sem pontuações", uma linha de rodapé com o texto "Sakana AI vs OpenAI - setembro de 2026", e o logotipo da OrcaRouter no canto inferior direito.
Guides & Insights

Fugu Max vs GPT-5.6 Sol: a alegação de preço foi direcionada ao meio da família

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Fugu Max's price justification names a G​PT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same Ope​nAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.

Confrontando a afirmação com a família a que ela se refere

A cifra de 40% a 60% da Sakana é testável, porque o modelo que ela menciona tem uma tarifa publicada. O GPT-5.6 Terra está listado a US$ 2,00 de entrada e US$ 12,00 de saída por milhão de tokens. O Fugu Max está listado a US$ 2,00 de entrada e US$ 6,00 de saída. Faça a comparação e duas coisas saltam aos olhos. Na saída, US$ 6,00 contra US$ 12,00 é um corte de exatamente 50 por cento — bem no centro da janela declarada de 40 a 60, o que é um sinal de que a janela foi traçada em torno dessa comparação, e não descoberta a partir dela. Na entrada, as duas tarifas são idênticas até o centavo.

That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the G​PT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.

• Preço de entrada — Fugu Max $2.00 por 1M tokens vs GPT-5.6 Sol $4.00 por 1M tokens

• Preço de saída — Fugu Max US$ 6,00 por 1 milhão de tokens vs. GPT-5.6 Sol US$ 20,00 por 1 milhão de tokens

• Entrada em cache — Fugu Max US$ 0,25 por 1M de tokens vs. cache do GPT-5.6 Sol com preço como desconto sobre a tarifa base de entrada

• Contexto — Fugu Max não publicado vs GPT-5.6 Sol 1M de tokens

• Teto de saída — Fugu Max não publicado vs GPT-5.6 Sol 128K tokens

• Modalidade de entrada — Fugu Max não publicada vs. GPT-5.6 Sol: texto, imagem e arquivo

• Tags de capacidade — Fugu Max: nenhuma publicada vs GPT-5.6 Sol: visão, uso de ferramentas, modo JSON, raciocínio

• Endpoints — Fugu Max uma única superfície compatível com OpenAI vs GPT-5.6 Sol chat completions e a responses API

• Números de benchmark — seis vitórias do Fugu Max alegadas sem pontuações vs. dados publicados pelo fornecedor para o GPT-5.6 Sol, incluindo Terminal-Bench 2.0 a 91,9% e SWE-bench Pro a 64,6%

Por que o degrau do meio é o degrau certo para nomear

Há uma versão defensável da escolha da Sakana, e ela merece ser apresentada antes da crítica. Um orquestrador que encaminha cada tarefa para o modelo capaz mais enxuto não está competindo com um modelo de ponta em trabalho de ponta. Está competindo com um modelo intermediário em trabalho intermediário, e se propondo a fazer um subconjunto desse trabalho por um custo menor. Se o argumento de venda é "a maior parte do seu tráfego não precisa do Sol", então o Terra é o termo de comparação correto, porque o Terra é o que a maioria das equipes realmente procura quando não quer pagar os preços do Sol. Comparar com a categoria que seu cliente compraria de outra forma é mais honesto do que comparar com o modelo mais caro disponível.

A dificuldade é que a mesma frase também reivindica um desempenho "a poucos passos de distância dos modelos de elite". Essas duas metades do discurso puxam em direções opostas. Se o Fugu Max é um substituto do Terra, então o enquadramento como modelo de elite está fazendo um trabalho de marketing que não consegue sustentar, porque o Terra explicitamente não é posicionado como elite — ele é posicionado como o nível do bom o suficiente. Se o Fugu Max de fato fica a poucos passos de distância do Sol, então a comparação de preços deveria ter sido feita em relação ao Sol, onde a diferença é maior e mais lisonjeira. Um lançamento que faz a alegação agressiva de capacidade e a comparação conservadora de preços no mesmo parágrafo está querendo as duas coisas ao mesmo tempo, e o leitor não tem como saber qual metade é a que sustenta o argumento.

A two-column scoreboard titled "Fugu Max vs GPT-5.6 Sol - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Context not published, Modality not published, Benchmarks six wins with no figures. Right column GPT-5.6 Sol: Output price $20.00 / 1M, Input price $4.00 / 1M, Cached input discount on base rate, Context 1M tokens with 128K output, Modality text, image and file, Benchmarks 91.9% on Terminal-Bench 2.0. Footer reading "Fugu Max figures vendor-reported by Sakana AI. Sakana's 40-60% output claim names GPT-5.6 Terra at $2.00 / $12.00, not Sol.", with the OrcaRouter logo bottom-right.

Seis benchmarks, sem números, e um nome que deveria levantar uma questão

A metade do pitch dedicada à capacidade assenta numa lista. O Fugu Max "alcança a melhor pontuação geral" no Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench e SWEFish. Não são apresentadas pontuações para nenhum deles. O SWEFish é um benchmark de programação interno da própria Sakana, o que significa que uma das seis vitórias é pontuada num teste que o fornecedor escreveu e não divulgou.

O GPT-5.6 Sol reporta números. O Sol aparece com 91,9% no Terminal-Bench 2.0 e 64,6% no SWE-bench Pro em dados comparativos de terceiros. Observe a divergência de versão no benchmark de terminal: o número publicado do Sol é referente ao Terminal-Bench 2.0, enquanto a Sakana alega uma vitória no 2.1, que é uma avaliação diferente e não pode ser comparada com aquela. Vale a pena destacar isso porque as duas alegações parecem próximas em uma manchete e, de fato, não são comparáveis.

A comparação relevante para este confronto seria Sol contra um modelo Fugu em uma avaliação compartilhada. Páginas de comparação de terceiros de fato trazem o GPT-5.6 Sol contra a geração base do Sakana Fugu — Sol à frente no Terminal-Bench 2.0, por 91,9% a 80,2%, e no SWE-bench Pro, por 64,6% a 59% —, mas esses são números da geração anterior, não do Fugu Max, e as mesmas fontes se recusam explicitamente a apontar um vencedor geral porque a cobertura de benchmarks compartilhados é escassa demais. Não há nenhuma comparação publicada de qualquer tipo entre o Fugu Max e o GPT-5.6 Sol. Quem afirmar que existe uma está extrapolando.

Nenhuma parte independente avaliou o Fugu Max, e não existe entrada no Artificial Analysis para ele nem para qualquer modelo Fugu. Todos os números do comunicado, incluindo as seis vitórias, vêm do fornecedor. Sol, em contrapartida, está disponível para o público em geral desde 9 de julho de 2026 e aparece em rankings de terceiros — um nível de escrutínio externo que o Fugu Max não teve a oportunidade de receber.

O que você está realmente comprando de cada lado

Configurar o GPT-5.6 Sol é algo já conhecido. Traz uma janela de contexto de 1M de tokens, um teto de saída de 128K, entrada de texto, imagem e ficheiros, visão, uso de ferramentas, modo JSON e raciocínio como capacidades documentadas, e dois endpoints — chat completions e a API responses — para que uma integração existente tenha para onde ir. Apresenta um tempo até ao primeiro token (p50) de 6,68 segundos no tráfego que servimos, o que é mais lento do que os modelos mais rápidos do nosso catálogo e vale a pena saber antes de construir um produto interativo com ele.

Configurar o Fugu Max está mais próximo de comprar um nível de serviço do que um modelo. Você recebe um endpoint compatível com OpenAI, uma alteração de parâmetro em uma única linha para migrar de um Fugu anterior para ele, e um coordenador que decide quais modelos chamar. O que você não recebe, pela página de lançamento, é uma janela de contexto, um teto de saída, uma lista de modalidades, um número de latência ou uma pontuação de benchmark. As decisões de roteamento do coordenador não são expostas por design. O pool foi ampliado nesta versão para incluir modelos de pesos abertos e especializados, com a família NVIDIA Nemotron nomeada por meio de uma colaboração com a NVIDIA, e, fora isso, não é divulgado.

A justificativa declarada da Sakana para essa opacidade é defensável — um pool agnóstico de fornecedor que pode ser substituído é uma proteção contra depreciações, mudanças de preço e retiradas regionais. É um hedge real, e a tarifa de entrada em cache de US$ 0,25 sugere que a Sakana espera as cargas de trabalho de contexto longo e alta repetição em que esse hedge faria mais diferença. Mas significa, sim, que a especificação que você está comprando é uma promessa sobre uma cadeia de suprimentos, e não uma descrição de um produto.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Como executar o teste

A maneira correta de resolver isso não é ler a página de nenhum dos fornecedores. Pegue uma amostra do seu próprio tráfego — algumas centenas de solicitações reais, de preferência incluindo as que sua equipe atualmente escala — e execute-as em ambos os endpoints com a contabilização de tokens ativada. Calcule o custo delas em tokens por tarefa concluída, e não em tokens por chamada, defina um orçamento de saída antes de começar para que um fan-out não o pegue de surpresa, e meça a qualidade verificando se uma segunda pessoa concorda que a resposta era aceitável. Esse experimento responde à pergunta em uma semana e custa pouco.

The friction is that Fugu Max is not on OrcaRouter. It reaches you through Sakana's own OpenAI-compatible API and several third-party platforms, which means a second integration, a second credential set and a second invoice. GPT-5.6 Sol is on our catalogue at Ope​nAI's list price with 0% markup — the provider's rate passed through rather than marked up, so a change to Ope​nAI's pricing is live on your existing key the same day, with automatic failover across provider paths when one is rate-limited or unavailable. It sits behind the same key as more than 200 other models, so when the pilot ends you keep the integration and change one string.

Conclusão

GPT-5.6 Sol vence a comparação que a Sakana se recusou a fazer. Custa o dobro na entrada e mais de três vezes mais na saída e, em troca, você obtém uma janela de contexto publicada, um teto de saída de 128K, entrada multimodal documentada, tags de capacidade nomeadas, dois endpoints e benchmarks do fornecedor que terceiros tiveram meses para examinar. Se o seu trabalho é do tipo para o qual o Sol foi criado — raciocínio profundo em várias etapas, engenharia de software em larga escala, tarefas agênticas de horizonte longo —, a diferença de preço é o custo de comprar algo que você pode especificar.

Fugu Max vence com uma aposta mais restrita e genuinamente interessante, e é o mais barato por uma margem ampla: 50 por cento abaixo do GPT-5.6 Terra na saída, 70 por cento abaixo do Sol, com a taxa de cache mais baixa em ambas as tabelas de preços. Se o seu tráfego for de alto volume, apenas texto, verificável e, na sua maioria, não precisar de raciocínio de ponta, um orquestrador que encaminha para o modelo suficiente mais enxuto é um design coerente e a taxa de saída de $6,00 é onde reside o valor. Aceite o enquadramento do próprio lançamento pelo valor de face e experimente-o como um substituto do Terra, em vez de um do Sol — e se você quiser o carro-chefe com o preço de tabela do fornecedor repassado sem alterações, o GPT-5.6 Sol está a uma chave de distância no OrcaRouter.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol, captured September 11, 2026, English UI), showing the Featured badge, the openai/gpt-5.6-sol model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-09, the /v1/chat/completions and /v1/responses endpoints, the pricing tiles reading INPUT $4.00 and OUTPUT $20.00 per 1M tokens with p50 TTFT 6.68s and 153.0M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.

Comparados neste artigo1

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente