Um cartão de título de destaque para “Fugu Max vs Claude Opus 5”, com o subtítulo “Quatro vezes mais barato, e um número que ninguém publicou”, três selos em formato de pílula com os textos “US$ 6,00 vs US$ 25,00 de saída”, “Seis vitórias, zero pontuações”, “US$ 2,00 vs US$ 5,00 de entrada”, uma linha de rodapé com “Sakana AI vs Anthropic - setembro de 2026”, e o logotipo da OrcaRouter no canto inferior direito.
Guides & Insights

Fugu Max vs Claude Opus 5: quatro vezes mais barato, e um número que ninguém publicou

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Fugu Max custa US$ 6,00 para produzir um milhão de tokens de saída. Claude Opus 5 custa US$ 25,00. A Sakana AI lançou o Fugu Max em 11 de setembro de 2026 como um coordenador que encaminha cada tarefa ao modelo mais enxuto de seu pool, e o precificou de forma agressiva o suficiente para que uma diferença de quatro vezes no custo de saída em relação ao carro-chefe da Anthropic seja o fato de maior destaque do lançamento. O que o lançamento não contém é um único número descrevendo o quão bem o Fugu Max realmente se sai. A Sakana diz que ele obtém a "melhor pontuação geral" em seis benchmarks e amplia a fronteira de custo-desempenho em sete de dez — afirmações sobre posicionamento em um gráfico, e não valores em um eixo. Claude Opus 5, em contraste, chega com uma pontuação publicada para quase tudo o que faz. Então a versão honesta dessa comparação não é barato versus caro. É medido versus afirmado, e a diferença de preço é o que torna essa troca digna de discussão.

A lacuna, e a comparação que a Sakana optou por não fazer

A página de lançamento da Sakana justifica a taxa de saída do Fugu Max comparando-a com outros modelos. Os três que ela nomeia são Claude Sonnet 5, GPT-5.6 Terra e Kimi K3, e a alegação é que o preço de saída do Fugu Max fica 40 a 60 por cento abaixo deles. Repare em quem está ausente. O Claude Opus 5 não está nessa lista, e o motivo é aritmético: a $6,00 contra $25,00, o Fugu Max não é 40 por cento mais barato que o Opus 5, é 76 por cento mais barato. Nomear o Opus 5 teria feito a alegação parecer implausível em vez de competitiva, então a comparação é feita com o nível abaixo do carro-chefe.

Isso não é uma crítica ao preço, que é genuinamente baixo. É uma observação sobre o que a frase em volta está fazendo. O próprio enquadramento da Sakana — desempenho “ao alcance de modelos de elite com custo duas a seis vezes menor” — está calibrado para os modelos que ela escolheu nomear. Em comparação com o Claude Opus 5, o múltiplo não é de dois a seis, e sim superior a quatro na saída; se o Opus 5 ainda é um “modelo de elite” segundo os critérios dessa frase não é declarado, o que é uma omissão curiosa em um lançamento cujo argumento de venda inteiro é a eficiência de custo-desempenho na fronteira.

• Preço de entrada — Fugu Max $2,00 por 1M de tokens vs Claude Opus 5 $5,00 por 1M de tokens

• Preço de saída — Fugu Max $6.00 por 1M de tokens vs Claude Opus 5 $25.00 por 1M de tokens

• Entrada em cache — Fugu Max US$ 0,25 por 1 milhão de tokens vs. o cache do Claude Opus 5 precificado como desconto de até 90% sobre a entrada em cache

• Pontuações de benchmark — Fugu Max: nenhuma publicada; seis vitórias em benchmarks afirmadas sem números vs. Claude Opus 5, com 96,0% no SWE-bench Verified, 79,2% no SWE-bench Pro e cerca de 30,2% no ARC-AGI 3, conforme relatado pela Anthropic

• Arquitetura — Fugu Max, um coordenador treinado sobre um conjunto não divulgado, vs. Claude Opus 5, um único modelo fixável por versão

• Contexto — Fugu Max não publicado vs Claude Opus 5 com 1M de tokens, com um teto de saída de 128K

• Avaliação independente — Fugu Max: não existe nenhuma para qualquer modelo Fugu vs Claude Opus, 5 meses de colocações em leaderboards de terceiros

Seis vitórias sem pontuações associadas

Os seis benchmarks são Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench e SWEFish. Cinco deles são avaliações públicas reconhecíveis. O sexto, SWEFish, é o benchmark de programação da própria Sakana, o que significa que uma das seis vitórias é pontuada em um teste que o fornecedor escreveu e não publicou.

Para os outros cinco, o comunicado afirma que o Fugu Max alcança a melhor pontuação geral sem dizer qual é essa pontuação, nem o que qualquer concorrente pontuou. Esse é um formato incomum para o anúncio de um modelo. Os fornecedores costumam exagerar, mas geralmente exageram com números, porque os números são o que circula. Um comunicado que alega seis vitórias e não publica nenhuma delas está pedindo para ser aceito apenas pela força da alegação.

Há uma leitura caridosa e vale a pena dizê-la com clareza. O Fugu Max é um coordenador otimizado para custo, não um avanço de capacidade — a Sakana o lançou no mesmo dia que o Fugu Ultra v2, que é a versão voltada para capacidade máxima com US$ 5,00 de entrada e US$ 30,00 de saída. A função do Max é atingir qualidade aceitável com US$ 6,00 de saída, e a pontuação principal de um orquestrador é menos significativa do que sua pontuação por dólar, que é exatamente o que um gráfico de Pareto mostra. A comunicação visual da Sakana para este lançamento são gráficos de Pareto. Se o argumento é "olhe para a curva, não para o pico", então um número bruto de benchmark não vem ao caso.

A leitura pouco caridosa é que um número convidaria a uma comparação que o fornecedor preferiria não ter. Ambas as leituras são compatíveis com as evidências, e nada no registro público atualmente as distingue. O que se pode dizer é que nenhuma parte independente avaliou qualquer modelo Fugu, e não há entrada da Artificial Analysis para o Fugu Max nem para qualquer um de seus irmãos. Todos os números do comunicado, incluindo as seis vitórias, têm origem na Sakana.

A two-column scoreboard titled "Fugu Max vs Claude Opus 5 - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Benchmarks six wins with no figures, Context not published, Evidence vendor-reported only. Right column Claude Opus 5: Output price $25.00 / 1M, Input price $5.00 / 1M, Cached input up to 90% discount, Benchmarks 96.0% SWE-bench Verified, Context 1M with a 128K output ceiling, Evidence independent evals. Footer reading "Fugu Max figures vendor-reported by Sakana AI; Opus 5 rows Anthropic-reported. No independent Fugu Max evaluation exists.", with the OrcaRouter logo bottom-right.

A compra que você está realmente fazendo

Quando um fornecedor de modelo único publica um benchmark, você está comprando uma alegação sobre um modelo. Quando um orquestrador publica um, você está comprando uma alegação sobre um pool — modelos que o fornecedor não treinou, operando sob um coordenador cujas decisões de roteamento são deliberadamente não expostas. O pool aqui é descrito como o maior que a Fugu já usou, ampliado com modelos de pesos abertos e especializados, incluindo a família NVIDIA Nemotron, por meio de uma colaboração com a NVIDIA. Fora isso, os membros não são divulgados.

A consequência prática é que o comportamento do Fugu Max pode mudar sem que sua versão mude. A descontinuação de um laboratório de fronteira, uma mudança de preço ou a retirada de um modelo de uma região altera aquilo que o coordenador pode chamar, e a Sakana deixa explícito que essa resiliência é o objetivo — está vendendo proteção contra o lock-in de fornecedor e revogações de API. Isso é um benefício real e não é gratuito. É também a razão pela qual um benchmark do Fugu Max, se fosse publicado, teria uma data de validade que um benchmark do Claude Opus 5 não tem.

A proposta de valor do Claude Opus 5 é o inverso e é mais fácil de precificar. É um modelo, em uma versão, executando raciocínio adaptativo por padrão com um ajuste explícito de esforço de baixo a máximo, com uma janela de contexto de 1M de tokens e um teto de saída de 128K, com visão, uso de ferramentas e modo JSON. A Anth​ropic relata 96,0% no SWE-bench Verified e 79,2% no SWE-bench Pro, e esses números foram medidos naquilo que você obtém ao chamar o endpoint — não em um conjunto cuja composição pode mudar sob seus pés. Para uma carga de trabalho que roda em produção e passa por revisão, essa estabilidade é um recurso pelo qual você paga US$ 19,00 por milhão de tokens de saída para ter.

Custo por tarefa concluída, não por token

A tarifa de saída de US$ 6,00 do Fugu Max é genuinamente atraente, e a forma de testá-la é parar de comparar preços de tokens. Um orquestrador cria agentes; cada um escreve tokens de raciocínio e de saída; o coordenador escreve uma síntese. O FAQ de preços da Sakana para a linha Fugu compromete-se com uma única tarifa combinada baseada no modelo participante de primeira linha, com execuções multiagente não acumulando a conta — o que remove a multiplicação de fan-out no pior cenário que torna sistemas multiagente ingênuos financeiramente inviáveis. Isso não remove o volume. O número de tokens de saída pelos quais você é cobrado é uma função de quantos agentes foram executados e, a US$ 6,00 por milhão, esse volume é a variável que uma página de preços não consegue informar.

A estrutura de custos do Claude Opus 5 é uma chamada, um modelo, um controle de esforço que você ajusta e processamento em lote pela metade do preço para trabalho que pode esperar. Você pode prever isso antes de executá-lo. Em mais de dez mil execuções, a previsibilidade vale muito mais do que uma margem de benchmark que ninguém publicou.

É aqui que a questão do roteamento se separa da questão do modelo. O Claude Opus 5 está no OrcaRouter ao preço de tabela da Anth​ropic, com 0% de markup — a tarifa do provedor repassada diretamente, de modo que uma mudança nos preços da Anth​ropic entra no ar no mesmo dia, na mesma chave, com failover automático entre os caminhos de provedores quando um deles está com limite de taxa atingido ou indisponível. O Fugu Max não está no nosso catálogo; ele chega até você por meio da própria API compatível com OpenAI da Sakana e de várias plataformas de terceiros, e migrar para ele a partir de um Fugu anterior é uma mudança de um único parâmetro. Se você quer a base de evidências do Opus 5 e uma fatura que você consiga prever, o roteador é o caminho mais curto. Se você quer um sistema que monta seu próprio fan-out em problemas difíceis, o Fugu Max é o que faz isso — e você deve pilotá-lo com a contabilização de tokens ativada desde a primeira requisição.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Onde o Fugu Max provavelmente é a resposta certa

Dê ao design o crédito que ele merece. Se o seu trabalho tem alto volume, é verificável e você se importa com o custo mediano de uma tarefa concluída, e não com a capacidade máxima de qualquer chamada individual, um orquestrador que escolhe o modelo suficiente mais barato para cada solicitação faz algo que um modelo fixo de ponta não consegue fazer. O Fugu Max é voltado exatamente para essa carga de trabalho, e a tarifa de US$ 2,00 por entrada, com US$ 0,25 para entrada em cache, foi definida para os contextos longos e repetitivos que essas cargas geram. A colaboração com a NVIDIA também importa mais do que parece: os modelos Nemotron têm pesos abertos, o que significa que o degrau mais barato do conjunto não está exposto às decisões de precificação de outro laboratório.

O que isso não lhe dá é um motivo para acreditar que o Fugu Max igualará o Claude Opus 5 nas tarefas em que os números publicados do Opus 5 são mais fortes — engenharia de software em escala de repositório e raciocínio difícil. Essas são precisamente as linhas em que o painel de seis benchmarks da Sakana não oferece número algum. Se o seu problema é um caso em que ser o melhor importa mais do que ser barato, a tarifa de saída de US$ 25,00 compra aquilo de que você realmente precisa.

Conclusão

O Claude Opus 5 é a compra mais bem fundamentada e o padrão de produção mais seguro: benchmarks publicados pelo fornecedor, uma versão que pode fixar, uma janela de contexto que não se altera, um limite de saída de 128K, um seletor de esforço que lhe permite comprar raciocínio apenas quando compensa, e meses de resultados de terceiros por trás dele. O Fugu Max é a aposta mais interessante e genuinamente mais barata — cerca de 60 por cento menos na entrada e 76 por cento menos na saída, com uma taxa de cache uma ordem de magnitude abaixo do preço base de entrada do Opus 5.

Se você executa trabalho verificável, repetitivo e de alto volume e está fora da UE/EEE, o Fugu Max merece um piloto com escopo definido, com um teto de tokens de saída definido antes de você começar e uma medição de tokens por tarefa concluída, em vez de tokens por chamada. Se você precisa de uma decisão de produção que consiga defender para outra pessoa neste trimestre, o Claude Opus 5 continua sendo a resposta — e ele está disponível no OrcaRouter pelo preço de tabela da Anth​ropic, com a tarifa do provedor repassada sem alterações.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, captured September 11, 2026, English UI), showing the Featured badge, the anthropic/claude-opus-5 model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24, the /v1/chat/completions and /v1/messages endpoints, the pricing tiles reading INPUT $5.00 and OUTPUT $25.00 per 1M tokens with p50 TTFT 4.94s and 195.4M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.