
Sakana Namazu vs DeepSeek V4 Flash: Ajuste Soberano vs Velocidade em Escala
- metaNOVOMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenNOVOQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekNOVODeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxNOVOMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligência77Código
- grokxAI: Grok 4.52026-07-0856Inteligência72Código
- tencentTencent: Hy32026-07-0642Inteligência59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligência42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligência39Código
- anthropicAnthropic: Claude Sonnet 52026-06-3055Inteligência72Código
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligência52Código57Matemática
Sakana Namazu e DeepSeek V4 Flash chegaram ambos em 2026 como respostas baratas aos preços de fronteira, e não poderiam ser mais diferentes. Sakana Namazu é uma API soberana do Japão — Kimi K2.6 pós-treinada para keigo e cultura empresarial japonesa, a US$ 0,95 / US$ 4,00 por milhão de tokens, com pesquisa na web e execução de código integradas. DeepSeek V4 Flash é um modelo de mistura de especialistas com 284 bilhões de parâmetros / 13 bilhões ativos, ajustado para cargas de trabalho cotidianas rápidas, listado a US$ 0,147 / US$ 0,295 por milhão de tokens — aproximadamente um sexto do preço de entrada do Namazu — com uma janela de contexto de 1 milhão de tokens e um conjunto de pontuações de benchmark medidas de forma independente.
A versão de 10 segundos:
• Se o seu texto for japonês de negócios e o tom importar → Sakana Namazu, e não há uma segunda opção real.
• Se sua carga for trabalho em inglês de alto volume, codificação ou recuperação de contexto longo com orçamento limitado → DeepSeek V4 Flash, com certeza.
• Se você precisa de números verificados de forma independente antes de comprar → DeepSeek V4 Flash é o único dos dois que os possui

As especificações, lado a lado
• Preço — Sakana Namazu $0.95 / $4.00 por 1M de tokens vs DeepSeek V4 Flash $0.147 / $0.295 por 1M de tokens (leitura de cache $0.020)
• Base — Namazu: Kimi K2.6 (1T total / 32B ativos, pesos abertos, pós-treinado) vs DeepSeek V4 Flash: 284B total / 13B ativos MoE
Contexto — Namazu: não divulgado vs DeepSeek V4 Flash: 1M tokens (saída máxima de 384K)
Japonês — Namazu: ajustado para keigo, documentos de negócios, recusas vs DeepSeek V4 Flash: multilíngue geral
• Ferramentas — Namazu: pesquisa na web + execução de código integradas vs DeepSeek V4 Flash: chamada de funções, sem ferramentas incluídas
• Verificação — Namazu: apenas relatado pelo fornecedor vs DeepSeek V4 Flash: medido de forma independente

O que o tuning japonês realmente oferece
Toda a razão de existir da Sakana Namazu é que um modelo geral, por mais barato que seja, responde a perguntas de negócios japonesas com o registro errado e as premissas culturais erradas. O ajuste se manifesta como keigo que permanece intacto ao longo de um e-mail de negociação, jargão de setores específicos reproduzido corretamente e — segundo os números da própria Sakana — um salto de 22 pontos no FairPoliticsQA, sua avaliação interna de neutralidade política (de 34,10% a 56,30%). Esses são números relatados pelo fornecedor, mas a tese do produto pode ser testada em uma manhã: envie um e-mail de um cliente japonês em um endpoint da Sakana Namazu e em um endpoint da DeepSeek V4 Flash e perceba a diferença no tom. Para um produto voltado ao mercado japonês, essa diferença é o diferencial.
O que os números independentes dizem sobre o DeepSeek V4 Flash
A vantagem do DeepSeek V4 Flash é que suas afirmações vêm de terceiros. Rastreadores independentes lhe atribuem 90,8 no GPQA Diamond, 95,0 no τ²-Bench, 50,0 no índice Artificial Analysis Intelligence e 74,3 de recall de contexto longo em escala — números que uma equipe de compras pode de fato verificar. Seu perfil de velocidade é sua identidade: cerca de 113 tokens de saída por segundo com um tempo até o primeiro token inferior a meio segundo, que é o que "otimizado para cargas de trabalho rápidas do dia a dia" significa na prática. Ele não vencerá uma competição de raciocínio de fronteira — o índice de inteligência fica bem abaixo de um carro-chefe proprietário de ponta — mas não precisa disso por esse preço.

A lacuna de disponibilidade
Os dois modelos estão em universos de aquisição diferentes no momento. O DeepSeek V4 Flash está no OrcaRouter pela tarifa do provedor — o mesmo repasse de $0,147 / $0,295, sem margem — então o número acima é o que uma única chave de API cobra, com failover automático caso o provedor subjacente falhe. O Sakana Namazu é acessado pelo console e API próprios da Sakana e por várias plataformas de terceiros, não pelo nosso catálogo, então compare-o diretamente na tarifa divulgada. Para uma stack que fala majoritariamente inglês, mas precisa de suporte ocasional para negócios em japonês, a arquitetura honesta é usar ambos: DeepSeek V4 Flash para a carga principal, Sakana Namazu roteado para as chamadas em japonês — exatamente o tipo de mix que uma camada de roteamento que atende 200+ modelos por trás de um único endpoint foi feita para suportar.

Conclusão
Se o trabalho é linguagem de negócios japonesa, a Sakana Namazu vence na única dimensão que importa — ninguém mais ajustou um modelo para esse registro a este preço. Se o trabalho é inferência de alto volume, bem avaliada em benchmarks e rápida, a DeepSeek V4 Flash vence em todos os eixos quantificáveis: seis vezes mais barata na entrada, um contexto real de 1M e números que você pode verificar. O desempate é se "barato" significa barato para chamar ou barato para confiar.
Comparados neste artigo1
Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente
