
Sakana Namazu API: o LLM do próprio Japão pelo preço do modelo base
- metaNOVOMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenNOVOQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekNOVODeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxNOVOMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligência77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligência77Código
- grokxAI: Grok 4.52026-07-0856Inteligência72Código
- tencentTencent: Hy32026-07-0642Inteligência59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligência42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligência39Código
- anthropicAnthropic: Claude Sonnet 52026-06-3055Inteligência72Código
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligência52Código57Matemática
Sakana Namazu, a API de LLM para negócios japoneses da Sakana AI, construída sobre o Kimi K2.6 de pesos abertos da Moonshot, foi lançada em 2 de agosto de 2026 — e o número mais importante é que ela custa exatamente o que seu modelo base já custa. A Moonshot cobra US$ 0,95 por milhão de tokens de entrada e US$ 4,00 por milhão de tokens de saída pelo Kimi K2.6 em sua própria API. A Sakana cobra os mesmos US$ 0,95 / US$ 4,00 pelo Sakana Namazu, um modelo que ela pós-treinou internamente para a língua japonesa, keigo e contexto de negócios. O acréscimo total do pós-treinamento é zero dólares.
O que realmente foi lançado
A API é compatível com OpenAI: mantenha seu cliente existente, troque o base_url, defina o modelo como sakana-namazu e pronto — funciona, incluindo function calling. O que mais a diferencia de um endpoint simples de Kimi K2.6 é que a busca na web e a execução de código são integradas como ferramentas de primeira classe, e o modelo é ajustado para usá-las em um loop autônomo. A Sakana demonstrou um agente semanal de pesquisa de mercado que planeja, busca, faz verificação cruzada e escreve um relatório sem intervenção humana; um fluxo de trabalho de suporte ao cliente que agrega dados de pedidos enquanto responde a tickets; e um espetáculo de luzes com cardume de peixes que lê capturas de tela do aquário, decide o próximo motivo e o executa.
Especificações conforme publicadas:
• Modelo base — Kimi K2.6 da Moonshot AI, um MoE de pesos abertos com 1T de parâmetros / 32B ativos, pós-treinado internamente com dados japoneses próprios da Sakana
• Interface — compatível com OpenAI; nome do modelo sakana-namazu; altere a base_url e a chave de API, sem reescrever o código
• Preço — $0,95 por 1M de tokens de entrada, $4,00 por 1M de tokens de saída, $0,15 por 1M de entrada em cache; tokens de raciocínio cobrados à taxa de saída
• Ferramentas — pesquisa na web a US$ 7,00 por 1.000 chamadas, execução de código a US$ 0,12 por hora (sessão mantida), cobrado além dos tokens
• Modalidade — entrada de texto e imagem, saída de texto
Janela de contexto — não divulgada pela Sakana
• Disponibilidade — ativa via console de API da Sakana; não disponível na UE/EEE, Reino Unido ou Suíça enquanto o trabalho relacionado ao GDPR continua
Observe a lacuna de honestidade: toda afirmação de qualidade aqui é relatada pelo fornecedor. A Sakana não divulgou uma janela de contexto, não publicou números de latência ou throughput, e nenhum laboratório independente avaliou a Sakana Namazu ainda.

O salto da FairPoliticsQA é a verdadeira história.
O benchmark que a Sakana apresenta como principal é o FairPoliticsQA, uma avaliação interna da neutralidade das respostas em questões politicamente e historicamente carregadas — exatamente os tópicos em que um modelo treinado majoritariamente com a internet de um país tende a absorver o enquadramento desse país. A Sakana relata que o Sakana Namazu subiu de 34,10% para 56,30% em relação ao modelo base Kimi K2.6. É um número impressionante e é honesto questioná-lo: a avaliação é da própria Sakana, sua construção não é totalmente pública, e um salto em um benchmark de neutralidade diz tanto sobre o viés inicial do modelo base quanto sobre a correção. A direção, no entanto, é todo o ponto do produto — um LLM soberano do Japão que não responde como um chinês ou um americano.
Em outras áreas, o cenário é "manteve o serviço e um pouco mais": JFBench (seguimento de instruções em japonês) subiu 1,5% em relação ao modelo base, uma avaliação interna de tradução japonês→inglês melhorou em textos com muitos honoríficos, e AIME26, MMLU-Pro e LiveCodeBench v6 praticamente inalterados. Se o modelo base já era forte, o modelo ajustado permanecer forte enquanto melhora o comportamento em contexto japonês é exatamente o trade-off que se deseja de um esforço de pós-treinamento.

O preço é o preço do modelo básico.
É na precificação que Sakana Namazu se mostra astuto ou desesperado, e vale a pena levar ambas as leituras a sério. Cobrar o preço de tabela do modelo base significa que um desenvolvedor que compare "chamar o Kimi K2.6 diretamente" com "chamar o Sakana Namazu ajustado para o japonês" não vê nenhum prêmio pelo ajuste — o que é toda a estratégia de adoção em um único número. Isso também torna o valor óbvio para cargas de trabalho de negócios japonesas: o keigo, o jargão, a redução de recusas, a busca integrada na web e a execução de código chegam sem sobretaxa por token.
As taxas de ferramentas são a parte a observar, porque é nelas que um loop de agente realmente gasta dinheiro. Pesquisa na web a US$ 7,00 por 1.000 chamadas e execução de código a US$ 0,12 por hora parecem pequenas até que um agente de pesquisa semanal execute algumas centenas de buscas — a contagem de chamadas, não o preço do token, é o que escala. Um gateway de roteamento que repassa os preços dos provedores sem margem mantém exatamente esses números honestos: nenhuma camada de plataforma inflando o custo da ferramenta, e um corte de preço do fornecedor ativo do seu lado no mesmo dia em que é publicado. (O próprio Sakana Namazu ainda não está no catálogo da OrcaRouter — ele roda no console da Sakana — mas o princípio de repasse é o motivo pelo qual a comparação com o modelo base permanece limpa.)

As coisas que Sakana não publicou
Três lacunas importam mais do que qualquer benchmark. Primeiro, nenhuma janela de contexto — o anúncio e a página do produto da Sakana a omitem completamente, o que é incomum para uma API comercializada para uso agêntico. Segundo, nenhuma avaliação independente; o Kimi K2.6, o modelo base, é um dos modelos de pesos abertos mais bem medidos do mundo — a Artificial Analysis o classifica no topo do campo de pesos abertos — mas os deltas da Sakana Namazu são inteiramente autorrelatados. Terceiro, tratamento de dados: por padrão, suas entradas podem ser usadas para treinamento, com uma opção de exclusão no console, e o processamento não tem garantia de permanecer no Japão — vale a pena saber antes de enviar dados de clientes por meio dele.
Quem deve experimentar, quem deve esperar
Experimente se você distribui produtos ou ferramentas internas em japonês e a peça que falta é um modelo que responde como um interlocutor de negócios japonês — keigo intacto, recusas reduzidas, ferramentas de agente integradas — e você pode viver sem benchmarks independentes por um tempo. Espere se sua implantação for na UE, Reino Unido ou Suíça (não está disponível lá), se seu regime de conformidade exigir garantia de tratamento de dados somente no Japão, ou se você precisar de uma janela de contexto em torno da qual possa planejar um design de recuperação.
O que observar nas próximas semanas: um scorecard independente para Sakana Namazu em um leaderboard público, a divulgação da janela de contexto e se a restrição da UE será suspensa. Até que esses elementos cheguem, trate Sakana Namazu pelo que ela é — uma aposta séria, bem precificada e soberana do Japão que, por enquanto, só é tão boa quanto a palavra do seu criador.
