Um cartão de título hero para Sakana Namazu — a própria API de LLM do Japão, com o subtítulo 'Construído sobre Kimi K2.6, ajustado para negócios japoneses — ao vivo em 2 de agosto de 2026' e chips de estatísticas para US$ 0,95/US$ 4,00 por 1M de tokens, API compatível com OpenAI e busca na web e execução de código integradas. Logotipo da OrcaRouter composto no canto inferior direito.
Engineering & Research

Sakana Namazu API: o LLM do próprio Japão pelo preço do modelo base

Autor

Jim Song

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Sakana Namazu, a API de LLM para negócios japoneses da Sakana AI, construída sobre o Kimi K2.6 de pesos abertos da Moonshot, foi lançada em 2 de agosto de 2026 — e o número mais importante é que ela custa exatamente o que seu modelo base já custa. A Moonshot cobra US$ 0,95 por milhão de tokens de entrada e US$ 4,00 por milhão de tokens de saída pelo Kimi K2.6 em sua própria API. A Sakana cobra os mesmos US$ 0,95 / US$ 4,00 pelo Sakana Namazu, um modelo que ela pós-treinou internamente para a língua japonesa, keigo e contexto de negócios. O acréscimo total do pós-treinamento é zero dólares.

O que realmente foi lançado

A API é compatível com OpenAI: mantenha seu cliente existente, troque o base_url, defina o modelo como sakana-namazu e pronto — funciona, incluindo function calling. O que mais a diferencia de um endpoint simples de Kimi K2.6 é que a busca na web e a execução de código são integradas como ferramentas de primeira classe, e o modelo é ajustado para usá-las em um loop autônomo. A Sakana demonstrou um agente semanal de pesquisa de mercado que planeja, busca, faz verificação cruzada e escreve um relatório sem intervenção humana; um fluxo de trabalho de suporte ao cliente que agrega dados de pedidos enquanto responde a tickets; e um espetáculo de luzes com cardume de peixes que lê capturas de tela do aquário, decide o próximo motivo e o executa.

Especificações conforme publicadas:

• Modelo base — Kimi K2.6 da Moonshot AI, um MoE de pesos abertos com 1T de parâmetros / 32B ativos, pós-treinado internamente com dados japoneses próprios da Sakana

• Interface — compatível com OpenAI; nome do modelo sakana-namazu; altere a base_url e a chave de API, sem reescrever o código

• Preço — $0,95 por 1M de tokens de entrada, $4,00 por 1M de tokens de saída, $0,15 por 1M de entrada em cache; tokens de raciocínio cobrados à taxa de saída

• Ferramentas — pesquisa na web a US$ 7,00 por 1.000 chamadas, execução de código a US$ 0,12 por hora (sessão mantida), cobrado além dos tokens

• Modalidade — entrada de texto e imagem, saída de texto

Janela de contexto — não divulgada pela Sakana

• Disponibilidade — ativa via console de API da Sakana; não disponível na UE/EEE, Reino Unido ou Suíça enquanto o trabalho relacionado ao GDPR continua

Observe a lacuna de honestidade: toda afirmação de qualidade aqui é relatada pelo fornecedor. A Sakana não divulgou uma janela de contexto, não publicou números de latência ou throughput, e nenhum laboratório independente avaliou a Sakana Namazu ainda.

A single-column scoreboard for Sakana Namazu listing the Kimi K2.6 base, $0.95/$4.00 per 1M tokens, an undisclosed context window, built-in web search and code execution, a vendor-reported FairPoliticsQA jump from 34.1% to 56.3%, and no independent scores, with a sourcing footer noting vendor-reported benchmarks. OrcaRouter logo composited bottom-right.

O salto da FairPoliticsQA é a verdadeira história.

O benchmark que a Sakana apresenta como principal é o FairPoliticsQA, uma avaliação interna da neutralidade das respostas em questões politicamente e historicamente carregadas — exatamente os tópicos em que um modelo treinado majoritariamente com a internet de um país tende a absorver o enquadramento desse país. A Sakana relata que o Sakana Namazu subiu de 34,10% para 56,30% em relação ao modelo base Kimi K2.6. É um número impressionante e é honesto questioná-lo: a avaliação é da própria Sakana, sua construção não é totalmente pública, e um salto em um benchmark de neutralidade diz tanto sobre o viés inicial do modelo base quanto sobre a correção. A direção, no entanto, é todo o ponto do produto — um LLM soberano do Japão que não responde como um chinês ou um americano.

Em outras áreas, o cenário é "manteve o serviço e um pouco mais": JFBench (seguimento de instruções em japonês) subiu 1,5% em relação ao modelo base, uma avaliação interna de tradução japonês→inglês melhorou em textos com muitos honoríficos, e AIME26, MMLU-Pro e LiveCodeBench v6 praticamente inalterados. Se o modelo base já era forte, o modelo ajustado permanecer forte enquanto melhora o comportamento em contexto japonês é exatamente o trade-off que se deseja de um esforço de pós-treinamento.

A pricing card for Sakana Namazu v1.0 showing $0.95 input, $4.00 output, and $0.15 cached input per 1M tokens, web search at $7.00 per 1,000 calls, code execution at $0.12 per hour, and a note that the model is not available in the EU/EEA, UK, or Switzerland and may train on inputs by default.

O preço é o preço do modelo básico.

É na precificação que Sakana Namazu se mostra astuto ou desesperado, e vale a pena levar ambas as leituras a sério. Cobrar o preço de tabela do modelo base significa que um desenvolvedor que compare "chamar o Kimi K2.6 diretamente" com "chamar o Sakana Namazu ajustado para o japonês" não vê nenhum prêmio pelo ajuste — o que é toda a estratégia de adoção em um único número. Isso também torna o valor óbvio para cargas de trabalho de negócios japonesas: o keigo, o jargão, a redução de recusas, a busca integrada na web e a execução de código chegam sem sobretaxa por token.

As taxas de ferramentas são a parte a observar, porque é nelas que um loop de agente realmente gasta dinheiro. Pesquisa na web a US$ 7,00 por 1.000 chamadas e execução de código a US$ 0,12 por hora parecem pequenas até que um agente de pesquisa semanal execute algumas centenas de buscas — a contagem de chamadas, não o preço do token, é o que escala. Um gateway de roteamento que repassa os preços dos provedores sem margem mantém exatamente esses números honestos: nenhuma camada de plataforma inflando o custo da ferramenta, e um corte de preço do fornecedor ativo do seu lado no mesmo dia em que é publicado. (O próprio Sakana Namazu ainda não está no catálogo da OrcaRouter — ele roda no console da Sakana — mas o princípio de repasse é o motivo pelo qual a comparação com o modelo base permanece limpa.)

The Artificial Analysis page for Kimi K2.6 in English, showing an Intelligence Index of 45, first-party pricing of $0.95/$4.00 per 1M tokens, and a note that Moonshot has since launched Kimi K3, captured August 11, 2026.

As coisas que Sakana não publicou

Três lacunas importam mais do que qualquer benchmark. Primeiro, nenhuma janela de contexto — o anúncio e a página do produto da Sakana a omitem completamente, o que é incomum para uma API comercializada para uso agêntico. Segundo, nenhuma avaliação independente; o Kimi K2.6, o modelo base, é um dos modelos de pesos abertos mais bem medidos do mundo — a Artificial Analysis o classifica no topo do campo de pesos abertos — mas os deltas da Sakana Namazu são inteiramente autorrelatados. Terceiro, tratamento de dados: por padrão, suas entradas podem ser usadas para treinamento, com uma opção de exclusão no console, e o processamento não tem garantia de permanecer no Japão — vale a pena saber antes de enviar dados de clientes por meio dele.

Quem deve experimentar, quem deve esperar

Experimente se você distribui produtos ou ferramentas internas em japonês e a peça que falta é um modelo que responde como um interlocutor de negócios japonês — keigo intacto, recusas reduzidas, ferramentas de agente integradas — e você pode viver sem benchmarks independentes por um tempo. Espere se sua implantação for na UE, Reino Unido ou Suíça (não está disponível lá), se seu regime de conformidade exigir garantia de tratamento de dados somente no Japão, ou se você precisar de uma janela de contexto em torno da qual possa planejar um design de recuperação.

O que observar nas próximas semanas: um scorecard independente para Sakana Namazu em um leaderboard público, a divulgação da janela de contexto e se a restrição da UE será suspensa. Até que esses elementos cheguem, trate Sakana Namazu pelo que ela é — uma aposta séria, bem precificada e soberana do Japão que, por enquanto, só é tão boa quanto a palavra do seu criador.

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

Fale conosco

Junte-se à comunidade

DiscordEmailXGitHubYouTube