Une carte de titre hero pour {{1}}Sakana Namazu{{/1}} — {{2}}la propre API LLM du Japon{{/2}}, avec le sous-titre {{3}}'Basé sur Kimi K2.6, optimisé pour les entreprises japonaises — disponible le 2 août 2026'{{/3}} et des pastilles de statistiques pour {{4}}$0.95/$4.00 par 1M de jetons{{/4}}, {{5}}API compatible OpenAI{{/5}}, et {{6}}recherche web intégrée et exécution de code{{/6}}. Logo {{7}}OrcaRouter{{/7}} incrusté en bas à droite.
Engineering & Research

API Sakana Namazu : le propre LLM du Japon au prix du modèle de base

Auteur

Jim Song

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Sakana Namazu, l'API LLM métier japonais de Sakana AI, construite sur le Kimi K2.6 open-weight de Moonshot, est entrée en service le 2 août 2026 — et le chiffre le plus important est qu'elle coûte exactement le même prix que son modèle de base. Moonshot facture 0,95 $ par million de tokens d'entrée et 4,00 $ par million de tokens de sortie pour Kimi K2.6 sur sa propre API. Sakana facture les mêmes 0,95 $ / 4,00 $ pour Sakana Namazu, un modèle qu'elle a post-entraîné en interne pour la langue japonaise, le keigo et le contexte professionnel. La prime totale du post-entraînement est de zéro dollar.

Ce qui a réellement été livré

L'API est compatible OpenAI : conservez votre client existant, changez le base_url, définissez le modèle sur sakana-namazu, et tout fonctionne — y compris l'appel de fonctions. Ce qui la distingue le plus d'un simple endpoint Kimi K2.6, c'est que la recherche web et l'exécution de code sont intégrées en tant qu'outils de première classe, et que le modèle est réglé pour les utiliser en boucle autonome. Sakana a démontré un agent d'étude de marché hebdomadaire qui planifie, recherche, recoupe et rédige un rapport sans intervention humaine ; un flux de travail de support client qui agrège les données de commande tout en répondant aux tickets ; et un spectacle lumineux de banc de poissons qui lit des captures d'écran d'aquarium, décide du motif suivant et l'exécute.

Spécifications telles que publiées :

• Modèle de base — Kimi K2.6 de Moonshot AI, un MoE open-weight de 1T paramètres / 32B actifs, post-entraîné en interne sur les données japonaises propres à Sakana.

• Interface — compatible OpenAI ; nom du modèle sakana-namazu ; modifier base_url et la clé API, aucune réécriture de code

• Prix — 0,95 $ par 1M de jetons d’entrée, 4,00 $ par 1M de jetons de sortie, 0,15 $ par 1M d’entrée en cache ; les jetons de réflexion sont facturés au tarif de sortie.

• Outils — recherche web à 7,00 $ par 1 000 appels, exécution de code à 0,12 $ par heure (session conservée), facturé en plus des tokens.

• Modalité — entrée de texte et d'images, sortie de texte.

• Fenêtre de contexte — non divulguée par Sakana

• Disponibilité — en direct via la console API de Sakana ; non disponible dans l’UE/EEE, au Royaume-Uni ou en Suisse tant que le travail sur le RGPD se poursuit

Notez le décalage d'honnêteté : chaque affirmation de qualité ici provient du fournisseur. Sakana n'a pas divulgué de fenêtre de contexte, n'a pas publié de chiffres de latence ou de débit, et aucun laboratoire indépendant n'a encore noté Sakana Namazu.

A single-column scoreboard for Sakana Namazu listing the Kimi K2.6 base, $0.95/$4.00 per 1M tokens, an undisclosed context window, built-in web search and code execution, a vendor-reported FairPoliticsQA jump from 34.1% to 56.3%, and no independent scores, with a sourcing footer noting vendor-reported benchmarks. OrcaRouter logo composited bottom-right.

Le bond de FairPoliticsQA est la véritable histoire.

Le benchmark que Sakana met en avant est FairPoliticsQA, une évaluation interne de la neutralité des réponses sur des questions politiquement et historiquement chargées — précisément les sujets où un modèle entraîné en grande partie sur l'internet d'un pays tend à absorber le cadrage de ce pays. Sakana rapporte que Sakana Namazu passe de 34,10 % à 56,30 % par rapport au modèle de base Kimi K2.6. C'est un chiffre frappant, et il est honnête de l'interroger : l'évaluation est propre à Sakana, sa construction n'est pas entièrement publique, et un bond sur un benchmark de neutralité en dit autant sur le biais initial du modèle de base que sur la correction apportée. La direction, cependant, est tout l'intérêt du produit — un LLM à souveraineté japonaise qui ne répond pas comme un modèle chinois ou américain.

Ailleurs, le tableau est « tenir le service, et même un peu plus » : JFBench (suivi d'instructions en japonais) en hausse de 1,5 % par rapport au modèle de base, une évaluation interne de traduction japonais-anglais améliorée sur des textes à forte teneur en titres honorifiques, et AIME26, MMLU-Pro et LiveCodeBench v6 à peu près inchangés. Si le modèle de base était déjà solide, le modèle ajusté qui reste solide tout en améliorant le comportement en contexte japonais est exactement le compromis que l'on attend d'un effort de post-entraînement.

A pricing card for Sakana Namazu v1.0 showing $0.95 input, $4.00 output, and $0.15 cached input per 1M tokens, web search at $7.00 per 1,000 calls, code execution at $0.12 per hour, and a note that the model is not available in the EU/EEA, UK, or Switzerland and may train on inputs by default.

Le prix est celui du modèle de base.

La fixation des prix est l’endroit où Sakana Namazu se montre soit habile, soit désespéré, et il vaut la peine de prendre ces deux lectures au sérieux. Facturer le prix catalogue du modèle de base signifie qu’un développeur qui compare « appeler Kimi K2.6 directement » à « appeler le Sakana Namazu ajusté pour le japonais » ne voit aucune prime pour l’ajustement — ce qui résume toute la stratégie d’adoption en un seul chiffre. Cela rend aussi la valeur évidente pour les charges de travail japonaises : le keigo, le jargon, la réduction des refus, la recherche web intégrée et l’exécution de code arrivent sans surcharge par jeton.

Les frais d'outils sont la partie à surveiller, car c'est là qu'une boucle agentique dépense réellement de l'argent. La recherche web à 7,00 $ pour 1 000 appels et l'exécution de code à 0,12 $ de l'heure semblent dérisoires jusqu'à ce qu'un agent de recherche hebdomadaire lance quelques centaines de recherches — c'est le nombre d'appels, et non le prix des jetons, qui augmente à l'échelle. Une passerelle de routage qui transmet les prix des fournisseurs sans marge maintient exactement ces chiffres honnêtes : aucune couche de plateforme ne gonfle le coût des outils, et une baisse de prix d'un fournisseur apparaît en direct chez vous le jour même où elle est publiée. (Sakana Namazu lui-même n'est pas encore au catalogue d'OrcaRouter — il fonctionne sur la console propre de Sakana — mais c'est le principe de répercussion qui explique pourquoi la comparaison avec le modèle de base reste fiable.)

The Artificial Analysis page for Kimi K2.6 in English, showing an Intelligence Index of 45, first-party pricing of $0.95/$4.00 per 1M tokens, and a note that Moonshot has since launched Kimi K3, captured August 11, 2026.

Ce que Sakana n'a pas publié

Trois lacunes comptent plus que n'importe quel benchmark. Premièrement, pas de fenêtre de contexte — l'annonce de Sakana et la page produit l'omettent entièrement, ce qui est inhabituel pour une API commercialisée pour un usage agentique. Deuxièmement, aucune évaluation indépendante ; Kimi K2.6, le modèle de base, est l'un des modèles open-weight les mieux mesurés au monde — Artificial Analysis le classe en tête du domaine open-weight — mais les deltas de Sakana Namazu sont entièrement auto-déclarés. Troisièmement, la gestion des données : par défaut, vos entrées peuvent être utilisées pour l'entraînement, avec une option de désactivation dans la console, et rien ne garantit que le traitement reste au Japon — bon à savoir avant d'y envoyer des données clients.

Qui devrait l'essayer, qui devrait attendre

Essayez-le si vous commercialisez des produits ou des outils internes en japonais et qu'il vous manque un modèle qui répond comme un interlocuteur commercial japonais — keigo intact, refus réduits, outils agentiques intégrés — et si vous pouvez vous passer de benchmarks indépendants pendant un certain temps. Attendez si votre déploiement se situe dans l'UE, au Royaume-Uni ou en Suisse (il n'y est pas disponible), si votre régime de conformité exige un traitement des données garanti uniquement au Japon, ou si vous avez besoin d'une fenêtre de contexte autour de laquelle vous pouvez planifier une architecture de récupération.

Ce qu’il faut surveiller dans les prochaines semaines : un tableau de bord indépendant pour Sakana Namazu sur un classement public, la divulgation d’une fenêtre de contexte, et la question de savoir si la restriction de l’UE sera levée. En attendant, considérez Sakana Namazu pour ce qu’il est — un pari sérieux, bien tarifé, sur le Japon souverain, qui ne vaut actuellement que la parole de son créateur.

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

Contactez-nous

Rejoignez notre communauté

DiscordEmailXGitHubYouTube