
Sakana Namazu vs Gemma 4 12B : une API souveraine ou des poids que vous possédez
- metaNOUVEAUMeta: Muse Spark 1.22026-08-0557Intelligence72Code
- qwenNOUVEAUQwen: Qwen3.8 Max2026-08-0358Intelligence72Code
- deepseekNOUVEAUDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligence69Code
- minimaxNOUVEAUMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligence69Code
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligence49Code
- metaMeta: Muse Spark 1.12026-07-1653Intelligence71Code
- kimiMoonshotAI: Kimi K32026-07-1560Intelligence76Code
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligence71Code
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligence77Code
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligence77Code
- grokxAI: Grok 4.52026-07-0856Intelligence72Code
- tencentTencent: Hy32026-07-0642Intelligence59Code
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligence42Code
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligence39Code
- anthropicAnthropic: Claude Sonnet 52026-06-3055Intelligence72Code
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligence52Code57Maths
Sakana Namazu et Gemma 4 12B répondent à la même question depuis des extrémités opposées : quelle est la manière la moins chère d'obtenir un comportement de modèle de langue japonaise réellement utile ? Sakana Namazu est une API hébergée — Kimi K2.6, post-entraînée pour la culture d'entreprise japonaise, 0,95 $ / 4,00 $ par million de jetons, avec recherche web et exécution de code intégrées. Gemma 4 12B est le modèle multimodal open-weight de Google de 12 milliards de paramètres, sous licence Apache 2.0, suffisamment petit pour fonctionner sur une machine de 16 Go, et gratuit à télécharger. L'un vous demande de faire confiance à la console d'un fournisseur ; l'autre vous demande de faire confiance à votre propre matériel.
Deux réponses différentes à « où cela s'exécute »
Sakana Namazu est un produit : vous vous inscrivez, vous échangez un base_url, et le modèle — ajusté, servi, outillé — est là. Gemma 4 12B est une matière première : vous téléchargez les poids et tout ce qui suit est votre problème, du moteur d'inférence (vLLM, llama.cpp, Ollama, MLX, SGLang fonctionnent tous) au GPU. Cette différence n'est pas une note de bas de page ; elle décide de toute la comparaison. Un modèle dense de 12B relève du domaine du laptop — Google a conçu celui-ci pour fonctionner dans environ 16 Go de mémoire — ce qui fait de Gemma 4 12B le seul des deux à fonctionner hors ligne, sur une machine isolée, ou sur un appareil qui ne contacte jamais son fabricant.
Le contraste de spécification
• Prix — Sakana Namazu 0,95 $ / 4,00 $ par 1M de tokens contre Gemma 4 12B : 0 $ au téléchargement, ~0,10 $ / 0,30 $ par 1M si vous louez un hébergement.
• Poids — Namazu fermé, servi par le fournisseur vs Gemma 4 12B ouvert (Apache 2.0), auto-hébergeable, affinable
• Contexte — Namazu non divulgué vs Gemma 4 12B : 256K jetons (262 144), jusqu'à 262K de sortie
• Modalité — Namazu texte + image vs Gemma 4 12B texte, image, audio et vidéo sous forme d'images (entrée audio native)
• Japonais — Namazu optimisé pour le keigo et la culture des affaires vs Gemma 4 12B généraliste multilingue
• Vérification — Namazu : données déclarées par le fournisseur uniquement vs Gemma 4 12B mesuré indépendamment (77,2 MMLU-Pro, 78,8 GPQA Diamond selon BenchLM, août 2026)

Keigo n'est pas un benchmark.
C'est dans le domaine des langues que les deux modèles divergent réellement. Gemma 4 12B est un modèle multilingue puissant — Google l'a entraîné sur plus de 140 langues — mais multilingue ne signifie pas culturellement japonais. La mise au point de Sakana Namazu porte précisément sur le registre : des honorifiques qui résistent à un courriel formel, un jargon industriel rendu correctement, et des réponses sur une histoire politiquement sensible qui ne portent pas le cadrage d'un autre pays (le score interne FairPoliticsQA de Sakana passe de 34.10% à 56.30%). Si votre charge de travail est du texte japonais destiné aux clients, c'est une différence de produit, pas une différence de spécification. Si votre charge de travail est généraliste — résumés, classification, extraction, transcription audio — l'audio natif et le contexte plus large de Gemma 4 12B lui donnent une ampleur que Namazu ne revendique pas.
Qui voit les données
La comparaison en matière de confidentialité est nettement à l'avantage de Gemma 4 12B. Exécutez-le en local et rien ne quitte la machine : aucune télémétrie, aucune utilisation de vos données pour l'entraînement, aucune question de juridiction. Sakana Namazu, en revanche, utilise par défaut vos entrées pour l'entraînement (option de retrait disponible dans la console), ne garantit pas que le traitement soit effectué uniquement au Japon et n'est pas du tout disponible dans l'UE/EEE, au Royaume-Uni ou en Suisse. Pour une entreprise japonaise qui traite des données personnelles de clients, « le modèle réside sur notre ordinateur portable » est un argument de conformité qu'aucune API hébergée ne peut actuellement égaler. Pour une entreprise qui ne peut pas exécuter ou maintenir sa propre inférence, l'inverse est vrai : une API hébergée avec des outils intégrés est la seule option réaliste.

La question du plafond
Le véritable contrepoids aux avantages de propriété de Gemma 4 12B est la capacité. Un modèle 12B est un junior diligent : 72,0 sur LiveCodeBench v6, un plafond bas sur Humanity's Last Exam, et des problèmes de fiabilité de l'OCR de documents sur des mises en page denses. C'est un cheval de trait, pas un cerveau. Sakana Namazu hérite du socle de raisonnement de Kimi K2.6, une base de classe frontière à 1T de paramètres qu'Artificial Analysis classe en tête du domaine des poids ouverts — avec la réserve que les deltas de post-entraînement propres à Namazu sont entièrement rapportés par le fournisseur. Si vos tâches exigent un raisonnement complexe ou des agents à long horizon, un modèle 12B est une contrainte ; si vos tâches sont à grand volume et bien délimitées, c'est une aubaine.

L'appel
Choisissez Gemma 4 12B lorsque les conditions limites priment sur la capacité de pointe : des données qui ne doivent jamais quitter votre réseau, un budget plancher de zéro, un fonctionnement hors ligne, ou une charge de travail multimodale qui exige de l'audio. Choisissez Sakana Namazu lorsque la tâche concerne spécifiquement le langage des affaires japonais, ou lorsque vous avez besoin d'un comportement agentique avec des outils intégrés et que vous ne pouvez pas faire fonctionner votre propre pile d'inférence. Et notez qu'aucun de ces choix n'est une décision à une seule touche : Gemma 4 12B est un modèle à poids ouverts que vous servez vous-même, Sakana Namazu fonctionne sur la console propre de Sakana — donc une pile qui veut les deux est déjà une pile multi-modèles, c'est là qu'un routeur qui place plus de 200 modèles derrière un seul point de terminaison compatible OpenAI et bascule automatiquement cesse d'être un bonus et devient l'architecture.
