Een hero-titelkaart die Sakana Namazu en Gemma 4 12B vergelijkt, ondertitel 'Een soevereine API of open gewichten die je zelf bezit', met kaarten voor Sakana Namazu (gehoste API, $0.95/$4.00) en Gemma 4 12B (12B open gewichten, draait op 16 GB). OrcaRouter-logo rechtsonder samengesteld.
Guides & Insights

Sakana Namazu vs Gemma 4 12B: Een soevereine API of gewichten die je zelf bezit

Auteur

Jim Song

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Sakana Namazu en Gemma 4 12B beantwoorden dezelfde vraag vanuit tegenovergestelde hoeken: wat is de goedkoopste manier om echt nuttig Japans-talig modelgedrag te verkrijgen? Sakana Namazu is een gehoste API — Kimi K2.6 verder getraind voor de Japanse zakencultuur, $0.95 / $4.00 per miljoen tokens, met ingebouwde webzoekopdracht en code-uitvoering. Gemma 4 12B is Goog​le's open-weight multimodale model met 12 miljard parameters, Apache 2.0, klein genoeg om te draaien op een machine met 16 GB, en gratis te downloaden. De een vraagt je een console van een leverancier te vertrouwen; de ander vraagt je je eigen hardware te vertrouwen.

Twee verschillende antwoorden op "waar draait dit"

Sakana Namazu is een product: je meldt je aan, vervangt een base_url, en het model — getuned, geserveerd, en van tools voorzien — is er. Gemma 4 12B is grondstof: je haalt de gewichten op en alles daarna is jouw probleem, van de inferentie-engine (vLLM, llama.cpp, Ollama, MLX, SGLang werken allemaal) tot de GPU. Dat verschil is geen voetnoot; het bepaalt de hele vergelijking. Een dense 12B-model is laptopterritorium — Goog​le heeft dit model ontworpen om in ongeveer 16 GB geheugen te draaien — wat Gemma 4 12B de enige van deze twee maakt die offline werkt, op een netwerkgeïsoleerde machine, of op een apparaat dat nooit naar huis belt.

Het specificatiecontrast

• Prijs — Sakana Namazu $0.95 / $4.00 per 1M tokens tegenover Gemma 4 12B $0 om te downloaden, ~$0.10 / $0.30 per 1M als je hosting huurt

• Gewichten — Namazu gesloten, door leverancier aangeboden, versus Gemma 4 12B open (Apache 2.0), zelf te hosten, fijn af te stemmen.

• Context — Namazu niet bekendgemaakt vs Gemma 4 12B 256K tokens (262.144), tot 262K output

• Modaliteit — Namazu tekst + afbeelding vs Gemma 4 12B tekst, afbeelding, audio, en video-als-frames (native audio-ingang)

• Japans — Namazu afgestemd op keigo en zakelijke cultuur versus Gemma 4 12B meertalige generalist

• Verificatie — Namazu alleen door leverancier opgegeven versus Gemma 4 12B onafhankelijk gemeten (77.2 MMLU-Pro, 78.8 GPQA Diamond volgens BenchLM, augustus 2026)

A two-column scoreboard comparing Sakana Namazu and Gemma 4 12B: Namazu at $0.95/$4.00, hosted on Sakana's API, undisclosed context, keigo and culture tuning, vendor FairPoliticsQA 56.3%, no independent scores; Gemma 4 12B at ~$0.10/$0.30 hosted, Apache-2.0 open weights, 256K context, runs on 16 GB RAM, MMLU-Pro 77.2%, AA Intelligence 22, independently measured. Footer notes Namazu figures are vendor-reported and Gemma figures are per BenchLM/Artificial Analysis. OrcaRouter logo composited bottom-right.

Keigo is geen benchmark

Het verhaal over taal is waar de twee modellen echt uiteenlopen. {{1}}Gemma 4 12B is een sterk meertalig model — Goog​le trainde het in meer dan 140 talen — maar meertalig is niet hetzelfde als cultureel Japans.{{/1}} De afstemming van Sakana Namazu draait specifiek om register: {{2}}beleefdheidsvormen die een formele e-mail overleven, branchejargon correct weergegeven, en antwoorden over politiek gevoelige geschiedenis die niet de framing van een ander land bevatten (Sakana's interne FairPoliticsQA-score springt van 34,10% naar 56,30%).{{/2}} Als je workload Japanse klantgerichte tekst is, is dat een productverschil, geen specificatieverschil. Als je workload algemeen van aard is — samenvattingen, classificatie, extractie, audiotranscriptie — geven de native audio en de grotere context van Gemma 4 12B het een breedte die Namazu niet claimt.

Wie ziet de data

De privacyvergelijking valt duidelijk in het voordeel van Gemma 4 12B uit. Draai je het lokaal, dan verlaat er niets de machine — geen telemetrie, geen trainingsclaims, geen jurisdictievragen. Sakana Namazu gebruikt je invoer daarentegen standaard voor training (uitschakelen kan in de console), garandeert niet dat verwerking uitsluitend in Japan plaatsvindt, en is in de EU/EER, het VK of Zwitserland helemaal niet beschikbaar. Voor een Japans bedrijf dat klant-PII verwerkt, is "het model draait op onze laptop" een compliance-verhaal waar geen enkele gehoste API momenteel aan kan tippen. Voor een bedrijf dat geen eigen inferentie kan draaien of onderhouden, geldt het omgekeerde: een gehoste API met ingebouwde tools is de enige realistische optie.

A pricing card for Sakana Namazu v1.0 showing $0.95 input, $4.00 output, and $0.15 cached input per 1M tokens, web search at $7.00 per 1,000 calls, code execution at $0.12 per hour, and a note that the model is not available in the EU/EEA, UK, or Switzerland and may train on inputs by default.

De plafondvraag

Het eerlijke tegenwicht tegen de eigendomsvoordelen van Gemma 4 12B is de bekwaamheid. Een 12B-model is een ijverige junior: 72,0 op LiveCodeBench v6, een laag plafond op Humanity's Last Exam, en betrouwbaarheidsproblemen met document-OCR bij dichte lay-outs. Het is een werkpaard, geen brein. Sakana Namazu erft de redeneerbasis van Kimi K2.6, een frontier-model met 1 biljoen parameters dat Artificial Analysis bovenaan het open-weight-veld plaatst — met de kanttekening dat Namazu's eigen post-training-deltas volledig door de leverancier zijn gerapporteerd. Als uw taken bestaan uit moeilijke redeneringen of agents met een lange horizon, is een 12B-model een beperking; als uw taken een hoog volume hebben en goed afgebakend zijn, is het een koopje.

The Hugging Face model card for google/gemma-4-12B-it in English, showing Gemma 4 12B under the Apache 2.0 license from Google DeepMind, a 12B parameter model size, and 2.97M downloads in the last month, captured August 11, 2026.

De oproep

Kies Gemma 4 12B wanneer de randvoorwaarden belangrijker zijn dan piekcapaciteit: data die je netwerk nooit mogen verlaten, een budgetvloer van nul, offline werking, of een multimodale workload die audio nodig heeft. Kies Sakana Namazu wanneer het specifiek om Japanse zakentaal gaat, of wanneer je agentisch gedrag nodig hebt met ingebouwde tools en je geen eigen inferencestack kunt draaien. En onthoud dat geen van beide een beslissing op basis van één criterium is: Gemma 4 12B heeft open gewichten die je zelf serveert, Sakana Namazu draait op Sakana's eigen console — dus een stack die beide wil, is al een multimodelstack, en dat is het punt waarop een router die 200+ modellen via één OpenAI-compatibel endpoint ontsluit en automatisch failover uitvoert, ophoudt een nice-to-have te zijn en de architectuur zelf wordt.

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

Neem contact op

Word lid van de community

DiscordEmailXGitHubYouTube