Eine Hero-Titelkarte, die Sakana Namazu und Gemma 4 12B vergleicht, mit dem Untertitel „Eine souveräne API oder Open Weights, die Ihnen gehören", mit Karten für Sakana Namazu (gehostete API, 0,95 $/4,00 $) und Gemma 4 12B (12B Open Weights, läuft auf 16 GB). OrcaRouter-Logo unten rechts eingeblendet.
Guides & Insights

Sakana Namazu vs Gemma 4 12B: Eine souveräne API oder Gewichte, die Sie besitzen

Autor

Jim Song

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Sakana Namazu und Gemma 4 12B beantworten dieselbe Frage von entgegengesetzten Enden: Was ist der günstigste Weg, um wirklich nützliches Verhalten japanischsprachiger Modelle zu erhalten? Sakana Namazu ist eine gehostete API — Kimi K2.6, nachtrainiert für die japanische Geschäftskultur, 0,95 $ / 4,00 $ pro Million Tokens, mit integrierter Websuche und Codeausführung. Gemma 4 12B ist Goog​les Open-Weight-Multimodell mit 12 Milliarden Parametern, Apache 2.0, klein genug, um auf einem 16-GB-Rechner zu laufen, und kostenlos zum Herunterladen. Das eine verlangt, dass Sie der Konsole eines Anbieters vertrauen; das andere, dass Sie Ihrer eigenen Hardware vertrauen.

Zwei verschiedene Antworten auf „Wo läuft das?"

Sakana Namazu ist ein Produkt: Du meldest dich an, tauschst eine base_url aus, und das Modell — abgestimmt, bereitgestellt, mit Tools ausgestattet — ist da. Gemma 4 12B ist Rohmaterial: Du holst dir die Gewichte, und alles danach ist dein Problem, von der Inferenz-Engine (vLLM, llama.cpp, Ollama, MLX, SGLang funktionieren alle) bis zur GPU. Dieser Unterschied ist keine Fußnote; er entscheidet über den gesamten Vergleich. Ein 12B-Dense-Modell ist Laptop-Territorium — Google hat dieses Modell so ausgelegt, dass es in etwa 16 GB Arbeitsspeicher läuft — was Gemma 4 12B zu dem einzigen der beiden macht, das offline, auf einer abgeschotteten Maschine oder auf einem Gerät funktioniert, das nie nach Hause telefoniert.

Der Spec-Kontrast

• Preis — Sakana Namazu 0,95 $ / 4,00 $ pro 1 Mio. Token im Vergleich zu Gemma 4 12B 0 $ zum Herunterladen, ~0,10 $ / 0,30 $ pro 1 Mio., wenn Sie Hosting mieten

• Gewichte — Namazu geschlossen, vom Anbieter bereitgestellt vs. Gemma 4 12B offen (Apache 2.0), selbst hostbar, feinabstimmbar

• Kontext — Namazu nicht offengelegt vs. Gemma 4 12B 256K Tokens (262,144), bis zu 262K Ausgabe

• Modalität — Namazu Text + Bild vs. Gemma 4 12B Text, Bild, Audio und Video-als-Frames (nativer Audio-Eingang)

Japanisch — Namazu, für Keigo und Geschäftskultur optimiert, vs. Gemma 4 12B, multilingualer Generalist

• Verifizierung — Namazu nur vom Anbieter gemeldet vs. Gemma 4 12B unabhängig gemessen (77,2 MMLU-Pro, 78,8 GPQA Diamond laut BenchLM, August 2026)

A two-column scoreboard comparing Sakana Namazu and Gemma 4 12B: Namazu at $0.95/$4.00, hosted on Sakana's API, undisclosed context, keigo and culture tuning, vendor FairPoliticsQA 56.3%, no independent scores; Gemma 4 12B at ~$0.10/$0.30 hosted, Apache-2.0 open weights, 256K context, runs on 16 GB RAM, MMLU-Pro 77.2%, AA Intelligence 22, independently measured. Footer notes Namazu figures are vendor-reported and Gemma figures are per BenchLM/Artificial Analysis. OrcaRouter logo composited bottom-right.

Keigo ist kein Benchmark.

Die Sprachgeschichte ist der Punkt, an dem sich die beiden Modelle wirklich unterscheiden. Gemma 4 12B ist ein starkes mehrsprachiges Modell – Goog​le hat es mit über 140 Sprachen trainiert –, aber mehrsprachig ist nicht dasselbe wie kulturell japanisch. Das Feintuning von Sakana Namazu zielt speziell auf die Stilebene ab: Höflichkeitsformen, die eine formelle E-Mail überstehen, korrekt wiedergegebene Branchenterminologie und Antworten zu politisch sensibler Geschichte, die nicht die Framing eines anderen Landes übernehmen (Sakanas interner FairPoliticsQA-Wert springt von 34,10 % auf 56,30 %). Wenn Ihre Arbeitslast aus japanischem, kundenorientiertem Text besteht, ist das ein Produktunterschied, kein Spezifikationsunterschied. Wenn Ihre Arbeitslast allgemeiner Natur ist – Zusammenfassungen, Klassifizierung, Extraktion, Audiotranskription –, dann verleihen Gemma 4 12Bs natives Audio und der größere Kontext ihm eine Breite, die Namazu nicht für sich beansprucht.

Wer sieht die Daten?

Der Datenschutzvergleich fällt klar zugunsten von {{1}}Gemma 4 12B{{/1}} aus. Bei lokaler Ausführung verlässt nichts die Maschine — keine Telemetrie, keine Trainingsnutzung, keine Zuständigkeitsfragen. {{2}}Sakana Namazu{{/2}} hingegen verwendet Ihre Eingaben standardmäßig für das Training (Opt-out in der Konsole verfügbar), garantiert nicht, dass die Verarbeitung ausschließlich in Japan erfolgt, und ist in der EU/im EWR, im Vereinigten Königreich und in der Schweiz überhaupt nicht verfügbar. Für ein japanisches Unternehmen, das personenbezogene Kundendaten (PII) verarbeitet, ist „Das Modell lebt auf unserem Laptop“ eine Compliance-Geschichte, die keine gehostete API derzeit erreichen kann. Für ein Unternehmen, das keine eigene Inferenz betreiben oder warten kann, gilt das Gegenteil: Eine gehostete API mit integrierten Tools ist die einzig realistische Option.

A pricing card for Sakana Namazu v1.0 showing $0.95 input, $4.00 output, and $0.15 cached input per 1M tokens, web search at $7.00 per 1,000 calls, code execution at $0.12 per hour, and a note that the model is not available in the EU/EEA, UK, or Switzerland and may train on inputs by default.

Die Deckenfrage

Das ehrliche Gegengewicht {{1}}zu den Besitzvorteilen von Gemma 4 12B{{/1}} ist die Leistungsfähigkeit. Ein 12B-Modell ist ein fleißiger Junior: {{2}}72,0 bei LiveCodeBench v6, eine niedrige Obergrenze bei Humanity's Last Exam und Dokument-OCR-Zuverlässigkeitsprobleme bei dichten Layouts.{{/2}} Es ist ein Arbeitstier, kein Gehirn. Sakana Namazu erbt das Reasoning-Fundament von Kimi K2.6, einem Basismodell der Spitzenklasse mit 1 Billion Parametern, das Artificial Analysis an der Spitze des Open-Weight-Bereichs einordnet — {{3}}mit der Einschränkung, dass Namazus eigene Post-Training-Deltas vollständig auf Anbieterangaben beruhen.{{/3}} Wenn Ihre Aufgaben anspruchsvolles Reasoning oder langfristige Agenten umfassen, ist ein 12B-Modell eine Einschränkung; {{4}}wenn Ihre Aufgaben ein hohes Volumen haben und klar abgegrenzt sind, ist es ein Schnäppchen.{{/4}}

The Hugging Face model card for google/gemma-4-12B-it in English, showing Gemma 4 12B under the Apache 2.0 license from Google DeepMind, a 12B parameter model size, and 2.97M downloads in the last month, captured August 11, 2026.

Der Anruf.

Wählen Sie Gemma 4 12B, wenn die Randbedingungen wichtiger sind als die Spitzenleistung: Daten, die Ihr Netzwerk niemals verlassen dürfen, ein Budget von null, Offline-Betrieb oder eine multimodale Workload, die Audio benötigt. Wählen Sie Sakana Namazu, wenn es speziell um japanische Geschäftssprache geht oder wenn Sie agentisches Verhalten mit integrierten Tools benötigen und keinen eigenen Inferenz-Stack betreiben können. Und beachten Sie: Keine der beiden ist eine Entscheidung auf Knopfdruck. Gemma 4 12B ist Open Weights, die Sie selbst hosten, Sakana Namazu läuft in Sakanas eigener Konsole – ein Stack, der beides will, ist also bereits ein Multi-Modell-Stack. Genau hier hört ein Router, der 200+ Modelle hinter einem einzigen OpenAI-kompatiblen Endpoint bereitstellt und automatisches Failover bietet, auf, ein Nice-to-have zu sein, und wird zur Architektur.

© 2026 OrcaRouter

Für Anbieter

Sie betreiben eine Inferenz-Plattform? Bringen Sie Ihre Modelle auf OrcaRouter.

Kontaktieren Sie uns

Community beitreten

DiscordEmailXGitHubYouTube