Główna karta tytułowa porównująca Sakana Namazu i Gemma 4 12B, podtytuł „Suwerenne API lub otwarte wagi, które posiadasz”, z kartami dla Sakana Namazu (hostowane API, $0.95/$4.00) i Gemma 4 12B (otwarte wagi 12B, działa na 16 GB). Logo OrcaRouter nałożone w prawym dolnym rogu.
Guides & Insights

Sakana Namazu vs Gemma 4 12B: Suwerenne API czy wagi, które posiadasz

Autor

Jim Song

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Sakana Namazu i Gemma 4 12B odpowiadają na to samo pytanie z przeciwnych stron: jaki jest najtańszy sposób na uzyskanie naprawdę przydatnych zachowań modelu języka japońskiego? Sakana Namazu to hostowane API — Kimi K2.6 dotrenowany pod japońską kulturę biznesową, $0.95 / $4.00 za milion tokenów, z wbudowanym wyszukiwaniem w sieci i wykonywaniem kodu. Gemma 4 12B to otwarty model wielomodalny Goog​le o otwartych wagach i 12 miliardach parametrów, Apache 2.0, na tyle mały, aby działać na maszynie z 16 GB RAM, i darmowy do pobrania. Jeden prosi, abyś zaufał konsoli dostawcy; drugi prosi, abyś zaufał własnemu sprzętowi.

Dwie różne odpowiedzi na pytanie „gdzie to działa”

Sakana Namazu to produkt: rejestrujesz się, podmieniasz base_url i model — dostrojony, serwowany, wyposażony w narzędzia — jest na miejscu. Gemma 4 12B to surowiec: pobierasz wagi i wszystko po tym jest twoim problemem — od silnika wnioskowania (vLLM, llama.cpp, Ollama, MLX, SGLang działają) po GPU. Ta różnica to nie przypis; decyduje o całym porównaniu. Gęsty model o 12B parametrów to terytorium laptopów — Goog​le zaprojektował go tak, aby działał w około 16 GB pamięci — co czyni Gemmę 4 12B jedynym z tych dwóch, który działa offline, na maszynie odizolowanej od sieci lub na urządzeniu, które nigdy nie wysyła danych do domu.

Kontrast specyfikacji

• Cena — Sakana Namazu $0,95 / $4,00 za 1M tokenów vs Gemma 4 12B $0 do pobrania, ~$0,10 / $0,30 za 1M jeśli wynajmiesz hosting

• Wagi — Namazu zamknięte, udostępniane przez dostawcę vs Gemma 4 12B otwarte (Apache 2.0), z możliwością samodzielnego hostowania i dostrajania

• Kontekst — Namazu nieujawniony vs Gemma 4 12B 256K tokenów (262 144), do 262K tokenów wyjściowych

• Modalność — Namazu tekst + obraz vs Gemma 4 12B tekst, obraz, audio i wideo w formie klatek (natywne wejście audio)

• Japoński — Namazu dostrojony pod keigo i kulturę biznesową vs Gemma 4 12B wielojęzyczny generalista

• Weryfikacja — Namazu: wyłącznie dane producenta, a Gemma 4 12B: pomiar niezależny (77,2 MMLU-Pro, 78,8 GPQA Diamond według BenchLM, sierpień 2026)

A two-column scoreboard comparing Sakana Namazu and Gemma 4 12B: Namazu at $0.95/$4.00, hosted on Sakana's API, undisclosed context, keigo and culture tuning, vendor FairPoliticsQA 56.3%, no independent scores; Gemma 4 12B at ~$0.10/$0.30 hosted, Apache-2.0 open weights, 256K context, runs on 16 GB RAM, MMLU-Pro 77.2%, AA Intelligence 22, independently measured. Footer notes Namazu figures are vendor-reported and Gemma figures are per BenchLM/Artificial Analysis. OrcaRouter logo composited bottom-right.

Keigo nie jest benchmarkiem

Kwestia języka to obszar, w którym te dwa modele naprawdę się różnią. Gemma 4 12B to solidny model wielojęzyczny — Goog​le trenowało go na ponad 140 językach — ale bycie wielojęzycznym nie oznacza bycia kulturowo japońskim. Dostrojenie Sakany Namazu dotyczy właśnie rejestru: honoryfikatywów, które przetrwają formalny e-mail, poprawnie oddanego żargonu branżowego oraz odpowiedzi na politycznie wrażliwe tematy historyczne, które nie niosą ze sobą narracji innego kraju (wewnętrzny wynik FairPoliticsQA firmy Sakana wzrasta z 34,10% do 56,30%). Jeśli Twoje zadania obejmują japońskie teksty kierowane do klientów, to jest to różnica w produkcie, a nie w specyfikacji. Jeśli Twoje zadania mają charakter ogólny — streszczenia, klasyfikacja, ekstrakcja, transkrypcja audio — natywna obsługa audio i większy kontekst Gemmy 4 12B zapewniają jej wszechstronność, której Namazu nie deklaruje.

Kto widzi dane

Porównanie prywatności wypada zdecydowanie na korzyść Gemmy 4 12B. Uruchamiasz ją lokalnie i nic nie opuszcza maszyny — brak telemetrii, brak oświadczeń o trenowaniu, brak pytań o jurysdykcję. Sakana Namazu z kolei domyślnie wykorzystuje Twoje dane wejściowe do trenowania (możliwość rezygnacji w konsoli), nie gwarantuje przetwarzania wyłącznie w Japonii i w ogóle nie jest dostępna w UE/EOG, Wielkiej Brytanii ani Szwajcarii. Dla japońskiej firmy przetwarzającej dane osobowe klientów (PII) stwierdzenie „model żyje na naszym laptopie” to historia zgodności, której obecnie nie może dorównać żadne hostowane API. Dla firmy, która nie może uruchomić ani utrzymać własnej inferencji, jest odwrotnie: hostowane API z wbudowanymi narzędziami to jedyna realistyczna opcja.

A pricing card for Sakana Namazu v1.0 showing $0.95 input, $4.00 output, and $0.15 cached input per 1M tokens, web search at $7.00 per 1,000 calls, code execution at $0.12 per hour, and a note that the model is not available in the EU/EEA, UK, or Switzerland and may train on inputs by default.

Pytanie o sufit

Uczciwą przeciwwagą dla przewag własnościowych Gemmy 4 12B są możliwości. Model 12B jest pracowity jak junior: 72,0 na LiveCodeBench v6, niski sufit na Humanity's Last Exam i problemy z niezawodnością OCR przy gęstych układach dokumentów. To koń roboczy, a nie mózg. Sakana Namazu dziedziczy fundament rozumowania po Kimi K2.6 — bazie klasy frontier z bilionem parametrów, którą Artificial Analysis plasuje na szczycie wśród modeli open-weight — z zastrzeżeniem, że delty z post-treningu Namazu są w całości raportowane przez producenta. Jeśli Twoje zadania wymagają trudnego rozumowania lub agentów o długim horyzoncie, model 12B jest ograniczeniem; jeśli zadania są wielkoskalowe i dobrze zdefiniowane, jest okazją.

The Hugging Face model card for google/gemma-4-12B-it in English, showing Gemma 4 12B under the Apache 2.0 license from Google DeepMind, a 12B parameter model size, and 2.97M downloads in the last month, captured August 11, 2026.

Połączenie

Wybierz Gemma 4 12B, gdy warunki brzegowe liczą się bardziej niż szczytowa wydajność: dane, które nigdy nie mogą opuścić Twojej sieci, minimalny budżet równy zero, praca offline lub multimodalne obciążenie wymagające dźwięku. Wybierz Sakana Namazu, gdy zadaniem jest konkretnie japoński język biznesowy, albo gdy potrzebujesz zachowań agentowych z wbudowanymi narzędziami i nie możesz obsługiwać własnego stosu wnioskowania. Zauważ też, że żaden z tych wyborów nie jest decyzją jednym przyciskiem: Gemma 4 12B to otwarte wagi, które serwujesz sam, a Sakana Namazu działa we własnej konsoli Sakany — więc stack, który chce obu, jest już stackiem wielomodelowym, a wtedy router, który udostępnia ponad 200 modeli za jednym punktem końcowym zgodnym z OpenAI i automatycznie przełącza się na zapasowe, przestaje być miłym dodatkiem, a staje się architekturą.

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

Skontaktuj się z nami

Dołącz do społeczności

DiscordEmailXGitHubYouTube