Karta tytułowa z napisem „Solar Mini 4 vs Gemma 4 12B” i podtytułem „Checkpoint, który pobierasz, i model, który wywołujesz”, osadzona na gradiencie od niebieskiego do turkusowego z logo OrcaRouter w prawym dolnym rogu.
Guides & Insights

Solar Mini 4 vs Gemma 4 12B: checkpoint, który pobierasz, i model, który wywołujesz

Autor

Magnus Corvin

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Najkrótsze uczciwe porównanie Solar Mini 4 i Gemma 4 12B polega na tym, że jeden z nich jest plikiem, a drugi punktem końcowym. Solar Mini 4 od Upstage to model typu mixture-of-experts o 35 miliardach parametrów, z 3 miliardami parametrów aktywnych na token, oknem kontekstowym o rozmiarze 512 000 tokenów i bez otwartych wag — docierasz do niego przez Upstage Console, Playground lub wdrożenie on-premises uzgodnione z dostawcą. Gemma 4 12B to gęsty checkpoint o 11,95 miliarda parametrów na licencji Apache 2.0, dostępny do pobrania już dziś, działający w około 16 GB zunifikowanej pamięci na laptopie. Oba są stworzone do pracy agentowej, oba przyjmują długi dokument jako dane wejściowe i nie konkurują o to samo miejsce w Twoim stacku, ponieważ jeden z nich ma rachunek za pamięć, a drugi za tokeny.

To rozróżnienie ginie, ponieważ oba modele wyglądają podobnie na liście funkcji. Oba rozumują, oba wywołują narzędzia, oba generują ustrukturyzowane dane wyjściowe, oba obsługują angielski, koreański i japoński. Różnice, które rozstrzygają tę kwestię, są gdzie indziej: co się dzieje o 3 w nocy, gdy system jest niedostępny, co twój zespół ds. zgodności mówi o tym, gdzie są przechowywane dane, i czy płacisz za token, czy za godzinę GPU.

Kontrast specyfikacji, wymiar po wymiarze

• Architektura — Solar Mini 4 jest rzadki: 35 mld parametrów łącznie, 3 mld aktywnych na token. Gemma 4 12B jest gęsta: każdy z jej 11,95 mld parametrów działa przy każdym tokenie. Solar przechowuje dziesięć razy więcej wag i wykonuje obliczenia przy użyciu jednej czwartej z nich; Gemma przechowuje jedną czwartą i wykonuje obliczenia przy użyciu wszystkich.

Gdzie działa — Solar Mini 4 działa w infrastrukturze Upstage (Console, Playground) lub w Twoim własnym środowisku w ramach wdrożenia on-premises. Gemma 4 12B działa na Twoim sprzęcie: około 16 GB pamięci zunifikowanej przy pełnej precyzji, bliżej 8 GB przy 4 bitach, i mieści się na pojedynczym konsumenckim GPU lub laptopie z serii M.

• Wagi — Apache 2.0 dla Gemma 4 12B, co oznacza użycie komercyjne, modyfikację i redystrybucję bez progu przychodowego. Zamknięte dla Solar Mini 4. Upstage już wcześniej publikował otwarte wagi, ale nic w tej premierze nie sugeruje, że zamierza to zrobić i tym razem.

• Kontekst — 512 000 tokenów dla Solar Mini 4, z maksymalnie 128 000 tokenów wyjścia. Gemma 4 12B ma 256 000 tokenów, a Artificial Analysis podaje 260 tys. na swojej stronie modelu. Solar jest dłuższy z tych dwóch, a różnica nie jest marginalna.

• Modalności — Gemma 4 12B to model multimodalny bez enkodera: fragmenty obrazu i dźwięk 16 kHz są rzutowane bezpośrednio w przestrzeń embeddingów modelu językowego, więc przyjmuje tekst, obraz, dźwięk i wideo, a zwraca tekst. Solar Mini 4 to tekst na wejściu, tekst na wyjściu. To jedyny wymiar, w którym Gemma wygrywa bezapelacyjnie i to z dużą przewagą.

• Cena — Solar Mini 4 ma cenę 0,10 USD za milion tokenów wejściowych i 0,40 USD za milion wyjściowych, a wejście z pamięci podręcznej kosztuje 0,01 USD; promocja startowa 50% trwa do 22 października 2026 r. Pobranie Gemma 4 12B jest bezpłatne, a Artificial Analysis podał hostowaną inferencję po 0,10 USD za wejście i 0,30 USD za wyjście za milion, gdy jego strona została zapisana 22 września 2026 r.

• Granica wiedzy — luty 2026 dla Solar Mini 4; Gemma 4 12B została wydana 3 czerwca 2026 z granicą wiedzy ze stycznia 2025. Obie są na tyle nieaktualne, że wyszukiwanie nie jest opcjonalne.

• Niezależne wyniki — Solar Mini 4 nie ma jeszcze żadnych, dzień po premierze. Gemma 4 12B ma Artificial Analysis Intelligence Index o wartości 14, sklasyfikowany na 22. miejscu spośród 142 modeli monitorowanych w swojej klasie, z szybkością 112,7 tokena wyjściowego na sekundę.

Do czego właściwie służy Gemma 4 12B

Screenshot of Artificial Analysis’s model page for Gemma 4 12B, showing its Intelligence Index score, its rank among the models tracked in its class, and its output speed.

Gemma 4 12B istnieje po to, by umieścić zdolny model multimodalny tam, gdzie masz kontrolę. Stanowisko Google przy premierze było takie, że zbliża się on do własnego modelu typu mixture-of-experts o 26B przy mniej niż połowie pamięci oraz że przewyższa Gemma 3 27B z poprzedniej generacji w rozumowaniu, nauce i zadaniach dokumentowych. Podane przez dostawcę liczby stojące za tym twierdzeniem są mocne jak na ten rozmiar: 77,2% w MMLU-Pro, 78,8% w GPQA Diamond, 94,9 w DocVQA i 88,4 w InfoVQA — to wszystko własne wyniki Google, niepotwierdzone niezależnie.

Ciekawa decyzja inżynieryjna polega na tym, że Gemma 4 12B nie ma oddzielnych enkoderów wizji ani audio. Patche obrazu są rzutowane do przestrzeni osadzeń modelu przez pojedyncze mnożenie macierzy; surowe audio trafia tam w ten sam sposób. To eliminuje koszt pamięci i opóźnień związany z uruchamianiem dwóch dodatkowych wież obok modelu językowego i dlatego model multimodalny mieści się w 16 GB. Oznacza to również, że model językowy przejmuje pracę, którą wykonałyby enkodery, co jest realnym kompromisem w przypadku drobnych szczegółów wizualnych.

Dla pracy z agentami praktyczną konsekwencją jest to, że Gemma 4 12B jest jedynym z tych dwóch modeli, który w ramach pętli potrafi odczytać zrzut ekranu, zeskanowaną stronę lub notatkę głosową. Jeśli zadanie twojego agenta polega na patrzeniu na coś, porównanie kończy się, zanim się zacznie.

Do czego tak naprawdę służy Solar Mini 4

Solar Mini 4 jest skierowany na przeciwny przypadek: pracę o wysokiej częstotliwości i wrażliwą na koszty, w której dane wejściowe są tekstem, a ich ilość jest duża. Sam Upstage opisuje to słowami „szybkość odpowiedzi i koszt mają znaczenie”, a mechanizmem jest liczba 3B aktywnych parametrów. Rzadki model o tym współczynniku jest tani w obsłudze, dlatego Upstage może podać 0,10 USD za milion tokenów wejściowych dla czegoś z oknem 512K.

Kontekst 512K to ostrzejsza broń. To ta sama wartość, jaką Upstage oferuje w Solar Pro 4, swoim flagowym modelu, co oznacza, że kompaktowy model nie jest pokrzywdzony pod względem pojemności dokumentów — 400-stronicowa umowa, pełna baza kodu, rok zgłoszeń do wsparcia. 256K w modelu Gemma 4 12B jest hojne jak na każdy normalny standard, a według tego standardu to połowa tego, co ma Solar.

Rozumowanie jest nowością w linii Mini. Modele solar-mini poprzedniej generacji całkowicie ignorują parametr reasoning_effort; Solar Mini 4 go akceptuje, a narzędzia agentowe firm trzecich zostały zaktualizowane, aby traktować go jako zdolny do rozumowania, a nie umieszczać go na liście wykluczeń. Upstage również tego samego dnia udostępniło Solar Jev, beta punkt końcowy decyzyjny obsługiwany na Solar Mini 4, który zwraca wybór, wynik lub prawdopodobieństwo bez żadnej prozy — sygnał dotyczący tego, dla jakich obciążeń Upstage uważa, że ten model jest przeznaczony.

Czego Solar Mini 4 nie ma — w momencie pisania tego tekstu — to ani jednej niezależnej liczby. Ani Intelligence Index, ani miejsca w Agent Arena, ani tabeli wyników benchmarków od Upstage — wpis w changelogu zawiera specyfikacje, a nie wyniki. Jedyną quasi-zewnętrzną liczbą w obiegu jest samodzielnie zgłoszony przez społecznościowy wrapper przebieg test400, oceniony przez inny model według podanych kryteriów oceny, w którym Solar Mini 4 uzyskał 98,4% dokładności pól przy reasoning_effort=none i średnio 1,21 sekundy na wywołanie. To porównanie jednego dewelopera z własnym harnessem i nie jest powodem do podejmowania decyzji produkcyjnej.

Porównanie, które o tym decyduje

Screenshot of Upstage’s pricing page listing Solar Mini 4’s input, cached input and output rates alongside the launch promotion window.

Jeśli masz karty GPU i powód, by trzymać dane u siebie, Gemma 4 12B tak naprawdę wcale nie konkuruje z Solar Mini 4 — konkuruje z twoim rachunkiem za prąd. Pobierasz ją raz, uruchamiasz bez końca, nie płacisz nic za token i otrzymujesz multimodalne dane wejściowe, których Solar Mini 4 nie oferuje za żadną cenę. Koszty, które pojawiają się później, mają charakter operacyjny: ktoś musi odpowiadać za stos obsługi, ktoś musi przeprowadzić aktualizację, gdy Google wyda kolejną wersję, a twoja przepustowość jest ograniczona przez to, jaki sprzęt kupiłeś.

Jeśli nie masz GPU albo masz je, a obciążenie jest skokowe, Solar Mini 4 to rozwiązanie bez kosztów kapitałowych. Płacisz 0,05 USD za milion tokenów wejściowych w ramach promocji startowej, a 0,10 USD później, otrzymujesz dwa razy większe okno kontekstowe i SLA od dostawcy zamiast pagera. Rezygnujesz z wag, danych wejściowych multimodalnych oraz możliwości odpowiedzenia na pytanie „co dzieje się z moimi danymi” słowami „nigdy nie opuszczają tego budynku”.

Porównanie cen jest bliższe, niż sugeruje nagłówek, i warto je przeprowadzić starannie. W cenie katalogowej Solar Mini 4 i hostowany Gemma 4 12B kosztują tyle samo na wejściu ($0.10), a Gemma jest tańsza na wyjściu ($0.30 wobec $0.40). W czasie promocji Upstage Solar jest o połowę tańszy w obu przypadkach. Jeśli Twoje obciążenie jest zdominowane przez wejście — długie dokumenty, krótkie odpowiedzi — przy cenie katalogowej oba rozwiązania są praktycznie na równi, a dziś Solar jest tańszy. Jeśli dominuje wyjście, Gemma jest tańsza, o ile nie trwa promocja.

Uruchamianie któregokolwiek z nich bez przebudowywania stosu

Niezręczną stroną tej decyzji jest to, że nie jest ona w oczywisty sposób odwracalna. Pobranie Gemma 4 12B wiąże cię ze stosem serwowania; przyjęcie Solar Mini 4 wiąże cię z kształtem API. Cokolwiek wybierzesz, koszt przełączenia jest tym, co powstrzymuje cię przed ponowną oceną za sześć miesięcy, a uczciwym powodem, by utrzymywać router w grze, jest utrzymanie tego kosztu blisko zera.

Jedna rzecz wymaga sprostowania: OrcaRouter nie kieruje żadnego modelu Upstage, więc Solar Mini 4 nie jest tu dostępny — pochodzi z własnego API Upstage i kilku platform zewnętrznych. Kierujemy natomiast większe rozmiary Gemma 4 od Google, czyli 26B-A4B i 31B, ale nie wersji 12B, o której traktuje ten artykuł. W tym kontekście platforma służy właściwie temu porównaniu, które robisz po tym: gdy już zdecydujesz „kompaktowy model agentowy, tekst na wejściu", ciekawym pytaniem staje się które, a na to pytanie odpowiadasz, stawiając trzy z nich za jednym kluczem i mierząc na własnym ruchu, a nie czytając kolejną specyfikację. DSL routingu, który komponuje kilka modeli w jedno wywołanie, pozwala przeprowadzić ten test bez pisania trzech integracji.

OrcaRouter scoreboard comparing Solar Mini 4 and Gemma 4 12B across six dimensions: architecture, weights, context, input modalities, price per million tokens, and Artificial Analysis Intelligence Index.

Który wybrać

Wybierz Gemma 4 12B, jeśli masz odpowiedni sprzęt, jeśli Twój agent musi patrzeć na obrazy lub słuchać dźwięku, jeśli potrzebujesz wag do dostrajania, lub jeśli odpowiedź na pytanie „gdzie trafiają dane” musi brzmieć „donikąd”. Wybierz Solar Mini 4, jeśli nie chcesz uruchamiać wnioskowania, jeśli Twoje dane wejściowe to długi tekst, a wyniki są krótkie, jeśli okno 512K ma znaczenie, lub jeśli potrzebujesz modelu zorientowanego na koreański z umową z dostawcą.

Jeśli się wahasz, rozstrzygnięciem nie jest benchmark. Jest nim pytanie, na które jeszcze nie możesz odpowiedzieć w sprawie Solar Mini 4: nikt poza Upstage go nie zmierzył. Gemma 4 12B ma Intelligence Index równy 14 i publiczny ranking; Solar Mini 4 ma kartę specyfikacji, cenę i promocję, która wygasa 22 października. Przetestowanie go w tym oknie kosztuje cię kilka dolarów. Postawienie ścieżki produkcyjnej na niego kosztuje cię przepisanie, jeśli liczby, gdy nadejdą, okażą się nieprzychylne.