Titelkarte mit der Aufschrift „Solar Mini 4 vs Gemma 4 12B“ und dem Untertitel „Ein Checkpoint, den man herunterlädt, und ein Modell, das man aufruft“, auf einem Farbverlauf von Blau zu Türkis mit dem OrcaRouter-Logo unten rechts.
Guides & Insights

Solar Mini 4 vs. Gemma 4 12B: Ein Checkpoint zum Herunterladen und ein Modell zum Aufrufen

Autor

Magnus Corvin

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Der kürzeste ehrliche Vergleich von Solar Mini 4 und Gemma 4 12B ist, dass eines davon eine Datei und das andere ein Endpunkt ist. Solar Mini 4 von Upstage ist ein Mixture-of-Experts-Modell mit 35 Milliarden Parametern, von denen pro Token 3 Milliarden Parameter aktiv sind, mit einem Kontextfenster von 512.000 Token und ohne offene Gewichte – Sie erreichen es über die Upstage Console, den Playground oder ein On-Premises-Deployment, das Sie mit dem Anbieter vereinbaren. Gemma 4 12B ist ein dichter Checkpoint mit 11,95 Milliarden Parametern unter Apache 2.0, heute herunterladbar, der auf einem Laptop in ungefähr 16 GB Unified Memory läuft. Beide sind für agentische Arbeit gebaut, beide nehmen ein langes Dokument als Eingabe, und sie konkurrieren nicht um denselben Platz in Ihrem Stack, weil eines davon eine Speicherrechnung und das andere eine Token-Rechnung hat.

Dieser Unterschied geht verloren, weil die beiden Modelle in einer Funktionsliste ähnlich aussehen. Beide schlussfolgern, beide rufen Tools auf, beide erzeugen strukturierte Ausgaben, beide kommen mit Englisch, Koreanisch und Japanisch zurecht. Die Unterschiede, die die Frage entscheiden, liegen woanders: was um 3 Uhr morgens passiert, wenn das Ding ausgefallen ist, was Ihr Compliance-Team dazu sagt, wo die Daten liegen, und ob Sie pro Token oder pro GPU-Stunde bezahlen.

Der Spezifikationskontrast, Dimension für Dimension

• Architektur — Solar Mini 4 ist sparse: 35B Gesamtparameter, 3B aktiv pro Token. Gemma 4 12B ist dense: Alle seine 11,95B Parameter laufen bei jedem Token. Solar speichert zehnmal so viele Gewichte und rechnet mit einem Viertel davon; Gemma speichert ein Viertel und rechnet mit allen.

• Wo es läuft — Solar Mini 4 läuft auf der Infrastruktur von Upstage (Console, Playground) oder in Ihrer eigenen Umgebung im Rahmen einer On-Premises-Vereinbarung. Gemma 4 12B läuft auf Ihrer Hardware: etwa 16 GB Unified Memory bei voller Präzision, bei 4-Bit eher 8 GB, und es passt auf eine einzelne Consumer-GPU oder ein M-Series-Laptop.

• Gewichte — Apache 2.0 für Gemma 4 12B, was kommerzielle Nutzung, Modifikation und Weitergabe ohne Umsatzschwelle bedeutet. Geschlossen für Solar Mini 4. Upstage hat zuvor offene Gewichte veröffentlicht, aber nichts an dieser Veröffentlichung deutet darauf hin, dass es das hier plant.

• Kontext — 512.000 Token für Solar Mini 4, mit bis zu 128.000 Token Ausgabe. Gemma 4 12B hat 256.000 Token, wobei Artificial Analysis auf seiner Modellseite 260K angibt. Solar ist das längere der beiden, und der Unterschied ist nicht marginal.

• Modalitäten — Gemma 4 12B ist encoderfreies multimodales Modell: Bild-Patches und 16-kHz-Audio werden direkt in den Embedding-Raum des Sprachmodells projiziert, sodass es Text, Bild, Audio und Video entgegennimmt und Text zurückgibt. Solar Mini 4 ist Text rein, Text raus. Dies ist die einzige Dimension, in der Gemma eindeutig und mit großem Abstand gewinnt.

• Preis — Solar Mini 4 wird mit 0,10 $ pro Million Input-Tokens und 0,40 $ pro Million Output gelistet, wobei gecachter Input 0,01 $ kostet; eine 50%ige Einführungsaktion läuft bis zum 22. Oktober 2026. Gemma 4 12B kostet nichts zum Herunterladen, und Artificial Analysis listete gehostete Inferenz mit 0,10 $ Input und 0,30 $ Output pro Million, als seine Seite am 22. September 2026 erfasst wurde.

• Wissensstichtag — Februar 2026 für Solar Mini 4; Gemma 4 12B wurde am 3. Juni 2026 mit einem Wissensstichtag von Januar 2025 veröffentlicht. Beide sind so veraltet, dass Retrieval nicht optional ist.

• Unabhängige Bewertungen — Solar Mini 4 hat noch keine, einen Tag nach der Veröffentlichung. Gemma 4 12B weist einen Artificial Analysis Intelligence Index von 14 auf, rangiert auf Platz 22 von 142 Modellen, die in seiner Klasse erfasst werden, bei 112,7 Ausgabe-Tokens pro Sekunde.

Wofür Gemma 4 12B tatsächlich gut ist

Screenshot of Artificial Analysis’s model page for Gemma 4 12B, showing its Intelligence Index score, its rank among the models tracked in its class, and its output speed.

Gemma 4 12B gibt es, um ein leistungsfähiges multimodales Modell an einem Ort bereitzustellen, den Sie kontrollieren. Googles Positionierung zum Marktstart war, dass es mit weniger als der Hälfte des Speichers an das eigene 26B-Mixture-of-Experts-Modell heranreicht und dass es die Gemma 3 27B der vorherigen Generation bei Reasoning-, Wissenschafts- und Dokumentaufgaben übertrifft. Die vom Anbieter gemeldeten Zahlen hinter dieser Behauptung sind für die Größe stark: 77,2 % bei MMLU-Pro, 78,8 % bei GPQA Diamond, 94,9 bei DocVQA und 88,4 bei InfoVQA – alles eigene Zahlen von Google und nicht unabhängig reproduziert.

Die interessante Ingenieursentscheidung ist, dass Gemma 4 12B keine separaten Vision- oder Audio-Encoder hat. Bild-Patches werden durch eine einzige Matrixmultiplikation in den Einbettungsraum des Modells projiziert; rohes Audio geht denselben Weg. Das beseitigt die Speicher- und Latenzkosten für den Betrieb von zwei zusätzlichen Türmen neben dem Sprachmodell, und deshalb passt ein multimodales Modell in 16 GB. Es bedeutet außerdem, dass das Sprachmodell die Arbeit übernimmt, die die Encoder geleistet hätten, was einen echten Kompromiss bei feinen visuellen Details darstellt.

Für Agentenarbeit ist die praktische Konsequenz, dass Gemma 4 12B das einzige dieser beiden Modelle ist, das einen Screenshot, eine eingescannte Seite oder eine Sprachnotiz als Teil des Loops lesen kann. Wenn die Aufgabe deines Agenten darin besteht, sich etwas anzusehen, ist der Vergleich vorbei, bevor er überhaupt begonnen hat.

Wofür Solar Mini 4 tatsächlich ist

Solar Mini 4 zielt auf den entgegengesetzten Fall ab: hochfrequente, kostenempfindliche Arbeit, bei der die Eingabe Text ist und das Volumen groß ist. Upstages eigene Beschreibung lautet „Antwortgeschwindigkeit und Kosten sind wichtig“, und die Anzahl von 3B aktiven Parametern ist der Mechanismus. Ein Sparse-Modell mit diesem Verhältnis ist kostengünstig zu betreiben, weshalb Upstage $0,10 pro Million Eingabe-Tokens für etwas mit einem 512K-Fenster angeben kann.

Der 512K-Kontext ist die schärfere Waffe. Es ist dieselbe Zahl, die Upstage bei Solar Pro 4, seinem Flaggschiff, bietet, was bedeutet, dass beim Kompaktmodell die Dokumentkapazität nicht zu kurz kommt – ein 400-seitiger Vertrag, eine vollständige Codebasis, ein Jahr an Support-Tickets. Die 256K von Gemma 4 12B sind nach jedem normalen Maßstab großzügig und nach diesem hier die Hälfte von Solar.

Reasoning ist neu in der Mini-Reihe. Die solar-mini-Modelle der vorherigen Generation ignorieren einen reasoning_effort-Parameter schlichtweg; Solar Mini 4 akzeptiert einen, und das Agenten-Tooling von Drittanbietern wurde aktualisiert, um es als reasoning-fähig zu behandeln, statt es auf eine Denylist zu setzen. Upstage brachte am selben Tag außerdem Solar Jev heraus, einen Beta-Entscheidungsendpunkt, der auf Solar Mini 4 läuft und eine Auswahl, einen Score oder eine Wahrscheinlichkeit ganz ohne Fließtext zurückgibt — ein Signal darüber, für welche Workloads Upstage dieses Modell als gedacht ansieht.

Was Solar Mini 4 zum Zeitpunkt dieses Schreibens nicht hat, ist eine einzige unabhängige Zahl. Kein Intelligence Index, keine Platzierung in der Agent Arena und auch keine Benchmark-Tabelle von Upstage – der Changelog-Eintrag enthält Spezifikationen und keine Scores. Die einzige halbwegs von dritter Seite stammende Zahl, die im Umlauf ist, ist ein selbst gemeldeter test400-Lauf eines Community-Wrappers, bewertet von einem anderen Modell nach einer angegebenen Rubrik, bei dem Solar Mini 4 bei reasoning_effort=none eine Feldgenauigkeit von 98,4 % erreichte und durchschnittlich 1,21 Sekunden pro Aufruf benötigte. Das ist der Vergleich eines einzelnen Entwicklers mit seinem eigenen Harness und kein Grund, eine Produktionsentscheidung zu ändern.

Der Vergleich, der den Ausschlag gibt

Screenshot of Upstage’s pricing page listing Solar Mini 4’s input, cached input and output rates alongside the launch promotion window.

Wenn Sie GPUs haben und einen Grund, Daten im eigenen Haus zu behalten, konkurriert Gemma 4 12B überhaupt nicht wirklich mit Solar Mini 4 – es konkurriert mit Ihrer Stromrechnung. Sie laden es einmal herunter, Sie betreiben es dauerhaft, Sie zahlen nichts pro Token, und Sie erhalten multimodale Eingaben, die Solar Mini 4 zu keinem Preis bietet. Die Kosten, die später auftauchen, sind operativer Natur: Jemand muss den Serving-Stack verantworten, jemand muss das Upgrade bewältigen, wenn Google die nächste Version ausliefert, und Ihr Durchsatz ist durch die Hardware begrenzt, die Sie gekauft haben.

Wenn Sie keine GPUs haben oder wenn Sie welche haben und die Arbeitslast stoßweise ist, dann ist Solar Mini 4 die Variante ohne Kapitalkosten. Während der Einführungsaktion zahlen Sie 0,05 $ pro Million Input-Tokens und danach 0,10 $, Sie erhalten das doppelte Kontextfenster und statt eines Pagers ein Anbieter-SLA. Was Sie aufgeben, sind die Gewichte, die multimodale Eingabe und jede Möglichkeit, die Frage „Was passiert mit meinen Daten?“ mit „Sie verlassen dieses Gebäude nie“ zu beantworten.

Der Preisvergleich ist enger, als die Schlagzeile vermuten lässt, und es lohnt sich, ihn sorgfältig anzustellen. Zum Listenpreis kosten Solar Mini 4 und gehostetes Gemma 4 12B dasselbe bei der Eingabe (0,10 $), und Gemma ist bei der Ausgabe günstiger (0,30 $ gegenüber 0,40 $). Während der Promotion von Upstage ist Solar bei beidem halb so teuer. Wenn Ihre Arbeitslast eingabelastig ist – lange Dokumente, kurze Antworten –, sind die beiden zum Listenpreis praktisch gleichauf, und Solar ist heute günstiger. Wenn sie ausgabelastig ist, ist Gemma günstiger, es sei denn, die Promotion läuft.

Eine der beiden ausführen, ohne deinen Stack neu aufzubauen

Der unangenehme Teil dieser Entscheidung ist, dass sie nicht offensichtlich umkehrbar ist. Wer Gemma 4 12B herunterlädt, bindet sich an einen Serving-Stack; wer Solar Mini 4 übernimmt, bindet sich an eine API-Form. Was auch immer man wählt, die Wechselkosten sind das, was einen daran hindert, nach sechs Monaten neu zu bewerten, und der ehrliche Grund, einen Router im Spiel zu behalten, ist, diese Kosten nahe null zu halten.

Eine Sache muss man genau festhalten: OrcaRouter routet kein Modell von Upstage, Solar Mini 4 ist hier also nicht verfügbar — es stammt aus Upstages eigener API und mehreren Drittanbieter-Plattformen. Wir routen allerdings Googles größere Gemma-4-Größen, die 26B-A4B und die 31B, aber nicht den 12B-Checkpoint, um den es in diesem Beitrag geht. Worum es bei der Plattform in diesem Zusammenhang eigentlich geht, ist der Vergleich, den man danach anstellt: Hat man sich erst einmal für „kompaktes Agentenmodell, Texteingabe" entschieden, wird die interessante Frage, welches davon, und diese Frage beantwortet man, indem man drei davon hinter einen Schlüssel legt und am eigenen Traffic misst, statt ein weiteres Datenblatt zu lesen. Eine Routing-DSL, die mehrere Modelle zu einem einzigen Aufruf zusammenführt, ist der Weg, diesen Test durchzuführen, ohne drei Integrationen zu schreiben.

OrcaRouter scoreboard comparing Solar Mini 4 and Gemma 4 12B across six dimensions: architecture, weights, context, input modalities, price per million tokens, and Artificial Analysis Intelligence Index.

Welches soll man wählen?

Nimm Gemma 4 12B, wenn du die Hardware hast, wenn dein Agent Bilder ansehen oder Audio anhören muss, wenn du die Gewichte für Fine-Tuning brauchst oder wenn die Antwort auf „Wohin gehen die Daten?“ „Nirgendwo“ lauten muss. Nimm Solar Mini 4, wenn du keine Inferenz ausführen möchtest, wenn deine Eingaben langer Text und deine Ausgaben kurz sind, wenn ein 512K-Fenster wichtig ist oder wenn du ein Koreanisch-First-Modell brauchst, hinter dem ein Anbietervertrag steht.

Wenn Sie unentschlossen sind, gibt nicht ein Benchmark den Ausschlag. Es ist die Frage, die Sie zu Solar Mini 4 noch nicht beantworten können: Niemand außerhalb von Upstage hat es gemessen. Gemma 4 12B hat einen Intelligence Index von 14 und ein öffentliches Ranking; Solar Mini 4 hat ein Datenblatt, einen Preis und eine Aktion, die am 22. Oktober endet. Es in diesem Zeitfenster zu testen, kostet Sie ein paar Dollar. Einen Produktionspfad darauf zu setzen, kostet Sie ein Rewrite, wenn die Zahlen, sobald sie eintreffen, ungünstig ausfallen.