
Solar Mini vs. Qwen3.8-Max: Was die letzten zwanzig Indexpunkte tatsächlich kosten
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 pro 1 Mio. Tokens
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 pro 1 Mio. Tokens · 159 tok/s
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 220 tok/s
- OpenAINEUOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAINEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAINEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Solar Mini 4 kostet 0,10 $ pro Million Input-Tokens und 0,40 $ pro Million Output-Tokens. Qwen3.8-Max, das Modell, das die meisten meinen, wenn sie „Qwen 3.8“ eintippen und nach der API fragen, kostet 2,00 $ und 6,00 $. Auf einer Preisliste liest sich das als zwanzigfacher Unterschied beim Input-Preis. In der unabhängigen Evaluierung, die beide Modelle inzwischen durchlaufen haben, lautet die ehrliche Zahl: Qwen3.8-Max erreicht 45,4 im Artificial Analysis Intelligence Index gegenüber 24,1 bei Solar Mini 4 – rund die doppelte gemessene Leistungsfähigkeit – kostet aber pro abgeschlossener Aufgabe etwa fünfzehnmal so viel. Alles Wissenswerte über diese Paarung steckt in der Kluft zwischen diesen beiden Verhältnissen – und in der Tatsache, dass Upstages Modell 204 Tokens pro Sekunde schafft, während Alibabas Flaggschiff auf 39 kommt.
Eine Anmerkung zur Namensgebung vor den Zahlen, denn sie ändert, was Sie kaufen. Qwen 3.8 ist eine Generation, kein Modell: Das gehostete Flaggschiff ist Qwen3.8-Max, aktualisiert als datierter 0902-Snapshot, und das herunterladbare Mitglied derselben Generation ist Qwen3.8-2.4T-A95B, die 2,4-Billionen-Parameter-Gewichte, die Alibaba am 12. August 2026 veröffentlicht hat. Solar Mini 4, veröffentlicht am 22. September 2026, ist Upstages Sparse-Mixture-of-Experts mit 35 Milliarden Parametern, bei dem pro Token etwa 3 Milliarden Parameter aktiv sind und das keine offenen Gewichte hat, egal zu welchem Preis.
Die beiden Spalten, zu den Dimensionen, die die Beschaffung entscheiden
• Intelligence Index — 45,4 für Qwen3.8-Max (0902) gegenüber 24,1 für Solar Mini 4, beide Intelligence Index v4.3.2.
• Kosten pro abgeschlossener Aufgabe — 5,41 $ für Qwen3.8-Max gegenüber 0,36 $ für Solar Mini 4. Etwa fünfzehn zu eins, und das Verhältnis, das niemand zitiert.
• Preisliste — 2,00 $ / 6,00 $ pro Million Tokens, gecachte Eingabe 0,25 $, für Qwen3.8-Max gegenüber 0,10 $ / 0,40 $, gecachte Eingabe 0,01 $, für Solar Mini 4.
• Kontext – 1.000.000 Token bei beiden, die einzige Dimension, in der das günstige Modell nichts preisgibt. Artificial Analysis listet 983.616 für Qwen3.8-Max und 1.048.576 für Solar Mini 4; Upstages eigene Dokumentation nennt 512K, das Limit des kleinen Modells ist also das unsicherere der beiden.
• Gewichte — Qwen3.8-Max ist proprietär und wird gehostet; sein offenes Schwestermodell Qwen3.8-2.4T-A95B ist unter einer eigenen Lizenz herunterladbar und erreicht 39,9 auf demselben Index bei 262.000 Token Kontext. Solar Mini 4 ist proprietär und hat kein offenes Schwestermodell.
• Durchsatz — 204 Ausgabe-Tokens pro Sekunde für Solar Mini 4 gegenüber 39,5 für Qwen3.8-Max, gemessen vom selben Labor. Das Modell, das pro Aufgabe ein Fünfzehntel so viel kostet, ist dabei fünfmal schneller.
Was einundzwanzig Indexpunkte kaufen

Sie kaufen das schwierige Ende der Verteilung. Bei Humanity's Last Exam beantwortet Qwen3.8-Max 43,1 % der Aufgaben korrekt, gegenüber 25,8 % bei Solar Mini 4. Beim wissenschaftlichen Programmieren sind es 52,1 % gegenüber 47,6 %. Bei agentischer Wissensarbeit weitet sich die Lücke zu einer anderen Kategorie: Qwen3.8-Max erreicht 1663 Elo auf GDPval-AA, wo Solar Mini 4 1072 erreicht — fast sechshundert Elo-Punkte, was keine Rundungsdifferenz ist, sondern eine Veränderung dessen, was dem Modell unbeaufsichtigt zugetraut werden kann.
Die einzige Bewertung, bei der das kleine Modell nicht nur mithält, sondern gewinnt, ist das Reasoning über lange Kontexte. Solar Mini 4 erzielt 83,3 % bei AA-LCR v1.1 und Qwen3.8-Max erzielt 80,3 %. Das ist das stärkste Argument für Solar Mini 4 in diesem gesamten Vergleich: Bei dem Benchmark, der dafür entwickelt wurde, „ein sehr langes Dokument zu lesen und darüber zu schlussfolgern“, erkauft das Fünfzehnfache des Preises pro Aufgabe ein Ergebnis, das drei Punkte schlechter ist.
Der Bereich, in dem keines der beiden Modelle das richtige Instrument ist, ist autonome Terminalarbeit. Solar Mini 4 erreicht 1 % bei Terminal-Bench 4.0; Qwen3.8-Max erreicht 38,9 %. Ein Modell, das acht von zwanzig schwierigen Terminal-Aufgaben löst, ist dort wirklich brauchbar, das andere nicht – was in diesem Vergleich das klarste Beispiel für einen Unterschied der Art und nicht des Grades ist.
Warum die Abrechnung pro Aufgabe des Flaggschiffs so viel schlechter ist, als sein Token-Preis suggeriert
Qwen3.8-Max erzeugt pro Aufgabe mehr Ausgabe als Solar Mini 4 — 107.700 Tokens gegenüber 88.300 — und erzeugt sie zu $6.00 pro Million statt zu $0.40. Das ist bereits der größte Teil der Lücke, noch bevor das Cache-Verhalten betrachtet wird. Alibaba bietet zwar einen Preis von $0.25 für gecachte Eingaben, was ein echter Rabatt gegenüber seinem Eingabepreis von $2.00 ist, und das offene Geschwistermodell der Familie, Qwen3.8-2.4T-A95B, ist ein Sparse-Modell mit 2,4 Billionen Parametern und etwa 95 Milliarden aktiven Parametern, sodass jedes von ihm erzeugte Token von einer deutlich größeren Maschine erzeugt wird. Nichts davon ist eine Kritik. Es ist der Grund, warum es einen fünfzehnfachen Multiplikator pro Aufgabe gibt, und der Grund, warum ein Preisvergleich pro Token zwischen diesen beiden Modellen in beide Richtungen irreführend ist.
Die praktische Konsequenz: Solar Mini 4 ist nicht „das Budget-Qwen 3.8“. Es ist ein Spezialist, der zufällig günstig, schnell und stark auf genau einer Achse ist – langen Dokumenten – und schwach auf der Achse, bei der Fehler am teuersten sind – der agentischen Zuverlässigkeit. Qwen3.8-Max ist der Generalist, dessen Vorteil sich genau dort zeigt, wo eine falsche Antwort teuer ist.
Das Paar laufen lassen, statt zwischen ihnen zu wählen.
Dies ist der ungewöhnliche Fall in der Solar-Mini-4-Reihe, in dem beide Seiten des Vergleichs Routen sind, die wir Ihnen tatsächlich anbieten können. Qwen3.8-Max und sein datierter 0902-Snapshot laufen auf OrcaRouter zum eigenen Listenpreis des Anbieters von 2,00 $ / 6,00 $, gemeinsam mit Qwen3.8-Flash zu 0,15 $ / 0,47 $ und Qwen3.8-27B zu 0,33 $ / 2,40 $ — drei Stufen derselben Generation, ein Schlüssel, kein zweiter Vertrag und keine Codeänderung über einen Modellstring hinaus. Stand 1. Oktober 2026 ergibt unsere eigene Playground-Messung für Qwen3.8-Max einen p50 von 2,5 Sekunden bei 87,7 Ausgabe-Tokens pro Sekunde über die zurückliegenden sieben Tage; dieses Fenster ist rollierend, lesen Sie also die Live-Modellkarte statt diesen Satz. Die Modelle von Upstage sind über uns nicht verfügbar, und Solar Mini 4 ist nur über die eigene API von Upstage erreichbar.

Was das möglich macht, ist die Aufteilung, für die dieser Vergleich argumentiert: Schicken Sie den Verkehr für lange Dokumente, koreanische Sprache und strukturierte Extraktion an eine günstige Stelle, leiten Sie die reasoning-intensiven und Werkzeuge nutzenden Anfragen an das Flaggschiff weiter und lassen Sie das Failover den Anbieter abdecken, der einen schlechten Nachmittag hat. Es ist auch der Punkt, an dem die Routing-DSL ihren Platz verdient – Modelle zu einem einzigen Aufruf zusammenzusetzen bedeutet, dass ein günstiger erster Durchlauf und ein teurer Verifizierungsdurchlauf eine Anfrage an einen einzigen Endpunkt sein können statt zwei Integrationen, die synchron gehalten werden müssen.
Die Kurzfassung

Wenn Ihre Workload aus langem Kontext, einer festen Ausgabeform und einem tolerierbaren Latenzbudget besteht, liefert Ihnen Solar Mini 4 83 % des Langkontext-Ergebnisses zu einem Fünfzehntel der Aufgabenkosten und mit fünffachem Durchsatz, und die einundzwanzig fehlenden Indexpunkte werden nie auf Ihrem Dashboard erscheinen. Wenn Ihre Workload Tools, mehrstufige Agenten oder Fragen umfasst, bei denen eine selbstsichere falsche Antwort schlimmer ist als gar keine Antwort, sind die fehlenden Punkte das gesamte Produkt, und Qwen3.8-Max ist das Fünfzehnfache des Preises wert. Jede oben genannte Zahl, die Artificial Analysis zugeschrieben wird, ist die unabhängige Messung dieser Organisation; die Namensgebung und die Veröffentlichungstermine von Qwen3.8 stammen von Alibaba, und die Serving-Zahlen von OrcaRouter sind unsere eigene Playground-Messung über ein rollierendes Sieben-Tage-Fenster.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
