
Solar Mini 4 vs Qwen3.8-Max: Wat de laatste twintig indexpunten werkelijk kosten
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 per 1 mln tokens
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 per 1 mln tokens · 159 tok/s
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 220 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Solar Mini 4 kost $0,10 per miljoen inputtokens en $0,40 per miljoen outputtokens. Qwen3.8-Max, het model dat de meeste mensen bedoelen wanneer ze "Qwen 3.8" typen en om de API vragen, kost respectievelijk $2,00 en $6,00. Op een tariefkaart leest dat als een twintigvoudig verschil in de inputprijs. Bij de onafhankelijke evaluatie die beide modellen inmiddels hebben ondergaan, is het eerlijke cijfer dat Qwen3.8-Max 45,4 scoort op de Artificial Analysis Intelligence Index, tegenover 24,1 voor Solar Mini 4 — ruwweg twee keer de gemeten capaciteit — terwijl het per voltooide taak ongeveer vijftien keer zoveel kost. Alles wat de moeite waard is om te weten over deze combinatie zit in de kloof tussen die twee ratio's, en in het feit dat het model van Upstage op 204 tokens per seconde draait, terwijl het vlaggenschip van Alibaba op 39 draait.
Eén opmerking over de naamgeving voordat we bij de cijfers komen, want het verandert wat je koopt. Qwen 3.8 is een generatie, geen model: het gehoste vlaggenschip is Qwen3.8-Max, vernieuwd als een gedateerde 0902-snapshot, en het downloadbare lid van dezelfde generatie is Qwen3.8-2.4T-A95B, de gewichten met 2,4 biljoen parameters die Alibaba op 12 augustus 2026 publiceerde. Solar Mini 4, uitgebracht op 22 september 2026, is de sparse mixture-of-experts van Upstage met 35 miljard parameters, waarvan ongeveer 3 miljard parameters per token actief zijn, en heeft geen open gewichten, tegen welke prijs dan ook.
De twee kolommen, over de dimensies die de inkoop bepalen
• Intelligence Index — 45,4 voor Qwen3.8-Max (0902) tegenover 24,1 voor Solar Mini 4, beide Intelligence Index v4.3.2.
• Kosten per voltooide taak — $5,41 voor Qwen3.8-Max tegenover $0,36 voor Solar Mini 4. Ongeveer vijftien tegen één, en de verhouding die niemand noemt.
• Tariefkaart — $2,00 / $6,00 per miljoen tokens, gecachte invoer $0,25, voor Qwen3.8-Max tegenover $0,10 / $0,40, gecachte invoer $0,01, voor Solar Mini 4.
• Context — 1.000.000 tokens bij beide, en dat is de enige dimensie waarop het goedkope model niets toegeeft. Artificial Analysis vermeldt 983.616 voor Qwen3.8-Max en 1.048.576 voor Solar Mini 4; Upstage's eigen documentatie zegt 512K, dus het plafond van het kleine model is van de twee het minst zeker.
• Gewichten — Qwen3.8-Max is propriëtair en gehost; zijn open zustermodel Qwen3.8-2.4T-A95B is downloadbaar onder een aangepaste licentie en scoort 39,9 op dezelfde index bij een context van 262.000 tokens. Solar Mini 4 is propriëtair en heeft geen open zustermodel.
• Doorvoer — 204 uitvoertokens per seconde voor Solar Mini 4 tegenover 39,5 voor Qwen3.8-Max, zoals gemeten door hetzelfde lab. Het model dat per taak een vijftiende kost, is vijf keer sneller in het uitvoeren ervan.
Wat eenentwintig indexpunten kopen

Ze kopen het moeilijke uiteinde van de verdeling. Op Humanity's Last Exam beantwoordt Qwen3.8-Max 43,1% van de items correct, tegenover 25,8% voor Solar Mini 4. Op wetenschappelijk programmeren scoort het 52,1% tegenover 47,6%. Bij agentisch kenniswerk wordt de kloof zo groot dat het een andere categorie wordt: Qwen3.8-Max bereikt 1663 Elo op GDPval-AA, waar Solar Mini 4 1072 haalt — bijna zeshonderd Elo-punten, wat geen afrondingsverschil is, maar een verandering in wat het model zonder toezicht betrouwbaar kan doen.
De enige evaluatie waarin het kleine model niet alleen standhoudt, maar wint, is redeneren over lange contexten. Solar Mini 4 scoort 83,3% op AA-LCR v1.1 en Qwen3.8-Max scoort 80,3%. Dat is het sterkste argument voor Solar Mini 4 in deze hele vergelijking: op de benchmark die is gebouwd om te testen "lees een zeer lang document en redeneer over de hele tekst heen", levert een vijftien keer zo hoge prijs per taak een resultaat op dat drie punten slechter is.
Waar geen van beide modellen het juiste instrument is, is autonoom terminalwerk. Solar Mini 4 scoort 1% op Terminal-Bench 4.0; Qwen3.8-Max scoort 38,9%. Een model dat acht van de twintig moeilijke terminaltaken haalt, is daar echt bruikbaar, en het andere niet, wat in deze vergelijking het duidelijkste voorbeeld is van een verschil in soort in plaats van in mate.
Waarom de rekening per taak van het vlaggenschip zoveel slechter uitvalt dan de tokenprijs doet vermoeden
Qwen3.8-Max produceert per taak meer output dan Solar Mini 4 — 107.700 tokens tegenover 88.300 — en genereert ze tegen $6,00 per miljoen in plaats van $0,40. Dat is daar al het grootste deel van het verschil, nog voordat er naar cachegedrag wordt gekeken. Alibaba biedt inderdaad een tarief van $0,25 voor gecachte input, wat een echte korting is ten opzichte van de inputprijs van $2,00, en het open zustermodel in de familie, Qwen3.8-2.4T-A95B, is een sparse model met 2,4 biljoen parameters waarvan ongeveer 95 miljard parameters actief zijn, dus elke token die het produceert, wordt geproduceerd door een aanzienlijk grotere machine. Niets daarvan is kritiek. Het is de reden dat er een vijftienvoudige per-taakvermenigvuldiger bestaat, en de reden dat een prijsvergelijking per token tussen deze twee modellen in beide richtingen misleidend is.
De praktische consequentie: Solar Mini 4 is niet "de budget-Qwen 3.8". Het is een specialist die toevallig goedkoop, snel en sterk is op precies één as — lange documenten — en zwak op de as waar fouten het duurst zijn, namelijk agentische betrouwbaarheid. Qwen3.8-Max is de generalist wiens voordeel precies daar blijkt waar een verkeerd antwoord duur is.
Het paar draaien in plaats van tussen beide te kiezen
Dit is het ongebruikelijke geval in de Solar Mini 4-serie waarin beide kanten van de vergelijking routes zijn die we je daadwerkelijk kunnen verkopen. Qwen3.8-Max en zijn gedateerde 0902-snapshot staan op OrcaRouter tegen de eigen lijstprijs van de leverancier van $2,00 / $6,00, naast Qwen3.8-Flash tegen $0,15 / $0,47 en Qwen3.8-27B tegen $0,33 / $2,40 — drie treden van dezelfde generatie, één sleutel, geen tweede contract en geen codewijziging verder dan een modelstring. Per 1 oktober 2026 zet onze eigen playground-meting Qwen3.8-Max op een p50 van 2,5 seconden met 87,7 outputtokens per seconde over de afgelopen zeven dagen; dat venster schuift, dus lees de actuele modelkaart in plaats van deze zin. De modellen van Upstage zijn niet via ons beschikbaar, en Solar Mini 4 moet via de eigen API van Upstage worden benaderd.

Wat dat mogelijk maakt, is de splitsing waar deze vergelijking voor pleit: stuur het verkeer voor lange documenten, Koreaanse taal en gestructureerde extractie naar iets goedkoops, routeer de redeneerintensieve en tools gebruikende verzoeken naar het vlaggenschip, en laat failover de provider opvangen die een slechte middag heeft. Het is ook waar de routing-DSL zijn plek verdient — modellen samenstellen tot één aanroep betekent dat een goedkope eerste pass en een dure verificatiepass één verzoek tegen één endpoint kunnen zijn in plaats van twee integraties die synchroon moeten worden gehouden.
De korte versie

Als het bij je workload gaat om lange context, een vaste outputvorm en een acceptabel latentiebudget, levert Solar Mini 4 je 83% van het resultaat voor lange context tegen een vijftiende van de taakkosten en vijf keer de doorvoer, en de eenentwintig ontbrekende indexpunten zullen nooit op je dashboard verschijnen. Als je workload tools, meerstapsagenten of vragen omvat waarbij een zelfverzekerd onjuist antwoord erger is dan geen antwoord, dan zijn de ontbrekende punten het hele product, en is Qwen3.8-Max vijftien keer de prijs waard. Elk cijfer dat hierboven aan Artificial Analysis wordt toegeschreven, is de onafhankelijke meting van die organisatie; de naamgeving en releasedata van Qwen3.8 zijn van Alibaba, en de OrcaRouter-servingcijfers zijn onze eigen playground-meting over een voortschuivend venster van zeven dagen.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
