
Solar Mini 4 vs Qwen3.8-Max: Vad de sista tjugo indexpoängen faktiskt kostar
- openaiNYOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 per 1M tokens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 per 1M tokens · 159 tok/s
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 220 tok/s
- OpenAINYOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAINYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
Solar Mini 4 kostar 0,10 USD per miljon indatatokens och 0,40 USD per miljon utdatatokens. Qwen3.8-Max, modellen som de flesta menar när de skriver "Qwen 3.8" och ber om API:et, kostar 2,00 USD och 6,00 USD. I en prislista framstår det som en tjugofaldig skillnad i indatapris. I den oberoende utvärdering som båda modellerna nu har genomgått, är den ärliga siffran att Qwen3.8-Max får 45,4 på Artificial Analysis Intelligence Index mot Solar Mini 4:s 24,1 — ungefär dubbelt så hög uppmätt kapacitet — samtidigt som den kostar ungefär femton gånger så mycket per slutförd uppgift. Allt som är värt att veta om det här paret finns i gapet mellan dessa två kvoter, och i det faktum att Upstages modell presterar 204 tokens per sekund medan Alibabas flaggskepp presterar 39.
En notering om namngivning före siffrorna, eftersom den ändrar vad du köper. Qwen 3.8 är en generation, inte en modell: den hostade flaggskeppsmodellen är Qwen3.8-Max, uppdaterad som en daterad 0902-snapshot, och den nedladdningsbara medlemmen i samma generation är Qwen3.8-2.4T-A95B, vikterna med 2,4 biljoner parametrar som Alibaba publicerade den 12 augusti 2026. Solar Mini 4, som släpptes den 22 september 2026, är Upstages glesa mixture-of-experts-modell med 35 miljarder parametrar, med omkring 3 miljarder aktiva parametrar per token och inga öppna vikter oavsett pris.
De två kolumnerna, på de dimensioner som avgör upphandling
• Intelligence Index — 45,4 för Qwen3.8-Max (0902) mot 24,1 för Solar Mini 4, båda Intelligence Index v4.3.2.
• Kostnad per slutförd uppgift — $5.41 för Qwen3.8-Max mot $0.36 för Solar Mini 4. Ungefär femton till ett, och förhållandet som ingen nämner.
• Prislista — 2,00 $ / 6,00 $ per miljon tokens, cachad indata 0,25 $, för Qwen3.8-Max mot 0,10 $ / 0,40 $, cachad indata 0,01 $, för Solar Mini 4.
• Kontext — 1 000 000 tokens för båda, vilket är den enda dimensionen där den billiga modellen inte står något efter. Artificial Analysis listar 983 616 för Qwen3.8-Max och 1 048 576 för Solar Mini 4; Upstages egen dokumentation anger 512K, så den lilla modellens tak är det mindre säkra av de två.
• Vikter — Qwen3.8-Max är proprietär och värdbaserad; dess öppna syskon Qwen3.8-2.4T-A95B kan laddas ner under en anpassad licens och får 39,9 på samma index vid 262 000 tokens kontext. Solar Mini 4 är proprietär utan något öppet syskon.
• Genomströmning — 204 utdatatokens per sekund för Solar Mini 4 mot 39,5 för Qwen3.8-Max, mätt av samma labb. Modellen som kostar en femtonde så mycket per uppgift är fem gånger snabbare på att göra det.
Vad tjugoen indexpunkter köper

De köper den hårda änden av distributionen. På Humanity's Last Exam svarar Qwen3.8-Max rätt på 43,1 % av uppgifterna, mot Solar Mini 4:s 25,8 %. Inom vetenskaplig kodning är det 52,1 % mot 47,6 %. Inom agentiskt kunskapsarbete vidgas gapet till en annan kategori: Qwen3.8-Max når 1663 Elo på GDPval-AA, där Solar Mini 4 klarar 1072 – nästan sexhundra Elo-poäng, vilket inte är en avrundningsskillnad utan en förändring i vad modellen kan förväntas göra utan tillsyn.
Den enda utvärderingen där den lilla modellen inte bara står sig utan vinner är resonemang över långa kontexter. Solar Mini 4 får 83,3 % på AA-LCR v1.1 och Qwen3.8-Max får 80,3 %. Det är det starkaste argumentet för Solar Mini 4 i hela den här jämförelsen: på benchmarken som byggts för att testa "läsa ett mycket långt dokument och resonera över det" ger femton gånger priset per uppgift ett resultat som är tre punkter sämre.
Området där ingen av modellerna är rätt instrument är autonomt terminalarbete. Solar Mini 4 får 1 % på Terminal-Bench 4.0; Qwen3.8-Max får 38,9 %. En modell som klarar åtta av tjugo svåra terminaluppgifter är verkligen användbar där och den andra är det inte, vilket är det tydligaste exemplet i den här jämförelsen på en skillnad i art snarare än i grad.
Varför flaggskeppets nota per uppgift är så mycket sämre än vad dess tokenpris antyder
Qwen3.8-Max genererar mer utdata per uppgift än vad Solar Mini 4 gör — 107 700 token mot 88 300 — och den genererar dem till 6,00 dollar per miljon i stället för 0,40 dollar. Det är större delen av gapet redan där, innan cachebeteende ens beaktas. Alibaba erbjuder visserligen en taxa på 0,25 dollar för cachad indata, vilket är en verklig rabatt jämfört med dess pris på 2,00 dollar för indata, och familjens öppna syskonmodell, Qwen3.8-2.4T-A95B, är en gles modell med 2,4 biljoner parametrar och omkring 95 miljarder aktiva parametrar, så varje token den producerar produceras av en betydligt större maskin. Inget av detta är kritik. Det är anledningen till att det finns en femtonfaldig multiplikator per uppgift, och anledningen till att en prisjämförelse per token mellan dessa två modeller är missvisande i båda riktningarna.
Den praktiska konsekvensen: Solar Mini 4 är inte "budget-Qwen 3.8". Det är en specialist som råkar vara billig, snabb och stark på exakt en axel — långa dokument — och svag på den axel där ett misstag kostar mest, nämligen agentisk tillförlitlighet. Qwen3.8-Max är generalisten vars fördel visar sig just där ett felaktigt svar är dyrt.
Att köra båda istället för att välja mellan dem
Detta är det ovanliga fallet i Solar Mini 4-serien där båda sidor av jämförelsen är rutter vi faktiskt kan sälja till dig. Qwen3.8-Max och dess daterade 0902-ögonblicksbild finns på OrcaRouter till leverantörens eget listpris på $2.00 / $6.00, tillsammans med Qwen3.8-Flash för $0.15 / $0.47 och Qwen3.8-27B för $0.33 / $2.40 — tre nivåer av samma generation, en nyckel, inget andra avtal och ingen kodändring utöver en modellsträng. Per den 1 oktober 2026 visar vår egen mätning i playgrounden att Qwen3.8-Max ligger på en p50 på 2,5 sekunder med 87,7 utdatatokens per sekund under de senaste sju dagarna; det fönstret rullar, så läs det aktuella modellkortet i stället för den här meningen. Upstages modeller är inte tillgängliga via oss, och Solar Mini 4 måste nås via Upstages eget API.

Vad det möjliggör är den uppdelning som den här jämförelsen argumenterar för: skicka trafiken för långa dokument, koreanska och strukturerad extrahering någonstans billigt, dirigera de resonemangstunga och verktygsanvändande förfrågningarna till flaggskeppet, och låt failover täcka leverantören som har en dålig eftermiddag. Det är också där routing-DSL:en förtjänar sin plats — att komponera modeller till ett enda anrop innebär att ett billigt första pass och ett dyrt verifieringspass kan vara en enda förfrågan mot en enda slutpunkt i stället för två integrationer som måste hållas i synk.
Den korta versionen

Om din arbetsbelastning är lång, med en fast utdataform och en tolerabel latensbudget, ger Solar Mini 4 dig 83 % av långkontextresultatet till en femtondedel av kostnaden för uppgiften och fem gånger genomströmningen, och de tjugoen saknade indexpoängen kommer aldrig att synas på din instrumentpanel. Om din arbetsbelastning involverar verktyg, flerstegsagenter eller frågor där ett självsäkert felaktigt svar är värre än inget svar, är de saknade poängen hela produkten, och Qwen3.8-Max är värd femton gånger priset. Varje siffra ovan som tillskrivs Artificial Analysis är den organisationens oberoende mätning; namngivningen och releasedatumen för Qwen3.8 är Alibabas, och OrcaRouters serving-siffror är vår egen playground-mätning över ett rullande sjudagarsfönster.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
