Ett genererat hero-titelkort med texten ”Solar Mini 4 vs Qwen3.8-Max”, underrubriken ”Vad de sista tjugo indexpoängen faktiskt kostade” och två märken med texten ”24,1 mot 45,4 på indexet” och ”0,36 $ mot 5,41 $ per uppgift”.
Guides & Insights

Solar Mini 4 vs Qwen3.8-Max: Vad de sista tjugo indexpoängen faktiskt kostar

Författare

Magnus Corvin

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Solar Mini 4 kostar 0,10 USD per miljon indatatokens och 0,40 USD per miljon utdatatokens. Qwen3.8-Max, modellen som de flesta menar när de skriver "Qwen 3.8" och ber om API:et, kostar 2,00 USD och 6,00 USD. I en prislista framstår det som en tjugofaldig skillnad i indatapris. I den oberoende utvärdering som båda modellerna nu har genomgått, är den ärliga siffran att Qwen3.8-Max får 45,4 på Artificial Analysis Intelligence Index mot Solar Mini 4:s 24,1 — ungefär dubbelt så hög uppmätt kapacitet — samtidigt som den kostar ungefär femton gånger så mycket per slutförd uppgift. Allt som är värt att veta om det här paret finns i gapet mellan dessa två kvoter, och i det faktum att Upstages modell presterar 204 tokens per sekund medan Alibabas flaggskepp presterar 39.

En notering om namngivning före siffrorna, eftersom den ändrar vad du köper. Qwen 3.8 är en generation, inte en modell: den hostade flaggskeppsmodellen är Qwen3.8-Max, uppdaterad som en daterad 0902-snapshot, och den nedladdningsbara medlemmen i samma generation är Qwen3.8-2.4T-A95B, vikterna med 2,4 biljoner parametrar som Alibaba publicerade den 12 augusti 2026. Solar Mini 4, som släpptes den 22 september 2026, är Upstages glesa mixture-of-experts-modell med 35 miljarder parametrar, med omkring 3 miljarder aktiva parametrar per token och inga öppna vikter oavsett pris.

De två kolumnerna, på de dimensioner som avgör upphandling

• Intelligence Index — 45,4 för Qwen3.8-Max (0902) mot 24,1 för Solar Mini 4, båda Intelligence Index v4.3.2.

• Kostnad per slutförd uppgift — $5.41 för Qwen3.8-Max mot $0.36 för Solar Mini 4. Ungefär femton till ett, och förhållandet som ingen nämner.

• Prislista — 2,00 $ / 6,00 $ per miljon tokens, cachad indata 0,25 $, för Qwen3.8-Max mot 0,10 $ / 0,40 $, cachad indata 0,01 $, för Solar Mini 4.

• Kontext — 1 000 000 tokens för båda, vilket är den enda dimensionen där den billiga modellen inte står något efter. Artificial Analysis listar 983 616 för Qwen3.8-Max och 1 048 576 för Solar Mini 4; Upstages egen dokumentation anger 512K, så den lilla modellens tak är det mindre säkra av de två.

• Vikter — Qwen3.8-Max är proprietär och värdbaserad; dess öppna syskon Qwen3.8-2.4T-A95B kan laddas ner under en anpassad licens och får 39,9 på samma index vid 262 000 tokens kontext. Solar Mini 4 är proprietär utan något öppet syskon.

• Genomströmning — 204 utdatatokens per sekund för Solar Mini 4 mot 39,5 för Qwen3.8-Max, mätt av samma labb. Modellen som kostar en femtonde så mycket per uppgift är fem gånger snabbare på att göra det.

Vad tjugoen indexpunkter köper

A two-column comparison scoreboard titled 'Solar Mini 4 vs Qwen3.8-Max', subtitled 'Roughly twice the capability at about fifteen times the task cost'. Solar Mini 4: Intelligence Index 24.05; cost per index task $0.36; rate card per 1M $0.10 in / $0.40 out; cached input $0.01 per 1M; context 1.05M listed and 512K claimed; output speed 204 tokens per second; output per task 88,300 tokens; long-context reasoning 83.3% on AA-LCR v1.1. Qwen3.8-Max: Intelligence Index 45.42; cost per index task $5.41; rate card per 1M $2.00 in / $6.00 out; cached input $0.25 per 1M; context 983,616; output speed 39.5 tokens per second; output per task 107,700 tokens; long-context reasoning 80.3% on AA-LCR v1.1.

De köper den hårda änden av distributionen. På Humanity's Last Exam svarar Qwen3.8-Max rätt på 43,1 % av uppgifterna, mot Solar Mini 4:s 25,8 %. Inom vetenskaplig kodning är det 52,1 % mot 47,6 %. Inom agentiskt kunskapsarbete vidgas gapet till en annan kategori: Qwen3.8-Max når 1663 Elo på GDPval-AA, där Solar Mini 4 klarar 1072 – nästan sexhundra Elo-poäng, vilket inte är en avrundningsskillnad utan en förändring i vad modellen kan förväntas göra utan tillsyn.

Den enda utvärderingen där den lilla modellen inte bara står sig utan vinner är resonemang över långa kontexter. Solar Mini 4 får 83,3 % på AA-LCR v1.1 och Qwen3.8-Max får 80,3 %. Det är det starkaste argumentet för Solar Mini 4 i hela den här jämförelsen: på benchmarken som byggts för att testa "läsa ett mycket långt dokument och resonera över det" ger femton gånger priset per uppgift ett resultat som är tre punkter sämre.

Området där ingen av modellerna är rätt instrument är autonomt terminalarbete. Solar Mini 4 får 1 % på Terminal-Bench 4.0; Qwen3.8-Max får 38,9 %. En modell som klarar åtta av tjugo svåra terminaluppgifter är verkligen användbar där och den andra är det inte, vilket är det tydligaste exemplet i den här jämförelsen på en skillnad i art snarare än i grad.

Varför flaggskeppets nota per uppgift är så mycket sämre än vad dess tokenpris antyder

Qwen3.8-Max genererar mer utdata per uppgift än vad Solar Mini 4 gör — 107 700 token mot 88 300 — och den genererar dem till 6,00 dollar per miljon i stället för 0,40 dollar. Det är större delen av gapet redan där, innan cachebeteende ens beaktas. Alibaba erbjuder visserligen en taxa på 0,25 dollar för cachad indata, vilket är en verklig rabatt jämfört med dess pris på 2,00 dollar för indata, och familjens öppna syskonmodell, Qwen3.8-2.4T-A95B, är en gles modell med 2,4 biljoner parametrar och omkring 95 miljarder aktiva parametrar, så varje token den producerar produceras av en betydligt större maskin. Inget av detta är kritik. Det är anledningen till att det finns en femtonfaldig multiplikator per uppgift, och anledningen till att en prisjämförelse per token mellan dessa två modeller är missvisande i båda riktningarna.

Den praktiska konsekvensen: Solar Mini 4 är inte "budget-Qwen 3.8". Det är en specialist som råkar vara billig, snabb och stark på exakt en axel — långa dokument — och svag på den axel där ett misstag kostar mest, nämligen agentisk tillförlitlighet. Qwen3.8-Max är generalisten vars fördel visar sig just där ett felaktigt svar är dyrt.

Att köra båda istället för att välja mellan dem

Detta är det ovanliga fallet i Solar Mini 4-serien där båda sidor av jämförelsen är rutter vi faktiskt kan sälja till dig. Qwen3.8-Max och dess daterade 0902-ögonblicksbild finns på OrcaRouter till leverantörens eget listpris på $2.00 / $6.00, tillsammans med Qwen3.8-Flash för $0.15 / $0.47 och Qwen3.8-27B för $0.33 / $2.40 — tre nivåer av samma generation, en nyckel, inget andra avtal och ingen kodändring utöver en modellsträng. Per den 1 oktober 2026 visar vår egen mätning i playgrounden att Qwen3.8-Max ligger på en p50 på 2,5 sekunder med 87,7 utdatatokens per sekund under de senaste sju dagarna; det fönstret rullar, så läs det aktuella modellkortet i stället för den här meningen. Upstages modeller är inte tillgängliga via oss, och Solar Mini 4 måste nås via Upstages eget API.

A screenshot of the OrcaRouter model page for Qwen3.8-Max, showing the model id qwen/qwen3.8-max at $2.00 input and $6.00 output per million tokens, text, image and video input with text output, vision, tools, JSON and reasoning capability flags, a 2.5-second median time to first token from our own playground, and the description of Alibaba's newest flagship model in the Qwen line.

Vad det möjliggör är den uppdelning som den här jämförelsen argumenterar för: skicka trafiken för långa dokument, koreanska och strukturerad extrahering någonstans billigt, dirigera de resonemangstunga och verktygsanvändande förfrågningarna till flaggskeppet, och låt failover täcka leverantören som har en dålig eftermiddag. Det är också där routing-DSL:en förtjänar sin plats — att komponera modeller till ett enda anrop innebär att ett billigt första pass och ett dyrt verifieringspass kan vara en enda förfrågan mot en enda slutpunkt i stället för två integrationer som måste hållas i synk.

Den korta versionen

A screenshot of the Artificial Analysis model page headed 'Qwen3.8 Max (0902) Intelligence, Performance & Price Analysis', marked as an Alibaba proprietary model released September 2026, ranked 32nd of 223 on intelligence, 172nd on speed and 101st on cost, with $2.00 input, $6.00 output and cached pricing rows, 39.5 output tokens per second, a $5.41 cost figure and a verbosity readout.

Om din arbetsbelastning är lång, med en fast utdataform och en tolerabel latensbudget, ger Solar Mini 4 dig 83 % av långkontextresultatet till en femtondedel av kostnaden för uppgiften och fem gånger genomströmningen, och de tjugoen saknade indexpoängen kommer aldrig att synas på din instrumentpanel. Om din arbetsbelastning involverar verktyg, flerstegsagenter eller frågor där ett självsäkert felaktigt svar är värre än inget svar, är de saknade poängen hela produkten, och Qwen3.8-Max är värd femton gånger priset. Varje siffra ovan som tillskrivs Artificial Analysis är den organisationens oberoende mätning; namngivningen och releasedatumen för Qwen3.8 är Alibabas, och OrcaRouters serving-siffror är vår egen playground-mätning över ett rullande sjudagarsfönster.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen