Genererat titelkort för Step 5 Preview mot Qwen 3.8 Max Prime med texten ”en indexpoäng, fyra dollar och trettioåtta cent”, med tre statistikchips: Artificial Analysis Intelligence Index 44 mot 45, kostnad per indexuppgift $1.03 mot $5.41 och pris för utdata $2.70 mot $9.902 per miljon tokens. OrcaRouter-logotypen sitter i en vit remsa längst ner till höger.
Guides & Insights

Step 5 Preview vs Qwen 3.8 Max Prime: En indexpoäng, fyra dollar och trettioåtta cent

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Börja med det som en sökruta inte berättar för dig. Qwen 3.8 Max Prime är inte en modell. Det är en serveringsväg – samma Qwen3.8-Max-vikter som leverantören tog till allmän tillgänglighet den 3 augusti 2026, sålda under ett andra modell-ID till exakt dubbla priset enligt den internationella prislistan. Step 5 Preview, StepFuns slutna flaggskepp, öppnade sitt API den 20 september 2026 och är en modell i vanlig mening: en slutpunkt, ett pris, en uppsättning vikter du inte kan hålla i. Så den ärliga versionen av den här jämförelsen ställer en uppmätt modell mot en icke uppmätt nivå, och aritmetiken som faller ut är krassare än vad någon av leverantörerna skulle sätta på en bild. På det oberoende Artificial Analysis Intelligence Index ligger de två en poäng ifrån varandra, 44 mot 45, och i fråga om vad en slutförd uppgift kostar ligger de $1,03 mot $5,41 ifrån varandra. En poäng, fyra dollar och trettioåtta cent, per uppgift — och det är innan du har köpt någon av den hastighet som Prime faktiskt tar betalt för.

Det följande är en uppdelning av det talet: varifrån det kommer, varför standard-Qwen-ID redan är den dyrare halvan av jämförelsen innan Prime dubblar något, och vad de extra fyra dollarna per uppgift köper och inte köper.

Namnet gör ett arbete som produkten inte gör.

Alibaba meddelade Prime – 优速模式, snabb – på Yunqi-konferensen den 22 september 2026 och publicerade en post på Model Studios prislista. Alibabas egen dokumentation är entydig om vad som ändras: utdatahastigheten ökar till 1,5 till 2 gånger standard-API:t, och enligt leverantören är funktionerna och användningsbegränsningarna identiska med originalet. Inget nytt parameterantal, inget nytt endpoint-kontrakt, ingen funktion som standard-ID:t saknar. Du ändrar modellnamnet i förfrågans body och du är på snabbfilen.

Generated two-column comparison scoreboard for Step 5 Preview and Qwen 3.8 Max Prime across six shared rows: what the name refers to, 'a model' against 'a serving lane for Qwen3.8-Max'; Artificial Analysis Intelligence Index 44 against 45, measured on the standard Qwen ID with no Prime row; cost per index task $1.03 against $5.41; output price $2.70 against $9.902 per million tokens; output speed 87 against 35.4 tokens per second, again measured on the standard ID; and weights, 'proprietary, BF16 checkpoint promised 15 October' against 'proprietary, none'. A footer reads that index, speed and cost-per-task figures are per Artificial Analysis and were measured on the standard Qwen3.8-Max ID rather than on Prime, and that rate cards are Alibaba's international list price and StepFun's own. The OrcaRouter logo sits in a white strip at the bottom right.

Det gör söktermen till en fälla. Den som letar efter ett Qwen-flaggskepp som är nyare än Qwen3.8-Max hittar ”Prime” och läser det som ett versionsnummer. Det är ett pris. Allt som namnet antyder om kapacitet kommer från Qwen3.8-Max själv: en gles mixture-of-experts-modell med 2,4 biljoner parametrar, varav ungefär 95 miljarder parametrar är aktiva per token, 512 experter per lager och en kontext på 983 616 token i den konfiguration som den oberoende nämnden testade.

Step 5 Preview har ingen motsvarande tvetydighet, och den har det motsatta problemet. StepFun listar den med cirka 600 miljarder totala parametrar med 27 miljarder aktiva, text-, bild- och videoinmatning, ett kontextfönster på 1M token och ett dokumenterat tak för utdata på 64 000 token, med resonemangsinsats valbar på låg, medel eller hög. Den är proprietär. En BF16-checkpoint har utlovats till den 15 oktober 2026 och har inte släppts; community-speglingar av ett BF16-bygge har cirkulerat på Hugging Face sedan dagen API:et öppnades, men återuppladdningar är inte ett släpp och StepFun har inte publicerat något tillkännagivande om öppna vikter.

Så paret är verkligen ojämnt redan innan ett enda benchmark-test har landat: en förhandsvisad modell som kan bli en nedladdning, mot en omprissatt serving-nivå för en modell som inte kommer att bli det.

Vad en indexpunkt kostar

Båda modellerna har körts av samma oberoende utvärderare, och det är här jämförelsen blir obekväm för narrativet om billigare per token. Läs vidare den 10 oktober 2026:

• Index — Step 5 Preview 44, långt över medianen på 26 för en jämförbar modell. Qwen3.8-Max på 0902-versionen, 45. En poäng.

• Kostnad per slutförd indexeringsuppgift — 1,03 $ mot 5,41 $. Mer än fem gånger bättre.

Pris för utdata — 2,70 $ mot 6,00 $ per miljon tokens på standard-ID:t, vilket blir 9,902 $ när du går över till Prime. Step 5 Preview är 2,2 gånger billigare än standard och 3,7 gånger billigare än Prime.

• Inputpris — $1.00 mot $2.00 standard och $3.301 på Prime. Spegelbilden av utdatakolumnen, och den som betyder mer när du har läst kostnadsuppdelningen nedan.

• Cache-träff $0,10 per miljon tokens på Step 5 Preview, en rabatt på 90 procent; $0,25 på Qwen3.8-Max, en rabatt på 87,5 procent som leverantörens egen sida avrundar till 88 procent.

• Utdata-tokens per sekund — 87 mot 35,4. Här är Qwen den långsamma, och med en faktor på ungefär två och en halv.

Kolumnerna per token och kolumnen per uppgift stämmer inte överens, och det är kolumnen per uppgift man ska tro på, av en anledning som bara visar sig om man öppnar kostnadsuppdelningen. Vid Step 5 Previews indexkörning är $0,85 av $1,03 ingångssidan och $0,17 utgång. Vid Qwen3.8-Max är $4,76 av $5,41 ingångssidan och $0,65 utgång. Listpriserna skiljer sig med ungefär en faktor två; uppgiftsräkningarna skiljer sig med en faktor fem, eftersom Qwen-körningen tryckte igenom omkring 9,9 miljarder indatatoken genom ramverket mot Step 5 Previews 5,5 miljarder, och eftersom merparten av den volymen är cachetrafik som läses om till vilken rabatt leverantören än ger snarare än till listpriset.

Step 5 Preview beskrivs av styrelsen som mycket ordrik, på ungefär 160 miljoner utdatatoken i sviten mot ett medianvärde på 82 miljoner — och Qwen3.8-Max beskrivs i exakt samma ordalag, på ungefär 190 miljoner mot samma median. Ingen av dessa är en modell som svarar kortfattat. Om utdatalängd är det du hoppades optimera, hjälper ingen av kolumnerna dig.

Screenshot of the Artificial Analysis model page for Qwen3.8 Max (0902), showing an Intelligence Index of 45 ranked 32 of 227 with a comparable-model median of 26, speed ranked 190 of 227, cost ranked 105 of 227 and verbosity ranked 103 of 227, pricing of $2.00 per million input tokens and $6.00 per million output tokens with an 88 percent cache discount, a measured cost of $5.41 per index task, 190 million output tokens generated across the run against an 82 million median, about 35 output tokens per second, and a 984k-token context.

Jämförelsen har ett hål i sig, och det är Prime-format.

Alla siffror i föregående avsnitt mättes på standard-Qwen3.8-Max ID. Ingen av dem mättes på Prime.

Det är inte en teknikalitet. Hela Primes argument är att tokens kommer snabbare, och tavlans enda hastighetssiffra för den här familjen är standard-ID:ts 35,4 utdatatoken per sekund – den klart långsammaste av de tre ID:n som diskuteras här, och den enda raden där Qwen3.8-Max inte bara är dyr utan synbart underpresterar. Om Prime levererar i den övre änden av Alibabas angivna intervall blir den där 35,4:an något i stil med 70, fortfarande under Step 5 Previews 87, samtidigt som den kostar 3,7 gånger så mycket per utdatatoken. Om den levererar i den nedre änden av intervallet blir den ungefär 53.

Det där är uppskattningar byggda på en leverantörsuppgiven multiplikator, inte mätningar, och de bör märkas som sådana. Ingen som vi kan hitta har publicerat ett oberoende genomströmningstest av Prime mode. Siffran 1,5 till 2× är Alibabas egen, och det är det enda bärande påståendet under hela nivån.

Den enda strukturella detalj som talar i Primes favör är strypningsregeln, och den är lätt att förbise. Alibabas dokumentation anger att under Prime, när samtalsvolymen når hastighetsgränsen, stryps inte begäran om plattformen fortfarande har lediga resurser – så det genomflöde som är tillgängligt för dig faller inte under den angivna gränsen. Det är ett mjukt tak med ett hårt golv: vid konkurrens får du gränsen, vid ledig kapacitet kan du få mer. För en agentloop som skickar dussintals sekventiella anrop spelar det större roll än medianen, eftersom det långsammaste anropet avgör när loopen avslutas. Det är också den tydligaste förklaringen till varför Prime överhuvudtaget finns som produkt. Alibaba säljer köposition ur kapacitet som de redan har byggt, och tar dubbelt betalt för rätten att bli betjänad först ur den.

Vad de två prislistorna säger när man ställer dem sida vid sida

Alibaba publicerar sina Qwen-rader intill varandra, vilket gör nivåns aritmetik ovanligt ren. På den internationella sidan står Prime-raden med $3,301 input och $9,902 output per miljon tokens, mot $1,65 och $4,951 för standard-ID:t och för dess 0902-pin. Det är exakt 2,0 i båda kolumnerna – inte en avrundad approximation utan det bokstavliga förhållandet mellan de publicerade siffrorna. StepFuns engelska prissida listar Step 5 Preview till $1,00 input, $0,10 vid en cacheträff och $2,70 output, där input vid cachemiss inkluderar kostnaden för att skriva nytt innehåll till cachen. Leverantörens publicerade siffra för cacheträffar är en rabatt på 90 procent; den oberoende nämnden registrerar 95 procent utifrån samma material, och det är värt att veta vilken av de två du modellerar mot.

Sätter man de tre korten i en kolumn blir bilden tydlig. Prime-utdata, $9.902. Standard-Qwens utdata, $6.00 enligt resultattavlans notering och $4.951 på Alibabas egen internationella sida. Step 5 Previews utdata, $2.70. Och på den billiga bana som ingen gör reklam för är Step 5 Previews cacheläsning $0.10 mot Qwens $0.25 — vilket betyder mer än utdatakolumnen för alla arbetsbelastningar som upprepar sitt prefix.

En varning om inaktuella siffror, för den här familjen har fått nya priser mer än en gång under sju veckor. De allmänt citerade $2 för indata och $6 för utdata för Qwen3.8-Max är rubriken från lanseringen i augusti, och det är fortfarande vad Alibaba Singapores flik visar. De internationella och globala raderna visar nu $1.65 och $4.951. Om du modellerar utgifter, använd prislistan för din region och läs den igen den dag du genomför.

Två sätt att läsa 2×

Eftersom Prime är samma modell till dubbla priset jämfört med standard ID är prispåslaget lätt att prissätta och svårt att motivera. I den övre änden av Alibabas utbud betalar du 2× för 2× hastigheten, vilket är kostnadsneutralt per sekund borttagen latens. I den nedre änden betalar du 2× för 1,5×, ett påslag på 33 procent per sparad sekund. Ingen av ändarna är orimlig för interaktivt arbete; ingen av dem är försvarbar för en batchkörning över natten. Det är därför standardrådet för nivån — latenskänsliga anrop på Prime, allt annat på standard ID — också är det korrekta rådet.

Jämförelsen mot Step 5 Preview är där resonemanget byter skepnad, och det är den här delen som "vs"-ramningen gör synlig. Prime konkurrerar inte alls med Step 5 Preview på pris. Standard-ID:t är redan dyrare per utdatatoken än Step 5 Preview är, fem gånger dyrare per slutförd uppgift, och det får en poäng högre. Prime multiplicerar kostnadssidan i en ekvation som redan förlorade och köper tillbaka hastighet som Step 5 Preview har mer av gratis. Om hastighet är vad du behöver från den här familjen, är det ärliga påståendet att modellen på andra sidan av den här sidan ger dig 87 tokens per sekund vid $2,70 per miljon utdatatokens, och snabbfilen ger dig ett intervall som toppar, enligt Alibabas egna siffror, runt 70 vid $9,902.

Det där är inte ett argument att Step 5 Preview vinner. Det är ett argument att Primes är helt och hållet internt inom Alibabas egen produktlinje, och att argumentet för det vilar på arbetsbelastningar där Qwen3.8-Maxs en poängs försprång, dess kontext på 983,616 tokens eller dess annorlunda uppgiftsprofil utför arbete som en 1M-token Step 5 Preview-kontext inte gör. Vilket är den jämförelse som ingen kan köra ännu, eftersom Prime inte finns på någon oberoende.

Generated rate-card infographic comparing three published price lists in one column: Qwen 3.8 Max Prime at $3.301 input and $9.902 output per million tokens, the standard qwen3.8-max and qwen3.8-max-0902 IDs at $1.65 and $4.951 on Alibaba's international page against the $2 and $6 still shown on its Singapore tab, and Step 5 Preview at $1.00 input, $0.10 cached input and $2.70 output from StepFun's English pricing page. A footer reads that the Prime row is exactly 2.0 times the standard row on both columns and that all figures are vendor list prices read on 10 October 2026.

Var detta landar för en köpare

Ingen av dessa två finns på OrcaRouter. Step 5 Preview går att nå via StepFuns eget API och en handfull tredjepartsplattformar; Prime är en nivå i Alibaba Cloud Model Studio som tillhandahålls via en slutpunkt begränsad till arbetsytan; och du kan kontrollera båda påståendena mot vår katalog i samma minut som du läser dem, vilket är ett bättre test än att bara ta oss på orden.

Det vi routar är en annan produkt i samma familj, och det råkar vara den som den här artikelns aritmetik gång på gång pekar tillbaka på. Standardmodellen Qwen3.8-Max och dess daterade pin Qwen3.8-Max-0902 finns i katalogen under samma nyckel som sina syskon Qwen3.8-Max-Preview, Qwen3.8-Flash och Qwen3.8-27B, tillsammans med över 200 andra modeller, med leverantörens listpris vidarebefordrat med 0 procents påslag. Två saker följer av det, och båda påverkar beslutet ovan. Den första är att en ändring i prislistan hos Alibaba syns på vår sida samma dag som Alibaba publicerar den – exakt den egenskap man vill ha av en leverantör som redan har ändrat priset för den här familjen två gånger på sju veckor. Den andra är att din baslinje upphör att vara en satsning på en enda leverantör: standard-ID:t är den nivå du med störst sannolikhet behåller på din standardväg, och att hålla den bakom ett routinglager i stället för en direkt integration är det som gör Prime-beslutet reversibelt per endpoint i stället för per avtal.

Om du väljer mellan de två namnen i den här artikelns rubrik är uppdelningen enkel. Ta till Step 5 Preview när du vill ha poängen, video- och bildinmatningen och 90 procents cacherabatt, och acceptera att du hyr en förhandsversion vars checkpoint är ett löfte till 15 oktober snarare än en licens. Ta bara till Qwen 3.8 Max Prime om du redan har satsat på Qwen3.8-Max och har mätt, på dina egna prompter, att standard-ID:ts 35 tokens per sekund är det som kostar dig pengar — och prissätta det beslutet mot 2× snarare än mot 1,5×, eftersom toppen av en leverantörs intervall inte är siffran du kommer att se i produktion.

Mätningen som skulle avgöra detta finns inte, och det är värt att säga det rakt ut i stället för att försköna det. Någon behöver köra Prime genom en testrigg som också kör Step 5 Preview, publicera en genomströmningsfördelning i stället för en multiplikator, och sätta en siffra för kostnad per uppgift bredvid den indexpunkt den köper. Fram till dess är de enda siffror båda sidor delar de två prislistorna, och de säger samma sak från motsatta håll: snabbspåret är det dyraste sättet att köpa en Qwen3.8-Max-token, och det långsammaste sättet att köpa en sekund väggklockstid mot vad alternativet tar för samma sekund.