
Step 5 Preview vs GLM-5.5: En modell släpps idag, den andra är fortfarande en prognos
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Step 5 Preview öppnade sitt API den 20 september 2026, samma dag som StepFun tillkännagav det, och du kan anropa det i eftermiddag från en enda slutpunkt för 1,00 USD per miljon input-tokens och 2,70 USD per miljon output-tokens. GLM-5.5 existerar inte. Det finns inget modellkort, ingen API-identifierare, inget pris, ingen checkpoint och ingen licensfil, och det finns ingen Z.ai-sida någonstans som använder namnet – eftersom GLM-5.5 är en förkortning som används i communityn och som företaget aldrig har anammat. Den asymmetrin är artikeln. Det som följer är vad StepFun faktiskt släppte, vad som verkligen är fastställt om Z.ai:s nästa flaggskepp, och den direkta jämförelse du kan köra idag i stället för den i rubriken.
Vad GLM-5.5 är, och vad det inte är
Namnet började cirkulera i mitten av 2026 knutet till ett lanseringsfönster, och fönstret har ett spårbart ursprung: en analytikerprognos som förmedlades den 25 juni 2026 och placerade Z.ai:s nästa flaggskepp i augusti. Det var ett bevakningsfönster, inte ett åtagande från leverantören, och augusti slutade utan det. Det Z.ai i stället släppte var GLM-5.3, som tillkännagavs den 14 augusti, med sitt API live runt den 18 augusti och öppna vikter den 28 augusti, följt av GLM-5.3-Flash den 26 augusti. Ingen GLM-5.5-checkpoint har dykt upp i leverantörens egen Hugging Face-organisation, där de nyaste repositorierna fortfarande som mest når GLM-5.3-serien.
Namngivningen är inte heller fastställd. GLM-5.3, GLM-5.4, GLM-5.5 och GLM-6 har alla nämnts i samma tidsfönster, och Z.ai har inte bekräftat någon av dem. Den enda signalen från företagets sida är en medgrundares uttalande om en "epic plus"-lansering, vilket är en stämning snarare än en specifikation. Analytiker som läser leverantörens takt — ungefär en flaggskeppsmodell var 54:e till 70:e dag — projicerar nu nästa modell till ett fönster som sträcker sig från den 8 oktober till den 9 november 2026, och förväntar sig att den numreras GLM-5.4 snarare än GLM-5.5.
Tre påståenden cirkulerar som om de vore bekräftade, och det är värt att vara exakt om alla tre. Parameterantalet är det svagaste: inget officiellt stöder siffran "mer än 1 biljon", och senare sociala inlägg som blåser upp det till över 3 biljoner citerar ingenting alls. 1M-tokenkontexten är det säkraste antagandet, eftersom både GLM-5.2 och GLM-5.3 har den. Öppna vikter är en förväntan snarare än ett löfte — Z.ai har släppt vikter för sina senaste flera flaggskepp, vilket är ett mönster, inte ett åtagande.
Vad Step 5 Preview faktiskt levererar
StepFuns modell är den konkreta halvan av denna jämförelse, och specifikationen är ovanlig. Det är en sparse mixture-of-experts-modell med totalt 600B parametrar och ungefär 27B aktiva per token – en aktiveringsgrad på nära 4,5 % – byggd på en 92-lagers smal-och-djup transformer med sparse grouped-query attention och blockvis token-sammanslagning. Kontextfönstret är 1M tokens, indata är text och bilder, utdata är text, och den resonerar med utökat tänkande. StepFun hoppade över hela Step 4.x-serien för att komma hit och gick direkt från Step-3.7-Flash till Step 5.
• Intelligensindex — 44 på Artificial Analysis, 24:e av 200 poängsatta modeller, mot ett medianvärde på 24
• Utdatningshastighet — 99,8 tokens per sekund, 45:e av 200
• Tid till första token — 2,96 sekunder i samma oberoende körning
• Pris — $1.00 per 1 miljon indatatoken, $2.70 per 1 miljon utdatatoken, med 95 % cacheringsrabatt
• Kostnad per Intelligence Index-uppgift — $0.71, 27:e av 200
• Vikter – inga idag; en BF16-checkpoint är planerad till den 15 oktober 2026
• Licens — ingen publicerad. Modellen är proprietär, utan angivet beviljande för kommersiell användning, vidaredistributionsrätt eller tillstånd för finjustering.
Priset är den iögonfallande raden, och detsamma gäller en som är mindre till StepFuns fördel än den först verkar: 160M utdatatokens på Intelligence Index mot ett medianvärde på 92M, 64:e av 200 i det måttet. Modellen är mångordig, och mångordighet är en kostnadsmultiplikator i precis de agentiska arbetsbelastningar som den säljs för. Siffran 0,71 $ i kostnad per uppgift räknar redan in det, vilket är varför den är den ärligare siffran att ange än listpriset.
StepFuns egna utvärderingar är inte reproducerade och bör läsas som leverantörsmaterial tills någon oberoende kör dem. De placerar modellen på 29,5 på ALE-CLI, 66,4 på FrontierFinance, 83,3 på DRACO, 80,5 på ProgramBench, 67,7 på DeepSWE v1.1 och 49,0 på StepCodeBench, med 33,3 % på Terminal-Bench 4.0 och 1 571 på GDPval-AA v2. StepFun rapporterar också en MLA-topp på 508 TFLOPS i en 24-timmars GPU-kärnoptimeringsuppgift mot 493 för Claude Opus 5. Det är StepFuns siffror om en modell som StepFun inte har öppnat upp.

Duellen du kan köra i stället för den här
Om du vill ha den jämförelse som titeln utlovar är den ärliga ersättningen Step 5 Preview mot GLM-5.3 — modellen som Z.ai faktiskt släppte, fortfarande sitt nuvarande öppna flaggskepp, och den som en eventuell GLM-5.5 skulle ersätta. På den oberoende resultattavlan ligger de två en poäng ifrån varandra. På nästan allt annat är de inte det.
• Intelligence Index — Step 5 Preview 44 mot GLM-5.3 45
• Parametrar — 600B totalt / 27B aktiva vs 753B totalt / 40B aktiva
• Utdatningshastighet — 99,8 tokens/sek vs 72,1 tokens/sek
• Tid till första token — 2,96 s vs 2,99 s
• Pris per 1 miljon tokens – 1,00 $ in / 2,70 $ ut mot 1,40 $ in / 4,40 $ ut
• Cacherabatt — 95 % mot 81 %
• Kostnad per Intelligence Index-uppgift — 0,71 USD mot 2,01 USD
• Indatamodalitet – text och bilder kontra enbart text
• Licens — ingen publicerad vs. en anpassad Z.ai-licens som inte är MIT
Mönstret upprepar det som lanseringen av Step 5 Preview etablerade mot varje tillgänglig modell som den har poängsatts mot: ett avgörande effektivitetsövertag och ett statistiskt dödläge när det gäller förmåga. Den genererar tokens ungefär 38 % snabbare, kostar ungefär hälften så mycket per miljon tokens i båda riktningarna och hamnar 2,8 gånger billigare per indexuppgift mot GLM-5.3 — samtidigt som den får en poäng lägre. På resultattavlan placerar den 44:an den också i nivå med Kimi K3, vilket är värt att veta innan man behandlar endera som en ledare.
Den enda rad där Step 5 Preview entydigt ligger efter är den du inte kan benchmarka. GLM-5.3 har en licensfil och nedladdningsbara vikter; Step 5 Preview har ett Hugging Face-arkiv som innehåller en enda .gitattributes och ett angivet datum den 15 oktober för BF16-kontrollpunkten. Om Z.ai:s nästa flaggskepp anländer med öppna vikter under samma anpassade villkor som det har använt hela året, hamnar det i den enda kategori där Step 5 Preview för närvarande inte har något svar — vilket är det verkliga skälet till att en jämförelse med GLM-5.5 är värd att vänta på i stället för att köra.

Varför väntan på GLM-5.5 är det dyra alternativet
Det praktiska problemet med en modell som i två månader har varit två månader bort är att ditt utvärderingsarbete inte kan vänta på den. GLM-5.5 har ingen slutpunkt, så den kan inte benchmarkas, prisjämföras, lasttestas eller sättas bakom en reservregel. Varje vecka som läggs på att planera kring den är en vecka av beslut som skjuts upp på grundval av en prognos – och prognosen har redan missat ett fönster.
GLM-5.3 är däremot live på OrcaRouter under z-ai/glm-5.3 till $1.26 för input och $3.96 för output, mot Z.ai:s listpriser på $1.40 och $4.40 på deras egen sida. Det förs vidare utan påslag, vilket innebär att siffran du ser är leverantörens aktuella pris snarare än ett pris vi sätter, och en ändring av leverantörens pris slår igenom hos oss samma dag i stället för vid nästa faktureringscykel.
Step 5 Preview finns inte i vår katalog och vi dirigerar den inte. Den körs på StepFuns eget API och Studio, och det är den enda platsen den körs på tills checkpointen den 15 oktober landar. Det OrcaRouter ger dig under tiden är allt på andra sidan av den jämförelsen bakom ett enda API för fler än 200 modeller: GLM-5.3 till priset ovan, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 och resten, med automatisk failover mellan leverantörer som håller en produktionsväg stabil medan kapacitetskurvan för en förhandsvisning fortfarande är okänd, och routing-DSL som komponerar flera av dem till ett enda anrop i stället för en andra integration. Benchmarka förhandsvisningen mot en produktionsmodell på samma nyckel; låt produktionsvägen vara kvar där den är.

Vad skulle ändra svaret
Två datum avgör detta. Den 15 oktober är datumet då StepFun har sagt att BF16-checkpointen för Step 5 Preview släpps, och licensen som släpps tillsammans med den är den enskilt mest avgörande okända faktorn i jämförelsen — en tillåtande licens skulle göra en kostnadsfördel per uppgift på 2,8 gånger till något du äger i stället för hyr, och skulle sudda ut den enda axel där GLM-5.3 är klart bättre. En restriktiv licens lämnar GLM-5.3 som den enda av de två som du kan bygga en produkt på, och förvandlar gapet på en poäng till en bagatell om två modeller som du ändå skulle använda på olika sätt.
Det andra är analytikerfönstret som löper från 8 oktober till 9 november för Z.ai:s nästa flaggskepp, som kanske eller kanske inte kallas GLM-5.5 och kanske eller kanske inte liknar ryktet. Om den alls kommer, kommer den som en modell med en licens och en checkpoint – de två saker som Step 5 Preview saknar – och jämförelsen blir en verklig sådan.
Till dess att båda är lösta är den användbara frågan inte vilken av de två som är bättre, eftersom en av dem inte kan köras. Det är vilken av de modeller som finns som du bör bygga på nu, och huruvida svaret ändras när nästa checkpoint dyker upp. Den frågan har ett testbart svar den här veckan, och den kräver inte att man väntar på att ett namn ska bli en modell.
Jämförda i den här artikeln3
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
