
Step 5 Preview vs GLM-5.5: Het ene model is vandaag beschikbaar, het andere is nog steeds een voorspelling
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Step 5 Preview opende zijn API op 20 september 2026, dezelfde dag dat StepFun het aankondigde, en je kunt het vanmiddag aanroepen via één endpoint voor $1,00 per miljoen inputtokens en $2,70 per miljoen outputtokens. GLM-5.5 bestaat niet. Er is geen modelkaart, geen API-identifier, geen prijs, geen checkpoint en geen licentiebestand, en er is nergens een Z.ai-pagina die de naam gebruikt — want GLM-5.5 is een door de community gebruikte verkorte aanduiding die het bedrijf nooit heeft overgenomen. Die asymmetrie is het artikel. Wat volgt is wat StepFun daadwerkelijk heeft uitgebracht, wat daadwerkelijk vaststaat over het volgende vlaggenschip van Z.ai, en de head-to-head die je vandaag kunt uitvoeren in plaats van die uit de titel.
Wat GLM-5.5 is, en wat het niet is
De naam raakte medio 2026 in omloop, verbonden aan een releasevenster, en dat venster heeft een traceerbare oorsprong: een analistenprognose die op 25 juni 2026 werd doorgegeven en het volgende vlaggenschip van Z.ai in augustus plaatste. Het was een venster om in de gaten te houden, geen toezegging van de leverancier, en augustus eindigde zonder dat. Wat Z.ai in plaats daarvan uitbracht, was GLM-5.3, aangekondigd op 14 augustus, met de API live rond 18 augustus en open gewichten op 28 augustus, gevolgd door GLM-5.3-Flash op 26 augustus. Er is geen GLM-5.5-checkpoint verschenen in de eigen Hugging Face-organisatie van de leverancier, waar de nieuwste repositories nog steeds niet verder komen dan de GLM-5.3-serie.
Ook de naamgeving is nog onzeker. GLM-5.3, GLM-5.4, GLM-5.5 en GLM-6 zijn allemaal binnen hetzelfde tijdsbestek geopperd, en Z.ai heeft geen ervan bevestigd. Het enige signaal van bedrijfszijde is een opmerking van een medeoprichter over een "epic plus"-release, wat eerder een stemming dan een specificatie is. Analisten die de cadans van de leverancier aflezen — ongeveer één vlaggenschipmodel per 54 tot 70 dagen — plaatsen het volgende model nu in een venster dat loopt van 8 oktober tot 9 november 2026, en verwachten dat het nummer GLM-5.4 krijgt in plaats van GLM-5.5.
Drie beweringen doen de ronde alsof ze bevestigd zijn, en het is de moeite waard om bij alle drie precies te zijn. Het aantal parameters is het zwakst: niets officieels ondersteunt het cijfer van "meer dan 1 biljoen", en latere posts op sociale media die het tot boven de 3 biljoen opblazen, citeren helemaal niets. De 1M-tokencontext is de veiligste aanname, omdat GLM-5.2 en GLM-5.3 die beide hebben. Open gewichten zijn eerder een verwachting dan een belofte — Z.ai heeft gewichten uitgebracht voor zijn laatste paar vlaggenschepen, wat een patroon is, geen toezegging.
Wat Step 5 Preview daadwerkelijk uitbrengt
Het model van StepFun is het concrete deel van deze vergelijking, en de specificatie is ongewoon. Het is een sparse mixture-of-experts-model met in totaal 600B parameters en ongeveer 27B actief per token — een activeringsratio van bijna 4,5% — gebouwd op een 92-laags narrow-and-deep-transformer met sparse grouped-query attention en block-wise token merging. Het contextvenster is 1M tokens, invoer is tekst en afbeeldingen, uitvoer is tekst, en het redeneert met uitgebreide denkprocessen. StepFun sloeg de volledige Step 4.x-reeks over om hier te komen, en ging rechtstreeks van Step-3.7-Flash naar Step 5.
• Intelligence Index — 44 op Artificial Analysis, 24e van 200 beoordeelde modellen, tegenover een mediaan van 24
• Uitvoersnelheid — 99,8 tokens per seconde, 45e van 200
• Tijd tot eerste token — 2,96 seconden tijdens dezelfde onafhankelijke run
• Prijs — $1,00 per 1 miljoen invoertokens, $2,70 per 1 miljoen uitvoertokens, met een cachekorting van 95%
• Kosten per Intelligence Index-taak — $0,71, 27e van 200
• Gewichten — vandaag geen; een BF16-checkpoint staat gepland voor 15 oktober 2026
• Licentie — niet gepubliceerd. Het model is propriëtair, zonder vermelding van toestemming voor commercieel gebruik, herverdelingsrecht of toestemming voor fine-tuning
De prijs is de opvallende rij, en dat geldt ook voor iets dat StepFun minder voordeel oplevert dan het op het eerste gezicht lijkt: 160M outputtokens op de Intelligence Index tegen een mediaan van 92M, de 64e van 200 op die maatstaf. Het model is langdradig, en langdradigheid is een kostenvermenigvuldiger in precies de agentische workloads waarvoor het wordt verkocht. Het cijfer van $0,71 kosten per taak houdt dat al in, en daarom is dat het eerlijkere getal om te noemen dan de lijstprijs.
De eigen evaluaties van StepFun zijn niet gereproduceerd en moeten als leveranciersmateriaal worden gelezen totdat iemand ze onafhankelijk uitvoert. Ze plaatsen het model op 29,5 op ALE-CLI, 66,4 op FrontierFinance, 83,3 op DRACO, 80,5 op ProgramBench, 67,7 op DeepSWE v1.1 en 49,0 op StepCodeBench, met 33,3% op Terminal-Bench 4.0 en 1571 op GDPval-AA v2. StepFun rapporteert ook een MLA-piek van 508 TFLOPS in een 24-uurs GPU-kerneloptimalisatietaak tegenover 493 voor Claude Opus 5. Dat zijn StepFuns cijfers over een model dat StepFun niet heeft opengesteld.

De directe vergelijking die je in plaats van deze kunt uitvoeren
Als je de vergelijking wilt die de titel belooft, is de eerlijke vervanging Step 5 Preview tegenover GLM-5.3 — het model dat Z.ai daadwerkelijk heeft uitgebracht, nog altijd het huidige open flagship, en het model dat een eventuele GLM-5.5 zou vervangen. Op de onafhankelijke ranglijst schelen de twee één punt. Op bijna al het andere niet.
• Intelligentie-index — Step 5 Preview 44 vs GLM-5.3 45
• Parameters — 600B totaal / 27B actief vs 753B totaal / 40B actief
• Uitvoersnelheid — 99,8 tokens/sec vs 72,1 tokens/sec
• Tijd tot eerste token — 2,96s vs 2,99s
• Prijs per 1M tokens — $1,00 in / $2,70 uit vs $1,40 in / $4,40 uit
• Cachekorting — 95% vs 81%
• Kosten per Intelligence Index-taak — $0,71 vs $2,01
• Invoermodaliteit — tekst en afbeeldingen versus alleen tekst
• Licentie — geen gepubliceerde licentie vs. een aangepaste Z.ai-licentie die niet MIT is
Het patroon herhaalt wat de lancering van Step 5 Preview heeft vastgesteld tegenover elk uitgeleverd model waartegen het is afgezet: een beslissende efficiëntievoorsprong en een statistisch gelijke stand qua capaciteiten. Het genereert tokens ongeveer 38% sneller, kost ongeveer half zoveel per miljoen tokens in beide richtingen, en komt 2,8 keer goedkoper uit per indextaak tegenover GLM-5.3 — terwijl het een punt lager scoort. Op de ranglijst zet die 44 het ook op gelijke hoogte met Kimi K3, wat de moeite waard is om te weten voordat je een van beide als koploper behandelt.
De enige rij waarin Step 5 Preview onmiskenbaar achterloopt, is de rij die je niet kunt benchmarken. GLM-5.3 heeft een licentiebestand en downloadbare gewichten; Step 5 Preview heeft een Hugging Face-repository met alleen een .gitattributes en een opgegeven datum van 15 oktober voor het BF16-checkpoint. Als het volgende vlaggenschip van Z.ai met open gewichten verschijnt onder dezelfde aangepaste voorwaarden die het het hele jaar al hanteert, valt het in de enige categorie waarin Step 5 Preview op dit moment geen antwoord heeft — wat de echte reden is waarom een vergelijking met GLM-5.5 het waard is om op te wachten in plaats van uit te voeren.

Waarom wachten op GLM-5.5 de dure optie is
Het praktische probleem met een model dat al twee maanden lang twee maanden ver weg is, is dat je evaluatiewerk niet mee kan wachten. GLM-5.5 heeft geen endpoint, dus het kan niet worden gebenchmarkt, op prijs vergeleken, load-getest of achter een fallbackregel worden geplaatst. Elke week die aan plannen rondom het model wordt besteed, is een week waarin beslissingen worden uitgesteld op basis van een voorspelling — en die voorspelling heeft al één tijdvenster gemist.
GLM-5.3 is daarentegen live op OrcaRouter onder z-ai/glm-5.3 voor $1,26 input en $3,96 output tegenover de $1,40 en $4,40 die Z.ai op zijn eigen pagina vermeldt. Dat wordt zonder markup doorgegeven, wat betekent dat het bedrag dat je ziet het huidige tarief van de provider is en niet een tarief dat wij hebben vastgesteld, en een prijswijziging van een leverancier is bij ons dezelfde dag live in plaats van bij de volgende factureringscyclus.
Step 5 Preview staat niet in onze catalogus en we routeren het niet. Het draait op de eigen API en Studio van StepFun, en dat is de enige plek waar het draait tot het checkpoint van 15 oktober er is. Wat OrcaRouter je in de tussentijd biedt, is alles aan de andere kant van die vergelijking achter één API voor meer dan 200 modellen: GLM-5.3 tegen het bovenstaande tarief, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 en de rest, met automatische failover tussen providers die een productiepad stabiel houdt terwijl de capaciteitscurve van een preview nog onbekend is, en de routing-DSL die meerdere ervan samenvoegt tot één aanroep in plaats van een tweede integratie. Benchmark de preview tegen een productiemodel op dezelfde sleutel; laat het productiepad waar het is.

Wat zou het antwoord veranderen
Twee data beslissen dit. 15 oktober is wanneer StepFun heeft gezegd dat de BF16-checkpoint voor Step 5 Preview verschijnt, en de licentie die daarnaast wordt meegeleverd is de meest cruciale onbekende in de vergelijking — een permissieve licentie zou van een kostenvoordeel per taak van 2,8 keer iets maken dat je bezit in plaats van huurt, en zou de enige as waarop GLM-5.3 duidelijk voorloopt, uitwissen. Een restrictieve licentie laat GLM-5.3 als enige van het tweetal over waarop je een product kunt bouwen, en maakt het verschil van één punt tot trivia over twee modellen die je toch anders zou gebruiken.
De tweede is het analistenvenster dat loopt van 8 oktober tot 9 november voor het volgende vlaggenschip van Z.ai, dat al dan niet GLM-5.5 heet en al dan niet op het gerucht lijkt. Als het überhaupt komt, komt het als een model met een licentie en een checkpoint — de twee dingen die Step 5 Preview mist — en wordt de vergelijking een echte.
Totdat beide zijn opgelost, is de nuttige vraag niet welke van de twee beter is, want een van hen kan niet worden uitgevoerd. Het is op welke van de modellen die bestaan je nu zou moeten voortbouwen, en of het antwoord verandert wanneer de volgende checkpoint verschijnt. Die vraag heeft deze week een testbaar antwoord, en het vereist niet dat je wacht tot een naam een model wordt.
Vergeleken in dit artikel3
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
