Gegenereerde titelkaart met als titel 'Step 5 Preview vs GLM-5.3 — één punt verschil' met twee kolommen en een badge '1 punt' ertussen: Step 5 Preview op AA Index 44, 600B totaal / 27B actief, prijs $1,00 / $2,70, output 99,8 tokens/sec en gewichten verwacht op 15 oktober; GLM-5.3 op AA Index 45, 753B totaal / 40B actief, prijs $1,40 / $4,40, output 72,1 tokens/sec en gewichten gepubliceerd onder een aangepaste licentie. Een voettekst luidt: 'Beide volgens Artificial Analysis Intelligence Index v4.3.2; GLM-5.3 wordt gescoord als GLM-5.3 (max).'
Guides & Insights

Step 5 Preview vs GLM-5.3: Eén punt verschil, en slechts één van hen heeft een licentiebestand

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Op het onafhankelijke leaderboardliggen Step 5 Preview en GLM-5.3 één punt uit elkaar: 44 tegen 45 op de Artificial Analysis Intelligence Index v4.3.2, waar GLM-5.3 wordt gescoord als GLM-5.3 (max) en Step 5 Preview helemaal geen effort-label heeft. Dat is het kleinste verschil in deze reeks, en het is ook het minst bruikbare getal in de vergelijking. Het getal dat de doorslag geeft, is dat GLM-5.3 gewichten heeft die je vandaag kunt downloaden — gepubliceerd door Z.ai onder een eigen licentie die geen MIT is — terwijl Step 5 Preview, op 20 september 2026 aangekondigd door StepFun, een Hugging Face-repository heeft met alleen een .gitattributes erin, plus een opgegeven releasedatum van 15 oktober voor het BF16-checkpoint. Het lanceringsmateriaal van StepFun beschrijft het model als een opensource-resultaat in de top drie. Het is nog niet open source. GLM-5.3 wel, en de licentie ervan is wat je moet lezen voordat je erop gaat plannen.

Wat één indexpunt daadwerkelijk koopt

Beide modellen werden door hetzelfde lab door dezelfde tien evaluaties gehaald, waardoor de vergelijking tegelijkertijd ongewoon zuiver en ongewoon weinig behulpzaam is.

• Intelligentie-index — Step 5 Preview 44 vs GLM-5.3 45

• Waar dat staat — GLM-5.3 staat één punt boven Step 5 Preview; Step 5 Preview staat gelijk met Kimi K3

• Parameters — Step 5 Preview 600B totaal / 27B actief vs GLM-5.3 753B totaal / 40B actief

• Uitvoersnelheid — Step 5 Preview 99,8 tokens/sec vs GLM-5.3 72,1 tokens/sec

• Tijd tot eerste token — Step 5 Preview 2,96s vs GLM-5.3 2,99s

• Prijs per 1 mln. tokens — Step 5 Preview $1,00 in / $2,70 uit vs GLM-5.3 $1,40 in / $4,40 uit

• Cachekorting — Step 5 Preview 95% vs GLM-5.3 81%

• Kosten per Intelligence Index-taak — Step 5 Preview $0,71 vs. GLM-5.3 $2,01

• Context — beide 1M tokens; onze catalogus vermeldt GLM-5.3 met een uitvoerplafond van 131,1K, StepFun heeft er geen gepubliceerd

• Gewichten — Step 5 Preview gesloten, BF16-checkpoint gepland voor 15 oktober; GLM-5.3 gepubliceerd onder een aangepaste Z.ai-licentie

Lees die rijen samen en het gat van één punt is niet langer het hoofdnieuws. Step 5 Preview is 29% goedkoper op input, 39% goedkoper op output, genereert tokens 38% sneller en heeft een cachekorting die 14 punten dieper gaat — en de kosten-per-indextaakwaarde, die uitgebreidheid en cachegedrag in één getal samenvat, is 2,8 keer lager. Het doet dat met een totaal van 600B tegenover de 753B van GLM-5.3, met 27B actief tegenover 40B. Op de efficiëntieas is dit geen spannende strijd; op het gebied van capaciteiten is het zo dicht bij elkaar als de ranglijst maar kan.

De enige rij waarin Step 5 Preview niet wint, is degene die het moeilijkst te repareren is: GLM-5.3 heeft een licentiebestand en Step 5 Preview niet.

De licentie is het hele verschil, en het is niet MIT.

Het is gemakkelijk om aan te nemen dat het open vlaggenschip van een Chinees lab onder MIT wordt uitgebracht, omdat verschillende dat doen. Z.ai's eigen GLM-5.2 en GLM-5.3-Flash vallen beide onder MIT. Het GLM-5.3-vlaggenschip doet dat niet — het wordt uitgebracht onder een aangepaste "glm-5.3"-licentie die commercieel gebruik toestaat, onderworpen aan een reeks beperkingen. Dat is een wezenlijk ander document dan de MIT-voorwaarden die het kleinere broertje hanteert, en voor een bedrijf waarvan de juristen de licentie eerder lezen dan de README, is het eerder een gesprek dan een formaliteit.

Step 5 Preview heeft nog helemaal geen licentie, wat een ander probleem is en niet duidelijk een kleiner probleem. Een beperkende licentie vertelt je wat je mag doen en laat het aan jou over om te bepalen of de voorwaarden acceptabel zijn. Geen licentie vertelt je niets: geen toestemming voor commercieel gebruik, geen recht op herdistributie, geen toestemming voor fine-tuning, en geen manier om te beoordelen of de checkpoint van 15 oktober bruikbaar zal zijn voor jouw product totdat het verschijnt. De repositorynaam die StepFun heeft gereserveerd — stepfun-ai/Step-5-Preview-BF16 — verwijst naar een bfloat16-formaat, het artefact waarvan je fine-tunet en kwantiseert in plaats van het artefact dat je serveert. Dat vertelt je de vorm van de release. Het vertelt je niet de voorwaarden.

Dus de eerlijke vergelijking is tussen een licentie die je kunt lezen en waar je het mee oneens kunt zijn, en een licentie die niet bestaat. Voor een team dat wil fine-tunen, zelf wil hosten in een gecontroleerde omgeving of een afgeleid product wil uitbrengen, is GLM-5.3 de enige van deze twee met een antwoord, en het antwoord is een juridische beoordeling in plaats van een groen licht.

De efficiëntiekloof is het deel dat standhoudt

Efficiëntieclaims verdienen meer scepsis dan benchmarkclaims, omdat ze makkelijker te maken en moeilijker te controleren zijn. Deze twee houden beter stand dan de meeste, en het mechanisme is zichtbaar in de architectuur.

Sparse mixture-of-experts-modellen besteden alleen rekenkracht aan de experts waarnaar een token routeert, dus het geactiveerde aantal bepaalt het gedrag in productie, terwijl het totaal vooral een geheugenkwestie is. Met 27B actief tegenover de 40B van GLM-5.3 verricht Step 5 Preview ongeveer een derde minder werk per token, en de metingen volgen: 99,8 outputtokens per seconde tegenover 72,1, en een kostprijs per indextaak van $0,71 tegenover $2,01. Dat is hetzelfde verhaal op drie manieren verteld, en dat maakt het geloofwaardig in plaats van één enkel flatterend getal.

De cachediscount is de rij die het zwaarst weegt voor de workload waarvoor beide modellen worden verkocht. Een agent-loop die bij elke beurt dezelfde systeemprompt en repositorycontext opnieuw verzendt, bevindt zich vrijwel volledig binnen die korting, dus 95% tegenover 81% stapelt zich gedurende een lange sessie op een manier die de listprijs niet doet. Bij een mix van 7:2:1 cache-hits / input / output komt het gemengde tarief van Step 5 Preview uit op bijna $0,51 per miljoen tokens, tegenover het aanzienlijk hogere gemengde tarief van GLM-5.3 — en de kloof wordt groter naarmate de loop langer draait.

Wat nog niet te testen valt, is of die efficiëntie standhoudt op schaal. De API van Step 5 Preview ging op de dag van de release open, op één enkel endpoint. GLM-5.3 verwerkt sinds half augustus productieverkeer van vele onafhankelijke aanroepers, en een model met vijf weken echte belasting achter de rug heeft storingsmodi die bij een grote genoeg groep bekend zijn dat ze publiekelijk opduiken. Een endpoint van een paar dagen oud heeft dat allemaal niet. De efficiëntiecijfers zijn de gunstigere lezing; het operationele trackrecord is de nuttigere.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator and a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second, cost per Intelligence Index task $0.71, verbosity 160M output tokens, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning, text and image input, and a 1M-token context window.

Waarop je vandaag aan elke kant een beroep kunt doen

Dit is het enige onderdeel van de vergelijking waarin de twee niet symmetrisch zijn, en het is de moeite waard daar precies over te zijn in plaats van het af te ronden naar "beide zijn beschikbaar."

GLM-5.3 is live op OrcaRouter onder de z-ai/glm-5.3 modelpagina voor $1,26 input en $3,96 output, tegenover de $1,40 en $4,40 die Z.ai zelf op de modelpagina vermeldt — doorgegeven zonder opslag, dus het bedrag dat je ziet is het huidige tarief van de provider en niet een tarief dat wij hebben gekozen. De open gewichten staan op Hugging Face, dus hetzelfde model is op drie manieren bereikbaar: ons endpoint, Z.ai's eigen API, of je eigen hardware.

Step 5 Preview staat niet in onze catalogus en we routeren het niet. Het draait op StepFun's eigen API en Studio, en dat is de enige plek waar het draait totdat de weights beschikbaar komen. Wat er aan onze kant naast staat, is de set modellen waarmee het wordt gemeten, achter één sleutel voor meer dan 200 modellen: GLM-5.3 tegen het hierboven genoemde kortingstarief, DeepSeek V4 Pro voor $0,66 en $1,98, en Claude Opus 5 voor $5,00 en $25,00. Dat is wat de komende vier weken werkbaar maakt in plaats van geblokkeerd — je kunt de preview benchmarken tegen een productiemodel op dezelfde sleutel, met automatische failover tussen providers die het productiepad in stand houdt terwijl de capaciteitscurve van de preview nog onbekend is, en de routing-DSL die het productiegedeelte samenbrengt tot één aanroep in plaats van een tweede integratie.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.3 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and weights due October 15. The right column gives GLM-5.3 the rows AA Index 45, parameters 753B total / 40B active, price $1.40 / $4.40 list, $1.26 / $3.96 on OrcaRouter, cache discount 81%, cost per index task $2.01, and weights published under a custom licence. A footer reads 'Both per Artificial Analysis Intelligence Index v4.3.2; GLM-5.3 is scored as GLM-5.3 (max).'

Kiezen tussen een lead en een track record

Als je fine-tunet, zelf host of een afgeleid product bouwt, is GLM-5.3 het antwoord, en het is niet eens close — niet omdat het één punt hoger scoort, maar omdat het de enige van de twee is met een licentie om te lezen en een checkpoint om te downloaden. Reserveer budget voor de juridische beoordeling, want de maatwerkvoorwaarden zijn niet MIT en het verschil is van de soort dat opduikt in een inkoopaudit in plaats van in een benchmark.

Als je een model aanroept via een API en je workload bestaat uit agentische tekst in grote volumes, dan staat Step 5 Preview voorop op alles waar de factuur en de klok om geven: goedkoper per token, goedkoper per taak, sneller genereren, en een diepere cachekorting voor het patroon van herhaalde prefixen dat een agent-loop vult. Tegenover een endpoint van een paar dagen oud met één enkele bron, zonder gepubliceerd plafond voor de output en zonder licentie, is het pleidooi om het je standaard te maken een pleidooi over een benchmark, niet over een contract.

Wat het antwoord zou veranderen, is het checkpoint van 15 oktober. Een permissieve licentie zou van de efficiëntievoorsprong iets maken dat je kunt bezitten in plaats van huren, en op dat punt doet het tekort van één punt er niet meer toe — een model dat 2,8 keer goedkoper is per indextaak en 38% sneller bij generatie hoeft het totaal niet te winnen. Een restrictieve licentie maakt dat GLM-5.3 het enige van het tweetal is waarop je een product kunt bouwen, en het verschil van één punt wordt een weetje over twee modellen die je toch anders zou gebruiken.

De enige specificatie die het bekijken waard is, is het outputplafond. Beide leveranciers adverteren met een context van 1M tokens. Onze catalogus vermeldt GLM-5.3 met een maximale output van 131,1K; StepFun's aankondiging noemt een context van 1M en geen outputlimiet, en een aparte configuratie van een derde partij die tijdens het lek circuleerde, vermeldde een context van 350.000 met een maximale output van 64.000. Voor twee modellen die worden aangeprezen voor langetermijn-agentisch werk, bepaalt dat getal wat je daadwerkelijk kunt bouwen, en op dit moment heeft slechts één kant daar een antwoord op gegeven.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a cache read rate of $0.25 per million tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt