Generierte Titelkarte mit dem Titel „Step 5 Preview vs. GLM-5.3 — ein Punkt Unterschied" mit zwei Spalten und einem „1 Punkt"-Badge dazwischen: Step 5 Preview bei AA Index 44, 600B gesamt / 27B aktiv, Preis 1,00 $ / 2,70 $, Ausgabe 99,8 Tokens/Sek. und Gewichte voraussichtlich am 15. Oktober; GLM-5.3 bei AA Index 45, 753B gesamt / 40B aktiv, Preis 1,40 $ / 4,40 $, Ausgabe 72,1 Tokens/Sek. und Gewichte unter einer eigenen Lizenz veröffentlicht. Eine Fußzeile lautet: „Beide gemäß Artificial Analysis Intelligence Index v4.3.2; GLM-5.3 wird als GLM-5.3 (max) bewertet."
Guides & Insights

Step 5 Preview vs. GLM-5.3: Einen Punkt auseinander, und nur eines von ihnen hat eine Lizenzdatei

Autor

Alistair Wren

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Auf dem unabhängigen Board Step 5 Preview und GLM-5.3 liegen einen Punkt auseinander: 44 gegen 45 auf dem Artificial Analysis Intelligence Index v4.3.2, wobei GLM-5.3 als GLM-5.3 (max) gewertet wird und Step 5 Preview überhaupt kein Effort-Label trägt. Das ist der engste Abstand in dieser Reihe, und zugleich die am wenigsten nützliche Zahl im Vergleich. Die Zahl, die den Ausschlag gibt, ist, dass GLM-5.3 Gewichte hat, die man heute herunterladen kann — veröffentlicht von Z.ai unter einer eigenen Lizenz, die nicht MIT ist —, während Step 5 Preview, am 20. September 2026 von StepFun angekündigt, ein Hugging-Face-Repository besitzt, das eine einzige .gitattributes und ein angegebenes Veröffentlichungsdatum des 15. Oktober für den BF16-Checkpoint enthält. Das Launch-Material von StepFun beschreibt das Modell als ein Top-Drei-Open-Source-Ergebnis. Open Source ist es noch nicht. GLM-5.3 ist es, und seine Lizenz ist das, was man lesen sollte, bevor man damit plant.

Was ein Indexpunkt tatsächlich bringt

Beide Modelle wurden vom selben Labor durch dieselben zehn Evaluierungen geschickt, was den Vergleich gleichzeitig ungewöhnlich sauber und ungewöhnlich wenig hilfreich macht.

• Intelligenz-Index — Step 5 Preview 44 vs. GLM-5.3 45

• Wo das einzuordnen ist — GLM-5.3 liegt einen Punkt über Step 5 Preview; Step 5 Preview liegt gleichauf mit Kimi K3

• Parameter — Step 5 Preview 600B gesamt / 27B aktiv vs. GLM-5.3 753B gesamt / 40B aktiv

• Ausgabegeschwindigkeit — Step 5 Preview 99,8 Tokens/Sek. vs. GLM-5.3 72,1 Tokens/Sek.

• Zeit bis zum ersten Token — Step 5 Preview 2,96 s vs. GLM-5.3 2,99 s

• Preis pro 1 Mio. Token — Step 5 Preview 1,00 $ in / 2,70 $ out vs. GLM-5.3 1,40 $ in / 4,40 $ out

• Cache-Rabatt — Step 5 Preview 95 % vs. GLM-5.3 81 %

• Kosten pro Intelligence-Index-Aufgabe — Step 5 Preview 0,71 $ vs. GLM-5.3 2,01 $

• Kontext — beide 1 Mio. Token; unser Katalog führt GLM-5.3 mit einer Ausgabegrenze von 131,1K auf, StepFun hat keine veröffentlicht

• Gewichte — Step 5 Preview geschlossen, BF16-Checkpoint für den 15. Oktober geplant; GLM-5.3 unter einer benutzerdefinierten Z.ai-Lizenz veröffentlicht

Liest man diese Zeilen zusammen, ist der Ein-Punkt-Abstand nicht mehr die Schlagzeile. Step 5 Preview ist bei der Eingabe 29 % günstiger, bei der Ausgabe 39 % günstiger, erzeugt Tokens 38 % schneller und bietet einen Cache-Rabatt, der 14 Punkte tiefer geht – und die Kennzahl Kosten pro Index-Aufgabe, die Ausführlichkeit und Cache-Verhalten in einer einzigen Zahl bündelt, ist 2,8-mal niedriger. Das gelingt mit insgesamt 600B gegenüber 753B von GLM-5.3, mit 27B aktiv gegenüber 40B. Auf der Effizienzachse ist das kein knappes Duell; bei der Leistungsfähigkeit ist es so knapp, wie es die Bestenliste hergibt.

Die eine Zeile, in der Step 5 Preview nicht gewinnt, ist die, die am schwersten zu beheben ist: GLM-5.3 hat eine Lizenzdatei, Step 5 Preview nicht.

Die Lizenz macht den ganzen Unterschied, und sie ist nicht MIT

Es ist leicht anzunehmen, dass das offene Flaggschiff eines chinesischen Labors unter MIT erscheint, weil mehrere es tun. Z.ais eigene GLM-5.2 und GLM-5.3-Flash tragen beide MIT. Das GLM-5.3-Flaggschiff dagegen nicht – es erscheint unter einer eigens geschaffenen „glm-5.3“-Lizenz, die die kommerzielle Nutzung vorbehaltlich einer Reihe von Einschränkungen erlaubt. Das ist ein inhaltlich anderes Dokument als die MIT-Bedingungen, die das kleinere Geschwistermodell trägt, und für ein Unternehmen, dessen Anwälte die Lizenz vor dem README lesen, ist es eher ein Gespräch als eine Formsache.

Step 5 Preview hat noch überhaupt keine Lizenz, was ein anderes Problem ist und nicht offensichtlich ein kleineres. Eine restriktive Lizenz sagt dir, was du tun darfst, und überlässt es dir zu entscheiden, ob die Bedingungen akzeptabel sind. Keine Lizenz sagt dir nichts: keine Erlaubnis zur kommerziellen Nutzung, kein Recht auf Weiterverbreitung, keine Genehmigung für Fine-Tuning und keine Möglichkeit zu beurteilen, ob der Checkpoint vom 15. Oktober für dein Produkt nutzbar sein wird, bis er erscheint. Der Repository-Name, den StepFun reserviert hat — stepfun-ai/Step-5-Preview-BF16 — benennt ein bfloat16-Format, also das Artefakt, von dem aus du fine-tunest und quantisierst, statt das, das du auslieferst. Das verrät dir die Form des Releases. Es verrät dir nicht seine Bedingungen.

Der ehrliche Vergleich ist also der zwischen einer Lizenz, die man lesen und der man widersprechen kann, und einer Lizenz, die nicht existiert. Für ein Team, das Fine-Tuning, Self-Hosting in einer kontrollierten Umgebung oder den Vertrieb eines abgeleiteten Produkts benötigt, ist GLM-5.3 das einzige dieser beiden, das eine Antwort hat, und die Antwort ist eine rechtliche Prüfung statt einer Genehmigung.

Die Effizienzlücke ist der Teil, der standhält.

Effizienzbehauptungen verdienen mehr Skepsis als Benchmark-Behauptungen, weil sie leichter aufzustellen und schwerer zu überprüfen sind. Diese beiden halten besser stand als die meisten, und der Mechanismus ist in der Architektur sichtbar.

Sparse-Mixture-of-Experts-Modelle verwenden Rechenleistung nur für die Experten, an die ein Token geroutet wird, daher bestimmt die aktivierte Zahl das Produktionsverhalten, während die Gesamtzahl vor allem eine Speicherfrage ist. Mit 27B aktiven Parametern gegenüber den 40B von GLM-5.3 leistet Step 5 Preview pro Token grob ein Drittel weniger Arbeit, und die Messwerte bestätigen das: 99,8 Ausgabe-Tokens pro Sekunde gegenüber 72,1 sowie Kosten pro Index-Aufgabe von 0,71 US-Dollar gegenüber 2,01 US-Dollar. Das ist dieselbe Geschichte, dreifach erzählt, und genau das macht sie glaubwürdig statt nur eine einzelne schmeichelhafte Zahl.

Der Cache-Rabatt ist die Zeile, die für die Arbeitslast am wichtigsten ist, für die beide Modelle verkauft werden. Eine Agentenschleife, die bei jedem Durchlauf denselben System-Prompt und Repository-Kontext erneut sendet, lebt fast vollständig innerhalb dieses Rabatts, sodass sich 95 % gegenüber 81 % über eine lange Sitzung hinweg auf eine Weise summieren, wie es der Listenpreis nicht tut. Bei einem Verhältnis von 7:2:1 aus Cache-Treffern, Input und Output liegt der Mischpreis von Step 5 Preview bei etwa 0,51 $ pro Million Tokens, gegenüber dem deutlich höheren Mischpreis von GLM-5.3 – und die Lücke wird größer, je länger die Schleife läuft.

Was sich noch nicht testen lässt, ist, ob diese Effizienz im großen Maßstab Bestand hat. Die API von Step 5 Preview wurde am Starttag geöffnet, auf einem einzigen Endpunkt. GLM-5.3 trägt seit Mitte August Produktionsverkehr über viele unabhängige Aufrufer hinweg, und ein Modell mit fünf Wochen echter Last hinter sich weist Fehlermodi auf, die einer ausreichend großen Population bekannt sind, sodass sie öffentlich zutage treten. Ein erst wenige Tage alter Endpunkt hat nichts davon. Die Effizienzzahlen sind die günstigere Lesart; die operative Erfolgsbilanz ist die nützlichere.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator and a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second, cost per Intelligence Index task $0.71, verbosity 160M output tokens, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning, text and image input, and a 1M-token context window.

Worauf du heute auf jeder Seite zurückgreifen kannst

Dies ist der eine Teil des Vergleichs, in dem die beiden nicht symmetrisch sind, und es lohnt sich, dabei genau zu sein, statt auf „beide sind verfügbar“ abzurunden.

GLM-5.3 ist live auf OrcaRouter unter der z-ai/glm-5.3 Modellseite bei 1,26 $ für Eingabe und 3,96 $ für Ausgabe, gegenüber den 1,40 $ und 4,40 $, die Z.ai auf der Modellseite selbst auflistet — ohne Aufschlag weitergegeben, sodass die Zahl, die Sie sehen, der aktuelle Tarif des Anbieters ist und nicht einer, den wir gewählt haben. Die offenen Gewichte sind auf Hugging Face, sodass dasselbe Modell auf drei Wegen erreichbar ist: über unseren Endpunkt, die eigene API von Z.ai oder Ihre eigene Hardware.

Step 5 Preview ist nicht in unserem Katalog, und wir routen es nicht. Es läuft über StepFuns eigene API und Studio, und das ist der einzige Ort, an dem es läuft, bis die Gewichte veröffentlicht werden. Was auf unserer Seite daneben steht, ist die Gruppe von Modellen, an denen es gemessen wird, hinter einem Schlüssel für mehr als 200 Modelle: GLM-5.3 zum oben genannten Rabattsatz, DeepSeek V4 Pro zu 0,66 $ und 1,98 $ sowie Claude Opus 5 zu 5,00 $ und 25,00 $. Das ist es, was die nächsten vier Wochen machbar statt blockiert macht — Sie können die Preview gegen ein Produktionsmodell mit demselben Schlüssel benchmarken, wobei automatisches Failover über Anbieter hinweg den Produktionspfad aufrechterhält, solange die Kapazitätskurve der Preview noch unbekannt ist, und die Routing-DSL den Produktionszweig in einen einzigen Aufruf zusammenfasst statt in eine zweite Integration.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.3 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and weights due October 15. The right column gives GLM-5.3 the rows AA Index 45, parameters 753B total / 40B active, price $1.40 / $4.40 list, $1.26 / $3.96 on OrcaRouter, cache discount 81%, cost per index task $2.01, and weights published under a custom licence. A footer reads 'Both per Artificial Analysis Intelligence Index v4.3.2; GLM-5.3 is scored as GLM-5.3 (max).'

Die Wahl zwischen einem Lead und einer Erfolgsbilanz

Wenn Sie Fine-Tuning betreiben, selbst hosten oder ein abgeleitetes Produkt entwickeln, ist GLM-5.3 die Antwort, und zwar mit großem Abstand – nicht weil es einen Punkt mehr erzielt, sondern weil es das einzige der beiden mit einer Lizenz zum Lesen und einem Checkpoint zum Herunterladen ist. Planen Sie die rechtliche Prüfung ein, denn die individuellen Bedingungen sind nicht MIT, und der Unterschied ist von der Art, die in einem Beschaffungsaudit auftaucht und nicht in einem Benchmark.

Wenn Sie ein Modell per API aufrufen und Ihre Workload aus agentischem Text in großem Umfang besteht, ist Step 5 Preview bei allem voraus, worauf Rechnung und Uhr achten: günstiger pro Token, günstiger pro Aufgabe, schneller bei der Generierung und ein tieferer Cache-Rabatt für das Muster wiederholter Präfixe, das einen Agenten-Loop füllt. Gegenüber einem erst wenige Tage alten Single-Source-Endpunkt ohne veröffentlichte Ausgabeobergrenze und ohne Lizenz ist das Argument, es zu Ihrem Standard zu machen, ein Argument über einen Benchmark, nicht über einen Vertrag.

Was die Antwort ändern würde, ist der Kontrollpunkt vom 15. Oktober. Eine permissive Lizenz würde den Effizienzvorsprung zu etwas machen, das man besitzen statt mieten kann, und dann spielt das Ein-Punkt-Defizit keine Rolle mehr — ein Modell, das pro Index-Aufgabe 2,8-mal günstiger und bei der Generierung 38 % schneller ist, muss nicht in der Gesamtwertung gewinnen. Eine restriktive Lizenz lässt GLM-5.3 als das einzige der beiden übrig, auf dem man ein Produkt aufbauen kann, und die Ein-Punkt-Lücke wird zu einer Nebensache über zwei Modelle, die man ohnehin unterschiedlich einsetzen würde.

Die eine Spezifikation, die man im Auge behalten sollte, ist die Ausgabeobergrenze. Beide Anbieter werben mit einem 1-Mio.-Token-Kontext. Unser Katalog führt GLM-5.3 mit einer maximalen Ausgabe von 131,1K; StepFuns Ankündigung nennt einen 1-Mio.-Token-Kontext und keine Obergrenze für die Ausgabe, und eine separate Drittanbieter-Konfiguration, die während des Leaks kursierte, führte 350.000 Kontext mit einer maximalen Ausgabe von 64.000 auf. Bei einem Modellpaar, das für Long-Horizon-Agentenarbeit verkauft wird, entscheidet diese Zahl darüber, was man tatsächlich bauen kann, und derzeit hat nur eine Seite darauf geantwortet.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a cache read rate of $0.25 per million tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert