Carte de titre générée intitulée « Step 5 Preview vs GLM-5.5 — l'un est livré, l'autre non » avec deux colonnes : Step 5 Preview à l'indice AA 44, 600 Md au total / 27 Md actifs, prix 1,00 $ / 2,70 $, débit de sortie de 99,8 jetons/s et API en production depuis le 20 septembre ; GLM-5.5 avec des lignes indiquant aucune fiche de modèle, aucun identifiant d'API, aucune tarification et aucun nom confirmé. Un pied de page indique « Les chiffres de Step 5 Preview selon Artificial Analysis ; GLM-5.5 est un modèle non annoncé et non publié. »
Guides & Insights

Step 5 Preview vs GLM-5.5 : un modèle est disponible aujourd'hui, l'autre n'est encore qu'une prévision.

Auteur

Gideon Frost

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Step 5 Preview a ouvert son API le 20 septembre 2026, le jour même où StepFun l'a annoncé, et vous pouvez l'appeler cet après-midi depuis un point de terminaison unique à 1,00 $ par million de jetons d'entrée et 2,70 $ par million de jetons de sortie. GLM-5.5 n'existe pas. Il n'y a pas de fiche de modèle, pas d'identifiant d'API, pas de prix, pas de checkpoint ni de fichier de licence, et il n'existe aucune page Z.ai où que ce soit qui utilise ce nom — parce que GLM-5.5 est un raccourci communautaire que l'entreprise n'a jamais adopté. Cette asymétrie, c'est l'article. Ce qui suit, c'est ce que StepFun a réellement livré, ce qui est véritablement établi à propos du prochain modèle phare de Z.ai, et le face-à-face que vous pouvez lancer aujourd'hui à la place de celui du titre.

Ce qu'est GLM-5.5, et ce qu'il n'est pas

Le nom a commencé à circuler à la mi-2026, associé à une fenêtre de sortie, et cette fenêtre a une origine traçable : une prévision d'analyste relayée le 25 juin 2026, qui situait le prochain modèle phare de Z.ai en août. Il s'agissait d'une période de surveillance, non d'un engagement du fournisseur, et août s'est achevé sans rien. Ce que Z.ai a livré à la place, c'est GLM-5.3, annoncé le 14 août, avec son API en ligne autour du 18 août et des poids ouverts le 28 août, suivi de GLM-5.3-Flash le 26 août. Aucun point de contrôle GLM-5.5 n'est apparu dans l'organisation Hugging Face du fournisseur lui-même, où les dépôts les plus récents s'arrêtent encore à la série GLM-5.3.

La dénomination reste elle aussi incertaine. GLM-5.3, GLM-5.4, GLM-5.5 et GLM-6 ont tous été évoqués dans la même fenêtre, et Z.ai n'en a confirmé aucun. Le seul signal du côté de l'entreprise est la remarque d'un cofondateur à propos d'une sortie « epic plus », ce qui relève de l'humeur plutôt que d'une spécification. Les analystes qui décryptent la cadence du fournisseur — environ un modèle phare tous les 54 à 70 jours — projettent désormais le prochain modèle dans une fenêtre allant du 8 octobre au 9 novembre 2026, et s'attendent à ce qu'il soit numéroté GLM-5.4 plutôt que GLM-5.5.

Trois affirmations circulent comme si elles étaient confirmées, et il vaut la peine d'être précis à propos des trois. Le nombre de paramètres est l'élément le plus fragile : rien d'officiel n'étaye le chiffre de « plus de 1 000 milliards », et les publications ultérieures sur les réseaux sociaux qui l'ont gonflé au-delà de 3 000 milliards ne citent absolument rien. Le contexte de 1 M de tokens est l'hypothèse la plus sûre, car GLM-5.2 et GLM-5.3 en disposent tous les deux. La mise à disposition des poids ouverts relève de l'attente plutôt que d'une promesse — Z.ai a publié les poids de ses plusieurs derniers modèles phares, ce qui constitue une tendance, et non un engagement.

Ce que Step 5 Preview livre réellement

Le modèle de StepFun constitue la moitié concrète de cette comparaison, et sa spécification est inhabituelle. Il s'agit d'un modèle à mélange d'experts sparse de 600 B de paramètres au total, avec environ 27 B actifs par token — un taux d'activation proche de 4,5 % — construit sur un transformer étroit et profond de 92 couches, doté d'une attention à requêtes groupées sparse et d'une fusion de tokens par blocs. La fenêtre de contexte est de 1 M de tokens, l'entrée est du texte et des images, la sortie est du texte, et il raisonne avec une réflexion étendue. StepFun a sauté toute la gamme Step 4.x pour en arriver là, passant directement de Step-3.7-Flash à Step 5.

• Intelligence Index — 44 sur Artificial Analysis, 24ᵉ sur 200 modèles évalués, contre une médiane de 24

• Vitesse de sortie — 99,8 jetons par seconde, 45e sur 200

• Temps jusqu'au premier token — 2,96 secondes lors de la même exécution indépendante

• Prix — 1,00 $ par million de jetons d’entrée, 2,70 $ par million de jetons de sortie, avec une remise de 95 % sur le cache

• Coût par tâche de l'Intelligence Index — 0,71 $, 27e sur 200

• Poids — aucun aujourd'hui ; un checkpoint BF16 est prévu pour le 15 octobre 2026

• Licence — aucune publiée. Le modèle est propriétaire, sans mention d’octroi d’utilisation commerciale, de droit de redistribution ou d’autorisation de fine-tuning.

Le prix est la ligne qui attire l’œil, et c’est aussi le cas d’une ligne qui est moins à l’avantage de StepFun qu’elle n’en a l’air à première vue : 160 M de tokens de sortie sur l’Intelligence Index, contre une médiane de 92 M, soit 64e sur 200 pour cette mesure. Le modèle est bavard, et la verbosité est un multiplicateur de coût précisément dans les charges de travail agentiques pour lesquelles il est vendu. Le chiffre de 0,71 $ de coût par tâche intègre déjà cela, c’est pourquoi il est plus honnête de le citer que le prix catalogue.

Les propres évaluations de StepFun n’ont pas été reproduites et doivent être lues comme des documents de fournisseur tant qu’un tiers indépendant ne les a pas exécutées. Elles placent le modèle à 29,5 sur ALE-CLI, 66,4 sur FrontierFinance, 83,3 sur DRACO, 80,5 sur ProgramBench, 67,7 sur DeepSWE v1.1 et 49,0 sur StepCodeBench, avec 33,3 % sur Terminal-Bench 4.0 et 1 571 sur GDPval-AA v2. StepFun rapporte également un pic MLA de 508 TFLOPS dans une tâche d’optimisation de noyau GPU de 24 heures, contre 493 pour Claude Opus 5. Ce sont les chiffres de StepFun à propos d’un modèle que StepFun n’a pas ouvert.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator with a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens against a 92M median, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning support, text and image input, and a 1M-token context window.

Le comparatif direct que vous pouvez exécuter à la place de celui-ci.

Si vous voulez la comparaison que le titre promet, le substitut honnête est Step 5 Preview face à GLM-5.3 — le modèle que Z.ai a réellement livré, toujours son actuel modèle phare ouvert, et celui que n'importe quel GLM-5.5 remplacerait. Sur le classement indépendant, un seul point les sépare. Sur presque tout le reste, ce n'est pas le cas.

• Indice d'intelligence — Aperçu de Step 5 44 vs GLM-5.3 45

• Paramètres — 600 B au total / 27 B actifs contre 753 B au total / 40 B actifs

• Vitesse de sortie — 99,8 tokens/s vs 72,1 tokens/s

• Temps jusqu'au premier token — 2,96 s vs 2,99 s

• Prix pour 1 M de tokens — 1,00 $ en entrée / 2,70 $ en sortie vs 1,40 $ en entrée / 4,40 $ en sortie

• Remise cache — 95 % vs 81 %

• Coût par tâche de l'Intelligence Index — 0,71 $ vs 2,01 $

• Modalité d'entrée — texte et images vs texte uniquement

• Licence — aucune publiée vs une licence Z.ai personnalisée qui n'est pas MIT

Le profil reproduit ce que le lancement de Step 5 Preview a établi face à chaque modèle commercialisé auquel il a été comparé : une avance décisive en efficacité et une égalité statistique en capacités. Il génère des tokens environ 38 % plus vite, coûte à peu près moitié moins par million de tokens dans les deux sens, et revient 2,8 fois moins cher par tâche d’indexation face à GLM-5.3 — tout en obtenant un point de moins. Au classement, ce 44 le place aussi à égalité avec Kimi K3, ce qu’il vaut la peine de savoir avant de considérer l’un ou l’autre comme un leader.

La seule ligne où Step 5 Preview est incontestablement à la traîne est celle que l'on ne peut pas évaluer. GLM-5.3 dispose d'un fichier de licence et de poids téléchargeables ; Step 5 Preview a un dépôt Hugging Face ne contenant qu'un seul .gitattributes et une date indiquée au 15 octobre pour le checkpoint BF16. Si le prochain modèle phare de Z.ai arrive avec des poids ouverts selon les mêmes conditions personnalisées qu'il a utilisées depuis le début de l'année, il se retrouve dans la seule catégorie où Step 5 Preview n'a actuellement aucune réponse — ce qui est la vraie raison pour laquelle une comparaison avec GLM-5.5 mérite d'être attendue plutôt que lancée.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.5 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and API live since September 20. The right column gives GLM-5.5 the rows AA Index no model to score, parameters more than 1T rumored and unconfirmed, price none, cache discount none, cost per index task none, and availability not released. A footer reads 'Step 5 Preview figures per Artificial Analysis Intelligence Index; GLM-5.5 is an unannounced, unreleased model with no vendor or independent figures.'

Pourquoi attendre GLM-5.5 est l'option coûteuse

Le problème pratique, avec un modèle qui reste à deux mois de disponibilité depuis deux mois, c’est que votre travail d’évaluation ne peut pas attendre en même temps que lui. GLM-5.5 n’a pas d’endpoint, il ne peut donc pas être évalué sur des benchmarks, comparé en termes de prix, testé en charge ni placé derrière une règle de repli. Chaque semaine passée à planifier autour de lui est une semaine de décisions reportées sur la foi d’une prévision — et la prévision a déjà manqué une fenêtre.

GLM-5.3, en revanche, est disponible sur OrcaRouter sous z-ai/glm-5.3 à 1,26 $ en entrée et 3,96 $ en sortie, contre les tarifs Z.ai de 1,40 $ et 4,40 $ affichés sur sa propre page. Ce tarif est répercuté sans marge, ce qui signifie que le chiffre que vous voyez correspond au tarif actuel du fournisseur plutôt qu'à un tarif que nous avons fixé, et qu'une modification de prix par le fournisseur est répercutée de notre côté le jour même plutôt qu'au cycle de facturation suivant.

Step 5 Preview ne figure pas dans notre catalogue et nous ne le routons pas. Il fonctionne sur l'API et le Studio propres à StepFun, et c'est le seul endroit où il tourne jusqu'à l'arrivée du checkpoint du 15 octobre. Ce qu'OrcaRouter vous offre entre-temps, c'est tout ce qui se trouve de l'autre côté de cette comparaison derrière une seule API pour plus de 200 modèles : GLM-5.3 au tarif ci-dessus, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 et le reste, avec un basculement automatique entre fournisseurs qui maintient stable un chemin de production alors que la courbe de capacité d'une preview reste encore inconnue, et le DSL de routage qui en compose plusieurs en un seul appel plutôt que de passer par une seconde intégration. Comparez la preview à un modèle de production sur la même clé ; laissez le chemin de production là où il est.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a seven-day median time to first token of 3.68 seconds and a 95th percentile of 10.00 seconds, seven-day traffic of 2296.2M tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

Qu’est-ce qui changerait la réponse ?

Deux dates décident de cela. Le 15 octobre est la date à laquelle StepFun a annoncé l’arrivée du checkpoint BF16 de Step 5 Preview, et la licence qui l’accompagne est l’inconnue la plus lourde de conséquences de la comparaison — une licence permissive ferait de l’avantage de coût par tâche d’un facteur 2,8 quelque chose que vous possédez plutôt que louez, et effacerait le seul axe sur lequel GLM-5.3 est clairement en avance. Une licence restrictive laisse GLM-5.3 comme le seul des deux sur lequel vous pouvez construire un produit, et transforme l’écart d’un point en un détail anecdotique à propos de deux modèles que vous utiliseriez de toute façon différemment.

Le second est la fenêtre d’analyse qui court du 8 octobre au 9 novembre pour le prochain modèle phare de Z.ai, qui s’appellera peut-être ou non GLM-5.5 et ressemblera peut-être ou non à la rumeur. S’il arrive un jour, il se présentera comme un modèle avec une licence et un checkpoint — les deux choses qui manquent à Step 5 Preview — et la comparaison deviendra réelle.

Tant que les deux ne sont pas résolus, la question utile n’est pas de savoir lequel des deux est meilleur, car l’un des deux ne peut pas être exécuté. Elle est de savoir sur lequel des modèles qui existent vous devriez vous appuyer dès maintenant, et si la réponse change lorsque le prochain checkpoint apparaît. Cette question a une réponse testable cette semaine, et elle n’exige pas d’attendre qu’un nom devienne un modèle.

Comparés dans cet article3

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement