GLM 5.5 : Date de sortie, ce qui est rapporté et à quoi s'attendre
Guides & Insights

GLM 5.5 : Date de sortie, ce qui est rapporté et à quoi s'attendre

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Zhipu AI (maintenant sous la marque Z.ai) a l'une des feuilles de route open-weight les plus surveillées dans l'IA, et la prochaine étape — largement appeléeGLM 5.5 — suscite une réelle anticipation. Mais il y a une mise en garde importante d'emblée : à fin juillet 2026,Z.ai n'a pas officiellement annoncé GLM 5.5. Il n'y a pas de fiche technique, pas de benchmarks, pas de tarification, et même pas de nom confirmé. Ce que nous avons, ce sont des rapports crédibles concernant une fenêtre de lancement en août 2026 et une base de référence très solide et bien documentée dans GLM-5.2. Ce guide sépare ce qui est réellement rapporté de ce qui est spéculation, et utilise GLM-5.2 pour fixer des attentes raisonnables.

Chaque figure ci-dessous est étiquetée par source. GLM 5.5 n'a pas de spécifications officielles ; les chiffres concrets ici appartiennent à GLM-5.2 (son prédécesseur) et sont rapportés par le fournisseur sauf indication contraire. Les informations sur GLM 5.5 proviennent de prévisions d'analystes et de couverture médiatique, pas de Z.ai. Les détails changeront — vérifiez au lancement.

TL;DR. GLM 5.5 est attendu autour d'août 2026, une fenêtre rapportée par les analystes de JPMorgan et relayée par Reuters et CGTN — pas un engagement de Z.ai. Des fuites indiquent un modèle open-weight de plus d'un billion de paramètres, axé sur les agents de codage, s'appuyant sur le contexte de 1M de tokens de GLM-5.2, mais rien de tout cela n'est confirmé (même le nom pourrait finir par être GLM-5.3 ou GLM-6). Le terrain solide est GLM-5.2 : un modèle MoE de 753B, sous licence MIT, avec un contexte de 1M, qui se classe déjà parmi les meilleurs systèmes open-weight pour le codage. Utilisez GLM-5.2 aujourd'hui ; adopter GLM 5.5 plus tard est trivial sur un point de terminaison neutre vis-à-vis du fournisseur.

Points clés

• Pas encore officiel. Fin juillet 2026, Z.ai n'a publié ni fiche technique de GLM 5.5, ni spécifications, ni tarifs — et n'a pas confirmé le nom.

• Fenêtre signalée : août 2026. Source : analystes de JPMorgan via Reuters et CGTN (fin juin 2026) — une "watch window", pas une date fournisseur.

Spécifications supposées (non confirmées) : plus de 1T paramètres, contexte de 1M tokens issu de GLM-5.2, poids ouverts, et un accent sur les agents de codage longue durée.

• Le seul signal direct : Tang Jie de Zhipu a décrit un modèle à venir comme un « epic plus » dans les médias chinois — encourageant, mais pas une fiche technique.

• Base solide : GLM-5.2 (753B MoE, contexte 1M, licence MIT) est un modèle de codage à poids ouverts de premier plan que vous pouvez utiliser dès maintenant.

Qu'est-ce qui est effectivement rapporté (et par qui) ?

Le calendrier d'août 2026 remonte à une chaîne de sources claire : des analystes de JPMorgan auraient prévu un autre modèle Z.ai pour août 2026, ce que Reuters a couvert et que CGTN a republié fin juin 2026. C'est un reportage crédible, mais il s'agit d'une prévision d'analyste, pas d'une note de version de Z.ai — il faut donc considérer août comme une fenêtre de surveillance plutôt qu'une promesse. Le seul signal direct du côté de l'entreprise est un commentaire du cofondateur de Zhipu, Tang Jie, qui a décrit une amélioration à venir comme un « epic plus » dans les médias chinois. Cela laisse entendre qu'un travail important est en cours, mais cela ne nomme pas le modèle, ne confirme pas le calendrier et ne révèle pas les spécifications.

Ce qui se raconte — et pourquoi le prendre à la légère

Des fuites dans la communauté circulant à la mi-juillet 2026 décrivent un modèle avec plus d'un billion de paramètres au total, une fenêtre de contexte d'un million de jetons reprise de GLM-5.2, des poids ouverts, et un fort accent sur les agents de codage de longue durée. Ceux-ci sont plausibles compte tenu de la trajectoire de Zhipu — mais ils ne sont pas confirmés, et les analystes eux-mêmes avertissent qu'un chiffre comme « 1T+ paramètres » ne peut pas encore être utilisé pour la planification matérielle, la tarification ou les affirmations de capacité. Même la marque est incertaine : les reportages ont évoqué GLM-5.3, GLM 5.5 et GLM-6 comme noms possibles. Quiconque cite aujourd'hui des benchmarks précis de GLM 5.5 ne fait que deviner.

La véritable référence : ce qu'est réellement GLM-5.2

Comme GLM 5.5 s'appuiera directement sur lui, GLM-5.2 est le meilleur moyen de fixer les attentes. Publié en juin 2026 sous licence MIT, GLM-5.2 est un modèle mixture-of-experts avec environ 753 milliards de paramètres au total (dont environ 40 milliards d'actifs par jeton), une fenêtre de contexte de 1 000 000 de jetons et jusqu'à 131 072 jetons de sortie, utilisant la conception d'attention sparse "IndexShare" de Zhipu. Il est entièrement en poids ouverts et auto-hébergeable.

Selon les benchmarks rapportés par les fournisseurs, GLM-5.2 est performant, surtout en codage : environ 62.1% sur SWE-bench Pro, 81.0% sur Terminal-Bench 2.1, 91.2% sur GPQA Diamond, et un quasi-saturé 99.2% sur AIME 2026, ainsi que 77.8% sur SWE-bench Verified (meilleur parmi les modèles open-source). C'est aussi bon marché — environ $1.20 par million de tokens en entrée et $4.10 par million en sortie — et Zhipu affirme qu'il bat GPT-5.5 sur plusieurs benchmarks de codage à long horizon pour une fraction du coût. Le contrepoids honnête : les composites indépendants ont tendance à obtenir des scores inférieurs aux chiffres des fournisseurs, et sur les tâches de raisonnement général les plus difficiles, GLM-5.2 est à la traîne par rapport à la frontière fermée et même à certains pairs ouverts. Néanmoins, en tant que cheval de bataille du codage en poids ouvert, c'est une option véritablement haut de gamme aujourd'hui.

Ce à quoi s'attendre raisonnablement de GLM 5.5 (étiqueté comme attente)

Sans spécifications officielles, toute attente n'est qu'une inférence. Mais les inférences fondées sur l'arc GLM-5.1 → GLM-5.2 et les fuites : attendez-vous à ce que GLM 5.5 pousse plus loin le codage agentique et à long horizon (la priorité claire de Zhipu), conserve probablement le contexte de 1M tokens, reste très probablement open-weight (GLM-5.2 était sous licence MIT, bien qu'une licence pour un successeur ne soit jamais garantie), et augmente probablement le nombre de paramètres – peut-être dans la gamme du trillion et plus. Ce que nous devrions pas supposer : des scores de benchmark spécifiques, des prix confirmés, une vision native, ou même le nom final. Traitez « plus gros, plus agentique, toujours ouvert, toujours bon marché » comme une hypothèse à vérifier au lancement, pas un fait.

Comment se préparer — et quoi utiliser aujourd'hui

Ne bloquez pas un projet en attendant un modèle qui n'est pas encore sorti. GLM-5.2 est disponible dès maintenant et constitue un excellent modèle de codage à poids ouverts, et si vous développez sur un endpoint indépendant du fournisseur et compatible OpenAI, adopter GLM 5.5 dès sa sortie est un changement de configuration plutôt qu'une réintégration. OrcaRouter expose GLM-5.2 dès aujourd'hui via un endpoint unique compatible OpenAI, aux côtés de nombreux autres modèles, afin que vous puissiez mettre GLM-5.2 en production dès maintenant et tester en A/B GLM 5.5 dès qu'il sera en ligne — puis laissez les benchmarks indépendants et vos propres tests décider s'il faut basculer.

Comment lire le lancement lorsqu'il se produit

Quand GLM 5.5 (ou quel que soit son nom final) arrivera, quelques éléments méritent d'être surveillés plutôt que pris au pied de la lettre. Vérifiez d'abord licence — les poids ouverts sont au cœur de l'attrait de GLM, et les conditions d'un successeur ne sont pas garanties. Surveillez indépendants les chiffres de codage et d'agents (SWE-bench Pro/Verified, Terminal-Bench) plutôt que les seules diapositives des fournisseurs, car les propres chiffres de Zhipu ont tendance à être élevés. Confirmez la fenêtre de contexte et tarification, qui façonnent toutes deux la valeur réelle. Et, comme toujours, exécutez vos propres tâches de codage représentatives : la position dans le classement est une hypothèse de départ, pas une garantie pour votre charge de travail.

FAQ

Quand GLM 5.5 sort-il ?

Des informations (analystes de JPMorgan via Reuters et CGTN, fin juin 2026) indiquent une fenêtre en août 2026, mais Z.ai n'a pas confirmé de date. Traitez-la comme une fenêtre de surveillance.

Existe-t-il des spécifications ou des benchmarks officiels pour GLM 5.5 ?

Non. Fin juillet 2026, il n'existe aucune fiche technique officielle, aucun benchmark, aucun prix, ni même un nom confirmé. Les chiffres concrets qui circulent actuellement ne sont que des spéculations.

Est-ce que GLM 5.5 sera open-weight ?

Probablement, étant donné que GLM-5.2 a été distribué sous licence MIT — mais la licence d'un successeur n'est jamais garantie avant la publication. Vérifiez les conditions lors du lancement.

Combien de paramètres GLM 5.5 aura-t-il ?

Des fuites suggèrent plus d'un billion de paramètres au total, contre les ~753B de GLM-5.2, mais il s'agit d'un chiffre non confirmé d'analystes/de la communauté.

Qu'est-ce que GLM-5.2, le prédécesseur ?

Le flagship open-weight de Zhipu de juin 2026 : un MoE d'environ 753B (environ 40B actifs), contexte de 1 million de tokens, sous licence MIT, performant en codage (par exemple, ~62.1% SWE-bench Pro, 81.0% Terminal-Bench 2.1, rapportés par le fournisseur) à environ 1,20 $/4,10 $ par million de tokens.

Puis-je utiliser GLM 5.5 maintenant ?

Pas encore — ce n'est pas encore sorti. Utilisez GLM-5.2 dès aujourd'hui, y compris via le point de terminaison compatible OpenAI d'OrcaRouter, et passez à GLM 5.5 lors de son lancement.

En résumé

GLM 5.5 est l'une des versions open-weight les plus attendues de 2026, mais elle n'est pas encore là — la date d'août 2026 provient d'analystes, les spécifications de trillion de paramètres et de contexte 1M sont des fuites non confirmées, et même le nom n'est pas définitif. Ce qui est solide, c'est la trajectoire et la base : GLM-5.2 est déjà un modèle de codage open-weight de premier plan, sous licence MIT et peu coûteux, et GLM 5.5 devrait faire progresser le codage agentique. Construisez dès aujourd'hui sur GLM-5.2 via un endpoint neutre comme OrcaRouter, surveillez la fiche officielle du modèle, et laissez les benchmarks indépendants ainsi que vos propres tests décider de la rapidité d'adoption de GLM 5.5 une fois qu'il sera réel. Nous mettrons à jour cet article lors de son lancement.

Comparés dans cet article3

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

providers@orcarouter.ai

Rejoignez notre communauté

Discordsupport@orcarouter.aiXGitHubYouTube