Une carte de titre principale pour « Qwen 4 Max vs GLM-5.3 » avec le sous-titre « Poids ouverts, licences personnalisées et le niveau qui est réellement livré », trois badges en forme de pilule indiquant « 1,26 $ et 3,96 $ », « texte uniquement vs multimodal » et « le 27B est celui à surveiller », une ligne de pied de page indiquant « Alibaba a annoncé le 22 septembre 2026 ; GLM-5.3 répertorié le 18 août 2026 », et le logo OrcaRouter dans le coin inférieur droit.
Engineering & Research

Qwen 4 Max vs GLM-5.3 : poids ouverts, licences personnalisées et le palier qui est réellement livré

Auteur

Gideon Frost

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Qwen 4 Max a été présenté en avant-première à la conférence Yunqi à Hangzhou le 22 septembre 2026 comme le fleuron d'une gamme de quatre modèles qui comprend également Qwen 4 Flash, Qwen 4 Plus et un niveau Qwen 4 27B à poids ouverts. Le GLM-5.3 de Z.ai est répertorié depuis le 18 août 2026, en mode texte uniquement, avec une fenêtre de contexte d'un million de jetons et un plafond de sortie de 128 000 jetons, à 1,26 $ par million de jetons d'entrée et 3,96 $ par million de jetons de sortie sur notre catalogue, contre les tarifs catalogue de 1,40 $ et 4,40 $ publiés par Z.ai. Les deux laboratoires sont issus de la tradition des poids ouverts et vendent désormais tous deux des modèles de pointe via des API hébergées, de sorte que le traditionnel clivage fermé/ouvert ne s'applique pas ici. L'axe qui s'applique réellement est celui que personne ne met dans un tableau comparatif : ce que la licence permet réellement, et quel niveau dans chaque famille est celui avec lequel vous êtes autorisé à faire quelque chose d'intéressant.

Deux laboratoires, deux réponses à la même question

Alibaba et Z.ai sont les deux éditeurs de modèles à poids ouverts les plus constants parmi les laboratoires proches de la frontière, et ils en sont venus à des positions divergentes sur la part de cette ouverture qui subsiste dans la gamme des modèles phares.

La génération Qwen 3.8 d’Alibaba a publié les poids de son plus grand modèle — Qwen3.8-2.4T-A95B, en BF16 et FP8 — le 12 août 2026. Elle les a publiés sous une licence Qwen personnalisée, et non sous Apache 2.0. C’est là tout l’enjeu : les poids existent, ce qui signifie que le fine-tuning, la quantification et l’auto-hébergement sont possibles d’une manière qui ne le sera jamais pour un modèle fermé, mais les conditions sont celles d’Alibaba et ne correspondent pas au régime permissif par défaut que l’expression « open weights » tend à laisser entendre.

La gamme GLM de Z.ai est issue d'un laboratoire dont la lignée est celle des poids ouverts, et le modèle phare n'y fait plus exception. Les poids de GLM-5.3 lui-même ont été publiés le 28 août 2026 — le modèle phare de 743 milliards de paramètres, en 141 fragments safetensors — sous une licence personnalisée que Z.ai a rédigée pour lui plutôt que sous MIT. Les termes s'apparentent à un octroi MIT, avec une condition d'examen de sécurité rattachée pour les entreprises de model-as-a-service dépassant un seuil de chiffre d'affaires élevé. Notez ce que cela signifie pour la famille : GLM-5.2 et GLM-5.3-Flash sont sous MIT, et le modèle phare ne l'est pas.

Comme indiqué, GLM-5.3 est un modèle texte uniquement doté d'une fenêtre de contexte publiée, d'un plafond de sortie publié ainsi que d'une utilisation d'outils, d'un mode JSON et d'un raisonnement documentés.

Mettez les deux côte à côte et le contraste pratique est le suivant :

• Poids phares — le modèle phare Qwen 3.8 publié sous une licence Qwen personnalisée face aux poids GLM-5.3 publiés le 28 août 2026 sous une licence Z.ai personnalisée

• Prix d'entrée — Qwen3.8-Max 2,00 $ par million de tokens contre GLM-5.3 1,26 $ par million de tokens sur notre catalogue, 1,40 $ sur la liste propre de Z.ai

• Prix de sortie — Qwen3.8-Max 6,00 $ par million de tokens, contre GLM-5.3 3,96 $ par million de tokens dans notre catalogue, et 4,40 $ sur la liste de Z.ai

• Contexte — Qwen3.8-Max 1 M de jetons versus GLM-5.3 1 M de jetons

• Plafond de sortie — Qwen3.8-Max 128 K jetons contre GLM-5.3 128 K jetons

• Modalité — Qwen3.8-Max en entrée texte, image et vidéo, contre GLM-5.3 en texte uniquement, documentée comme telle

• Étiquettes de capacités — vision, outils, JSON et raisonnement de Qwen3.8-Max contre outils, JSON et raisonnement de GLM-5.3

• Qwen 4 Max — annoncé le 22 septembre 2026, sans prix, sans contexte, sans poids, sans date, face à GLM-5.3 déjà livré et servant du trafic

La ligne multimodale est ce qui paie l'écart de prix. Le modèle phare de Qwen accepte les entrées d'images et de vidéos et facture 2,00 $ en entrée et 6,00 $ en sortie ; GLM-5.3 prend du texte et facture 1,26 $ et 3,96 $. Si votre charge de travail est textuelle, vous payez une prime d'encodeur de vision que vous n'invoquez jamais, et c'est la raison la plus concrète pour laquelle un spécialiste du texte seul bat un modèle phare multimodal sur le coût pour le travail textuel.

A two-column scoreboard titled "Qwen 4 Max vs GLM-5.3 - the scoreboard". Left column Qwen 4 Max: Status Max announced, no date; Input price $2.00 per 1M tokens; Output price $6.00 per 1M tokens; Modality text, image, video in; Flagship weights custom Qwen licence; Output ceiling 128K tokens. Right column GLM-5.3: Status shipping since Aug 18 2026; Input price $1.26 per 1M tokens; Output price $3.96 per 1M tokens; Modality text-only; Flagship weights custom Z.ai licence, Aug 28 2026; Output ceiling 128K tokens. Footer reads "GLM-5.3 pricing from its catalogue listing; Qwen3.8-Max figures from its published model card, September 22 2026.", with the OrcaRouter logo bottom-right.

C'est le palier 27B qui décide de cela

Qwen 4 Max fait la une, mais c'est le palier 27B qui est l'histoire. Chaque génération de Qwen a livré sa petite gamme ouverte sous des conditions qui permettent aux gens de faire des choses, et les preuves en aval sont sans ambiguïté : en quelques jours à peine après l'arrivée des poids de Qwen 3.8 27B, l'écosystème avait produit des conversions MLX, des quantifications NVFP4 et des fine-tunes non censurés, sans que rien de tout cela n'ait nécessité la permission de qui que ce soit. Voilà ce qu'achète une sortie permissive de petit modèle, et c'est une forme de distribution qu'aucune API hébergée ne peut égaler.

Le niveau phare est une autre affaire. Un modèle de 2,4 billions de paramètres publié sous une licence personnalisée est ouvert en ce sens que les octets sont téléchargeables et fermé en ce sens que ce que vous pouvez en faire est défini par l'éditeur. Les deux sont vraies à la fois, et l'annonce de Qwen 4 n'a changé ni l'une ni l'autre. Si le niveau 27B de Qwen 4 suit le schéma de ses prédécesseurs, ce sera la version qui compte pour le plus grand nombre de personnes, et c'est aussi la version dont la date de livraison est la plus prévisible, car les petits niveaux ouverts sont ce qu'il y a de plus facile à terminer sur la feuille de route.

Ce qui ramène la comparaison à quelque chose d’utilisable. GLM-5.3 est un modèle hébergé à un prix publié, avec un ensemble de capacités documenté, et il est disponible dès maintenant. Qwen 4 Max est un nom de gamme. Si vous voulez que l’argument de l’ouverture soit concret plutôt que philosophique, le modèle à attendre est le 27B, pas le Max.

C’est au niveau de la couche de routage que la question de la licence cesse d’avoir de l’importance.

Il existe une version de cette décision qui évite entièrement la question de la licence, et il vaut la peine de reconnaître honnêtement qu’il s’agit d’une véritable option plutôt que d’un compromis. Si votre exigence est d’appeler un modèle plutôt que d’en posséder un, la licence sur les poids n’a aucune importance et les termes qui comptent sont le prix, la latence et le comportement en cas de défaillance.

OrcaRouter propose GLM-5.3 sous l'identifiant z-ai/glm-5.3 à 1,26 $ en entrée et 3,96 $ en sortie par million de tokens — en dessous des 1,40 $ et 4,40 $ publiés par Z.ai, la page du modèle affichant ces tarifs catalogue à côté du tarif que nous facturons, sans marge ajoutée par-dessus ce que nous payons au fournisseur. Le même point de terminaison compatible OpenAI propose la famille Qwen 3.8, Qwen3.8-Max, Qwen3.8-Flash et Qwen3.8-27B, aux côtés de près de 200 autres modèles, avec un basculement automatique en cas de dégradation d'un chemin de fournisseur et un DSL de routage qui vous permet d'exprimer explicitement la politique de substitution plutôt que de modifier une chaîne de modèle dans le code de l'application. Lorsqu'un fournisseur modifie son tarif, le changement s'applique à votre clé le jour même, car il n'existe aucune couche de marge derrière laquelle il pourrait rester bloqué.

Ce qu'OrcaRouter ne propose pas, c'est Qwen 4 Max ni aucun niveau de Qwen 4. Le catalogue ne comporte aucune entrée pour cette famille, ce qui est l'état correct pour un modèle annoncé sur scène et non encore commercialisé. Qwen 4 Max sera accessible, quand il le sera, via l'API de son fournisseur et plusieurs plateformes tierces. D'ici là, le modèle Qwen de cette comparaison que vous pouvez réellement appeler est Qwen3.8-Max, et il figure dans le même catalogue que GLM-5.3 — ce qui fait de la version live de cette confrontation une décision de politique de routage plutôt qu'une décision d'achat.

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, English UI), showing the 1M token context badge, the model ID z-ai/glm-5.3, a 128K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-08-18 credited to Z.ai, a p50 time-to-first-token of 4.41s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description calling GLM-5.3 Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks.

Ce que la question de la licence détermine réellement

GLM-5.3 est moins cher sur les deux axes, sa fenêtre de contexte et son plafond de sortie correspondent à ceux du modèle phare de Qwen, ses limites de modalité sont documentées plutôt que laissées à la déduction, et il traite déjà du trafic aujourd'hui. Qwen 4 Max a un créneau de conférence et un nom de gamme, et la seule partie de la feuille de route de Qwen 4 dont la livraison est prévisible est le niveau 27B.

La décision qui subsiste après le lancement n’est pas de savoir quel modèle est meilleur. C’est de savoir si vous avez besoin de posséder la chose. Si vous devez l’auto-héberger, le fine-tuner ou le modifier, les poids phares de l’un ou l’autre laboratoire s’accompagnent de conditions que vous devriez lire avant de bâtir une entreprise sur eux, et c’est dans le petit palier ouvert que les options permissives ont historiquement vécu. Si vous devez faire appel à un modèle, GLM-5.3 est aujourd’hui la réponse la moins chère pour le travail textuel, Qwen3.8-Max est la réponse si vous avez besoin d’une entrée image ou vidéo, et il suffit d’un seul point de terminaison et d’une seule facture pour les deux. Revenez sur la question du modèle phare quand Alibaba publiera une fiche de modèle, et lisez la licence avant le tableau des benchmarks.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement