
Claude Sonnet 5.5 vs Qwen 4 Max : un modèle a une carte, l'autre a un nom
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 931 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAINOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 192 tok/s
- OrcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- xAISpaceXAI: Grok 4.62026-08-1244Intelligence77Code
Les deux moitiés de ce titre ne sont pas du même type d'objet, et c'est la première chose dont un lecteur a besoin. Claude Sonnet 5.5 est sorti le 28 septembre 2026 : il possède un identifiant d'API, une grille tarifaire, une fenêtre de contexte, une échéance de retrait publiée et une ligne dans les classements indépendants. Qwen 4 Max a été présenté en avant-première à la conférence Yunqi de Hangzhou le 22 septembre 2026 comme le modèle phare d'une gamme Qwen 4 de quatre modèles annoncée — et, à ce jour, il n'a ni prix, ni fenêtre de contexte, ni score publié, ni fiche de modèle, ni page sur Artificial Analysis à ouvrir. Ce n'est pas un scandale ; c'est ainsi qu'on annonce une gamme. Mais cela change la forme que prend une comparaison utile. La comparaison qui vaut la peine d'être faite est entre le Sonnet le plus récent déjà sorti et le modèle Qwen que vous pouvez réellement appeler aujourd'hui, à savoir Qwen3.8 Max — parce que celui-là a une grille tarifaire, et que cette grille tarifaire est instructive.
Ce qu'Alibaba a réellement mis sur la table
Qwen 4 Max a été présenté comme un nom dans une gamme, pas comme un produit. La présentation de la conférence a introduit la structure par niveaux de la famille Qwen 4, et rien à son sujet n’a depuis été converti en spécification sur laquelle un développeur pourrait s’appuyer pour planifier : aucun prix par million de tokens, aucune taille de fenêtre, aucune sortie maximale, aucun tableau de benchmarks, aucun dépôt Hugging Face, aucune entrée dans la propre liste de modèles du fournisseur. Qu’il soit commercialisé sous forme de niveau d’API fermé, de poids ouverts, ou des deux à la fois n’est indiqué nulle part dans ce que le fournisseur a publié. Quand un niveau en est à un stade aussi précoce, la seule chose honnête qu’un article puisse dire de ses spécifications, c’est qu’il n’y en a aucune — et toute page proposant dès maintenant une fiche technique de Qwen 4 Max ne fait que publier une projection.

La seule chose que l’annonce établit utilement, c’est la direction. Le dernier fer de lance commercial d’Alibaba, Qwen3.8 Max, est positionné par le guide de migration du fournisseur lui-même directement face à GPT-5.5, Claude Opus 4.7 et Gemini 3.1 Pro, et c’est le niveau que Qwen 4 Max est conçu pour remplacer. La cible du successeur est donc lisible même lorsque ses chiffres ne le sont pas, et le modèle qu’il devra battre sur le prix est celui déjà en vente.
Le Qwen que vous pouvez appeler aujourd'hui, avec un tarif à comparer à celui du nouveau Sonnet
Qwen3.8 Max est disponible de façon générale depuis le 3 août 2026. C'est le niveau de capacité le plus élevé d'Alibaba à ce jour : nativement multimodal avec entrée de texte, d'image et de vidéo et sortie de texte, une fenêtre de 1 000 000 de jetons, un mode réflexion, l'appel de fonctions, des outils intégrés et des sorties structurées, servi via des points de terminaison compatibles OpenAI, compatibles Anthropic et natifs DashScope. Alibaba le positionne pour les mêmes analyses multiphasées exigeantes et le même travail agentique pour lesquels l'éditeur positionne Claude Sonnet 5.5, et les deux affichent un tarif de référence presque exactement identique — c'est là que la comparaison devient intéressante.
• Prix d'entrée — Claude Sonnet 5.5 2,00 $ par million contre Qwen3.8 Max 2,00 $ par million, identiques
• Prix de sortie — Claude Sonnet 5.5 10,00 $ par million contre Qwen3.8 Max 6,00 $ par million
• Lecture du cache — Claude Sonnet 5.5 0,20 $ par million vs Qwen3.8 Max 0,25 $ par million
• Écriture dans le cache — Claude Sonnet 5.5 2,50 $ par million vs Qwen3.8 Max 2,50 $ par million
• Contexte — Claude Sonnet 5.5 1 000 000 de tokens contre Qwen3.8 Max 1 000 000 de tokens sur la fiche technique du fournisseur ; Artificial Analysis consigne l’instantané qu’il a mesuré à 983 616
• Sortie max — Claude Sonnet 5.5 128 000 en synchrone, 300 000 sur Batches, contre Qwen3.8 Max non publié par le fournisseur
• Modalité d'entrée — Claude Sonnet 5.5 : texte, image et fichier vs Qwen3.8 Max : texte, image et vidéo
Un tarif d’entrée identique et un tarif de sortie 40 % moins cher constituent une position tarifaire réellement solide, et c’est la raison pour laquelle Qwen3.8 Max ne cesse d’apparaître dans les comparaisons face aux modèles de pointe. Puis on regarde les mesures indépendantes, et l’avantage se déplace entièrement ailleurs.
Ce que les chiffres indépendants disent de l’avantage prix
Les deux modèles figurent sur le même Artificial Analysis Intelligence Index, révision v4.3.2, et tous deux ont été mesurés plutôt qu'estimés.
• Indice d'intelligence — Claude Sonnet 5.5 56 à effort maximal contre Qwen3.8 Max 45 sur l'instantané du 2 septembre
• Coût par tâche Index — Claude Sonnet 5.5 7,60 $ vs Qwen3.8 Max 5,41 $
• Vitesse de sortie — Claude Sonnet 5.5 138,7 tokens/s vs Qwen3.8 Max 38,2 tokens/s
• Temps jusqu'au premier chunk — Claude Sonnet 5.5 370,8 s en Max Effort vs Qwen3.8 Max 3,0 s
• Jetons de sortie générés sur l'ensemble de l'Index — Claude Sonnet 5.5 410M contre Qwen3.8 Max 190M, que le conseil signale comme très verbeux par rapport à une médiane de 88M
• GPQA Diamond — Claude Sonnet 5.5 non publié sur le tableau actuel vs Qwen3.8 Max 92,8 %
• Humanity's Last Exam — Claude Sonnet 5.5 55,0 % contre Qwen3.8 Max 43,1 %
• Rappel sur contexte long — Claude Sonnet 5.5 82,7 % contre Qwen3.8 Max 80,3 %
Deux choses ressortent, et ni l’une ni l’autre n’est le prix. La première, c’est qu’un tarif de sortie 40 % moins cher se réduit à une tâche 30 % moins chère lorsqu’on tient compte du nombre de tokens — Qwen3.8 Max émet 190 M de tokens sur l’ensemble de l’index, contre 410 M pour Claude Sonnet 5.5, ce qui est plus sobre, mais pas assez pour préserver tout l’écart de tarif. La seconde, c’est la vitesse, et là le rapport s’inverse nettement : Claude Sonnet 5.5 génère ses sorties 3,6 fois plus vite que Qwen3.8 Max, 138,7 tokens par seconde contre 38,2. Sur une longue génération, c’est la différence entre une minute et plusieurs, et ce n’est pas une différence qu’une remise par token peut corriger.
Le chiffre du premier token joue en sens inverse et mérite que sa réserve soit énoncée sans détour. 370,8 secondes, c'est Claude Sonnet 5.5 en Max Effort avec repli par défaut, une configuration de raisonnement qui dépense un budget de réflexion très important avant de répondre ; un appelant qui configure un effort moindre obtient un premier token en quelques secondes. Les 3,0 secondes de Qwen3.8 Max sont mesurées sur un modèle dont le comportement de réflexion diffère. La comparaison est réelle, mais c'est une comparaison de configurations, non de fournisseurs.

Où retombe le coût de migration Sonnet manquant
Une différence opérationnelle n'apparaît dans aucune des lignes ci-dessus et compte plus que l'écart de prix pour quiconque a du code en production. Claude Sonnet 5.5 a modifié six comportements par rapport à Claude Sonnet 5, et cinq d'entre eux cassent les intégrations existantes : les valeurs non par défaut de temperature, top_p et top_k renvoient désormais une erreur 400 ; thinking: {"type": "disabled"} renvoie une erreur 400 et doit devenir between_tools avec un effort limité à low, medium ou high ; le choix forcé d'un outil "any" ou d'un outil nommé est rejeté, donc les boucles doivent passer à auto avec l'utilisation stricte des outils ou des sorties structurées ; l'outil d'utilisation d'ordinateur computer_20251124 est refusé sur l'API Claude et Google Cloud ; et les blocs de réflexion sont désormais liés au modèle et au compte qui les produisent, donc le raisonnement est conservé depuis Sonnet 5 mais pas vers une autre famille. Le sixième changement ne casse rien et c'est donc celui qu'il est facile de livrer cassé : le texte entre les appels d'outils est désormais renvoyé à l'intérieur des blocs de réflexion, donc une application de streaming reste silencieuse entre les appels jusqu'à ce qu'elle définisse une valeur d'affichage ou désactive la réflexion en amont.
Qwen3.8 Max n'exige rien de tout cela d'un appelant Qwen — c'est un point de terminaison compatible OpenAI avec toute la surface d'échantillonnage et la forme standard d'appel d'outils — et son point de terminaison compatible Anthropic existe précisément pour que du code écrit pour Claude puisse le cibler avec un simple changement d'URL de base. Pour une équipe déjà sur Sonnet 5, passer à Sonnet 5.5 représente une journée de travail de migration avec une liste de cinq points à vérifier ; passer à Qwen3.8 Max est un changement de configuration avec un ensemble de risques différents, principalement liés à une dérive de comportement plutôt qu'à la forme de l'API.
Mettre l'accessible sur la même clé
Un pipeline réaliste fin septembre 2026 ne choisit pas l’un de ceux-ci. Il exécute un modèle Claude pour le parcours agentique et un modèle Qwen là où l’entrée vidéo ou le prix compte, et le coût de cet arrangement se traduit normalement par deux contrats, deux clés, deux surfaces de limitation de débit et deux endroits où une requête peut échouer. OrcaRouter le réduit à un seul point de terminaison compatible OpenAI sur plus de 200 modèles, avec le prix catalogue des fournisseurs répercuté et sans marge ajoutée, de sorte qu’un changement de tarif d’un fournisseur, d’un côté ou de l’autre, prend effet ici le jour même plutôt qu’au prochain renouvellement, ainsi qu’un basculement automatique entre fournisseurs en amont et un DSL de routage permettant de composer des appels à partir de plusieurs modèles.
Qwen3.8 Max est routable ici dès aujourd'hui en tant que qwen/qwen3.8-max aux tarifs d'Alibaba de 2,00 $ en entrée et 6,00 $ en sortie sur toute la fenêtre de 1 000 000 de jetons, et l'instantané du 2 septembre mesuré par Artificial Analysis est adressable en tant que qwen/qwen3.8-max-0902 lorsque vous avez besoin de la révision exacte sur laquelle un score a été établi. Ni Qwen 4 Max ni aucun autre palier Qwen 4 ne figure dans notre catalogue, et aucun palier Qwen 4 n'y figurera tant qu'Alibaba n'aura pas publié quelque chose à router. Claude Sonnet 5.5 n'est pas non plus au catalogue — il n'a qu'un jour, et la voie pour y accéder est l'API propre à Anthropic, avec Claude Sonnet 5 disponible ici aux tarifs d'Anthropic de 2,00 $ et 10,00 $ comme cible de basculement en attendant. Qwen3.8 Max achemine 52,0 millions de jetons de trafic par semaine via ce catalogue et Claude Sonnet 5 en achemine 7,9 millions, ce qui constitue la version concrète de l'argument ci-dessus : le palier Qwen n'est pas un repli de nom seulement.

La règle pour un palier annoncé
Traitez un palier annoncé comme une donnée de planification, et non comme une option d’approvisionnement. Qwen 4 Max mérite d’être suivi, car il indique vers quoi se dirige le fleuron d’Alibaba et parce qu’il finira par détrôner Qwen3.8 Max en haut de la gamme. Il ne mérite pas de servir de base à une planification, car il n’y a rien sur quoi planifier : aucun identifiant, aucun prix, aucune fenêtre, aucun poids, aucun score mesuré. Les preuves qui le rendront réel sont précises et faciles à reconnaître — une entrée dans la propre liste de modèles d’Alibaba, une ligne de prix, une fenêtre de contexte publiée, un dépôt Hugging Face si les poids sont ouverts, et une page sur Artificial Analysis, car un modèle que personne n’a mesuré n’est pas un modèle que l’on peut comparer.
D’ici là, la décision se joue entre deux modèles qui existent tous les deux. Si votre travail est agentique, les dix-sept points d’Index et la vitesse de sortie de 3,6× sont ce que vous achetez, et le coût par tâche plus élevé de Claude Sonnet 5.5 en est le prix. Si votre travail accepte des entrées vidéo, nécessite un point de terminaison natif compatible avec Anthropic sur une facture Qwen, ou ne peut tout simplement pas justifier un tarif de sortie de 10 $, Qwen3.8 Max est en promotion en ce moment au même prix d’entrée, avec une sortie 40 % moins chère et un premier token qui arrive en quelques secondes — et la mise en garde honnête, c’est qu’il paraîtra lent une fois la génération lancée, ce qui est le compromis que vous offre ce tarif moins cher.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
