Carte de titre générée indiquant GPT-6 Sol vs Qwen 4 Max, le prix d'entrée est à égalité et presque tout le reste n'est pas comparable, avec trois cartes indiquant GPT-6 Sol sorti le 2026-09-22 avec une grille tarifaire publiée, Qwen 4 Max annoncé le 2026-09-22 sans grille publiée, et Qwen3.8 Max, le Qwen que vous pouvez router aujourd'hui à $2.00 / $6.00, avec un pied de page indiquant Qwen 4 Max a été annoncé le 2026-09-22 sans prix publié, ni fenêtre de contexte, ni poids, ni score.
Guides & Insights

GPT-6 Sol vs Qwen 4 Max : le prix des entrées est à égalité et presque tout le reste n’est pas comparable

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Voici le chiffre qui rend l'association GPT-6 Sol et Qwen 4 Max digne d'une page à part : les deux sont annoncés à 2,00 $ par million de jetons en entrée. C'est là que commence la partie exploitable de la comparaison et, pour Qwen 4 Max, presque là qu'elle se termine. L'entreprise a annoncé le palier Qwen 4 Max le 22 septembre 2026 lors de sa conférence Apsara — le jour même de la sortie de GPT-6 Sol — et, à l'heure où nous écrivons, aucune fiche modèle n'a été publiée pour lui : ni prix, ni fenêtre de contexte, ni déclaration sur les poids, ni score d'aucun évaluateur. Le fleuron Qwen qui, lui, dispose de mesures et que vous pouvez appeler dès aujourd'hui, c'est Qwen3.8 Max, sorti le 3 août 2026 à 2,00 $ / 6,00 $. La vraie question n'est donc pas de savoir comment Qwen 4 Max se comporte face à GPT-6 Sol. C'est ce que le palier annoncé vous dit de la direction que prend le fleuron de l'entreprise, et ce que le Qwen que vous pouvez réellement router fait face au modèle GPT-6 aujourd'hui.

Cette distinction n’est pas de la pédanterie. Un niveau qui a été annoncé mais non spécifié peut absorber toute hypothèse que vous voulez formuler à son sujet, et un article qui suppose discrètement que Qw​en 4 Max bat GPT-6 Sol — parce que le numéro de version est plus élevé — avance un argument que le fournisseur n’a pas avancé et que les preuves n’étayent pas.

Trois choses qui sont comparables en ce moment

• Prix d'entrée — GPT-6 Sol 2,00 $ par million contre Qwen3.8 Max 2,00 $ par million, égalité parfaite
• Prix de sortie — GPT-6 Sol 10,00 $ par million contre Qwen3.8 Max 6,00 $ par million
• Entrée mise en cache — GPT-6 Sol 0,20 $ par million contre Qwen3.8 Max 0,25 $ par million
• GPT-6 Sol 1 050 000 jetons contre Qwen3.8 Max 1 050 000 jetons
• Modalités d'entrée — les deux acceptent le texte, l'image et la vidéo ou les fichiers — GPT-6 Sol : texte, image et fichier ; Qwen3.8 Max : texte, image et vidéo
• Requête longue — GPT-6 Sol applique un tarif revu à partir de 272 000 jetons, soit 4,00 $ / 10,00 $, contre Qwen3.8 Max, sans palier sur sa fiche
• Indice d'intelligence — GPT-6 Sol 47,6 contre Qwen3.8 Max 45,4
• Indice de codage — GPT-6 Sol non publié sur cette révision contre Qwen3.8 Max 76,2
• GPQA Diamond — GPT-6 Sol 96,1 contre Qwen3.8 Max 92,8
• Terminal-Bench 4.0 — GPT-6 Sol 43,9 contre Qwen3.8 Max 38,9

Deux de ces lignes sont celles sur lesquelles il faut s’attarder. La ligne des entrées mises en cache va à l’encontre de la tendance — Qwen3.8 Max facture cinq cents de plus par million pour les lectures de cache que GPT-6 Sol, ce qui, dans une boucle d’agent à forte intensité de mise en cache, est le compteur qui bouge en premier. Et c’est dans la clause des requêtes longues que l’égalité sur le prix d’entrée se rompt définitivement : à exactement 2,00 $ en entrée, les deux semblent interchangeables jusqu’à ce qu’une requête dépasse 272 000 tokens, moment où toute la requête de GPT-6 Sol est refacturée à 4,00 $ / 15,00 $, alors que la fiche de Qwen3.8 Max ne comporte aucune étape équivalente. Sur une requête à contexte complet, le modèle de l’entreprise n’est pas seulement moins cher en sortie. C’est le seul des deux dont le tarif publié reste prévisible à partir du prix affiché.

Deux choses qui ne sont pas comparables, et pourquoi la différence compte

Le premier est la capacité de Qw​en 4 Max. L'entreprise l'a présenté comme un échelon dans une gamme plutôt que comme un produit : aucun tableau de référence, aucun chiffre de contexte, aucune déclaration sur les poids, aucun taux. Tout ce qui est écrit sur ses performances est une projection à partir de la trajectoire de la gamme Qw​en, y compris cette phrase. La seule chose qui soit lisible, c'est la cible — l'échelon qu'il remplace et le modèle que le successeur est conçu pour dépasser — et cela vous indique la direction du mouvement, pas la destination.

Le second point est la question des poids ouverts, et c'est celui qui mérite le plus d'être signalé avant de planifier un déploiement de Qw​en 4 Max. L'entreprise publie les poids de certaines parties de la famille Qwen et pas d'autres. Qwen3.8 Max, le modèle phare, est répertorié comme un modèle d'API fermé — aucun fichier de licence, aucun checkpoint téléchargeable — alors même que des modèles plus petits de la même génération sont publiés. La question de savoir si le modèle phare de la série 4 suivra les modèles plus petits ou restera fermé demeure sans réponse, et une équipe qui échafaude un plan d'auto-hébergement en tablant sur des poids ouverts parierait sur un précédent que le modèle phare actuel n'établit pas.

La comparaison qui a réellement cours oppose GPT-6 Sol à Qwen3.8 Max, et elle est plus serrée que ne le suggèrent les numéros de génération : 47,6 contre 45,4 sur l’Intelligence Index, les deux chiffres provenant de tiers sur la même révision, et GPQA Diamond un véritable 96,1 contre 92,8. Un écart d’indice de 2,2 points à trois quarts du prix de sortie est la version la plus serrée de cette confrontation disponible, et c’est celle à partir de laquelle raisonner jusqu’à ce que l’entreprise publie quelque chose pour la série 4.

Generated comparison scoreboard titled GPT-6 Sol vs Qwen 4 Max, the scoreboard, with six matched rows. GPT-6 Sol: released 2026-09-22, input $2.00 per million, output $10.00 per million, Intelligence Index 47.6, context window 1,050,000 tokens, reprices above 272K input tokens. Qwen 4 Max: announced 2026-09-22, price not published, output price not published, no score published, context window not published, weights not stated. A footer reads Qwen 4 Max was announced 2026-09-22 with no specification published; GPT-6 Sol figures per Artificial Analysis v4.3.2 and OpenAI.

Ce dont l’annonce elle-même est la preuve

Un niveau annoncé mais non spécifié n’est pas un signal vide. Il vous indique que l’entreprise a l’intention de placer son prochain modèle phare au sommet de sa gamme et qu’elle est prête à le nommer publiquement avant qu’il ne soit prêt, ce qui relève d’un changement d’habitude de communication plutôt que d’une affirmation de capacité. Cela enclenche aussi un compte à rebours : un niveau annoncé en septembre crée l’attente d’une fenêtre de commercialisation, et c’est dans l’écart entre l’annonce et la spécification que se joue généralement le positionnement concurrentiel.

Pour quiconque fait tourner actuellement Qwen3.8 Max, la conséquence pratique est que la migration sera une question de capacités plutôt que de coût. Le palier que Qw​en 4 Max est conçu pour remplacer est déjà à 2,00 $ / 6,00 $, et le successeur doit battre un modèle qui obtient 45,4 tout en coûtant un tiers de moins en sortie que GPT-6 Sol. Savoir s’il comble aussi l’écart jusqu’à 47,6 — et à quelle date — est la seule chose qui vaille la peine d’être suivie, et rien dans l’annonce n’y répond.

OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max) by Qwen, dated 2026-08-03, tagged Vision, Tools, JSON and Reasoning, showing text, image and video input with text output, a list price of $2.00 per million input and $6.00 per million output, and a p50 time to first token of 5.79 seconds.

Routage d'un modèle qui n'existe pas encore

Un seul des deux modèles Qwen de cette conversation figure dans notre catalogue, et ce n'est pas la série 4. Qwen3.8 Max est acheminé via OrcaRouter sous l'identifiant de modèle qwen/qwen3.8-max, sur la même clé que GPT-6 Sol et plus de 200 autres modèles, et l'association vaut exactement cela : un changement de route plutôt qu'un projet d'intégration lorsque l'entreprise publiera le successeur. Qwen 4 Max sera ajouté lorsqu'il y aura quelque chose à router — une fiche, un tarif, un point de terminaison — et pas avant, car il n'y a pas de manière responsable de vendre un emplacement sur la base d'une spécification qui n'a pas encore été écrite.

En attendant, la raison de garder les deux colonnes ouvertes, c'est que les deux modèles ne s'accordent pas sur l'endroit où ils sont bon marché. Qwen3.8 Max ne cède rien sur le prix des entrées, retranche un tiers au tarif de sortie de GPT-6 Sol et n'a pas de falaise du contexte long ; GPT-6 Sol affiche un indice légèrement meilleur et une remise bien plus généreuse sur les entrées mises en cache, au prix d'une re-tarification de toute la requête au-delà de 272 000 tokens. Une charge de travail longue et à forte production de sortie et une charge de travail courte et avantageuse pour le cache veulent des réponses différentes, et il n'y a qu'une règle de routage d'écart entre les deux, plutôt que deux conversations d'approvisionnement.

Le basculement de secours compte ici pour une raison propre à cette confrontation. Qwen3.8 Max est un modèle à fort volume sur nos routes — plus de 110 millions de tokens sur une fenêtre de sept jours — et c’est le volume qui met au jour la variance des endpoints. Une deuxième route configurée derrière lui signifie qu’un primaire dégradé est une nouvelle tentative, et qu’un changement de tarif sur la carte de l’entreprise, exactement le type d’événement que produit une passation de modèle phare, est actif de notre côté le jour même, parce que notre catalogue répercute les prix catalogue des fournisseurs sans marge.

Artificial Analysis model page for Qwen3.8 Max (0902), described as a proprietary Alibaba model released September 2026, showing an Intelligence rank of 32 of 225, a cost rank of 104 of 225, $2.00 per million input tokens and $6.00 per million output tokens, an 88% cache discount, 190M output tokens generated during the Index evaluation described as very verbose, and a 984k-token context window.

Que faire de ça, ce mois-ci

Si vous avez besoin d'un fleuron Qwen maintenant, celui à appeler est Qwen3.8 Max, et il est compétitif avec GPT-6 Sol sur le raisonnement à un coût de sortie nettement inférieur — voilà l'état honnête de la confrontation aujourd'hui. Si vous avez besoin du résultat publié le plus solide sur les benchmarks de raisonnement dans cette paire, le 47,6 de GPT-6 Sol est le chiffre à retenir, et sa remise sur les entrées mises en cache est la moins chère de la comparaison. Si vous attendez Qwen 4 Max, attendez une carte plutôt qu'une date, car l'annonce vous a donné le palier et rien d'autre.

Et quel que soit votre choix, vérifiez le côté GPT-6 avant de vous engager. GPT-6 Sol a déjà été remplacé par GPT-6.1 Sol au même tarif de 2,00 $ / 10,00 $, avec l'entrée mise en cache réduite de moitié à 0,10 $, et sa propre page de modèle redirige désormais les lecteurs vers lui. Une comparaison avec GPT-6 Sol revient à comparer avec un modèle dont le successeur est en vente, et la même prudence s'applique à tout chiffre Qwen tiré de l'annonce du 4 Max : les deux sont des formes d'actualité, et une seule d'entre elles correspond à un produit achetable dès maintenant.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement