
GPT-6 Sol vs Qwen 4 Max : le prix des entrées est à égalité et presque tout le reste n’est pas comparable
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Voici le chiffre qui rend l'association GPT-6 Sol et Qwen 4 Max digne d'une page à part : les deux sont annoncés à 2,00 $ par million de jetons en entrée. C'est là que commence la partie exploitable de la comparaison et, pour Qwen 4 Max, presque là qu'elle se termine. L'entreprise a annoncé le palier Qwen 4 Max le 22 septembre 2026 lors de sa conférence Apsara — le jour même de la sortie de GPT-6 Sol — et, à l'heure où nous écrivons, aucune fiche modèle n'a été publiée pour lui : ni prix, ni fenêtre de contexte, ni déclaration sur les poids, ni score d'aucun évaluateur. Le fleuron Qwen qui, lui, dispose de mesures et que vous pouvez appeler dès aujourd'hui, c'est Qwen3.8 Max, sorti le 3 août 2026 à 2,00 $ / 6,00 $. La vraie question n'est donc pas de savoir comment Qwen 4 Max se comporte face à GPT-6 Sol. C'est ce que le palier annoncé vous dit de la direction que prend le fleuron de l'entreprise, et ce que le Qwen que vous pouvez réellement router fait face au modèle GPT-6 aujourd'hui.
Cette distinction n’est pas de la pédanterie. Un niveau qui a été annoncé mais non spécifié peut absorber toute hypothèse que vous voulez formuler à son sujet, et un article qui suppose discrètement que Qwen 4 Max bat GPT-6 Sol — parce que le numéro de version est plus élevé — avance un argument que le fournisseur n’a pas avancé et que les preuves n’étayent pas.
Trois choses qui sont comparables en ce moment
• Prix d'entrée — GPT-6 Sol 2,00 $ par million contre Qwen3.8 Max 2,00 $ par million, égalité parfaite
• Prix de sortie — GPT-6 Sol 10,00 $ par million contre Qwen3.8 Max 6,00 $ par million
• Entrée mise en cache — GPT-6 Sol 0,20 $ par million contre Qwen3.8 Max 0,25 $ par million
• GPT-6 Sol 1 050 000 jetons contre Qwen3.8 Max 1 050 000 jetons
• Modalités d'entrée — les deux acceptent le texte, l'image et la vidéo ou les fichiers — GPT-6 Sol : texte, image et fichier ; Qwen3.8 Max : texte, image et vidéo
• Requête longue — GPT-6 Sol applique un tarif revu à partir de 272 000 jetons, soit 4,00 $ / 10,00 $, contre Qwen3.8 Max, sans palier sur sa fiche
• Indice d'intelligence — GPT-6 Sol 47,6 contre Qwen3.8 Max 45,4
• Indice de codage — GPT-6 Sol non publié sur cette révision contre Qwen3.8 Max 76,2
• GPQA Diamond — GPT-6 Sol 96,1 contre Qwen3.8 Max 92,8
• Terminal-Bench 4.0 — GPT-6 Sol 43,9 contre Qwen3.8 Max 38,9
Deux de ces lignes sont celles sur lesquelles il faut s’attarder. La ligne des entrées mises en cache va à l’encontre de la tendance — Qwen3.8 Max facture cinq cents de plus par million pour les lectures de cache que GPT-6 Sol, ce qui, dans une boucle d’agent à forte intensité de mise en cache, est le compteur qui bouge en premier. Et c’est dans la clause des requêtes longues que l’égalité sur le prix d’entrée se rompt définitivement : à exactement 2,00 $ en entrée, les deux semblent interchangeables jusqu’à ce qu’une requête dépasse 272 000 tokens, moment où toute la requête de GPT-6 Sol est refacturée à 4,00 $ / 15,00 $, alors que la fiche de Qwen3.8 Max ne comporte aucune étape équivalente. Sur une requête à contexte complet, le modèle de l’entreprise n’est pas seulement moins cher en sortie. C’est le seul des deux dont le tarif publié reste prévisible à partir du prix affiché.
Deux choses qui ne sont pas comparables, et pourquoi la différence compte
Le premier est la capacité de Qwen 4 Max. L'entreprise l'a présenté comme un échelon dans une gamme plutôt que comme un produit : aucun tableau de référence, aucun chiffre de contexte, aucune déclaration sur les poids, aucun taux. Tout ce qui est écrit sur ses performances est une projection à partir de la trajectoire de la gamme Qwen, y compris cette phrase. La seule chose qui soit lisible, c'est la cible — l'échelon qu'il remplace et le modèle que le successeur est conçu pour dépasser — et cela vous indique la direction du mouvement, pas la destination.
Le second point est la question des poids ouverts, et c'est celui qui mérite le plus d'être signalé avant de planifier un déploiement de Qwen 4 Max. L'entreprise publie les poids de certaines parties de la famille Qwen et pas d'autres. Qwen3.8 Max, le modèle phare, est répertorié comme un modèle d'API fermé — aucun fichier de licence, aucun checkpoint téléchargeable — alors même que des modèles plus petits de la même génération sont publiés. La question de savoir si le modèle phare de la série 4 suivra les modèles plus petits ou restera fermé demeure sans réponse, et une équipe qui échafaude un plan d'auto-hébergement en tablant sur des poids ouverts parierait sur un précédent que le modèle phare actuel n'établit pas.
La comparaison qui a réellement cours oppose GPT-6 Sol à Qwen3.8 Max, et elle est plus serrée que ne le suggèrent les numéros de génération : 47,6 contre 45,4 sur l’Intelligence Index, les deux chiffres provenant de tiers sur la même révision, et GPQA Diamond un véritable 96,1 contre 92,8. Un écart d’indice de 2,2 points à trois quarts du prix de sortie est la version la plus serrée de cette confrontation disponible, et c’est celle à partir de laquelle raisonner jusqu’à ce que l’entreprise publie quelque chose pour la série 4.

Ce dont l’annonce elle-même est la preuve
Un niveau annoncé mais non spécifié n’est pas un signal vide. Il vous indique que l’entreprise a l’intention de placer son prochain modèle phare au sommet de sa gamme et qu’elle est prête à le nommer publiquement avant qu’il ne soit prêt, ce qui relève d’un changement d’habitude de communication plutôt que d’une affirmation de capacité. Cela enclenche aussi un compte à rebours : un niveau annoncé en septembre crée l’attente d’une fenêtre de commercialisation, et c’est dans l’écart entre l’annonce et la spécification que se joue généralement le positionnement concurrentiel.
Pour quiconque fait tourner actuellement Qwen3.8 Max, la conséquence pratique est que la migration sera une question de capacités plutôt que de coût. Le palier que Qwen 4 Max est conçu pour remplacer est déjà à 2,00 $ / 6,00 $, et le successeur doit battre un modèle qui obtient 45,4 tout en coûtant un tiers de moins en sortie que GPT-6 Sol. Savoir s’il comble aussi l’écart jusqu’à 47,6 — et à quelle date — est la seule chose qui vaille la peine d’être suivie, et rien dans l’annonce n’y répond.

Routage d'un modèle qui n'existe pas encore
Un seul des deux modèles Qwen de cette conversation figure dans notre catalogue, et ce n'est pas la série 4. Qwen3.8 Max est acheminé via OrcaRouter sous l'identifiant de modèle qwen/qwen3.8-max, sur la même clé que GPT-6 Sol et plus de 200 autres modèles, et l'association vaut exactement cela : un changement de route plutôt qu'un projet d'intégration lorsque l'entreprise publiera le successeur. Qwen 4 Max sera ajouté lorsqu'il y aura quelque chose à router — une fiche, un tarif, un point de terminaison — et pas avant, car il n'y a pas de manière responsable de vendre un emplacement sur la base d'une spécification qui n'a pas encore été écrite.
En attendant, la raison de garder les deux colonnes ouvertes, c'est que les deux modèles ne s'accordent pas sur l'endroit où ils sont bon marché. Qwen3.8 Max ne cède rien sur le prix des entrées, retranche un tiers au tarif de sortie de GPT-6 Sol et n'a pas de falaise du contexte long ; GPT-6 Sol affiche un indice légèrement meilleur et une remise bien plus généreuse sur les entrées mises en cache, au prix d'une re-tarification de toute la requête au-delà de 272 000 tokens. Une charge de travail longue et à forte production de sortie et une charge de travail courte et avantageuse pour le cache veulent des réponses différentes, et il n'y a qu'une règle de routage d'écart entre les deux, plutôt que deux conversations d'approvisionnement.
Le basculement de secours compte ici pour une raison propre à cette confrontation. Qwen3.8 Max est un modèle à fort volume sur nos routes — plus de 110 millions de tokens sur une fenêtre de sept jours — et c’est le volume qui met au jour la variance des endpoints. Une deuxième route configurée derrière lui signifie qu’un primaire dégradé est une nouvelle tentative, et qu’un changement de tarif sur la carte de l’entreprise, exactement le type d’événement que produit une passation de modèle phare, est actif de notre côté le jour même, parce que notre catalogue répercute les prix catalogue des fournisseurs sans marge.

Que faire de ça, ce mois-ci
Si vous avez besoin d'un fleuron Qwen maintenant, celui à appeler est Qwen3.8 Max, et il est compétitif avec GPT-6 Sol sur le raisonnement à un coût de sortie nettement inférieur — voilà l'état honnête de la confrontation aujourd'hui. Si vous avez besoin du résultat publié le plus solide sur les benchmarks de raisonnement dans cette paire, le 47,6 de GPT-6 Sol est le chiffre à retenir, et sa remise sur les entrées mises en cache est la moins chère de la comparaison. Si vous attendez Qwen 4 Max, attendez une carte plutôt qu'une date, car l'annonce vous a donné le palier et rien d'autre.
Et quel que soit votre choix, vérifiez le côté GPT-6 avant de vous engager. GPT-6 Sol a déjà été remplacé par GPT-6.1 Sol au même tarif de 2,00 $ / 10,00 $, avec l'entrée mise en cache réduite de moitié à 0,10 $, et sa propre page de modèle redirige désormais les lecteurs vers lui. Une comparaison avec GPT-6 Sol revient à comparer avec un modèle dont le successeur est en vente, et la même prudence s'applique à tout chiffre Qwen tiré de l'annonce du 4 Max : les deux sont des formes d'actualité, et une seule d'entre elles correspond à un produit achetable dès maintenant.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
