
GPT-6 vs Claude Opus 5.5 : le modèle que tout le monde vient d’obtenir, face à celui qui reste toujours en tête
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Le 7 octobre 2026, GPT-6 est devenu le modèle auquel parlent plus de 1,2 milliard d'utilisateurs hebdomadaires de ChatGPT, et ce n'est toujours pas le modèle le mieux noté du classement indépendant. GPT-6 Sol — le niveau qu'OpenAI a activé pour ChatGPT Plus, Pro, Business et Enterprise — obtient 47,6 sur l'Intelligence Index v4.3.2 d'Artificial Analysis. Claude Opus 5.5, qu'Anthropic a lancé le 22 septembre 2026 à 4,00 $ par million de tokens d'entrée et 20,00 $ par million de tokens de sortie, obtient 57,6 sur la même révision. Dix points, sur la seule mesure sur laquelle les équipes marketing des deux fournisseurs acceptent d'être évaluées.
Cet écart est réel, et je ne vais pas le minimiser. Mais c’est aussi le fait le moins intéressant concernant ce duo en octobre, parce que ce qui a changé cette semaine n’est pas un benchmark. GPT-6 est arrivé dans ChatGPT pour tout le monde avec une capacité qu’OpenAI appelle Intelligent UI, et le modèle qui alimente les niveaux payants de ce déploiement est GPT-6 Sol. Donc la comparaison utile n’est plus « quelle API est la meilleure » — elle est « qu’ont réellement obtenu les 1,2 milliard de personnes qui viennent de recevoir GPT-6, et est-ce suffisant pour qu’un développeur ou une équipe arrête de payer pour Claude Opus 5.5 ». Les deux réponses diffèrent, et la différence n’est pas les dix points.
Qu’est-ce qui a réellement changé le 7 octobre ?
Pour être précis quant à la date, car il ne s'agit pas d'un lancement : GPT-6 Sol et GPT-6 Luna sont sortis le 22 septembre 2026 en tant que modèles API. GPT-6 Astra, le modèle phare, les précède — OpenAI l'a mis à disposition le 3 septembre 2026. Ce qui s'est passé le 7 octobre, c'est que GPT-6 est arrivé dans l'onglet Chat de ChatGPT à l'échelle mondiale pour Plus, Pro, Business et Enterprise, les offres Free et Go suivant à partir du 8 octobre ; l'accès Enterprise dépend toujours des paramètres d'un administrateur d'espace de travail. Il s'agit d'un événement de distribution, et non d'une sortie, et la distinction compte pour quiconque lit les articles plus anciens.
La capacité qui y est associée constitue la véritable nouveauté. L'interface intelligente permet à GPT-6 de composer une réponse à partir de texte, d'éléments graphiques, de boutons cliquables, de formulaires et de graphiques, choisis en fonction de la question, et de diffuser l'interface au fur et à mesure que le modèle la génère. La présentation qu'en fait OpenAI elle-même est qu'une comparaison peut revenir côte à côte, une explication sous forme de diagramme interactif, et une réponse en texte brut lorsque le texte est la bonne réponse. Deux résultats internes rapportés par le fournisseur l'accompagnent : sur des tâches agentiques quotidiennes à forte valeur, GPT-6 en effort Extra High commence à répondre en même temps que GPT-5.6 en Medium tout en obtenant un score global meilleur que GPT-5.6 en Extra High, et sur les questions nécessitant une recherche web, GPT-6 Instant commence à répondre 44 % plus tôt en moyenne que GPT-5.6 Instant. Ces deux chiffres sont ceux d'OpenAI, repris de sa propre annonce, et aucun n'a encore fait l'objet d'une reproduction indépendante.
Deux grilles tarifaires, et où les dix points sont achetés
Aucun des deux modèles n’a changé son prix cette semaine. Claude Opus 5.5 est à 4,00 $ en entrée et 20,00 $ en sortie depuis le 22 septembre. GPT-6 Sol est à 2,00 $ et 10,00 $ depuis le même jour. Une ligne par dimension, les deux côtés sur chacune :
• Entrée du titre — GPT-6 Sol 2,00 $ par million contre Claude Opus 5.5 4,00 $ ; Sol est à moitié prix
• Sortie du titre — GPT-6 Sol 10,00 $ par million contre Claude Opus 5.5 20,00 $ ; encore la moitié
• Clause de contexte long — GPT-6 Sol refacture toute la requête à 4,00 $ en entrée et 15,00 $ en sortie au-delà de 272 000 tokens d'entrée Opus 5.5 n'a pas de palier comparable à sa fenêtre de 1 M
• Entrée mise en cache — GPT-6 Sol 0,20 $ par million contre Claude Opus 5.5 0,20 $ ; au même niveau
• Coût pour exécuter la suite complète de l'Intelligence Index — Claude Opus 5.5 5,98 $ par tâche GPT-6 Sol 1,04 $, un écart de 5,7× acheté pour ces dix points
• Fenêtre de contexte — GPT-6 Sol 1 050 000 tokens contre Claude Opus 5.5 1 000 000, avec un plafond de sortie de 128 000 tokens pour les deux

La quatrième ligne est celle qui détermine la plupart des déploiements réels, et ce n’est pas celle de la page marketing. Le supplément pour contexte long de GPT-6 Sol est agressif par rapport à son propre tarif affiché : dès qu’une requête dépasse 272 000 jetons d’entrée, l’intégralité de la requête est facturée à 4,00 $ et 15,00 $, et non seulement le dépassement. Pour un agent qui tient une longue session avec un gros document en contexte, cela supprime discrètement la majeure partie de l’avantage du demi-tarif. Claude Opus 5.5 n’applique aucun palier équivalent, de sorte qu’une requête de 400 000 jetons lui coûte le même tarif par jeton qu’une requête de 4 000 jetons.
Où se trouvent les dix points, car ils ne sont pas répartis uniformément
Un indice composite cache ses propres composantes, et celui-ci cache un profil inhabituellement irrégulier. Récupérez les évaluations individuelles par rapport auxquelles les chiffres des deux fournisseurs peuvent être lus :
• Humanity's Last Exam — Claude Opus 5.5 61,4 % contre GPT-6 Sol 47,9 %, un écart de 13,5 points en raisonnement abstrait
• SciCode — Claude Opus 5.5 66,9 % contre GPT-6 Sol 57,6 %, un écart de 9,3 points sur du code de niveau recherche
• Terminal-Bench 4.0 — Claude Opus 5.5 59,6 % contre GPT-6 Sol 43,9 %
• Rappel en contexte long — Claude Opus 5.5 84,7 % contre GPT-6 Sol 83,7 %, un écart de 1,0 point, le plus faible de cette page
• Utilisation d'outils agentiques multi-tours — les deux modèles se tiennent à quelques points d'écart sur la famille τ²-Bench, où tous deux sont performants

Tout est dans la distribution. En matière de raisonnement abstrait — une question d’examen difficile, un problème de recherche sans réponse existante à copier — Claude Opus 5.5 est nettement devant, et l’écart est bien trop grand pour être du bruit. Pour extraire un fait d’une entrée très longue, les deux sont pratiquement à égalité, et GPT-6 Sol dispose de la fenêtre légèrement plus grande. Si votre charge de travail porte sur la récupération de documents longs et le travail d’agent sur de longues sessions, les dix points sont en grande partie le problème de quelqu’un d’autre. S’il s’agit de raisonnement inédit, ils sont votre problème, et les éviter vous coûte 5,7× par tâche.
Ce que le déploiement de ChatGPT vous dit et ne vous dit pas
Il est tentant de lire « 1,2 milliard d’utilisateurs hebdomadaires disposent désormais de GPT-6 » comme une preuve de capacité. Ce n’est pas le cas. C’est une preuve de distribution, et OpenAI précise explicitement que le déploiement de ChatGPT est alimenté par GPT-6 Sol pour les offres payantes et GPT-6 Luna pour Free et Go, tous deux « optimisés pour la conversation quotidienne » — une cible d’optimisation différente du produit API. Les modèles derrière Work et Codex sont inchangés par cette version, ce qui constitue le signal le plus clair de l’annonce : il s’agit d’un événement pour la surface grand public plutôt que d’une sortie de capacités. Quiconque évalue « le GPT-6 que 1,2 milliard de personnes utilisent » doit savoir qu’il mesure un déploiement optimisé pour le chat, et non le point de terminaison API.
Ce que le déploiement change, c’est le choix par défaut. Un modèle simplement présent pour tout le monde se retrouve dans bien plus de prototypes, d’outils internes et de projets annexes à moitié terminés qu’un modèle qu’il faut choisir délibérément. Si vous choisissez une API pour quelque chose de durable, cette familiarité ambiante vaut quelque chose — mais elle ne vaut pas dix points d’indice, et elle ne vaut pas 5,7× le coût par tâche sur un pipeline à forte intensité de raisonnement.
Exécuter les deux sans choisir
La réponse honnête à « dois-je changer » ici, c'est que les deux modèles veulent des choses différentes, et que la question du changement est surtout une question de routage. Tous deux figurent au catalogue d'OrcaRouter — GPT-6 Sol au tarif du fournisseur de 2,00 $/10,00 $, avec le palier de contexte long à 4,00 $/15,00 $ répercuté tel quel, et Claude Opus 5.5 à 4,00 $/20,00 $ — derrière une seule clé et un seul point de terminaison compatible OpenAI, à 0 % de marge sur le prix catalogue du fournisseur. Cela compte plus que d'habitude dans une semaine où un fournisseur modifie le déploiement grand public d'un produit, parce que notre ligne de prix est celle du fournisseur, pas la nôtre.
Le schéma qui convient à cet appariement est une répartition : envoyez le trafic des documents longs et des sessions longues vers celui des deux qui est le moins cher à ce nombre de tokens — qui, au-delà de 272 000 tokens, n'est plus GPT-6 Sol — et envoyez le trafic de raisonnement inédit à Claude Opus 5.5, avec GPT-6 Sol conservé comme une bascule automatique afin qu'une limite de débit sur une route ne devienne pas une panne de votre côté. Vous n'avez pas à trancher l'argument en dix points pour livrer ; vous devez savoir lesquelles de vos requêtes se trouvent dans la partie de la distribution où cela s'applique.

Le verdict, tel qu'il est.
Claude Opus 5.5 est le meilleur modèle sur la mesure que les deux laboratoires publient, et l'écart n'est pas mince sur les deux évaluations qui comptent le plus pour le raisonnement difficile. GPT-6 Sol est à moitié prix au tarif affiché, à un cinquième du coût par tâche sur la suite indépendante, et désormais le modèle par défaut dans l'application que la plupart de vos collègues ont déjà ouverte. Aucun de ces faits n'a changé cette semaine ; ce qui a changé, c'est que GPT-6 a cessé d'être quelque chose que vous deviez choisir et est devenu quelque chose que vous avez.
Ce qu'il faut surveiller, c'est de savoir si le prochain mouvement d'OpenAI est une avancée sur le plan des capacités ou une nouvelle étape de distribution. Sa propre annonce formule explicitement cette attente — l'entreprise déclare vouloir que ChatGPT développe au fil du temps davantage d'interfaces dont les gens ont besoin — et c'est une feuille de route qui porte sur les surfaces, pas sur les points de l'indice. Si votre décision repose sur l'indice, Claude Opus 5.5 l'emporte encore. Si elle repose sur le coût à grande échelle et sur le fait que le modèle est déjà connu de tous, GPT-6 Sol est le choix par défaut le plus sûr aujourd'hui, avec la clause de contexte long comme la seule ligne de sa grille tarifaire que vous devez prévoir dans votre budget.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
