
Claude Opus 5.5 vs GPT-6 Sol : moitié prix, jusqu'à ce que le contexte s'allonge
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 177 tok/s
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1323 tok/s
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
Anthropic et OpenAI ont commercialisé des modèles phares concurrents le même après-midi. Claude Opus 5.5est sorti le 22 septembre 2026 à 4 $ par million de jetons d'entrée et 20 $ par million de jetons de sortie, soit une baisse de 20 % sur les deux lignes par rapport à Claude Opus 5. GPT-6 Solest sorti le même jour à 2 $ en entrée et 10 $ en sortie, une baisse nette de 50 % par rapport à GPT-5.6 Sol, qu'OpenAI a qualifiée de permanente plutôt que promotionnelle. Ne lisez que ces deux phrases et la confrontation semble jouée d'avance : le modèle d'OpenAI est à moitié prix, et moitié prix, c'est moitié prix. Lisez le reste des deux grilles tarifaires et l'écart se referme en grande partie — non pas parce que l'un ou l'autre fournisseur a modifié quoi que ce soit, mais parce que les deux modèles appliquent un supplément au même type de requête, et cela coûte à Sol bien plus de son avantage que cela n'en coûte à Anthropic.
Deux cartes tarifaires, toutes deux comportant un palier
En dessous de 272 000 jetons d’entrée, c’est la comparaison la plus simple dans la frontière actuelle :
• Entrée — GPT-6 Sol 2,00 $ par million vs Claude Opus 5.5 4,00 $
• Sortie — GPT-6 Sol 10,00 $ par million contre Claude Opus 5.5 20,00 $
• Entrée mise en cache — GPT-6 Sol environ 90 % de réduction sur la portion mise en cache, contre 0,20 $ par million pour Claude Opus 5.5, soit un multiplicateur de 5 % sur l’entrée de base
• Contexte et sortie — GPT-6 Sol 872 K selon les mesures d’Artificial Analysis, 1 M annoncé ailleurs, 128 K de sortie maximale contre Claude Opus 5.5 1 M et 128 K
• Date de coupure des connaissances — Claude Opus 5.5 juin 2026 vs GPT-6 Sol non précisée dans les mêmes termes
Au-delà de 272 000 jetons d'entrée, l'arithmétique change des deux côtés, et pas dans la même mesure. GPT-6 Sol refacture la totalité de la requête — pas seulement l'excédent, mais l'appel entier — à environ le double du tarif d'entrée et une fois et demie le tarif de sortie, pour aboutir à près de 4,00 $ en entrée et 15,00 $ en sortie. La grille tarifaire de Claude Opus 5.5 ne comporte pas de palier de contexte long : Anthropic facture 4,00 $ et 20,00 $ sur toute la fenêtre de 1 million de jetons et indique qu'une requête de 900 000 jetons coûte le même prix par jeton qu'une requête de 9 000 jetons.
Mettez tout cela bout à bout, et le classement s'inverse à un endroit inattendu. Lors d'un appel à contexte long, les tarifs d'entrée convergent autour de 4 $ sur les deux modèles — l'avantage de moitié prix de Sol sur l'entrée disparaît complètement — tandis que la sortie se réduit d'un écart de 2x à environ 15 $ contre 20 $, soit un avantage de 25 % plutôt que de 50 %. Sol reste moins cher. Il n'est plus assez bon marché pour être le seul chiffre dans la décision, et la raison en est que les deux surcoûts ont des formes différentes : le modèle d'Anthropic facture un tarif forfaitaire qui se trouve être plus élevé, celui d'OpenAI facture une pénalité qui frappe le plus durement exactement les charges de travail agentiques, de lecture de dépôt et d'ensembles de documents pour lesquelles les deux entreprises vendent ces modèles.

Le score indépendant, qui est la seule comparaison à conditions identiques

Aucun des deux tableaux de lancement ne contient le nouveau modèle de l’autre — tous deux ont été rédigés avant l’arrivée des sorties du même jour —, si bien que la documentation du fournisseur ne peut pas du tout classer ces deux modèles. Artificial Analysis le peut, car elle exécute chaque modèle dans une configuration publiée unique :
• Indice d’intelligence — Claude Opus 5.5 58, classé n°1 sur 210 contre GPT-6 Sol 48, classé n°18
• Libellé de configuration — les deux notés à effort maximal ; Claude Opus 5.5 porte en outre le libellé « Default Fallback »
• Vitesse de sortie — GPT-6 Sol 113,3 tokens/sec, classé 38e contre Claude Opus 5.5, pas encore publié
• Temps jusqu'au premier token — GPT-6 Sol 142,74 s contre une médiane du classement de 3,83 s ; Claude Opus 5.5 pas encore publié
• Prix — GPT-6 Sol 2,00 $ / 10,00 $ par million contre Claude Opus 5.5 4,00 $ / 20,00 $
Dix points d'indice et dix-sept rangs, c'est l'écart le plus large de toutes les confrontations actuelles entre Claude et OpenAI, et il joue en défaveur du modèle le moins cher pour la deuxième fois ce mois-ci — le même schéma est apparu lorsque GPT-6 Sol a affronté Claude Opus 5 dans une comparaison antérieure et a perdu de trois points, à un coût inférieur de 60 %. La ligne consacrée à la vitesse va dans l'autre sens et compte plus qu'il n'y paraît : 113,3 tokens par seconde, soit environ le double de ce que gère le fleuron GPT-6 Astra, et c'est le chiffre le plus rapide de ce groupe. Combiné à un premier token en 142 secondes, le profil qui se dégage est celui d'un modèle qui réfléchit longuement puis écrit rapidement, ce qui convient mal à toute utilisation interactive et raisonnablement bien aux longues exécutions sans surveillance.
Les deux chiffres portent la même mise en garde que ceux des fournisseurs : ce sont des mesures à effort maximal, et la configuration par défaut livrée avec aucun des deux modèles n'est l'effort maximal. Claude Opus 5.5 est réglé par défaut sur medium sur une échelle d'effort allant de faible à maximal ; GPT-6 Sol expose une échelle allant de aucun à maximal. Un indice à effort maximal est une façon équitable de comparer les plafonds et une façon trompeuse de prédire votre facture.
Qu'est-ce qui casse quand on bascule, dans les deux sens ?
La friction de migration est ici asymétrique, et il vaut la peine de le savoir avant l'un ou l'autre de ces déplacements.
Claude Opus 5.5 n'est pas un remplacement direct de Claude Opus 5. La réflexion ne peut plus être désactivée, donc le code qui définissait un chemin sans réflexion produira une erreur ou changera de comportement silencieusement. L'utilisation forcée d'outils renvoie une erreur. Les blocs de réflexion sont liés au modèle et à la conversation qui les ont produits, ils ne peuvent donc pas être rejoués d'un modèle à l'autre. L'ancien computer_20251124 outil d'utilisation de l'ordinateur n'est pas accepté sur l'API Claude ni sur Google Cloud. Par ailleurs, le texte entre les appels d'outils est désormais renvoyé à l'intérieur de blocs de réflexion qui sont vides avec le paramètre d'affichage par défaut, donc une application qui diffuse ce texte comme indicateur de progression deviendra simplement silencieuse entre les appels sans lever quoi que ce soit.
L’échelle d’effort de GPT-6 Sol est la plus flexible des deux : elle peut être modifiée en cours de conversation sans invalider le cache de prompt, ce qui signifie qu’une première passe peu coûteuse et une nouvelle tentative coûteuse sur le même contexte constituent un schéma pris en charge plutôt qu’un schéma qui casse le cache. C’est un véritable avantage d’ingénierie pour quiconque exécute un raisonnement par paliers au sein d’une même session, et c’est l’argument le plus fort en faveur de Sol qui n’apparaît dans aucun tableau de prix.
Exécuter les deux, et décider avec vos propres chiffres
La position honnête sur cette comparaison est que les tableaux des fournisseurs ne peuvent pas la trancher et que l’indice indépendant ne tranche que le plafond. Ce qui reste, c’est la question de la charge de travail — combien de temps durent réellement vos contextes, et combien coûte une tentative échouée — et cela se mesure sur votre propre trafic au lieu de s’argumenter à partir d’un communiqué de presse.
Les deux modèles sont routables depuis OrcaRouter au prix catalogue du fournisseur, avec 0 % de marge : GPT-6 Sol à 2,00 $ / 10,00 $ chez OpenAI et Claude Opus 5.5 à 4,00 $ / 20,00 $ chez Anthropic. Comme le pass-through est exact et que les prix évoluent le jour même où les fournisseurs les modifient, le ratio que vous mesurez en staging est le ratio que vous payez en production, sans couche de marge à recalculer. Une seule clé couvre les deux, donc la règle de routage qui envoie les appels de moins de 272 K à Sol et les appels à long contexte au modèle qui l'emporte sur vos évaluations est un changement de configuration plutôt qu'une seconde intégration — et le basculement automatique signifie qu'un lancement le jour même d'un côté comme de l'autre est une chose sur laquelle vous pouvez mettre une partie du trafic plutôt qu'un pari que vous faites avec tout un pipeline.

La version de ceci qui survit au contact d'un projet de loi
GPT-6 Sol est le modèle le moins cher sur chaque ligne, dans chaque configuration, et cela n'est pas contesté. Ce qui ne résiste pas, en revanche, c'est l'hypothèse selon laquelle « moitié prix » est le chiffre à retenir pour planifier : sur un appel à contexte long, les tarifs d'entrée se rejoignent autour de 4 $ et l'écart en sortie se réduit à un quart, ce qui constitue une décision différente de celle que décrivent les pages de lancement. Pesez cela face à un écart de dix points d'indice, dix-sept rangs, et un premier token mesuré à 142 secondes, et la répartition s'impose d'elle-même pour la plupart des charges de travail — Sol comme choix par défaut à fort volume sur les contextes courts et moyens, Claude Opus 5.5 là où le contexte s'allonge ou la tâche est assez difficile pour qu'une nouvelle tentative coûte plus cher que la différence de tokens. L'erreur à éviter est de choisir l'un ou l'autre sur le seul tarif affiché en gros, car c'est le deuxième chiffre de chaque grille tarifaire qui tranche le cas pour lequel les deux modèles ont été conçus.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
