Une carte de titre générée pour l'article « Claude Opus 5.5 vs GPT-6.1 Sol : l'écart de valeur d'abonnement de 5x, mesuré », avec pour titre « Claude Opus 5.5 vs GPT-6.1 Sol : l'écart de valeur d'abonnement », pour sous-titre « Même 200 $ par mois. Même charge de travail agentique. 5,6 fois la valeur équivalente API sur le forfait d'Anthropic. » et trois cartes indiquant « 200 $/mois Claude Max 20x — Opus 5.5 / 11 726 $ équivalent API », « 200 $/mois ChatGPT Pro 200 — GPT-6.1 Sol / 2 084 $ équivalent API » et « Écart / 5,6x ». Le pied de page indique « Charge de travail agentique, 96,6 % d'entrée mise en cache. Chiffres de valeur : SemiAnalysis, 5 octobre 2026 — modèle d'une publication concernant les limites d'abonnement des fournisseurs. Les prix des forfaits sont les tarifs catalogue des fournisseurs. »
Guides & Insights

Claude Opus 5.5 vs GPT-6.1 Sol : l'écart de valeur d'abonnement de 5x, mesuré

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Deux cents dollars par mois achètent soit un siège Claude Max 20x, soit un siège ChatGPT Pro 200. Sur la même charge de travail agentique, l'un d'eux rapporte 11 726 $ par mois en jetons équivalents API first-party et l'autre rapporte 2 084 $ — un écart de 5,6x entre Claude Opus 5.5 et GPT-6.1 Sol. Ni l'un ni l'autre de ces modèles n'est ce qui fait cette actualité, et aucun des deux n'est nouveau : Claude Opus 5.5 est sorti le 22 septembre 2026 et GPT-6.1 Sol le 29 septembre 2026, donc les modèles eux-mêmes ont respectivement deux semaines et une semaine. Ce qui est nouveau, c'est que l'économie de l'abonnement pour les exécuter a un chiffre mesuré associé, publié par SemaAnalysis le 5 octobre 2026 — un jour avant ceci — après que le cabinet a mis au point une méthode pour tarifer les limites que les fournisseurs ne publient pas.

Le chiffre phare circule sur X depuis la soirée du 5 octobre, généralement privé de ses mises en garde. Les mises en garde sont donc annoncées d'emblée, car le chiffre ne vaut rien sans elles. Chaque valeur du graphique ci-dessous est le modèle d'une publication de recherche portant sur les compteurs privés de quelqu'un d'autre, mesurée sur un profil de charge de travail défini et rapportée sous forme de plage, non comme un benchmark audité. Les prix des forfaits sont les tarifs catalogue publiés par les fournisseurs eux-mêmes. Les scores de capacités cités plus loin sont ceux d'Artificial Analysis, dans des configurations nommées. Et toute la comparaison porte sur abonnements — un mode de facturation avec ses propres règles — et non sur ce que coûte chaque modèle par jeton, une question différente avec une réponse différente.

Comment fixer le prix d'un plan dont vous ne pouvez pas voir l'intérieur

Anthropic et OpenAI exposent tous deux l'utilisation de l'abonnement comme un compteur en pourcentage, et non comme un prix. Il existe une fenêtre de cinq heures et une limite hebdomadaire, et aucune facture par requête. Les fournisseurs différencient les paliers par des multiplicateurs par rapport à leurs propres autres offres — les offres Max 5x et Max 20x de Claude sont littéralement nommées d'après leur position par rapport à Pro, et les paliers de ChatGPT étaient annoncés de la même manière, jusqu'à ce qu'OpenAI retire les mentions d'utilisation relative de sa page de tarification.

Un même forfait a donc une valeur différente selon le modèle sur lequel vous le dépensez, car un crédit consommé par un token d’entrée mis en cache et un crédit consommé par un token de sortie ne sont pas facturés dans le même rapport que celui que les fournisseurs appliquent via l’API. C’est toute la thèse de l’exercice : on ne peut pas dire qu’un forfait vaut $X en soi. Il faut considérer le forfait, le modèle et la charge de travail ensemble.

La méthode de SemiAnalysis mérite d'être décrite car elle détermine quel poids les chiffres peuvent porter. L'entreprise effectue des appels répétés conçus pour isoler un type de jeton à la fois — une portion de Guerre et Paix avec une étiquette aléatoire par appel pour les entrées non mises en cache, le même prompt marqué pour la mise en cache pour les écritures de cache, une étiquette fixe pour les lectures de cache, un long essai technique pour forcer la sortie. Chaque appel enregistre les jetons facturés par le fournisseur et la position du compteur d'utilisation. Comme une seule requête ne déplace presque jamais le compteur, ils mesurent par étapes : les totaux de jetons entre deux mouvements du compteur donnent le coût d'une unité de compteur, les étapes partielles à chaque extrémité sont ignorées, et les étapes s'accumulent jusqu'à ce que la plage soit dans une marge de ±5 %. Les lectures de cache qui ne déplacent pas le compteur après 500 millions de jetons sont considérées comme gratuites. Le mélange de charges de travail provient ensuite des propres ratios d'utilisation de septembre de l'entreprise, et la valeur est la capacité de jetons résultante multipliée par le prix API publié du fournisseur pour chaque type de jeton.

Le constat le plus intéressant de la section méthodologie ne porte pas sur la générosité de l’un ou l’autre des laboratoires. Lors de la validation, SemiAnalysis a découvert que l’un des trois comptes qu’elle testait sur le même forfait avait des limites environ 20 % inférieures à celles des deux autres — un compte plus ancien. Le fournisseur a confirmé qu’il s’agissait d’un test A/B « extrêmement minuscule » sur les limites et a souligné qu’il n’avait pas réduit les limites de manière généralisée. Les deux volets de cette affaire comptent : cela prouve que les limites d’abonnement peuvent être modifiées en silence à tout moment, et cela prouve que la méthode est suffisamment sensible pour détecter une variation de 20 % lorsqu’elle se produit.

Ce que chaque palier rapporte, à 200 $, 100 $ et 20 $

Trois paliers, les deux laboratoires, charge de travail agentique, valeur équivalente API par mois aux tarifs catalogue first-party :

• 200 $ par mois — Claude Opus 5.5 sur Max 20x rapporte 11 726 $ — 58,6 fois le coût en jetons équivalents API ; GPT-6.1 Sol sur ChatGPT Pro 200 rapporte 2 084 $ — 10,4 fois le coût. Ratio : 5,6x.

• 100 $ par mois — Claude Opus 5.5 sur Max 5x rapporte 5 725 $ (57,3 fois les frais) ; GPT-6.1 Sol sur ChatGPT Pro 100 rapporte 1 055 $ (10,6 fois les frais). Ratio : 5,4x.

• 20 $ par mois — Claude Opus 5.5 sur Claude Pro rapporte 1 178 $ (58,9 fois les frais) ; GPT-6.1 Sol sur ChatGPT Plus rapporte 211 $ (10,6 fois les frais). Ratio : 5,6x.

Que les trois paliers se situent entre 5,4x et 5,6x, voilà la conclusion, et non les montants individuels. La comparaison est réalisée sur le milieu de gamme du catalogue de chaque laboratoire — le modèle que les deux fournisseurs positionnent comme la solution quotidienne plutôt que le produit phare — et elle est menée sur toute l'échelle des prix, de sorte qu'un lecteur sur un forfait à 20 $ obtient la même réponse qu'un lecteur sur un forfait à 200 $. Le résumé de SemiAnalysis est sans détour : à ce palier, Anthropic est « une offre incomparablement plus avantageuse, offrant environ 5x la valeur équivalente en API sur toute la ligne. »

La forme de charge de travail derrière les trois lignes est étiquetée, et elle mérite d'être lue deux fois : agentique, 0,4 % d'entrée non mise en cache, 96,6 % d'entrée mise en cache, 2,6 % d'écritures de cache, 0,3 % de sortie. Voilà à quoi ressemble une boucle d'agent — une petite quantité d'instruction fraîche, une énorme quantité de contexte relu, et une infime portion de texte généré. C'est aussi, comme le montre la section suivante, la répartition qui flatte le plus Anthropic.

A generated two-column scoreboard titled 'Claude Opus 5.5 vs GPT-6.1 Sol - the scoreboard'. Left column 'Claude Opus 5.5': Input $4.00 per Mtok, Output $20.00 per Mtok, Cache read $0.20 per Mtok, Released Sept 22 2026, AA Intelligence Index 58 (max effort), API value on the $200 plan $11,726. Right column 'GPT-6.1 Sol': Input $2.00 per Mtok, Output $10.00 per Mtok, Cache read $0.10 per Mtok, Released Sept 29 2026, AA Intelligence Index 51.8 (max effort), API value on the $200 plan $2,084. The footer reads 'Prices: vendor rate cards. Index: Artificial Analysis v4.3.2, max effort. $200-plan value: SemiAnalysis, Oct 5, 2026 - model estimate, not audited.'

Opus 5.5 coûte deux fois plus cher par token, et gagne quand même d'un facteur 5,6

Voici ce que la version qui circule de ce graphique omet. Claude Opus 5.5 n'est pas le modèle le moins cher. C'est le plus cher, par un facteur de deux.

Les deux grilles tarifaires sont publiques. Claude Opus 5.5 est affiché à 4,00 $ par million de tokens d'entrée, 0,20 $ par million de lectures de cache, 5,00 $ par million d'écritures de cache et 20,00 $ par million de tokens de sortie. GPT-6.1 Sol est affiché à 2,00 $, 0,10 $, 2,50 $ et 10,00 $ pour les mêmes quatre lignes. Pondérez ces tarifs selon la répartition agentique ci-dessus et les tarifs combinés ressortent à environ 0,399 $ par million de tokens pour Claude Opus 5.5, contre 0,200 $ pour GPT-6.1 Sol — un ratio de 2,00x. Ce calcul est le nôtre, établi à partir des grilles publiées par les deux fournisseurs, mais il n'a rien de controversé : il découle directement des prix publiés et de la répartition indiquée.

Divisez l'écart de valeur de 5,6x par l'écart de prix de 2,0x et vous obtenez environ 2,8x plus de tokens par dollar de forfait du côté de Claude. La même division au palier à 20 $ donne 2,79x — l'écart vient de ce qu'un compteur est bien plus généreux, de façon presque exactement uniforme sur toute l'échelle, et non du fait qu'un modèle coûte moins cher à exécuter. Ce qui signifie que le chiffre phare de 5x est une affirmation sur la tarification des crédits d'Anthropic, et qu'il ne vaut que pour les charges de travail qui ressemblent à celle qui a été mesurée.

Changez la composition et le nombre change. La composition est de 96,6 % de lectures mises en cache, où Opus 5.5 facture 0,20 $ contre 0,10 $ pour Sol. Une charge de travail à faible recours au cache — documents longs et nouveaux, peu de réutilisation — repose sur la ligne d'entrée et le même facteur 2 y apparaît. Un travail intensif en sortie, comme de longues générations plutôt que de longues exécutions d'agents, atteint la ligne où Opus est à 20,00 $ contre 10,00 $. Et SemiAnalysis précise explicitement que sa propre métrique préférée a un mode de défaillance : la valeur équivalente API « sera bien sûr trompeuse » si un modèle est particulièrement avantageux ou désavantageux aux prix API, ce qui est précisément la situation ici — le modèle le plus cher par token est celui qui a le meilleur abonnement. La firme refuse également de s'appuyer sur les graphiques d'efficacité des tokens, affirmant qu'elle ne croit pas que les tâches typiques de benchmark agentique soient représentatives du travail réel, et que l'industrie manque de données fiables sur l'efficacité. Considérez le 5x comme une déclaration mesurée concernant une forme de charge de travail donnée, issue d'une publication, et non comme une propriété permanente de l'un ou l'autre modèle.

Ce qui fait de l’écart un véritable problème plutôt qu’un arbitrage neutre, c’est que le camp de l’abonnement et du moins cher est aussi le plus fort sur le tableau indépendant. Artificial Analysis place Claude Opus 5.5 à 58 sur son Intelligence Index dans la configuration que sa page modèle intitule « max with fallback », listée dans le sélecteur de variante sous « Claude Opus 5.5 (Max, Default Fallback) » — le plus haut qu’il ait mesuré, de plusieurs points. GPT-6.1 Sol affiche 51.8 à effort maximal sur le même indice, version d’indice v4.3.2, avec GPT-6 Astra à 52.7. Ainsi, un acheteur qui compare les deux forfaits à 200 $ se voit demander de payer 5,6 fois plus par dollar de capacité utilisable pour le modèle au score inférieur. Les scores proviennent de tiers indépendants ; les chiffres de valeur relèvent du modèle de SemiAnalysis. Les deux sont étiquetés, et aucun n’est un chiffre de fournisseur.

A screenshot of the OrcaRouter model page for Claude Opus 5.5 (anthropic/claude-opus-5.5), captured 6 October 2026, showing the model name and id, 1M-token context, Max output 128K, input text + image + file, Vision, Tools, JSON and Reasoning tags, the $4.00 input and $20.00 output pricing tiles, p50 TTFT 3.81 s, p95 TTFT 10.00 s, 48.5M tokens of 7-day traffic, the benchmark provenance line 'Public benchmarks by Anthropic - 2026-09-22', an OpenAI-compatible code sample using base_url https://api.orcarouter.ai/v1, and the buttons 'Get the Claude Opus 5.5 API' and 'Try in playground'.

Ce qu'OpenAI a changé le 29 septembre

Rien de tout cela n’était statique. Si l’écart est discuté cette semaine plutôt que la semaine dernière, c’est qu’OpenAI a déplacé ses propres compteurs huit jours avant que la mesure ne tombe.

Le 29 septembre 2026, OpenAI a rouvert les abonnements Pro à 200 $ aux nouveaux abonnés et a modifié le mode de calcul de l’utilisation en même temps que cette réouverture. Selon ses propres termes ce jour-là, ce changement « reviendrait à la moitié, en dollars, des dépenses d’API par rapport à l’ancien forfait Pro à 200 $ », et un second post publié le même jour décrivait une réduction de moitié de la valeur équivalente en API de ce niveau d’abonnement. Il s’agit d’une déclaration du fournisseur au sujet de son propre forfait, datée, et c’est l’événement qui a rendu une mesure de la valeur d’un abonnement digne d’être publiée.

Trois conséquences, telles que SemiAnalysis les a mesurées :

• Le nombre de tokens par palier a été réduit de moitié, et la valeur des modèles de classe Sol a chuté davantage encore. OpenAI a réduit en même temps le prix des entrées en cache pour GPT-6.1 Sol — à 0,10 $ par million, ce que le compte développeur d'OpenAI a décrit le 29 septembre comme étant 95 % inférieur au prix standard des entrées et 50 % inférieur au tarif en cache de GPT-6 Sol — de sorte que la valeur mesurée équivalente à l'API des modèles de classe Sol sur l'offre a baissé de plus de 50 %, plutôt que des 50 % qu'implique à elle seule la réduction de tokens.

• Un palier à 500 $ a fait son apparition, et il ne restaure pas la valeur. Le nouveau forfait Pro 500 offre 21 % de GPT-6 Astra de plus que ne le faisait l'ancien forfait à 200 $ ; en raison de la baisse du prix de Sol, la valeur équivalente en API de la classe Sol sur le palier à 500 $ a en réalité diminué. Le mode ultrafast — le niveau de service à 300 jetons par seconde — est la véritable nouveauté, et SemiAnalysis affirme que ses limites sont encore à l'essai.

• Les abonnés existants bénéficient de droits acquis jusqu'au 29 octobre 2026. Un forfait à 200 $ souscrit avant la réduction conserve l'ancienne allocation, plus généreuse, jusqu'à cette date, puis passe à l'allocation inférieure à un prix inchangé. Pour toute personne ayant souscrit avant le 29 septembre, la comparaison de cet article s'applique à son compte à partir de la fin du mois, et non aujourd'hui.

Le rééquilibrage est la partie subtile. Avant la réduction, la valeur par dollar d'OpenAI était déséquilibrée en sa propre faveur au sommet : Pro 200 offrait environ deux fois la valeur par dollar de Pro 100 sur Astra, qui offrait elle-même environ deux fois celle de Plus. Après la réduction, Pro 100, Pro 200 et Pro 500 donnent tous le même nombre de tokens par dollar pour chaque modèle, et Plus est comparable sur Sol, bien que toujours relativement moins bon sur Astra. OpenAI a rendu son échelle équitable en interne en divisant tout par deux jusqu'au barreau inférieur. Anthropic, en revanche, offrait déjà la même valeur par dollar à chaque niveau — c'est pourquoi le même 5,6x apparaît que l'on regarde un forfait à 20 $ ou à 200 $. Si vous êtes sur Plus et comptiez sur l'accès à Astra, la réduction a supprimé la valeur qui rendait auparavant le niveau le plus élevé d'OpenAI intéressant à viser.

OpenAI conserve bel et bien un véritable avantage structurel, et SemiAnalysis le reconnaît : aucun des niveaux Pro n’est assorti d’une fenêtre de cinq heures, ce qui facilite la consommation d’une part élevée de la limite mensuelle en une seule longue session. Le jugement de la société est que cela ne compense pas un écart d’environ 4x à 5x sur la valeur équivalente API.

Deux économies, un modèle

Il y a un piège à lire tout ceci comme une affirmation sur les modèles. Si vous payez au token — une clé API, une pile auto-hébergée, une plateforme d'agents que vous construisez — le facteur 5.6x n'est pas votre chiffre, et ne l'a jamais été. Votre chiffre, c'est le coût mixte de 2.00x, et sur cette base, GPT-6.1 Sol est le modèle le moins cher pour la même boucle agentique. La comparaison des abonnements répond à « quel siège dois-je acheter ». La comparaison des API répond à « quel modèle dois-je appeler ». Elles pointent dans des directions opposées pour ces deux modèles, et les confondre est l'erreur la plus répandue dans les commentaires autour du graphique.

La vague de baisses de prix qui a alimenté la mesure de l'abonnement figure déjà dans les grilles tarifaires de l'API. Anthropic a réduit les tarifs d'entrée et de sortie d'Opus 5.5 de 20 % par rapport à Opus 5, et les lectures de cache de 60 %, lors du lancement du modèle, le 25 septembre. OpenAI a réduit de moitié l'entrée en cache de GPT-6.1 Sol lors de son lancement, le 29 septembre. Ce sont les deux grilles tarifaires utilisées tout au long de cet article, et elles s'appliquent, que vous achetiez un siège ou un jeton. Les deux modèles figurent au catalogue OrcaRouter au prix catalogue du fournisseur — Claude Opus 5.5 au prix catalogue du fournisseur avec 0 % de marge, et GPT-6.1 Sol sur la même clé derrière un seul point de terminaison — ainsi, une baisse de prix du fournisseur est effective au moment même où elle est publiée, plutôt que d'attendre une actualisation de la table de routage.

Une chose qu'il faut dire clairement : OrcaRouter ne vend pas d'abonnements, donc cette mesure ne change pas ce que paie un utilisateur d'OrcaRouter. Elle change le modèle pour lequel il devrait payer, et elle donne le prix de l'alternative. Le volet forfaitaire de la comparaison est un mur que vous ne contrôlez pas — deux laboratoires, qui ont tous deux démontré qu'ils modifieront les limites, silencieusement et à court préavis, la même semaine où ils baissent les prix. L'équivalent API de ce risque, c'est de pouvoir envoyer la même requête ailleurs sans nouveau contrat, et c'est à cela que sert le basculement automatique entre fournisseurs. Si vous faites tourner une boucle d'agent à 96,6 % de lectures mises en cache, ce que vous voulez réellement, c'est la route la moins chère qui acceptera la requête, et la possibilité de changer d'avis quand un fournisseur change d'avis.

Qui devrait bouger, et qui ne devrait pas

Si vous payez un abonnement Claude et que vous exécutez du codage agentique ou de longues boucles d’outils, l’argument pour rester est désormais mesuré plutôt qu’anecdotique : 58,6 fois votre abonnement vous revient sous forme de capacité équivalente à l’API sur l’offre à 200 $, contre 10,4 fois sur l’offre ChatGPT comparable, et cela tient à tous les niveaux de prix. Si vous avez un forfait ChatGPT Pro 200 acheté avant le 29 septembre, vous disposez de l’ancien quota jusqu’au 29 octobre 2026, puis du quota inférieur après — vérifiez la date avant de décider quoi que ce soit, car pendant les trois prochaines semaines, vous vous comparez à une offre qui n’existe plus pour les nouveaux acheteurs.

Si vous développez des API, ignorez le 5,6x. Routez sur le tarif mixte de 2,00x, facturez à la tâche plutôt qu'au token, et revérifiez-le après chaque changement de prix d'un fournisseur, car ce trimestre en a produit quatre — GPT-6 Sol, Fable 5.1, Opus 5.5 et GPT-6.1 Sol en un peu plus d'un mois. La mesure qui compte pour un abonnement est un compteur que personne en dehors du laboratoire ne peut voir. La mesure qui compte pour une API est une grille tarifaire, et celle-là est publique.

À surveiller ensuite : si les limites d'Opus d'Anthropic tiennent tout au long du trimestre, étant donné que son propre concurrent a passé la semaine dernière à procéder à des coupes et que les deux laboratoires conservent la capacité d'ajuster discrètement les compteurs ; si OpenAI rétablit la valeur de classe Sol sur le palier à 500 $ en augmentant les limites plutôt qu'en baissant à nouveau les prix ; et si le maintien des conditions acquises pour le palier à 200 $ prend effectivement fin le 29 octobre comme publié. SemiAnalysis maintient les chiffres sous-jacents sous forme de tableau de bord en direct plutôt que d'étude figée, de sorte que les chiffres cités ici correspondent à l'état au 5 octobre 2026 d'un ensemble de données conçu pour évoluer.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol (openai/gpt-6.1-sol), captured 6 October 2026, showing the model name and id, 1M-token context, Max output 128K, input text + image + file, Vision, Tools, JSON and Reasoning tags, the reasoning / coding / agentic capability tags, the $2.00 input and $10.00 output pricing tiles, 10.60 s p50 TTFT, 10.00 s p95 TTFT and 248.5M tokens of 7-day traffic, the benchmark provenance line 'Public benchmarks by OpenAI - 2026-09-29', and the buttons 'Get the GPT-6.1 Sol API' and 'Try in playground'.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement