Une carte hero générée intitulée « Le mode est la constante. Le compteur, non. », avec trois cartes empilées indiquant « Mode pro — reasoning.mode : pro sur les deux niveaux, facturé aux tarifs standard du modèle par token », « Multiplicateur — non publié par OpenAI ; le coût du mode pro se présente sous forme de volume de tokens supplémentaire, et non de surcharge », et « La différence — chaque ligne publiée du compteur 6.1 est divisée par deux par rapport à celle du 5.6, et la ligne des entrées mises en cache est divisée par quatre, 0,10 $ contre 0,40 $ par million ». Un pied de page indique « Chiffres OpenAI déclarés par le fournisseur ; aucune évaluation indépendante du niveau GPT-6.1 publiée au 30 septembre 2026 », et le logo OrcaRouter se trouve dans le coin inférieur droit.
Guides & Insights

GPT-6.1 Sol Pro vs GPT-5.6 Sol Pro : une génération d'écart, la moitié du tarif

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Laissons les noms de côté un instant et regardons ce à quoi chacun correspond dans une requête, car c'est là que ce duel se décide. GPT-6.1 Sol Pro est GPT-6.1 Sol — publié le 29 septembre 2026 — exécuté avec reasoning.mode défini sur pro dans l'API Responses, et il facture le travail supplémentaire aux tarifs propres du modèle, soit 2,00 $ en entrée et 10,00 $ en sortie par million de tokens. GPT-5.6 Sol Pro est la même construction, une génération plus tôt : GPT-5.6 Sol, livré le 9 juillet 2026, exécuté avec reasoning.mode : pro, facturant ses tokens supplémentaires à 4,00 $ en entrée et 20,00 $ en sortie. Aucun des deux fournisseurs ne publie d'identifiant -pro pour l'un ou l'autre palier, il n'y a donc pas de grille tarifaire pro à comparer ni de surcoût pro à évaluer. Ce que vous comparez réellement, ce sont deux grilles tarifaires de base, à trois mois d'écart, dont les prix affichés diffèrent d'un facteur deux — et dont les tarifs de cache diffèrent d'un facteur quatre. Le mode est identique. Le compteur en dessous, lui, ne l'est pas.

Pourquoi l’ancien compteur Pro est-il encore présent dans cette comparaison ?

Si GPT-5.6 Sol Pro revient sans cesse comme un pair plutôt qu’un prédécesseur, c’est parce qu’OpenAI a réellement vendu Pro comme un produit à l’époque de GPT-5, et que ces identifiants figurent toujours sur la grille tarifaire avec leurs propres tarifs premium : gpt-5.4-pro et gpt-5.5-pro à 30,00 $ en entrée et 180,00 $ en sortie par million de tokens en contexte court, passant à 60,00 $ et 270,00 $ au-delà de 272 000 tokens d’entrée. Ce sont de vrais produits, tarifés séparément, et c’est pour cela que « Pro » se lit comme un mot coûteux. La génération GPT-5.6 a changé le mécanisme sans changer le vocabulaire — pro est devenu un mode du modèle phare plutôt qu’un modèle premium à côté de lui, facturé aux tarifs du modèle phare. Ainsi, l’effet pratique du passage d’une configuration pro de l’ère 5.6 à une configuration de l’ère 6.1 n’est pas « un modèle pro moins cher ». C’est la même configuration, sur une base moins chère.

• Ce que c'est, des deux côtés — un modèle, plus reasoning.mode : « pro », et non un déploiement entraîné séparément ou facturé séparément

• Identifiant que vous envoyez — gpt-6.1-sol versus gpt-5.6-sol, avec le mode transporté dans l'objet reasoning

• Prix d'entrée standard — 2,00 $ par million de jetons contre 4,00 $, donc les jetons supplémentaires du mode pro coûtent deux fois moins cher sur le palier le plus récent

• Prix de sortie standard — 10,00 $ par million de tokens contre 20,00 $, la même réduction de moitié appliquée au côté de la facture que gonfle le mode pro

• Entrée mise en cache — 0,10 $ par million sur 6.1 Sol contre 0,40 $ sur 5.6 Sol, une différence d'un facteur quatre qui compte le plus, précisément dans les boucles d'agents pour lesquelles le mode pro est conçu

• Écritures de cache — 2,50 $ contre 5,00 $ par million de jetons, de nouveau réduit de moitié

• Nouvelle tarification des prompts longs — les deux appliquent une nouvelle tarification à l’ensemble de la requête au-delà de 272 000 jetons d’entrée, à 2× les tarifs d’entrée et de cache, et à 1,5× la sortie

• Contexte et plafond de sortie — 1 050 000 tokens et 128 000 tokens de sortie maximum sur les deux, avec un maximum d'entrée de 922 000 documenté sur chacun

• Date limite des connaissances — 30 avril 2026 sur 6.1 Sol contre le 16 février 2026 sur 5.6 Sol

• Effort de raisonnement — low, medium, high, xhigh, max avec none et minimal non pris en charge sur 6.1 Sol, par rapport à la même échelle plus none sur 5.6 Sol

• Documentation du mode Pro — démontré nommément sur gpt-6.1-sol dans le guide de raisonnement d'OpenAI, face à une déclaration au niveau de la famille couvrant GPT-5.6 et GPT-6 sans liste d'éligibilité par modèle

Deux lignes de cette liste valent plus que toutes les autres réunies, et ni l’une ni l’autre n’est le prix affiché.

La ligne de cache marque le point où les deux générations cessent d’être comparables.

Le coût du mode Pro se présente sous forme de volume, non de supplément : la documentation d'OpenAI indique qu'il « agrège le travail du modèle effectué pour produire la réponse finale et facture ces jetons aux tarifs standards du modèle sélectionné », et le fournisseur ne publie pas le multiplicateur. Cela fait du coût d'une configuration pro une fonction de deux éléments que vous ne pouvez pas consulter — la quantité de travail supplémentaire que le mode effectue sur vos tâches, et le coût de vos jetons — et seul le second est publié. Sur cet axe, le palier 6.1 l'emporte sur chaque ligne par un facteur deux net, et sur la ligne d'entrée mise en cache par un facteur quatre.

Faites le calcul pour un agent de support client qui rejoue un préfixe fixe d’instructions et de schéma d’outils à chaque tour. Avec 200 millions de tokens d’entrée par mois, dont 95 % de hits de préfixe, la partie mise en cache est facturée à 0,10 $ par million sur 6.1 Sol contre 0,40 $ sur 5.6 Sol — 19 $ contre 76 $ pour le même préfixe, avant même de compter le moindre token en mode pro. Ajoutez maintenant le mode pro par-dessus et l’écart se creuse au lieu de se réduire, parce que le raisonnement supplémentaire de ce mode tombe du côté sortie à 10,00 $ contre 20,00 $ par million. La seule ligne qui ne diminue pas de moitié est la règle de réévaluation tarifaire des prompts longs, identique sur les deux niveaux et appliquant les mêmes multiplicateurs de 2× et 1,5× — ainsi, une charge de travail qui dépasse régulièrement 272 000 tokens d’entrée paie un surcoût des deux côtés de la comparaison, mais un surcoût plus faible sur le niveau le plus récent.

Il existe également un piège qui tient au mode plutôt qu’à l’un ou l’autre des modèles, et il piégera un estimateur de coûts naïf. Définir reasoning.effort sur none alors que le mode pro est activé renvoie une erreur au lieu de se rabattre silencieusement, et les jetons de raisonnement que le mode pro consomme sont signalés dans l’objet usage sous output_tokens_details.reasoning_tokens tout en n’apparaissant jamais dans le corps de la réponse. Tout client qui estime la dépense à partir du texte renvoyé sous-comptera une configuration pro à chaque fois.

Là où l'ancienne génération a encore des arguments à faire valoir

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol) showing the header 'by OpenAI - 2026-07-09', a 1,050,000-token context window with 128,000 maximum output tokens, capability tags for vision, tools, JSON and reasoning, and pricing of $4.00 per million input tokens and $20.00 per million output tokens with a cached-input rate of $0.40 per million, alongside a long-prompt tier reading $8.00 input and $30.00 output.

Moins cher ne veut pas dire meilleur, et la génération 5.6 présente trois avantages qu'un tableau de prix ne montre pas. Le premier est la maturité : gpt-5.6-sol est généralement disponible depuis le 9 juillet 2026, son comportement est stabilisé, et c'est le modèle vers lequel la page des dépréciations d'OpenAI elle-même renvoie lorsqu'elle retire les anciens compteurs Pro — ce qui signifie que le chemin de migration depuis ces compteurs à 180 $ par million aboutit sur le palier 5.6, et non sur celui de la 6.1. Le deuxième est la promotion : OpenAI indique que le tarif promotionnel de GPT-5.6 Sol est disponible au moins jusqu'au 21 novembre 2026, de sorte que le couple 4,00 $ / 20,00 $ est un plancher assorti d'une date plutôt qu'un prix catalogue. Le troisième est une preuve indépendante, et c'est celui qui compte le plus si vous ne pouvez pas réaliser votre propre évaluation — Artificial Analysis dispose d'une évaluation complète de GPT-5.6 Sol et d'aucune page du tout pour le palier 6.1.

Cette lecture indépendante relève d’une histoire de coût plutôt que d’une histoire d’intelligence, ce qui est la partie utile. Sur l’Intelligence Index du tableau neutre, GPT-5.6 Sol obtient 47 avec un effort de raisonnement maximal, classé 13e sur un échantillon de 145 modèles, avec un Coding Index de 77,4 au 3e rang et un GPQA Diamond de 94,1 %. Son coût par tâche de l’indice s’établit près de 2,00 $ contre 1,06 $ pour GPT-6 Sol au même réglage — environ le double — et ce ratio constitue à lui seul tout l’argument en faveur du palier plus récent, en un chiffre. La génération 6.1 n’a aucune donnée comparable publiée au 30 septembre 2026 : la page modèle du tableau pour le slug 6.1 Sol renvoie une erreur 404 et la chaîne n’apparaît pas dans le classement en direct. La comparaison honnête aujourd’hui oppose donc une génération 5.6 mesurée à une génération 6.1 décrite par le fournisseur, et aucune accumulation de tableaux ne comble cet écart.

Exécuter les deux configurations à partir d'une seule touche

C'est la rare comparaison dont l'expérience ne coûte presque rien à mettre en place, car les deux branches ne diffèrent que par une chaîne de modèle et un paramètre. OrcaRouter achemine openai/gpt-5.6-sol au tarif catalogue d'OpenAI lui-même, sans rien ajouter — 4,00 $ en entrée, 0,40 $ en cache, 20,00 $ en sortie, le palier pour prompts longs étant publié à 8,00 $ et 30,00 $ — et achemine openai/gpt-6-sol à 2,00 $ / 0,20 $ / 10,00 $, avec son propre palier de 272K à 4,00 $ et 15,00 $. Comme la marge est nulle et que la grille tarifaire du fournisseur est répercutée telle quelle, une promotion ou une baisse de tarif sur l'un ou l'autre palier apparaît sur la route le jour même où OpenAI la publie, sans second contrat ni nouvel enregistrement modèle par modèle. Un seul point de terminaison compatible OpenAI et une seule clé API couvrent les deux branches du test : le seul travail consiste donc à choisir un ensemble de tâches et à lire l'objet d'utilisation.

A screenshot of the OrcaRouter model page for GPT-6 Sol (openai/gpt-6-sol), showing the header 'by OpenAI - 2026-09-22', a 1,050,000-token context window with 128,000 maximum output tokens, capability tags for vision, tools, JSON and reasoning, and pricing of $2.00 per million input tokens and $10.00 per million output tokens with a cached-input rate of $0.20 per million, alongside a long-prompt tier reading $4.00 input and $15.00 output.

Lancez-le de trois façons sur le même ensemble de vos propres requêtes difficiles, en gardant reasoning.effort constant afin qu'une seule variable change : gpt-5.6-sol en mode standard, gpt-5.6-sol avec le mode pro activé, et gpt-6.1-sol au même effort. Comparez la réussite des tâches, la latence d'horloge murale et le nombre total de tokens facturés, en lisant le champ reasoning-token plutôt que le corps de la réponse. Le total de tokens de l'exécution pro comparé à celui de son jumeau standard est votre multiplicateur sur votre trafic — il ne correspondra à celui de personne d'autre, car l'intention de conception est que le travail supplémentaire évolue avec la difficulté de la requête. L'exécution 6.1 est le même corps de requête avec une seule chaîne modifiée, donc la garder comme test de régression après la décision ne coûte rien.

Deux choses à garder en tête avant de tirer la conclusion. Si l’identifiant 6.1 rejette le paramètre pro au lieu de renvoyer un résultat, c’est en soi un constat, et vous l’aurez appris avant que cela n’ait touché quoi que ce soit côté utilisateur. Et si le bras auquel vous comparez est le gpt-6-sol actuellement routable plutôt qu’une configuration 5.6, rappelez-vous que les grilles tarifaires de base sont identiques entre 6.0 et 6.1 — la différence entre ces deux-là tient à la ligne d’entrée mise en cache et aux résultats de tâches rapportés par le fournisseur, tandis que la différence entre 5.6 et 6.1 porte sur toute la grille tarifaire.

FAQ

GPT-5.6 Sol Pro est-il un modèle distinct avec son propre tarif premium ? Non — et c'est le piège que tend ce nom. La grille tarifaire d'OpenAI comporte de véritables compteurs Pro premium, mais ils appartiennent à des générations antérieures, à partir de 30,00 $ en entrée et 180,00 $ en sortie par million de tokens. Pour la famille GPT-5.6, le fournisseur vend le modèle phare et expose pro comme une valeur de reasoning.mode dans l'API Responses, facturé aux tarifs ordinaires de ce modèle phare. Une fiche pro datée de la génération 5.6 et indiquant 4,00 $ et 20,00 $ reprend la grille tarifaire du modèle phare, ce qui vous permet de voir qu'il n'y a pas de second compteur.

Sur lequel des deux devrais-je mettre une charge de travail exigeante et à faible volume ?Aucune des deux réponses n'est gratuite, la décision dépend donc de ce que vous pouvez mesurer plutôt que de ce que vous pouvez lire. Le niveau le plus récent est à moitié prix sur chaque ligne publiée et quatre fois moins cher sur l'entrée mise en cache, mais son mode pro ne dispose d'aucune évaluation indépendante et sa page de modèle ne mentionne pas du tout ce mode. Le niveau plus ancien a un historique GA bien établi et une évaluation complète par un tiers, et coûte deux fois plus cher par token. Si votre ensemble de tâches est peu coûteux à exécuter, la réponse est l'option qui l'emporte sur vos propres requêtes à effort égal ; sinon, le niveau plus ancien est celui dont vous pouvez au moins vérifier le comportement par rapport aux chiffres de quelqu'un d'autre.

Le mode pro change-t-il ce dans quoi le modèle excelle ? Non. Il effectue davantage de travail de modèle avant de renvoyer une réponse finale unique, ce qui peut améliorer la fiabilité sur des tâches difficiles et augmente à la fois la latence et l'utilisation de tokens — les poids sont les mêmes dans les deux cas. Si la métrique que vous cherchez à faire évoluer est un chiffre de précision ou d'hallucination plutôt qu'un taux de réussite sur des problèmes réellement difficiles, les preuves indépendantes concernant cette famille indiquent que la génération du modèle et le réglage de l'effort sont les leviers les plus fiables, et non le mode.

A generated comparison card titled 'One generation, two rate cards', with a left panel labelled 'GPT-5.6 Sol Pro' reading 'Released: July 9, 2026', 'Base input: $4.00 per 1M', 'Base output: $20.00 per 1M', 'Cached input: $0.40 per 1M' and 'Independent score: AA Intelligence 47', and a right panel labelled 'GPT-6.1 Sol Pro' reading 'Released: September 29, 2026', 'Base input: $2.00 per 1M', 'Base output: $10.00 per 1M', 'Cached input: $0.10 per 1M' and 'Independent score: none published'. A footer reads 'OpenAI figures vendor-reported; GPT-5.6 Sol scores per Artificial Analysis; no third-party evaluation of the GPT-6.1 tier published as of September 30, 2026.'

La version courte, et celle qui vaut la peine d'être retenue de cette comparaison : le mode pro est la constante et la grille tarifaire est la variable. Entre ces deux configurations, rien dans le fonctionnement du mode n'a changé — la même agrégation du travail des modèles, la même facturation au tarif standard, le même multiplicateur non publié, la même erreur si vous essayez de l'associer à l'effort : aucune. Ce qui a changé en trois mois, c'est que chaque ligne publiée du compteur en dessous a été divisée par deux, et la ligne des entrées mises en cache a été divisée par quatre. Cela fait du palier le plus récent le choix par défaut côté prix pour quiconque exploite déjà une configuration pro, et cela fait du palier plus ancien le choix par défaut côté preuves pour quiconque a besoin d'un chiffre tiers avant de basculer. Aucune de ces deux choses n'est une raison de traiter les noms comme deux produits.

Les deux volets du test s'exécutent à partir de un point de terminaison compatible OpenAI avec la grille tarifaire du fournisseur transmise telle quelle, sans marge ajoutée, et un basculement automatique entre fournisseurs.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement