Une carte de comparaison générée intitulée « Même carte, à une ligne d'écart », avec un panneau de gauche intitulé « GPT-6 Sol Pro » indiquant « Base : gpt-6-sol, publié le 22 septembre 2026 », « Entrée / sortie : 2,00 $ / 10,00 $ par 1 M », « Entrée mise en cache : 0,20 $ par 1 M » et « Mode Pro : reasoning.mode, tarifs standards », et un panneau de droite intitulé « GPT-6.1 Sol Pro » indiquant « Base : gpt-6.1-sol, publié le 29 septembre 2026 », « Entrée / sortie : 2,00 $ / 10,00 $ par 1 M », « Entrée mise en cache : 0,10 $ par 1 M » et « Mode Pro : reasoning.mode, tarifs standards ». Un pied de page indique « Les chiffres d'OpenAI sont déclarés par le fournisseur ; aucune évaluation indépendante de l'une ou l'autre configuration Pro n'a été publiée en date du 30 septembre 2026 », et le logo OrcaRouter figure dans le coin inférieur droit.
Guides & Insights

GPT-6.1 Sol Pro vs GPT-6 Sol Pro : même grille tarifaire, à une ligne d’écart

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Deux semaines séparent les sorties et presque rien ne sépare les factures, c'est pourquoi la confrontation entre GPT-6.1 Sol Pro et GPT-6 Sol Pro est courte et inhabituellement précise. Les deux noms renvoient au même type de chose — un modèle de base plus reasoning.mode défini sur pro dans la Responses API — donc aucun n'a son propre identifiant, sa propre grille tarifaire ni son propre supplément. GPT-6.1 Sol Pro est GPT-6.1 Sol, sorti le 29 septembre 2026, fonctionnant en mode pro. GPT-6 Sol Pro est GPT-6 Sol, sorti le 22 septembre 2026, fonctionnant dans le même mode. Les deux exposent 1 050 000 tokens de contexte et 128 000 tokens de sortie maximale, facturent tous deux 2,00 $ par million de tokens d'entrée et 10,00 $ par million de tokens de sortie, et facturent tous deux le travail supplémentaire du mode à ces mêmes tarifs standard. Ce qui diffère réellement, c'est une ligne du compteur, un échelon de l'échelle d'effort, et la quantité de preuves indépendantes qui existe derrière l'une ou l'autre configuration.

Les deux noms sont le même mot pour le même interrupteur.

Commençons par le mécanisme, car c'est la raison pour laquelle cette comparaison comporte si peu de lignes. OpenAI vendait Pro comme un produit à l'ère de GPT-5 — gpt-5-pro, gpt-5.2-pro, gpt-5.4-pro, gpt-5.5-pro, o1-pro, o3-pro — chacun avec son propre identifiant et son propre compteur premium, jusqu'à 150,00 $ en entrée et 600,00 $ en sortie par million de tokens sur o1-pro. Puis le mécanisme a changé, mais pas le vocabulaire. Pro est devenu une valeur que l'on définit sur le modèle phare, facturée aux tarifs du modèle phare lui-même, et la page des dépréciations d'OpenAI le dit dans ses propres termes : lorsque ces anciens compteurs prendront leur retraite entre octobre et décembre 2026, le substitut recommandé est gpt-5.6-sol avec reasoning.mode: pro — un modèle plus un mode, et non un produit successeur.

Le schéma de l'API publique du fournisseur concorde. Recherchez-y des identifiants de l'ère GPT-6 et quatre apparaissent : gpt-6-astra, gpt-6-sol, gpt-6-luna et gpt-6.1-sol. Aucune variante pro n'apparaît parmi eux, et aucune variante pro n'apparaît non plus sur la liste de prix. Ce qui est apparu, quelques heures après le lancement du niveau 6.1, ce sont des fiches pro pour toute la famille dans des catalogues tiers — 6.1 Sol Pro, 6 Sol Pro, 6 Luna Pro, 5.6 Sol Pro — chacune citant la fiche de son modèle de base. C'est une ligne de catalogue que l'on habille d'un nom, et non un fournisseur qui expédie un produit, et c'est pourquoi les deux sujets de cette comparaison sont un mode sur deux modèles de base différents plutôt que deux déploiements.

Ce sur quoi les deux configurations diffèrent réellement

A screenshot of the flagship-model table on OpenAI's pricing page, whose columns run input, cached input, cache writes and output for short context and then the same four for long context. Three rows are visible and none of them is gpt-6-sol: gpt-6-astra reading $10.00, $1.00, $12.50 and $50.00 short context against $20.00, $2.00, $25.00 and $75.00 long context; gpt-6.1-sol reading $2.00, $0.10, $2.50 and $10.00 short context against $4.00, $0.20, $5.00 and $15.00 long context; and gpt-6-luna reading $0.10, $0.01, $0.125 and $0.50 short context against $0.20, $0.02, $0.25 and $0.75 long context.

Voici chaque dimension qui les sépare, les deux côtés sur une seule ligne :

• À quoi correspond le nom — gpt-6.1-sol avec reasoning.mode: "pro" par rapport à gpt-6-sol avec reasoning.mode: "pro" ; ni le fournisseur ni le catalogue ne publient d'identifiant -pro pour l'un ou l'autre
• Date de sortie du modèle de base — 29 septembre 2026 contre 22 septembre 2026, à sept jours d'écart
• Prix d'entrée — 2,00 $ par million de jetons dans les deux cas, de sorte que le volume d'entrée supplémentaire du mode pro coûte le même prix à l'unité sur l'un ou l'autre niveau
• Prix de sortie — 10,00 $ par million de jetons dans les deux cas, et c'est le tarif auquel sont facturés les jetons de raisonnement supplémentaires du mode, puisque le mode pro change le volume et non le prix
• Entrée mise en cache — 0,10 $ par million sur 6.1 Sol contre 0,20 $ sur 6 Sol ; la seule ligne publiée où les deux grilles tarifaires divergent
• Écritures en cache — 2,50 $ par million de jetons dans les deux cas
• Révision tarifaire des prompts longs — au-delà de 272 000 jetons d'entrée, l'ensemble de la requête est refacturé à 2× les tarifs d'entrée et de cache et à 1,5× le tarif de sortie dans les deux cas, ce qui place 6.1 Sol à 4,00 $ en entrée, 0,20 $ en cache, 5,00 $ en écriture de cache et 15,00 $ en sortie par million, contre 4,00 $, 0,40 $, 5,00 $ et 15,00 $ sur 6 Sol — la remise de cache survit intacte à la révision tarifaire
• Plafond de contexte et de sortie — 1 050 000 jetons de contexte et 128 000 jetons de sortie maximum dans les deux cas
• Échelle d'effort de raisonnement — low, medium (par défaut), high, xhigh et max sur 6.1 Sol, avec none et minimal non pris en charge ; la même échelle sur 6 Sol avec none toujours disponible
• Coupure de connaissances documentée — 30 avril 2026 sur le niveau 6.1 ; nous n'avons pas vérifié celle de 6 Sol sur les pages que nous avons consultées, donc considérez cette ligne comme non tranchée plutôt que comme une différence
• Évaluation indépendante — une page tierce publiée pour GPT-6 Sol, aucune du tout pour GPT-6.1 Sol, et aucune évaluation d'une configuration pro pour l'un ou l'autre

Lisez la liste et la forme de la décision s'impose d'elle-même. Une ligne est une véritable différence publiée — le tarif des entrées mises en cache, qui est divisé par deux. Une ligne est une capacité que vous perdez plutôt que gagnez — l'impossibilité d'associer le mode à effort: none sur le palier le plus récent, ce qui compte pour quiconque utilise cette combinaison afin de réduire la latence sur les tâches de type routage. Tout le reste est identique, y compris la règle de re-tarification qui s'applique à toute requête dépassant 272 000 tokens.

Le manque de preuves, dit sans détour

C’est ici que la comparaison cesse d’être symétrique. GPT-6 Sol dispose d’une véritable évaluation tierce : le classement neutre que ce blog utilise comme référence externe lui attribue 47,5 sur son Intelligence Index, le classant 12e sur un échantillon de 145 modèles, et nos propres routes présentent un historique de performances mesuré pour la configuration standard — une latence médiane proche de 1,24 seconde, environ 65 jetons par seconde, et un taux d’erreur de 0,16 % sur environ 167 millions de jetons de trafic. GPT-6.1 Sol n’a rien de tout cela. La page du classement pour le slug 6.1 renvoie une 404 et la chaîne n’apparaît pas dans le classement en direct, donc tous les scores que vous voyez cités pour lui aujourd’hui proviennent du fournisseur.

Deux réserves à ce sujet, et toutes deux vont à l’encontre d’une surinterprétation de ce que nous avons réellement. Le chiffre de latence mesuré appartient à la configuration standard ; le mode pro effectue davantage de travail du modèle avant de renvoyer une seule réponse finale, il est donc plus lent par construction et ce chiffre ne s’applique pas à une exécution en mode pro. Et aucun classement tiers ne publie d’évaluation séparée d’une configuration pro sur un modèle de cette famille — le classement mesure la configuration qu’il mesure et ne sépare pas le mode. L’état honnête du dossier est donc un 6 Sol mesuré en mode standard face à un palier 6.1 décrit par le fournisseur, le mode pro des deux côtés ne reposant que sur la description du fournisseur.

Trois cas, et ce que chacun devrait faire

• Vous exécutez déjà le mode pro sur GPT-6 Sol et il est rentable. Restez sur gpt-6-sol pour l'instant et conservez la charge de travail sur laquelle vous l'avez mesuré. Le palier 6.1 divise par deux le tarif des entrées mises en cache, ce qui, sur un préfixe réutilisé, représente de l'argent réel à volume, mais le mode lui-même est documenté par rapport à l'identifiant 6.1 à un seul endroit — l'exemple travaillé du guide de raisonnement — et nulle part sur la page propre à ce modèle. Attendez que la documentation par modèle du fournisseur soit à jour avant de déplacer un chemin que vous avez déjà validé
• Vous n'avez jamais mesuré le mode pro, du tout. Commencez sur le palier 6.1 en mode standard, puis exécutez un bras pro à côté, avec le même reasoning.effort. Vous obtenez la ligne de cache moins chère sur le bras que vous conserverez, l'instantané le plus récent, et une mesure du multiplicateur du mode sur votre propre trafic plutôt qu'une attente empruntée à d'autres
• Votre trafic est dominé par un préfixe stable — instructions, schémas d'outils, un long prompt système. C'est le seul cas où le palier 6.1 gagne sur le prix avant toute mesure, parce que la seule ligne publiée qui diffère est celle que vous payez le plus souvent. Faites le calcul sur votre propre volume de préfixe : à 0,10 $ contre 0,20 $ par million de jetons mis en cache, l'économie évolue avec la part de votre entrée qui est une répétition

Aucun de ces trois cas n’est tranché par un benchmark, et c’est bien là l’essentiel. Le mode est identique des deux côtés, le taux affiché est identique des deux côtés, et la décision dépend d’un taux de cache, d’une restriction liée à l’échelle d’effort, et de la question de savoir si vous avez besoin du chiffre de quelqu’un d’autre avant de vous lancer.

Exécuter les deux configurations à partir d'une seule touche

La raison pratique de lancer cette comparaison plutôt que d'en raisonner, c'est que les deux branches ne diffèrent que par une chaîne de modèle et un paramètre, si bien que l'expérience ne coûte presque rien à mettre en place. OrcaRouter route openai/gpt-6-solau prix catalogue d'OpenAI lui-même, sans rien ajouter — 2,00 $ en entrée, 0,20 $ en cache, 10,00 $ en sortie, le palier de 272 K étant publié à 4,00 $ et 15,00 $ — et répercute la règle de re-tarification du fournisseur telle qu'écrite, plutôt que de la remplacer par une règle qui lui serait propre. Comme il n'y a aucune marge ajoutée à la grille du fournisseur, une modification de tarif ou de prix de cache apparaît sur la route le jour même où OpenAI la publie, sans second contrat à renégocier. Ni le palier 6.1 ni une fiche pro de celui-ci ne figurent sur ces routes aujourd'hui — nous avons consulté le catalogue public le 30 septembre 2026 et openai/gpt-6.1-sol comme openai/gpt-6.1-sol-pro renvoient modèle introuvable — la branche que vous pouvez donc appeler dès maintenant est celle de 6 Sol, en mode standard ou pro, sur le même point de terminaison et avec la même clé que ceux que vous utiliseriez pour le palier plus récent lorsqu'il sera disponible.

A screenshot of the OrcaRouter model page for GPT-6 Sol (openai/gpt-6-sol), showing the header 'by OpenAI - 2026-09-22', capability tags for vision, tools, JSON and reasoning, a 1,050,000-token context window with 128,000 maximum output tokens, a pricing table whose standard tier reads $2.00 input, $10.00 output, $0.20 cache read and $2.50 cache write, a long-context row reading $4.00 input, $15.00 output, $0.40 cache read and $5.00 cache write, a measured performance panel showing a p50 latency near 1.24 seconds, about 65 tokens per second and a 0.16% error rate, and an OpenAI-compatible code sample calling model openai/gpt-6-sol through base_url https://api.orcarouter.ai/v1.

Lancez le test à trois bras sur vos propres requêtes difficiles et maintenez reasoning.effort constant afin qu'une seule variable change à la fois : gpt-6-sol en mode standard, gpt-6-sol avec le mode pro activé, et — une fois qu'il est routable — gpt-6.1-sol au même effort. Lisez le total de jetons facturés depuis l'objet d'utilisation plutôt que depuis le corps de la réponse, car le raisonnement supplémentaire du mode atterrit dans un champ que le texte de la réponse ne montre jamais. L'exécution pro comparée à sa jumelle standard vous donne le multiplicateur sur votre trafic, qui ne correspondra à celui de personne d'autre. Conserver le troisième bras comme test de régression après la décision coûte un seul changement de chaîne, et une règle de routage qui envoie les requêtes véritablement difficiles vers la configuration pro tandis que la masse reste en standard est une ligne dans un DSL de routage plutôt qu'une réarchitecture — c'est la version de cette décision qui survivra au prochain renouvellement de modèle.

A generated scoreboard titled 'GPT-6 Sol Pro vs GPT-6.1 Sol Pro - the scoreboard'. Left column 'GPT-6 Sol Pro': rows reading 'Base model released: Sept 22, 2026', 'Input / output: $2.00 / $10.00 per 1M', 'Cached input: $0.20 per 1M', 'Cache writes: $2.50 per 1M', 'Context: 1,050,000 tokens', 'Effort none: available', 'Independent score: AA Intelligence 47.5, rank 12 of 145', 'Pro mode evaluated: no'. Right column 'GPT-6.1 Sol Pro': rows reading 'Base model released: Sept 29, 2026', 'Input / output: $2.00 / $10.00 per 1M', 'Cached input: $0.10 per 1M', 'Cache writes: $2.50 per 1M', 'Context: 1,050,000 tokens', 'Effort none: not supported', 'Independent score: none published', 'Pro mode evaluated: no'. A footer reads 'OpenAI figures vendor-reported; GPT-6 Sol score per Artificial Analysis; no third-party evaluation of either pro configuration published as of September 30, 2026.'

L'essentiel

Si l'on retire les noms, il s'agit d'une seule configuration sur deux instantanés adjacents, à sept jours d'intervalle, partageant une grille tarifaire jusqu'au seuil de réévaluation tarifaire. L'instantané le plus récent divise par deux le tarif des entrées en cache et abandonne effort : aucun ; l'ancien conserve cet échelon et s'accompagne d'une évaluation par un tiers, d'un relevé de latence mesurée et d'un mode pro que le fournisseur documente sur une page de modèle plutôt que seulement dans un exemple de guide. Si votre trafic réutilise un préfixe stable à volume, le palier 6.1 est l'option par défaut la moins chère et vous devriez l'indiquer sur la ligne de cache plutôt que sur le titre. Si votre parcours en mode pro est déjà mesuré et fonctionnel, aucune preuve publiée ne justifie de le déplacer cette semaine. Dans les deux cas, considérez les deux noms de catalogue comme un seul commutateur sur deux modèles de base — car c'est la seule lecture qui résiste à un examen de la propre liste de prix du fournisseur.

L'arme que vous pouvez appeler aujourd'hui est celle de 6 Sol, standard ou pro, et elle figure dans le catalogue public au prix catalogue d'OpenAI, sans rien de plus, sur un seul endpoint et une seule clé.