Une carte de titre générée intitulée « GPT-6.1 Sol Pricing », avec le sous-titre « La grille tarifaire, le seul compteur qui a bougé, et la falaise des 272K », au-dessus d'une rangée de quatre puces arrondies indiquant « Entrée : 2,00 $/M », « Entrée en cache : 0,10 $/M », « Écriture en cache : 2,50 $/M » et « Sortie : 10,00 $/M », avec la légende « Niveau standard d'OpenAI, relevé le 7 octobre 2026 », accompagnée d'icônes linéaires plates minimales et du logo OrcaRouter intégré dans le coin inférieur droit.
Guides & Insights

Tarification de GPT-6.1 Sol : la grille tarifaire, le seul compteur qui a bougé, et la falaise des 272K

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Cette page est la grille tarifaire. GPT-6.1 Sol coûte 2,00 $ par million de jetons d'entrée, 0,10 $ par million de jetons d'entrée mis en cache, 2,50 $ par million de jetons d'écriture de cache et 10,00 $ par million de jetons de sortie sur le niveau standard du fournisseur, et GPT-6 Sol — l'échelon que ce modèle remplace, et celui que notre catalogue propose — affiche 2,00 $, 0,20 $, 2,50 $ et 10,00 $ pour les quatre mêmes compteurs. Un seul chiffre diffère entre les deux grilles, le seuil au-dessus duquel les deux changent de tarif se situe au même endroit, et les remises sous le prix catalogue sont des multiplicateurs plutôt qu'une seconde grille tarifaire. Tout ce qui figure sur cette page est tiré de la page de tarification pour développeurs du fournisseur lui-même et de ses deux pages de modèle pour GPT-6.1 Sol et GPT-6 Sol, toutes consultées le 7 octobre 2026, et de nos propres fiches de modèle lorsqu'un chiffre est identifié comme le nôtre. Aucun récit de lancement n'est répété ici ; si vous voulez ce qui a été livré, c'est une autre page.

La grille tarifaire, avec les quatre de GPT-6 Sol juste en dessous

OpenAI publie ces tarifs sous forme de prix par million de jetons sur le niveau de traitement standard, pour une requête d’au plus 272 000 jetons d’entrée. Les deux lignes qui comptent sont adjacentes à dessein, car tout l’argument de l’annonce est visible dans le couple : lisez chaque compteur l’un après l’autre de haut en bas et exactement l’un d’eux change.

• Entrée GPT-6.1 Sol — 2,00 $ par million de tokens, inchangé par rapport à GPT-6 Sol.
• Entrée mise en cache GPT-6.1 Sol — 0,10 $ par million de tokens, soit la moitié des 0,20 $ de GPT-6 Sol.
• Écriture de cache GPT-6.1 Sol — 2,50 $ par million de tokens, inchangé par rapport à GPT-6 Sol.
• Sortie GPT-6.1 Sol — 10,00 $ par million de tokens, inchangé par rapport à GPT-6 Sol.

• GPT-6 Sol entrée — 2,00 $ par million de tokens.
• GPT-6 Sol entrée mise en cache — 0,20 $ par million de tokens.
• GPT-6 Sol écriture de cache — 2,50 $ par million de tokens.
• GPT-6 Sol sortie — 10,00 $ par million de tokens.

Trois de ces huit lignes sont le même nombre écrit deux fois, et c’est bien là l’essentiel : il ne s’agit pas d’une nouvelle tarification, mais d’un seul compteur qui évolue sur un seul modèle. Les écritures en cache correspondent à 1,25× le tarif d’entrée non mis en cache sur les deux cartes, donc 2,50 $ équivaut à 2,00 $ × 1,25 sur les deux — le surcoût d’écriture est une propriété de la famille, pas de la version. Les lectures mises en cache sont la seule ligne où les deux modèles se distinguent : sur GPT-6.1 Sol, une lecture mise en cache représente 5 % du tarif d’entrée ; sur GPT-6 Sol, elle en représente 10 %, et OpenAI indique les deux comme des fractions du tarif d’entrée plutôt que comme des prix indépendants.

Une remarque sur la manière dont cette page présente les chiffres. OpenAI publie la grille tarifaire sous la forme d'un prix catalogue fixe par mètre, sans aucun qualificatif lié à l'effort de raisonnement associé à l'une des huit lignes ci-dessus, de sorte qu'aucune d'entre elles n'est citée à un niveau d'effort particulier. L'effort change le nombre de tokens qu'une tâche consomme, et non le coût d'un token, ce qui explique pourquoi la grille est indépendante de l'effort, contrairement à votre facture. Rien sur cette page ne constitue une comparaison directe à effort équivalent avec un modèle concurrent, et aucune comparaison de ce type n'est sous-entendue nulle part ci-dessous — lorsqu'un chiffre dépendrait de l'effort, cette page précise l'effort auquel il a été produit.

A generated two-column scoreboard headed 'GPT-6.1 Sol vs GPT-6 Sol - the rate card'. Left column 'GPT-6.1 Sol' rows: 'Input: $2.00 /M', 'Cached input: $0.10 /M', 'Cache write: $2.50 /M', 'Output: $10.00 /M', 'Above 272K input: $4.00 /M', 'Above 272K cached: $0.20 /M'. Right column 'GPT-6 Sol' rows: 'Input: $2.00 /M', 'Cached input: $0.20 /M', 'Cache write: $2.50 /M', 'Output: $10.00 /M', 'Above 272K input: $4.00 /M', 'Above 272K cached: $0.40 /M'. A footer reads 'Standard tier prices per OpenAI's pricing page, read October 7, 2026; the whole request reprices above 272K input tokens.'

La seule ligne qui a changé : entrée mise en cache, de 0,20 $ à 0,10 $.

Un compteur d'entrée mise en cache tarifie la partie d'une requête qui n'a pas changé. Lorsqu'un long préfixe stable — une invite système, un ensemble de schémas d'outils, un corpus récupéré, la transcription accumulée d'une boucle — est délibérément stocké afin que la requête suivante puisse le réutiliser, les tokens réutilisés sont facturés au tarif mis en cache plutôt qu'au tarif d'entrée, et les tokens qui sont stockés au départ sont facturés au tarif d'écriture du cache. C'est une remise sur la répétition, et elle existe parce que l'alternative pour le fournisseur est de recalculer le même préfixe à partir de zéro à chaque appel.

Diviser ce compteur par deux n'est pas le même type d'information que diviser par deux le compteur d'entrée, et la différence mérite d'être précisée. Le tarif d'entrée est ce que coûte chaque token non mis en cache de la famille, donc le diviser par deux reviendrait à une nouvelle tarification de toute la ligne de catalogue. Le tarif mis en cache est une profondeur de remise — de combien un token réutilisé se situe en dessous du tarif d'entrée — donc le modifier revient à changer la récompense d'un comportement spécifique plutôt qu'à changer la base de référence. Le tarif d'entrée de GPT-6.1 Sol est de 2,00 $, exactement ce que facture GPT-6 Sol, donc une requête sans préfixe mis en cache est facturée de façon identique sur les deux modèles. Diviser par deux le compteur mis en cache fait passer la remise de 90 % en dessous du tarif d'entrée à 95 % en dessous du tarif d'entrée, et cela touche exactement les charges de travail dont les préfixes sont assez longs et assez souvent réutilisés pour apparaître ne serait-ce que sur la ligne. Interprétez le compteur modifié comme « la même tâche coûte moins cher si vous mettez en cache » plutôt que comme « le modèle est devenu moins cher », et la fiche cesse d'être surprenante.

L'arithmétique découle des deux lignes et de rien d'autre. Un million de jetons d'entrée mis en cache coûte 0,10 $ sur GPT-6.1 Sol et 0,20 $ sur GPT-6 Sol, donc cette version vaut dix cents par million mis en cache — un chiffre trivial sur un seul appel et non négligeable sur une longue exécution, car un préfixe mis en cache est lu une fois par tour. Les écritures de cache restent inchangées à 2,50 $, donc le seuil de rentabilité de la mise en cache en soi est inchangé par cette version : le retour sur investissement d'une prime d'écriture provient de la réutilisation du préfixe, et non de celui des deux tarifs de cache qui s'applique.

Au-delà de 272 000 jetons d'entrée, l'intégralité de la requête est re-tarifée

Les deux cartes comportent un palier à contexte long, et la page tarifaire d'OpenAI énonce la règle de la même manière pour les deux : les invites dépassant 272K jetons d'entrée sont facturées à 2× les tarifs d'entrée et de cache et à 1,5× le tarif de sortie pour la requête complète. C'est l'intégralité de la requête qui est refacturée — pas seulement les jetons au-delà du seuil. C'est cette phrase qu'il faut retenir de cette section, car c'est là qu'une grille tarifaire cesse d'être une simple table de consultation : à 272 001 jetons d'entrée, la totalité de la requête, y compris le premier jeton, est facturée selon les colonnes du contexte long.

La carte tarifaire remaniée pour GPT-6.1 Sol, au-delà de 272 000 jetons d'entrée :

• Entrée — 4,00 $ par million de jetons, 2× le tarif de contexte court.
• Entrée mise en cache — 0,20 $ par million de jetons, 2× le tarif de contexte court.
• Écriture de cache — 5,00 $ par million de jetons, 2× le tarif de contexte court.
• Sortie — 15,00 $ par million de jetons, 1,5× le tarif de contexte court.

Et le même palier sur GPT-6 Sol, afin que les deux lignes puissent être comparées l'une à l'autre :

• Entrée — 4,00 $ par million de tokens.
• Entrée mise en cache — 0,40 $ par million de tokens.
• Écriture de cache — 5,00 $ par million de tokens.
• Sortie — 15,00 $ par million de tokens.

Là encore, c’est la requête entière qui est re-tarifée, et non l’excédent, si bien qu’une invite de 273 000 tokens est facturée à 4,00 $ en entrée pour la totalité des 273 000 tokens, plutôt qu’à 2,00 $ pour les 272 000 premiers et à 4,00 $ pour le dernier millier. Cela transforme le franchissement du seuil en palier plutôt qu’en pente, et donne au changement lié aux entrées mises en cache une apparence différente au-dessus de la ligne qu’en dessous. Les 0,20 $ que GPT-6.1 Sol facture pour une lecture mise en cache au-dessus de 272 K correspondent exactement au tarif que GPT-6 Sol facture en dessous, si bien qu’une charge de travail mise en cache à contexte long sur le modèle plus récent paie le montant d’avant la sortie. L’économie subsiste en termes relatifs au-dessus de la ligne — 0,20 $ contre 0,40 $ pour GPT-6 Sol, soit toujours une division par deux — mais les dix cents mis en avant ne s’appliquent pas à la requête qui franchit le seuil, car cette requête n’est pas du tout facturée selon la grille tarifaire de contexte court.

A screenshot of OpenAI's own developer pricing page headed 'Our latest models' and 'Prices per 1M tokens.', with column groups 'Short context' and 'Long context', each headed Model, Input, Cached input, Cache writes, Output. The gpt-6.1-sol row reads $2.00, $0.10, $2.50 and $10.00 in the short-context columns and $4.00, $0.20, $5.00 and $15.00 under long context; a gpt-6-astra row sits above it and a gpt-6-luna row below. Beneath the rows are three footnotes covering the 10% regional-processing uplift for models released on or after March 5, 2026, the rename of priority processing to Fast mode on July 30, 2026, and GPT-5.6 Sol's promotional pricing being available at least through November 21, 2026.

Les paliers de remise, en tant que multiplicateurs

Tout ce qui se situe en dessous du prix catalogue standard est un multiplicateur appliqué à la carte ci-dessus plutôt qu'une liste de prix distincte. C'est en les énonçant sous forme de multiplicateurs qu'on les rend transposables : les trois mêmes facteurs s'appliquent aux quatre compteurs des deux modèles, de sorte qu'un lecteur qui dispose de la carte standard possède toute la structure des paliers.

• Batch — 50 % du tarif standard. Chez OpenAI, la tarification Batch est exactement de moitié sur les quatre compteurs, pour les deux modèles : 1,00 $ en entrée, 0,05 $ en entrée mise en cache, 1,25 $ en écriture de cache et 5,00 $ en sortie par million sur GPT-6.1 Sol, et 1,00 $, 0,10 $, 1,25 $ et 5,00 $ sur GPT-6 Sol.
• Flex — 50 % du tarif standard, et identique à Batch sur les deux modèles, ligne pour ligne, de sorte que le choix entre les deux relève de l'ordonnancement plutôt que du prix.
• Mode rapide — 2× le tarif standard sur les quatre compteurs, pour les deux cartes, sans aucune exception indiquée dans l'une ou l'autre des grilles tarifaires. Le mode rapide coûte 4,00 $ en entrée, 0,20 $ en entrée mise en cache, 5,00 $ en écriture de cache et 20,00 $ en sortie par million sur GPT-6.1 Sol, contre 4,00 $, 0,40 $, 5,00 $ et 20,00 $ sur GPT-6 Sol — les deux lignes ne diffèrent que sur la ligne de la mise en cache, et uniquement par le même facteur de 2× que le tarif standard de mise en cache propre à chaque modèle applique déjà.
• Traitement régional — une majoration de 10 % s'ajoutant au palier applicable, pour les modèles publiés à partir du 5 mars 2026, sur toute résidence autre que celle par défaut.

Le mode Fast comporte une restriction de disponibilité que le prix à lui seul ne révèle pas. La page de modèle d'OpenAI consacrée à GPT-6.1 Sol indique que le mode Fast n'est pas disponible avec la résidence des données dans l'UE, et ses recommandations en matière de résidence des données classent GPT-6.1 Sol parmi les modèles qui prennent en charge la résidence UE avec les traitements Standard, Flex et Batch. Ainsi, au sein de l'UE, l'échelle des niveaux est plus courte de deux échelons, et non d'un seul : les niveaux à moitié prix sont présents, mais le niveau à prix doublé ne l'est pas. Un lecteur qui compare un déploiement européen à un déploiement américain devrait le comparer au niveau Standard, car c'est le niveau le plus rapide qui lui soit disponible — citer un chiffre de mode Fast pour une charge de travail dans l'UE décrit une configuration que le fournisseur ne propose pas.

Rien sur cette carte n'est promotionnel, et rien ne porte de date d'expiration.

Les lignes GPT-6.1 Sol ci-dessus correspondent au tarif catalogue. La page de tarification d'OpenAI n'y attache aucun qualificatif promotionnel ni date de fin, et aucun des quatre compteurs, sur la carte de contexte court comme sur celle de contexte long, n'est signalé comme un chiffre à durée limitée. Cela mérite d'être dit explicitement, car la famille a un contre-exemple sur la même page : la tarification promotionnelle de GPT-5.6 Sol comporte une note de bas de page qui l'engage au moins jusqu'au 21 novembre 2026, ce qui signifie que tout prix GPT-5.6 Sol cité aujourd'hui est un prix auquel est attaché un point de réexamen connu. Rien sur GPT-6.1 Sol n'a cette forme.

La conséquence pratique, c'est que cette page n'a pas besoin d'une mise en garde sur la vérification des dates à propos des chiffres eux-mêmes — elle en a besoin sur la page que vous êtes en train de lire, car un tarif catalogue peut changer sans qu'une date d'expiration ait été déclenchée. Cela signifie aussi que la fiche GPT-6.1 Sol est la bonne ligne sur laquelle bâtir un modèle de coûts si vous hésitez entre les deux paliers Sol et voulez que la comparaison reste stable : le compteur en cache à 0,20 $ de GPT-6 Sol est lui aussi un simple tarif catalogue, sans promotion associée, de sorte que l'écart de dix cents entre les deux tient à une différence structurelle entre les fiches plutôt qu'à une remise temporaire qu'un modèle appliquerait face à l'autre.

Comment interpréter l'affirmation de prix GPT-6.1 Sol de n'importe qui d'autre

Deux questions suffisent à trancher presque tout désaccord sur ce que coûte un modèle de classe Sol, et l'on peut répondre à l'une comme à l'autre à partir de la fiche, plutôt qu'à partir du texte qui l'entoure.

• Quel compteur est cité ? L'entrée, l'entrée mise en cache, l'écriture de cache et la sortie sont quatre nombres différents pour une même requête, et un prix unique mis en avant est presque toujours celui du compteur d'entrée, les trois autres restant implicites. Une affirmation qui se lit comme un coût total est généralement un tarif d'entrée multiplié par une répartition de tokens supposée, et c'est dans la répartition supposée que réside le désaccord.
• Quel palier de contexte a été supposé ? Les cartes de contexte court et de contexte long diffèrent d'un facteur 2 sur l'entrée et le cache et de 1,5 sur la sortie, et le palier est sélectionné en fonction de la requête entière plutôt que de l'excédent ; ainsi, un chiffre cité sans palier est un chiffre qui change dès que la requête dépasse 272 000 tokens d'entrée.
• Quel palier de traitement a été supposé ? Standard, Batch, Flex et Fast diffèrent selon des facteurs de 2 et de 50 %, et un prix cité sans préciser lequel est un prix qui comporte un facteur quatre d'ambiguïté avant même que toute question de compteur ne soit posée.
• Quel niveau d'effort a été supposé, si un nombre de tokens est en jeu ? Les tarifs sont indépendants de l'effort, mais les nombres de tokens ne le sont pas ; ainsi, tout chiffre de coût par tâche hérite de l'effort de raisonnement auquel il a été mesuré — et une comparaison entre deux modèles à des réglages d'effort différents n'est pas une comparaison de leurs prix.

Répondez à ces quatre points et une allégation de prix soit tient, soit ne tient pas. Ce qu’elle ne doit pas faire, c’est être comparée aux quatre compteurs de cette page sans que le palier et le compteur soient d’abord nommés, car les deux cartes sont adjacentes précisément pour que la seule ligne mobile soit visible et que rien d’autre ne soit confondu avec elle.

A screenshot of the OrcaRouter model page for openai/gpt-6-sol showing the breadcrumb 'Home / Models / OpenAI', the title 'GPT-6 Sol', the slug openai/gpt-6-sol, 'Max output 128K', a context figure of 1M tokens, a chip row reading $2.00, $10.00, 1.44 s, 10.00 s and 950.6K, the buttons 'Get the GPT-6 Sol API', 'Try in playground' and 'Use via API', an OpenAI-compatible code sample against https://api.orcarouter.ai/v1, and a description stating that GPT-6 Sol is the cost-efficient high-end model in OpenAI's GPT-6 series, above the fast GPT-6 Luna tier and below the flagship GPT-6 Astra.

Où est servi l’échelon GPT-6 Sol

OrcaRouter sert l'échelon GPT-6 au tarif catalogue officiel d'OpenAI, sans rien ajouter. La page du modèle à l'adresse https://www.orcarouter.ai/models/openai/gpt-6-sol indique GPT-6 Sol à $2.00 en entrée et $10.00 en sortie par million de tokens, ce qui correspond ligne pour ligne à la fiche ci-dessus, à 0 % de marge, et le catalogue compte plus de 200 modèles aux mêmes conditions. Notre fiche pour cette route affiche les mêmes montants de $0.20 pour l'entrée mise en cache et de $2.50 pour l'écriture en cache que ceux publiés par OpenAI, si bien que les chiffres concordent compteur par compteur ; considérez chaque montant mis en cache sur cette page comme une reprise du tarif publié par OpenAI plutôt que comme un devis indépendant de notre part. GPT-6.1 Sol figure lui aussi dans notre catalogue — la fiche active pour openai/gpt-6.1-sol porte une date de sortie au 29 septembre 2026, ses deux niveaux tarifaires reprenant ceux d'OpenAI, et un décompte de tokens sur sept jours se chiffrant dans les centaines de millions — aussi, un lecteur qui veut l'échelon le plus récent devrait consulter les chiffres de cette page-là plutôt que de considérer la présente page comme la référence définitive à leur sujet. Les prix évoluent ; la page fait foi.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement