
Tarification de l'API GPT-5.6 : niveaux Sol, Terra et Luna, coût réel et comment appeler chacun d'eux
- qwenNOUVEAUQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaNOUVEAUOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicNOUVEAUAnthropic: Claude Opus 52026-07-2461Intelligence78Code
- googleNOUVEAUGoogle: Gemini 3.6 Flash2026-07-2150Intelligence69Code
- googleNOUVEAUGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligence49Code
- metaNOUVEAUMeta: Muse Spark 1.12026-07-1651Intelligence71Code
- kimiMoonshotAI: Kimi K32026-07-1557Intelligence76Code
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Intelligence71Code
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Intelligence77Code
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Intelligence77Code
- grokxAI: Grok 4.52026-07-0854Intelligence72Code
- tencentTencent: Hy32026-07-0641Intelligence59Code
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligence42Code
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligence39Code
- anthropicAnthropic: Claude Sonnet 52026-06-3053Intelligence72Code
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligence52Code57Maths
- z-aiZ.ai: GLM 5.22026-06-1651Intelligence69Code60Maths
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Intelligence61Code61Maths
- anthropicAnthropic: Claude Fable 52026-06-0960Intelligence77Code
- qwenQwen: Qwen3.7 Plus2026-06-0139Intelligence56Code59Maths
GPT-5.6 est la famille phare d’OpenAI pour juillet 2026, et l’essentiel pour les développeurs est qu’elle n’a pas un prix unique. Elle se décline en trois niveaux : Sol, Terra et Luna. Sur l’API OpenAI, Sol coûte 5 $ par million de tokens d’entrée et 30 $ par million de tokens de sortie, Terra est à 2,50 $ et 15 $, et Luna à 1 $ et 6 $. Chaque niveau bénéficie d’une réduction pour entrée en cache, les trois acceptent les images ainsi que le texte, et la fenêtre de contexte est d’environ 1,05 M de tokens avec jusqu’à 128 K de sortie.
Le prix catalogue n'est que le début du coût réel. Le niveau dont vous avez réellement besoin, la quantité que vous mettez en cache, le volume de sortie généré par le modèle, et quelques règles de tarification que la plupart des guides omettent — les invites de plus de 272K tokens, la majoration pour résidence des données et les niveaux de service — déterminent la facture bien plus que le taux affiché. Ce guide décompose le prix de chaque niveau, à quoi il sert, comment il est noté, comment migrer depuis GPT-5.5, comment l'appeler, et comment il se compare à Claude, GLM, Gemini, DeepSeek et Grok.
Réponse rapide : tarifs de GPT-5.6 en un coup d'œil
- Trois niveaux (par million de jetons, entrée / sortie) : Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.
- Entrée mise en cache : 0,50 $ (Sol), 0,25 $ (Terra), 0,10 $ (Luna) par million de jetons ; les écritures en cache coûtent 1,25 fois le taux d'entrée non mis en cache.
- Positionnement : Sol pour le travail de raisonnement et agentique le plus difficile, Terra comme défaut équilibré, Luna pour les tâches à volume élevé et sensibles aux coûts.
- Modalité : multimodal — GPT-5.6 accepte des entrées d'image en complément du texte. Contexte ~1,05M tokens, sortie max 128K.
- Deux règles de tarification à prévoir : les requêtes de plus de 272K tokens d'entrée sont facturées à 2x l'entrée et 1.5x la sortie pour l'ensemble de la demande, et les points de terminaison de résidence des données ajoutent une majoration de 10%.
- Moyens de payer moins : Le lot est à 50 % de réduction par rapport au standard, la mise en cache réduit les entrées répétées à un dixième, et le routage du travail de routine vers un niveau inférieur évite la sortie à 30 $ de Sol.
- Intelligence : Artificial Analysis place GPT-5.6 Sol près du sommet de son Intelligence Index (score 59).
Tarification de l'API GPT-5.6, niveau par niveau

OpenAI facture le GPT-5.6 par million de tokens, et la sortie est bien plus chère que l'entrée à chaque niveau. Les tarifs publiés actuels sont :
- GPT-5.6 Sol : 5,00 $ entrée, 0,50 $ entrée en cache, 30,00 $ sortie (écritures en cache 6,25 $).
- GPT-5.6 Terra : 2,50 $ en entrée, 0,25 $ en entrée en cache, 15,00 $ en sortie.
- GPT-5.6 Luna : 1,00 $ en entrée, 0,10 $ en entrée en cache, 6,00 $ en sortie.
Deux détails comptent avant de planifier un budget. Premièrement, le taux de sortie domine la plupart des factures réelles, surtout pour le raisonnement et le travail agentique où le modèle génère de longues traces, des appels d'outils et des révisions avant une réponse finale. Deuxièmement, il n'y a pas de ligne de prix distincte « Sol Ultra » sur la page des tarifs ; « Sol Ultra » est une configuration de raisonnement supérieur de Sol (une configuration multi-agents), pas un niveau indépendant—budgétisez autour de Sol, Terra et Luna.
À quoi sert réellement chaque niveau
Luna : à volume élevé et sensible aux coûts
Luna est le niveau économique à 1 $ en entrée et 6 $ en sortie. C'est le bon choix par défaut pour la classification, l'extraction, le routage, la synthèse, la rédaction et le grand volume de travail de routine où une petite différence de qualité ne change pas le résultat. À six dollars par million de jetons de sortie, c'est suffisamment bon marché pour fonctionner à grande échelle et pour échantillonner à plusieurs reprises.
Terra : le défaut équilibré
Terra se situe au milieu à 2,50 $ et 15 $. Pour la plupart des travaux d'application et de codage, c'est le point de départ raisonnable : nettement plus fort que Luna sur les tâches difficiles, mais à moitié prix de la sortie de Sol. Commencez ici, puis déplacez une tâche vers Sol uniquement lorsque Terra échoue visiblement.
Sol : le raisonnement le plus difficile et le travail agentif
Sol est le produit phare à 5 $ et 30 $, et Artificial Analysis le place près du sommet de son Intelligence Index. Réservez-le pour l'architecture difficile, le débogage complexe, les agents à long horizon et les analyses à enjeux élevés où un échec évité vaut le supplément. Utiliser Sol pour un travail de routine est la manière la plus courante de dépenser trop pour GPT-5.6.
Vous venez de GPT-5.5 ? Quel palier offre le plus d'économies ?
GPT-5.6 Sol est proposé au même prix que GPT-5.5, soit 5 $ en entrée et 30 $ en sortie, donc transférer directement une charge de travail GPT-5.5 vers Sol modifie peu la facture. L'économie réside dans les deux nouveaux niveaux inférieurs. Terra offre une qualité comparable à celle de GPT-5.5 pour la plupart des tâches, à moitié prix, donc la migration la plus simple consiste à envoyer le trafic GPT-5.5 existant vers Terra et à ne remonter que les tâches qui régressent vers Sol.
Le plan de migration pratique comporte trois étapes : rediriger les appels GPT-5.5 vers Terra, exécuter votre jeu d'évaluation, et ne remonter que les échecs à Sol tout en poussant le travail clairement routinier vers Luna. La plupart des charges de travail GPT-5.5 reviennent moins chères de cette façon sans perte de qualité mesurable.
Comment les paliers notent réellement


Le prix n'a d'importance qu'à côté des capacités. Sur les propres chiffres d'OpenAI dans Terminal-Bench 2.1, les niveaux se séparent à peu près comme on peut s'y attendre : Sol 88,8 %, Sol Ultra 91,9 %, Terra 87,4 % et Luna 84,7 %. Pour contexte dans le même tableau, GPT-5.5 obtient 85,6 %, Claude Opus 4.8 est 78,9 %, Claude Fable 5 est 83,1 %, et Gemini 3.1 Pro (aperçu) est 70,7 %. Artificial Analysis donne séparément à Sol un Intelligence Index de 59, près du sommet de son classement.
Lisez-les comme étant rapportés par le fournisseur et indicatifs. OpenAI a publié un ensemble limité d'évaluations pour GPT-5.6 et non, au moment de la rédaction, des benchmarks traditionnels de codage et de raisonnement tels que SWE-bench Verified ou GPQA, alors utilisez ces scores pour décider quoi tester sur votre propre charge de travail plutôt que comme un verdict final.

Le taux de lecture des entrées mises en cache de chaque palier est d'un dixième de son taux d'entrée fraîche : 0,50 $ sur Sol, 0,25 $ sur Terra, 0,10 $ sur Luna. L'écriture dans le cache coûte toutefois 1,25 fois le taux d'entrée non mise en cache (environ 6,25 $ par million sur Sol), de sorte que la mise en cache n'est rentable que lorsqu'un préfixe stable est réutilisé suffisamment de fois pour récupérer la prime d'écriture — instructions système, un document volumineux, des règles de dépôt ou une taxonomie de produit. Placez le matériel stable au début de l'invite et la question changeante à la fin, et évitez d'insérer des horodatages ou des identifiants aléatoires avant le contexte réutilisable.
La mise en cache réduit le coût des entrées répétées ; elle n'a aucun effet sur les sorties. Comme la sortie est le côté coûteux à chaque niveau, les deux leviers qui font le plus bouger la facture d'un GPT-5.6 sont la mise en cache d'un préfixe stable et le contrôle de la quantité que le modèle écrit.
Quel palier devriez-vous choisir ?

Ne choisissez pas un niveau en fonction de sa réputation. Choisissez-le en le testant. Construisez un petit ensemble de tâches représentatives avec des critères d'acceptation clairs, exécutez-les d'abord sur Luna, puis promouvez uniquement les tâches qui échouent vers Terra, puis vers Sol. Mesurez le coût par tâche acceptée, pas le prix moyen du token, car un niveau moins cher qui nécessite trois tentatives peut coûter plus cher qu'un niveau plus performant qui réussit du premier coup.
Une habitude opérationnelle permet de réaliser de réelles économies : spécifier l'ID exact du modèle de niveau dans chaque appel plutôt que de se fier à un alias nu, afin qu'une demande de routine ne s'exécute jamais silencieusement sur le niveau le plus coûteux. Une charge de travail mixte se résout généralement à Luna pour les transformations et rédactions de routine, Terra pour la mise en œuvre et l'analyse quotidiennes, et Sol réservé à la minorité difficile — la plupart des demandes n'ont jamais besoin du produit phare.
GPT-5.6 face à la concurrence sur le prix
GPT-5.6 n'existe pas de manière isolée. Comparez avec les modèles actuels (par million de tokens, entrée / sortie, mi-2026) : Claude Opus 4.8 est à 5 $ / 25 $, Claude Fable 5 — le modèle public le plus puissant d'Anthropic — est à 10 $ / 50 $, GLM 5.2 est à 1,40 $ / 4,40 $ sur Z.AI (les hébergeurs tiers peuvent être moins chers), Grok 4.5 est à 2 $ / 6 $, de Google Gemini 3.5 Flash est à environ 1,50 $ / 9 $, et DeepSeek V4-Pro est à environ 0,44 $ / 0,87 $. Confirmez chacun sur la page du vendeur, car ces prix changent.
Les points à retenir sont précis. GPT-5.6 Sol égale Opus 4.8 en entrée mais est plus cher en sortie (30 $ contre 25 $), donc pour un travail agentique intensif en sortie, Opus est légèrement moins cher par token tandis que Sol domine l’Intelligence Index. Terra sous‑cote les deux modèles phares et offre le meilleur rapport qualité-prix au sein de la famille OpenAI. Luna rivalise avec des modèles moins chers sur le prix, bien que Grok 4.5, GLM 5.2, et surtout DeepSeek soient encore plus bas. Aucun niveau ni fournisseur ne remporte tout, et c’est exactement pourquoi le routage par difficulté bat le fait de s’engager sur un seul.
Une facture mensuelle traitée

Mettez des chiffres dessus. Pour un mois mi-lourd de 50M tokens d'entrée et 10M tokens de sortie, au prix catalogue avant mise en cache et utilisation d'outils, le coût du modèle s'élève à environ :
- GPT-5.6 Luna : environ 110 $.
- GPT-5.6 Terra : environ 275 $
- GPT-5.6 Sol : environ 550 $
- À titre de comparaison : GLM 5.2 environ 114 $, Grok 4.5 environ 160 $, Claude Opus 4.8 environ 500 $, Claude Fable 5 environ 1 000 $.
Les mêmes tâches, acheminées intelligemment—Luna et Terra pour la majorité, Sol pour la minorité difficile—se situent bien plus près de la fourchette de 110 à 275 dollars que d'un prix fixe de 550 dollars pour Sol pour tout. Cet écart, multiplié sur une année, est tout l'argument en faveur du routage par niveaux.
Coûts cachés à prévoir
Plusieurs règles de tarification n'apparaissent pas dans le taux affiché et surprennent les équipes plus tard :
- Requêtes longues : une requête de plus de 272 000 tokens d'entrée est facturée à 2x l'entrée et 1,5x la sortie pour l'ensemble de la requête, donc les appels à grand contexte et les appels RAG volumineux peuvent plus que doubler le coût.
- Volume de sortie : la sortie peut atteindre jusqu'à six fois le taux d'entrée, donc une sortie sans limite ou à raisonnement élevé est le principal risque de dépassement de budget.
- Niveau de service : Le traitement prioritaire est environ le double du tarif standard (environ 10 $ d’entrée / 60 $ de sortie sur Sol) ; Flex et Batch sont moins chers. Choisissez le niveau délibérément avec le paramètre service_tier.
- Résidence des données : les points de terminaison de traitement régional ajoutent une majoration de 10 % pour les modèles publiés le ou après le 5 mars 2026, ce qui inclut GPT-5.6.
- Boucles et nouvelles tentatives d'agent : les instructions, outils et historique sont renvoyés à chaque tour, et une longue requête échouée gaspille l'entrée que vous avez déjà payée.
- Dérive de niveau : tout laisser sur Sol « pour être sûr » est l'habitude la plus coûteuse qui soit.
Moyens de payer moins
Trois leviers réduisent une facture GPT-5.6 sans changer ce que vous construisez. Batch : les requêtes asynchrones via le niveau Batch bénéficient d'une réduction de 50 % par rapport au tarif standard, idéales pour les travaux Luna à grand volume qui ne sont pas sensibles à la latence. Caching : réutilisez un préfixe stable suffisamment de fois pour surmonter la prime d'écriture de 1,25x, et les entrées répétées chutent à un dixième. Routage : envoyez le travail courant vers Luna ou Terra et escaladez uniquement la minorité difficile vers Sol, et gardez les invites sous le seuil des 272K lorsque vous le pouvez.
Comment appeler GPT-5.6
GPT-5.6 est disponible via l'API OpenAI et via des passerelles compatibles OpenAI, de sorte que l'intégration reste stable pendant que vous changez de modèle ou de niveau derrière. Voici un modèle standard compatible OpenAI ; confirmez l'ID du modèle actuel avant une utilisation en production, et figez le niveau exact plutôt qu'un simple alias.
from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "Refactoriser ce module et expliquer les risques."}],
)
print(response.choices[0].message.content)
Changer de niveau est une modification d'une ligne sur le champ du modèle, ce qui rend le routage basé sur la difficulté pratique : envoyez les appels de routine à Luna ou Terra et ne faites remonter que les plus difficiles à Sol.
Test de GPT-5.6 via OrcaRouter
Une passerelle rend GPT-5.6 plus facile à adopter pour deux raisons. Premièrement, le même client compatible OpenAI peut appeler les trois niveaux et les modèles de comparaison tels que Claude Opus 4.8, GLM 5.2 et Grok 4.5, afin que vous puissiez exécuter un seul ensemble d'évaluation sur l'ensemble sans réécrire le code d'intégration et mesurer le coût réel par tâche acceptée — frais d'outils, tentatives et supplément de 272K inclus. Deuxièmement, une passerelle peut basculer entre les fournisseurs et imposer un plafond budgétaire, de sorte qu'un problème de capacité temporaire ou un appel Sol inopiné ne fasse pas exploser le mois. Confirmez la route live de GPT-5.6 et les identifiants de niveau actuels avant de construire un budget basé sur ceux-ci.

Prochaine étape : inscrivez-vous à OrcaRouter et exécutez votre propre comparaison des niveaux GPT-5.6 via un point de terminaison API.
FAQ
Quelle est la différence entre {{1}}GPT-5.6 Sol{{/1}}, {{2}}Terra{{/2}} et {{3}}Luna{{/3}}?
Il s'agit de trois niveaux d'une même famille, à des prix et des capacités différents. Sol est le produit phare pour les tâches les plus exigeantes (5 $/30 $), Terra est le choix équilibré par défaut (2,50 $/15 $), et Luna est le niveau économique pour les tâches à volume élevé (1 $/6 $). Choisissez le niveau le plus bas qui réussit vos tests.
Existe-t-il un niveau de tarification GPT-5.6 Sol Ultra ?
Non. "Sol Ultra" est une configuration de Sol à raisonnement supérieur et multi-agents, pas une ligne distincte sur la page des tarifs. Elle utilise plus de tokens et coûte plus cher par tâche, mais vous la budgetisez comme Sol à un effort plus élevé.
Pourquoi ma facture GPT-5.6 a-t-elle dépassé une simple estimation ?
Habituellement, les jetons de sortie, la surcharge pour long prompt de 272K (2x entrée, 1,5x sortie), le niveau de service prioritaire, la majoration pour résidence des données ou les nouvelles tentatives. Enregistrez la chaîne de requête complète et mesurez le coût par tâche acceptée plutôt que par prompt.
Puis-je affiner GPT-5.6, et existe-t-il un niveau gratuit ?
Non aux deux. GPT-5.6 ne prend pas en charge le fine-tuning, et l'API n'a pas de niveau gratuit — la facturation commence dès le premier jeton. L'accès gratuit n'existe que dans certains forfaits ChatGPT, qui sont un produit distinct de l'API.
Quel forfait ChatGPT peut utiliser quel niveau ?
Cela varie selon le produit. Dans ChatGPT Work et Codex, les formules Free et Go peuvent utiliser Terra tandis que Plus et au-dessus peuvent choisir entre Sol, Terra et Luna ; le réglage ultra le plus élevé est limité aux formules Pro et Enterprise. Traitez les plans API et ChatGPT comme séparés — une clé API n'hérite pas de l'accès d'un abonnement.
En résumé
GPT-5.6 : l'histoire des prix, c'est le palier. Sol à 5 $/30 $ mène le classement de l'intelligence, Terra à 2,50 $/15 $ est le défaut de valeur et le foyer naturel de l'ancien trafic GPT-5.5, et Luna à 1 $/6 $ gère le volume. La mise en cache réduit la saisie répétée au dixième (après une prime d'écriture de 1,25x), Batch coûte moitié moins, mais la sortie est le côté coûteux sur chaque palier et les longues invites de plus de 272K entraînent un supplément.
Traitez les trois niveaux comme un problème de routage, et non comme un achat unique : par défaut bas, escalader en cas d'échec, mettre en cache le contexte stable, utiliser Batch lorsque la latence le permet, et garder un modèle de comparaison accessible via le même point de terminaison. Cela produit un coût par tâche acceptée bien inférieur au paiement des tarifs phares pour un travail de routine.
