
Tarifs de GPT-5.6 après la baisse : Luna vs Terra vs Sol, et quel niveau utiliser
- metaNOUVEAUMeta: Muse Spark 1.22026-08-0557Intelligence72Code
- qwenNOUVEAUQwen: Qwen3.8 Max2026-08-0358Intelligence72Code
- deepseekNOUVEAUDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligence69Code
- minimaxNOUVEAUMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens · 2275 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligence69Code
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligence49Code
- metaMeta: Muse Spark 1.12026-07-1653Intelligence71Code
- kimiMoonshotAI: Kimi K32026-07-1560Intelligence76Code
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligence71Code
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligence77Code
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligence77Code
- grokxAI: Grok 4.52026-07-0856Intelligence72Code
- tencentTencent: Hy32026-07-0642Intelligence59Code
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligence42Code
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligence39Code
- anthropicAnthropic: Claude Sonnet 52026-06-3055Intelligence72Code
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligence52Code57Maths
Après la baisse de prix d'OpenAI du 30 juillet 2026, la famille GPT-5.6 — GPT-5.6 Luna, GPT-5.6 Terra et GPT-5.6 Sol — n'a jamais été aussi abordable à faire tourner à grande échelle. Une semaine plus tard, le 6 août, OpenAI a intégré ces mêmes niveaux directement dans ChatGPT : GPT-5.6 Luna devient le modèle par défaut des comptes gratuits et Go, avec des conversations textuelles illimitées, tandis que GPT-5.6 Sol a été mis à jour pour Plus et Pro. Mais les trois niveaux sont tarifés très différemment, et choisir le bon (en plus d'utiliser correctement la mise en cache, le batch et le routage) est le levier le plus important sur votre facture API. Ce guide présente la tarification complète après la baisse, des exemples de coûts chiffrés, la comparaison de chaque niveau avec les concurrents, et la façon de router entre eux via un seul endpoint.
Les prix sont par million de jetons (entrée / sortie), reflétant la grille tarifaire après réduction telle que rapportée et les pages du modèle pass-through d'OrcaRouter ; les tarifs par paliers et de cache proviennent des pages de modèle d'OrcaRouter, et les chiffres des concurrents sont attribués. Les détails du déploiement de ChatGPT dans cet article sont tels qu'OpenAI les a déclarés le 6 août 2026 — rapportés par le fournisseur, non mesurés indépendamment. Les prix changent — vérifiez avant de construire.
TL;DR
GPT-5.6 Luna ($0.20 / $1.20) est le cheval de trait pour les gros volumes ; Terra ($2 / $12) est le juste milieu ; Sol ($5 / $30) est le fleuron pour les raisonnements les plus exigeants et le codage agentique. Les trois partagent un contexte d'environ 1,05 M de jetons et une sortie maximale de 128 K. La mise en cache des prompts et l'option batch réduisent encore les coûts, tandis que les entrées très longues vous font passer à un palier supérieur. Côté grand public, OpenAI a annoncé le 6 août que GPT-5.6 Luna devient le modèle par défaut des comptes ChatGPT Free et Go avec des conversations textuelles illimitées, et qu'une version mise à jour de GPT-5.6 Sol est déployée progressivement pour Plus et Pro. Utilisez Luna pour la grande majorité des tâches faciles, Terra lorsque vous avez besoin de plus, et Sol uniquement là où il justifie son coût — et acheminez selon la difficulté via un endpoint compatible OpenAI pour minimiser les dépenses.
Points clés
• Luna : 0,20 $ / 1,20 $ par million de jetons — rapide, économique, idéal pour les volumes élevés et les travaux sensibles à la latence.
• Terra : 2 $ / 12 $ — le niveau intermédiaire équilibré pour les tâches plus difficiles qui n'ont pas besoin du produit phare.
• Sol : 5 $ / 30 $ — le produit phare pour le raisonnement approfondi, le codage à grande échelle, les agents à long horizon.
• La mise en cache et le traitement par lots réduisent encore les coûts ; les entrées longues vous font passer à un palier de contexte long plus coûteux.
• ChatGPT (selon OpenAI, 6 août) : Luna devient l’option par défaut de free/Go avec des conversations textuelles illimitées ; Sol bénéficie d’une mise à jour de fiabilité pour Plus/Pro.
• Principal levier d'économies : router selon la difficulté — ne payez pas les tarifs de Sol pour un travail que Luna peut faire.
Le nouveau prix de base du GPT-5.6
Voici les prix de base après réduction par million de jetons d’entrée/sortie : Luna 0,20 $ / 1,20 $ (en baisse par rapport à 1 $ / 6 $), Terra 2 $ / 12 $ (en baisse par rapport à 2,50 $ / 15 $) et Sol 5 $ / 30 $ (inchangé). Les deux paliers les moins chers ont été réduits le 30 juillet 2026 ; le palier phare a tenu. En clair, les paliers inférieurs sont désormais tarifés pour passer à l’échelle, tandis que le palier phare reste premium.

Tarification par paliers, en cache et par lots
Le taux de base n'est que le point de départ. La tarification de GPT-5.6 comporte trois modificateurs qui modifient sensiblement votre coût effectif :
• Niveaux de contexte long. Les prix augmentent pour les entrées très longues. Sur les pages de transit d'OrcaRouter, Luna est à 0,20 $ / 1,20 $ jusqu'à un niveau de contexte large et à 0,40 $ / 1,80 $ au-delà ; Sol est à 5 $ / 30 $ à son niveau de base et à 10 $ / 45 $ au niveau le plus élevé. Le niveau est choisi en fonction du nombre de tokens d'entrée de chaque requête, donc quelques énormes prompts peuvent discrètement augmenter votre prix moyen.
• Mise en cache des invites. Le contexte réutilisé est facturé à un tarif fortement réduit — la lecture du cache de Luna coûte environ 0,02 $ par million de jetons (contre 0,20 $ pour du nouveau), avec des écritures de cache autour de 0,25 $ ; la lecture du cache de Sol est d’environ 0,50 $ (contre 5 $ pour du nouveau). Pour les agents et les chats avec un prompt système stable, la mise en cache est souvent la plus grosse économie.
• Batch. Les tâches non urgentes sont exécutées de manière asynchrone à tarif réduit — idéal pour la classification en masse, les évaluations et la génération hors ligne lorsque la latence n'a pas d'importance.
Exemples chiffrés : ce que cela coûte réellement
Des chiffres concrets rendent les paliers réels. Prenons 10 millions de jetons par mois avec une répartition 70 % entrée / 30 % sortie (un mélange typique chat/agent) :
• Luna : environ 5 $ par mois (environ 4,37 $ avec la mise en cache des invites).
• Terra : environ 50 $ par mois.
• Sol : environ 125 $ par mois (environ 109 $ avec la mise en cache).
C'est un écart de 25x entre Luna et Sol pour le même volume — c'est précisément pourquoi associer chaque requête au palier le moins cher adapté importe plus qu'un tarif unique. (Ces chiffres correspondent au calculateur de coûts sur la page d'OrcaRouter, qui estime à partir du prix catalogue ; vos chiffres réels dépendent de la mise en cache et de votre combinaison d'entrées/sorties.)
À quoi sert réellement chaque niveau
GPT-5.6 Luna — le cheval de trait du volume
Luna est le niveau rapide et rentable, conçu pour les charges de travail à grand volume et sensibles à la latence : chat, classification, extraction, routage et tâches agentiques légères, avec un temps avant premier jeton (p50) d’environ 1,65 seconde. Après la réduction de prix, à 0,20 $ / 1,20 $, il est positionné pour concurrencer directement les modèles ouverts bon marché — le choix par défaut pour la grande majorité des appels simples. C’est également le niveau vers lequel OpenAI oriente ChatGPT pour les consommateurs : selon son annonce du 6 août, GPT-5.6 Luna devient le modèle par défaut des comptes Free et Go, avec des discussions textuelles illimitées et un nouveau bouton Think pour un raisonnement plus approfondi sur les questions difficiles, qui arrivera la semaine suivante (les limites de fichiers, d’images et de voix demeurent). OpenAI affirme que Luna commet 62 % d’erreurs factuelles de moins que le GPT-5.5 Instant qu’elle remplace — un chiffre annoncé par le fournisseur, mais un signal clair que le niveau de volume est là où l’entreprise dirige l’essentiel de son trafic.
GPT-5.6 Terra — le juste milieu
Terra se situe entre le volume et le flagship : plus capable que Luna pour les raisonnements et le codage difficiles, mais bien moins cher que Sol. À 2 $ / 12 $, c'est un choix par défaut judicieux lorsque Luna ne suffit pas tout à fait mais qu'on n'a pas besoin du flagship — extraction de complexité moyenne, rédaction et tâches multi-étapes qui fonctionnent encore à grande échelle.
GPT-5.6 Sol — le produit phare
Sol est conçu pour les tâches les plus difficiles : le raisonnement profond en plusieurs étapes, l'ingénierie logicielle à grande échelle et les flux de travail agentiques à long horizon, en restant cohérent sur un contexte d’environ 1,05 million de jetons et jusqu’à 128 000 en sortie. À 5 $ / 30 $ (de base), c’est un choix premium — réservez-le aux tâches qui en ont réellement besoin, comme le codage complexe multi-fichiers ou les longues exécutions d’agents. Le 6 août, OpenAI a également mis à jour GPT-5.6 Sol dans ChatGPT pour les utilisateurs Plus et Pro : la société affirme que la version de chat est plus fiable sur les faits — 68 % d’erreurs factuelles en moins, selon OpenAI — et donne des réponses plus ciblées, avec un nouveau curseur pour contrôler l’effort de raisonnement appliqué. La mise à jour concerne uniquement le chat (le Sol qui alimente Work et Codex est inchangé), et le niveau API reste à 5 $ / 30 $.
La mise en garde concernant les jetons de raisonnement.
GPT-5.6 sont des modèles de raisonnement, donc le coût de sortie effectif peut dépasser une estimation naïve : lorsque le raisonnement est activé, les jetons de raisonnement internes sont facturés comme sortie. Sur des invites difficiles avec un effort de raisonnement élevé, cela peut dominer votre facture. Ajustez l’effort de raisonnement à la tâche (faible ou désactivé pour les appels simples), plafonnez les jetons de sortie lorsque vous le pouvez, et mesurez l’utilisation réelle. Des tarifs par jeton moins chers aident ; générer moins de jetons aide encore plus.
Comment chaque palier se compare à ses concurrents
La baisse des prix a repositionné GPT-5.6 par rapport à la concurrence. Selon les rapports, les tarifs de Luna à 0,20 $ / 1,20 $ sont désormais inférieurs à ceux de Claude Haiku 4.5 d’environ 5 fois en entrée et 4 fois en sortie, et ceux de Terra à 2 $ / 12 $ se situent sous le prix standard de Claude Sonnet 5 (annoncé à 3 $ / 15 $). Face aux modèles open weights, Luna se rapproche du plancher établi par la gamme V4 de DeepSeek et le GLM-5.2 de Zhipu (environ 1,20 $ / 4,10 $), avec les paliers Qwen et Gemini Flash non loin. En résumé : pour les tâches sensibles aux coûts, Luna est désormais compétitive avec les modèles capables les moins chers, plutôt qu’une alternative premium à ceux-ci — tandis que Sol demeure un véritable palier premium pour des capacités qu’on ne peut pas obtenir à bas prix.
Le véritable levier d'économies : router selon la difficulté
La facture la moins chère ne s'obtient pas avec un palier unique — il faut associer chaque requête au modèle le moins cher capable de la traiter. En pratique : envoyez les appels simples et à fort volume vers Luna (ou un modèle ouvert bon marché), passez à Terra pour les tâches plus difficiles, et réservez Sol à la minorité vraiment difficile. Combinée à la mise en cache et au traitement par lots, cette approche réduit systématiquement les coûts bien plus que n'importe quel changement de prix unique. Le hic est d'ordre opérationnel : vous ne voulez pas avoir à intégrer séparément trois paliers OpenAI et des alternatives de modèles ouverts.
Accédez aux trois (et aux concurrents moins chers) via un seul point de terminaison
C'est là qu'un routeur neutre vis-à-vis des fournisseurs est utile. OrcaRouter expose GPT-5.6 Luna, Terra et Sol — aux mêmes prix post-réduction, avec 0% de marge — via un seul endpoint compatible OpenAI, aux côtés de modèles ouverts moins chers comme DeepSeek V4 Pro, GLM-5.2 et Qwen. Changer de niveau (ou tester A/B Luna contre un modèle ouvert) est une modification de configuration, pas une réintégration, et vous pouvez router chaque requête vers ce qui est le moins cher.

La grille tarifaire Luna après réduction est visible sur la page du modèle OrcaRouter au prix catalogue — 0,20 $ / 1,20 $ par million de jetons — car le routeur répercute les prix des fournisseurs avec une marge de 0 %, avec un calculateur de coûts sur la page pour une facture mensuelle typique. Il existe également un palier gratuit et une page Offres pour des économies supplémentaires.

FAQ
Quels sont les prix de GPT-5.6 après la réduction ?
Luna $0.20 / $1.20, Terra $2 / $12, et Sol $5 / $30 par million de jetons d’entrée/sortie. Luna et Terra ont été réduits le 30 juillet 2026 ; Sol est inchangé.
Quel niveau de GPT-5.6 devrais-je utiliser ?
Luna pour les travaux à volume élevé et sensibles à la latence ; Terra pour les tâches plus difficiles qui n'ont pas besoin du produit phare ; Sol pour le raisonnement le plus difficile et le codage agentique. Acheminez par difficulté pour minimiser les coûts.
Est-ce que GPT-5.6 Luna est gratuit dans ChatGPT ?
OpenAI a annoncé le 6 août que GPT-5.6 Luna deviendra le modèle par défaut pour les comptes ChatGPT gratuits et Go, avec des discussions textuelles illimitées ; des limites subsistent pour les téléversements de fichiers, les images et les outils vocaux, et un bouton Think pour un raisonnement plus avancé est déployé séparément. Ce sont des plans annoncés par OpenAI, non vérifiés de manière indépendante.
Combien coûte GPT-5.6 par mois ?
À 10 millions de tokens par mois (70 % de tokens d'entrée) : environ 5 $ sur Luna, 50 $ sur Terra et 125 $ sur Sol — soit un écart de 25 fois, avant mise en cache. Votre coût réel dépend de la mise en cache et de votre répartition entrées/sorties.
Les trois niveaux ont-ils la même fenêtre de contexte ?
Oui — environ un contexte de 1.05M tokens et jusqu'à 128K tokens de sortie, avec prise en charge de la vision, des outils, du JSON et du raisonnement.
Comment la mise en cache des prompts affecte-t-elle les coûts ?
La mise en cache réduit considérablement le coût des contextes répétés — la lecture du cache de Luna coûte environ 0,02 $ par million de jetons contre 0,20 $ pour un contexte frais — donc réutilisez autant que possible les prompts mis en cache. À l'inverse, les entrées longues peuvent vous faire passer à un palier long-contexte plus coûteux.
Comment les niveaux se comparent-ils à ceux d'Anthropic ou aux modèles ouverts ?
Selon les rapports, Luna sous-cote Claude Haiku 4.5 (~5x en entrée / 4x en sortie) et Terra se situe en dessous de Claude Sonnet 5 ($3 / $15). Luna est également proche du plancher des modèles ouverts bon marché (DeepSeek, GLM-5.2 ~$1.20/$4.10).
Où puis-je utiliser les trois niveaux ensemble ?
Via l'endpoint unique compatible OpenAI d'OrcaRouter avec une majoration de 0%, aux côtés de modèles ouverts moins chers pour un routage basé sur la difficulté.
En résumé
Après la coupe, GPT-5.6 Luna (0,20 $ / 1,20 $) et Terra (2 $ / 12 $) sont intéressants pour les volumes élevés et les tâches intermédiaires, tandis que Sol (5 $ / 30 $) reste le fleuron premium — un écart de coût de 25x qui récompense un routage intelligent. Le déploiement grand public renforce la scission : OpenAI fait de Luna le modèle gratuit par défaut tout en réservant la mise à jour de fiabilité de Sol aux offres payantes, ce qui, pour les développeurs d’API, est une raison de plus de router le trafic facile vers Luna. Les plus grosses économies viennent du routage par difficulté, de l’utilisation du cache et du traitement par lots, et du contrôle des jetons de raisonnement plutôt que de se limiter à un seul niveau d’offre. Pour cela, le plus simple est de passer par un point de terminaison unique sans marge comme OrcaRouter, où les trois niveaux (aux nouveaux tarifs) côtoient les modèles ouverts moins chers auxquels vous voudrez les comparer.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
