Tarifs de GPT-5.6 après la baisse : Luna vs Terra vs Sol, et quel niveau utiliser
Guides & Insights

Tarifs de GPT-5.6 après la baisse : Luna vs Terra vs Sol, et quel niveau utiliser

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Après la baisse de prix d'O​penAI du 30 juillet 2026, la famille GP​T-5.​6 — GPT-5.6 Luna, GPT-5.6 Terra et GPT-5.6 Sol — n'a jamais été aussi abordable à exécuter à grande échelle. Une semaine plus tard, le 6 août, O​penAI a intégré les mêmes paliers dans ChatGPT lui-même : GPT-5.6 Luna devient le modèle par défaut pour les comptes gratuits et Go avec des discussions texte illimitées, tandis que GPT-5.6 Sol a été mis à jour pour Plus et Pro. Le 19 août, O​penAI et Replit ont annoncé que le nouveau mode gratuit de Replit pour les abonnés Core et Pro fonctionne avec GPT-5.6 Luna — le plus grand pari tiers à ce jour sur le palier de volume. Et fin août, O​penAI a commencé à déployer un filet de sécurité pour les utilisateurs grand public très actifs : un quota « Luna Reserve » qui offre à certains comptes ChatGPT Plus et Pro une utilisation limitée de GPT-5.6 Luna dans Codex et ChatGPT Work une fois leurs limites d'utilisation habituelles épuisées. Mais les trois paliers sont tarifés très différemment, et choisir le bon (ainsi qu'utiliser judicieusement la mise en cache, le traitement par lots et le routage) est le levier le plus important sur votre facture API. Ce guide présente l'intégralité de la tarification après la baisse, des exemples de coûts concrets, la comparaison de chaque palier à ses concurrents, et comment router entre eux via un seul point de terminaison.

Les prix sont exprimés par million de jetons (entrée / sortie), reflétant la grille tarifaire après réduction telle que rapportée ainsi que les pages de modèles en transparence d'OrcaRouter ; les tarifs par paliers et de cache proviennent des pages de modèles d'OrcaRouter, et les chiffres des concurrents sont attribués. Les détails du déploiement de ChatGPT dans cet article sont tels qu'OpenAI les a annoncés le 6 août 2026, et les détails du mode gratuit de Replit sont tels qu'OpenAI et Replit les ont annoncés le 19 août 2026 — déclarations du fournisseur, non mesurées de manière indépendante. Les détails de Luna Reserve sont tels qu'OpenAI les documente dans son centre d'aide et tels que le personnel d'OpenAI et les premiers utilisateurs les ont rapportés fin août 2026 — déclarations du fournisseur et de la communauté, non vérifiées de manière indépendante. Les prix changent — vérifiez avant de développer.

TL;DR

GPT-5.6 Luna (0,20 $ / 1,20 $) est le cheval de bataille des gros volumes ; Terra (2 $ / 12 $) est le modèle intermédiaire équilibré ; Sol (5 $ / 30 $) est le modèle phare pour les raisonnements les plus difficiles et le codage agentique. Les trois partagent un contexte d’environ 1,05 M de jetons et une sortie maximale de 128 K. La mise en cache des prompts et l’option par lots réduisent encore les coûts, tandis que les entrées très longues vous font passer à un palier supérieur. Côté grand public, O​penAI a annoncé le 6 août que GPT-5.6 Luna devient le modèle par défaut des comptes ChatGPT gratuits et Go avec des conversations textuelles illimitées, et qu’une version mise à jour de GPT-5.6 Sol est déployée pour Plus et Pro. Le 19 août, Replit a lancé le mode gratuit sur GPT-5.6 Luna pour les abonnés Core et Pro, en routant les tâches plus difficiles vers GPT-5.6 Sol si nécessaire. Fin août, O​penAI a également commencé à déployer un mécanisme de repli « Luna Reserve » qui offre à certains comptes ChatGPT Plus et Pro une utilisation limitée de GPT-5.6 Luna dans Codex et ChatGPT Work après épuisement de leurs limites habituelles — documenté par O​penAI, avec le déploiement sur des comptes sélectionnés rapporté par les utilisateurs. Utilisez Luna pour la majorité des tâches faciles, Terra quand vous avez besoin de plus, et Sol uniquement là où il justifie son coût — et routez selon la difficulté via un point de terminaison compatible O​penAI pour minimiser les dépenses.

Points clés

• Luna : 0,20 $ / 1,20 $ par million de jetons — rapide, économique, idéal pour les volumes élevés et les travaux sensibles à la latence.

• Terra : 2 $ / 12 $ — le niveau intermédiaire équilibré pour les tâches plus difficiles qui n'ont pas besoin du produit phare.

• Sol : 5 $ / 30 $ — le produit phare pour le raisonnement approfondi, le codage à grande échelle, les agents à long horizon.

• La mise en cache et le traitement par lots réduisent encore les coûts ; les entrées longues vous font passer à un palier de contexte long plus coûteux.

• ChatGPT (selon OpenAI, 6 août) : Luna devient l’option par défaut de free/Go avec des conversations textuelles illimitées ; Sol bénéficie d’une mise à jour de fiabilité pour Plus/Pro.

• Replit (annoncé le 19 août) : le mode gratuit pour Core/Pro fonctionne sur GPT-5.6 Luna — jusqu'à 30 fois plus d'utilisation par Replit, les tâches plus difficiles étant acheminées jusqu'à GPT-5.6 Sol. Déclaration de Replit, non vérifiée indépendamment.

• Réserve Luna (fin août, documenté par OpenAI) : une allocation de repli plafonnée qui permet à certains comptes ChatGPT Plus et Pro de continuer à utiliser GPT-5.6 Luna dans Codex et ChatGPT Work après épuisement des limites habituelles — pas illimitée, et non disponible dans les espaces de travail Business ou Enterprise.

• Principal levier d'économies : router selon la difficulté — ne payez pas les tarifs de Sol pour un travail que Luna peut faire.

Le nouveau tarif de base du GP​T-5.​6

Voici les prix de base après réduction par million de jetons d’entrée/sortie : Luna 0,20 $ / 1,20 $ (en baisse par rapport à 1 $ / 6 $), Terra 2 $ / 12 $ (en baisse par rapport à 2,50 $ / 15 $) et Sol 5 $ / 30 $ (inchangé). Les deux paliers les moins chers ont été réduits le 30 juillet 2026 ; le palier phare a tenu. En clair, les paliers inférieurs sont désormais tarifés pour passer à l’échelle, tandis que le palier phare reste premium.

Tarification par paliers, en cache et par lots

Le taux de base n'est que le point de départ. La tarification de GP​T-5.​6 comporte trois modificateurs qui changent sensiblement votre coût effectif :

• Niveaux de contexte long. Les prix augmentent pour les entrées très longues. Sur les pages de transit d'OrcaRouter, Luna est à 0,20 $ / 1,20 $ jusqu'à un niveau de contexte large et à 0,40 $ / 1,80 $ au-delà ; Sol est à 5 $ / 30 $ à son niveau de base et à 10 $ / 45 $ au niveau le plus élevé. Le niveau est choisi en fonction du nombre de tokens d'entrée de chaque requête, donc quelques énormes prompts peuvent discrètement augmenter votre prix moyen.

• Mise en cache des invites. Le contexte réutilisé est facturé à un tarif fortement réduit — la lecture du cache de Luna coûte environ 0,02 $ par million de jetons (contre 0,20 $ pour du nouveau), avec des écritures de cache autour de 0,25 $ ; la lecture du cache de Sol est d’environ 0,50 $ (contre 5 $ pour du nouveau). Pour les agents et les chats avec un prompt système stable, la mise en cache est souvent la plus grosse économie.

• Batch. Les tâches non urgentes sont exécutées de manière asynchrone à tarif réduit — idéal pour la classification en masse, les évaluations et la génération hors ligne lorsque la latence n'a pas d'importance.

Exemples chiffrés : ce que cela coûte réellement

Des chiffres concrets rendent les paliers réels. Prenons 10 millions de jetons par mois avec une répartition 70 % entrée / 30 % sortie (un mélange typique chat/agent) :

• Luna : environ 5 $ par mois (environ 4,37 $ avec la mise en cache des invites).

• Terra : environ 50 $ par mois.

• Sol : environ 125 $ par mois (environ 109 $ avec la mise en cache).

C'est un écart de 25x entre Luna et Sol pour le même volume — c'est précisément pourquoi associer chaque requête au palier le moins cher adapté importe plus qu'un tarif unique. (Ces chiffres correspondent au calculateur de coûts sur la page d'OrcaRouter, qui estime à partir du prix catalogue ; vos chiffres réels dépendent de la mise en cache et de votre combinaison d'entrées/sorties.)

À quoi sert réellement chaque niveau

GPT-5.6 Luna — le cheval de trait du volume

Luna est le niveau rapide et rentable, conçu pour les charges de travail à grand volume et sensibles à la latence : chat, classification, extraction, routage et tâches agentiques légères, avec un temps avant premier jeton (p50) d’environ 1,65 seconde. Après la réduction de prix, à 0,20 $ / 1,20 $, il est positionné pour concurrencer directement les modèles ouverts bon marché — le choix par défaut pour la grande majorité des appels simples. C’est également le niveau vers lequel O​penAI oriente ChatGPT pour les consommateurs : selon son annonce du 6 août, GPT-5.6 Luna devient le modèle par défaut des comptes Free et Go, avec des discussions textuelles illimitées et un nouveau bouton Think pour un raisonnement plus approfondi sur les questions difficiles, qui arrivera la semaine suivante (les limites de fichiers, d’images et de voix demeurent). O​penAI affirme que Luna commet 62 % d’erreurs factuelles de moins que le GPT-5.5 Instant qu’elle remplace — un chiffre annoncé par le fournisseur, mais un signal clair que le niveau de volume est là où l’entreprise dirige l’essentiel de son trafic.

Le 19 août 2026, Replit a fait de GPT-5.6 Luna le moteur de son nouveau Free Mode — l'expérience par défaut pour les abonnés Core et Pro. Les discussions courantes, l'idéation et les tâches de codage simples tournent sur Luna sans consommer le budget de crédits IA payants de l'utilisateur ; Replit affirme que les utilisateurs Core peuvent désormais créer jusqu'à 30 fois plus par mois, avec notamment jusqu'à 30 heures de chat. Lorsqu'une tâche exige davantage de raisonnement, l'Agent de Replit route la requête vers un modèle plus grand pour cette partie — ses modes Power/Max ou GPT-5.6 Sol — puis revient à Luna. Ce sont des informations communiquées par Replit et OpenAI, non vérifiées indépendamment — mais la tendance correspond à la baisse de prix : une Luna 80 % moins chère est ce qui rend viable un niveau toujours actif et inclus par défaut.

Un autre rebondissement côté consommateurs est arrivé fin août 2026 : Luna Reserve. Comme le documente O​penAI dans son centre d’aide, certains comptes ChatGPT Plus et Pro peuvent bénéficier d’un pool limité d’utilisation de GPT-5.6 Luna dans Codex et ChatGPT Work en secours une fois leur allocation habituelle épuisée — un avertissement ou un indicateur de lune apparaît à la limite, et vous pouvez continuer à travailler sur Luna tant que la réserve dure. Ce n’est pas une extension illimitée : la réserve est distincte de l’allocation habituelle et elle-même plafonnée, elle ne sert jamais que GPT-5.6 Luna (jamais Terra ni Sol), elle n’est pas disponible dans les espaces de travail Business ou Enterprise, et atteindre une limite habituelle ne garantit pas l’accès. Le personnel d’O​penAI a confirmé l’existence de la réserve le 27 août, et les premiers retours d’utilisateurs la décrivent comme déployée sur certains comptes — selon le fournisseur et la communauté, non vérifié de manière indépendante. Certains premiers rapports communautaires notent également que la réserve utilise le côté allégé du navigateur de GPT-5.6 Luna, de sorte que les tâches d’inspection web en direct peuvent ne pas fonctionner pendant la réserve.

GPT-5.6 Terra — le juste milieu

Terra se situe entre le volume et le flagship : plus capable que Luna pour les raisonnements et le codage difficiles, mais bien moins cher que Sol. À 2 $ / 12 $, c'est un choix par défaut judicieux lorsque Luna ne suffit pas tout à fait mais qu'on n'a pas besoin du flagship — extraction de complexité moyenne, rédaction et tâches multi-étapes qui fonctionnent encore à grande échelle.

GPT-5.6 Sol — le produit phare

Sol est conçu pour les tâches les plus difficiles : le raisonnement profond en plusieurs étapes, l'ingénierie logicielle à grande échelle et les flux de travail agentiques à long horizon, en restant cohérent sur un contexte d’environ 1,05 million de jetons et jusqu’à 128 000 en sortie. À 5 $ / 30 $ (de base), c’est un choix premium — réservez-le aux tâches qui en ont réellement besoin, comme le codage complexe multi-fichiers ou les longues exécutions d’agents. Le 6 août, O​penAI a également mis à jour GPT-5.6 Sol dans ChatGPT pour les utilisateurs Plus et Pro : la société affirme que la version de chat est plus fiable sur les faits — 68 % d’erreurs factuelles en moins, selon O​penAI — et donne des réponses plus ciblées, avec un nouveau curseur pour contrôler l’effort de raisonnement appliqué. La mise à jour concerne uniquement le chat (le Sol qui alimente Work et Codex est inchangé), et le niveau API reste à 5 $ / 30 $.

La mise en garde concernant les jetons de raisonnement.

GP​T-5.​6 sont des modèles de raisonnement, donc le coût de sortie effectif peut dépasser une estimation naïve : lorsque le raisonnement est activé, les jetons de raisonnement internes sont facturés comme sortie. Sur les invites difficiles avec un effort de raisonnement élevé, cela peut dominer votre facture. Ajustez l'effort de raisonnement à la tâche (faible ou désactivé pour les appels simples), limitez les jetons de sortie lorsque vous le pouvez, et mesurez l'utilisation réelle. Des tarifs par jeton moins chers aident ; générer moins de jetons aide davantage.

Comment chaque palier se compare à ses concurrents

La réduction a repositionné GP​T-5.​6 par rapport au marché. Selon les rapports, les tarifs de Luna à $0.20 / $1.20 sont désormais inférieurs à ceux de Claude Haiku 4.5 d’environ 5x en entrée et 4x en sortie, et ceux de Terra à $2 / $12 se situent en dessous du prix standard de Claude Sonnet 5 (annoncé à $3 / $15). Face aux modèles open weight, Luna se situe près du plancher établi par la gamme V4 de Deep​Seek et GLM-5.2 de Zhi​pu (environ $1.20 / $4.10), avec les niveaux Qw​en et Gem​ini Flash à proximité. En résumé : pour les travaux sensibles aux coûts, Luna est désormais compétitive face aux modèles capables les moins chers, plutôt qu’une alternative premium à ceux-ci — tandis que Sol reste un véritable niveau premium pour des capacités que l’on ne peut pas obtenir à bas prix.

Le véritable levier d'économies : router selon la difficulté

La facture la moins chère ne s'obtient pas avec un palier unique — il faut associer chaque requête au modèle le moins cher capable de la traiter. En pratique : envoyez les appels simples et à fort volume vers Luna (ou un modèle ouvert bon marché), passez à Terra pour les tâches plus difficiles, et réservez Sol à la minorité vraiment difficile. Combinée à la mise en cache et au traitement par lots, cette approche réduit systématiquement les coûts bien plus que n'importe quel changement de prix unique. Le hic est d'ordre opérationnel : vous ne voulez pas avoir à intégrer séparément trois paliers OpenAI et des alternatives de modèles ouverts.

Accédez aux trois (et aux concurrents moins chers) via un seul point de terminaison

C’est là qu’un routeur neutre vis-à-vis des fournisseurs s’avère utile. OrcaRouter expose GPT-5.6 Luna, Terra et Sol — aux mêmes tarifs après réduction, avec 0 % de marge — via un point de terminaison compatible O​penAI, aux côtés de modèles ouverts moins chers comme DeepSeek V4 Pro, GLM-5.2 et Qw​en. Changer de niveau (ou tester en A/B Luna contre un modèle ouvert) est une modification de configuration, pas une réintégration, et vous pouvez router chaque requête vers l’option la moins chère. Luna Reserve est la version côté consommateur de cette même idée — un repli intégré qui maintient certains utilisateurs sur GPT-5.6 Luna après épuisement de leur quota habituel — et l’équivalent côté API est le basculement automatique, qu’OrcaRouter gère lorsqu’un fournisseur limite le débit ou renvoie une erreur sur une requête.

La grille tarifaire Luna après réduction est visible sur la page du modèle OrcaRouter au prix catalogue — 0,20 $ / 1,20 $ par million de jetons — car le routeur répercute les prix des fournisseurs avec une marge de 0 %, avec un calculateur de coûts sur la page pour une facture mensuelle typique. Il existe également un palier gratuit et une page Offres pour des économies supplémentaires.

FAQ

Quels sont les prix du GP​T-5.​6 après la baisse ?

Luna $0.20 / $1.20, Terra $2 / $12, et Sol $5 / $30 par million de jetons d’entrée/sortie. Luna et Terra ont été réduits le 30 juillet 2026 ; Sol est inchangé.

Quel niveau de GP​T-5.​6 devrais-je utiliser ?

Luna pour les travaux à volume élevé et sensibles à la latence ; Terra pour les tâches plus difficiles qui n'ont pas besoin du produit phare ; Sol pour le raisonnement le plus difficile et le codage agentique. Acheminez par difficulté pour minimiser les coûts.

Est-ce que GPT-5.6 Luna est gratuit dans ChatGPT ?

OpenAI a annoncé le 6 août que GPT-5.6 Luna deviendra le modèle par défaut pour les comptes ChatGPT gratuits et Go, avec des discussions textuelles illimitées ; des limites subsistent pour les téléversements de fichiers, les images et les outils vocaux, et un bouton Think pour un raisonnement plus avancé est déployé séparément. Ce sont des plans annoncés par OpenAI, non vérifiés de manière indépendante.

Pourquoi Replit utilise-t-il GPT-5.6 Luna pour le mode gratuit ?

Le mode gratuit de Replit, annoncé le 19 août 2026, exécute par défaut les discussions quotidiennes, l'idéation et le codage simple sur GPT-5.6 Luna pour les abonnés Core et Pro, en acheminant les tâches plus difficiles vers un modèle plus grand — ses modes Power/Max ou GPT-5.6 Sol — selon les besoins. Replit attribue la baisse de prix de l'API Luna du 30 juillet, d'environ 80 %, à la viabilité économique. Ce sont des plans annoncés par le fournisseur, non vérifiés indépendamment.

Qu'est-ce que Luna Reserve ?

Une allocation de secours qu'O​penAI documente pour Codex et ChatGPT Work : certains comptes ChatGPT Plus et Pro reçoivent un pool limité d'utilisation de GPT-5.6 Luna une fois leur limite d'utilisation habituelle épuisée, afin qu'ils continuent de fonctionner au lieu d'être coupés. Elle ne fournit que GPT-5.6 Luna — jamais Terra ni Sol — possède son propre plafond, est distincte de l'utilisation régulière et n'est pas disponible dans les espaces de travail Business ou Enterprise. L'existence est déclarée par O​penAI (le personnel l'a confirmée le 27 août) ; le déploiement sur des comptes sélectionnés est rapporté par la communauté, non vérifié indépendamment.

Combien coûte GP​T-5.​6 par mois ?

À 10 millions de tokens par mois (70 % de tokens d'entrée) : environ 5 $ sur Luna, 50 $ sur Terra et 125 $ sur Sol — soit un écart de 25 fois, avant mise en cache. Votre coût réel dépend de la mise en cache et de votre répartition entrées/sorties.

Les trois niveaux ont-ils la même fenêtre de contexte ?

Oui — environ un contexte de 1.05M tokens et jusqu'à 128K tokens de sortie, avec prise en charge de la vision, des outils, du JSON et du raisonnement.

Comment la mise en cache des prompts affecte-t-elle les coûts ?

La mise en cache réduit considérablement le coût des contextes répétés — la lecture du cache de Luna coûte environ 0,02 $ par million de jetons contre 0,20 $ pour un contexte frais — donc réutilisez autant que possible les prompts mis en cache. À l'inverse, les entrées longues peuvent vous faire passer à un palier long-contexte plus coûteux.

Comment les niveaux se comparent-ils à ceux d'Anthropic ou aux modèles ouverts ?

Selon les rapports, Luna sous-cote Claude Haiku 4.5 (~5x en entrée / 4x en sortie) et Terra se situe en dessous de Claude Sonnet 5 ($3 / $15). Luna est également proche du plancher des modèles ouverts bon marché (Deep​Seek, GLM-5.2 ~$1.20/$4.10).

Où puis-je utiliser les trois niveaux ensemble ?

Via l'endpoint unique compatible OpenAI d'OrcaRouter avec une majoration de 0%, aux côtés de modèles ouverts moins chers pour un routage basé sur la difficulté.

En résumé

Après la baisse des prix, GPT-5.6 Luna (0,20 $ / 1,20 $) et Terra (2 $ / 12 $) sont intéressants pour les charges de travail à fort volume et de niveau intermédiaire, tandis que Sol (5 $ / 30 $) demeure le fleuron premium — un écart de coût de 25x qui récompense un routage intelligent. Le déploiement grand public renforce la distinction : O​penAI fait de Luna le choix gratuit par défaut tout en réservant la mise à jour de fiabilité de Sol aux formules payantes, et le mode gratuit du 19 août de Replit — construit sur GPT-5.6 Luna, avec les tâches plus difficiles routées vers GPT-5.6 Sol — montre que les produits à fort trafic se positionnent sur le même palier. La solution de repli Luna Reserve de fin août prolonge ce schéma en maintenant certains utilisateurs Plus et Pro sur GPT-5.6 Luna même après l'épuisement de leurs limites habituelles. Pour les développeurs d'API, c'est une raison de plus de router le trafic simple vers Luna. Les plus grosses économies proviennent d'un routage selon la difficulté, en s'appuyant sur la mise en cache et le traitement par lots, et en contrôlant les jetons de raisonnement plutôt que d'opter par défaut pour un seul palier. Le plus simple est de passer par un endpoint unique sans marge comme OrcaRouter, où les trois paliers (aux nouveaux prix) côtoient les modèles ouverts moins chers auxquels vous voudrez les comparer.