
GPT-6 Luna et GPT-6 Sol : l'offre économique qu'OpenAI n'a pas encore lancée
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Il n'y a qu'un seul artefact concret et vérifiable dans cette histoire, et ce n'est aucun des deux noms figurant dans le titre. Le 21 septembre, des développeurs ont signalé avoir vu la chaîne GPT-6 Sol medium dans des enregistrements de fusion de code de NVIDIA — le dépôt d'un tiers, pas celui du fournisseur. Autour de ce seul artefact s'est assemblée une rumeur bien plus vaste : qu'OpenAI se prépare à lancer GPT-6 Sol comme cheval de labour de milieu de gamme et GPT-6 Luna comme son échelon bon marché, en dessous du vaisseau amiral GPT-6 Astra qu'OpenAI a effectivement mis en service le 3 septembre 2026. Ni GPT-6 Sol ni GPT-6 Luna n'a d'identifiant de modèle, de prix, de fenêtre de contexte, de fiche système ou de ligne dans la documentation propre d'OpenAI. L'échelon qu'ils occuperaient a pourtant déjà un occupant actif en la personne de GPT-5.6 Luna — le membre économique de la famille GPT-5.6, en vente depuis le 9 juillet 2026 à 0,20 $ par million de jetons d'entrée et 1,20 $ par million de jetons de sortie. Cette asymétrie est toute l'histoire, et c'est la raison pour laquelle cet article mérite d'être lu plutôt que simplement d'être accueilli avec prudence.
Qu’est-ce qui est réellement documenté, et qu’est-ce qui relève de l’inférence ?
Commencez par l’artefact, car c’est la seule chose ici qu’un lecteur peut aller consulter. Le registre de fusion NVIDIA est réel au sens où les personnes qui l’ont signalé lisaient un dépôt public, et la modification de code décrite est banale : un commit écrit avec l’aide de GPT-6 Astra, puis relu par quelque chose étiqueté GPT-6 Sol. L’article de 新智元 qui a porté cette découverte auprès d’un public plus large la présentait comme un exemple fonctionnel d’une « matrice de travailleurs IA » — une chaîne où un modèle écrit et un autre relit. Considérez ce cadrage comme un commentaire. Le registre de fusion lui-même vous dit que quelqu’un, à l’intérieur de l’infrastructure d’un tiers, se prépare à servir un modèle sous ce nom. Il ne vous dit pas qu’OpenAI en a livré un, et il ne dit rien du tout à propos de Luna.
Le reste des arguments en faveur d’un lancement de GPT-6 Sol est plus mince que la couverture médiatique qui l’entoure ne le suggère. La presse technologique chinoise a rapporté un prix divulgué de 2,50 $ par million de jetons d’entrée et de 15 $ par million de jetons de sortie — soit environ la moitié de ce que coûte GPT-5.6 Sol —, en parallèle d’affirmations selon lesquelles la prise en charge était en cours d’intégration dans l’API OpenAI, Codex OAuth, l’entrée d’images et la gestion de contextes longs, et d’un lancement annoncé pour le mardi 22 septembre. Une partie de ces informations faisait état de 3 h du matin, mardi. Au moment de la rédaction, il n’y a aucune annonce d’OpenAI, aucune chaîne d’identifiant, aucune entrée sur la page des tarifs et aucun repérage dans le sélecteur de modèles pour GPT-6 Sol ou GPT-6 Luna. Un média couvrant la même chaîne de rumeurs a noté que ses propres chiffres de prix ne concordaient pas entre eux, citant 2,50 $/15 $, 4 $/30 $ et d’autres nombres en circulation — ce à quoi ressemble une rumeur après avoir passé par quatre traductions, pas à quoi ressemble une grille tarifaire.
GPT-6 Luna est encore plus faible, et il faut être franc à ce sujet. La présence de Luna dans cette histoire remonte à un seul post du 6 septembre, dans lequel le compte X @kimmonismus écrivait qu’OpenAI « préparait déjà la sortie de GPT-6 Sol », puis déduisait du schéma de nommage de GPT-5.6 que « Sol, Terra et Luna restent encore à venir ». C’est un argument fondé sur la symétrie des noms. Luna n’a jamais fait l’objet d’une affirmation qui lui soit propre — aucune fuite, aucune capture d’écran, aucune chaîne de modèle, aucun prix. Elle n’apparaît dans les récapitulatifs ultérieurs que parce qu’elle figurait dans le premier post.
Trois dates, et ce que chacune a prouvé
Les chronologies de fuites valent la peine d'être lues comme une grille d'évaluation, car celle-ci en a déjà une.
• 6 septembre — la revendication de la famille. Inférence de la communauté à partir du précédent GPT‑5.6, aucun artefact joint. Non vérifiée alors, non vérifiée aujourd'hui.
• 15–16 septembre — Sam Altman a publié qu’OpenAI avait une « grosse livraison cette semaine, puis pour le DevDay, livraison x 6 », avant de faire marche arrière sur la première moitié le lendemain soir, en disant que ce qu’il était le plus impatient de lancer arriverait plutôt la semaine suivante et vaudrait « la peine d’attendre ». Il n’a nommé aucun produit dans l’un ou l’autre de ces posts. C’est le seul élément énoncé par un dirigeant dans toute cette histoire, et il ne concerne que le calendrier, rien d’autre.
• 21 septembre — l'enregistrement de merge NVIDIA, et le premier artefact de la chaîne. Un enregistrement de merge dans le dépôt de quelqu'un d'autre est un signal concret qu'un modèle est en cours de préparation pour être servi. Ce n'est pas une sortie.
• mardi 22 septembre — aujourd'hui, et la date que la rumeur elle-même a citée. Au moment où nous écrivons, il n'existe aucune annonce d'OpenAI, aucun identifiant de modèle, aucune entrée dans la grille tarifaire ni aucune apparition de GPT-6 Sol dans un sélecteur de modèles, et absolument rien de tel pour GPT-6 Luna.
Le prochain jalon daté est le DevDay, le mardi 29 septembre au Fort Mason Center — le « ship x 6 » auquel Altman a fait référence, et la date de repli que les reportages chinois indiquaient si le lancement du mardi n'avait pas lieu. Si un modèle de milieu de gamme ou d'entrée de gamme de sixième génération est réel, c'est là qu'il est le plus plausible qu'il fasse surface, et une seule ligne dans la propre liste de modèles d'OpenAI suffirait à trancher tout ce que cet article doit présenter avec prudence.
Le palier existe déjà, et il est bon marché.
Voici la partie de l'histoire qui est entièrement vérifiable, et c'est la raison pour laquelle un « GPT-6 Luna » est une chose étrange à attendre. GPT-5.6 Luna est en ligne, et il est bon marché, ce que les modèles de pointe ne sont pas.
• Prix — 0,20 $ par million de jetons d'entrée et 1,20 $ par million de jetons de sortie, selon la documentation API d'OpenAI elle-même. Lancé le 9 juillet 2026 à 1,00 $ / 6,00 $, son tarif a été réduit d'environ 80 % fin juillet.
• Tarifs pour les entrées en cache et le contexte long — les lectures d'entrées mises en cache bénéficient d'une remise d'environ 90 % ; les requêtes dépassant le seuil de contexte long sont facturées environ 0,40 $ / 1,80 $ pour la requête entière.
• Contexte et sortie — une fenêtre de contexte de 1 M de tokens avec une sortie maximale de 128 K. Le temps médian jusqu’au premier token est indiqué à 1,83 seconde.
• Rôle — OpenAI a remplacé GPT-5.5 Instant par GPT-5.6 Luna comme modèle par défaut pour ChatGPT Free et Go les 6 et 7 août 2026, en ajoutant la semaine suivante un bouton « Think » pour un raisonnement plus approfondi.
• Effet de la réduction — le 9 septembre, la directrice financière d'OpenAI, Sarah Friar, a déclaré lors de la conférence Communacopia de Goldman Sachs que la réduction des prix avait entraîné une multiplication par dix environ de l'utilisation, et a soutenu que déployer Luna est moins cher que de faire tourner GLM 5.3 de Z.ai sur une couche cloud. Les deux sont des chiffres de fournisseur présentés par un dirigeant lors d'un événement d'investisseurs : à rapporter, mais à ne pas considérer comme vérifiés de manière indépendante.

Mettez les deux points de prix côte à côte et la question des paliers trouve sa réponse d'elle-même. Le prix rapporté de GPT-6 Sol, 2,50 $ / 15 $, est plus de douze fois le tarif des entrées de GPT-5.6 Luna. Une Luna de sixième génération ne rivaliserait pas avec Sol — elle rivaliserait avec le modèle qu'OpenAI distribue déjà gratuitement comme modèle par défaut de son palier gratuit.
Pourquoi un palier GPT-6 bon marché reste quand même plausible
Un véritable argument commercial se cache sous la rumeur, et il porte sur l’endroit où se trouvent les tokens plutôt que sur celui où se trouve le classement. GPT-6 Astra coûte 10 $ par million de tokens d’entrée et 50 $ par million de tokens de sortie, les requêtes à long contexte étant facturées à un palier supérieur. Il affiche une fenêtre de contexte de 1 M de tokens — la même catégorie que la génération 5.6, à un tarif bien plus élevé. Sur Artificial Analysis, la configuration de raisonnement maximal d’Astra obtient 53 sur l’Intelligence Index du tracker, pour environ 3,26 $ par tâche, ce qui est un prix défendable pour le travail de pointe et indéfendable pour la classification, l’extraction, le routage ou les boucles d’agents à haut volume.
Cet écart est exactement la configuration qui a produit Sol, Terra et Luna dans la génération 5.6, et c’est pourquoi les analyses continuent de pointer vers un Sol de milieu de gamme plutôt que vers un second modèle phare. Le comportement tarifaire d’OpenAI lui-même va dans ce sens : sa réponse à la pression sur les coûts en juillet a été de réduire de 80 % le tarif de l’offre bon marché plutôt que de la remplacer, et son directeur financier est monté sur scène en septembre pour débattre des prix face aux modèles chinois à poids ouverts. Une entreprise qui défend le bas du marché est une entreprise qui entend continuer à proposer des produits dans le bas de gamme.
Le contre-argument est tout aussi réel, et c'est pourquoi la logique même de la fuite est plus faible qu'elle n'en a l'air. Commercialiser un modèle d'entrée de gamme de la série 6 signifie demander à chaque équipe qui a déjà ajusté ses prompts, sa mise en cache et ses harnais d'évaluation autour de GPT-5.6 Luna de tout requalifier pour un gain marginal. C'est une raison bien réelle pour laquelle un GPT-6 Luna pourrait ne jamais être annoncé — non pas parce que la rumeur est fausse, mais parce que la décision produit qu'elle suppose n'a peut-être pas été prise.

Comment se préparer sans parier sur un modèle qui n’existe pas
Vous ne pouvez pas appeler GPT-6 Sol ni GPT-6 Luna. Personne ne le peut, et aucune plateforme ne les héberge — tout ce qui a été rapporté, c'est qu'un développeur a vu une chaîne de modèle GPT-6 Sol renvoyée là où une requête GPT-5.6 Sol était attendue, ce qui relève d'une curiosité de routage plutôt que d'une disponibilité. Ce que vous pouvez faire, c'est rendre l'arrivée éventuelle peu coûteuse à adopter et coûteuse à découvrir par surprise.
La version pratique consiste à garder le nom du modèle hors de votre code applicatif. Si votre stack appelle un modèle via une chaîne codée en dur, adopter un modèle intermédiaire de sixième génération implique un déploiement, une nouvelle passe de qualification des prompts et une nouvelle campagne d'évaluation. Si elle appelle une route, cela revient à modifier une seule ligne. OrcaRouter expose plus de 200 modèles derrière une API unique, avec 0 % de marge — le prix catalogue du fournisseur est répercuté tel quel, donc quand un fournisseur baisse un prix, le chiffre de notre côté évolue le jour même, et c'est ainsi que la réduction de 80 % de GPT-5.6 Luna est apparue ici sans que personne n'ait à renégocier quoi que ce soit. Le basculement automatique fait le reste : pointez une route vers le palier le moins cher qui satisfait votre seuil d'évaluation, et un modèle non commercialisé reste hors du chemin tant qu'il n'existe pas et n'a pas passé l'évaluation.

C'est là l'usage honnête d'une fuite comme celle-ci : non pas planifier une migration vers un modèle qui n'a pas été annoncé, mais repérer quelle place dans votre stack un nouveau modèle de gamme intermédiaire viendrait occuper, et veiller à ce que la combler plus tard relève d'un changement de configuration plutôt que d'un projet.
Qu’est-ce qui compterait comme preuve ?
La distinction entre une fuite qui mérite d’être suivie et une fuite qui mérite d’être ignorée tient à la question de savoir si l’artefact a été produit par le fournisseur ou par un tiers neutre. Appliqué ici :
• Compte — un identifiant de modèle dans la documentation de l'API d'OpenAI, une fiche système, une entrée sur la page de tarification d'OpenAI, une apparition dans le sélecteur de modèles de ChatGPT, une première exécution de benchmark indépendante sur un outil de suivi comme Artificial Analysis, ou une fiche dans un catalogue de routage avec un véritable point de terminaison derrière.
• Ne compte pas — un enregistrement de fusion dans le dépôt de quelqu'un d'autre à lui seul, une liste de rumeurs non attribuée dans un récapitulatif, une capture d'écran divulguée d'un prix que trois médias rapportent de trois façons différentes, l'observation d'un développeur anonyme, ou une probabilité issue d'un marché de prédiction. À la fin du mois de juillet, les marchés de prédiction cotaient à environ 77–78 % la probabilité d'une sortie de GPT-6 d'ici le 30 septembre. C'est l'opinion d'un marché sur une date, pas une preuve concernant un modèle, et elle a été cotée avant la sortie d'Astra.
Jusqu’à ce que l’un des premiers de la liste se concrétise, la position exacte sur les deux noms est étroite et peu glamour. GPT-6 Sol est une chaîne dans un enregistrement de fusion NVIDIA et un prix sur lequel personne ne parvient à s’accorder. GPT-6 Luna est un nom qui apparaît dans une rumeur de gamme, dans une liste que personne n’a revendiquée, occupant un palier que GPT-5.6 Luna remplit déjà à 0,20 $ en entrée et 1,20 $ en sortie. Il n’y a rien vers quoi migrer, rien à évaluer, et rien à tarifer. La seule chose qui vaut la peine d’être faite aujourd’hui est de s’assurer que, lorsqu’il y en aura, votre routage n’aura pas besoin d’être réécrit pour l’atteindre.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
