Una hero title card per un articolo di leak watch sui rumor su GPT-6 Luna e GPT-6 Sol, che mostra in alto a sinistra un badge ambra 'NON VERIFICATO · LEAK WATCH', l'occhiello 'RAPPORTO FUGHE', il titolo 'GPT-6 Luna e GPT-6 Sol' sopra la riga 'due nomi, nessun modello', il sottotitolo 'Nessuno dei due ha un ID modello, un prezzo, una data o una dichiarazione di OpenAI', tre chip con scritto 'GPT-6 Astra rilasciato il 3 set 2026', 'Record di merge NVIDIA: GPT-6 Sol medium' e 'GPT-5.6 Luna attivo a $0,20 / $1,20', e in basso una card piena 'GPT-5.6 Luna — rilasciato, $0,20 / $1,20 per MTok' collegata da una freccia sottile a due card tratteggiate 'GPT-6 Sol ? — non annunciato' e 'GPT-6 Luna ? — non annunciato'. Il logo OrcaRouter è inserito in composizione nell'angolo in basso a destra.
Guides & Insights

GPT-6 Luna e GPT-6 Sol: la fascia economica che OpenAI non ha ancora rilasciato

Autore

Magnus Corvin

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

C'è un solo artefatto concreto e verificabile in questa storia, e non è nessuno dei due nomi nel titolo. Il 21 settembre, alcuni sviluppatori hanno riferito di aver visto la stringa GPT-6 Sol medium all'interno dei record di merge del codice di NVIDIA — il repository di una terza parte, non quello del fornitore. Attorno a quell'unico artefatto si è assembrata una voce molto più grande: che OpenAI stia preparando il lancio di GPT-6 Sol come cavallo di battaglia di fascia media e di GPT-6 Luna come la sua fascia economica, al di sotto del modello di punta GPT-6 Astra che OpenAI ha effettivamente rilasciato il 3 settembre 2026. Né GPT-6 Sol né GPT-6 Luna hanno un identificatore di modello, un prezzo, una finestra di contesto, una scheda di sistema o una riga nella documentazione di OpenAI. La fascia che occuperebbero, però, ha già un occupante attivo in GPT-5.6 Luna — il membro economico della famiglia GPT-5.6, in vendita dal 9 luglio 2026 a $0,20 per milione di token in input e $1,20 per milione in output. Questa asimmetria è tutta la storia, ed è il motivo per cui vale la pena leggere questo pezzo anziché limitarsi a prenderne le distanze.

Che cosa è effettivamente documentato e che cosa è inferenza

Inizia dall'artefatto, perché è l'unica cosa qui che un lettore può andare a vedere. Il record di merge di NVIDIA è reale nel senso che le persone che lo riportavano stavano leggendo un repository pubblico, e la modifica al codice descritta è banale: un commit scritto con l'assistenza di GPT-6 Astra e poi revisionato da qualcosa etichettato GPT-6 Sol. L'articolo di 新智元 che ha portato la scoperta a un pubblico più ampio lo ha presentato come esempio funzionante di una "matrice di lavoratori AI" — una catena in cui un modello scrive e un altro revisiona. Considera quell'inquadramento come commento. Il record di merge stesso ti dice che qualcuno all'interno dell'infrastruttura di una terza parte si sta preparando a servire un modello con quel nome. Non ti dice che OpenAI ne abbia rilasciato uno, e non dice assolutamente nulla su Luna.

Il resto delle argomentazioni a favore di un lancio di GPT-6 Sol è più esile di quanto suggerisca la copertura che lo circonda. La stampa tecnologica cinese ha riportato un prezzo trapelato di 2,50 $ per milione di token di input e 15 $ per milione di output — circa la metà di quanto costa GPT-5.6 Sol — insieme ad affermazioni secondo cui il supporto sarebbe stato implementato attraverso l'API di OpenAI, Codex OAuth, l'input di immagini e la gestione di contesti lunghi, e a un presunto lancio martedì 22 settembre. Parte di quei resoconti indicava le 3 del mattino di martedì. Al momento in cui scriviamo non esiste alcun annuncio di OpenAI, nessuna stringa identificativa, nessuna voce nella pagina dei prezzi e nessun avvistamento nel selettore di modelli per GPT-6 Sol o GPT-6 Luna. Una testata che ha seguito la stessa catena di voci ha osservato che le sue stesse cifre di prezzo non concordavano tra loro, citando 2,50 $/15 $, 4 $/30 $ e altri numeri in circolazione — che è l'aspetto che ha una voce dopo essere passata attraverso quattro traduzioni, non quello che ha un listino prezzi.

GPT-6 Luna è ancora più debole, e vale la pena essere schietti al riguardo. La presenza di Luna nella vicenda risale a un singolo post del 6 settembre, in cui l'account X @kimmonismus ha scritto che OpenAI stava "già preparando il rilascio di GPT-6 Sol" e poi ha dedotto dallo schema di denominazione di GPT-5.6 che "Sol, Terra e Luna devono ancora arrivare". Questo è un argomento basato sulla simmetria dei nomi. Luna non è mai stata oggetto di un'affermazione a sé stante — nessun leak, nessuno screenshot, nessuna stringa di modello, nessun prezzo. Compare nei riepiloghi successivi solo perché era apparso nel primo post.

Tre date, e ciò che ciascuna di esse ha dimostrato

Vale la pena leggere le timeline dei leak come una pagella, perché questa ne ha già una.

6 settembre — la rivendicazione della famiglia. Inferenza della community basata sul precedente GPT-5.6, nessun artefatto allegato. Non verificata allora, non verificata ora.

15–16 settembre — Sam Altman ha pubblicato che OpenAI aveva "un grosso rilascio questa settimana, e poi per il devday, sei rilasci", per poi fare marcia indietro sulla prima metà la sera successiva, dicendo che la cosa che era più entusiasta di lanciare sarebbe invece arrivata la settimana dopo e che ne sarebbe "valsa la pena aspettare". Non ha nominato alcun prodotto in nessuno dei due post. Questo è l'unico elemento dichiarato da un dirigente in tutta la storia, e riguarda i tempi e nient'altro.

21 settembre — il record di merge di NVIDIA, e il primo artefatto della catena. Un record di merge nel repository di qualcun altro è un segnale reale che un modello viene preparato per il serving. Non è un rilascio.

martedì 22 settembre — oggi, e la data che il rumor stesso ha indicato. Al momento in cui scriviamo non esiste alcun annuncio di OpenAI, alcun identificatore di modello, alcuna voce nel listino prezzi e alcun avvistamento nel selettore di modelli per GPT-6 Sol, e nessuno in assoluto per GPT-6 Luna.

Il prossimo appuntamento datato è il DevDay di martedì 29 settembre al Fort Mason Center — lo "ship x 6" a cui si riferiva Altman, e la data di riserva che i resoconti cinesi indicavano nel caso in cui il lancio di martedì non fosse avvenuto. Se un modello di sesta generazione di fascia media o economica esiste davvero, è lì che con maggiore plausibilità emergerebbe, e una singola riga nell'elenco dei modelli di OpenAI chiarirebbe tutto ciò su cui questo articolo è costretto a mantenere un tono cauto.

Il tier esiste già, ed è economico.

Ecco la parte della storia che è del tutto verificabile, ed è il motivo per cui un "GPT-6 Luna" è una cosa strana da aspettare. GPT-5.6 Luna è disponibile, ed è economico in un modo in cui i modelli di frontiera non lo sono.

Prezzo — 0,20 $ per milione di token di input e 1,20 $ per milione di token di output, secondo la documentazione API di OpenAI stessa. È stato lanciato il 9 luglio 2026 a 1,00 $ / 6,00 $ ed è stato ridotto di circa l'80% a fine luglio.

Tariffe per cache e contesto lungo — le letture di input dalla cache usufruiscono di uno sconto di circa il 90%; le richieste oltre la soglia di contesto lungo vengono fatturate a circa $0,40 / $1,80 per l'intera richiesta.

Contesto e output — una finestra di contesto da 1M token con un output massimo di 128K. Il tempo mediano al primo token è indicato in 1,83 secondi.

Ruolo — OpenAI ha sostituito GPT-5.5 Instant con GPT-5.6 Luna come modello predefinito per ChatGPT Free e Go il 6–7 agosto 2026, aggiungendo la settimana successiva un pulsante "Think" per un ragionamento più approfondito.

Effetto del taglio — il 9 settembre, Sarah Friar, direttrice finanziaria di OpenAI, ha dichiarato alla conferenza Communacopia di Goldman Sachs che la riduzione di prezzo ha prodotto un aumento dell'utilizzo di circa dieci volte, e ha sostenuto che distribuire Luna costa meno che eseguire GLM 5.3 di Z.ai su un livello cloud. In entrambi i casi si tratta di dati forniti dall'azienda e presentati da un dirigente a un evento per investitori: vale la pena riportarli, non considerarli come verificati in modo indipendente.

A two-column scoreboard titled 'GPT-6 Sol and GPT-6 Luna (reported) vs GPT-5.6 Luna (shipped) — the scoreboard'. The left column 'GPT-6 Sol and GPT-6 Luna (reported)' reads: Model ID: none found; Price per MTok: reported $2.50 in / $15 out, inconsistent; Context window: not announced; Availability: not shipped; Evidence: one NVIDIA merge record plus unnamed developer reports; Date: claimed Sep 22, unconfirmed. The right column 'GPT-5.6 Luna (shipped)' reads: Model ID: openai/gpt-5.6-luna; Price per MTok: $0.20 in / $1.20 out; Context window: 1M tokens, 128K max output; Availability: GA since Jul 9, 2026; Evidence: OpenAI API docs and price list; Role: default model for ChatGPT Free and Go. The footer reads 'GPT-6 Sol and GPT-6 Luna are unconfirmed; GPT-5.6 Luna figures per OpenAI's API documentation.' The OrcaRouter logo is composited in the bottom-right corner.

Metti i due punti di prezzo uno accanto all'altro e la questione dei livelli si risolve da sola. Il prezzo riportato di GPT-6 Sol, $2.50 / $15, è più di dodici volte la tariffa di input di GPT-5.6 Luna. Una Luna di sesta generazione non competerebbe con Sol: competerebbe con il modello che OpenAI sta già regalando come predefinito del suo piano gratuito.

Perché un tier economico di GPT-6 è comunque plausibile

Sotto la diceria c'è una vera argomentazione commerciale, e riguarda dove si trovano i token piuttosto che dove si trova la classifica. GPT-6 Astra costa 10 $ per milione di token di input e 50 $ per milione di output, con le richieste a contesto lungo fatturate a un livello superiore. Dichiara una finestra di contesto da 1M di token — la stessa classe della generazione 5.6, a una tariffa molto più alta. Su Artificial Analysis, la configurazione con massimo ragionamento di Astra ottiene 53 sull'Intelligence Index del tracker a circa 3,26 $ per attività, un prezzo difendibile per il lavoro di frontiera e indifendibile per classificazione, estrazione, routing o cicli di agenti ad alto volume.

Quel divario è esattamente la forma che ha prodotto Sol, Terra e Luna nella generazione 5.6, ed è il motivo per cui le indiscrezioni continuano a indicare un Sol di fascia media anziché un secondo flagship. Il comportamento stesso di OpenAI in materia di prezzi supporta la direzione intrapresa: la sua risposta alla pressione sui costi a luglio è stata tagliare dell'80% il tier economico anziché sostituirlo, e a settembre il suo CFO è salito sul palco per discutere di prezzo contro i modelli open-weight cinesi. Un'azienda che difende la fascia bassa del mercato è un'azienda che intende continuare a rilasciare nella fascia bassa.

Il controargomento è altrettanto reale, ed è il motivo per cui la logica stessa del leak è più debole di quanto sembri. Distribuire un modello economico della serie 6 significa chiedere a ogni team che ha già messo a punto prompt, caching e harness di valutazione attorno a GPT-5.6 Luna di riqualificare tutto quanto per un guadagno marginale. Questa è una ragione concreta per cui un GPT-6 Luna potrebbe non essere mai annunciato — non perché l'indiscrezione sia falsa, ma perché la decisione di prodotto che presuppone potrebbe non essere stata presa.

A screenshot of the Artificial Analysis model page for GPT-6 Astra at maximum reasoning, showing an Intelligence Index score of 53, a speed of 65.3 output tokens per second, a cost of $3.26 per Intelligence Index task, and list pricing of $10.00 per million input tokens and $50.00 per million output tokens.

Come prepararsi senza puntare su un modello che non esiste

Non puoi chiamare GPT-6 Sol o GPT-6 Luna. Nessuno può, e nessuna piattaforma li ospita — il massimo che è stato segnalato è che uno sviluppatore ha visto restituita una stringa del modello GPT-6 Sol dove ci si aspettava una richiesta GPT-5.6 Sol, che è una curiosità di routing più che una disponibilità. Quello che puoi fare è rendere l'eventuale arrivo economico da adottare e costoso da subire come sorpresa.

La versione pratica consiste nel tenere il nome del modello fuori dal codice della tua applicazione. Se il tuo stack chiama un modello tramite una stringa hard-coded, adottare un modello di fascia media di sesta generazione comporta un deploy, un nuovo passaggio di riqualificazione dei prompt e una nuova esecuzione di valutazione. Se invece chiama una route, significa cambiare una sola riga. OrcaRouter espone oltre 200 modelli dietro un'unica API con markup dello 0% — il prezzo di listino del provider viene trasferito direttamente, quindi quando un fornitore taglia un prezzo il numero dalla nostra parte si aggiorna lo stesso giorno: è così che il taglio dell'80% di GPT-5.6 Luna è comparso qui senza che nessuno rinegoziasse nulla. Il failover automatico fa il resto: punta una route sul tier più economico che soddisfa la tua soglia di valutazione, e un modello non ancora rilasciato resta fuori dal percorso finché non esiste e non supera i test.

A screenshot of the OrcaRouter model page for openai/gpt-5.6-luna, showing the model title GPT-5.6 Luna, its capability chips, a 1M-token context window with a 128K maximum output, an input price of $0.20 per million tokens and an output price of $1.20 per million tokens.

Questo è l'uso onesto di una fuga di notizie come questa: non pianificare una migrazione verso un modello che non è stato annunciato, ma notare quale slot nel tuo stack andrebbe a occupare un nuovo modello di fascia media, e assicurarsi che riempirlo in seguito sia una modifica di configurazione anziché un progetto.

Che cosa varrebbe come prova

La linea di demarcazione tra un leak che vale la pena seguire e un leak che vale la pena ignorare sta nel fatto che l'artefatto sia qualcosa prodotto dal fornitore o da una parte neutrale. Applicato qui:

Conta — un identificatore di modello nella documentazione API di OpenAI, una system card, una voce nella pagina dei prezzi di OpenAI, una comparsa nel selettore di modelli di ChatGPT, un primo benchmark indipendente eseguito su un tracker come Artificial Analysis, o una presenza in un catalogo di routing con un endpoint reale dietro.

Non conta — un record di merge, da solo, nel repository di qualcun altro, un elenco di indiscrezioni non attribuite in una rassegna, uno screenshot trapelato di un prezzo che tre testate riportano in tre modi diversi, l'osservazione di uno sviluppatore senza nome, o la probabilità di un mercato predittivo. A fine luglio, i mercati predittivi valutavano all'incirca il 77–78% la probabilità di un rilascio di GPT-6 entro il 30 settembre. È l'opinione di un mercato su una data, non una prova riguardo a un modello, ed è stata quotata prima che Astra venisse distribuito.

Finché non arriva uno dei primi della lista, la posizione corretta su entrambi i nomi è ristretta e poco glamour. GPT-6 Sol è una stringa in un record di merge NVIDIA e un prezzo su cui nessuno riesce a mettersi d'accordo. GPT-6 Luna è un nome che compare in una voce di corridoio di famiglia, in una lista che nessuno ha rivendicato, e occupa un tier che GPT-5.6 Luna già copre a $0,20 in ingresso e $1,20 in uscita. Non c'è nulla verso cui migrare, nulla da benchmarkare e nulla da prezzare. L'unica cosa che vale la pena fare oggi è assicurarsi che, quando ci sarà, il tuo routing non debba essere riscritto per raggiungerlo.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno