Prezzi di GPT-5.6 Dopo il Taglio: Luna vs Terra vs Sol, e Quale Piano Usare
Guides & Insights

Prezzi di GPT-5.6 Dopo il Taglio: Luna vs Terra vs Sol, e Quale Piano Usare

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Dopo il taglio dei prezzi di OpenAI del 30 luglio 2026, la famiglia GPT-5.6 — GPT-5.6 Luna, GPT-5.6 Terra e GPT-5.6 Sol — non è mai stata così conveniente da eseguire su larga scala. Una settimana dopo, il 6 agosto, OpenAI ha portato gli stessi livelli direttamente in ChatGPT: GPT-5.6 Luna sta diventando il modello predefinito per gli account gratuiti e Go con chat di testo illimitate, mentre GPT-5.6 Sol è stato aggiornato per Plus e Pro. Il 19 agosto, OpenAI e Replit hanno annunciato che la nuova Free Mode di Replit per gli abbonati ai piani Core e Pro gira su GPT-5.6 Luna — la più grande scommessa di terze parti finora sul livello ad alto volume. E a fine agosto, OpenAI ha iniziato a distribuire un meccanismo di riserva per gli utenti consumer più assidui: una dotazione "Luna Reserve" che offre ad alcuni account ChatGPT Plus e Pro selezionati un utilizzo limitato di GPT-5.6 Luna in Codex e ChatGPT Work una volta esauriti i normali limiti di utilizzo. Ma i tre livelli hanno prezzi molto diversi tra loro e scegliere quello giusto (oltre a usare bene caching, batch e routing) è la leva più importante sulla tua fattura API. Questa guida illustra i prezzi completi dopo il taglio, esempi concreti di costo, come ogni livello si confronta con i concorrenti e come instradare il traffico tra di essi tramite un unico endpoint.

I prezzi sono per milione di token (input / output) e riflettono la tariffa post-taglio come riportata e le pagine dei modelli pass-through di OrcaRouter; le tariffe a livelli e quelle cache provengono dalle pagine dei modelli di OrcaRouter, mentre le cifre della concorrenza sono attribuite. I dettagli sul rollout di ChatGPT in questo articolo sono come dichiarati da O​penAI il 6 agosto 2026, e quelli sulla Replit Free Mode come dichiarati da O​penAI e Replit il 19 agosto 2026 — dichiarazioni del fornitore, non misurate in modo indipendente. I dettagli sulla Luna Reserve sono come documentati da O​penAI nel suo centro assistenza e come riportati dal personale O​penAI e dai primi utenti alla fine di agosto 2026 — dichiarazioni del fornitore e della community, non verificate in modo indipendente. I prezzi cambiano — verifica prima di creare qualcosa.

In breve

GPT-5.6 Luna ($0.20 / $1.20) è il cavallo di battaglia per volumi elevati; Terra ($2 / $12) è la via di mezzo bilanciata; Sol ($5 / $30) è il modello di punta per i ragionamenti più complessi e la codifica agentica. Tutti e tre condividono un contesto di ~1.05M token e un output massimo di 128K. La cache dei prompt e l'opzione batch riducono ulteriormente i costi, mentre input molto lunghi ti spostano a un livello superiore. Sul lato consumer, O​penAI ha annunciato il 6 agosto che GPT-5.6 Luna sta diventando il predefinito per gli account ChatGPT Free e Go con chat di solo testo illimitate, e che una versione aggiornata di GPT-5.6 Sol è in distribuzione per Plus e Pro. Il 19 agosto, Replit ha lanciato la Free Mode su GPT-5.6 Luna per gli abbonati Core e Pro, indirizzando i compiti più difficili a GPT-5.6 Sol quando necessario. A fine agosto, O​penAI ha anche iniziato a distribuire un fallback chiamato “Luna Reserve” che offre ad alcuni account ChatGPT Plus e Pro selezionati un utilizzo limitato di GPT-5.6 Luna in Codex e ChatGPT Work dopo l'esaurimento dei limiti regolari — documentato da O​penAI, con la distribuzione agli account selezionati segnalata dagli utenti. Usa Luna per la maggior parte dei compiti facili, Terra quando ti serve di più, e Sol solo dove ripaga il costo — e indirizza in base alla difficoltà attraverso un unico endpoint compatibile con O​penAI per ridurre al minimo la spesa.

Punti chiave

Luna: $0.20 / $1.20 per 1M tokens — veloce, economico, per attività ad alto volume e sensibili alla latenza.

Terra: $2 / $12 — il livello medio equilibrato per attività più impegnative che non richiedono il modello di punta.

• Sol: $5 / $30 — l'ammiraglia per il ragionamento profondo, la codifica su larga scala e gli agenti a lungo orizzonte.

• La memorizzazione nella cache e l'elaborazione in batch riducono ulteriormente i costi; gli input lunghi ti spostano a un livello di contesto lungo più costoso.

• ChatGPT (dichiarato da OpenAI, 6 agosto): Luna diventa il default gratuito/Go con chat di testo illimitate; Sol riceve un aggiornamento di affidabilità per Plus/Pro.

• Replit (annunciato il 19 agosto): la Modalità gratuita per Core/Pro gira su GPT-5.6 Luna — fino a 30x più utilizzo per Replit, con attività più difficili instradate fino a GPT-5.6 Sol. Dichiarato da Replit, non verificato in modo indipendente.

• Luna Reserve (fine agosto, documentato da OpenAI): una quota di riserva limitata che consente ad alcuni account ChatGPT Plus e Pro selezionati di continuare a utilizzare GPT-5.6 Luna in Codex e ChatGPT Work dopo l'esaurimento dei limiti regolari — non illimitata, e non disponibile negli spazi di lavoro Business o Enterprise.

• La leva di risparmio più grande: instrada in base alla difficoltà — non pagare le tariffe di Sol per un lavoro che Luna può fare.

Il nuovo prezzo base di GP​T-5.​6

Ecco i prezzi base post-taglio per milione di token in input/output: Luna $0.20 / $1.20 (in calo da $1 / $6), Terra $2 / $12 (in calo da $2.50 / $15), e Sol $5 / $30 (invariato). I due livelli più economici sono stati tagliati il 30 luglio 2026; il livello di punta è rimasto. In poche parole, i livelli bassi ora sono prezzati per il volume, mentre il livello di punta resta premium.

Prezzi a livelli, memorizzati nella cache e in batch

La tariffa base è solo il punto di partenza. I prezzi di GP​T-5.​6 hanno tre modificatori che cambiano sostanzialmente il costo effettivo:

• Livelli per contesto lungo. I prezzi aumentano per input molto lunghi. Nelle pagine pass-through di OrcaRouter, Luna è a $0.20 / $1.20 fino a un livello di contesto ampio e a $0.40 / $1.80 oltre; Sol è a $5 / $30 al livello base e a $10 / $45 al livello massimo. Il livello viene scelto in base al numero di token di input di ciascuna richiesta, quindi alcuni prompt enormi possono aumentare silenziosamente il prezzo medio.

• Caching del prompt. Il contesto riutilizzato viene addebitato con uno sconto notevole — la lettura dalla cache di Luna costa circa $0.02 per milione di token (contro i $0.20 del contesto fresco), con scritture in cache intorno a $0.25; la lettura dalla cache di Sol è di circa $0.50 (contro i $5 del contesto fresco). Per agenti e chat con un prompt di sistema stabile, il caching è spesso il singolo risparmio più grande.

• Batch. I job non urgenti vengono eseguiti in modalità asincrona a prezzo scontato — ideali per classificazione in grandi volumi, valutazioni e generazione offline dove la latenza non è un fattore critico.

Esempi svolti: quanto costa realmente

I numeri concreti rendono reali i livelli. Prendi 10 milioni di token al mese con una suddivisione 70% input / 30% output (un mix tipico per chat/agenti):

• Luna: circa $5 al mese (circa $4,37 con la cache dei prompt).

• Terra: circa 50 $ al mese.

• Sol: circa $125 al mese (all'incirca $109 con caching).

C'è un divario di 25 volte tra Luna e Sol per lo stesso volume — ed è esattamente per questo che abbinare ogni richiesta al livello capace più economico conta più di qualsiasi tariffa singola. (Questi corrispondono al calcolatore di costi integrato nella pagina di OrcaRouter, che stima dal prezzo di listino; i tuoi numeri reali dipendono dalla cache e dal tuo mix di input/output.)

A cosa serve effettivamente ogni livello

GPT-5.6 Luna — il cavallo di lavoro per i volumi

{{1}}Luna{{/1}} è il livello veloce ed economico, ottimizzato per carichi di lavoro ad alto volume e sensibili alla latenza: chat, classificazione, estrazione, routing e attività agentiche leggere, con un tempo al primo token (p50) di circa 1,65 secondi. Dopo il taglio dei prezzi, a $0.20 / $1.20, è prezzato per competere direttamente con i modelli open economici — l'opzione predefinita per la maggior parte delle chiamate semplici. È anche il livello verso cui O​penAI sta indirizzando ChatGPT consumer: secondo il suo annuncio del 6 agosto, GPT-5.6 Luna sta diventando il modello predefinito per gli account Free e Go, con chat testuali illimitate e un nuovo pulsante Think per un ragionamento superiore su domande più difficili, in arrivo la settimana successiva (i limiti per file, immagini e voce restano invariati). O​penAI afferma che Luna commette il 62% di errori fattuali in meno rispetto alla GPT-5.5 Instant che sostituisce — un dato dichiarato dal vendor, ma un segnale chiaro che il livello di volume è quello verso cui l'azienda sta indirizzando la maggior parte del proprio traffico.

Il 19 agosto 2026, Replit ha reso GPT-5.6 Luna il motore della sua nuova Free Mode — l'esperienza predefinita per gli abbonati Core e Pro. Le chat quotidiane, l'ideazione e le attività di codifica semplice girano su Luna senza consumare il budget di crediti AI a pagamento dell'utente; Replit afferma che gli utenti Core possono ora creare fino a 30 volte di più al mese, incluse fino a 30 ore di chat. Quando un'attività richiede più ragionamento, l'Agent di Replit instrada la richiesta a un modello più grande per quella parte — le sue modalità Power/Max o GPT-5.6 Sol — per poi tornare a Luna. Questi sono dettagli dichiarati da Replit e O​penAI, non verificati in modo indipendente — ma la direzione corrisponde al taglio del prezzo: una Luna più economica dell'80% è ciò che rende vitale un livello sempre attivo e incluso per impostazione predefinita.

Un'altra complicazione lato consumatori è arrivata a fine agosto 2026: Luna Reserve. Come O​penAI documenta nel suo centro assistenza, alcuni account ChatGPT Plus e Pro selezionati possono ottenere un pool limitato di utilizzo di GPT-5.6 Luna in Codex e ChatGPT Work come fallback una volta esaurita la loro quota di utilizzo regolare — un avviso o un indicatore a luna appare al raggiungimento del tetto, e puoi continuare a lavorare su Luna finché dura la riserva. Non è un'estensione illimitata: la riserva è separata dalla quota regolare ed è essa stessa limitata, serve esclusivamente GPT-5.6 Luna (mai Terra o Sol), non è disponibile negli spazi di lavoro Business o Enterprise, e il raggiungimento di un limite regolare non garantisce l'accesso. Lo staff O​penAI ha confermato l'esistenza della riserva il 27 agosto, e i primi rapporti degli utenti la descrivono in fase di distribuzione ad account selezionati — dichiarato dal fornitore e dalla community, non verificato in modo indipendente. Alcuni primi rapporti della community notano anche che la riserva esegue il lato browser-light di GPT-5.6 Luna, quindi le attività di ispezione web in tempo reale potrebbero non funzionare durante la riserva.

GPT-5.6 Terra — il giusto mezzo

Terra si colloca tra volume e flagship: più capace di Luna per ragionamenti e coding complessi, ma molto più economica di Sol. A $2 / $12 è una scelta sensata di default quando Luna non basta ma non serve la flagship — estrazione di complessità media, bozze e attività multi-step che girano comunque su larga scala.

GPT-5.6 Sol — il modello di punta

Sol è costruito per i lavori più difficili: ragionamento profondo multi-step, ingegneria software su larga scala e workflow agentici a lungo orizzonte, mantenendo la coerenza su un contesto di ~1,05M token e fino a 128K di output. A $5 / $30 (base) è una scelta premium — riservalo a compiti che ne hanno davvero bisogno, come codifica complessa su più file o lunghe sessioni agente. Il 6 agosto, O​penAI ha anche aggiornato GPT-5.6 Sol in ChatGPT per gli utenti Plus e Pro: l'azienda afferma che la versione chat è più affidabile sui fatti — 68% in meno di errori fattuali, secondo O​penAI — e fornisce risposte più mirate, con un nuovo cursore per controllare quanto sforzo di ragionamento applica. L'aggiornamento è solo per la chat (il Sol dietro Work e Codex è invariato), e il livello API resta a $5 / $30.

L'avvertenza sui token di ragionamento

I modelli GP​T-5.​6 sono modelli di ragionamento, quindi il costo effettivo dell'output può superare una stima approssimativa: quando il ragionamento è attivo, i token di ragionamento interni vengono fatturati come output. Su prompt difficili con un elevato sforzo di ragionamento, questo può dominare i costi. Regola lo sforzo di ragionamento in base all'attività (basso o disattivato per chiamate semplici), limita i token di output dove puoi e misura l'utilizzo effettivo. Tariffe per token più basse aiutano; generare meno token aiuta di più.

Come ogni livello si confronta con i rivali

Il taglio ha riposizionato GP​T-5.​6 rispetto alla concorrenza. Secondo quanto riportato, i $0.20 / $1.20 di Luna ora sottocostano Claude Haiku 4.5 di circa 5x in input e 4x in output, e i $2 / $12 di Terra scendono sotto il prezzo standard di Claude Sonnet 5 (riportato a $3 / $15). Rispetto ai modelli open weights, Luna si colloca vicino al minimo stabilito dalla linea V4 di Deep​Seek e dal GLM-5.2 di Zhi​pu (circa $1.20 / $4.10), con i livelli Qw​en e Gem​ini Flash poco distanti. In sintesi: per le attività sensibili ai costi, Luna ora è competitiva con i modelli capaci più economici, anziché un'alternativa premium a essi — mentre Sol rimane un autentico livello premium per capacità che non si possono ottenere a buon mercato.

La vera leva di risparmio: instrada per difficoltà.

La bolletta più economica non è un singolo livello — è abbinare ogni richiesta al modello meno costoso che possa gestirla. In pratica: invia le chiamate facili e ad alto volume a Luna (o a un modello open economico), passa a Terra per i compiti più difficili e usa Sol solo per la minoranza davvero complessa. In combinazione con caching e batch, questo taglia i costi in modo sistematico, molto più di qualsiasi singola modifica di prezzo. Il problema è di natura operativa: non vuoi re-integrare separatamente tre livelli di OpenAI più alternative open-model.

Accedi a tutti e tre (e ai rivali più economici) tramite un unico endpoint.

È qui che un router indipendente dal fornitore aiuta. OrcaRouter espone GPT-5.6 Luna, Terra e Sol — agli stessi prezzi post-taglio, 0% di markup — tramite un unico endpoint compatibile con O​penAI, insieme a modelli open più economici come DeepSeek V4 Pro, GLM-5.2 e Qw​en. Passare da un tier all'altro (o fare A/B testing di Luna contro un modello open) è un cambiamento di configurazione, non una re-integrazione, e puoi instradare ogni richiesta verso l'opzione più economica. Luna Reserve è la versione consumer di questa stessa idea — un fallback integrato che mantiene utenti selezionati su GPT-5.6 Luna dopo che la loro quota regolare è esaurita — e l'equivalente lato API è il failover automatico, che OrcaRouter gestisce quando un provider applica rate limit o restituisce errori su una richiesta.

La scheda tariffaria di Luna post-taglio è visibile sulla pagina del modello di OrcaRouter stesso al prezzo di listino — $0,20 / $1,20 per milione di token — poiché il router trasmette i prezzi dei fornitori con margine dello 0%, con un calcolatore di costi in pagina per una tipica fattura mensile. C'è anche un piano gratuito e una pagina Offerte per ulteriori risparmi.

Domande frequenti

Quali sono i prezzi di GP​T-5.​6 dopo il taglio?

Luna $0.20 / $1.20, Terra $2 / $12 e Sol $5 / $30 per milione di token di input/output. I prezzi di Luna e Terra sono stati ridotti il 30 luglio 2026; Sol è rimasto invariato.

Quale livello di GP​T-5.​6 dovrei usare?

Luna per lavori ad alto volume e sensibili alla latenza; Terra per attività più complesse che non richiedono il modello di punta; Sol per i ragionamenti più difficili e la programmazione agentica. Instrada in base alla difficoltà per minimizzare i costi.

GPT-5.6 Luna è gratuito in ChatGPT?

O​penAI ha annunciato il 6 agosto che GPT-5.6 Luna diventerà il modello predefinito per gli account ChatGPT gratuiti e Go, con chat illimitate solo testo; restano limiti per caricamenti di file, immagini e strumenti vocali, e un pulsante Think per un ragionamento superiore è in fase di distribuzione separatamente. Questi sono piani dichiarati da O​penAI, non verificati in modo indipendente.

Perché Replit sta usando GPT-5.6 Luna per la Free Mode?

La modalità gratuita di Replit, annunciata il 19 agosto 2026, esegue chat quotidiane, ideazione e codifica semplice su GPT-5.6 Luna per impostazione predefinita per gli abbonati Core e Pro, instradando i compiti più difficili verso un modello più grande — le sue modalità Power/Max o GPT-5.6 Sol — quando necessario. Replit attribuisce al taglio del prezzo dell'API Luna del 30 luglio, circa l'80%, il merito di far quadrare i conti. Questi sono piani dichiarati dal fornitore, non verificati in modo indipendente.

Cos'è Luna Reserve?

Una quota di ripiego che O​penAI documenta per Codex e ChatGPT Work: alcuni account ChatGPT Plus e Pro ottengono un pool limitato di utilizzo di GPT-5.6 Luna una volta esaurito il loro limite di utilizzo regolare, così continuano a funzionare invece di essere interrotti. Serve esclusivamente GPT-5.6 Luna — mai Terra o Sol — ha un proprio limite, è separato dall'utilizzo regolare e non è disponibile negli spazi di lavoro Business o Enterprise. L'esistenza è dichiarata da O​penAI (il personale l'ha confermata il 27 agosto); la distribuzione agli account selezionati è riportata dalla community, non verificata in modo indipendente.

Quanto costa GP T-5. 6 al mese?

A 10M token al mese (70% input): circa $5 su Luna, $50 su Terra e $125 su Sol — un divario di 25x, prima della cache. Il costo effettivo dipende dalla cache e dal mix di input/output.

Tutti e tre i livelli hanno la stessa finestra di contesto?

Sì — circa un contesto da 1.05M token e fino a 128K token di output, con supporto per vision, strumenti, JSON e ragionamento.

In che modo la memorizzazione nella cache dei prompt influisce sui costi?

La cache riduce drasticamente il costo dei contesti ripetuti — la lettura dalla cache di Luna costa circa $0.02 per milione di token contro $0.20 per quelli nuovi — quindi riutilizza i prompt in cache quando possibile. Gli input lunghi, al contrario, possono portarti a un livello di contesto lungo più costoso.

Come si confrontano i livelli con Anthropic o i modelli open?

Per reporting, Luna è più economica di Claude Haiku 4.5 (~5x input / 4x output) e Terra è al di sotto di Claude Sonnet 5 ($3 / $15). Luna è anche vicina alla soglia inferiore dei prezzi dei modelli open economici (Deep​Seek, GLM-5.2 ~$1.20/$4.10).

Dove posso usare tutti e tre i livelli insieme?

Tramite il singolo endpoint compatibile con OpenAI di OrcaRouter con markup 0%, insieme a modelli open più economici per il routing basato sulla difficoltà.

Il risultato finale

Dopo il taglio, GPT-5.6 Luna ($0.20 / $1.20) e Terra ($2 / $12) sono interessanti per lavori ad alto volume e di fascia media, mentre Sol ($5 / $30) rimane il flagship premium: una differenza di costo di 25 volte che premia un routing intelligente. Il lancio consumer rafforza la divisione: O​penAI sta rendendo Luna il default gratuito, riservando l'aggiornamento di affidabilità di Sol ai piani a pagamento, e la Free Mode del 19 agosto di Replit — basata su GPT-5.6 Luna, con i compiti più difficili instradati a GPT-5.6 Sol — mostra prodotti ad alto traffico che si attestano sullo stesso livello, e il fallback Luna Reserve di fine agosto estende il modello mantenendo selezionati utenti Plus e Pro su GPT-5.6 Luna anche dopo il consumo dei limiti regolari. Per chi sviluppa API, questo è un motivo in più per instradare il traffico facile verso Luna. I maggiori risparmi si ottengono instradando in base alla difficoltà, sfruttando la cache e le richieste batch e controllando i token di ragionamento, invece di impostare un unico livello predefinito. Il modo più semplice per farlo è attraverso un endpoint unico con markup 0% come OrcaRouter, dove tutti e tre i livelli (ai nuovi prezzi) si trovano accanto ai modelli open più economici con cui vorrai confrontarli.