
Prezzi dell'API GPT-5.6: Piani Sol, Terra e Luna, Costo Reale e Come Chiamare Ciascuno
- qwenNUOVOQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaNUOVOOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicNUOVOAnthropic: Claude Opus 52026-07-2461Intelligenza78Codice
- googleNUOVOGoogle: Gemini 3.6 Flash2026-07-2150Intelligenza69Codice
- googleNUOVOGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaNUOVOMeta: Muse Spark 1.12026-07-1651Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1557Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Intelligenza71Codice
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Intelligenza77Codice
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Intelligenza77Codice
- grokxAI: Grok 4.52026-07-0854Intelligenza72Codice
- tencentTencent: Hy32026-07-0641Intelligenza59Codice
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligenza42Codice
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligenza39Codice
- anthropicAnthropic: Claude Sonnet 52026-06-3053Intelligenza72Codice
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligenza52Codice57Matematica
- z-aiZ.ai: GLM 5.22026-06-1651Intelligenza69Codice60Matematica
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Intelligenza61Codice61Matematica
- anthropicAnthropic: Claude Fable 52026-06-0960Intelligenza77Codice
- qwenQwen: Qwen3.7 Plus2026-06-0139Intelligenza56Codice59Matematica
GPT-5.6 è la famiglia di punta di OpenAI del luglio 2026, e la cosa importante per gli sviluppatori è che non ha un prezzo unico. Viene rilasciata in tre livelli: Sol, Terra e Luna. Sull'API di OpenAI, Sol costa $5 per milione di token in input e $30 per milione di token in output, Terra costa $2,50 e $15, Luna costa $1 e $6. Ogni livello ha uno sconto per input in cache, tutti e tre accettano input di immagini oltre che di testo, e la finestra di contesto è di circa 1,05 milioni di token con un massimo di 128.000 token in output.
Il prezzo di listino è solo l'inizio del costo reale. Il livello di cui hai effettivamente bisogno, quanto memorizzi nella cache, quanto output genera il modello e alcune regole di prezzo che la maggior parte delle guide salta—prompt superiori a 272K token, sovrapprezzo per residenza dei dati e livelli di servizio—determinano la fattura molto più del tasso di riferimento. Questa guida analizza il prezzo di ogni livello, a cosa serve, come si valuta, come migrare da GPT-5.5, come chiamarlo e come si confronta con Claude, GLM, Gemini, DeepSeek e Grok.
Risposta rapida: prezzi di GPT-5.6 a colpo d'occhio
- Tre livelli (per milione di token, input / output): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.
- Input memorizzato nella cache: $0,50 (Sol), $0,25 (Terra), $0,10 (Luna) per milione di token; le scritture nella cache costano 1,25 volte la tariffa di input non memorizzato nella cache.
- Posizionamento: Sol per i lavori di ragionamento più complessi e agentici, Terra come impostazione predefinita bilanciata, Luna per attività ad alto volume e sensibili ai costi.
- Modalità: multimodale—GPT-5.6 accetta input di immagini insieme al testo. Contesto ~1.05M token, output massimo 128K.
- Due regole di prezzo da considerare: i prompt con oltre 272K token di input vengono fatturati a 2x input e 1.5x output per l'intera richiesta, e gli endpoint di data-residency aggiungono un aumento del 10%.
- Modi per pagare meno: Batch è al 50% di sconto rispetto allo standard, la memorizzazione nella cache riduce l'input ripetuto a un decimo, e instradare il lavoro di routine a un livello inferiore evita il costo di output di Sol di $30.
- Intelligenza: Artificial Analysis colloca GPT-5.6 Sol vicino alla cima del suo Intelligence Index (punteggio 59).
Prezzi dell'API GPT-5.6, livello per livello

OpenAI prezza GPT-5.6 per milione di token, e l'output è molto più costoso dell'input su ogni livello. Le tariffe pubblicate attuali sono:
- GPT-5.6 Sol: $5.00 input, $0.50 input in cache, $30.00 output (scritture cache $6.25).
- GPT-5.6 Terra: $2.50 input, $0.25 input in cache, $15.00 output.
- GPT-5.6 Luna: $1.00 input, $0.10 input in cache, $6.00 output.
Due dettagli sono importanti prima di pianificare un budget. Primo, il tasso di output domina la maggior parte dei costi reali, specialmente per il ragionamento e il lavoro agentico, dove il modello genera lunghe tracce, chiamate a strumenti e revisioni prima di una risposta finale. Secondo, non esiste una riga di prezzo separata per "Sol Ultra" nella pagina dei prezzi; "Sol Ultra" è una configurazione di ragionamento avanzato di Sol (un setup multi-agente), non un livello indipendente—preventiva intorno a Sol, Terra e Luna.
A cosa serve effettivamente ogni livello
Luna: ad alto volume e sensibile ai costi
Luna è il piano economico a 1 dollaro per input e 6 dollari per output. È la scelta predefinita per classificazione, estrazione, instradamento, sintesi, bozze e per il grande volume di lavoro di routine in cui una piccola differenza di qualità non cambia il risultato. A sei dollari per milione di token in output, è abbastanza economico da essere eseguito su larga scala e da campionare ripetutamente.
Terra: il default equilibrato
Terra si trova nel mezzo a $2,50 e $15. Per la maggior parte del lavoro di applicazione e codifica è il punto di partenza sensato: notevolmente più forte di Luna nei compiti più difficili, ma a metà del prezzo di output di Sol. Inizia qui, poi sposta un compito su Sol solo quando Terra fallisce visibilmente.
Sol: il ragionamento più difficile e il lavoro agentivo
Sol è il modello di punta a $5 e $30, e Artificial Analysis lo colloca vicino alla cima del suo Intelligence Index. Riservalo per architetture difficili, debugging complesso, agenti a lungo orizzonte e analisi ad alto rischio dove un errore evitato vale il premio. Usare Sol per lavori di routine è il modo più comune di spendere troppo su GPT-5.6.
Provieni da GPT-5.5? Quale livello fa risparmiare di più?
GPT-5.6 Sol ha lo stesso prezzo di GPT-5.5, con $5 per input e $30 per output, quindi spostare un carico di lavoro GPT-5.5 direttamente su Sol cambia poco in bolletta. Il risparmio sta nei due nuovi livelli inferiori. Terra offre una qualità paragonabile a GPT-5.5 nella maggior parte dei compiti a metà prezzo, quindi la migrazione più semplice è inviare il traffico GPT-5.5 esistente a Terra e promuovere solo i compiti che regrediscono di nuovo a Sol.
Il piano di migrazione pratica è in tre fasi: reindirizzare le chiamate a GPT-5.5 verso Terra, eseguire il tuo set di valutazione, e inoltrare solo i fallimenti a Sol mentre si spinge il lavoro chiaramente di routine verso Luna. La maggior parte dei carichi di lavoro di GPT-5.5 risulta più economica in questo modo senza una perdita di qualità misurabile.
Come i livelli vengono effettivamente valutati


Il prezzo conta solo in confronto alle capacità. Secondo i dati dello stesso Terminal-Bench 2.1 di OpenAI, i livelli si differenziano più o meno come ci si aspetterebbe: Sol 88,8%, Sol Ultra 91,9%, Terra 87,4% e Luna 84,7%. Per contesto nella stessa tabella, GPT-5.5 ottiene 85,6%, Claude Opus 4.8 ottiene 78,9%, Claude Fable 5 ottiene 83,1%, e Gemini 3.1 Pro (anteprima) ottiene 70,7%. Artificial Analysis assegna separatamente a Sol un Intelligence Index di 59, vicino alla cima della sua classifica.
Leggi questi come riportati dal fornitore e indicativi. OpenAI ha pubblicato una serie limitata di valutazioni per GPT-5.6 e non, al momento della stesura, benchmark tradizionali per codice e ragionamento come SWE-bench Verified o GPQA, quindi utilizza questi punteggi per decidere cosa testare sul tuo carico di lavoro piuttosto che come verdetto finale.

La velocità di lettura dell'input memorizzato nella cache di ogni livello è un decimo della velocità di input fresco: $0.50 su Sol, $0.25 su Terra, $0.10 su Luna. Scrivere nella cache, tuttavia, costa 1.25x la velocità di input non memorizzato (circa $6.25 per milione su Sol), quindi l'uso della cache è conveniente solo quando un prefisso stabile viene riutilizzato un numero sufficiente di volte per recuperare il premio di scrittura—istruzioni di sistema, un documento di grandi dimensioni, regole del repository o una tassonomia di prodotto. Metti il materiale stabile all'inizio del prompt e la domanda variabile alla fine, ed evita di inserire timestamp o identificatori casuali prima del contesto riutilizzabile.
La memorizzazione nella cache riduce il costo dell'input ripetuto; non fa nulla per l'output. Poiché l'output è il lato costoso su ogni livello, le due leve che influenzano maggiormente un conto GPT-5.6 sono la memorizzazione nella cache di un prefisso stabile e il controllo di quanto il modello scrive.
Quale livello dovresti scegliere?

Non scegliere un livello in base alla reputazione. Sceglilo in base ai test. Crea un piccolo insieme di attività rappresentative con chiari criteri di accettazione, eseguile prima su Luna e promuovi solo le attività che falliscono a Terra, poi a Sol. Misura il costo per attività accettata, non il prezzo medio dei token, perché un livello più economico che necessita di tre tentativi può costare più di un livello più potente che riesce al primo colpo.
Un'abitudine operativa fa risparmiare denaro reale: specificare l'ID esatto del modello di livello in ogni chiamata invece di affidarsi a un semplice alias, così una richiesta di routine non viene mai eseguita silenziosamente sul livello più costoso. Un carico di lavoro misto di solito si risolve in Luna per la trasformazione e la bozza di routine, Terra per l'implementazione e l'analisi quotidiane, e Sol riservato alla minoranza difficile—la maggior parte delle richieste non ha mai bisogno del modello di punta.
GPT-5.6 vs la concorrenza sul prezzo
GPT-5.6 non esiste isolato. Confrontato con lo stato attuale (per milione di token, input / output, metà 2026): Claude Opus 4.8 è $5 / $25, Claude Fable 5—il modello pubblico più forte di Anthropic—è $10 / $50, GLM 5.2 è $1.40 / $4.40 su Z.AI (host di terze parti possono essere più economici), Grok 4.5 è $2 / $6, di Google Gemini 3.5 Flash è circa $1.50 / $9, e DeepSeek V4-Pro è circa $0.44 / $0.87. Conferma ciascuno sulla pagina del fornitore, poiché questi cambiano.
I punti salienti sono specifici. GPT-5.6 Sol corrisponde a Opus 4.8 in input ma è più caro in output ($30 contro $25), quindi in lavori agentici ad alto output, Opus è leggermente più economico per token mentre Sol guida l'Intelligence Index. Terra sottocosta entrambi i modelli di punta ed è la scelta di valore nella famiglia OpenAI. Luna compete con modelli più economici sul prezzo, sebbene Grok 4.5, GLM 5.2, e specialmente DeepSeek si posizionino ancora più in basso. Nessun singolo livello o fornitore vince su tutto, ed è esattamente per questo che il routing basato sulla difficoltà batte l'impegno verso uno solo.
Una fattura mensile elaborata

Metti dei numeri. Per un mese medio-pesante con 50 milioni di token in input e 10 milioni in output, al prezzo di listino prima della memorizzazione nella cache e dell'uso di strumenti, il costo del modello è all'incirca:
- GPT-5.6 Luna: circa $110
- GPT-5.6 Terra: circa $275.
- GPT-5.6 Sol: circa $550.
- Per confronto: GLM 5.2 circa $114, Grok 4.5 circa $160, Claude Opus 4.8 circa $500, Claude Fable 5 circa $1.000.
The same tasks routed intelligently—Luna and Terra for the bulk, Sol for the hard minority—land far closer to the $110–$275 band than to a flat $550 of Sol-for-everything. That gap, multiplied across a year, is the whole argument for tier-based routing.
Costi nascosti da mettere in conto
Diverse regole di prezzo non compaiono nel tasso principale e sorprendono i team successivamente:
- Prompt lunghi: una richiesta con oltre 272.000 token di input viene fatturata a 2x per l'input e 1.5x per l'output per l'intera richiesta, quindi le chiamate con contesto ampio e big-RAG possono più che raddoppiare i costi.
- Volume di output: l'output è fino a sei volte il tasso di input, quindi l'output senza limiti o con ragionamento avanzato è il principale rischio di spesa eccessiva.
- Livello di servizio: L'elaborazione prioritaria costa circa il doppio della tariffa standard (circa $10 di input / $60 di output su Sol); Flex e Batch sono più economici. Scegli il livello deliberatamente con l'impostazione service_tier.
- Residenza dei dati: gli endpoint di elaborazione regionale aggiungono un aumento del 10% per i modelli rilasciati a partire dal 5 marzo 2026, che include GPT-5.6.
- Cicli di agente e tentativi: istruzioni, strumenti e cronologia vengono reinviati a ogni turno, e una richiesta lunga fallita spreca l'input che hai già pagato.
- Deriva di livello: lasciare tutto su Sol "per sicurezza" è l'abitudine più costosa in assoluto.
Modi per pagare meno
Tre leve riducono una bolletta GPT-5.6 senza cambiare ciò che costruisci. Batch: le richieste asincrone tramite il livello Batch hanno uno sconto del 50% rispetto al prezzo standard, ideali per lavori Luna ad alto volume che non sono sensibili alla latenza. Caching: riutilizza un prefisso stabile abbastanza volte da superare il premio di scrittura di 1.25x e gli input ripetuti scendono a un decimo. Routing: invia il lavoro di routine a Luna o Terra e scala solo la minoranza difficile a Sol, e mantieni i prompt sotto la soglia di 272K quando puoi.
Come chiamare GPT-5.6
GPT-5.6 è disponibile tramite l'API OpenAI e tramite gateway compatibili con OpenAI, quindi l'integrazione rimane stabile mentre si cambia il modello o il livello sottostante. Quello che segue è un pattern standard compatibile con OpenAI; conferma l'ID del modello corrente prima dell'uso in produzione e blocca il livello esatto piuttosto che un semplice alias.
from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "Rifattorizza questo modulo e spiega i rischi."}],
)
print(response.choices[0].message.content)
Passare da un livello all'altro è una modifica di una sola riga al campo del modello, ed è ciò che rende pratico il routing basato sulla difficoltà: inviare le chiamate di routine a Luna o Terra e inoltrare solo quelle difficili a Sol.
Test di GPT-5.6 tramite OrcaRouter
Un gateway rende GPT-5.6 più facile da adottare per due motivi. Primo, lo stesso client compatibile con OpenAI può chiamare tutti e tre i tier e modelli di confronto come Claude Opus 4.8, GLM 5.2 e Grok 4.5, così puoi eseguire un unico set di valutazione su tutto senza riscrivere codice di integrazione e misurare il costo reale per attività accettata – commissioni degli strumenti, tentativi e il sovrapprezzo di 272K inclusi. Secondo, un gateway può eseguire il failover tra provider e imporre un tetto di budget, così un problema temporaneo di capacità o una chiamata Sol fuori luogo non fa saltare il mese. Conferma la route live di GPT-5.6 e gli attuali ID dei tier prima di costruire un budget su di essi.

Prossimo passo: registrati per OrcaRouter ed esegui il tuo confronto dei tier GPT-5.6 su un singolo endpoint API.
Domande frequenti
Qual è la differenza tra GPT-5.6 Sol, Terra e Luna?
Sono tre livelli della stessa famiglia a prezzi e livelli di capacità diversi. Sol è l'ammiraglia per i lavori più impegnativi ($5/$30), Terra è l'opzione predefinita equilibrata ($2.50/$15), e Luna è il livello economico per attività ad alto volume ($1/$6). Scegli il più basso che supera i tuoi test.
Esiste un livello di prezzo per GPT-5.6 Sol Ultra?
No. "Sol Ultra" è una configurazione multi-agente di ragionamento superiore di Sol, non una riga separata nella pagina dei prezzi. Utilizza più token e costa di più per attività, ma la si considera nel budget come Sol con uno sforzo maggiore.
Perché la mia fattura per GPT-5.6 ha superato una semplice stima?
Di solito token di output, il sovrapprezzo per prompt lunghi 272K (2x input, 1.5x output), livello di servizio Priority, maggiorazione per residenza dei dati, o tentativi. Registra l'intera catena di richieste e misura il costo per attività accettata piuttosto che per prompt.
Posso fare il fine-tuning di GPT-5.6, e c'è un livello gratuito?
No su entrambi. GPT-5.6 non supporta il fine-tuning e l’API non ha un livello gratuito—la fatturazione inizia dal primo token. L’accesso gratuito esiste solo all’interno di alcuni piani di ChatGPT, che è un prodotto separato dall’API.
Quale piano di ChatGPT può utilizzare quale livello?
Varia in base al prodotto. In ChatGPT Work e Codex, gli utenti Free e Go possono usare Terra, mentre gli utenti Plus e superiori possono scegliere tra Sol, Terra e Luna; l'impostazione ultra più alta è limitata a Pro ed Enterprise. Considera i piani API e ChatGPT come separati: una chiave API non eredita l'accesso di un abbonamento.
La conclusione
La storia dei prezzi di GPT-5.6 è la suddivisione in livelli. Sol a $5/$30 guida la classifica dell'intelligenza, Terra a $2.50/$15 è il valore predefinito e la casa naturale per il traffico precedente di GPT-5.5, e Luna a $1/$6 gestisce il volume. La cache riduce l'input ripetuto a un decimo (dopo un premio di scrittura di 1,25x), Batch costa la metà, ma l'output è il lato costoso in ogni livello e i prompt lunghi oltre 272K comportano un sovrapprezzo.
Tratta i tre livelli come un problema di instradamento, non come un singolo acquisto: imposta su basso di default, scala in caso di fallimento, memorizza nella cache il contesto stabile, usa Batch dove la latenza lo consente e mantieni un modello di confronto raggiungibile attraverso lo stesso endpoint. Questo produce un costo per attività accettata molto inferiore rispetto al pagamento delle tariffe premium per il lavoro di routine.
