Illustrazione editoriale in stile flat-vector per l'hero di un blog tecnologico sui prezzi dei modelli di punta: un grande chip del modello dagli angoli arrotondati in blu scuro con un morbido bagliore ciano su uno sfondo chiaro, un'etichetta di prezzo di carta fissata al suo angolo, tre flussi di token che escono dal chip e confluiscono in un indicatore di prezzo circolare con piccoli tick astratti, una piccola pila di blocchi cache accanto all'indicatore e un sottile foglio di calendario che scivola da sinistra. Sfondo bianco con accenti sfumati blu e ciano tenui e un sottile riflesso caldo; icone minimaliste flat; tipografia geometrica sans-serif moderna e pulita; nessun testo leggibile.
Guides & Insights

GPT-5.6 Sol API Prezzi: $4 / $20 per 1 milione di token dopo il taglio del prezzo.

Autore

Gideon Frost

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

GPT-5.6 Sol costa $4,00 per milione di token di input e $20,00 per milione di token di output sull'API GPT-5.6 Sol ad oggi — lo stesso tasso di pass-through che il livello di punta pratica sul directory OrcaRouter, verificato il 25/08/2026 a markup zero. Il 24 agosto 2026, OpenAI ha ridotto il prezzo API di Sol del 20% sull'input e di circa il 33% sull'output, una promozione temporanea che durerà almeno fino al 21 novembre 2026. È ancora il livello più costoso della famiglia GPT-5.6, ed è il primo livello il cui prezzo di listino è cambiato dal taglio del 30 luglio, che ha saltato il livello di punta. Le leve contano più del titolo: l'input riutilizzato viene fatturato a $0,40 per milione tramite prompt caching, l'API batch scende a $2,00 / $10,00, e la modalità veloce comporta un premio di 2x in cambio di una velocità fino a 2,5x. Questa pagina è il riferimento dei prezzi per Sol specificamente — la scheda tariffaria esatta, quanto costa effettivamente una richiesta, come si confronta il livello di punta con gli altri, quando è la scelta sbagliata e come chiamarlo tramite un endpoint compatibile con OpenAI con la propria chiave.

I prezzi sono per milione di token (input / output), aggiornati al 2026-08-25. Il taglio — 20% sull'input, circa 33% sull'output, in vigore almeno fino al 21 novembre 2026 — è l'annuncio di OpenAI stesso, riportato al valore nominale; le cifre in dollari sono lette dalle tariffe API pubblicate da OpenAI e verificate incrociando la pagina del modello OrcaRouter per GPT-5.6 Sol. Le tariffe per cache, batch, modalità veloce e contesto lungo sono annunciate da OpenAI. Si tratta di tariffe promozionali, non di un reset permanente: i prezzi cambiano e possono cambiare di nuovo; verifica prima di creare la tua soluzione.

Il prezzo esatto, verificato oggi

Ecco la scheda tariffaria completa per GPT-5.6 Sol, verificata il 2026-08-25 alle tariffe promozionali. Le stesse tariffe si applicano alle richieste che utilizzano l'alias gpt-5.6, e le riduzioni sono in fase di distribuzione per i piani di credito ChatGPT Work e Codex idonei; gli abbonamenti ChatGPT Pro, Plus e Business rimangono invariati.

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

• Input — $4,00 per 1 milione di token in caso di cache miss (in calo rispetto a $5,00, sconto del 20% fino al 21 novembre).

• Output — $20,00 per 1M token (in calo rispetto a $30,00, ~33% di sconto fino al 21 novembre).

• Lettura della cache del prompt — $0,40 per 1M di token (prima $0,50), uno sconto del 90% su qualsiasi input che reinvii.

• Scrittura cache del prompt — $5.00 per 1M token (era $6.25).

• Long-context tier — gli input oltre circa 272K token vengono fatturati a $8,00 per input / $30,00 per output (prima $10,00 / $45,00; gli stessi multipli di 2x sull'input e 1,5x sull'output ora si applicano sulla base inferiore).

• Batch API — $2.00 input / $10.00 output, uno sconto fisso del 50% (era $2.50 / $15.00), asincrona, in genere pronta entro circa 24 ore.

• Modalità veloce — $8.00 di input / $40.00 di output (prima $10.00 / $60.00), un premio di 2x per una velocità di output fino a circa 2.5x senza variazioni nell'intelligenza.

• Finestra di contesto — ~1,05M token, fino a 128K di output.

{{1}}OrcaRouter trasmette la tariffa del fornitore senza alcun ricarico{{/1}}, quindi {{2}}la cifra riportata nella directory è quella che paghi{{/2}} — e {{3}}una riduzione del fornitore compare nell'elenco lo stesso giorno in cui entra in vigore{{/3}}. {{4}}Nella pagina del modello live, la scheda mostra $4.00 / $20.00 per 1M, cache read $0.400{{/4}}, {{5}}con i badge Vision, Tools, JSON e Reasoning{{/5}}. {{6}}È la prima volta che il prezzo di listino di Sol si muove dalla riduzione del 30 luglio{{/6}}, {{7}}che ha portato GPT-5.6 Luna a $0.20 / $1.20 e GPT-5.6 Terra a $2 / $12 mentre il modello di punta è rimasto invariato{{/7}}; {{8}}la riduzione del 24 agosto è il turno del modello di punta{{/8}}.

Le leve che modificano il prezzo effettivo

La tariffa base è solo il punto di partenza. Quattro modificatori cambiano quanto Sol ti costa effettivamente:

• Prompt caching — il contesto riutilizzato costa $0,40 per milione invece di {{1}}$4{{/1}} per nuovo, e le scritture in cache costano $5,00 per milione. Per qualsiasi agente o chat che {{2}}rinvia un grande prefisso a ogni turno{{/2}}, la cache è {{3}}la singola leva più importante sulla bolletta{{/3}}. OpenAI associa la cache {{4}}per progetto e chiave API{{/4}}, quindi {{5}}restare su una sola chiave (canale){{/5}} è ciò che mantiene i colpi a segno.

• Fascia long-context — una richiesta il cui input supera circa 272K token passa dalla tariffa base a $8 / $30. Alcuni prompt enormi possono far aumentare silenziosamente il prezzo medio, quindi raggruppa o tronca quando non hai realmente bisogno del contesto profondo.

• Batch — L'API batch di OpenAI esegue i job in modalità asincrona, con un tempo di completamento di circa 24 ore a esattamente metà prezzo: $2,00 / $10,00, con input in cache a $0,20 e scritture in cache a $2,50. È cumulabile con il prompt caching e si adatta a valutazioni, classificazione in blocco e generazione offline dove la latenza non è rilevante.

• Modalità Fast — $8 / $40 per una produttività di output fino a ~2,5 volte superiore, utile per lavori critici in termini di latenza con utenti in attesa, come l'assistenza alla codifica in tempo reale. Viene fatturata per token a 2 volte la tariffa standard, non viene conteggiata nei pacchetti TPM Scale Tier acquistati e può ripiegare sull'elaborazione standard se si supera il limite di velocità condiviso.

Quanto costa realmente una richiesta

I prezzi per token sono astratti, quindi ecco alcuni esempi concreti alle tariffe attuali:

• Chiamata chat singola, 50K input + 20K output — $0.20 + $0.40 = $0.60 (era $0.85).

• 1M input + 1M output — $4 + $20 = $24 (era $35).

• Turno agentico, 200K di contesto in cache + 20K di input fresco + 30K di output — $0,08 + $0,08 + $0,60 = $0,76. Lo stesso turno con cache fredda — 220K di input fresco a $0,88 più $0,60 di output — ammonta a $1,48. La cache lo riduce all'incirca della metà.

• Un mese da 10M token con una suddivisione 70% input / 30% output, con l'80% dell'input servito dalla cache: 1,4M di input fresco ($5,60) + 5,6M di input in cache ($2,24) + 3M di output ($60) ≈ $68. Senza cache, lo stesso mese costa $88 — e lo stesso mese su GPT-5.6 Terra costa circa $50, o circa $5 su GPT-5.6 Luna. Questa differenza di ~14x tra Sol e Luna è il motivo per cui abbinare il livello giusto conta più di qualsiasi tariffa singola.

Due avvertenze fanno aumentare la tariffa effettiva. Sol è un modello di ragionamento: i token di ragionamento interni vengono fatturati come output a 20 dollari per milione. Un prompt complesso con un'impostazione di reasoning effort elevata può spendere gran parte del budget di output in elaborazione, quindi il costo effettivo dell'output su lavori difficili supera di molto una stima approssimativa. Inoltre, il tokenizer di OpenAI è più verboso di quello della generazione precedente su alcuni input, quindi lo stesso testo può costare più token di quanti ne costerebbe su GPT-5.5. Adatta il reasoning effort al compito, limita l'output dove puoi e misura l'utilizzo effettivo prima di stimare la fattura.

Come i prezzi di Sol si confrontano con la concorrenza

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Letto rispetto ai prezzi di listino pubblicati il 2026-08-25 (Sol alla sua tariffa promozionale). La copertura stampa interpreta il taglio come una risposta alla pressione sui prezzi da parte di Anthropic e dei laboratori cinesi — questa è un'interpretazione di terze parti, non una dichiarazione di OpenAI.

• GPT-5.6 Terra — $2 / $12, il livello medio post-taglio. Sol ora costa il doppio in input e circa 1,7 volte in più in output; Terra è l'opzione predefinita quando non serve il ragionamento di punta.

GPT-5.6 Luna — $0.20 / $1.20, il livello di volume post-taglio. Un divario di input di 20x rispetto a Sol; Luna è prezzata per la maggior parte del traffico semplice.

• Claude Opus 5 — $5 / $25. Sol ora è il 20% più economico sia in input che in output, sulla carta, rispetto a eguagliare Opus 5 in input alle vecchie tariffe. Il confronto era già favorevole a Sol prima del taglio: questo blog aveva già misurato Sol con circa il 34,5% di token in meno rispetto a un modello Anthropic sullo stesso campione in inglese/misto, e un'analisi pubblicata di token-economics (TheBlockBeats) stimava che la fattura totale di Sol possa essere inferiore di circa il 21% rispetto a Claude Opus 5 per un lavoro equivalente, anche quando la tariffa di output di Sol era più alta. Misura il tuo tokenizer, non il prezzo di listino.

• Claude Fable 5 — $10 / $50. Sol è ora il 60% più economico in input e il 60% più economico in output rispetto al livello superiore di Anthropic (prima era 50% / 40% con le vecchie tariffe).

• Claude Opus 4.8 — $5 / $25. Sol è ora il 20% più economico in input e il 20% più economico in output — il vantaggio sul prezzo di listino rispetto alla punta di diamante della generazione precedente di Anthropic si è completamente ribaltato.

• Grok 4.6 — $2 / $6. Il numero più interessante in classifica: ha eguagliato GPT-5.6 Sol nell'indice Artificial Analysis (entrambi 61) con input 2x più economico e output ~3.3x più economico, in calo rispetto al divario di 2.5x / 5x delle vecchie tariffe.

• DeepSeek V4 Pro — $0.44 / $0.88 fuori punta (negli orari di punta raddoppia). Un universo di prezzi completamente diverso, per la fascia economica dei modelli open-weights.

La lettura onesta: Sol è ancora un'ammiraglia premium, ma il taglio l'estromette dalla fascia di prezzo più alta — l'output da $20 ora costa meno dei $25 di Claude Opus 5 e dei $25 di Claude Opus 4.8, lasciando i $50 di Claude Fable 5 come unica tariffa di output tra le ammiraglie proprietarie a essere superiore. Vince sul costo effettivo per unità di lavoro pesante (il suo tokenizer, il suo ragionamento, il suo contesto lungo) piuttosto che sulla tariffa assoluta, e il taglio del 24 agosto rafforza questa tesi. Se il tuo traffico è fatto di prompt brevi e attività semplici, una Terra da $2, una Luna da $0.20 o un Grok 4.6 da $2/$6 è ancora la scelta più economica — e nell'indice, Grok 4.6 sulla carta non è da meno.

Quando Sol è la scelta sbagliata.

Quattro casi in cui questo prezzo non è quello che desideri:

Prompt brevi e semplici. Al di sotto di circa 20K token senza ragionamento approfondito, il modello premium di punta è sprecato. GPT-5.6 Terra a $2 / $12 oppure GPT-5.6 Luna a $0.20 / $1.20 gestisce la fascia di volume a una frazione del costo, e un modello di classe Grok 4.6 o DeepSeek costa ancora meno.

Volume ad alta intensità di ragionamento. Poiché il pensiero viene fatturato come output, un prompt complesso ad alto sforzo può costare ben più della tariffa di output nominale. Se il tuo carico di lavoro è costituito da molte chiamate difficili, misura i token di output effettivi prima di impegnarti: la tariffa effettiva può sorprenderti.

Prezzo per token come unico obiettivo. Grok 4.6 ha pareggiato con Sol nell'indice a $2 / $6, e DeepSeek V4 Pro si attesta a $0.44 / $0.88 in fascia non di punta. Se un punteggio di benchmark di frontiera non è il requisito vincolante, questi modelli offrono tariffe per token molto più basse per la stessa classe di lavoro.

Budget di latenza rigorosi. Sol è un grande modello di ragionamento, quindi il tempo al primo token è ben superiore a quello di un modello di livello Flash. Per la chat in tempo reale in cui il TTFT sub-secondo è importante, la modalità veloce a $8 / $40 acquista throughput, non una latenza del primo token inferiore — e un modello più piccolo rimane la soluzione più economica.

Come chiamarlo su OrcaRouter

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol è ospitato su OrcaRouter con ID modello openai/gpt-5.6-sol, servito tramite l'endpoint compatibile OpenAI all'indirizzo api.orcarouter.ai/v1 alla tariffa del fornitore con zero ricarico. Se hai già un client OpenAI, la migrazione è un cambio di URL di base e di ID modello — nient'altro. La stessa chiave e lo stesso endpoint supportano oltre 200 modelli, quindi Sol si affianca a GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 e ai modelli open-weight con cui vorresti confrontarlo, e puoi instradare le richieste in base alla difficoltà invece di dover integrare nuovamente ciascuno di essi.

Due caratteristiche specifiche di OrcaRouter degne di nota in una pagina dei prezzi.BYOK: porta la tua chiave OpenAI e OpenAI ti fattura direttamente alle sue tariffe — OrcaRouter aggiunge $0 per token e mantiene intatti i limiti di velocità e i crediti del tuo provider.Guardrails: lo scudo PII e la content policy vengono applicati prima della fatturazione, quindi una richiesta bloccata restituisce un 400 pulito e non viene mai addebitata, e l'Agent Firewall valuta le chiamate agli strumenti e MCP prima che vengano eseguite.

La nota di onestà che conta per una pagina di prezzi: instradiamo il modello, non ne fissiamo noi il prezzo.La cifra di $4 / $20 è la tariffa promozionale di OpenAI applicata senza ricarico — e quando OpenAI l'ha modificata il 24 agosto, la tariffa mostrata è stata aggiornata lo stesso giorno, che è esattamente il motivo per cui questa pagina è datata. Se chiami OpenAI direttamente ottieni la stessa tariffa; OrcaRouter esiste per il percorso con chiave singola e zero ricarichi, se vuoi un unico endpoint per tutta la linea di modelli.

Fonti e data

Tutti i prezzi sopra indicati sono stati verificati il 25 agosto 2026. I dati relativi a GPT-5.6 Sol sono tratti dai prezzi API pubblicati da OpenAI, incrociati con la pagina del modello OrcaRouter per GPT-5.6 Sol (controllata lo stesso giorno) e con i resoconti stampa del taglio del 24 agosto (Indian Express, Economic Times, The Star); le tariffe per batch, modalità veloce, cache-write e contesto lungo sono quelle annunciate da OpenAI. I dati relativi a Claude, Grok e DeepSeek corrispondono alle attuali voci della directory OrcaRouter, con DeepSeek V4 Pro indicato alla sua tariffa fuori punta. Il prezzo di listino di Sol è rimasto invariato dal lancio del 9 luglio fino al taglio del 30 luglio e si è mosso per la prima volta il 24 agosto con questa promozione — ed è esattamente per questo che la data è importante qui: le tariffe di $4 / $20 sono temporanee e i prezzi cambiano; tratta qualsiasi pagina "GPT-5.6 Sol pricing" precedente o successiva che trovi in base alla data di verifica riportata. I numeri qui riportati sono aggiornati a oggi.

Ogni prezzo sopra è il tasso live su GPT-5.6 Sol on OrcaRouter — verificato il 2026-08-25 a zero markup, pronto per la tua chiave personale.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno