Una card del titolo generata intitolata 'GPT-6.1 Sol Pricing' con il sottotitolo 'Il listino prezzi, l'unico contatore che si è mosso, e il precipizio dei 272K', sopra una fila di quattro chip arrotondati che riportano 'Input: $2.00 /M', 'Input in cache: $0.10 /M', 'Scrittura cache: $2.50 /M' e 'Output: $10.00 /M', con didascalia 'OpenAI standard tier, rilevato il 7 ottobre 2026', con icone a linee piatte minimali e il logo OrcaRouter compositato nell'angolo in basso a destra.
Guides & Insights

Prezzi di GPT-6.1 Sol: il listino, l'unico contatore che si è mosso e il precipizio dei 272K

Autore

Elias Hawthorne

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Questa pagina è la scheda tariffaria. GPT-6.1 Sol costa $2,00 per milione di token di input, $0,10 per milione di token di input in cache, $2,50 per milione di token di scrittura in cache e $10,00 per milione di token di output sul tier standard del fornitore, e GPT-6 Sol — il gradino che questo modello sostituisce, e quello servito dal nostro catalogo — riporta $2,00, $0,20, $2,50 e $10,00 per gli stessi quattro parametri. Un solo numero differisce tra le due schede, la soglia oltre la quale entrambi applicano il nuovo prezzo si trova nello stesso punto, e gli sconti sotto il prezzo di listino sono moltiplicatori anziché un secondo listino prezzi. Tutto ciò che compare in questa pagina è tratto dalla pagina dei prezzi per sviluppatori del fornitore e dalle sue due pagine dei modelli per GPT-6.1 Sol e GPT-6 Sol, tutte consultate il 7 ottobre 2026, e dalle nostre schede modello laddove una cifra è indicata come nostra. Nessuna narrazione di lancio viene ripetuta qui; se vuoi ciò che è stato rilasciato, quella è una pagina diversa.

Il listino prezzi, con i quattro contatori di GPT-6 Sol direttamente sotto

OpenAI pubblica questi come prezzi per milione di token sul livello di elaborazione standard, per una richiesta pari o inferiore a 272.000 token di input. Le due righe che contano sono adiacenti per precisa scelta progettuale, perché l’intera argomentazione del rilascio è visibile nella coppia: leggendo in sequenza ciascun contatore, esattamente uno di essi cambia.

• Input di GPT-6.1 Sol — 2,00 $ per milione di token, invariato rispetto a GPT-6 Sol.
• Input in cache di GPT-6.1 Sol — 0,10 $ per milione di token, dimezzato rispetto ai 0,20 $ di GPT-6 Sol.
• Scrittura in cache di GPT-6.1 Sol — 2,50 $ per milione di token, invariata rispetto a GPT-6 Sol.
• Output di GPT-6.1 Sol — 10,00 $ per milione di token, invariato rispetto a GPT-6 Sol.

• Input di GPT-6 Sol — 2,00 $ per milione di token.
• Input in cache di GPT-6 Sol — 0,20 $ per milione di token.
• Scrittura in cache di GPT-6 Sol — 2,50 $ per milione di token.
• Output di GPT-6 Sol — 10,00 $ per milione di token.

Tre di quelle otto righe sono lo stesso numero scritto due volte, ed è proprio questo il punto: non è una nuova tariffazione, è un solo indicatore che si muove su un solo modello. Le scritture in cache sono 1,25× la tariffa di input non in cache su entrambe le schede, quindi $2,50 è $2,00 × 1,25 su entrambe — il premio di scrittura è una proprietà della famiglia, non della versione. Le letture in cache sono l'unica voce in cui i due modelli divergono: su GPT-6.1 Sol una lettura in cache è il 5% della tariffa di input, su GPT-6 Sol è il 10%, e OpenAI indica entrambe come frazioni della tariffa di input anziché come prezzi indipendenti.

Una nota su come questa pagina riporta le cifre. OpenAI pubblica il listino come prezzo di listino fisso per metro, senza alcun qualificatore di impegno di ragionamento associato a nessuna delle otto voci sopra, quindi nessuna di esse è quotata a un particolare livello di impegno. L'impegno cambia quanti token consuma un'attività, non quanto costa un token, ed è per questo che il listino è indipendente dall'impegno mentre la tua fattura non lo è. Nulla in questa pagina è un confronto testa a testa a impegno equivalente contro un modello rivale, e nessun confronto di questo tipo è implicito in alcuna parte che segue — dove una cifra dipenderebbe dall'impegno, questa pagina indica l'impegno con cui è stata prodotta.

A generated two-column scoreboard headed 'GPT-6.1 Sol vs GPT-6 Sol - the rate card'. Left column 'GPT-6.1 Sol' rows: 'Input: $2.00 /M', 'Cached input: $0.10 /M', 'Cache write: $2.50 /M', 'Output: $10.00 /M', 'Above 272K input: $4.00 /M', 'Above 272K cached: $0.20 /M'. Right column 'GPT-6 Sol' rows: 'Input: $2.00 /M', 'Cached input: $0.20 /M', 'Cache write: $2.50 /M', 'Output: $10.00 /M', 'Above 272K input: $4.00 /M', 'Above 272K cached: $0.40 /M'. A footer reads 'Standard tier prices per OpenAI's pricing page, read October 7, 2026; the whole request reprices above 272K input tokens.'

L'unica riga che si è mossa: input in cache, da $0,20 a $0,10

Un contatore di input in cache tariffa la parte di una richiesta che non è cambiata. Quando un lungo prefisso stabile — un prompt di sistema, un insieme di schemi di strumenti, un corpus recuperato, la trascrizione accumulata di un ciclo — viene deliberatamente memorizzato affinché la richiesta successiva possa riutilizzarlo, i token riutilizzati vengono fatturati alla tariffa della cache anziché alla tariffa di input, e i token che vengono memorizzati in primo luogo vengono fatturati alla tariffa di scrittura della cache. È uno sconto sulla ripetizione, ed esiste perché l'alternativa per il fornitore è ricalcolare lo stesso prefisso da zero a ogni chiamata.

Dimezzare quel contatore non è lo stesso tipo di notizia che dimezzare il contatore dell'input, e vale la pena essere precisi sulla differenza. La tariffa di input è quanto costa ogni token non in cache della famiglia, quindi dimezzarla sarebbe un riprezzamento dell'intera linea di listino. La tariffa in cache è una profondità di sconto — quanto sotto la tariffa di input si colloca un token riutilizzato — quindi spostarla è una modifica alla ricompensa per un comportamento specifico, non una modifica alla base. La tariffa di input di GPT-6.1 Sol è $2.00, esattamente quanto fa pagare GPT-6 Sol, quindi una richiesta senza prefisso in cache viene fatturata in modo identico sui due modelli. Dimezzare il contatore della cache porta lo sconto dal 90% al 95% di sconto sull'input, e questo raggiunge esattamente i carichi di lavoro i cui prefissi sono abbastanza lunghi e riutilizzati abbastanza spesso da comparire sulla linea. Leggi il contatore spostato come «la stessa attività costa meno se usi la cache» invece che «il modello è diventato più economico», e la card smette di essere sorprendente.

L'aritmetica deriva dalle due righe e da nient'altro. Un milione di token di input in cache costa $0,10 su GPT-6.1 Sol e $0,20 su GPT-6 Sol, quindi il rilascio vale dieci centesimi per milione in cache — una cifra trascurabile su una singola chiamata e rilevante su una lunga esecuzione, perché un prefisso in cache viene letto una volta per turno. Le scritture in cache restano invariate a $2,50, quindi il punto di pareggio per l'uso della cache in quanto tale non è modificato dal rilascio: il ritorno sul sovrapprezzo di scrittura deriva dal riutilizzo del prefisso, non da quale delle due tariffe in cache si applichi.

Oltre 272.000 token di input, l'intera richiesta viene ricalcolata

Entrambe le schede prevedono un livello per contesto lungo, e la pagina dei prezzi di OpenAI enuncia la regola allo stesso modo per entrambe: i prompt con più di 272K token di input vengono fatturati a tariffe di input e cache pari a 2× e output pari a 1,5× per la richiesta completa. L'intera richiesta viene ricalcolata — non solo i token oltre la soglia. Questa è la frase da portare con sé da questa sezione, perché è il punto in cui un listino prezzi smette di essere una tabella di consultazione: a 272.001 token di input l'intera richiesta, incluso il primo token, viene fatturata alle colonne del contesto lungo.

La scheda con prezzo aggiornato per GPT-6.1 Sol, oltre 272.000 token di input:

• Input — $4.00 per milione di token, 2× la tariffa del contesto breve.
• Input in cache — $0.20 per milione di token, 2× la tariffa del contesto breve.
• Scrittura in cache — $5.00 per milione di token, 2× la tariffa del contesto breve.
• Output — $15.00 per milione di token, 1.5× la tariffa del contesto breve.

E lo stesso livello su GPT-6 Sol, così che le due righe possano essere confrontate tra loro:

• Input — $4.00 per milione di token.
• Input in cache — $0.40 per milione di token.
• Scrittura cache — $5.00 per milione di token.
• Output — $15.00 per milione di token.

Ancora una volta, l'intera richiesta viene riprezzata, non l'eccedenza, perciò un prompt da 273.000 token viene fatturato a 4,00 $ di input per tutti i 273.000 token anziché a 2,00 $ per i primi 272.000 e a 4,00 $ per l'ultimo migliaio. Ciò rende il superamento della soglia un gradino anziché una pendenza, e fa apparire diversa la variazione dell'input in cache sopra la soglia rispetto a sotto di essa. I 0,20 $ che GPT-6.1 Sol addebita per una lettura in cache oltre i 272K sono esattamente la tariffa che GPT-6 Sol applica al di sotto di tale soglia, quindi un carico di lavoro con contesto lungo sul modello più recente paga la cifra pre-rilascio. Il risparmio resta in termini relativi sopra la soglia — 0,20 $ contro gli 0,40 $ di GPT-6 Sol è comunque un dimezzamento — ma il prezzo di richiamo di dieci centesimi non si applica alla richiesta che supera la soglia, perché quella richiesta non viene affatto fatturata sulla scheda del contesto breve.

A screenshot of OpenAI's own developer pricing page headed 'Our latest models' and 'Prices per 1M tokens.', with column groups 'Short context' and 'Long context', each headed Model, Input, Cached input, Cache writes, Output. The gpt-6.1-sol row reads $2.00, $0.10, $2.50 and $10.00 in the short-context columns and $4.00, $0.20, $5.00 and $15.00 under long context; a gpt-6-astra row sits above it and a gpt-6-luna row below. Beneath the rows are three footnotes covering the 10% regional-processing uplift for models released on or after March 5, 2026, the rename of priority processing to Fast mode on July 30, 2026, and GPT-5.6 Sol's promotional pricing being available at least through November 21, 2026.

Le fasce di sconto, come moltiplicatori

Tutto ciò che si trova al di sotto del prezzo di listino standard è un moltiplicatore applicato alla scheda precedente anziché un prezzo a sé stante. Il fatto di esprimerli come moltiplicatori è ciò che li rende trasferibili: gli stessi tre fattori si applicano a tutti e quattro i contatori su entrambi i modelli, così un lettore che dispone della scheda standard ha l'intera struttura dei livelli.

• Batch — 50% dello standard. Il prezzo Batch di OpenAI è esattamente la metà su tutti e quattro i parametri di entrambi i modelli: $1.00 input, $0.05 input in cache, $1.25 scrittura cache e $5.00 output per milione su GPT-6.1 Sol, e $1.00, $0.10, $1.25 e $5.00 su GPT-6 Sol.
• Flex — 50% dello standard, e identico a Batch su entrambi i modelli riga per riga, quindi la scelta tra i due è una scelta di programmazione più che di prezzo.
• Fast mode — 2× lo standard su tutti e quattro i parametri di entrambe le schede, senza alcuna eccezione elencata su nessuna delle due tabelle dei prezzi. Fast mode costa $4.00 input, $0.20 input in cache, $5.00 scrittura cache e $20.00 output per milione su GPT-6.1 Sol, contro $4.00, $0.40, $5.00 e $20.00 su GPT-6 Sol — le due righe differiscono solo sulla voce della cache, e solo dello stesso fattore 2× che la tariffa standard della cache di ciascun modello già presenta.
• Elaborazione regionale — un incremento del 10% in aggiunta al livello applicabile, per i modelli rilasciati il 5 marzo 2026 o in seguito, su qualsiasi residenza diversa da quella predefinita.

La modalità Fast ha una restrizione di disponibilità che il solo prezzo non rivela. La pagina del modello GPT-6.1 Sol di OpenAI stessa dichiara che Fast mode non è disponibile con la residenza dei dati nell'UE, e le sue linee guida sulla residenza dei dati elencano GPT-6.1 Sol tra i modelli che supportano la residenza UE con l'elaborazione Standard, Flex e Batch. Quindi all'interno dell'UE la scala dei livelli è più corta di due pioli, non di uno: i livelli a metà prezzo ci sono e il livello dal prezzo doppio no. Un lettore che confronta un deployment europeo con uno statunitense dovrebbe confrontarlo con Standard, perché quello è il livello più veloce disponibile — citare un dato di Fast mode per un carico di lavoro nell'UE descrive una configurazione che il fornitore non offre.

Niente su questa carta è promozionale, e niente ha una scadenza.

Le righe di GPT-6.1 Sol qui sopra riportate sono la tariffa di listino. La pagina dei prezzi di OpenAI non associa loro alcun qualificatore promozionale né una data di fine, e nessuno dei quattro contatori su nessuna delle due schede, a contesto breve o lungo, è contrassegnato come cifra a tempo limitato. Vale la pena affermarlo esplicitamente, perché la famiglia ha un controesempio che si trova sulla stessa pagina: il prezzo promozionale di GPT-5.6 Sol riporta una nota a piè di pagina che lo impegna almeno fino al 21 novembre 2026, il che significa che qualsiasi prezzo di GPT-5.6 Sol quotato oggi è un prezzo con un punto di revisione noto allegato. Nulla su GPT-6.1 Sol presenta quella forma.

La conseguenza pratica è che questa pagina non ha bisogno di un avviso di verifica della data sui numeri stessi — ne ha bisogno sulla pagina che stai leggendo, perché una tariffa di listino può cambiare senza che sia scattata una data di scadenza. Significa anche che la scheda GPT-6.1 Sol è la riga giusta su cui costruire un modello di costo se stai scegliendo tra i due livelli di Sol e vuoi che il confronto resti stabile: anche il misuratore in cache da $0,20 di GPT-6 Sol è una normale tariffa di listino senza alcuna promozione abbinata, quindi il divario di dieci centesimi tra i due è una differenza strutturale tra le schede, piuttosto che uno sconto temporaneo che un modello applica contro l'altro.

Come interpretare l'affermazione sul prezzo di GPT-6.1 Sol di chiunque altro

Due domande risolvono ogni disaccordo su quanto costa un modello di classe Sol, ed entrambe trovano risposta nella scheda piuttosto che nella prosa che la circonda.

• Quale metrica viene quotata? Input, input in cache, scrittura in cache e output sono quattro numeri diversi nella stessa richiesta, e un singolo prezzo di riferimento è quasi sempre la metrica di input, con le altre tre lasciate implicite. Un'affermazione che si legge come un costo totale è di solito una tariffa di input moltiplicata per un mix di token presunto, ed è nel mix presunto che risiede il disaccordo.
• Quale fascia di contesto è stata presunta? Le schede del contesto breve e del contesto lungo differiscono di 2× sull'input e sulla cache e di 1,5× sull'output, e la fascia viene selezionata dall'intera richiesta anziché dall'eccedenza, quindi una cifra quotata senza indicare la fascia è una cifra che cambia nel momento in cui la richiesta supera i 272.000 token di input.
• Quale livello di elaborazione è stato presunto? Standard, Batch, Flex e Fast differiscono di fattori di 2× e del 50%, e un prezzo quotato senza dire quale sia è un prezzo che porta con sé un fattore di quattro di ambiguità prima ancora che venga posta qualsiasi domanda sulla metrica.
• Quale livello di effort è stato presunto, se è coinvolto un conteggio di token? Le tariffe sono indipendenti dall'effort, ma i conteggi dei token no, quindi qualsiasi cifra di costo per attività eredita l'effort di ragionamento con cui è stata misurata — e un confronto tra due modelli con impostazioni di effort diverse non è un confronto dei loro prezzi.

Rispondi a quei quattro e un'affermazione sul prezzo o regge o non regge. Quello che non deve fare è essere confrontata con i quattro contatori di questa pagina senza che prima siano nominati la fascia e il contatore, perché le due schede sono adiacenti proprio affinché sia visibile l'unica linea in movimento e nient'altro venga scambiato per essa.

A screenshot of the OrcaRouter model page for openai/gpt-6-sol showing the breadcrumb 'Home / Models / OpenAI', the title 'GPT-6 Sol', the slug openai/gpt-6-sol, 'Max output 128K', a context figure of 1M tokens, a chip row reading $2.00, $10.00, 1.44 s, 10.00 s and 950.6K, the buttons 'Get the GPT-6 Sol API', 'Try in playground' and 'Use via API', an OpenAI-compatible code sample against https://api.orcarouter.ai/v1, and a description stating that GPT-6 Sol is the cost-efficient high-end model in OpenAI's GPT-6 series, above the fast GPT-6 Luna tier and below the flagship GPT-6 Astra.

Dove viene servito il livello GPT-6 Sol

OrcaRouter serve il livello GPT-6 alla tariffa di listino di OpenAI senza aggiungere nulla. La pagina del modello su https://www.orcarouter.ai/models/openai/gpt-6-sol riporta GPT-6 Sol a 2,00 $ per l'input e 10,00 $ per l'output per milione di token, corrispondente riga per riga alla scheda qui sopra, con 0% di ricarico, e il catalogo conta più di 200 modelli alle stesse condizioni. La nostra scheda per quella rotta riporta gli stessi 0,20 $ di input in cache e 2,50 $ di scrittura in cache che OpenAI pubblica, quindi i numeri concordano voce per voce; considera ogni cifra relativa alla cache presente su questa pagina come una riformulazione della tariffa pubblicata da OpenAI, non come una nostra quotazione indipendente. Anche GPT-6.1 Sol è presente nel nostro catalogo — la scheda attiva per openai/gpt-6.1-sol riporta una data di rilascio del 29 settembre 2026, con entrambi i livelli di prezzo che rispecchiano quelli di OpenAI e un conteggio dei token su sette giorni nell'ordine delle centinaia di milioni — quindi chi desidera il livello più recente dovrebbe leggere i numeri di quella pagina stessa invece di considerare questa pagina come l'ultima parola al riguardo. I prezzi cambiano; la pagina è la quotazione.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno