Una card di confronto generata intitolata "Stessa card, a una riga di distanza", con un pannello sinistro etichettato "GPT-6 Sol Pro" che riporta "Base: gpt-6-sol, rilasciato il 22 settembre 2026", "Input / output: $2.00 / $10.00 per 1M", "Input in cache: $0.20 per 1M" e "Modalità Pro: reasoning.mode, tariffe standard", e un pannello destro etichettato "GPT-6.1 Sol Pro" che riporta "Base: gpt-6.1-sol, rilasciato il 29 settembre 2026", "Input / output: $2.00 / $10.00 per 1M", "Input in cache: $0.10 per 1M" e "Modalità Pro: reasoning.mode, tariffe standard". Un piè di pagina recita "I dati di OpenAI sono dichiarati dal fornitore; nessuna valutazione indipendente di nessuna delle due configurazioni pro è stata pubblicata al 30 settembre 2026", e il logo OrcaRouter si trova nell'angolo in basso a destra.
Guides & Insights

GPT-6.1 Sol Pro vs GPT-6 Sol Pro: stesso listino prezzi, a una riga di distanza

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Due settimane separano le release e quasi nulla separa i costi, ed è per questo che il confronto tra GPT-6.1 Sol Pro e GPT-6 Sol Pro è breve e insolitamente preciso. Entrambi i nomi si risolvono nello stesso tipo di cosa — un modello base più reasoning.mode impostato su pro nella Responses API — quindi nessuno dei due ha un proprio identificatore, un proprio listino prezzi o un proprio sovrapprezzo. GPT-6.1 Sol Pro è GPT-6.1 Sol, rilasciato il 29 settembre 2026, in esecuzione in modalità pro. GPT-6 Sol Pro è GPT-6 Sol, rilasciato il 22 settembre 2026, in esecuzione nella stessa modalità. Entrambi espongono 1.050.000 token di contesto e 128.000 token di output massimo, entrambi fatturano 2,00 $ per milione di token di input e 10,00 $ per milione di token di output, ed entrambi prezzano il lavoro extra della modalità a quelle stesse tariffe standard. Ciò che differisce davvero è una riga del contatore, un gradino della scala dello sforzo, e quanta evidenza indipendente esiste dietro l'una o l'altra configurazione.

Entrambi i nomi sono la stessa parola per lo stesso interruttore

Partiamo dal meccanismo, perché è la ragione per cui questo confronto ha così poche righe. OpenAI vendeva Pro come prodotto nell'era GPT-5 — gpt-5-pro, gpt-5.2-pro, gpt-5.4-pro, gpt-5.5-pro, o1-pro, o3-pro — ciascuno con il proprio identificatore e il proprio contatore premium, fino a 150,00 $ in input e 600,00 $ in output per milione di token su o1-pro. Poi il meccanismo è cambiato e il vocabolario no. Pro è diventato un valore che si imposta sul modello di punta, prezzato alle tariffe del modello di punta stesso, e la pagina delle deprecazioni di OpenAI lo dice con parole sue: quando quei vecchi contatori andranno in pensione tra ottobre e dicembre 2026, il sostituto consigliato è gpt-5.6-sol con reasoning.mode: pro — un modello più una modalità, non un prodotto successore.

Lo schema API pubblico del fornitore concorda. Cercando al suo interno identificatori dell'era GPT-6, ne emergono quattro: gpt-6-astra, gpt-6-sol, gpt-6-luna e gpt-6.1-sol. Tra di essi non compare alcuna variante pro, e nessuna variante pro compare nemmeno nel listino prezzi. Ciò che è comparso, nel giro di poche ore dal lancio del livello 6.1, sono stati elenchi pro per l'intera famiglia in cataloghi di terze parti — 6.1 Sol Pro, 6 Sol Pro, 6 Luna Pro, 5.6 Sol Pro — ognuno dei quali citava la scheda del proprio modello base. Si tratta di una riga di catalogo abbellita con un nome, non di un fornitore che commercializza un prodotto, ed è per questo che i due soggetti di questo confronto sono una modalità su due modelli base diversi anziché due distribuzioni.

Su cosa differiscono effettivamente le due configurazioni

A screenshot of the flagship-model table on OpenAI's pricing page, whose columns run input, cached input, cache writes and output for short context and then the same four for long context. Three rows are visible and none of them is gpt-6-sol: gpt-6-astra reading $10.00, $1.00, $12.50 and $50.00 short context against $20.00, $2.00, $25.00 and $75.00 long context; gpt-6.1-sol reading $2.00, $0.10, $2.50 and $10.00 short context against $4.00, $0.20, $5.00 and $15.00 long context; and gpt-6-luna reading $0.10, $0.01, $0.125 and $0.50 short context against $0.20, $0.02, $0.25 and $0.75 long context.

Ecco ogni dimensione che li separa, entrambi i lati su una riga:

• A cosa corrisponde il nome — gpt-6.1-sol con reasoning.mode: "pro" rispetto a gpt-6-sol con reasoning.mode: "pro"; né il fornitore né il catalogo pubblicano un identificatore -pro per nessuno dei due
• Data di rilascio del modello base — 29 settembre 2026 contro 22 settembre 2026, a sette giorni di distanza
• Prezzo di input — $2,00 per milione di token su entrambi, quindi il volume di input extra della modalità pro costa lo stesso per unità su entrambi i livelli
• Prezzo di output — $10,00 per milione di token su entrambi, e questa è la tariffa a cui vengono fatturati i token di ragionamento aggiuntivi della modalità, poiché la modalità pro cambia il volume e non il prezzo
• Input in cache — $0,10 per milione su 6.1 Sol contro $0,20 su 6 Sol; l'unica voce pubblicata in cui le due tariffe non concordano
• Scritture in cache — $2,50 per milione di token su entrambi
• Riprezzamento per prompt lunghi — oltre 272.000 token di input l'intera richiesta viene riprezzata a 2× le tariffe di input e cache e 1,5× l'output su entrambi, il che porta 6.1 Sol a $4,00 di input, $0,20 in cache, $5,00 di scrittura in cache e $15,00 di output per milione, contro $4,00, $0,40, $5,00 e $15,00 su 6 Sol — lo sconto cache sopravvive intatto al riprezzamento
• Contesto e limite massimo di output — 1.050.000 token di contesto e 128.000 token di output massimi su entrambi
• Scala dello sforzo di ragionamento — low, medium (predefinito), high, xhigh e max su 6.1 Sol, con none e minimal non supportati; la stessa scala su 6 Sol con none ancora disponibile
• Cutoff delle conoscenze documentato — 30 aprile 2026 sul livello 6.1; non abbiamo verificato quello di 6 Sol nelle pagine che abbiamo consultato, quindi considera quella riga come non definita anziché come una differenza
• Valutazione indipendente — una pagina di terze parti pubblicata per GPT-6 Sol, nessuna per GPT-6.1 Sol, e nessuna valutazione di una configurazione pro per nessuno dei due

Leggi la lista e la forma della decisione emerge da sola. Una riga è una differenza reale e pubblicata — la tariffa per input in cache, che si dimezza. Una riga è una capacità che perdi anziché guadagnare — non poter abbinare la modalità a effort: none sul tier più recente, cosa che conta per chiunque usi quella combinazione per mantenere bassa la latenza su attività di tipo routing. Tutto il resto è identico, inclusa la regola di riprezzamento che intercetta qualsiasi richiesta che superi i 272.000 token.

Il divario probatorio, detto chiaramente

È qui che il confronto smette di essere simmetrico. GPT-6 Sol ha un vero riscontro di terze parti: la classifica neutrale che questo blog usa come riferimento esterno gli assegna 47,5 sull'Intelligence Index, al 12º posto su un campione di 145 modelli, e le nostre stesse rotte portano un record di prestazioni misurato per la configurazione standard — una latenza mediana di circa 1,24 secondi, all'incirca 65 token al secondo e un tasso di errore dello 0,16% su circa 167 milioni di token di traffico. GPT-6.1 Sol non ha nulla di tutto ciò. La pagina della classifica per lo slug 6.1 restituisce un 404 e la stringa non compare nella classifica in tempo reale, quindi ogni punteggio che vedete citato oggi per esso proviene dal fornitore.

Due avvertenze al riguardo, ed entrambe vanno contro il sovrainterpretare ciò che effettivamente abbiamo. Il dato di latenza misurato appartiene alla configurazione standard; la modalità pro svolge più lavoro del modello prima di restituire un'unica risposta finale, quindi è più lenta per costruzione e quel numero non è trasferibile a un'esecuzione in modalità pro. E nessuna board di terzi pubblica una valutazione separata di una configurazione pro su alcun modello di questa famiglia: la board misura la configurazione che misura e non separa la modalità. Quindi lo stato onesto delle evidenze è un 6 Sol misurato in modalità standard contro un livello 6.1 descritto dal fornitore, con la modalità pro, su entrambi i fronti, che si basa unicamente sulla descrizione del fornitore.

Tre casi, e cosa dovrebbe fare ciascuno

• Esegui già la modalità pro su GPT-6 Sol e si ripaga da sola. Resta su gpt-6-sol per ora e mantieni il carico di lavoro su cui l'hai misurata. Il livello 6.1 dimezza la tariffa dell'input in cache, che su un prefisso riutilizzato, a volume, rappresenta denaro reale, ma la modalità stessa è documentata facendo riferimento all'identificatore 6.1 in un solo punto — l'esempio svolto della guida al ragionamento — e da nessuna parte sulla pagina di quel modello. Aspetta che la documentazione per modello del fornitore si aggiorni prima di spostare un percorso che hai già validato
• Non hai mai misurato affatto la modalità pro. Inizia dal livello 6.1 in modalità standard, poi esegui un braccio pro accanto ad esso allo stesso reasoning.effort. Ottieni la voce cache più economica sul braccio che manterrai, lo snapshot più recente e una misurazione del moltiplicatore della modalità sul tuo traffico invece di un'aspettativa presa in prestito
• Il tuo traffico è dominato da un prefisso stabile — istruzioni, schemi degli strumenti, un lungo prompt di sistema. Questo è l'unico caso in cui il livello 6.1 vince sul prezzo prima di qualsiasi misurazione, perché l'unica voce pubblicata che differisce è quella che paghi più spesso. Fai il calcolo sul volume del tuo prefisso: a $0,10 contro $0,20 per milione di token in cache, il risparmio cresce in proporzione a quanta parte del tuo input è una ripetizione

Nessuno di quei tre casi viene risolto da un benchmark, e questo è il punto. La modalità è identica da entrambe le parti, il tasso principale è identico da entrambe le parti, e la decisione dipende da un tasso di cache, da una restrizione della scala dello sforzo e dal fatto che tu abbia bisogno del numero di qualcun altro prima di muoverti.

Eseguire entrambe le configurazioni da un unico tasto

La ragione pratica per eseguire questo confronto invece di ragionarci sopra è che i due rami differiscono per una stringa di modello e un parametro, quindi allestire l'esperimento non costa quasi nulla. OrcaRouter instrada openai/gpt-6-sol al prezzo di listino di OpenAI senza aggiungere nulla — $2,00 di input, $0,20 in cache, $10,00 di output, con il livello da 272K pubblicato a $4,00 e $15,00 — e applica la regola di riprezzamento del fornitore così com'è scritta, invece di sostituirla con una regola propria. Poiché non c'è alcun ricarico sopra il listino del fornitore, una variazione di tariffa o del prezzo della cache compare sulla rotta il giorno stesso in cui OpenAI la pubblica, senza un secondo contratto da rinegoziare. Su quelle rotte oggi non c'è né il livello 6.1 né un suo listino pro — abbiamo controllato il catalogo pubblico il 30 settembre 2026 e sia openai/gpt-6.1-sol sia openai/gpt-6.1-sol-pro restituiscono model not found — quindi il ramo che puoi chiamare in questo momento è quello 6 Sol, in modalità standard o pro, sullo stesso endpoint e con la stessa chiave che useresti per il livello più recente quando arriverà.

A screenshot of the OrcaRouter model page for GPT-6 Sol (openai/gpt-6-sol), showing the header 'by OpenAI - 2026-09-22', capability tags for vision, tools, JSON and reasoning, a 1,050,000-token context window with 128,000 maximum output tokens, a pricing table whose standard tier reads $2.00 input, $10.00 output, $0.20 cache read and $2.50 cache write, a long-context row reading $4.00 input, $15.00 output, $0.40 cache read and $5.00 cache write, a measured performance panel showing a p50 latency near 1.24 seconds, about 65 tokens per second and a 0.16% error rate, and an OpenAI-compatible code sample calling model openai/gpt-6-sol through base_url https://api.orcarouter.ai/v1.

Esegui il test a tre bracci sulle tue richieste difficili e mantieni reasoning.effort costante, così si muove una variabile alla volta: gpt-6-sol in modalità standard, gpt-6-sol con la modalità pro attiva e — una volta che è instradabile — gpt-6.1-sol allo stesso effort. Leggi i token totali fatturati dall'oggetto usage anziché dal corpo della risposta, dato che il ragionamento extra della modalità finisce in un campo che il testo della risposta non mostra mai. L'esecuzione pro messa a confronto con la sua gemella standard ti dà il moltiplicatore sul tuo traffico, che non coinciderà con quello di nessun altro. Mantenere il terzo braccio come test di regressione dopo la decisione costa il cambio di una stringa, e una regola di routing che invia le richieste davvero difficili alla configurazione pro mentre la gran parte resta standard è una riga in un DSL di routing anziché una riarchitettura — che è la versione di questa decisione che sopravvive al prossimo aggiornamento dei modelli.

A generated scoreboard titled 'GPT-6 Sol Pro vs GPT-6.1 Sol Pro - the scoreboard'. Left column 'GPT-6 Sol Pro': rows reading 'Base model released: Sept 22, 2026', 'Input / output: $2.00 / $10.00 per 1M', 'Cached input: $0.20 per 1M', 'Cache writes: $2.50 per 1M', 'Context: 1,050,000 tokens', 'Effort none: available', 'Independent score: AA Intelligence 47.5, rank 12 of 145', 'Pro mode evaluated: no'. Right column 'GPT-6.1 Sol Pro': rows reading 'Base model released: Sept 29, 2026', 'Input / output: $2.00 / $10.00 per 1M', 'Cached input: $0.10 per 1M', 'Cache writes: $2.50 per 1M', 'Context: 1,050,000 tokens', 'Effort none: not supported', 'Independent score: none published', 'Pro mode evaluated: no'. A footer reads 'OpenAI figures vendor-reported; GPT-6 Sol score per Artificial Analysis; no third-party evaluation of either pro configuration published as of September 30, 2026.'

Il risultato finale

Togli i nomi e questa è un'unica configurazione su due snapshot adiacenti, a sette giorni di distanza, che condividono un tariffario fino alla soglia di repricing. Lo snapshot più recente dimezza la tariffa per input in cache e rinuncia a sforzo: nessuno; quello più vecchio mantiene quel livello e include una valutazione di terze parti, un record di latenza misurato e una modalità pro che il fornitore documenta su una pagina del modello anziché solo in un esempio della guida. Se il tuo traffico riutilizza un prefisso stabile ad alto volume, il livello 6.1 è il default più economico e dovresti dirlo sulla riga della cache anziché sul titolo. Se il tuo percorso in modalità pro è già misurato e funzionante, non ci sono prove pubblicate che giustifichino il passaggio questa settimana. In ogni caso, considera i due nomi di catalogo come un unico interruttore su due modelli di base — perché è l'unica lettura che resiste a un'occhiata al listino prezzi del fornitore stesso.

Il braccio che puoi chiamare oggi è quello 6 Sol, standard o pro, ed è elencato nel catalogo pubblico al prezzo di listino di OpenAI senza nulla in più, su un endpoint e una chiave.