Una hero card generata intitolata "GPT-6 Sol vs GPT-5.6 Sol", con il titolo "1 punto di Index di differenza, metà del prezzo", con le card dei due modelli che mostrano un AA Index di 48 contro 47 e prezzi di $2.00/$10.00 contro $4.00/$20.00, e il logo OrcaRouter in basso a destra.
Guides & Insights

GPT-6 Sol vs GPT-5.6 Sol: un punto indice, metà del prezzo e una regressione che nessuno ha annunciato

Autore

Elias Hawthorne

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Sì, fai l'upgrade — ma leggi il secondo paragrafo prima di farlo. GPT-6 Sol, rilasciato il 22 settembre 2026, ottiene 48 su Intelligence Index di Artificial Analysis. GPT-5.6 Sol, rilasciato il 9 luglio 2026, ottiene 47. Un punto. Il modello che lo ha sostituito costa la metà: 2,00 $ per milione di input e 10,00 $ per milione di output contro 4,00 $ e 20,00 $. Sui numeri principali, questa è la decisione di upgrade più facile della gamma attuale, e il taglio di prezzo è reale, permanente e la più grande singola riduzione che il fornitore abbia applicato a un modello di punta.

La complicazione è che la valutazione di GPT-6 Sol fatta da Artificial Analysis stessa ha rilevato un mix di miglioramenti e regressioni, non un netto passo avanti. Ci sono regressioni su GDPval-AA v2.1. Esiste anche una fascia di riprezzamento per contesto lungo oltre 272.000 token di input che raddoppia all'incirca la tariffa di input e aumenta quella di output della metà — e 272K è esattamente la banda in cui GPT-5.6 Sol ha un punto di forza documentato. Una migrazione che sembra un semplice dimezzamento della tua fattura può, sul traffico a contesto lungo, rivelarsi più vicina a un pareggio, con annesso un compromesso sulla capacità.

Cosa significa realmente un guadagno di un punto dell'Index

Entrambi i modelli sono stati misurati sulla stessa scheda, versione 4.3.2, il che rende questo il confronto più pulito dell'intera serie GPT-6 Sol — nessuna differenza di harness, nessuna discrepanza tra misurazioni del fornitore e misurazioni indipendenti, un unico laboratorio che misura due modelli di un solo fornitore.

• AA Intelligence Index — GPT-6 Sol 48, classificato 18° su 212 rispetto a GPT-5.6 Sol 47, classificato 19° su 212

• Costo per attività Index — GPT-6 Sol circa la metà di GPT-5.6 Sol

• Velocità di output — GPT-6 Sol 104,4 token/sec vs GPT-5.6 Sol 72,6 token/sec

• Tempo al primo token — GPT-6 Sol 107,18 s vs GPT-5.6 Sol più veloce, entrambi rispetto a una mediana della classifica di 3,87 s

• Prezzo di input — GPT-6 Sol 2,00 $ per 1M vs GPT-5.6 Sol 4,00 $ per 1M

• Prezzo dell'output — GPT-6 Sol 10,00 $ per 1M vs GPT-5.6 Sol 20,00 $ per 1M

• Input nella cache — GPT-6 Sol circa il 90% in meno rispetto a GPT-5.6 Sol, 0,40 $ per 1M

Tariffa batch — GPT-6 Sol non pubblicata vs GPT-5.6 Sol 2,50 $ / 15,00 $

• Livello long-context — GPT-6 Sol applica un prezzo diverso oltre 272K input rispetto a GPT-5.6 Sol, che non ha un passaggio equivalente

• Finestra di contesto — GPT-6 Sol 872K secondo AA, 1,05M dichiarati rispetto a GPT-5.6 Sol, circa da 1,05M a 1,1M

• Output massimo — 128K su entrambi

• Rilasciato — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

A generated two-column scoreboard titled 'GPT-6 Sol vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6 Sol: Input $2.00 per 1M, Output $10.00 per 1M, AA Index 48, Speed 104.4 tok/s, Long context 'reprices above 272K', Released 2026-09-22. Right column GPT-5.6 Sol: Input $4.00 per 1M, Output $20.00 per 1M, AA Index 47, Speed 72.6 tok/s, Long context 'no step', Released 2026-07-09. Footer: 'Both measured by Artificial Analysis, Index v4.3.2.'

Osserva insieme le due linee della velocità. GPT-6 Sol genera output circa il 44% più velocemente del suo predecessore, ed è drammaticamente più lento a produrre il primo token — 107,18 secondi contro una mediana della board di 3,87. GPT-5.6 Sol non è nemmeno un modello veloce secondo gli standard della board, ma non è in quel territorio. Se sei passato a GPT-5.6 Sol per un prodotto interattivo, GPT-6 Sol non è un sostituto drop-in, e questa è una regressione funzionale indipendente da qualsiasi benchmark.

Una riga è silenziosamente favorevole: la tariffa standard di GPT-6 Sol, $2/$10, è inferiore alla tariffa batch di GPT-5.6 Sol, $2.50/$15. Persino il livello scontato del vecchio modello è più costoso del prezzo di listino del nuovo. Questa è la prova più forte che il taglio è strutturale anziché promozionale.

La regressione è la parte interessante

Artificial Analysis ha rilevato che GPT-6 Sol dimezza all'incirca il costo per attività, producendo al contempo un mix di miglioramenti e regressioni. GDPval-AA v2.1 è la regressione specificamente indicata. Separatamente, anche GPT-5.6 Luna di OpenAI ha registrato una regressione sul Coding Agent Index — il che suggerisce un pattern in questa generazione, più che un errore isolato su un singolo modello.

Vale la pena prenderlo sul serio proprio perché è il risultato indipendente. I materiali di lancio di OpenAI sono costruiti attorno al costo per attività e attorno a righe di benchmark che ha selezionato; Artificial Analysis non ha alcun prodotto da vendere e riporta ciò che ha prodotto il suo harness. Un modello che è più economico e all'incirca equivalente sul punteggio composito, ma misurabilmente peggiore su specifici sotto-compiti, non è un modello strettamente migliore. È un punto diverso sulla frontiera.

La versione pratica di ciò: se il tuo carico di lavoro è fortemente a forma di GDPval-AA — lavoro intellettuale economicamente prezioso, il tipo di compito che quel benchmark è stato creato per quantificare — allora il guadagno composito di un punto non ti copre, e la regressione è il numero che conta. Se il tuo carico di lavoro è generale, il dimezzamento del costo per compito è il numero che conta e il composito dice che non hai rinunciato a nulla di misurabile.

Dove GPT-5.6 Sol vince ancora

GPT-5.6 Sol ha un risultato pubblicato di retrieval su contesto lungo che GPT-6 Sol non eguaglia con nulla di equivalente: MRCR v2, 8-needle, 91,5% nell'intervallo da 256K a 512K. Si tratta di un dato di accuratezza di retrieval nella fascia in cui cambia il listino prezzi di GPT-6 Sol.

Metti i due fatti a confronto. Oltre 272.000 token di input, l'intera richiesta di GPT-6 Sol viene ricalcolata a circa 4 $ per l'input e 15 $ per l'output. Si tratta all'incirca della vecchia tariffa di GPT-5.6 Sol sull'input e di tre quarti di essa sull'output — quindi il risparmio del 50% per cui hai migrato crolla a circa lo 0% sull'input e al 25% sull'output, esattamente nell'intervallo di contesto in cui GPT-5.6 Sol ha un punto di forza documentato e GPT-6 Sol non ha una controparte pubblicata.

Gli altri risultati pubblicati di GPT-5.6 Sol rimangono rispettabili ed è il motivo per cui alcuni team non effettueranno il passaggio:

• Agents' Last Exam — GPT-5.6 Sol 53.6

• Terminal-Bench 2.1 — GPT-5.6 Sol 88,8 / 88,0

• SWE-Bench Pro — GPT-5.6 Sol 64.6

• OSWorld 2.0 — GPT-5.6 Sol 62.6

• BrowseComp — GPT-5.6 Sol 90,4

• GDPval-AA v2 — GPT-5.6 Sol 1747,8 Elo

• HLE — GPT-5.6 Sol 49,5

• MRCR v2, 8-needle — GPT-5.6 Sol 91,5% da 256K a 512K

Questi sono riportati da OpenAI. Si noti che BrowseComp a 90.4 e il valore MRCR sono i due più difficili da sostituire: gli agenti di ricerca web e il retrieval a contesto lungo sono carichi di lavoro in cui un modello vecchio di due mesi con un numero pubblicato è una scommessa più sicura di un nuovo modello senza una misurazione corrispondente.

Cosa offre GPT-6 Sol che non è nel listino prezzi

Il prezzo è la notizia, ma sono cambiate altre tre cose.

Innanzitutto, il tetto del contesto. GPT-6 Sol è indicato a 872.000 token da Artificial Analysis, rispetto a una dichiarazione di 1,05 M altrove nei materiali di OpenAI, con un input massimo di 922K. GPT-5.6 Sol si attesta intorno a 1,05 M–1,1 M a seconda della fonte. Sulla carta, si tratta di un piccolo passo indietro nella finestra utilizzabile — con l’avvertenza che è il confine della fascia a 272K, non il tetto, a determinare il costo.

Secondo, la disponibilità. GPT-6 Sol è disponibile nell'API e in ChatGPT Work e Codex nei piani Plus, Pro, Business, Enterprise ed Edu — e gli amministratori Enterprise devono abilitarlo prima che gli utenti possano vederlo. Non è disponibile in ChatGPT Chat. GPT-5.6 Sol ha avuto un rilascio più ampio. Se il percorso di accesso del tuo team passa attraverso un amministratore enterprise, la migrazione non è solo una modifica al codice.

Terzo, il lancio di un nuovo modello di punta di solito significa che quello vecchio diventa l'alternativa più economica invece di essere ritirato. GPT-5.6 Sol a $4/$20 è ancora un modello eccellente con un punteggio di 47 sull'Index, e per il lavoro di retrieval a contesto lungo dispone di un dato pubblicato che GPT-6 Sol non ha.

Una migrazione che costa meno di quanto sembri

Il motivo per cui questo particolare aggiornamento è semplice è che i due modelli sono dello stesso fornitore, hanno la stessa forma di API e sono adiacenti nella classifica — il che significa che la migrazione è un cambio di stringa del modello anziché una riarchitettura, e il percorso di fallback è già nel tuo codice. GPT-5.6 Sol è su OrcaRouter al prezzo di listino di OpenAI, secondo il modello pass-through che rende una variazione di prezzo di OpenAI attiva dalla nostra parte lo stesso giorno, invece che dopo che un rivenditore rinegozia.

GPT-6 Sol non è nel nostro catalogo al momento in cui scriviamo — è raggiungibile tramite l'API di OpenAI. Quindi la forma onesta di una migrazione è una route con GPT-5.6 Sol dietro di essa sulla stessa chiave: inviare il nuovo traffico a GPT-6 Sol, mantenere il modello precedente a una modifica di configurazione di distanza e lasciare che il failover automatico copra la finestra in cui la disponibilità di un nuovo flagship è ancora in fase di assestamento. Per un modello che ha due giorni di vita, con un toggle di abilitazione Enterprise davanti e un tier a contesto lungo che cambia l'economia oltre i 272K token, avere la generazione precedente ancora collegata non è cautela — è la differenza tra un pomeriggio storto e una settimana storta.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

La checklist di migrazione

Misura la tua effettiva distribuzione del contesto prima di ogni altra cosa. Se il 95° percentile delle tue richieste si colloca sotto i 272.000 token di input, migra — il risparmio è un autentico 50% su entrambi i lati della bolletta, il costo per attività si dimezza e l'indice composito dice che non hai rinunciato a nulla. Se una quota significativa di traffico si colloca sopra quella soglia, modella con attenzione il tier: a circa $4/$15, il vantaggio rispetto ai $4/$20 di GPT-5.6 Sol è del 25% sull'output e nullo sull'input, e lo stai pagando con la perdita di un risultato documentato di retrieval su contesto lungo.

Verifica se qualcuno resta in attesa del primo token. 107 secondi corrispondono all'incirca a ventotto volte la mediana della board ed è la modalità di errore che emergerà per prima in produzione. Qualsiasi cosa con un essere umano dall'altra parte dovrebbe restare su GPT-5.6 Sol o essere instradata altrove.

Poi verifica il percorso di abilitazione. I piani Enterprise richiedono che un amministratore attivi GPT-6 Sol, e questo è del tutto assente da ChatGPT Chat. Conferma che i tuoi utenti possano effettivamente accedervi prima di annunciare una migrazione a livello interno.

Infine, tieni d'occhio GDPval-AA v2.1 sulle tue valutazioni per il primo mese. Il laboratorio indipendente ha riscontrato una regressione lì, e un guadagno composito di un punto non ti dice se il tuo specifico insieme di attività è salito o sceso. Esegui le tue valutazioni su entrambi i modelli prima di effettuare il passaggio, non dopo.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), showing the Vision, Tools, JSON and Reasoning badges, a 1.05M-token context with 128K maximum output and text + image + file input, list pricing of $4.00 input and $20.00 output per 1M tokens, and the description of GPT-5.6 Sol as the flagship of OpenAI's GPT-5.6 series, strong at command-line and multi-file coding tasks.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno