
GPT-6 Sol vs GPT-5.6 Sol: un punto indice, metà del prezzo e una regressione che nessuno ha annunciato
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 610 tok/s
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 189 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
Sì, fai l'upgrade — ma leggi il secondo paragrafo prima di farlo. GPT-6 Sol, rilasciato il 22 settembre 2026, ottiene 48 su Intelligence Index di Artificial Analysis. GPT-5.6 Sol, rilasciato il 9 luglio 2026, ottiene 47. Un punto. Il modello che lo ha sostituito costa la metà: 2,00 $ per milione di input e 10,00 $ per milione di output contro 4,00 $ e 20,00 $. Sui numeri principali, questa è la decisione di upgrade più facile della gamma attuale, e il taglio di prezzo è reale, permanente e la più grande singola riduzione che il fornitore abbia applicato a un modello di punta.
La complicazione è che la valutazione di GPT-6 Sol fatta da Artificial Analysis stessa ha rilevato un mix di miglioramenti e regressioni, non un netto passo avanti. Ci sono regressioni su GDPval-AA v2.1. Esiste anche una fascia di riprezzamento per contesto lungo oltre 272.000 token di input che raddoppia all'incirca la tariffa di input e aumenta quella di output della metà — e 272K è esattamente la banda in cui GPT-5.6 Sol ha un punto di forza documentato. Una migrazione che sembra un semplice dimezzamento della tua fattura può, sul traffico a contesto lungo, rivelarsi più vicina a un pareggio, con annesso un compromesso sulla capacità.
Cosa significa realmente un guadagno di un punto dell'Index
Entrambi i modelli sono stati misurati sulla stessa scheda, versione 4.3.2, il che rende questo il confronto più pulito dell'intera serie GPT-6 Sol — nessuna differenza di harness, nessuna discrepanza tra misurazioni del fornitore e misurazioni indipendenti, un unico laboratorio che misura due modelli di un solo fornitore.
• AA Intelligence Index — GPT-6 Sol 48, classificato 18° su 212 rispetto a GPT-5.6 Sol 47, classificato 19° su 212
• Costo per attività Index — GPT-6 Sol circa la metà di GPT-5.6 Sol
• Velocità di output — GPT-6 Sol 104,4 token/sec vs GPT-5.6 Sol 72,6 token/sec
• Tempo al primo token — GPT-6 Sol 107,18 s vs GPT-5.6 Sol più veloce, entrambi rispetto a una mediana della classifica di 3,87 s
• Prezzo di input — GPT-6 Sol 2,00 $ per 1M vs GPT-5.6 Sol 4,00 $ per 1M
• Prezzo dell'output — GPT-6 Sol 10,00 $ per 1M vs GPT-5.6 Sol 20,00 $ per 1M
• Input nella cache — GPT-6 Sol circa il 90% in meno rispetto a GPT-5.6 Sol, 0,40 $ per 1M
Tariffa batch — GPT-6 Sol non pubblicata vs GPT-5.6 Sol 2,50 $ / 15,00 $
• Livello long-context — GPT-6 Sol applica un prezzo diverso oltre 272K input rispetto a GPT-5.6 Sol, che non ha un passaggio equivalente
• Finestra di contesto — GPT-6 Sol 872K secondo AA, 1,05M dichiarati rispetto a GPT-5.6 Sol, circa da 1,05M a 1,1M
• Output massimo — 128K su entrambi
• Rilasciato — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

Osserva insieme le due linee della velocità. GPT-6 Sol genera output circa il 44% più velocemente del suo predecessore, ed è drammaticamente più lento a produrre il primo token — 107,18 secondi contro una mediana della board di 3,87. GPT-5.6 Sol non è nemmeno un modello veloce secondo gli standard della board, ma non è in quel territorio. Se sei passato a GPT-5.6 Sol per un prodotto interattivo, GPT-6 Sol non è un sostituto drop-in, e questa è una regressione funzionale indipendente da qualsiasi benchmark.
Una riga è silenziosamente favorevole: la tariffa standard di GPT-6 Sol, $2/$10, è inferiore alla tariffa batch di GPT-5.6 Sol, $2.50/$15. Persino il livello scontato del vecchio modello è più costoso del prezzo di listino del nuovo. Questa è la prova più forte che il taglio è strutturale anziché promozionale.
La regressione è la parte interessante
Artificial Analysis ha rilevato che GPT-6 Sol dimezza all'incirca il costo per attività, producendo al contempo un mix di miglioramenti e regressioni. GDPval-AA v2.1 è la regressione specificamente indicata. Separatamente, anche GPT-5.6 Luna di OpenAI ha registrato una regressione sul Coding Agent Index — il che suggerisce un pattern in questa generazione, più che un errore isolato su un singolo modello.
Vale la pena prenderlo sul serio proprio perché è il risultato indipendente. I materiali di lancio di OpenAI sono costruiti attorno al costo per attività e attorno a righe di benchmark che ha selezionato; Artificial Analysis non ha alcun prodotto da vendere e riporta ciò che ha prodotto il suo harness. Un modello che è più economico e all'incirca equivalente sul punteggio composito, ma misurabilmente peggiore su specifici sotto-compiti, non è un modello strettamente migliore. È un punto diverso sulla frontiera.
La versione pratica di ciò: se il tuo carico di lavoro è fortemente a forma di GDPval-AA — lavoro intellettuale economicamente prezioso, il tipo di compito che quel benchmark è stato creato per quantificare — allora il guadagno composito di un punto non ti copre, e la regressione è il numero che conta. Se il tuo carico di lavoro è generale, il dimezzamento del costo per compito è il numero che conta e il composito dice che non hai rinunciato a nulla di misurabile.
Dove GPT-5.6 Sol vince ancora
GPT-5.6 Sol ha un risultato pubblicato di retrieval su contesto lungo che GPT-6 Sol non eguaglia con nulla di equivalente: MRCR v2, 8-needle, 91,5% nell'intervallo da 256K a 512K. Si tratta di un dato di accuratezza di retrieval nella fascia in cui cambia il listino prezzi di GPT-6 Sol.
Metti i due fatti a confronto. Oltre 272.000 token di input, l'intera richiesta di GPT-6 Sol viene ricalcolata a circa 4 $ per l'input e 15 $ per l'output. Si tratta all'incirca della vecchia tariffa di GPT-5.6 Sol sull'input e di tre quarti di essa sull'output — quindi il risparmio del 50% per cui hai migrato crolla a circa lo 0% sull'input e al 25% sull'output, esattamente nell'intervallo di contesto in cui GPT-5.6 Sol ha un punto di forza documentato e GPT-6 Sol non ha una controparte pubblicata.
Gli altri risultati pubblicati di GPT-5.6 Sol rimangono rispettabili ed è il motivo per cui alcuni team non effettueranno il passaggio:
• Agents' Last Exam — GPT-5.6 Sol 53.6
• Terminal-Bench 2.1 — GPT-5.6 Sol 88,8 / 88,0
• SWE-Bench Pro — GPT-5.6 Sol 64.6
• OSWorld 2.0 — GPT-5.6 Sol 62.6
• BrowseComp — GPT-5.6 Sol 90,4
• GDPval-AA v2 — GPT-5.6 Sol 1747,8 Elo
• HLE — GPT-5.6 Sol 49,5
• MRCR v2, 8-needle — GPT-5.6 Sol 91,5% da 256K a 512K
Questi sono riportati da OpenAI. Si noti che BrowseComp a 90.4 e il valore MRCR sono i due più difficili da sostituire: gli agenti di ricerca web e il retrieval a contesto lungo sono carichi di lavoro in cui un modello vecchio di due mesi con un numero pubblicato è una scommessa più sicura di un nuovo modello senza una misurazione corrispondente.
Cosa offre GPT-6 Sol che non è nel listino prezzi
Il prezzo è la notizia, ma sono cambiate altre tre cose.
Innanzitutto, il tetto del contesto. GPT-6 Sol è indicato a 872.000 token da Artificial Analysis, rispetto a una dichiarazione di 1,05 M altrove nei materiali di OpenAI, con un input massimo di 922K. GPT-5.6 Sol si attesta intorno a 1,05 M–1,1 M a seconda della fonte. Sulla carta, si tratta di un piccolo passo indietro nella finestra utilizzabile — con l’avvertenza che è il confine della fascia a 272K, non il tetto, a determinare il costo.
Secondo, la disponibilità. GPT-6 Sol è disponibile nell'API e in ChatGPT Work e Codex nei piani Plus, Pro, Business, Enterprise ed Edu — e gli amministratori Enterprise devono abilitarlo prima che gli utenti possano vederlo. Non è disponibile in ChatGPT Chat. GPT-5.6 Sol ha avuto un rilascio più ampio. Se il percorso di accesso del tuo team passa attraverso un amministratore enterprise, la migrazione non è solo una modifica al codice.
Terzo, il lancio di un nuovo modello di punta di solito significa che quello vecchio diventa l'alternativa più economica invece di essere ritirato. GPT-5.6 Sol a $4/$20 è ancora un modello eccellente con un punteggio di 47 sull'Index, e per il lavoro di retrieval a contesto lungo dispone di un dato pubblicato che GPT-6 Sol non ha.
Una migrazione che costa meno di quanto sembri
Il motivo per cui questo particolare aggiornamento è semplice è che i due modelli sono dello stesso fornitore, hanno la stessa forma di API e sono adiacenti nella classifica — il che significa che la migrazione è un cambio di stringa del modello anziché una riarchitettura, e il percorso di fallback è già nel tuo codice. GPT-5.6 Sol è su OrcaRouter al prezzo di listino di OpenAI, secondo il modello pass-through che rende una variazione di prezzo di OpenAI attiva dalla nostra parte lo stesso giorno, invece che dopo che un rivenditore rinegozia.
GPT-6 Sol non è nel nostro catalogo al momento in cui scriviamo — è raggiungibile tramite l'API di OpenAI. Quindi la forma onesta di una migrazione è una route con GPT-5.6 Sol dietro di essa sulla stessa chiave: inviare il nuovo traffico a GPT-6 Sol, mantenere il modello precedente a una modifica di configurazione di distanza e lasciare che il failover automatico copra la finestra in cui la disponibilità di un nuovo flagship è ancora in fase di assestamento. Per un modello che ha due giorni di vita, con un toggle di abilitazione Enterprise davanti e un tier a contesto lungo che cambia l'economia oltre i 272K token, avere la generazione precedente ancora collegata non è cautela — è la differenza tra un pomeriggio storto e una settimana storta.

La checklist di migrazione
Misura la tua effettiva distribuzione del contesto prima di ogni altra cosa. Se il 95° percentile delle tue richieste si colloca sotto i 272.000 token di input, migra — il risparmio è un autentico 50% su entrambi i lati della bolletta, il costo per attività si dimezza e l'indice composito dice che non hai rinunciato a nulla. Se una quota significativa di traffico si colloca sopra quella soglia, modella con attenzione il tier: a circa $4/$15, il vantaggio rispetto ai $4/$20 di GPT-5.6 Sol è del 25% sull'output e nullo sull'input, e lo stai pagando con la perdita di un risultato documentato di retrieval su contesto lungo.
Verifica se qualcuno resta in attesa del primo token. 107 secondi corrispondono all'incirca a ventotto volte la mediana della board ed è la modalità di errore che emergerà per prima in produzione. Qualsiasi cosa con un essere umano dall'altra parte dovrebbe restare su GPT-5.6 Sol o essere instradata altrove.
Poi verifica il percorso di abilitazione. I piani Enterprise richiedono che un amministratore attivi GPT-6 Sol, e questo è del tutto assente da ChatGPT Chat. Conferma che i tuoi utenti possano effettivamente accedervi prima di annunciare una migrazione a livello interno.
Infine, tieni d'occhio GDPval-AA v2.1 sulle tue valutazioni per il primo mese. Il laboratorio indipendente ha riscontrato una regressione lì, e un guadagno composito di un punto non ti dice se il tuo specifico insieme di attività è salito o sceso. Esegui le tue valutazioni su entrambi i modelli prima di effettuare il passaggio, non dopo.

Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
