Una card hero generata con intestazione 'Un livello, tre modelli' e tre chip che recitano 'GPT-6.1 Sol Ultrafast: disponibile, $12.00 / $60.00', 'GPT-6 Astra Ultrafast: disponibile, $60.00 / $300.00' e 'GPT-5.6 Sol Ultrafast: solo anteprima, nessuna tariffa pubblicata', su un footer che recita 'Come riportato nella documentazione di OpenAI il 9 ottobre 2026'.
Guides & Insights

GPT-6.1 Sol Ultrafast vs GPT-5.6 Sol Ultrafast: un tier, tre modelli, uno dei quali ancora in attesa

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

GPT-6.1 Sol Ultrafast e GPT-5.6 Sol Ultrafastsono lo stesso livello di servizio applicato a due diverse generazioni Sol, e dopo l'8 ottobre 2026 si trovano in stati opposti. GPT-6.1 Solè passato da "prossimamente" a una tabella di tariffe pubblicata — 12,00 $ per milione di token in input, 60,00 $ per milione di token in output, sei volte lo Standard — disponibile per ogni utente API, e per gli utenti di Codex e ChatGPT Work sul piano Pro da 500 $. GPT-5.6 Solè ancora dove Ultrafast ha avuto inizio: un livello annunciato, in anteprima limitata, senza alcuna riga nella pagina dei prezzi. Stesso nome, stesso meccanismo, e solo uno dei due è qualcosa che si può acquistare.

Questa è la versione breve. La versione più lunga è importante perché i numeri di velocità di punta del livello sono legati a modelli diversi, misurati su superfici diverse e, in un caso, vecchi di tre mesi.

Cos'è realmente "Ultrafast" su ciascun modello

Su nessuno dei due modelli Ultrafast è un checkpoint separato. Invii lo stesso id del modello e cambi un livello di servizio — model: "gpt-6.1-sol" con service_tier: "ultrafast" nell'API Responses — e OpenAI pianifica la tua richiesta sul percorso a bassa latenza. I pesi, le risposte e la finestra di contesto sono invariati. Su GPT-6.1 Sol quella finestra è di 1.050.000 token, con un input massimo di 922.000 token e un output massimo di 128.000; GPT-5.6 Sol ha la stessa identica finestra e lo stesso tetto di output, e differisce principalmente nella data di cutoff delle conoscenze (16 febbraio 2026 contro 30 aprile 2026) e nella scala di ragionamento, dove GPT-5.6 Sol accetta ancora none e GPT-6.1 Sol no.

Quindi il confronto non è "quale modello pensa più velocemente". È "quale generazione della stessa fascia ti è accessibile", e la risposta è cambiata quattro giorni fa.

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the WebSockets recommendation warning that network overhead can reduce the latency gains without a persistent connection, the note that Ultrafast has separate rate limits from Standard and Fast modes, the line that GPT-6.1 Sol supports US and EU data residency, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

I multipli pubblicati, e l'unico numero che è rimasto a 14x

OpenAI ha pubblicato due dichiarazioni sulla velocità relative a questo livello, su due modelli, e nessuna delle due è un'affermazione generale su "Ultrafast".

• GPT-6 Astra Ultrafast — "genera token fino a 8 volte più velocemente di GPT-6 Astra in modalità Standard in Codex". Questa è l'attuale affermazione di punta del livello, ripetuta nella documentazione sulla velocità lato ChatGPT.

• GPT-5.6 Sol Ultrafast — annunciato il 13 agosto 2026 come capace di funzionare "fino a 14 volte più velocemente dell'elaborazione Standard", in anteprima limitata per clienti selezionati.

Nota ciò che manca. Non esiste un moltiplicatore di velocità pubblicato per GPT-6.1 Sol Ultrafast. La sua pagina di documentazione descrive il tier, fornisce i suoi limiti di frequenza e la sua impostazione in materia di residenza dei dati, e rimanda alla tabella dei prezzi — ma l'unico moltiplicatore specifico per modello dell'intero corpus di documentazione appartiene ad Astra. La posizione onesta è che «fino a 8x» è la misurazione di Astra, sullo stesso stack di servizio, ed è il numero su cui viene venduto il rollout senza che sia stato riprodotto per Sol da nessuno, dentro o fuori O​penAI.

Il numero 14 merita più diffidenza del solito, per quanto è vecchio. Annunciato a metà agosto per un livello che non ha ancora raggiunto la disponibilità generale, è rimasto invariato per circa due mesi mentre il livello stesso veniva costruito attorno ad altri due modelli. In quel periodo, la cosa ovvia da aspettarsi — che l'Ultrafast di 5.6 Sol uscisse dall'anteprima e ricevesse un prezzo — non è mai accaduta. Invece GPT-6 Astra l'ha ottenuto il 29 settembre e GPT-6.1 Sol l'ha ottenuto l'8 ottobre. Un numero che esiste solo in un annuncio, abbinato a una configurazione che nessuno può acquistare, è testo pubblicitario finché non compare su un listino prezzi.

Fianco a fianco: quanto costa ciascuno e chi può raggiungerlo

• Tariffa standard — GPT-6.1 Sol $2,00 input / $0,10 in cache / $2,50 scrittura cache / $10,00 output per 1 milione di token rispetto a GPT-5.6 Sol $4,00 / $0,40 / $5,00 / $20,00

• Tariffa Ultrafast — GPT-6.1 Sol $12.00 / $0.60 / $15.00 / $60.00, pubblicata tramite la regola 6x-Standard e la propria riga nella tabella dei prezzi Ultrafast rispetto a GPT-5.6 Sol, nessuna tariffa pubblicata

• Contesto lungo oltre 272K token di input — GPT-6.1 Sol ha un nuovo prezzo: 2x per le tariffe di input e cache e 1,5x per l'output sull'intera richiesta, offrendo una fascia Ultrafast a contesto lungo di $24,00 / $1,20 / $30,00 / $90,00 rispetto all'equivalente Ultrafast di GPT-5.6 Sol, che nessuno ha pubblicato

• Disponibilità del livello — GPT-6.1 Sol: tutti gli utenti API, soggetti a limiti di frequenza separati, e Codex più ChatGPT Work su Pro da $500 e piani Enterprise ed Edu idonei vs GPT-5.6 Sol: anteprima limitata per clienti API selezionati

• Limiti di utilizzo al lancio — GPT-6.1 Sol dispone di un proprio budget Ultrafast, separato dai limiti Standard e Fast, impostato per organizzazione e aumentato su richiesta rispetto a GPT-5.6 Sol, non pubblicato

• Residenza dei dati — GPT-6.1 Sol supporta la residenza negli Stati Uniti e nell'UE e l'elaborazione globale con Fast e Ultrafast, rispetto a GPT-5.6 Sol, che prevede la residenza negli Stati Uniti e l'elaborazione globale

• Moltiplicatore di velocità — GPT-6.1 Sol, nessuno pubblicato vs GPT-5.6 Sol, "fino a 14x" nell'annuncio di agosto, non riprodotto

• Contesto e limite di output — 1.050.000 e 128.000 per entrambi

Un'asimmetria in quell'elenco merita di essere messa in evidenza. GPT-6.1 Sol è l'unica configurazione Ultrafast con residenza dei dati nell'UE: l'Ultrafast di Astra è disponibile solo negli Stati Uniti, e 5.6 Sol non è affatto disponibile. Se il tuo carico di lavoro è vincolato all'elaborazione nell'UE, l'8 ottobre è la prima data in cui questo livello è stato disponibile per te in qualsiasi forma.

Con un abbonamento, la differenza sta nel piano, non nel modello

In Codex e ChatGPT Work entrambe le generazioni si comportano allo stesso modo a livello strutturale — Ultrafast è un'impostazione di velocità su un modello che già possiedi — ma il controllo di accesso che lo precede è nuovo. Ultrafast è disponibile su Pro da 500 $ e sui piani Enterprise ed Edu idonei, ed è disattivato per impostazione predefinita negli spazi di lavoro Enterprise finché un amministratore non lo abilita. All'interno di un abbonamento, l'utilizzo incluso viene consumato a 8 volte la tariffa Standard e i crediti acquistati o l'Enterprise pay-as-you-go vengono fatturati a 6 volte; sull'API il moltiplicatore è un 6x fisso su ogni voce di prezzo.

Nello specifico di GPT-5.6 Sol, niente di tutto ciò è ancora accessibile. Non esiste un percorso in abbonamento — la documentazione sulla velocità lato ChatGPT elenca Ultrafast come supporto per GPT-6 Astra e GPT-6.1 Sol — e il percorso API è ancora vincolato a una coorte di anteprima. La cifra di 14x promette, ma lo sta promettendo a un insieme di account che non si è ampliato da due mesi.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing exactly two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

Quale usare davvero, e quando aspettare

Se inizi oggi, la domanda si risponde in gran parte da sola: GPT-6.1 Sol Ultrafast è acquistabile, ha un prezzo ed è documentato, mentre GPT-5.6 Sol Ultrafast no. Il motivo per cui rivolgersi invece al modello più vecchio non è affatto il livello — è che GPT-5.6 Sol è in circolazione dal 9 luglio 2026 e, se hai suite di prompt, valutazioni e modelli di costo costruiti su di esso, il costo di migrazione verso un aggiornamento di Sol con un cutoff delle conoscenze diverso e una scala di ragionamento strettamente più limitata è reale, anche quando il prezzo è dimezzato. Fai quel passaggio secondo i suoi tempi, non perché è finalmente arrivata un'impostazione della velocità.

La regola decisionale per la fascia stessa è quella che i numeri di Astra implicano e che quelli di Sol convalidano: sei volte il prezzo per una riduzione della latenza è un buon affare quando un umano o un agente è bloccato sull'output, e un cattivo affare quando un lavoro ha tempo fino al mattino. Nulla nel rollout di GPT-6.1 Sol cambia quell'aritmetica; lo rende semplicemente disponibile su un modello base più economico, dove il conto assoluto per una risposta rapida è più basso.

E se invece vuoi il livello Fast, puoi ragionarci basandoti esclusivamente sulla rate card: 2x Standard, e Fast è stata l'opzione intermedia costante da quando OpenAI ha rinominato Priority processing il 30 luglio 2026. Ultrafast è ancora il livello in cui acquisti una promessa non misurata, e sul fronte GPT-5.6 Sol, una che non puoi comprare affatto.

Chiamare uno dei due con un solo tasto

Su OrcaRouter ci sono sia GPT-5.6 Sol che GPT-6.1 Sol di fascia Standard — openai/gpt-5.6-sol a $4,00 in input e $20,00 in output per milione di token, openai/gpt-6.1-sol a $2,00 e $10,00 — serviti con markup 0%, con il prezzo di listino del provider trasferito tal quale, così un movimento di prezzo del fornitore arriva sulla tua fattura lo stesso giorno in cui arriva sul tariffario. Su questa coppia conta più del solito, perché il prezzo di $4,00 / $20,00 di GPT-5.6 Sol è esplicitamente promozionale e OpenAI dichiara che è disponibile almeno fino al 21 novembre 2026. Quando quella finestra si chiude, il divario tra le due generazioni si restringe, e una piattaforma pass-through significa che lo scopri dai tuoi numeri di utilizzo anziché da un'email di rinnovo.

La stessa chiave e lo stesso endpoint trasportano più di 200 modelli, quindi confrontare le due generazioni di Sol sul tuo traffico non richiede due integrazioni né due contratti, e il failover automatico mantiene in piedi un percorso di produzione se un provider peggiora. Dove una singola risposta non basta, il DSL di routing compone diversi modelli in un'unica chiamata e la fusione di modelli vi pone dietro un panel.

Ciò che non offriamo è Ultrafast. Su entrambi i modelli è un flag di livello di servizio su un account O​penAI anziché un modello instradabile separatamente, quindi resta all'interno della tua integrazione diretta con O​penAI — e su GPT-5.6 Sol non è nemmeno generalmente disponibile. Lo diciamo senza giri di parole perché l'alternativa sarebbe lasciar intendere una capacità che non abbiamo. E non è una frase che vogliamo su questo blog.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1,050,000-token context window, 128K maximum output, text and image input with text output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.36 s, a 2.86 s figure and 85.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno