Una hero card generata intitolata 'Three posts deep' con il sottotitolo 'GPT-6.1 Ultrafast è Pro $500 solo in ChatGPT — aperto a tutti gli utenti API', chip che recitano 'piano Pro $500', 'Enterprise ed Edu idonei' e 'tutti gli utenti API', e un footer che recita 'Disponibilità secondo la documentazione OpenAI, 8 ottobre 2026'.
Guides & Insights

GPT-6.1 Ultrafast Pro costa solo 500 $, e quel dettaglio era a tre post di profondità

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

GPT-6.1 Sol Ultrafastè arrivato l'8 ottobre 2026 con la cosa più rara che un livello di velocità possa offrire al momento del lancio: un prezzo pubblicato. 12,00 $ per milione di token in input, 60,00 $ per milione di token in output, esattamente sei volte quello che GPT-6.1 Sol — il modello che O​penAI ha rilasciato il 29 settembre 2026 durante il keynote del DevDay 2026 — costa sul canale standard. Ciò che il thread dell'annuncio non ha messo in apertura è dove un abbonato a ChatGPT possa effettivamente attivarlo, e la risposta, tre post più in basso, è il piano Pro da 500 $. Quest'ordine merita più attenzione di quanta ne abbia ricevuta, perché la metà API e la metà abbonamento di questo lancio sono soggette a vincoli opposti, e la differenza decide se Ultrafast è qualcosa che puoi provare questa settimana o qualcosa per cui devi comprare un piano.

Non è cambiato nulla del modello. GPT-6.1 Sol Ultrafast è lo stesso checkpoint, la stessa finestra di contesto da 1.050.000 token, lo stesso tetto di output da 128.000 token, la stessa data di cutoff delle conoscenze del 30 aprile 2026 e le stesse risposte di GPT-6.1 Sol. Ultrafast è un livello di servizio — una priorità di pianificazione che richiedi — non un secondo modello. L'intero prodotto è la latenza, venduta a un multiplo, e le uniche due domande che contano sono quanta ne ottieni e chi è autorizzato a comprarla.

Quello che il verbale dice realmente, nell'ordine in cui lo dice

La versione risentita di questa storia è che OpenAI ha insabbiato il gate. La versione accurata è più specifica ed è verificabile riga per riga rispetto alla documentazione di OpenAI stessa.

Il changelog per sviluppatori contiene la voce datata 8 ottobre: aggiunta della modalità Ultrafast per GPT-6.1 Sol nell'API Responses, richiesta inviando model: "gpt-6.1-sol" con service_tier: "ultrafast", descritta come riduzione del tempo tra i token di output generati, e indicata come disponibile a tutti gli utenti API soggetti a limiti di frequenza, con elaborazione globale e residenza dei dati negli Stati Uniti e nell'UE. Letta da sola, si tratta di un lancio senza restrizioni a una tariffa pubblicata.

La documentazione sui tier afferma che Ultrafast è il livello di servizio più veloce nell'API, ampiamente disponibile per GPT-6 Astra e GPT-6.1 Sol con accesso in anteprima per GPT-5.6 Sol, e consiglia WebSockets per esso. Ancora nessuna menzione di un piano.

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

Il dettaglio dell'abbonamento si trova sulla pagina della velocità lato ChatGPT, e sono tre limitazioni racchiuse in un unico paragrafo: Ultrafast è disponibile in Codex e ChatGPT Work, su Pro da $500, e sui piani Enterprise ed Edu idonei. Gli amministratori Enterprise lo trovano disattivato per impostazione predefinita e devono abilitarlo per utente o per workspace. E alla superficie consumer di Chat il livello non è offerto affatto — GPT-6.1 Sol stesso risiede in Work e Codex, quindi Chat non è mai stato previsto.

Mettendo insieme le tre pagine, il quadro è chiaro. Una chiave API è un biglietto. Un abbonamento ChatGPT è un biglietto solo se è il più costoso che OpenAI vende, o se un amministratore te l'ha abilitato. Nessuno che legga il primo post dell'annuncio lo intuirebbe.

Perché esiste il gate, e non è arbitrario

La lettura ovvia è che OpenAI stia usando la corsia veloce per vendere piani da $500. Il meccanismo sottostante è meno cinico e più utile: Ultrafast è un contatore costoso, e un piano da $500 è l'unico piano per consumatori in cui un contatore 8x rientra nell'utilizzo incluso.

Con un abbonamento, l'utilizzo incluso viene consumato a una velocità otto volte superiore rispetto allo standard quando usi Ultrafast, quindi un singolo turno in Ultrafast consuma la stessa quota di otto turni standard. È una conseguenza di ciò che comporta il livello: compra tempo di orologio spendendo capacità di servizio, e un abbonamento è un prodotto a capacità fissa. Fai pagare lo stesso per otto volte il consumo e l'economia del piano crolla a 20 $ al mese. Addebita otto volte la quota e il livello diventa semplicemente poco attraente su un piano. In un modo o nell'altro, il livello si colloca laddove la quota è abbastanza ampia da assorbirlo.

L'API non ha questo tipo di vincolo, perché è a consumo. Lì, Ultrafast ha un proprio budget di rate limit, separato da quelli di Standard e Fast, e OpenAI descrive quei limiti come impostati per organizzazione anziché pubblicati sulla pagina del livello. Questa è una seconda cosa a cui prestare attenzione che l'annuncio non ha messo in evidenza: spostare un carico di lavoro su Ultrafast non moltiplica soltanto la bolletta, lo sposta su un tetto diverso, e se aumenti il traffico oltre quanto è stato concesso all'organizzazione, i limiti del livello stesso diventano la modalità di errore.

L'aritmetica di comprare velocità in due modi diversi

Ecco la decisione in cifre, ed è la parte che vale la pena fare sui tuoi conteggi di token anziché sui miei. Prendi una sessione di un agente che invia 30.000 token di input e riceve 1.500 token di output per turno, su 40 turni.

• Token totali per esecuzione — 1.200.000 in input, 60.000 in output, distribuiti su 40 richieste che restano ciascuna comodamente al di sotto della soglia di 272.000 token oltre la quale OpenAI ricalcola il prezzo dell'intera richiesta.

• Su GPT-6.1 Sol standard — 1,2 milioni di token a 2,00 $ per milione fanno 2,40 $, più 60.000 a 10,00 $ per milione fanno 0,60 $. Tre dollari a esecuzione.

• Su GPT-6.1 Sol Ultrafast — 1,2 milioni a 12,00 $ fanno 14,40 $, più 60.000 a 60,00 $ fanno 3,60 $. Diciotto dollari per esecuzione.

• La differenza — 15,00 $ per esecuzione per eliminare gran parte del tempo di generazione su un job che per il resto non cambia.

Quel $15,00 per esecuzione è il numero da confrontare con l'abbonamento. Se l'unico motivo per cui stai considerando il piano Pro è Ultrafast, circa 33 esecuzioni al mese con questi conteggi di token è il punto in cui i $500 del piano e il contatore per token dell'API si incrociano — al di sotto, il contatore è il modo più economico per acquistare lo stesso livello, e al di sopra, il piano inizia a convenire. I tuoi conteggi di token sposteranno quel punto di incrocio, a volte anche di molto, quindi fai i tuoi calcoli prima di trattare 33 come soglia. È il nostro calcolo su un carico di lavoro dichiarato, non un punto di pareggio pubblicato.

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>Due note strutturali che sopravvivono a qualsiasi conteggio di token.

L'affermazione sulla velocità è presa in prestito, ed è l'unica cosa da leggere con attenzione.

Ultrafast viene venduto con "fino a 8 volte più veloce", e l'unica misurazione specifica per modello che OpenAI pubblica a sostegno di questa frase appartiene a un modello diverso. La frase nella sua documentazione afferma che GPT-6 Astra Ultrafast genera token fino a 8 volte più velocemente di GPT-6 Astra in modalità Standard in Codex. Si tratta di un dato di Astra, misurato in Codex. La documentazione per il livello di GPT-6.1 Sol lo descrive come in grado di ridurre il tempo inter-token e rimanda a una tabella tariffaria; non gli attribuisce un numero, e nessuna parte indipendente ha pubblicato una misurazione di token al secondo nemmeno per la variante Sol.

Potrebbe benissimo reggere. Entrambi i modelli girano sullo stesso stack di serving e il meccanismo del tier è lo stesso, quindi un moltiplicatore di Astra è un prior ragionevole per Sol. Ma "fino a 8x" è un tetto del fornitore, non riprodotto, preso da un modello fratello — e il "fino a" sta facendo un vero lavoro in quella frase. Tratta il moltiplicatore come un'ipotesi da testare sui tuoi prompt, perché la documentazione del tier stesso non lo testa per te.

La stessa avvertenza è più facile da fare per i livelli più vecchi. Ultrafast su GPT-5.6 Sol è stato annunciato il 13 agosto 2026 con "fino a 14 volte più veloce dell'elaborazione Standard" in anteprima limitata, e tre mesi dopo la documentazione parla ancora di accesso in anteprima, mentre la tabella delle tariffe di Ultrafast contiene esattamente due righe — GPT-6 Astra e GPT-6.1 Sol. Un numero 14x senza prezzo pubblicato e senza disponibilità generale è un'affermazione più che un prodotto, ed è un utile promemoria di quanto di questa gerarchia di livelli sia ancora solo aspirazionale.

Se il piano da $500 non si fa

Per chiunque non abbia intenzione di acquistare Pro da $500 per testare un livello di latenza, la mossa utile è separare le due cose che l'annuncio ha raggruppato. Il livello è disponibile sull'API per tutti gli utenti API, quindi la corsia veloce è acquistabile senza un abbonamento — a $12,00 e $60,00 per milione di token, con un proprio budget di rate limit, su un carico di lavoro abbastanza piccolo da poter essere misurato. Provalo prima lì, sui tuoi prompt, confrontandolo con la corsia standard.

La corsia standard è quella che esiste senza tutto questo. OrcaRouter serve GPT-6.1 Sol come openai/gpt-6.1-sol alle tariffe di listino di O​penAI stesso — 2,00 $ per milione di token in input e 10,00 $ per milione di token in output — con 0% di markup e il prezzo del fornitore trasferito direttamente, così un adeguamento dei prezzi del fornitore arriva dalla nostra parte lo stesso giorno. Ultrafast non è qualcosa che vendiamo: è un flag di livello di servizio fatturato sul tuo account O​penAI, e preferiamo dirlo chiaramente piuttosto che lasciare che una pagina di modello lasci intendere il contrario. Ciò che una chiave acquista è la capacità di instradare la corsia standard e il resto del catalogo — più di 200 modelli dietro un unico endpoint compatibile con O​penAI — e di eseguire automaticamente il failover tra provider quando uno è degradato, che è l'assicurazione più economica disponibile se stai per mettere un livello di latenza davanti a un percorso di produzione.

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

E se sei su Plus o Team e la risposta che stavi cercando era «posso semplicemente attivarlo?», la risposta è no, con una forma specifica. Codex e ChatGPT Work su Pro da $500 o su un piano Enterprise o Edu idoneo, abilitati da un amministratore se si tratta del tipo enterprise. Tutto il resto raggiunge Ultrafast tramite l'API e paga per token.

Cosa guardare dopo

Tre cose trasformerebbero questo da un rollout con accesso controllato in un rollout ordinario, e tutte e tre sono osservabili. Un rate limit Ultrafast pubblicato per GPT-6.1 Sol porrebbe fine alle congetture su se il tetto del livello stesso si imponga prima della bolletta. Una misurazione di velocità specifica per il modello — o una indipendente — sostituirebbe il numero preso in prestito da Astra con qualcosa su cui poter valutare il livello Sol. E il fatto che Ultrafast arrivi su ChatGPT Plus significherebbe che i calcoli sulla capacità sono cambiati, il che è il segnale che il gate era una scarsità di lancio e non la forma permanente del livello.

Fino ad allora la sintesi onesta è ristretta e verificabile. GPT-6.1 Sol è stato rilasciato il 29 settembre 2026 ed è invariato. L'8 ottobre 2026 ha ottenuto una corsia preferenziale con un prezzo reale, aperta agli utenti API e riservata in ChatGPT al piano da $500 — un dettaglio che meritava il primo post anziché il terzo, e che per la maggior parte dei lettori decide se si tratta di una voce di spesa o di un ordine d'acquisto.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno