Una card del titolo hero generata per "GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed" con il sopratitolo "Due livelli di velocità. Un prezzo mancante." e due card: a sinistra "GPT-5.6 Sol Ultrafast" che elenca Pesi: come Sol, Velocità dichiarata: fino a 14x, Prezzo: non ancora pubblicato; a destra "MiMo v2.6 Pro Ultraspeed" che elenca Pesi: come Pro, Velocità dichiarata: da 10x a 20x, Prezzo: $4.35 / $8.70; footer "Nessuno dei due è stato misurato in modo indipendente." Logo OrcaRouter in basso a destra.
Guides & Insights

GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: due livelli di velocità, un prezzo mancante

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Due fornitori hanno lanciato la stessa idea di prodotto a tre settimane di distanza, e la differenza tra loro è il modo migliore per capire cosa stanno davvero vendendo. Il fronte Xiaomi è arrivato il 22 settembre 2026: Xiaomi MiMo v2.6 Pro Ultraspeed è lo stesso checkpoint da 1,02 trilioni di parametri di MiMo-V2.6-Pro, servito più velocemente, a 4,35 $ per milione di token di input e 8,70 $ per milione di output, contro gli 0,44 $ e 0,87 $ del canale Pro standard. Il GPT-5.6 Sol Ultrafast del fornitore è la stessa manovra applicata a GPT-5.6 Sol: pesi identici, fino a 750 token di output al secondo, fino a 14× il livello standard, in esecuzione su hardware wafer-scale di Cerebras — e nessun prezzo pubblicato, sei settimane dopo l'annuncio della modalità avvenuto il 13 agosto.

Mettili uno accanto all'altro e l'anomalia è immediata. Xiaomi ha pubblicato un listino prezzi prima di pubblicare la maggior parte dei benchmark. OpenAI ha pubblicato i benchmark, il partner hardware e i nomi dei clienti — e non ha ancora pubblicato un numero su cui poter basare un budget. Uno di questi livelli può essere acquistato oggi. L'altro è un valore in uno schema API. Confrontarli, quindi, significa chiedersi meno quale sia più veloce e più quanto valga un livello di velocità quando un fornitore ti ha comunicato il prezzo e l'altro no.

Cosa sia in realtà ognuno

Nessuno dei due è un nuovo modello. Questa è la premessa condivisa e vale la pena affermarla senza mezzi termini, perché entrambi i lanci hanno attirato una copertura che ha trattato un cambiamento nel serving come un rilascio di capacità.

MiMo v2.6 Pro Ultraspeed è una configurazione di serving del modello di punta di Xiaomi: stesso checkpoint sparse mixture-of-experts da 1,02T parametri con 42B attivati per token, stesso contesto da 1M token, stessa multimodalità nativa su testo, immagine, video e audio, stessi pesi con licenza MIT sui repository pubblici. Il materiale di Xiaomi stesso dichiara fino a 20 volte la velocità di output del servizio Pro standard, a parità di qualità; gli elenchi di cataloghi di terze parti che descrivono lo stesso modello nello stesso giorno indicano circa 10 volte. Nessuno ha pubblicato una misurazione che riconcili le due.

GPT-5.6 Sol Ultrafast è una configurazione di servizio del modello di punta di OpenAI: stesso checkpoint, stesso comportamento di ragionamento, stessa finestra di contesto da 1.050.000 token, stesso output massimo di 128K, stesse risposte. L'accelerazione è data dall'hardware anziché dallo scheduling — i pesi del modello risiedono nella SRAM on-chip sul silicio wafer-scale di Cerebras invece di essere spostati tra la memoria della GPU e il compute — ed è il primo prodotto della partnership computazionale tra OpenAI e Cerebras di gennaio 2026, stimata in circa 10 miliardi di dollari nell'arco di tre anni.

Quindi l'asse onesto di confronto non è l'intelligenza. È ciò che il fornitore ha scelto di cambiare, quanto ha fatto pagare per il cambiamento e quanta parte del cambiamento ti ha permesso di verificare.

A screenshot of the Hugging Face model card for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the TextGeneration / Transformers / Safetensors / English / Chinese / mimo_v2 / multimodal / conversational / custom_code / 3-bit precision fp8 tags, a License: mit badge, 53 likes, and the card opening 'MiMo-V2.6-Pro-RL — Scaling Reinforcement Learning Toward Self-Improvement' with the Technical Report link and the introduction describing native omnimodal input and a 1M-token context window.

Le schede tariffarie, inclusa quella vuota

• MiMo v2.6 Pro Ultraspeed — 4,35 $ input / 8,70 $ output per milione di token, pubblicato da Xiaomi.

• MiMo-V2.6-Pro standard — 0,44 $ / 0,87 $, pubblicati dai cataloghi commerciali di Xiaomi. Circa 9,9× sull'input ed esattamente 10× sull'output.

• GPT-5.6 Sol Ultrafast — nessuna scheda tariffaria pubblicata al 27 settembre 2026. La pagina dei prezzi di OpenAI presenta ancora quattro schede — Standard, Batch, Flex, Fast — e il livello non è tra queste.

• GPT-5.6 Sol standard — $4,00 / $20,00 per milione, l'attuale tariffa promozionale di OpenAI, con input in cache a $0,40 e un passaggio a contesto lungo a $8,00 / $30,00 oltre circa 272K token di input.

L'unico premium comparabile che OpenAI abbia mai prezzato — la modalità Fast, a $8,00 / $40,00, esattamente il doppio della tariffa standard per una velocità di output fino a circa 2,5×.

Quell'ultima riga è l'intera ragione per cui lo spazio vuoto conta. Il livello di velocità di Xiaomi costa dieci volte la corsia standard e dichiara una velocità da dieci a venti volte superiore, il che è almeno internamente coerente come scambio: paghi proporzionalmente di più per un'attesa proporzionalmente minore, e la scommessa è che il tempo effettivo sia il prodotto. Il livello di velocità di OpenAI è una pretesa maggiore su silicio più scarso rispetto a Fast mode, quindi qualunque cosa alla fine costi, il precedente indica un premio anziché uno sconto. Ma "il precedente dice un premio" non è un numero, e finché non ne esiste uno, il livello non può affatto essere confrontato con UltraSpeed sul prezzo — solo sul fatto che Xiaomi era disposta a dire il suo numero e OpenAI no.

Da dove vengono i numeri

I due livelli hanno problemi probatori opposti, e vale la pena nominarli entrambi invece di spartire la differenza.

La dichiarazione di velocità di Xiaomi è vaga in termini di entità ma ancorata a un prezzo pubblicato. Il 20× è un tetto del fornitore in condizioni che Xiaomi non ha specificato, il 10× è ciò che una scheda di catalogo era disposta ad affermare come tipico, e il moltiplicatore reale si trova da qualche parte in un'ampia fascia che nessuno ha misurato pubblicamente a un livello di concorrenza dichiarato. Di contro, il prezzo è esatto, i pesi sono scaricabili con licenza MIT, e il rapporto tecnico e l'ambiente di addestramento per l'apprendimento per rinforzo sono pubblici — puoi ispezionare ciò che Xiaomi ha fatto, semplicemente non puoi ancora verificare quanto velocemente venga eseguito.

L'affermazione di OpenAI sulla velocità è specifica in termini quantitativi ma non è ancorata ad alcun prodotto acquistabile. Fino a 750 token di output al secondo, fino a 14 volte lo standard, affermato senza giri di parole. È anche un dato di throughput per i token di output, non un moltiplicatore end-to-end fisso: l'elaborazione dell'input e il ragionamento del modello stesso non si comprimono a quel rapporto, motivo per cui l'azienda lo definisce un massimo. I benchmark a supporto sono riportati dal fornitore e in un caso tra fornitori diversi — un'esecuzione di Humanity's Last Exam da 2.500 domande riportata come conclusa in 11 ore e 11 minuti contro 78 ore e 27 minuti per Claude Fable 5, con accuratezza comparabile. La copertura indipendente del lancio ha citato un confronto più ristretto, di circa 11×, sulla velocità di generazione nella stessa esecuzione, mentre le cifre di Cerebras implicano circa 7× per il tempo totale del test. Tre soggetti, tre frazioni di un unico carico di lavoro, nessuna riproduzione da parte di terzi di alcuna di esse. Cerebras riporta separatamente 5,6× end-to-end su GDP-Val senza perdita di qualità misurabile, anch'esso non riprodotto.

Entrambi i gruppi di numeri sono dichiarati dai fornitori. La differenza è che la vaghezza di Xiaomi riguarda la velocità e quella di OpenAI riguarda il costo, e per chiunque stia redigendo un budget, il costo è quello più difficile da indovinare.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Speed claim up to 14x, Output speed up to 750 tok/s, Price not published, Context 1.05M tokens, Access waitlisted preview. Right column 'MiMo v2.6 Pro Ultraspeed': Checkpoint same as Pro, Speed claim 10x to 20x, Output speed not published, Price $4.35 / $8.70, Context 1M tokens, Access purchasable today. Footer sourcing line noting neither speed claim is independently measured; OrcaRouter logo bottom-right.

Cosa è successo questa settimana, e perché non colma il divario

Il motivo per cui questo confronto ha un aggancio giornalistico è un commit, non un annuncio. Il valore ultrafast è presente nello schema pubblico openai-openapi di OpenAI dal 13 agosto 2026 — lo stesso giorno in cui è stata annunciata la modalità — e porta la descrizione che lo circoscrive a gpt-5.6-sol e lo definisce ad accesso controllato. Il commit che è passato questa settimana è successivo e più piccolo: il 25 settembre 2026, fe4f7a1 ha aggiunto ultrafast a due ulteriori enumerazioni, il parametro service-tier a livello di richiesta e il campo della policy service-tier dell'agente. Prima di quel commit quelle due liste riportavano auto, default, flex, priority, fast. Dopo, c'è una voce descritta come "Usa il livello di servizio ultrafast."ultrafast alle service_tier enumerazioni nella sua specifica pubblica openai-openapi — il campo che lo schema descrive come "il livello di servizio utilizzato per le richieste al modello", e il campo della policy associato agli agenti. Prima della modifica quella lista riportava default, flex, priority, fast. Dopo di essa c'è una voce descritta come "Usa il livello di servizio ultrafast."

La distinzione è importante per chiunque legga la copertura. Questo non è il livello che viene creato; è il livello che viene collegato al campo con cui è configurato un agente, il che significa che alla fine si potrà scrivere un client per interfacciarsi con esso senza alcun nuovo endpoint. Un articolo del giorno successivo descrive un selettore Fast / Standard / Ultrafast in arrivo nel Responses API Playground, con un accesso più ampio previsto dopo la conferenza DevDay di OpenAI. Non abbiamo visto il selettore e OpenAI non ha pubblicato una nota di rollout, quindi quella parte è a fonte unica. Ciò che è verificabile sono le voci aggiunte allo schema e la persistente assenza di un listino prezzi sei settimane dopo l'annuncio.

Nel frattempo la fascia di Xiaomi è acquistabile da cinque giorni ed è ancora l'unica delle due che puoi mettere in fattura. La sua questione aperta è diversa: se un premium di 10× regge, o se si comporta come la maggior parte dei prezzi di lancio di una nuova fascia premium e scivola verso la corsia standard quando la copertura del lancio si esaurisce. Standard Pro a 0,44 $ / 0,87 $ è l'ancora, e una fascia che parte a dieci volte la sua ancora raramente finisce lì.

Scegliere tra loro, dato che probabilmente non puoi

Il fatto pratico e scomodo è che per la maggior parte dei lettori si tratta di un confronto tra un livello che non si può acquistare e uno che probabilmente non si dovrebbe acquistare a prezzo di listino. GPT-5.6 Sol Ultrafast è un'anteprima in lista d'attesa per clienti selezionati, in espansione man mano che la capacità aumenta, senza data di disponibilità generale né prezzo; MiMo v2.6 Pro Ultraspeed è disponibile, costoso e pensato per un tipo specifico di acquirente.

Il test del carico di lavoro è lo stesso per entrambi, e riguarda la forma del tuo grafo di richieste piuttosto che la dimensione del tuo prompt. Una singola generazione lunga guadagna molto meno del moltiplicatore annunciato, perché l'elaborazione dell'input e il ragionamento non accelerano allo stesso rapporto. Un ciclo di agente a quaranta passaggi dietro una singola azione visibile all'utente guadagna qualcosa di molto più vicino al numero completo, perché ogni round trip è latenza che una persona sta sopportando. Se il tuo traffico assomiglia alla seconda forma, entrambi i livelli sono pensati per te; se assomiglia alla prima, la corsia standard su entrambi i modelli è sempre stata la scelta corretta e la corsia standard MiMo-V2.6-Pro a $0.44 / $0.87 è uno dei modi più economici per chiamare un modello di classe trilione di parametri ovunque.

Ciò che nessuno dei due livelli cambia è che stai acquistando latenza, non qualità. Se sottoponi UltraSpeed o Ultrafast a benchmark rispetto alla sua corsia standard sugli stessi prompt e ottieni risposte diverse, questo è un risultato degno di essere segnalato, non una funzionalità: nulla nella descrizione di nessuno dei due fornitori afferma che i pesi siano cambiati.

Questo è anche il caso in cui un router si guadagna il suo posto, e in particolare per il tier che non puoi ottenere. GPT-5.6 Sol è attivo su OrcaRouter come openai/gpt-5.6-sol alla tariffa del provider stesso con zero markup sui token tramite l'endpoint compatibile con OpenAI su api.orcarouter.ai/v1, quindi la corsia standard su cui ripiegheresti è a un solo cambio di base-URL di distanza, e la stessa chiave porta oltre 200 modelli. Questo conta perché la risposta onesta a "dovrei usare Ultrafast" oggi è "non puoi, quindi decidi cosa gestisce il traffico interattivo nel frattempo" — e il modo per comprare latenza senza lista d'attesa è instradare le chiamate interattive verso qualunque modello del catalogo superi la tua soglia di qualità con il minor tempo effettivo, e lasciare il lavoro notturno sulla corsia più economica che passa. Quando il tier si apre, quello è l'interruttore che azioni. Nota chiaramente cosa non ospitiamo: nessun modello Xiaomi è su OrcaRouter, quindi MiMo v2.6 Pro Ultraspeed proviene dall'API di Xiaomi stessa e da diverse piattaforme di terze parti, e questa pagina non è una via per arrivarci.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, labelled 'Openweights model, Released September 2026', showing the Intelligence, Performance & Price Analysis headings with an Intelligence Index figure, a Speed figure, a Cost figure of In $0.435 / Out $0.87 with a 99% cache discount, a $0.13 blended figure, a Verbosity rank of 20/115, and a Comparison Summary describing the model as among the leading open-weight models in intelligence and notably fast but somewhat verbose, with text, image, speech and video input and a 1M-token context window.

Cosa lo risolverebbe

Tre misurazioni, nessuna delle quali esiste ancora. Una rate card Ultrafast pubblicata renderebbe questo il confronto che merita di essere, anziché un confronto con un buco al suo interno. Una distribuzione indipendente della latenza a un livello di concorrenza dichiarato ti direbbe se il moltiplicatore reale di Xiaomi si colloca più vicino a 10× o a 20×, e se regge sotto carico anziché in una dimostrazione a flusso singolo. E una riproduzione indipendente della suite di benchmark di uno dei due vendor sposterebbe entrambe le serie di cifre fuori dalla colonna delle dichiarazioni.

Fino ad allora l'interpretazione difendibile è ristretta. Xiaomi ha lanciato una fascia di velocità con un prezzo e una velocità vaga; OpenAI ha lanciato una fascia di velocità con una velocità specifica e nessun prezzo; entrambe sono lo stesso modello della cosa rispetto alla quale sono prezzate, e nessuna delle due è stata misurata in modo indipendente. Se ti serve la latenza adesso e il carico di lavoro è interattivo, UltraSpeed è reale, acquistabile e prezzato esattamente per l'acquirente che vuole. Se ti serve adesso e il carico di lavoro non è interattivo, le corsie standard di entrambi i modelli sono più economiche, collaudate e disponibili oggi — e la fascia su cui tutti stanno discutendo sarà ancora lì quando qualcuno pubblicherà un numero.