
GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: due corsie veloci, una dice quanto è costato
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAIGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
I due modi più rapidi per acquistare un modello di frontiera sono andati in vendita a sedici giorni di distanza, e solo uno dei due ti ha detto come è stata prodotta la velocità. GPT-6.1 Ultrafast — il livello di servizio sopra GPT-6.1 Sol, che OpenAI ha rilasciato il 29 settembre 2026 e che ha ottenuto questo livello l'8 ottobre 2026 — è un modello di punta chiuso a cui si accede tramite API, con un prezzo sei volte quello di Standard e senza alcun resoconto pubblicato di ciò che accade tra i pesi e la tua richiesta. Xiaomi MiMo v2.6 Pro Ultraspeed, rilasciato il 22 settembre 2026, è un livello di velocità sopra MiMo-V2.6-Pro, un checkpoint con licenza MIT di cui Xiaomi ha pubblicato anche l'ambiente di apprendimento per rinforzo. Entrambi vendono la latenza a un multiplo. Solo il multiplo di Xiaomi poggia su qualcosa che un cliente può ispezionare, e quella differenza, ai fini della decisione, conta più di entrambe le promesse di velocità.
Il prezzo delle due corsie è la parte facile ed è trattato di seguito. La parte difficile è che un livello di velocità è una promessa sul servizio, e i due fornitori hanno fatto quella promessa a livelli di divulgazione molto diversi: uno ha preso in prestito il numero di punta da un modello affine, l'altro ha pubblicato la ricetta di addestramento insieme al listino prezzi. Se stai per affidare un carico di lavoro di produzione a una corsia veloce, il divario di divulgazione è il rischio che ti stai effettivamente assumendo.
I prezzi, con entrambi i lati sulla stessa riga
Entrambi i livelli vengono venduti come multiplo di una corsia standard, e i multipli sono abbastanza vicini che il prezzo non è ciò che li distingue.
• Canale standard — GPT-6.1 Sol a $2,00 input / $10,00 output per milione di token, contro MiMo-V2.6-Pro a $0,44 / $0,87.
• Corsia veloce — GPT-6.1 Ultrafast a $12,00 / $60,00, contro MiMo-V2.6-Pro-UltraSpeed a $4,35 / $8,70.
• Il moltiplicatore — esattamente 6x su ogni riga per il livello OpenAI, circa 9,9x sull'input ed esattamente 10x sull'output per quello di Xiaomi.
• Input in cache — GPT-6.1 Sol costa 0,10 $ per milione su Standard e 0,60 $ su Ultrafast; il listino prezzi di MiMo che possiamo consultare non pubblica una voce separata per l'input in cache per nessuna delle due modalità.
• Contesto lungo — GPT-6.1 Sol rimodula il prezzo dell'intera richiesta a 2x le tariffe di input e cache e a 1,5x l'output oltre i 272.000 token di input, portando Ultrafast a $24,00 / $1,20 / $30,00 / $90,00. MiMo-V2.6-Pro offre una finestra di contesto da 1M di token senza un'equivalente soglia di prezzo pubblicata.
• Divario assoluto — le due corsie veloci sono distanti 2,8x in input e 6,9x in output, ovvero il divario tra un modello chiuso di frontiera e uno a pesi aperti che si manifesta all'interno del livello di velocità anziché alla tariffa standard.
Il riassunto in una riga di quel blocco: Xiaomi applica un moltiplicatore più alto su un modello molto più economico, e OpenAI applica un moltiplicatore più basso su uno molto più costoso. Sui token di output paghi $60,00 per milione per la corsia OpenAI e $8,70 per quella di Xiaomi. Nessuno dei due fornitori offre uno sconto per la velocità; entrambi la prezzano come un prodotto separato, il che è il primo segno che in entrambi i casi la corsia standard è ancora quella predefinita e la corsia veloce è un'eccezione che giustifichi in base al carico di lavoro.
Cosa ti dirà ogni fornitore riguardo alla velocità
È qui che i due rollout smettono di essere simmetrici, ed è la cosa più utile della pagina.
Il numero pubblicato da OpenAI per Ultrafast è che GPT-6 Astra Ultrafast genera token fino a 8 volte più velocemente di GPT-6 Astra in modalità Standard in Codex. Si tratta però della misurazione di un modello diverso, in un client diverso, formulata come tetto massimo. La documentazione che riguarda Ultrafast per GPT-6.1 Sol afferma che il livello riduce il tempo tra i token di output generati e rimanda a una rate card; non associa alcun numero al livello Sol. Quindi il numero di punta legato a questo rilascio è preso in prestito dal modello gemello che è su Ultrafast dal 29 settembre, e nessuna parte indipendente ha pubblicato una misurazione di token al secondo per nessuno dei due. Può benissimo reggere — stesso stack di serving, stesso meccanismo — ma è un tetto massimo dichiarato dal fornitore che OpenAI stessa non ha misurato per questo modello.
La divulgazione di Xiaomi è di natura diversa, e la differenza non sta nel fatto che sia più precisa. Il materiale di Xiaomi stesso afferma che UltraSpeed raggiunge fino a 20 volte la velocità di output del servizio Pro standard alla stessa qualità. Le schede di catalogo di terze parti che descrivono lo stesso modello nello stesso giorno indicano circa 10 volte. Entrambi i numeri circolano, non sono lo stesso numero, e nessuno ha pubblicato una misurazione che li concili. A leggerla onestamente: "fino a 20x" è un limite massimo dichiarato dal fornitore in condizioni che Xiaomi non ha specificato, "circa 10x" è ciò che un catalogo era disposto ad affermare come tipico, e il moltiplicatore reale si colloca da qualche parte in una fascia ampia finché qualcuno non pubblica distribuzioni della latenza per richiesta a un livello di concorrenza dichiarato.
Quindi Xiaomi ti fornisce due numeri non riconciliati, e OpenAI te ne fornisce uno che appartiene a un modello diverso. Nessuno dei due è un dato su cui puoi basare il budget, e la conseguenza pratica è la stessa per entrambi: misura il tier sui tuoi stessi prompt prima di impegnarti in un percorso di produzione basato su di esso.
{{1}}L'asimmetria che{{1}} {{2}}le cifre extra comprano{{2}}{{3}}{{3}}
A parte le dichiarazioni sulla velocità, le due corsie sono associate a tipi di prodotto molto diversi, ed è qui che la scelta smette di essere un confronto di prezzo.
MiMo-V2.6-Pro è un'architettura mixture-of-experts sparsa che Xiaomi ha descritto pubblicamente: 1,02 trilioni di parametri totali con 42 miliardi attivati per token, una finestra di contesto da 1 milione di token, multimodalità nativa su testo, immagine, video e audio, e un'etichetta di licenza MIT sui checkpoint rilasciati. Il pacchetto di rilascio include un rapporto tecnico e note di deployment, e Xiaomi afferma di rilasciare in open source l'ambiente di addestramento di reinforcement learning e il relativo codice, così che il post-training possa essere esaminato e riprodotto. Anche l'esecuzione RL è documentata: 30 step e circa 750.000 traiettorie per modello, in meno di sei giorni, con una spesa complessiva pubblicata di circa 3.474.715 $ per le esecuzioni Pro e Flash. Su DeepSWE v1.1, l'harness proprietario di Xiaomi con mini-swe-agent ad avg@3, l'azienda riporta MiMo-V2.6-Flash passare da 48,8 a 65,68 e MiMo-V2.6-Pro da 58,4 a 72,57 in quella run. Sono dati dichiarati dal fornitore e non riprodotti; la distinzione tra "l'harness di Xiaomi dice 72,57" e "72,57 è il punteggio" è la differenza tra un'affermazione e un fatto.
GPT-6.1 Sol non pubblica nulla di tutto ciò. Non c'è un conteggio dei parametri, nessuna nota sull'architettura, nessuna cifra di spesa per l'addestramento, nessun checkpoint e nessuna licenza da leggere — ci sono una model card, una finestra di contesto, una data di cutoff delle conoscenze del 30 aprile 2026 e un'API. Questa è la normale prassi per un laboratorio di frontiera e non è una critica. Ma ha una conseguenza per una decisione d'acquisto che la copertura del lancio tende a tralasciare: con il binario open-weight, un livello veloce deludente è recuperabile. Se UltraSpeed si rivela non valere 10 volte il tuo traffico, lo stesso checkpoint è scaricabile e puoi servirlo tu stesso o tramite un altro provider, il che limita le tue perdite al costo della migrazione. Con il binario chiuso, un livello veloce deludente è una bolletta e un budget di rate-limit che ridimensioni al ribasso; non puoi aggirarlo eseguendo i pesi, perché non ci sono pesi da eseguire.
Una precisazione su quel tag MIT, perché nella copertura del lancio viene appiattito. La licenza si applica ai checkpoint pubblicati da Xiaomi. UltraSpeed è un servizio ospitato, e i servizi ospitati sono regolati da termini di servizio anziché da una licenza sui pesi. Avere il diritto di eseguire il checkpoint sul proprio hardware e avere il diritto di rivendere l'erogazione accelerata che qualcun altro ne fa sono due diritti diversi, e solo il primo deriva dal file di licenza.


Due trappole di denominazione prima di copiare l'uno o l'altro identificatore
Nessuno dei due nomi nel titolo di questa pagina è un checkpoint, e la documentazione di entrambi i fornitori rende l'errore facile da ripetere.
• GPT-6.1 Ultrafast — non è un modello. L'identificatore nella richiesta resta lo stesso di quello del modello standard; il livello viene impostato da un campo della richiesta e il risultato è lo stesso checkpoint pianificato in modo diverso.
• MiMo v2.6 Pro Ultraspeed — anche questo non è un insieme distinto di pesi. È il checkpoint MiMo-V2.6-Pro servito su un percorso più rapido e con un prezzo indicato come voce a sé stante.
• Che cosa significa per il benchmarking: se confronti le due corsie di uno dei due modelli su prompt identici, il risultato atteso sono le stesse risposte a velocità diverse. Contenuti divergenti sullo stesso input sono un difetto da segnalare, non una capacità che hai acquistato.
• Cosa significa per il controllo della licenza — per Xiaomi, leggi la model card. Per OpenAI, non c’è nulla da leggere, perché i pesi non vengono distribuiti.
C'è anche un'asimmetria più tenue che emerge nel modo in cui viene venduto ciascun livello. GPT-6.1 Sol supporta la residenza dei dati negli Stati Uniti e nell'UE e l'elaborazione globale, anche con Ultrafast, quindi un carico di lavoro vincolato all'elaborazione europea ha una risposta documentata. Il tariffario MiMo che possiamo consultare non indica affatto la residenza: Xiaomi vende un modello e un percorso di servizio, non una posizione di conformità. Per un acquirente soggetto a regolamentazione, quella singola riga può decidere il confronto prima ancora che venga considerato il prezzo.
Dove ciascuna corsia è effettivamente chiamabile
Entrambe le corsie veloci sono accessibili tramite l'API proprietaria del rispettivo fornitore, ed entrambe compaiono su piattaforme di terze parti. Nessuna delle due è presente su OrcaRouter, e vale la pena dirlo chiaramente anziché lasciare che una pagina di confronto suggerisca il contrario.
Ciò che è su OrcaRouter è la corsia standard del modello OpenAI: openai/gpt-6.1-sol alle tariffe di listino di OpenAI stessa di 2,00 $ per milione di token di input e 10,00 $ per milione di token di output, con 0% di ricarico e il prezzo del provider passato tal quale, così una variazione di prezzo del fornitore arriva dalla nostra parte lo stesso giorno. Ultrafast è un flag di livello di servizio fatturato sul tuo account OpenAI personale, e nessun modello Xiaomi è ospitato qui. Ciò che una singola chiave offre è la corsia standard accanto a più di 200 altri modelli dietro un unico endpoint compatibile con OpenAI, con failover automatico tra provider — che è la posizione utile quando il carico di lavoro che stai proteggendo è quello che noterebbe un tetto di rate limit alle tre del mattino.

Quale corsia testare, in ordine
Se il tuo carico di lavoro è interattivo e il tempo di generazione pesa sul tempo di una persona, entrambi i livelli meritano una prova, e il fattore decisivo non sarà il prezzo: sarà la data di scadenza della tua fiducia. Il binario open-weight ti permette di verificare e poi andartene; il binario closed ti chiede di verificare con l'unico fornitore in grado di erogarlo e di restare. Questa asimmetria è reale, ma non è gratuita: MiMo-V2.6-Pro-UltraSpeed è un servizio hosted, quindi l'uscita è una migrazione più che una modifica di configurazione, e il checkpoint verso cui migreresti potrebbe non corrispondere alle ottimizzazioni di erogazione di quel livello.
Se il tuo carico di lavoro è batch o pianificato, entrambi sono l'acquisto sbagliato, a 6x e a 10x, e la mossa onesta è eseguirlo sulla corsia standard e spendere invece la differenza in valutazione.
Cosa cambierebbe questa pagina: una misurazione indipendente della velocità di output di uno dei due tier a un livello di concorrenza dichiarato, una dichiarazione sulla residenza pubblicata da Xiaomi, oppure un numero di rate limit da OpenAI per il tier Sol sul quale un acquirente possa pianificare invece di doverlo richiedere. Finché non esisteranno, il confronto è un listino prezzi contro un listino prezzi, con uno dei due fornitori che ha pubblicato molto di più sull'oggetto di cui si sta determinando il prezzo.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
