
MiMo-V2.6-Pro vs GPT-5.6 Sol: Un punto indice costa quindici volte di più per attività
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 36 tok/s
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 181 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
Nell’Artificial Analysis Intelligence Index v4.3.2, consultato il 25 settembre 2026, GPT-5.6 Sol con sforzo massimo ottiene 47 e MiMo-V2.6-Pro di Xiaomi ottiene 46. Un punto. Il numero che li separa davvero non è il punteggio e non è la tariffa per token — è il costo di un singolo task dell’indice, che Artificial Analysis pubblica come 1,99 $ per GPT-5.6 Sol e 0,13 $ per MiMo-V2.6-Pro. Quindici volte la cifra per un punto. E al momento di questa lettura, la pagina dello stesso valutatore per quel modello riporta un avviso di deprecazione, perché GPT-6 Sol lo ha sostituito.
Xiaomi ha pubblicato i pesi e il rapporto tecnico di MiMo-V2.6-Pro il 21 settembre 2026, quattro giorni prima di questa lettura; OpenAI ha rilasciato GPT-5.6 Sol il 9 luglio 2026. Entrambi i fatti sopra sono nuovi da quando questo abbinamento è stato trattato l’ultima volta, e tirano in direzioni opposte. L’avviso di deprecazione dice che il confronto è con un modello che OpenAI ha già superato. Il dato per singolo task dice che ciò che sembrava un errore di arrotondamento quando entrambi i modelli erano quotati al prezzo di listino, su un carico di lavoro reale, è l’intera decisione. Quale dei due fattori pesi di più dipende dal fatto che si stia acquistando un modello o sostituendone uno.
Cosa dicono ora le due pagine
GPT-5.6 Sol è stato rilasciato il 9 luglio 2026 come modello di punta della famiglia GPT-5.6. Il suo prezzo di listino è di $4,00 per milione di token di input e $20,00 per milione di output sull’API first-party di OpenAI, con uno sconto sulla cache del 90%, e la pagina registra 90 milioni di token di output generati durante l’esecuzione dell’indice rispetto a una mediana di 88 milioni. Ha misurato 73 token di output al secondo, che la stessa pagina definisce più veloce della media rispetto a una mediana di 72 t/s. La sua voce nell’indice si colloca al rango 19 di 210 modelli della sua classe.
Xiaomi MiMo-V2.6-Pro è un checkpoint sparse mixture-of-experts con 1,02 trilioni di parametri totali e 42 miliardi attivi, con licenza MIT, con una finestra di contesto da 1M token e input di testo, immagini, voce e video a fronte di output testuale. È listato a $0,43 e $0,87 per milione di token con uno sconto sulla cache del 99% — un decimo della tariffa di input di Sol e un ventitreesimo della sua tariffa di output. Ha generato 140 milioni di token di output durante l'esecuzione dell'indice, e ha misurato 43,6 token di output al secondo, che la sua pagina descrive come notevolmente lento rispetto a una mediana di 67,1 t/s.
• Costo del task di indicizzazione — MiMo-V2.6-Pro $0,13; GPT-5.6 Sol $1,99 — il divario è di 15× • Prezzo di listino — MiMo-V2.6-Pro $0,43 / $0,87 per 1M; GPT-5.6 Sol $4,00 / $20,00 • Sconto cache — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Token di output nell'esecuzione dell'indice — MiMo-V2.6-Pro 140M; GPT-5.6 Sol 90M • Velocità di output — MiMo-V2.6-Pro 43,6 t/s, contro una mediana di 67,1; GPT-5.6 Sol 73 t/s, contro una mediana di 72 • Contesto e pesi — MiMo-V2.6-Pro 1M e con licenza MIT; GPT-5.6 Sol 1M e proprietario

L'avviso di deprecazione è la riga più significativa
Artificial Analysis ora apre la pagina di GPT-5.6 Sol con un avviso in un riquadro: “Questo modello è deprecato. Continuiamo a eseguire il benchmarking delle prestazioni solo per il carico di lavoro predefinito di 10k token di input”, seguito dalla frase che OpenAI ha lanciato un modello più recente, GPT-6 Sol (max), e che si dovrebbe considerare quello al suo posto. Il 47 sull’indice è quindi una lettura di un modello che non è più ciò che si dovrebbe acquistare. Ciò non rende la lettura errata — è stata misurata sullo stesso indice, nello stesso giorno, con la stessa impostazione di effort del 46 — ma cambia lo scopo del confronto. Non è più “quale modello di punta dovrei usare”. È “quanto costa il vertice della classifica dei modelli proprietari, nel momento in cui era in vetta”.
Quella riformulazione conta più di quanto sembri, perché gli avvisi di deprecazione sulle pagine di valutazione sono uno dei pochi luoghi in cui la cadenza dei prodotti di un fornitore si manifesta come una modifica dei dati anziché come un comunicato stampa. Il punteggio è congelato; il modello non è disponibile. Qualunque cosa tu costruisca basandoti sul 47, la stai costruendo su un’istantanea.

Perché il numero per attività è quello su cui modellare
Le tariffe per token lusingano i modelli economici e inducono in errore sui carichi di lavoro che non sono neutri rispetto ai token. Il costo per task dell'indice è una misurazione diversa: è ciò che il valutatore ha effettivamente speso per ottenere una risposta da ciascun modello, e incorpora sia la tariffa sia il numero di token che il modello ha scelto di emettere. MiMo-V2.6-Pro emette più token di Sol durante l'esecuzione dell'indice — 140 milioni contro 90 milioni, circa 1,6 volte tanto — e costa comunque $0,13 per task contro $1,99. Il vantaggio sulla tariffa è di circa ventitré volte sull'output; la penalità di verbosità è 1,6×; il prodotto è il divario di quindici volte per task.
Questa è l'aritmetica su cui dovrebbe essere costruito un modello di costo, ed è l'aritmetica che è invisibile se confronti $0,87 con $20,00 e ti fermi. Ti dice anche cosa farebbe crollare la conclusione. Se il tuo carico di lavoro è dominato da output molto brevi, il conteggio dei token di Sol collassa verso il tuo e il divario tariffario di ventitré volte fa la maggior parte del lavoro, quindi il moltiplicatore reale si sposta verso il divario tariffario anziché allontanarsene. Se il tuo carico di lavoro è dominato da lunghe tracce di ragionamento, la verbosità di 1,6× di MiMo-V2.6-Pro si accumula e $0,13 diventa il tetto anziché la stima. La cifra pubblicata è una misurazione della forma di un benchmark, non un preventivo che puoi consegnare alla finanza.
La linea della latenza è l'onesto contrappeso
A 43,6 token di output al secondo, MiMo-V2.6-Pro è più lento di GPT-5.6 Sol, misurato nello stesso giorno a 73 — e più lento dei modelli con cui la sua stessa pagina lo confronta, la cui mediana è 67,1. La sua pagina lo dice a chiare lettere: "notevolmente lento". Per una pipeline batch si tratta di un costo di throughput che puoi quantificare. Per un agente interattivo è una decisione di prodotto, e un costo per attività quindici volte inferiore non rende veloce un modello lento. Se il tuo vincolo è un budget per turno anziché una bolletta mensile, il rapporto che conta è 43,6 contro 73, e MiMo-V2.6-Pro lo perde.
Dove questo finisce su un router
L'aspetto utile di questo abbinamento non è “scegline uno”. È che entrambi i modelli rispondono allo stesso indice e il valutatore pubblica un costo per attività per ciascuno, così la suddivisione può essere fatta sul costo misurato anziché sui livelli del fornitore. Su OrcaRouter il catalogo arriva a oltre 200 modelli accessibili con un'unica chiave al prezzo di listino di ciascun fornitore con 0% di ricarico — un taglio di prezzo del fornitore arriva sulla tua fattura lo stesso giorno, senza un secondo contratto da rinegoziare — e il DSL di routing consente a un carico di lavoro di inviare le chiamate economiche e ad alto volume a un modello e quelle difficili a un altro per attività anziché per marca. Il failover automatico copre il caso in cui la rotta più economica è degradata. Xiaomi MiMo-V2.6-Pro non è sulle nostre rotte — non elenchiamo un modello prima che un fornitore lo abbia integrato — quindi per quel lato del confronto la risposta onesta è l'API del fornitore stesso o qualunque piattaforma ospitata con cui hai già un rapporto.

Cosa fare con questo entro la prossima settimana
Due cose sono cambiate il 25 settembre 2026 e solo una delle due riguarda il prezzo. GPT-5.6 Sol porta un avviso di deprecazione sull'indice in cui è stato misurato a 47, il che lo ritira come scelta d'acquisto e lo lascia come riferimento di benchmark. MiMo-V2.6-Pro è misurato a 0,13 $ per attività dell'indice contro gli 1,99 $ di Sol, cioè quindici volte il denaro per un punto di indice — ed è 43,6 token al secondo, più lento del modello con cui viene confrontato e più lento della mediana della sua stessa classe. Confronta i due valori con il tuo traffico prima che l'uno o l'altro numero diventi una decisione: il costo per attività è una misurazione, non una tariffa, e la latenza è una misurazione, non un'opinione. Se i tuoi output sono brevi e non interattivi, il caso a favore del checkpoint aperto è più forte di quanto suggerisca il divario nell'indice. Se i tuoi output sono lunghi o i tuoi utenti sono in attesa, il risparmio di quindici volte ti compra un prodotto più lento, e questo è uno scambio che solo il tuo carico di lavoro può valutare.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
