Una card del titolo generata che mostra MiMo-V2.6-Pro vs GPT-5.6 Sol, con il sottotitolo 15 volte il costo per attività per un punto indice al di sotto e tre icone lineari piatte sopra il titolo che suggeriscono un misuratore di costi, una scheda di valutazione e un avviso datato. Il logo OrcaRouter è composto nell'angolo in basso a destra.
Guides & Insights

MiMo-V2.6-Pro vs GPT-5.6 Sol: Un punto indice costa quindici volte di più per attività

Autore

Elias Hawthorne

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Nell’Artificial Analysis Intelligence Index v4.3.2, consultato il 25 settembre 2026, GPT-5.6 Sol con sforzo massimo ottiene 47 e MiMo-V2.6-Pro di Xiaomi ottiene 46. Un punto. Il numero che li separa davvero non è il punteggio e non è la tariffa per token — è il costo di un singolo task dell’indice, che Artificial Analysis pubblica come 1,99 $ per GPT-5.6 Sol e 0,13 $ per MiMo-V2.6-Pro. Quindici volte la cifra per un punto. E al momento di questa lettura, la pagina dello stesso valutatore per quel modello riporta un avviso di deprecazione, perché GPT-6 Sol lo ha sostituito.

Xiaomi ha pubblicato i pesi e il rapporto tecnico di MiMo-V2.6-Pro il 21 settembre 2026, quattro giorni prima di questa lettura; OpenAI ha rilasciato GPT-5.6 Sol il 9 luglio 2026. Entrambi i fatti sopra sono nuovi da quando questo abbinamento è stato trattato l’ultima volta, e tirano in direzioni opposte. L’avviso di deprecazione dice che il confronto è con un modello che OpenAI ha già superato. Il dato per singolo task dice che ciò che sembrava un errore di arrotondamento quando entrambi i modelli erano quotati al prezzo di listino, su un carico di lavoro reale, è l’intera decisione. Quale dei due fattori pesi di più dipende dal fatto che si stia acquistando un modello o sostituendone uno.

Cosa dicono ora le due pagine

GPT-5.6 Sol è stato rilasciato il 9 luglio 2026 come modello di punta della famiglia GPT-5.6. Il suo prezzo di listino è di $4,00 per milione di token di input e $20,00 per milione di output sull’API first-party di OpenAI, con uno sconto sulla cache del 90%, e la pagina registra 90 milioni di token di output generati durante l’esecuzione dell’indice rispetto a una mediana di 88 milioni. Ha misurato 73 token di output al secondo, che la stessa pagina definisce più veloce della media rispetto a una mediana di 72 t/s. La sua voce nell’indice si colloca al rango 19 di 210 modelli della sua classe.

Xiaomi MiMo-V2.6-Pro è un checkpoint sparse mixture-of-experts con 1,02 trilioni di parametri totali e 42 miliardi attivi, con licenza MIT, con una finestra di contesto da 1M token e input di testo, immagini, voce e video a fronte di output testuale. È listato a $0,43 e $0,87 per milione di token con uno sconto sulla cache del 99% — un decimo della tariffa di input di Sol e un ventitreesimo della sua tariffa di output. Ha generato 140 milioni di token di output durante l'esecuzione dell'indice, e ha misurato 43,6 token di output al secondo, che la sua pagina descrive come notevolmente lento rispetto a una mediana di 67,1 t/s.

• Costo del task di indicizzazione — MiMo-V2.6-Pro $0,13; GPT-5.6 Sol $1,99 — il divario è di 15× • Prezzo di listino — MiMo-V2.6-Pro $0,43 / $0,87 per 1M; GPT-5.6 Sol $4,00 / $20,00 • Sconto cache — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Token di output nell'esecuzione dell'indice — MiMo-V2.6-Pro 140M; GPT-5.6 Sol 90M • Velocità di output — MiMo-V2.6-Pro 43,6 t/s, contro una mediana di 67,1; GPT-5.6 Sol 73 t/s, contro una mediana di 72 • Contesto e pesi — MiMo-V2.6-Pro 1M e con licenza MIT; GPT-5.6 Sol 1M e proprietario

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol - the scoreboard, subtitled Fifteen times the cost per index task, for one index point. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; cache discount 99%; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; cost per index task $1.99; list price $4.00 / $20.00 per 1M; cache discount 90%; output speed 73 tokens per second; 90M output tokens; 1M context, and carries a tag reading Proprietary - deprecated. A footer line reads Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and a warning line below it notes that the evaluator's GPT-5.6 Sol page now carries a deprecation notice and that it is superseded by GPT-6 Sol (max). The OrcaRouter logo is composited in the bottom-right corner.

L'avviso di deprecazione è la riga più significativa

Artificial Analysis ora apre la pagina di GPT-5.6 Sol con un avviso in un riquadro: “Questo modello è deprecato. Continuiamo a eseguire il benchmarking delle prestazioni solo per il carico di lavoro predefinito di 10k token di input”, seguito dalla frase che OpenAI ha lanciato un modello più recente, GPT-6 Sol (max), e che si dovrebbe considerare quello al suo posto. Il 47 sull’indice è quindi una lettura di un modello che non è più ciò che si dovrebbe acquistare. Ciò non rende la lettura errata — è stata misurata sullo stesso indice, nello stesso giorno, con la stessa impostazione di effort del 46 — ma cambia lo scopo del confronto. Non è più “quale modello di punta dovrei usare”. È “quanto costa il vertice della classifica dei modelli proprietari, nel momento in cui era in vetta”.

Quella riformulazione conta più di quanto sembri, perché gli avvisi di deprecazione sulle pagine di valutazione sono uno dei pochi luoghi in cui la cadenza dei prodotti di un fornitore si manifesta come una modifica dei dati anziché come un comunicato stampa. Il punteggio è congelato; il modello non è disponibile. Qualunque cosa tu costruisca basandoti sul 47, la stai costruendo su un’istantanea.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 25 September 2026. The header shows an Openweights model badge with Released September 2026, 46 on the Artificial Analysis Intelligence Index, 43.6 output tokens per second, $0.43 input and $0.87 output per 1M tokens with a 99% cache discount, and $0.13 per task to evaluate on the Intelligence Index; the summary paragraph calls the model notably slow, and the verbosity line shows 140M output tokens generated on the index run against a median of 140M.

Perché il numero per attività è quello su cui modellare

Le tariffe per token lusingano i modelli economici e inducono in errore sui carichi di lavoro che non sono neutri rispetto ai token. Il costo per task dell'indice è una misurazione diversa: è ciò che il valutatore ha effettivamente speso per ottenere una risposta da ciascun modello, e incorpora sia la tariffa sia il numero di token che il modello ha scelto di emettere. MiMo-V2.6-Pro emette più token di Sol durante l'esecuzione dell'indice — 140 milioni contro 90 milioni, circa 1,6 volte tanto — e costa comunque $0,13 per task contro $1,99. Il vantaggio sulla tariffa è di circa ventitré volte sull'output; la penalità di verbosità è 1,6×; il prodotto è il divario di quindici volte per task.

Questa è l'aritmetica su cui dovrebbe essere costruito un modello di costo, ed è l'aritmetica che è invisibile se confronti $0,87 con $20,00 e ti fermi. Ti dice anche cosa farebbe crollare la conclusione. Se il tuo carico di lavoro è dominato da output molto brevi, il conteggio dei token di Sol collassa verso il tuo e il divario tariffario di ventitré volte fa la maggior parte del lavoro, quindi il moltiplicatore reale si sposta verso il divario tariffario anziché allontanarsene. Se il tuo carico di lavoro è dominato da lunghe tracce di ragionamento, la verbosità di 1,6× di MiMo-V2.6-Pro si accumula e $0,13 diventa il tetto anziché la stima. La cifra pubblicata è una misurazione della forma di un benchmark, non un preventivo che puoi consegnare alla finanza.

La linea della latenza è l'onesto contrappeso

A 43,6 token di output al secondo, MiMo-V2.6-Pro è più lento di GPT-5.6 Sol, misurato nello stesso giorno a 73 — e più lento dei modelli con cui la sua stessa pagina lo confronta, la cui mediana è 67,1. La sua pagina lo dice a chiare lettere: "notevolmente lento". Per una pipeline batch si tratta di un costo di throughput che puoi quantificare. Per un agente interattivo è una decisione di prodotto, e un costo per attività quindici volte inferiore non rende veloce un modello lento. Se il tuo vincolo è un budget per turno anziché una bolletta mensile, il rapporto che conta è 43,6 contro 73, e MiMo-V2.6-Pro lo perde.

Dove questo finisce su un router

L'aspetto utile di questo abbinamento non è “scegline uno”. È che entrambi i modelli rispondono allo stesso indice e il valutatore pubblica un costo per attività per ciascuno, così la suddivisione può essere fatta sul costo misurato anziché sui livelli del fornitore. Su OrcaRouter il catalogo arriva a oltre 200 modelli accessibili con un'unica chiave al prezzo di listino di ciascun fornitore con 0% di ricarico — un taglio di prezzo del fornitore arriva sulla tua fattura lo stesso giorno, senza un secondo contratto da rinegoziare — e il DSL di routing consente a un carico di lavoro di inviare le chiamate economiche e ad alto volume a un modello e quelle difficili a un altro per attività anziché per marca. Il failover automatico copre il caso in cui la rotta più economica è degradata. Xiaomi MiMo-V2.6-Pro non è sulle nostre rotte — non elenchiamo un modello prima che un fornitore lo abbia integrato — quindi per quel lato del confronto la risposta onesta è l'API del fornitore stesso o qualunque piattaforma ospitata con cui hai già un rapporto.

Screenshot of the Artificial Analysis model page for GPT-5.6 Sol (max), captured 25 September 2026. A boxed banner at the top reads This model is deprecated, that benchmarking continues only for the default 10k input token workload, and that OpenAI has launched a newer model, GPT-6 Sol (max), which should be considered instead. Below it the header shows an OpenAI badge, Intelligence rank 19 of 210, Speed 83 of 210, Cost 67 of 210, Verbosity 50 of 210, 47 on the Intelligence Index, $4.00 input and $20.00 output per 1M tokens, a 90% cache discount, $1.99 per task to evaluate on the Intelligence Index, and a line reading At 73 tokens per second, GPT-5.6 Sol (max) is faster than average (72).

Cosa fare con questo entro la prossima settimana

Due cose sono cambiate il 25 settembre 2026 e solo una delle due riguarda il prezzo. GPT-5.6 Sol porta un avviso di deprecazione sull'indice in cui è stato misurato a 47, il che lo ritira come scelta d'acquisto e lo lascia come riferimento di benchmark. MiMo-V2.6-Pro è misurato a 0,13 $ per attività dell'indice contro gli 1,99 $ di Sol, cioè quindici volte il denaro per un punto di indice — ed è 43,6 token al secondo, più lento del modello con cui viene confrontato e più lento della mediana della sua stessa classe. Confronta i due valori con il tuo traffico prima che l'uno o l'altro numero diventi una decisione: il costo per attività è una misurazione, non una tariffa, e la latenza è una misurazione, non un'opinione. Se i tuoi output sono brevi e non interattivi, il caso a favore del checkpoint aperto è più forte di quanto suggerisca il divario nell'indice. Se i tuoi output sono lunghi o i tuoi utenti sono in attesa, il risparmio di quindici volte ti compra un prodotto più lento, e questo è uno scambio che solo il tuo carico di lavoro può valutare.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno