
Xiaomi MiMo-V2.6-Pro vs Grok 4.7: 30× più economico per attività, e nessuno dei due è veloce
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 36 tok/s
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 181 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0540Intelligenza72Codice
Xiaomi MiMo-V2.6-Pro e Grok 4.7 sono entrambi usciti il 21 settembre 2026, entrambi si collocano a 46 sull'Artificial Analysis Intelligence Index v4.3.2, ed entrambi vengono definiti lenti dalla pagina che li ha misurati — 43,6 token di output al secondo per MiMo-V2.6-Pro contro una mediana di 67,1, 40 per Grok 4.7 con sforzo xhigh. Ciò che li distingue è quanto costa una risposta. La cifra per attività del valutatore è di $0,13 per il checkpoint aperto cinese e $3,74 per il modello Grok 4.7, un fattore di circa 29. Non è una differenza di tariffa, o non solo una: la tariffa di output di Grok 4.7 è di $6,00 per milione di token contro $0,87, cioè sette volte tanto, e il resto del multiplo deriva da quanti token consuma ciascun modello per arrivare a una risposta.
Due modelli nello stesso mese, sullo stesso indice, con lo stesso punteggio, prezzati come se appartenessero a decenni diversi del mercato. La domanda interessante non è quale dei due vince. È quale parte di quel 29 puoi effettivamente aggirare — perché in questo abbinamento esattamente uno dei due è una via che puoi comprare oggi, ed è quello costoso.
Stesso giorno, stesso punteggio, animali diversi
Grok 4.7 è stato rilasciato il 21 settembre 2026 a 2,00 $ per milione di token in input e 6,00 $ per milione in output, con una finestra di contesto di 500.000 token, un knowledge cutoff di maggio 2026, uno sconto del 75% sulla cache, e input testuale e di immagini con output testuale. Ha ottenuto 46 sull'indice a sforzo xhigh, 56 sul Coding Agent Index nell'harness Grok Build e 1.657 Elo su AA-Briefcase — quarto in quella classifica, dietro tre voci Anthropic, a circa metà del costo per attività di Claude Opus 5.
Xiaomi MiMo-V2.6-Pro è un checkpoint mixture-of-experts sparso, 1,02 trilioni di parametri totali con 42 miliardi attivi, con licenza MIT, contesto da 1M di token, input testo, immagine, parlato e video a fronte di output testuale, $0,43 e $0,87 per milione di token con uno sconto cache del 99% che riduce la tariffa effettiva di input quasi a zero su un prompt caldo. Artificial Analysis lo colloca primo su 114 modelli open-weights nell'indice e dodicesimo su 114 per costo. È raggiungibile tramite tre provider API. Non è sulle nostre route e non elenchiamo un modello prima che un provider lo abbia integrato.
L'unica riga che lo decide
• Costo per attività di indicizzazione — MiMo-V2.6-Pro 0,13 $; Grok 4.7 3,74 $ — 29× • Tariffa di output — MiMo-V2.6-Pro 0,87 $ / 1M; Grok 4.7 6,00 $ / 1M — 6,9× • Token di output nell'esecuzione dell'indice — MiMo-V2.6-Pro 140M; Grok 4.7 240M, rispetto a una mediana di 88M • Velocità di output — MiMo-V2.6-Pro 43,6 t/s; Grok 4.7 40 t/s — entrambi sotto la mediana • Finestra di contesto — MiMo-V2.6-Pro 1M; Grok 4.7 500K • Pesi — MiMo-V2.6-Pro con licenza MIT e scaricabili; Grok 4.7 proprietario, solo API
Leggi insieme i primi due punti elenco e la forma del divario diventa chiara. A prezzo di listino i due distano 6,9× sull’output. Nell’esecuzione sull’indice distano 29× su quanto costa una risposta. Il fattore moltiplicativo nel mezzo è la verbosità: Grok 4.7 ha generato 240 milioni di token di output contro una mediana di 88 milioni per la sua classe, e MiMo-V2.6-Pro ne ha generati 140 milioni. Si tratta di una penalità di 1,71× sui token che si aggiunge alla penalità di 6,9× sulla tariffa, e 1,71 × 6,9 fa 11,8 — il resto della distanza fino a 29 arriva dal lato input, dove lo sconto del 99% sulla cache di MiMo-V2.6-Pro e la tariffa di input di $0,43 fanno il grosso del lavoro su un carico di lavoro con un qualsiasi prefisso ripetuto.

La verbosità è il numero che la gente omette dal preventivo
I modelli di costo vengono solitamente costruiti a partire da un listino tariffe e da un numero di token ipotizzato. Entrambe le metà di questo ragionamento sono sbagliate in questo caso. Il listino tariffe è sbagliato perché lo sconto della cache non è una nota a piè di pagina — 99% contro 75% è la differenza tra un system prompt che ti costa denaro a ogni chiamata e uno che ti costa quasi nulla. Il numero di token è sbagliato perché i due modelli non emettono lo stesso numero di token per lo stesso lavoro, e il valutatore ha misurato la differenza: 240 milioni contro 140 milioni, uno scarto di 1,71× su un benchmark identico.
Nessuno dei due è un proxy che puoi leggere da una scheda tecnica. Il rank di verbosità di Grok 4.7 è #94 su 210 modelli della sua classe; il rank di costo di MiMo-V2.6-Pro è #12 su 114 della sua. Un team che cita il listino prezzi di Grok 4.7 e presume un carico di lavoro neutro rispetto ai token prevederà circa un quarto di ciò che l’indice ha effettivamente speso per attività. La correzione non è nemmeno usare il costo dell’indice come stima — è una misurazione della forma di un singolo benchmark. È misurare i tuoi conteggi di token su entrambi i lati prima di impegnarti, perché il divario tra i due modelli è di 6,9× sulla carta e 29× nella pratica, e solo uno di quei numeri è reale per il tuo traffico.

Entrambi sono lenti, e questo non è un pareggio
Artificial Analysis ha misurato Grok 4.7 a 40 token di output al secondo e lo definisce «tra i più lenti»; MiMo-V2.6-Pro a 43,6 e lo definisce «notevolmente lento». Le due rilevazioni sono abbastanza vicine da far sì che la velocità non debba essere l'elemento decisivo tra i due. Ma le mediane sottostanti non lo sono: 67,1 per l'ambito open-weights in cui si colloca MiMo-V2.6-Pro. Entrambi i modelli sono ben al di sotto, e MiMo-V2.6-Pro registra anche un tempo al primo token di 3,17 secondi contro una mediana di 2,31 secondi, ed è questo il dato che pesa in un ciclo interattivo anziché in uno a batch.
Quindi il riepilogo onesto del lato latenza è che un costo inferiore di 29× non ti compra un prodotto più veloce, ti compra uno più lento che costa meno — e se i tuoi utenti stanno fissando un cursore, l'attesa di 3,17 secondi può costare più dei token risparmiati. Per il lavoro in batch notturno, la valutazione offline o qualsiasi pipeline in cui il tempo si misura in ore, il compromesso è semplice e il 29× è quasi gratis.
Cosa può e non può fare un router con questo abbinamento
Questo è l'abbinamento in cui il nostro catalogo è davvero unilaterale, ed è giusto dirlo chiaramente. Grok 4.7 è attivo su OrcaRouter come grok/grok-4.7 al prezzo del fornitore stesso di $2,00 / $6,00, con un output massimo di 450K e un endpoint compatibile con OpenAI-SDK su https://api.orcarouter.ai/v1 — quindi se il confronto ti fa desiderare il modello xAI dietro la stessa chiave di tutto il resto, quella strada esiste già oggi. Xiaomi MiMo-V2.6-Pro non è sulle nostre rotte; per quel lato, l'API del fornitore stesso o quello dei suoi tre provider elencati che già usi è la risposta, e non fingeremo il contrario.
Ciò che fa guadagnare a un router il suo posto in un confronto come questo sono le parti che non riguardano il modello. Una sola chiave per oltre 200 modelli al prezzo di listino di ciascun provider con 0% di ricarico significa che un taglio di prezzo di un fornitore arriva sulla tua fattura lo stesso giorno, anziché al rinnovo contrattuale successivo. Il failover automatico significa che il degrado di una rotta da 40 t/s non si porta dietro la tua pipeline. Il DSL di routing consente di effettuare la suddivisione in base al costo pubblicato per attività anziché alla fedeltà al marchio: modello economico per gli alti volumi, modello potente per le chiamate difficili, deciso per singola richiesta. E per i carichi di lavoro in cui nessuno dei due modelli è del tutto adatto, la fusione di modelli può eseguirne diversi dietro un'unica chiamata.

Domande che questo confronto solitamente solleva
Il 29× vale per il mio carico di lavoro? Solo se il tuo mix di token è simile a quello dell’esecuzione indice. Se i tuoi output sono brevi e i tuoi prompt sono lunghi e in cache, il moltiplicatore collassa verso il divario di tariffa di 6,9× sull’output e si amplia sull’input, dove lo sconto del 99% di MiMo-V2.6-Pro è il termine decisivo. Se i tuoi output sono lunghe tracce di ragionamento, si amplia oltre 29×, perché la penalità di verbosità di Grok 4.7 è proporzionale alla lunghezza dell’output.
Il 46 su ciascun lato è lo stesso 46? È lo stesso indice, la stessa versione e la stessa scala — i sotto-punteggi sottostanti erano 46,32 e 46,45, una differenza di 0,13 punti, e l'indice arrotonda entrambi a 46. Artificial Analysis non pubblica analisi dettagliate per singola valutazione per nessuno dei due modelli, quindi il composito è il livello di dettaglio più fine disponibile e una differenza di 0,13 punti non dovrebbe essere interpretata come una classifica delle capacità.
Quale dovrebbe essere l'impostazione predefinita per un nuovo progetto? Se il carico di lavoro è batch, tollerante alla latenza e sensibile ai costi, MiMo-V2.6-Pro a 0,13 $ per attività è il default e i pesi aperti significano che non sei esposto al prezzo di un singolo provider. Se hai bisogno specificamente del modello xAI — i risultati dell'harness Grok Build, il posizionamento in AA-Briefcase, il contesto da 500K con cutoff a maggio 2026 — Grok 4.7 è una route attiva su OrcaRouter oggi e il sovrapprezzo per attività è il prezzo di quella specifica capacità. Qui non c'è nessun modello che vinca su entrambi i fronti.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
