Hero-kort med rubriken 'MiMo-V2.6-Pro vs MiMo-V2.6-Flash' och underrubriken 'En 3x prisskillnad, och vad som inte förklarar den', samt två paneler: en vänsterpanel med rubriken 'MiMo-V2.6-Pro' och texten '$0.435 / $0.87 per 1M' och '42B aktiva parametrar', och en högerpanel med rubriken 'MiMo-V2.6-Flash' och texten '$0.14 / $0.28 per 1M' och '15B aktiva parametrar', ovan en sidfot med texten 'Båda är MIT-licensierade · båda har 1M kontext · index publicerat endast för Pro'.
Guides & Insights

MiMo-V2.6-Pro vs MiMo-V2.6-Flash: En 3x prisskillnad som två benchmarks inte förklarar

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

I Xiaomis egna utvärderingstabeller slår MiMo-V2.6-Flash MiMo-V2.6-Pro. Raden är CyberGym, och marginalen är 95,1 mot 94,0. Det är en rad av femton, och det är anledningen till att läsa resten av den här jämförelsen noggrant i stället för att anta att flaggskeppet alltid är svaret – eftersom MiMo-V2.6-Flash kostar ungefär en tredjedel av vad MiMo-V2.6-Pro kostar, och på de flesta raderna skiljer de båda sig bara några poäng åt.

Båda modellerna publicerades som Hugging Face-repositorier den 21 september 2026, under MIT-licensen, med arton sekunders mellanrum, som separata träningskörningar snarare än steg på en och samma stege. Xiaomi MiMo-V2.6-Pro är nivån med en biljon parametrar. MiMo-V2.6-Flash är effektivitetsnivån. Frågan som den här sidan besvarar är vilken av dem som hör hemma i din produktionsväg, och det ärliga svaret beror på en siffra som inte finns i någon av utgåvorna.

Vad var och en är

• Parametrar — Xiaomi MiMo-V2.6-Pro 1,02T totalt med 42B aktiva per token, mot Xiaomi MiMo-V2.6-Flash på omkring 309B totalt med 15B aktiva
• Arkitektur — båda är sparsa mixture-of-experts-modeller med inbyggd omnimodal indata; Flash dokumenteras med 48 lager, 39 med glidande fönster och 9 med full attention, dold storlek 4096, 256 routade experter med 8 aktiva och inga delade experter, tillsammans med en 681M vision transformer, en 308M ljudtokeniserare och en 127M ljudpatchkodare
• Kontext — 1M token på båda, med upp till 128 000 utdatatoken på båda
• Licens — MIT på båda, vikter utan gating på båda
• Pris — $0,435 in och $0,87 ut per miljon token för Pro, mot $0,14 och $0,28 för Flash: en 3,1x skillnad på båda sidor av kortet
• Indata vid cacheträff — $0,0036 per miljon på Pro, $0,0028 på Flash
• Träningskostnad — Xiaomi rapporterar ungefär $2,62M för Pro RL-körningen och $854K för Flash, var och en slutförd på under sex dagar fördelat över 30 steg för förstärkningsinlärning och omkring 750 000 trajektorier
• Oberoende indexpoäng — 46 för Xiaomi MiMo-V2.6-Pro på Artificial Analysis Intelligence Index v4.3.2; inga publicerade för MiMo-V2.6-Flash

Den sista raden är den man ska hålla fast vid. Allt ovanför den, förutom Pro-poängen, är Xiaomi-rapporterat.

Där tre gånger priset nästan inte ger någonting

Xiaomis tabell 3 ställer de två sida vid sida över de testramverk som serien tränades på, och i långsiktigt agentiskt arbete är marginalerna små:

• DeepSWE v1.1 — Pro 71,9, Flash 67,9
• MiMo Code Bench — Pro 63,2, Flash 61,2
• AutomationBench v1.0.6 — Pro 53,1, Flash 52,3
• Toolathlon-Verified — Pro 76,9, Flash 73,6
• Terminal Bench 2.1 — Pro 89,9, Flash 87,6
• OSWorld-Verified — Pro 82,0, Flash 80,8
• JobBench — Pro 62,0, Flash 61,2
• MiMo Visual Coding — Pro 72,3, Flash 71,5
• CyberGym — Pro 94,0, Flash 95,1
• MiMo Cyber Bench — Pro 80,2, Flash 77,2

Läs nedåt i den kolumnen, och flaggskeppets fördel ligger mestadels mellan en och fyra poäng, med en rad som förloras helt. I ett arbetsflöde där skillnaden mellan 67,9 och 71,9 är skillnaden mellan att en uppgift slutförs och att en uppgift misslyckas, är ett tre gånger så högt pris billigt. I ett arbetsflöde där det är skillnaden mellan två godtagbara svar är det inte. Leverantörstabeller med decimaler som dessa inbjuder till falsk precision – ingen utanför Xiaomi har kört dem, och en tvåpoängsskillnad i ett internt bedömt testramverk ligger med god marginal inom det intervall som en annan bedömare eller en annan återförsökspolicy kan förskjuta.

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6-Flash — the scoreboard'. The left column, MiMo-V2.6-Pro, reads Active params 42B, Price $0.435 / $0.87, DeepSWE v1.1 71.9, CyberGym 94.0, ExploitGym 17.8, Independent index 46. The right column, MiMo-V2.6-Flash, reads Active params 15B, Price $0.14 / $0.28, DeepSWE v1.1 67.9, CyberGym 95.1, ExploitGym 6.0, Independent index none published. A footer reads 'All benchmark figures are Xiaomi's own runs; only the Pro index score is independent.'

Där det köper mycket

Det finns ett kluster av rader där gapet slutar vara ett avrundningsargument. Var och en av dem är säkerhetsarbete:

• ExploitGym — Pro 17,8, Flash 6,0
• ExploitBench — Pro 47,9, Flash 25,3
• SEC Bench Pro — Pro 66,3, Flash 47,5
• Agents' Last Exam — Pro 31,6, Flash 27,6
• Terminal Bench 4.0 — Pro 34,9, Flash 28,8

På ExploitGym är flaggskeppet tre gånger så bra som den billigare modellen, vilket är samma faktor som priset, och på SEC Bench Pro är det 1,4x. Det mönstret är vad man skulle förvänta sig av en modell med 42B aktiva parametrar mot en med 15B: en uppgift som kräver en lång kedja av resonemang utan delpoäng är den typ av uppgift där den extra kapaciteten visar sig, och att CyberGym ligger åt andra hållet är undantaget som bevisar att de två körningarna lärde sig olika saker snarare än samma sak i olika storlekar.

Så uppdelningen motsvarar en verklig arbetsbelastningsgräns snarare än en marknadsföringsmässig. Agentarbete i hög volym med ett förlåtande framgångskriterium – hämtning, klassificering, rutinmässiga redigeringar, anrop som ett nytt försök kan rädda – är Flash-territorium. Arbete där ett felaktigt svar är dyrt och ett ofullständigt svar är värdelöst – exploitutveckling, säkerhetsgranskning, terminalsessioner med tillstånd i flera steg – är där Pro-nivån motiverar den flerdubbla kostnaden.

Numret som inte finns

MiMo-V2.6-Flash har ingen modellsida hos Artificial Analysis. Det har däremot dess syskon. Den asymmetrin är det enskilt viktigaste på den här sidan, för den betyder att den enda oberoende uppmätta siffran någonstans i MiMo-V2.6-serien är 46:an bredvid Xiaomi MiMo-V2.6-Pro. Varje Flash-siffra ovan – inklusive CyberGym-raden som den vinner – kommer från ett Xiaomi-testramverk, en Xiaomi-bedömare och en Xiaomi-offlinekörning.

Det finns fog för att detta är tillfälligt: modellen är en dag gammal när detta skrivs, och tredjepartsutvärdering tar tid. Det finns också fog för att det är strukturellt, eftersom Flash är volymsegmentet och volymsegment drar till sig mindre uppmärksamhet vid benchmarking. Hur som helst är den praktiska konsekvensen i dag att du inte kan jämföra Flash med något utanför dess egen familj med samma säkerhet som när du jämför Pro. Om du väljer mellan Flash och en icke-Xiaomi-modell utifrån pris per kvalitet, jämför du en siffra från leverantören mot någon annans uppmätta siffra.

Båda modellkorten har samma andra förbehåll. Inget av reporna är driftsatt av någon inferensleverantör – Hugging Face säger det uttryckligen på varje sida, och Artificial Analysis räknade en enda API-leverantör för Pro. Vi hostar inte någon av checkpointarna, så ingen av dem kan dirigeras via oss. Vägen till båda går via Xiaomis egen plattform och de tredjepartskataloger som tillhandahåller dem.

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Flash-RL, showing the MIT licence tag and multimodal tags including 8-bit precision and fp8, a Safetensors panel reporting a model size of 159B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a model tree listing one finetune and six quantizations, and a collection block headed MiMo-V2.6 holding three items.

Priset du betalar i hårdvara, inte i tokens

Prissättningen per token är bara hälften av vad en checkpoint kostar dig, och de två skiljer sig långt mer markant på disk än på prislistan. MiMo-V2.6-Flash publicerar 172,9 GB FP8-vikter fördelade på 65 shards. Xiaomi MiMo-V2.6-Pro har ungefär tre gånger så många parametrar, vilket gör att rå nedladdning hamnar i halvterabyteklassen innan någon kvantisering — och dess eget repo rapporterar en Safetensors-modellstorlek på 524B parametrar, en siffra som varken stämmer med totalen på 1,02T eller antalet aktiva på 42B.

Den klyftan förändrar beslutets karaktär. Flash på 172,9 GB är en modell som ett litet team kan självhosta på hyrd kapacitet och behandla som en bulkvara. Pro, på ungefär tre gånger så mycket, är ett klusterbeslut – rapporteringen kring lanseringen uppskattade de två träningskörningarna till ungefär 4 000 respektive 8 000 H200-ekvivalenta GPU:er. Om anledningen till att du tittar på öppna vikter är att du vill ha möjligheten att sluta betala per token, erbjuder de två checkpointarna den möjligheten på mycket olika nivåer av åtagande.

Att välja mellan dem

Regeln som överlever förbehållen ovan är att välja efter arbetsbelastningsklass i stället för efter genomsnittligt benchmarkresultat. Flash för allt du skulle vara bekväm med att försöka igen; Pro för allt där ett nytt försök inte räddar dig. Mät sedan, eftersom ingen av modellerna har en oberoende poäng på de benchmarks du faktiskt bryr dig om.

Att mäta två checkpoints sida vid sida är där en router gör något som ett kontrakt per modell inte kan. Att lägga en billig nivå på merparten av din trafik och bara eskalera de svåra fallen till den dyra är samma beslut som på den här sidan, uttryckt som konfiguration i stället för som en omskrivning – och den sammansättningen är precis vad routningslagret finns till för. Det spelar också roll för själva priset: vi för vidare leverantörens listpris med 0 % påslag, så om Xiaomi sänker priset på endera checkpointen ändras siffran på vår sida samma dag i stället för vid nästa avtalsförnyelse. Det gäller de modeller vi erbjuder. För just MiMo-V2.6-paret köper du i dag fortfarande direkt från Xiaomi.

Vad skulle avgöra det

Två saker skulle förvandla detta från en bedömningsfråga till en räknefråga. En Artificial Analysis-sida för MiMo-V2.6-Flash skulle placera båda checkpoints på samma axel för kostnad per uppgift som för närvarande placerar Pro på $0.133 per Intelligence Index-uppgift, och jämförelsen skulle lösa sig själv. En tredjepartsreplikering av säkerhetsklustret — ExploitGym, ExploitBench, SEC Bench Pro — skulle bekräfta huruvida 3x-gapet på de raderna är en egenskap hos modellen eller en egenskap hos bedömaren.

Fram till dess är den försvarbara ståndpunkten att Xiaomi MiMo-V2.6-Flash är det bättre köpet för de flesta team under större delen av tiden, och att Xiaomi MiMo-V2.6-Pro är det bättre köpet för den snäva kategorin av arbete där ett misslyckande är det dyra utfallet. Den enda raden där Flash vinner kullkastar inte det — men den är en användbar påminnelse om att flaggskeppets premium är ett påstående om en arbetsbelastning, inte om en modell.

Screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, showing the Xiaomi attribution and 'Released September 2026', an Intelligence card reading 46 ranked #1 of 114, a Speed card reading 125.2 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.13 cost per Intelligence Index task, and a Verbosity card reading 140M output tokens, with a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.