
MiMo-V2.6-Pro vs MiMo-V2.6-Flash: En 3x prisskillnad som två benchmarks inte förklarar
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
I Xiaomis egna utvärderingstabeller slår MiMo-V2.6-Flash MiMo-V2.6-Pro. Raden är CyberGym, och marginalen är 95,1 mot 94,0. Det är en rad av femton, och det är anledningen till att läsa resten av den här jämförelsen noggrant i stället för att anta att flaggskeppet alltid är svaret – eftersom MiMo-V2.6-Flash kostar ungefär en tredjedel av vad MiMo-V2.6-Pro kostar, och på de flesta raderna skiljer de båda sig bara några poäng åt.
Båda modellerna publicerades som Hugging Face-repositorier den 21 september 2026, under MIT-licensen, med arton sekunders mellanrum, som separata träningskörningar snarare än steg på en och samma stege. Xiaomi MiMo-V2.6-Pro är nivån med en biljon parametrar. MiMo-V2.6-Flash är effektivitetsnivån. Frågan som den här sidan besvarar är vilken av dem som hör hemma i din produktionsväg, och det ärliga svaret beror på en siffra som inte finns i någon av utgåvorna.
Vad var och en är
• Parametrar — Xiaomi MiMo-V2.6-Pro 1,02T totalt med 42B aktiva per token, mot Xiaomi MiMo-V2.6-Flash på omkring 309B totalt med 15B aktiva
• Arkitektur — båda är sparsa mixture-of-experts-modeller med inbyggd omnimodal indata; Flash dokumenteras med 48 lager, 39 med glidande fönster och 9 med full attention, dold storlek 4096, 256 routade experter med 8 aktiva och inga delade experter, tillsammans med en 681M vision transformer, en 308M ljudtokeniserare och en 127M ljudpatchkodare
• Kontext — 1M token på båda, med upp till 128 000 utdatatoken på båda
• Licens — MIT på båda, vikter utan gating på båda
• Pris — $0,435 in och $0,87 ut per miljon token för Pro, mot $0,14 och $0,28 för Flash: en 3,1x skillnad på båda sidor av kortet
• Indata vid cacheträff — $0,0036 per miljon på Pro, $0,0028 på Flash
• Träningskostnad — Xiaomi rapporterar ungefär $2,62M för Pro RL-körningen och $854K för Flash, var och en slutförd på under sex dagar fördelat över 30 steg för förstärkningsinlärning och omkring 750 000 trajektorier
• Oberoende indexpoäng — 46 för Xiaomi MiMo-V2.6-Pro på Artificial Analysis Intelligence Index v4.3.2; inga publicerade för MiMo-V2.6-Flash
Den sista raden är den man ska hålla fast vid. Allt ovanför den, förutom Pro-poängen, är Xiaomi-rapporterat.
Där tre gånger priset nästan inte ger någonting
Xiaomis tabell 3 ställer de två sida vid sida över de testramverk som serien tränades på, och i långsiktigt agentiskt arbete är marginalerna små:
• DeepSWE v1.1 — Pro 71,9, Flash 67,9
• MiMo Code Bench — Pro 63,2, Flash 61,2
• AutomationBench v1.0.6 — Pro 53,1, Flash 52,3
• Toolathlon-Verified — Pro 76,9, Flash 73,6
• Terminal Bench 2.1 — Pro 89,9, Flash 87,6
• OSWorld-Verified — Pro 82,0, Flash 80,8
• JobBench — Pro 62,0, Flash 61,2
• MiMo Visual Coding — Pro 72,3, Flash 71,5
• CyberGym — Pro 94,0, Flash 95,1
• MiMo Cyber Bench — Pro 80,2, Flash 77,2
Läs nedåt i den kolumnen, och flaggskeppets fördel ligger mestadels mellan en och fyra poäng, med en rad som förloras helt. I ett arbetsflöde där skillnaden mellan 67,9 och 71,9 är skillnaden mellan att en uppgift slutförs och att en uppgift misslyckas, är ett tre gånger så högt pris billigt. I ett arbetsflöde där det är skillnaden mellan två godtagbara svar är det inte. Leverantörstabeller med decimaler som dessa inbjuder till falsk precision – ingen utanför Xiaomi har kört dem, och en tvåpoängsskillnad i ett internt bedömt testramverk ligger med god marginal inom det intervall som en annan bedömare eller en annan återförsökspolicy kan förskjuta.

Där det köper mycket
Det finns ett kluster av rader där gapet slutar vara ett avrundningsargument. Var och en av dem är säkerhetsarbete:
• ExploitGym — Pro 17,8, Flash 6,0
• ExploitBench — Pro 47,9, Flash 25,3
• SEC Bench Pro — Pro 66,3, Flash 47,5
• Agents' Last Exam — Pro 31,6, Flash 27,6
• Terminal Bench 4.0 — Pro 34,9, Flash 28,8
På ExploitGym är flaggskeppet tre gånger så bra som den billigare modellen, vilket är samma faktor som priset, och på SEC Bench Pro är det 1,4x. Det mönstret är vad man skulle förvänta sig av en modell med 42B aktiva parametrar mot en med 15B: en uppgift som kräver en lång kedja av resonemang utan delpoäng är den typ av uppgift där den extra kapaciteten visar sig, och att CyberGym ligger åt andra hållet är undantaget som bevisar att de två körningarna lärde sig olika saker snarare än samma sak i olika storlekar.
Så uppdelningen motsvarar en verklig arbetsbelastningsgräns snarare än en marknadsföringsmässig. Agentarbete i hög volym med ett förlåtande framgångskriterium – hämtning, klassificering, rutinmässiga redigeringar, anrop som ett nytt försök kan rädda – är Flash-territorium. Arbete där ett felaktigt svar är dyrt och ett ofullständigt svar är värdelöst – exploitutveckling, säkerhetsgranskning, terminalsessioner med tillstånd i flera steg – är där Pro-nivån motiverar den flerdubbla kostnaden.
Numret som inte finns
MiMo-V2.6-Flash har ingen modellsida hos Artificial Analysis. Det har däremot dess syskon. Den asymmetrin är det enskilt viktigaste på den här sidan, för den betyder att den enda oberoende uppmätta siffran någonstans i MiMo-V2.6-serien är 46:an bredvid Xiaomi MiMo-V2.6-Pro. Varje Flash-siffra ovan – inklusive CyberGym-raden som den vinner – kommer från ett Xiaomi-testramverk, en Xiaomi-bedömare och en Xiaomi-offlinekörning.
Det finns fog för att detta är tillfälligt: modellen är en dag gammal när detta skrivs, och tredjepartsutvärdering tar tid. Det finns också fog för att det är strukturellt, eftersom Flash är volymsegmentet och volymsegment drar till sig mindre uppmärksamhet vid benchmarking. Hur som helst är den praktiska konsekvensen i dag att du inte kan jämföra Flash med något utanför dess egen familj med samma säkerhet som när du jämför Pro. Om du väljer mellan Flash och en icke-Xiaomi-modell utifrån pris per kvalitet, jämför du en siffra från leverantören mot någon annans uppmätta siffra.
Båda modellkorten har samma andra förbehåll. Inget av reporna är driftsatt av någon inferensleverantör – Hugging Face säger det uttryckligen på varje sida, och Artificial Analysis räknade en enda API-leverantör för Pro. Vi hostar inte någon av checkpointarna, så ingen av dem kan dirigeras via oss. Vägen till båda går via Xiaomis egen plattform och de tredjepartskataloger som tillhandahåller dem.

Priset du betalar i hårdvara, inte i tokens
Prissättningen per token är bara hälften av vad en checkpoint kostar dig, och de två skiljer sig långt mer markant på disk än på prislistan. MiMo-V2.6-Flash publicerar 172,9 GB FP8-vikter fördelade på 65 shards. Xiaomi MiMo-V2.6-Pro har ungefär tre gånger så många parametrar, vilket gör att rå nedladdning hamnar i halvterabyteklassen innan någon kvantisering — och dess eget repo rapporterar en Safetensors-modellstorlek på 524B parametrar, en siffra som varken stämmer med totalen på 1,02T eller antalet aktiva på 42B.
Den klyftan förändrar beslutets karaktär. Flash på 172,9 GB är en modell som ett litet team kan självhosta på hyrd kapacitet och behandla som en bulkvara. Pro, på ungefär tre gånger så mycket, är ett klusterbeslut – rapporteringen kring lanseringen uppskattade de två träningskörningarna till ungefär 4 000 respektive 8 000 H200-ekvivalenta GPU:er. Om anledningen till att du tittar på öppna vikter är att du vill ha möjligheten att sluta betala per token, erbjuder de två checkpointarna den möjligheten på mycket olika nivåer av åtagande.
Att välja mellan dem
Regeln som överlever förbehållen ovan är att välja efter arbetsbelastningsklass i stället för efter genomsnittligt benchmarkresultat. Flash för allt du skulle vara bekväm med att försöka igen; Pro för allt där ett nytt försök inte räddar dig. Mät sedan, eftersom ingen av modellerna har en oberoende poäng på de benchmarks du faktiskt bryr dig om.
Att mäta två checkpoints sida vid sida är där en router gör något som ett kontrakt per modell inte kan. Att lägga en billig nivå på merparten av din trafik och bara eskalera de svåra fallen till den dyra är samma beslut som på den här sidan, uttryckt som konfiguration i stället för som en omskrivning – och den sammansättningen är precis vad routningslagret finns till för. Det spelar också roll för själva priset: vi för vidare leverantörens listpris med 0 % påslag, så om Xiaomi sänker priset på endera checkpointen ändras siffran på vår sida samma dag i stället för vid nästa avtalsförnyelse. Det gäller de modeller vi erbjuder. För just MiMo-V2.6-paret köper du i dag fortfarande direkt från Xiaomi.
Vad skulle avgöra det
Två saker skulle förvandla detta från en bedömningsfråga till en räknefråga. En Artificial Analysis-sida för MiMo-V2.6-Flash skulle placera båda checkpoints på samma axel för kostnad per uppgift som för närvarande placerar Pro på $0.133 per Intelligence Index-uppgift, och jämförelsen skulle lösa sig själv. En tredjepartsreplikering av säkerhetsklustret — ExploitGym, ExploitBench, SEC Bench Pro — skulle bekräfta huruvida 3x-gapet på de raderna är en egenskap hos modellen eller en egenskap hos bedömaren.
Fram till dess är den försvarbara ståndpunkten att Xiaomi MiMo-V2.6-Flash är det bättre köpet för de flesta team under större delen av tiden, och att Xiaomi MiMo-V2.6-Pro är det bättre köpet för den snäva kategorin av arbete där ett misslyckande är det dyra utfallet. Den enda raden där Flash vinner kullkastar inte det — men den är en användbar påminnelse om att flaggskeppets premium är ett påstående om en arbetsbelastning, inte om en modell.

