OrcaRouter modellradar-hero-kort med rubriken 'MiMo-V2.6-Flash vs Qwen 3.8', med underrubriken 'En nedladdning mot en mätare, och bara en sida har en tredjepartspoäng', med en vänsterpanel för MiMo-V2.6-Flash som visar 309B totalt / 15B aktiva, MIT-licens, utan grind och Ingen oberoende poäng, en högerpanel för Qwen3.8-Max som visar 2.4T totalt / 95B aktiva, $2.00 in / $6.00 ut per 1M och AA Index 45, aktuell skala, samt tre märken nedanför som lyder Flash: publicerad 21 sep 2026, Qwen: mätbaserad sedan 3 aug 2026 och Routable: endast Qwen3.8-Max.
Guides & Insights

MiMo-V2.6-Flash vs Qwen3.8-Max: En nedladdning mot en mätare, och bara en av dem har en poäng

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Ett nummer avgör hur den här jämförelsen vanligtvis skrivs, och det är inte ett benchmark. Qwen3.8-Max är en hostad modell som Artificial Analysis mäter kontinuerligt, så den har ett aktuellt Intelligence Index på 45 på den omkalibrerade v4.3-skalan, en utdatahastighet på 39,2 tokens per sekund och ett listpris på 2,00 USD per miljon indatatokens och 6,00 USD per miljon utdatatokens. MiMo-V2.6-Flash, som Xiaomi publicerade som nedladdningsbara vikter den 21 september 2026, har inget av detta: inget priskort från någon leverantör, ingen modellidentifierare som Xiaomi har meddelat och ingen Artificial Analysis-sida alls. Allt som har publicerats om MiMo-V2.6-Flashs kapacitet kommer från Xiaomis egna utvärderingstabeller i dess modellkort. Inte en enda siffra har körts om av någon som inte arbetar på Xiaomi.

Den asymmetrin är inte ett minus för modellen. Det är ett faktum om vilken typ av köp var och en är, och det förändrar vad du faktiskt kan dra för slutsatser av en direkt jämförelse. Resten av den här artikeln handlar om de tre saker du verkligen kan jämföra – anspråkets form, kostnaden för en token och licensen – plus en siffra som är verklig, oberoende mätt och inte tillhör någon av modellerna i rubriken.

Först, vilken Qwen 3.8, och vilken MiMo

Båda namnen i den rubriken är familjer som låtsas vara kontrollpunkter, och substitutionerna är inte ofarliga.

• Qwen3.8-Max — Alibabas värdbaserade flaggskepp, avtäcktes den 3 augusti 2026. En gles mixture-of-experts-modell med 2,4 biljoner parametrar och omkring 95 miljarder aktiva parametrar per token, 1M-tokens kontext samt text-, bild- och videoinmatning. Detta är modellen som resten av den här artikeln behandlar som motståndaren.

• Qwen3.8-Max (0902) — den daterade ögonblicksbilden från 2 september av samma modell, listad som en egen post med samma prissättning på $2.00 och $6.00 och ett utdatatak på 131 072 tokens. Den aktuella Artificial Analysis-sidan gäller den här versionen, vilket har betydelse när du anger en indexpoäng.

• Qwen3.8-2.4T-A95B – checkpointen med öppna vikter för samma kärna, nedladdningsbar sedan 12 augusti 2026 under Qwen3.8-Max License. Den hanterar endast text, tänkandet är alltid påslaget, och dess inbyggda kontext är 262K i stället för en miljon. Det är inte modellen i rubriken.

• MiMo-V2.6-Flash — Xiaomis glesa mixture-of-experts-checkpoint med 309B totalt och 15B aktiva, utan åtkomstgrind på Hugging Face under MIT-licensen, nativt omnimodal, med ett påstående om 1M tokens kontext. Det är effektivitetsvarianten i ett släpp med två checkpoints, vars flaggskepp är MiMo-V2.6-Pro med 1,02T totalt och 42B aktiva.

• MiMo-V2-Flash — modellen från december 2025. Samma 309B totalt, samma 15B aktiva, samma glidande fönster på 128 tokens. Annan träningskörning, annan benchmarktabell och en kontext på 256K. Varje sida som rangordnar "MiMo-V2-Flash" mot en Qwen-modell jämför fel generation, och enbart specifikationsbladet kommer inte att säga dig det.

MiMo-kollisionen är den vassare av de två fällorna, eftersom siffrorna som identifierar modellen också råkar vara de siffror som är identiska mellan 2025- och 2026-checkpointarna. Qwen-kollisionen är mildare men har ett pris: de öppna 2,4T-vikterna och det hostade API:et är olika artefakter med olika villkor, och en jämförelse som byter ut dem kommer att få både kapaciteten och licensen fel.

Indexet byggdes om, och numret som de flesta sidor fortfarande skriver ut är borta.

Här är felmoden att hålla utkik efter innan någon poäng visas.

Artificial Analysis kalibrerade om sitt Intelligence Index till v4.3 den 7 september 2026. Poäng före detta datum är inte jämförbara med poäng efter det, och live-sidan för Qwen3.8-Max bär ett Uppdaterat märke som markerar ett omräknat resultat. Den allmänt spridda siffran 58 för Qwen3.8-Max tillhör den gamla skalan. Nuvarande Qwen3.8-Max (0902) visar 45, rankad 19:e av de 202 modeller som Artificial Analysis placerar i den klassen.

Det här är inte pedanteri. En 58:a bredvid en 46:a uppfattas som ett glapp på tolv poäng. Samma två modeller på samma nuvarande skala skiljer sig bara en enda poäng åt — och 46:an är inte ens den modell som den här artikeln handlar om:

• Qwen3.8-Max (0902), oberoende uppmätt — Intelligence Index 45 i v4.3. Utdatashastighet 39,2 tokens per sekund, rankad 151:a av 202, vilket sidan själv noterar är långsamt. Kostnad per Intelligence Index-uppgift: 5,41 $. Utdatatokens som genererades för att slutföra indexet: 190M.

• MiMo-V2.6-Pro, oberoende mätt — Intelligence Index 46, rankad först av de 114 modellerna i open-weights-klassen. Utdatashastighet 134,3 tokens per sekund. Kostnad per Intelligence Index-uppgift $0,13. Utdatatokens för att slutföra indexet: 140M.

• MiMo-V2.6-Flash, det egentliga ämnet — det finns ingen Artificial Analysis-sida. Inget att citera.

Läser man de tre tillsammans är den ärliga sammanfattningen obekväm för båda leverantörerna. Den jämförelse alla vill ha – Flash mot Qwen3.8-Max på en neutral skala – existerar inte och kan inte konstrueras utifrån leverantörstabeller, eftersom de två leverantörerna körde olika testramverk på olika checkpoints vid olika tidpunkter och sedan jämförde sig med andra företags modeller som de också körde. Det som däremot finns är en gap på en punkt mellan flaggskeppet Qwen och Xiaomis större checkpoint, till ungefär en fyrtiondel av kostnaden per indextask. Det är det mest intressanta verkliga talet i den här matchen, och det handlar om en modell som ingen av sidorna i rubriken nämner.

Scoreboard card headed 'MiMo-V2.6-Flash vs Qwen3.8-Max', with paired rows for parameters (309B total / 15B active against 2.4T total / 95B active), licence (MIT, ungated, no revenue trigger, against a hosted API whose open 2.4T sibling uses the Qwen3.8-Max License), price per 1M (no vendor rate card against $2.00 in and $6.00 out with an 88% cache discount), independent score (None published, no Artificial Analysis page, against AA Index 45 on the v4.3 scale, 19th of 202 in class), DeepSWE v1.1 (67.9 on Xiaomi's own harness against Not published) and routability (No - nowhere, including OrcaRouter, against Yes - on OrcaRouter, base tier and the 0902 snapshot).

Vad leverantörstabellerna kommer att berätta för dig – och vad de inte kommer att berätta

Båda leverantörerna publicerar siffror. De är inte samma sorts siffror, och att ställa upp dem kolumn för kolumn ger ett diagram snarare än ett rön – men anspråkens form är fortfarande värd att läsa, eftersom den talar om vad varje labb optimerade för.

• Kodagent — Xiaomi rapporterar MiMo-V2.6-Flash vid DeepSWE v1.1 67,9, Terminal Bench 2.1 87,6, ProgramBench 26,0 och MiMo Code Bench 61,2. Alibaba rapporterar Qwen3.8-Max vid SWE-bench Pro 67,7 och Terminal-Bench 2.1 86,6. Terminal-Bench-siffrorna är tillräckligt nära för att det rimligen är testramverket, inte modellen, som avgör ordningen.

• Allmän agent — Xiaomi rapporterar AutomationBench v1.0.6 52,3, Toolathlon-Verified 73,6, OSWorld-Verified 80,8 och Agents' Last Exam 27,6 för Flash. Alibaba rapporterar OSWorld-Verified 86,1, WideSearch 81,9 och Agent's Last Exam 52,4 för Qwen3.8-Max. På de två benchmarks som båda labben körde ligger Qwens rapporterade siffror före — i Alibabas egen testmiljö.

• Kunskap och säkerhet — Xiaomi kör CyberGym (Flash 95.1), MiMo Cyber Bench (77.2), ExploitGym (6.0), ExploitBench (25.3) och SEC Bench Pro (47.5). Alibaba kör GPQA Diamond (92.6), Humanity's Last Exam (43.6) och PaperBench (93.0). Nästan ingen överlappning, så nästan ingenting att jämföra.

Det enda genuint användbara som en leverantörstabell kan visa är en intern inkonsekvens, och Xiaomis har en. Dess offentliga RL-dashboard, som streamade träningskörningen under september, publicerade MiMo-V2.6-Flash på 65.68 på DeepSWE v1.1 med en mini-swe-agent-harness, som medelvärde av tre. Det färdiga modellkortet anger 67.9 för de släppta vikterna. De beskriver en träningsögonblicksbild respektive en släppt artefakt, och skillnaden på två punkter är lika stor som gapet mellan Xiaomis två checkpoints. Om du har citerat dashboard-siffran sedan förra veckan är den inaktuell.

Notan, vilket är där de två modellerna slutar vara jämförbara

Detta är avsnittet som avgör driftsättningar, och det är inte jämnt.

• Qwen3.8-Max debiteras efter förbrukning. 2,00 USD per miljon indatatoken och 6,00 USD per miljon utdatatoken enligt Alibabas internationella prislista, med en cacherabatt som Artificial Analysis uppmäter till 88 % och en kostnad på 5,41 USD per uppgift i Intelligence Index. Alibabas dokumentation för Kina-regionen anger 12 CNY och 36 CNY per miljon för samma par. Du kan anropa den i eftermiddag och få en räkning.

• MiMo-V2.6-Flash är en nedladdning. Xiaomi publicerar inget tokenpris för MiMo-V2.6-generationen på sin egen webbplats och har inte meddelat någon anropbar identifierare för någon av checkpointarna, så det finns inget att mäta. Det som finns i stället är 172,9 GB FP8-viktdata över 65 shards, före KV-cache för en kontext på 1M token, och ett avsnitt om driftsättning som rekommenderar SGLang vid tensor-parallellism 16 med en dataparallell faktor på 2, eller ett vLLM-recept vid tensor-parallellism 8 – ett flernodigt serveringsjobb.

• Tredjepartslistningar är inte en prislista. Katalogsidor innehåller visserligen siffror för MiMo-V2.6-serien, och Artificial Analysis räknar med en enda API-leverantör som tillhandahåller MiMo-V2.6-Pro för $0,435 och $0,87 per miljon. Det är en leverantörslistning för den större checkpointen, inte ett Xiaomi-pris, och den finns inte alls för Flash.

Så räkneövningen är en mätbaserad radpost ställd mot ett kapitalbeslut. Vid några hundra miljoner tokens i månaden är Qwen3.8-Max en räkning du kan prognostisera, och Flash en nod du skulle köpa för att betjäna en modell som ingen utanför Xiaomi har mätt. Vid miljarder tokens i månaden börjar den öppna vägen vinna på kostnad, och det är här licensen slutar vara en juridisk fotnot och blir en upphandlingsparameter.

Licenserna är inte samma behörighet

MIT är ungefär så tillåtande som öppna vikter kan bli. Qwen3.8-Max License är inte MIT, och skillnaden är inte att leka med.

MiMo-V2.6-Flash släpps under MIT utan intäktsgräns, utan utlösare för antal användare, utan separat kommersiellt avtal och utan forskningsklausul. Kommersiell driftsättning, modifiering, vidaredistribution och vidare träning är alla tillåtna, och repositoriet är utan grind.

Qwen3.8-Max-licensen beviljar användning, modifiering, distribution, underlicensiering, försäljning, driftsättning, hosting och finjustering, på två villkor. En produkt eller tjänst som överstiger 100 miljoner månatliga aktiva användare eller 20 miljoner USD i månatliga intäkter måste visa modellnamnet tydligt i sitt gränssnitt. Och en verksamhet inom model-as-a-service eller AI-arbetsassistent med sammanlagda intäkter över 50 miljoner USD under valfri tolvmånadersperiod i följd behöver en separat licens från Alibaba före kommersiell användning. Intern användning undantas, förutsatt att modellen eller dess funktioner inte exponeras för tredje parter.

För de flesta team är inget av villkoren bindande. För ett plattformsföretag som lyckas är ett av dem det – och det är bindande i precis det ögonblick då modellen har blivit bärande. Notera också att dessa villkor är knutna till de nedladdningsbara 2,4T-vikterna, inte till det hostade API:et, där i stället leverantörens villkor gäller. De två vägarna har olika skyldigheter, vilket är ännu ett skäl att inte jämföra den öppna checkpointen med den hostade varianten som om de vore samma produkt.

Var OrcaRouter passar in, och var det inte gör det

Qwen3.8-Max går att routa på OrcaRouter, både på basposten och den daterade 0902-ögonblicksbilden, via en enda API-nyckel till leverantörens listpris med 0 % påslag som förs vidare. Det spelar särskilt stor roll här av två skäl. För det första är 0902-bygget en separat post i stället för en tyst ersättning, så routnings-DSL:en kan fästa reproducerbarhetskänslig trafik vid den daterade ögonblicksbilden medan allt annat följer basnivån – ingen andra integration, ingen kodändring. För det andra, eftersom listpriset förs vidare i stället för att påläggas, landar en ändring i Alibabas prislista på din sida samma dag i stället för vid nästa avtalsförnyelse, vilket är vad som håller räkneexemplet mätt–nod ovan ärligt när priserna rör sig. Cache-tunga arbetsbelastningar behåller dessutom leverantörens cacherabatt i stället för att förlora en del av den till en återförsäljares marginal.

Screenshot of the OrcaRouter model page for Qwen3.8 Max, marked FEATURED, giving the model id qwen/qwen3.8-max, a 1M-token context, text, image and video input with text output, an input price of $2.00 and output price of $6.00 per 1M tokens, a p50 time to first token of 3.33 seconds, and seven-day traffic of 30.8M tokens.

MiMo-V2.6-Flash går inte att routa någonstans, inte ens hos oss. Vi routar ingen Xiaomi-modell, och tillgänglighetsraden i Xiaomis eget kort pekar på Xiaomis egna kanaler: MiMo API-plattformen, AI Studio, MiMo Code och skrivbordsappen. Om du vill ha den här checkpointen laddar du ner 172,9 GB och hittar en nod.

Screenshot of the Artificial Analysis model page for Qwen3.8 Max (0902), showing an Intelligence Index of 45 on the updated v4.3 scale ranked 19th of 202, output speed of 39.2 tokens per second ranked 151st of 202, a price of $2.00 per million input tokens and $6.00 per million output with an 88% cache discount and a $5.41 cost per Intelligence Index task, 190M output tokens generated on the index, and a 984k-token context window.

Vilken, och när?

Ta Qwen3.8-Max om du vill ha kapacitet utan hårdvara, om du är osäker på volymen, eller om du vill ha möjligheten till en oberoende siffra innan du bestämmer dig. Acceptera att 45 på det aktuella indexet är en position i mitten av frontlinjen snarare än en topposition, att 39,2 tokens per sekund är tillräckligt långsamt för att spela roll i en agentloop, och att 190M utdatatokens för att slutföra Intelligence Index är ungefär dubbelt så många som medianen — mångordighet kostar pengar på den sida av mätaren som prissätts efter output.

Välj MiMo-V2.6-Flash om begränsningen är licensen, datavägen eller en långsiktig kostnad som du kan amortera — och om du har noden. MIT-villkor utan intäktsgrind är genuint ett annat tillstånd än en licens med en MAU-tröskel och en utlösare för intäktsdelning, och för ett företag som förväntar sig att bli stort är det anledningen att välja den. Budgetera för flernodsservering, dimensionera utifrån de publicerade viktdata i stället för reposidan, och behandla varje siffra i Xiaomis kort som leverantörsrapporterad tills någon utanför labbet kör om den.

Och om du väljer i dag i stället för nästa kvartal, kör det förbrukningsbaserade alternativet först. En månad med Qwen3.8-Max säger dig vad din arbetsbelastning faktiskt behöver. En nod säger dig bara vad du hoppades att den skulle.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen