
MiMo-V2.6-Flash vs Qwen3.8-Max: Een download tegen een meter, en slechts één van hen heeft een score
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Eén getal bepaalt hoe deze vergelijking gewoonlijk wordt opgeschreven, en dat is geen benchmark. Qwen3.8-Max is een gehost model dat Artificial Analysis continu meet, dus het heeft een actuele Intelligence Index van 45 op de herkalibreerde v4.3-schaal, een outputsnelheid van 39,2 tokens per seconde en een lijstprijs van $2,00 per miljoen inputtokens en $6,00 per miljoen output. MiMo-V2.6-Flash, die Xiaomi op 21 september 2026 publiceerde als downloadbare gewichten, heeft niets van dat alles: geen tariefkaart van een provider, geen modelidentificatie die Xiaomi heeft aangekondigd, en helemaal geen Artificial Analysis-pagina. Alles wat er over de capaciteiten van MiMo-V2.6-Flash is gepubliceerd, komt uit Xiaomi's eigen evaluatietabellen in de modelkaart. Geen enkel cijfer is opnieuw uitgevoerd door iemand die niet bij Xiaomi werkt.
Die asymmetrie is geen minpunt voor het model. Het is een feit over wat voor soort aankoop elk van beide is, en het verandert wat je daadwerkelijk kunt concluderen uit een rechtstreekse vergelijking. De rest van dit stuk gaat over de drie dingen die je echt kunt vergelijken — de vorm van de claim, de kosten van een token en de licentie — plus één getal dat echt is, onafhankelijk gemeten, en aan geen van beide modellen in de kop toebehoort.
Ten eerste, welke Qwen 3.8, en welke MiMo
Beide namen in die kop zijn families die zich voordoen als controlepunten, en de substituties zijn niet onschuldig.
• Qwen3.8-Max — het gehoste vlaggenschip van Alibaba, onthuld op 3 augustus 2026. Een sparse mixture-of-expertsmodel met 2,4 biljoen parameters, waarvan ongeveer 95 miljard actieve parameters per token, een context van 1M tokens, en tekst-, beeld- en video-invoer. Dit is het model dat de rest van dit artikel als de tegenstander behandelt.
• Qwen3.8-Max (0902) — de gedateerde snapshot van 2 september van hetzelfde model, aangeboden als een eigen vermelding met dezelfde prijsstelling van $2,00 en $6,00 en een uitvoerplafond van 131.072 tokens. De huidige Artificial Analysis-pagina is voor deze build, wat van belang is wanneer je een indexscore citeert.
• Qwen3.8-2.4T-A95B — het open-weight checkpoint van dezelfde kern, sinds 12 augustus 2026 downloadbaar onder de Qwen3.8-Max License. Het is tekst-only, denken staat altijd aan, en de native context is 262K in plaats van een miljoen. Het is niet het model uit de kop.
• MiMo-V2.6-Flash — Xiaomi's 309B-totaal, 15B-actief sparse mixture-of-experts-checkpoint, zonder toegangsbeperking op Hugging Face onder de MIT-licentie, native omnimodaal, met een geclaimde context van 1M tokens. Het is de efficiëntievariant van een release met twee checkpoints, waarvan het vlaggenschip MiMo-V2.6-Pro is met 1,02T totaal en 42B actief.
• MiMo-V2-Flash — het model van december 2025. Nog steeds 309B totaal, nog steeds 15B actief, nog steeds een sliding window van 128 tokens. Een andere trainingsrun, een andere benchmarktabel en een context van 256K. Elke pagina die "MiMo-V2-Flash" tegenover een Qwen-model rangschikt, vergelijkt de verkeerde generatie, en het specificatieblad alleen zal je dat niet vertellen.
De MiMo-botsing is de scherpere van de twee valkuilen, omdat de cijfers die het model identificeren toevallig ook de cijfers zijn die identiek zijn tussen de checkpoints van 2025 en 2026. De Qwen-botsing is milder, maar er hangt een prijskaartje aan: de open 2,4T-gewichten en de gehoste API zijn verschillende artefacten met verschillende voorwaarden, en een vergelijking die ze verwisselt, zal zowel de capaciteit als de licentie verkeerd inschatten.
De index is opnieuw opgebouwd, en het nummer dat de meeste pagina's nog steeds afdrukken is verdwenen.
Hier is de faalmodus waarop u moet letten voordat er een score verschijnt.
Artificial Analysis heeft zijn Intelligence Index op 7 september 2026 herijkt naar v4.3. Scores van vóór die datum zijn niet vergelijkbaar met scores erna, en de live Qwen3.8-Max-pagina draagt een Bijgewerkt-badge die een herzien resultaat markeert. Het wijdverspreide cijfer 58 voor Qwen3.8-Max hoort bij de oude schaal. Huidige Qwen3.8-Max (0902) staat op 45, op de 19e plaats van de 202 modellen die Artificial Analysis in die klasse plaatst.
Dit is geen pedanterie. Een 58 naast een 46 leest als een gat van twaalf punten. Dezelfde twee modellen op dezelfde huidige schaal liggen slechts één punt uit elkaar — en de 46 is niet eens het model waarover dit artikel gaat:
• Qwen3.8-Max (0902), onafhankelijk gemeten — Intelligence Index 45 op v4.3. Uitvoersnelheid 39,2 tokens per seconde, gerangschikt 151e van 202, wat de pagina zelf traag noemt. Kosten per Intelligence Index-taak $5,41. Uitvoertokens gegenereerd om de index te voltooien: 190M.
• MiMo-V2.6-Pro, onafhankelijk gemeten — Intelligence Index 46, als eerste gerangschikt van de 114 modellen in de open-weights-klasse. Uitvoersnelheid 134,3 tokens per seconde. Kosten per Intelligence Index-taak $0,13. Uitvoertokens om de index te voltooien: 140 mln.
• MiMo-V2.6-Flash, het eigenlijke onderwerp — er bestaat geen Artificial Analysis-pagina. Niets om te citeren.
Lees die drie samen en de eerlijke samenvatting is ongemakkelijk voor beide leveranciers. Het vergelijkingspunt waar iedereen op zit te wachten — Flash tegen Qwen3.8-Max op een neutrale schaal — bestaat niet en kan niet worden geconstrueerd uit leverancierstabellen, omdat de twee leveranciers op verschillende tijdstippen verschillende harnassen op verschillende checkpoints hebben gedraaid en zich vervolgens vergeleken met modellen van andere bedrijven die ze ook hebben gedraaid. Wat wel bestaat, is een verschil van één punt tussen de vlaggenschip-Qwen en Xiaomi's grotere checkpoint, tegen ruwweg een veertigste van de kosten per indextaak. Dat is het meest interessante echte getal in deze confrontatie, en het gaat over een model dat geen van beide partijen in de kop noemt.

Wat de leverancierstabellen je wel en niet vertellen
Beide leveranciers publiceren cijfers. Het zijn niet dezelfde soort cijfers, en ze kolom voor kolom naast elkaar zetten levert een grafiek op in plaats van een bevinding — maar de vorm van de beweringen is nog steeds het lezen waard, want die vertelt je waar elk lab op heeft geoptimaliseerd.
• Codeagent — Xiaomi rapporteert voor MiMo-V2.6-Flash 67,9 op DeepSWE v1.1, 87,6 op Terminal Bench 2.1, 26,0 op ProgramBench en 61,2 op MiMo Code Bench. Alibaba rapporteert voor Qwen3.8-Max 67,7 op SWE-bench Pro en 86,6 op Terminal-Bench 2.1. De Terminal-Bench-cijfers liggen dicht genoeg bij elkaar dat het aannemelijk is dat het testharnas, niet het model, de volgorde bepaalt.
• Algemene agent — Xiaomi rapporteert AutomationBench v1.0.6 52,3, Toolathlon-Verified 73,6, OSWorld-Verified 80,8 en Agents' Last Exam 27,6 voor Flash. Alibaba rapporteert OSWorld-Verified 86,1, WideSearch 81,9 en Agent's Last Exam 52,4 voor Qwen3.8-Max. Op de twee benchmarks die beide labs hebben uitgevoerd, liggen de door Qwen gerapporteerde cijfers hoger — op Alibaba's eigen harness.
• Kennis en beveiliging — Xiaomi draait CyberGym (Flash 95.1), MiMo Cyber Bench (77.2), ExploitGym (6.0), ExploitBench (25.3) en SEC Bench Pro (47.5). Alibaba draait GPQA Diamond (92.6), Humanity's Last Exam (43.6) en PaperBench (93.0). Bijna geen overlap, dus bijna niets om te vergelijken.
Het enige echt nuttige ding dat een leverancierstabel kan tonen, is een interne inconsistentie, en die van Xiaomi heeft er een. Het openbare RL-dashboard, dat de trainingsrun tot en met september streamde, publiceerde MiMo-V2.6-Flash op 65,68 op DeepSWE v1.1 met een mini-swe-agent-harnas bij een gemiddelde van drie. De definitieve modelkaart vermeldt 67,9 voor de vrijgegeven gewichten. Die beschrijven respectievelijk een trainingssnapshot en een vrijgegeven artefact, en het verschil van twee punten is even groot als de kloof tussen de twee checkpoints van Xiaomi. Als je sinds vorige week het dashboardgetal citeert, is het verouderd.
De rekening, en dat is waar de twee modellen niet meer vergelijkbaar zijn.
Dit is de afdeling die over de inzet beslist, en het is niet eens nipt.
• Qwen3.8-Max werkt met verbruiksmeting. $2,00 per miljoen inputtokens en $6,00 per miljoen output op Alibaba's internationale tariefkaart, met een cachekorting die Artificial Analysis op 88% meet en een kostenpost van $5,41 per Intelligence Index-taak. Documentatie van Alibaba voor de Chinese regio vermeldt CNY 12 en CNY 36 per miljoen voor hetzelfde paar. Je kunt het vanmiddag aanroepen en dan krijg je een factuur.
• MiMo-V2.6-Flash is een download. Xiaomi publiceert geen tarief per token voor de MiMo-V2.6-generatie op zijn eigen site en heeft voor geen van beide checkpoints een aanroepbare identifier aangekondigd, dus er valt niets te meten. Wat er in plaats daarvan is, is 172,9 GB aan FP8-gewichtsdata verdeeld over 65 shards, nog vóór KV-cache voor een context van 1M tokens, en een deployment-sectie die SGLang aanraadt bij tensor-parallel 16 met een data-parallelfactor van 2, of een vLLM-recept bij tensor-parallel 8 — een multi-node servingtaak.
De vermeldingen van derden zijn geen tariefkaart. Cataloguspagina's bevatten wel cijfers voor de MiMo-V2.6-serie, en Artificial Analysis telt één API-provider die MiMo-V2.6-Pro aanbiedt voor $0,435 en $0,87 per miljoen. Dat is een vermelding van een provider voor het grotere checkpoint, geen Xiaomi-prijs, en voor Flash bestaat die helemaal niet.
Dus de rekensom is een verbruiksgemeten regelpost tegenover een kapitaalbeslissing. Bij een paar honderd miljoen tokens per maand is Qwen3.8-Max een factuur die je kunt voorspellen, en Flash is een node die je zou aanschaffen om een model te bedienen dat niemand buiten Xiaomi heeft gemeten. Bij miljarden tokens per maand begint het open pad te winnen op kosten, en dit is het punt waarop de licentie ophoudt een juridische voetnoot te zijn en een inkoopinput wordt.
De licenties zijn niet dezelfde toestemming
MIT is ongeveer het meest permissieve dat open weights te bieden hebben. De Qwen3.8-Max-licentie is geen MIT, en dat verschil is niet mis.
MiMo-V2.6-Flash wordt uitgebracht onder MIT, zonder omzetdrempel, zonder trigger op basis van het aantal gebruikers, zonder afzonderlijke commerciële overeenkomst en zonder onderzoeksclausule. Commerciële inzet, wijziging, herdistributie en verdere training zijn allemaal toegestaan, en de repository is vrij toegankelijk.
De Qwen3.8-Max-licentie verleent gebruik, wijziging, distributie, sublicentiëring, verkoop, implementatie, hosting en fine-tuning, onder twee voorwaarden. Een product of dienst met meer dan 100 miljoen maandelijkse actieve gebruikers of US$20 miljoen aan maandelijkse omzet moet de modelnaam prominent in de interface weergeven. En een bedrijf dat model-as-a-service of een AI-werkassistent aanbiedt, met een totale omzet van meer dan US$50 miljoen over een willekeurige periode van twaalf opeenvolgende maanden, heeft een aparte licentie van Alibaba nodig voordat het commercieel mag worden gebruikt. Intern gebruik is uitgezonderd, mits het model of zijn capaciteiten niet aan derden worden blootgesteld.
Voor de meeste teams is geen van beide voorwaarden bindend. Voor een platformbedrijf dat succesvol is, geldt dat wel voor één ervan — en die bindt precies op het moment dat het model onmisbaar is geworden. Merk ook op dat die voorwaarden verbonden zijn aan de downloadbare 2,4T-gewichten, niet aan de gehoste API, waar in plaats daarvan de voorwaarden van de aanbieder gelden. De twee paden hebben verschillende verplichtingen, wat een extra reden is om het open checkpoint niet met het gehoste checkpoint te vergelijken alsof het hetzelfde product is.
Waar OrcaRouter past, en waar niet
Qwen3.8-Max is routeerbaar op OrcaRouter, zowel op de basisvermelding als op de gedateerde 0902-snapshot, via één API-sleutel tegen de lijstprijs van de provider met 0% doorberekende markup. Dat is hier specifiek om twee redenen van belang. Ten eerste is de 0902-build een aparte vermelding in plaats van een stille vervanging, dus de routing-DSL kan reproduceerbaarheidsgevoelig verkeer vastpinnen op de gedateerde snapshot, terwijl al het andere de basistier volgt — geen tweede integratie, geen codewijziging. Ten tweede, omdat de lijstprijs wordt doorgegeven in plaats van dat er markup wordt gerekend, komt een wijziging in Alibaba's tariefkaart dezelfde dag bij jou terecht in plaats van bij de volgende contractverlenging, wat de hierbovenstaande metered-versus-node-berekening eerlijk houdt wanneer prijzen veranderen. Cache-intensieve workloads behouden ook de cachekorting van de provider in plaats van een deel ervan aan de marge van een wederverkoper te verliezen.

MiMo-V2.6-Flash is nergens routeerbaar, ook niet bij ons. Wij routeren geen enkel Xiaomi-model, en de beschikbaarheidsregel in Xiaomi's eigen kaart verwijst naar Xiaomi's eigen kanalen: het MiMo API-platform, AI Studio, MiMo Code en de desktopapp. Als je deze checkpoint wilt, download je 172,9 GB en moet je een node zien te vinden.

Welke, en wanneer?
Kies Qwen3.8-Max als je capaciteit wilt zonder hardware, als je volume onzeker is, of als je de optie wilt van een onafhankelijk cijfer voordat je je vastlegt. Accepteer dat 45 op de huidige index een middenpositie in de frontier is in plaats van een toppositie, dat 39,2 tokens per seconde traag genoeg is om van belang te zijn binnen een agent-loop, en dat 190M output-tokens om de Intelligence Index af te ronden ruwweg twee keer de mediaan is — verboseheid kost geld aan de output-geprijsde kant van de meter.
Kies MiMo-V2.6-Flash als de beperking de licentie, het gegevenspad of een langetermijnrekening is die je kunt afschrijven — en als je de node hebt. MIT-voorwaarden zonder omzetpoort zijn wezenlijk een andere toestemming dan een licentie met een MAU-drempel en een trigger voor omzetdeling, en voor een bedrijf dat verwacht groot te worden is dat de reden om het te kiezen. Maak een begroting voor multi-node serving, baseer de dimensionering op de gepubliceerde gewichtsdata in plaats van de repositorypagina, en beschouw elk getal op Xiaomi's kaart als door de leverancier gerapporteerd totdat iemand buiten het lab het opnieuw uitvoert.
En als je vandaag kiest in plaats van volgend kwartaal, probeer dan eerst de metered optie. Een maand Qwen3.8-Max vertelt je wat je workload echt nodig heeft. Een node vertelt je alleen wat je hoopte dat die nodig zou hebben.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
