
MiMo-V2.6-Flash vs MiMo-V2.6: jedna seria, dwa checkpointy i nazwa, która pełni podwójną funkcję
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Zapytaj dwie osoby, czym jest MiMo-V2.6, a możesz usłyszeć o dwóch różnych modelach. Wrześniowe wydanie Xiaomi z 2026 roku to seria z dwoma opublikowanymi checkpointami — MiMo-V2.6-Flash o 309 miliardach parametrów i MiMo-V2.6-Pro o 1,02 biliona — a sama nazwa MiMo-V2.6 bywa używana zarówno na określenie całej rodziny, jak i, w większości omówień, najwyższej klasy tego pokolenia. Strona zatytułowana „MiMo-V2.6-Flash vs MiMo-V2.6” to więc tak naprawdę zestawienie wydajnego checkpointu z nazwą, którą ludzie piszą, mając na myśli model flagowy. Oba checkpointy trafiły na Hugging Face osiemnaście sekund od siebie 21 września 2026 roku, oba mają licencję MIT i oba są przede wszystkim do pobrania — nie ma punktu końcowego Xiaomi, do którego można by się zwrócić. Prawie nic więcej nie jest w nich takie samo.
Ma to większe znaczenie, niż zwykle miałby spór o nazewnictwo, ponieważ te dwa nie są drabiną rozmiarów, po której można wspinać się później. To osobne przebiegi treningowe, z osobnymi tabelami benchmarków, osobnym zużyciem pamięci i — jak pokazują opublikowane liczby — kilkoma miejscami, w których mniejszy wygrywa bezapelacyjnie.
Dwa punkty kontrolne, jedna opublikowana minuta
Repozytoria to XiaomiMiMo/MiMo-V2.6-Flash-RL, utworzone o 15:39:51 UTC, oraz XiaomiMiMo/MiMo-V2.6-Pro-RL, utworzone o 15:39:33 UTC. Żadne z nich nie ma ograniczonego dostępu. Oba mają dołączony raport techniczny i kartę modelu, a Xiaomi opisuje oba jako efekt pojedynczego mieszanego przebiegu uczenia ze wzmocnieniem, który połączył zadania programistyczne, zadania dla agentów ogólnych, zadania wizualne i zadania z zakresu cyberbezpieczeństwa w jeden przebieg treningowy, a nie w osobne przebiegi dla poszczególnych domen.
• Parametry — MiMo-V2.6-Flash: 309B łącznie, 15B aktywowanych na token. MiMo-V2.6-Pro: 1,02T łącznie, 42B aktywowanych. Oba to rzadkie modele mieszaniny ekspertów.
• Backbone — Flash ma 48 warstw, 39 z oknem przesuwnym i 9 z pełną uwagą, rozmiar ukryty 4096, 256 ekspertów routowanych z 8 aktywowanymi, 128-tokenowe okno przesuwne i brak współdzielonych ekspertów. Pro stosuje tę samą ideę hybrydowej uwagi przy znacznie większej szerokości.
• Modalność — oba są natywnie omnimodalne, przyjmując tekst, obraz, wideo i dźwięk do jednego modelu, a nie trzech sklejonych ze sobą potoków. Flash zawiera 681M-parametrowy transformer wizyjny, 308M tokenizator audio i 127M enkoder patchy audio.
• Kontekst — 1 mln tokenów, deklarowany dla obu, z konfiguracją wskazującą maksymalny embedding pozycji wynoszący 1 048 576 tokenów.
• Licencja — MIT w obu przypadkach, bez progu przychodowego, bez ograniczeń dopuszczalnego użycia poza zwyczajowymi i bez klauzuli badawczej. Komercyjne wdrożenie, modyfikacja i redystrybucja są dozwolone.
• Pliki wag — Flash publikuje 172,9 GB danych wag FP8 w 65 shardach. Pro ma około trzykrotnie większą liczbę parametrów, więc jego pobranie plasuje się w zakresie pół terabajta, zanim sam zastosujesz jakąkolwiek kwantyzację.
• Gdzie są udostępniane — Hugging Face, własna platforma API Xiaomi, AI Studio, MiMo Code i aplikacja desktopowa MiMo. Karta zauważa, że żaden z dwóch checkpointów nie jest obecnie wdrożony przez zewnętrznego dostawcę inferencji na samym Hubie.
Kolizja, która kosztuje ludzi sprzęt
Zamieszanie w tym zestawieniu nie dotyczy tak naprawdę relacji między Flash i Pro. Dotyczy relacji między MiMo-V2.6-Flash a modelem, który go poprzedzał.
MiMo-V2-Flash został wydany w grudniu 2025 r., a sam wpis na blogu Xiaomi ogłaszający jego premierę opisuje model typu mixture-of-experts z 309 miliardami parametrów łącznie, 15 miliardami aktywnych, hybrydowym schematem uwagi przeplatającym uwagę z oknem przesuwnym i pełną uwagę oraz agresywnym oknem przesuwnym o rozmiarze 128 tokenów. Zestaw to z powyższą listą punktowaną. Checkpoint z 2026 r. i checkpoint z 2025 r. mają taki sam ogólny kształt, ten sam rozmiar okna przesuwanego i ten sam budżet aktywacji — dziewięć miesięcy różnicy, z różnych przebiegów treningowych, o różnych możliwościach i innej tabeli wyników.
Tak więc wyszukiwanie „MiMo V2.6 Flash” bez problemu podrzuci ci strony o MiMo-V2-Flash, wraz z wartością kontekstu 256K i ceną jednej dziesiątej dolara za milion tokenów wejściowych, która należy do starszego modelu. Jeśli dobierasz rozmiar węzła, to nie jest błąd kosmetyczny. Starszy checkpoint i nowszy to różne pliki do pobrania z różnymi przepisami serwowania, a nowszy deklaruje czterokrotnie większy kontekst.
Jest jeszcze druga, cichsza pułapka w nazewnictwie. Oba repozytoria kończą się na -RL, co brzmi jak adapter do uczenia ze wzmocnieniem siedzący na szczycie jakiegoś innego modelu bazowego. To nie są adaptery. Ten przyrostek oznacza rodowód po treningu: to pełne checkpointy, które wyszły ze strumieniowego przebiegu RL. Indeks wag to potwierdza — dziesiątki tysięcy tensorów obejmujących cały szkielet, enkoder wizji, stos audio i spekulatywny drafter.
Co mówi własna tabela dostawcy
Każda liczba w tej sekcji pochodzi z tabel oceny Xiaomi zawartych w dwóch kartach modeli. Xiaomi uruchomiło te zestawy testowe na własnych checkpointach. Nic z tego nie zostało odtworzone poza laboratorium, nic z tego nie pojawia się na publicznym leaderboardzie, a kolumny porównawcze to własne uruchomienia tego samego zestawu testów przez dostawcę na modelach innych firm. Traktuj ranking jako informacyjny, a miejsca po przecinku jako dekorację.
• Agent kodu — DeepSWE v1.1: Flash 67,9, Pro 71,9. Terminal Bench 2.1: Flash 87,6, Pro 89,9. ProgramBench: Flash 26,0. MiMo Code Bench: Flash 61,2.
• Agent ogólny — AutomationBench v1.0.6: Flash 52,3, Pro 53,1. Toolathlon-Verified: Flash 73,6, Pro 76,9. OSWorld-Verified: Flash 80,8, Pro 82,0. Agents' Last Exam: Flash 27,6. Terminal Bench 4.0: Flash 28,8.
• Cyberbezpieczeństwo — jedyna kolumna, w której mniejszy model prowadzi. CyberGym: Flash 95,1 wobec 94,0 Pro. MiMo Cyber Bench: Flash 77,2. Potem grunt usuwa się spod nóg: ExploitGym 6,0, ExploitBench 25,3, SEC Bench Pro 47,5.
• Agent wizualny — MiMo VisualCoding: Flash 71.5, Pro 72.3.
Przejrzyj te punkty, a uczciwe podsumowanie jest takie, że Pro prowadzi niemal wszędzie, choć niewielkimi marginesami, a marginesy te są na tyle małe, że mieszczą się w szumie samodzielnie uruchamianego harnessu. W DeepSWE te dwa dzieli cztery punkty w skali, w której ten sam checkpoint przesunął się o dwa punkty między dwiema własnymi ewaluacjami Xiaomi.
Ten ostatni punkt zasługuje na osobny akapit, bo jest najużyteczniejszą rzeczą na obu kartach. Publiczny dashboard RL Xiaomi, który przez wrzesień transmitował oba przebiegi treningowe, podał dla Flasha 65.68 na DeepSWE v1.1 przy użyciu harnessu mini-swe-agent, ze średniej z trzech. Gotowa karta podaje 67.9 dla wydanych wag. Tymczasem wynik Pro na dashboardzie wynosił 72.57, a jego karta podaje 71.9 — czyli spadł. Dwa checkpointy z tego samego przebiegu, oceniane dwukrotnie, a różnica między tymi dwiema ocenami jest tej samej wielkości co różnica między oboma modelami. Jeśli od zeszłego tygodnia cytujesz liczby z dashboardu, opisują one migawki treningowe, a nie artefakty, które pobrałbyś dzisiaj.

Żaden z nich nie jest na routerze
Oto część, która decyduje o większości rzeczywistych ocen. Xiaomi nie sprzedaje żadnego z tych checkpointów: na własnej stronie nie opublikowano ceny za token dla generacji MiMo-V2.6 ani nie ogłoszono możliwego do wywołania identyfikatora modelu dla żadnego z nich. Zamiast tego istnieje plik do pobrania, a dodatkowo — wyłącznie w przypadku Pro — pojedynczy dostawca API, którego Artificial Analysis uznaje za udostępniającego go po 0,435 USD za milion tokenów wejściowych i 0,87 USD za milion tokenów wyjściowych. To wpis dostawcy, a nie cennik producenta, a dla Flash nie ma zupełnie nic porównywalnego. Krążące po stronach katalogowych podmiotów trzecich liczby należy odczytywać w ten sam sposób.
Więc wybór między Flash a Pro to nie wybór między dwoma punktami końcowymi z różnymi licznikami. To wybór między dwoma rachunkami za GPU, a ten mniejszy to mniej więcej jedna trzecia większego. Na tym opiera się cały argument handlowy za Flashem i jest on mocniejszy, niż sugeruje tabela benchmarków, bo oba modele dzieli zaledwie kilka punktów w zadaniach, dla których większość ludzi je kupuje.
Co to pozostawia, to znany podział na trzy warianty. Wynajmij frontier, miej własny mały model albo własny duży. Kolumna frontieru to ta, względem której Xiaomi porównuje w swoich własnych tabelach — Claude Opus 5, GPT-5.6 Sol i Claude Fable 5 plasują się o kilka punktów powyżej Pro w DeepSWE w porównaniu samego dostawcy, a wszystkie trzy można dziś wywołać przez jeden klucz API w OrcaRouter w cenie katalogowej dostawcy z 0% marży doliczonej. Ma to znaczenie dla konkretnej decyzji, przed którą stoisz: zmiana ceny dostawcy trafia na twoją stronę tego samego dnia, a nie przy kolejnym odnowieniu umowy, więc arytmetyka wynajem kontra posiadanie pozostaje uczciwa, gdy zmieniają się ceny hostowane. Automatyczne przełączanie awaryjne oznacza też, że model, który wciąż oceniasz, nigdy nie musi sam znajdować się na ścieżce produkcyjnej, podczas gdy decydujesz.
Czego nie można dziś zrobić na żadnym routerze — w tym na naszym — to wywołać MiMo-V2.6-Flash lub MiMo-V2.6-Pro. Nie kierujemy żadnego modelu Xiaomi, a wiersz o dostępności w karcie samego Xiaomi wskazuje na własne kanały Xiaomi: platformę MiMo API, AI Studio, MiMo Code i aplikację desktopową.
Który punkt kontrolny i kiedy
Wybierz MiMo-V2.6-Flash, jeśli chcesz generację MiMo-V2.6, a sprzęt jest ograniczeniem wiążącym. Tracisz około czterech punktów DeepSWE i punkt lub dwa w większości benchmarków agentowych względem flagowca. Zyskujesz checkpoint, który zajmuje około jednej trzeciej pamięci, wyprzedza Pro w CyberGym w tabeli samego Xiaomi i ma tę samą licencję, to samo deklarowane okno kontekstu 1M tokenów oraz tę samą multimodalność. Dla zespołu wykonującego prace ewaluacyjne w zakresie cyberbezpieczeństwa ta kolumna CyberGym nie jest błędem zaokrąglenia.
Wybierz MiMo-V2.6-Pro, jeśli obciążenie to kodowanie lub praca agentowa o długim horyzoncie, a węzeł jest już opłacony. Jest lepszym modelem w niemal każdej kolumnie, to ten, który został faktycznie zmierzony przez Artificial Analysis — Intelligence Index wynoszący 46 w zrekalibrowanej skali v4.3, pierwszy spośród 114 modeli w swojej klasie otwartych wag, 134,3 tokena wyjściowego na sekundę i wyceniony na 0,435 USD za milion tokenów wejściowych oraz 0,87 USD za milion tokenów wyjściowych — a niezależny pomiar jest wart więcej niż tabela dostawcy, gdy planujesz produkcję.
Nie wybieraj żadnego z nich, dopóki nie przeczytasz plików konfiguracyjnych, a nie streszczeń. Karta Flash opisuje pięciowarstwowy spekulacyjny model szkicujący, który przewiduje siedem tokenów na przebieg; plik config.json w tym samym repozytorium ustawia num_nextn_predict_layers na 3. Streszczenie karty to nie to, co odczytuje środowisko uruchomieniowe. A blok Safetensors na stronie repozytorium podaje 159B parametrów dla Flash i 524B dla Pro, z których żadna nie zgadza się z całkowitą liczbą ani z liczbą aktywnych parametrów w żadnej z kart modeli. Xiaomi nie wyjaśniło rozbieżności. Zamiast tego określ rozmiar na podstawie opublikowanych danych wagowych, ponieważ to jest liczba, za którą płacisz w VRAM, niezależnie od tego, jak liczone są parametry.

Co by to rozstrzygnęło
Trzy rzeczy, w przybliżonej kolejności użyteczności. Zewnętrzny test na tych samych stanowiskach — DeepSWE lub Terminal Bench, zgłoszony, a nie podany przez samo zainteresowane — powiedziałby ci, czy czteropunktowa różnica między Flash a Pro to realna pozycja, czy korzystna konfiguracja. Opublikowany cennik zamieniłby całe porównanie z projektu sprzętowego w pozycję kosztową, którą można postawić obok hostowanej granicy. A środowiska RL, które Xiaomi zapowiedziało jako open source, to artefakt, którego większość zespołów naprawdę by chciała, bo właśnie ich potrzebowałbyś, aby odtworzyć tę pętlę na własnych śladach.
Na razie praktyczny wniosek jest wąski. MiMo-V2.6 to dwa checkpointy, nie jeden, a sama nazwa zwykle oznacza ten droższy. Jeśli wybierasz dziś w obrębie tej serii, uczciwym domyślnym wyborem jest Flash — chyba że kolumna benchmarku, na której szczególnie ci zależy, mówi inaczej. A jeśli nie jesteś gotowy na zakup węzła, to na razie żadna z tych opcji nie jest właściwą odpowiedzią.

