Karta hero z tytułem artykułu „Xiaomi MiMo-V3-Flash”, zwieńczona kickerem „OrcaRouter · radar modeli — przeciek”, z tytułem „Xiaomi MiMo-V3-Flash”, podtytułem „Analityk twierdzi, że anonimowy Omen Alpha od OpenCode to niewydany szybki model Xiaomi. Nikt w Xiaomi tego nie potwierdził.”, lewą kartą z nagłówkiem „Twierdzenie” i treścią „teortaxesTex, 4 września 2026 — cytat z testu szybkości Omen Alpha z pierwszej ręki” oraz wierszem „Omen Alpha to Xiaomi MiMo-V3-Flash.”, prawą kartą z nagłówkiem „Status” i treścią „Xiaomi nic nie ogłosiło — brak wag, karty modelu i strony cenowej” oraz wierszem „Niepotwierdzone · tylko inferencja”, a także czterema chipami o treści „Producent: niepotwierdzony”, „CoT wskazuje na DeepSeek V4 GA”, „Omen Alpha · tylko OpenCode Go” i „Wysokie rozumowanie · szybki”. Logo OrcaRouter jest wkomponowane w prawym dolnym rogu.
Guides & Insights

Xiaomi MiMo-V3-Flash: Czy niewydany szybki model działa wewnątrz Omen Alpha firmy OpenCode?

Autor

Gideon Frost

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Xiaomi MiMo-V3-Flash nie został ogłoszony przez Xiaomi. Nie ma żadnej karty modelu, żadnych wag na Hugging Face, żadnej strony z cenami ani żadnego posta premierowego — nazwa ta krąży tylko z jednego powodu: 4 września 2026 roku teortaxesTex, prominentny niezależny analityk AI, publicznie stwierdził, że jego zdaniem Omen Alpha, anonimowy „model stealth", który OpenCode tego samego ranka udostępnił swoim subskrybentom Go, to Xiaomi MiMo-V3-Flash. Jego identyfikacja opiera się głównie na tym, co odczytuje jako łańcuch myślenia modelu z ery DeepSeek V4 GA wewnątrz widocznego śladu rozumowania Omen Alpha — co, jeśli się potwierdzi, oznaczałoby, że Xiaomi MiMo-V3-Flash to zbudowany przez Xiaomi szybki wariant wytrenowany na otwartych wagach DeepSeek V4. Nic w tej identyfikacji nie zostało potwierdzone, a niniejszy tekst traktuje ją dokładnie tak, jaką jest: jedną dobrze uzasadnioną hipotezą w trwającej grze w zgadywanki.

Zasady, które obowiązują w dalszej części: premiera Omen Alpha jest potwierdzonym faktem, a twierdzenie analityka jest wyraźnie oznaczone jako twierdzenie. Istnienie generacji V3 jest poparte zapowiedzią konferencyjną oraz przeciekiem benchmarku — oba te elementy są przy tym wyraźnie oznaczone jako niepotwierdzone przez Xiaomi. Twierdzenie, że w ogóle istnieje model o nazwie Xiaomi MiMo-V3-Flash, jest wnioskiem wyciągniętym z obserwacji zachowania, a nie oświadczeniem Xiaomi — a ponieważ Xiaomi nie wydało żadnego takiego oświadczenia, żadne nie jest tu powtarzane jako fakt.

Twierdzenie i cztery powody, które za nim stoją

Wyzwalaczem był raport programisty. Programista testujący Omen Alpha w OpenCode, publikujący jako @SPAC89, napisał, że „Omen Alpha High” — model na wysokim ustawieniu rozumowania — ukończył pokaźne zadanie programistyczne w mniej niż dziesięć minut, a w toku był znacznie dłuższy, wielogodzinny przebieg. Cytując ten raport, teortaxesTex powiedział, że uważa, iż model to Xiaomi MiMo-V3-Flash, i podał cztery powody, wszystkie behawioralne, a nie dokumentacyjne:

• Ślad rozumowania. Widoczny chain-of-thought wygląda na DeepSeek V4 GA CoT — jego znaki rozpoznawcze to „hmm”, „fine” oraz pozycje listy z prefiksem ✓. Dołączony zrzut ekranu pokazuje Omen Alpha w trakcie budowania na ustawieniu „high” ze śladem pasującym do tego wzorca.

Szybkość. Model jest szybki — właśnie na to spostrzeżenie odpowiadał — a szybki segment Xiaomi historycznie nosił nazwę "Flash".

• Operator. DeepSeek nie prowadzi ukrytych promocji, więc nawet jeśli tok rozumowania wywodzi się z DeepSeek V4 GA, ten, kto stoi za Omen Alpha, jest podmiotem trzecim, który zbudował coś na bazie DeepSeek, a nie samym DeepSeekiem.

• Grupowanie. Tekst generowany przez modele Xiaomi MiMo grupuje się z tekstem DeepSeeka — to jego skrót na określenie dwóch generacji, których teksty są blisko siebie w rozkładzie; tak właśnie wyglądałby model trenowany przez DeepSeeka. Wymienia jedną alternatywę, która również grupuje się z DeepSeekiem — Step-4 od StepFun — i mówi, że nie jest pewien co do obecnej generacji StepFun.

Posłaniec jest wart osobnego zdania, ponieważ ten sam fakt można interpretować na dwie strony. teortaxesTex jest samozwańczym wyznawcą DeepSeeka — na swoim profilu na X od 2023 roku nazywa siebie fanem DeepSeeka. To profil kogoś, kto potrafi rozpoznać styl rozumowania DeepSeek V4 na pierwszy rzut oka, a także kogoś, kto jest skłonny go dostrzec.

Gdzie MiMo-V3-Flash plasowałby się w ofercie Xiaomi

Oficjalnie potwierdzone dziś przez Xiaomi modele MiMo to MiMo-V2.5 oraz MiMo-V2.5-Pro, oba udostępnione pod koniec kwietnia 2026 roku jako open source na licencji MIT. MiMo-V2.5-Pro to model mieszanki ekspertów (mixture-of-experts) o 1,02 biliona parametrów, z 42 miliardami aktywnych parametrów i oknem kontekstowym wynoszącym 1 milion tokenów; MiMo-V2.5 to mniejszy, ogólnego przeznaczenia „brat” z 310 miliardami parametrów. W drzewie tej rodziny za nimi znajdują się MiMo-V2-Flash (grudzień 2025, otwarty MoE o 309 miliardach parametrów) oraz MiMo-V2-Pro (marzec 2026) — a MiMo-V2-Pro ma znaczenie dla tej historii, ponieważ po raz pierwszy trafił do publiczności pod anonimowym kryptonimem Hunter Alpha, zanim Xiaomi się do niego przyznało. Anonimowe testy polowe nie są dla Xiaomi wyjątkiem; to element tego, jak Xiaomi wprowadza produkty.

Generacja V3 to etap, na którym historia przechodzi od wydanego produktu do raportu. Na ICML w lipcu 2026 roku Luo Fuli, badaczka kierująca zespołem MiMo, zapowiedziała architekturę V3. Najważniejszym punktem jest projekt, który Xiaomi nazywa High Sparse: niewielka liczba warstw pełnej uwagi działa jak „wyrocznia”, która wybiera tokeny, na których powinny skupić się otaczające warstwy rzadkie, a te warstwy rzadkie współdzielą pamięć podręczną KV warstw pełnej uwagi zamiast utrzymywać własną. Xiaomi twierdzi, że zmniejsza to zużycie pamięci KV-cache około dziesięciokrotnie i że współczynnik 11:1 warstw rzadkich do pełnych zweryfikowano na modelu o skali 80 miliardów parametrów, osiągając jakość pełnej uwagi tam, gdzie hybrydowa linia bazowa z przesuwanym oknem traciła około siedmiu punktów MMLU przy tym samym poziomie rzadkości. To własne deklaracje zespołu z wystąpienia konferencyjnego, a nie niezależne wyniki. Następnie, 21 sierpnia, zaczął krążyć rzekomy zrzut ekranu z benchmarków dla MiMo-V3-Pro, udostępniony przez Max For AI: SWE-Bench Pro 72,8 wobec 67,9 dla GLM 5.3, 65,8 dla Kimi K3, 74,6 dla Claude Opus 5 i 75,4 dla GPT-5.6 Sol Max, a także Terminal-Bench 2.0 70,6 i τ3-bench 76,4. Xiaomi niczego nie potwierdziło, a istnienie V3 i termin premiery pozostają nieujawnione. Najważniejszy wniosek dla tego artykułu jest węższy: generacja V3 wyraźnie jest w ruchu, ale żaden model V3 nie został wydany — i właśnie dlatego ciche pojawienie się nieogłoszonego Xiaomi MiMo-V3-Flash byłoby wiadomością, a nie rutyną.

Dlaczego Flash — i dlaczego OpenCode Go — miałyby pasować.

Warstwa Flash to sposób, w jaki Xiaomi rozsiewa szybką, tanią pojemność; to samo zrobiło z MiMo-V2-Flash w grudniu. A OpenCode Go to prawdopodobny poligon doświadczalny, ponieważ już teraz uruchamia aktualny otwarty model Xiaomi: ten sam zestaw Go, który wymienia Omen Alpha na 11 600 żądań na pięć godzin, podaje też MiMo-V2.5 na 30 100, co należy do najbardziej hojnych limitów na stronie. Zespół Xiaomi testujący w terenie V3-Flash obok własnego MiMo-V2.5 na jednej platformie uzyskałby bezpośrednie porównanie z poprzednią generacją przy zerowych kosztach marketingowych, na platformie, która już przeprowadziła jedną anonimową premierę w tym miesiącu. To argument za prawdopodobieństwem, nie dowód tożsamości.

A screenshot of the official OpenCode Go page, showing a 'New' promo banner reading 'GLM-5.3-Flash gets 2x usage limits for a limited time', the heading 'Low cost coding models for everyone', a 'Subscribe to Go $10/month' button, and the model lineup of per-model request allowances per five hours, including 'Omen Alpha — 11,600' and 'MiMo-V2.5 — 30,100' together with GLM-5.3-Flash (1,580, under the 2x banner), DeepSeek V4 Flash, LongCat-2.0, Kimi K3 and Muse Spark 1.3 Contributor (45,300).

Kształt produktu wskazuje ten sam kierunek. To, że Omen Alpha przy ustawieniu rozumowania „high” kończy w mniej niż dziesięć minut, odpowiada zachowaniu, jakiego można oczekiwać od szybkiej warstwy rozumującej, a krążące dane od podmiotów trzecich dotyczące Omen Alpha — mniej więcej 0,20 USD za milion tokenów wejściowych i 0,66 USD za milion tokenów wyjściowych, według doniesień prasowych, a nie oficjalnego cennika — plasują go na tanim końcu rynku obok DeepSeek V4 Flash. Warstwa „Flash” zbudowana na DeepSeek V4 wyglądałaby właśnie jak model, który zachowuje się jak szybki, tani model rozumujący z generacji DeepSeek. Jak doniesiono i wywnioskowano, ponownie: nie potwierdzono.

Powiązanie z DeepSeek jest sednem sprawy — i najsłabszym dowodem.

Dlaczego DeepSeek V4 GA w ogóle ma znaczenie: linia V4 DeepSeeka przeszła z wersji preview do ogólnej dostępności (GA) w sierpniu 2026 r., kiedy DeepSeek V4 Pro wypuścił 13 sierpnia build 0813 swojej wersji GA — z otwartymi wagami na licencji MIT — wraz z tańszym modelem siostrzanym DeepSeek V4 Flash. Otwarte wagi na licencji MIT oznaczają, że podmiot trzeci może legalnie na nich budować, a społeczność zwykle rozpoznaje taki model po stylu rozumowania, który po nich dziedziczy: łańcuch myślowy DeepSeeka z ery GA ma rozpoznawalne nawyki językowe — i właśnie te nawyki, jak twierdzi teortaxesTex, widać w śladzie Omen Alpha. Jeśli ma rację, że ślad to DeepSeek V4 GA, i ma rację, że operatorem jest Xiaomi, to Xiaomi MiMo-V3-Flash byłby szybkim wariantem Xiaomi zbudowanym na otwartych wagach rozumowania DeepSeeka — wybór legalny, ale istotny strategicznie, który w zgrabny sposób wyjaśniałby, dlaczego rzekomy model Xiaomi rozumuje jak DeepSeek.

Teraz najtrudniejsza część. Podobieństwo łańcucha myślowego to najsłabsza klasa odcisku palca modelu, ponieważ dotyczy stylu, a nie struktury. Identyfikacja anonimowego modelu, która faktycznie się utrzymała w tym miesiącu — Ox Alpha jako GLM-5.3-Flash — została rozstrzygnięta na podstawie znacznie twardszych dowodów: dopasowania tokenizera i analizy kodowania wideo. Nie opublikowano żadnego porównywalnego twardego odcisku palca wskazującego, że Omen Alpha pochodzi od Xiaomi. Co więcej, wiodąca interpretacja społeczności wskazuje gdzie indziej: deweloperzy donoszą, że żądania backendu Omen Alpha rozwiązują się w przestrzeni nazw „zhipu", niektórzy testerzy opisują model jako samookreślający się jako oparty na GLM, a prasa odczytuje premierę jako drugą anonimową publikację Zhipu AI w ciągu dziewięciu dni, po uruchomieniu Ox Alpha, które interpretowano jako GLM-5.3-Flash. Jeśli ten odczyt jest poprawny, rozumowanie w stylu DeepSeek jest albo stylistycznym zbiegiem okoliczności, albo oznaką, że sam model Zhipu był trenowany z użyciem śladów DeepSeek — ale nie jest to produkt Xiaomi. Obie strony nie mogą mieć jednocześnie racji i żadna z nich nie dysponuje oświadczeniem laboratorium, które wskazuje.

A two-column infographic titled 'Is Omen Alpha Xiaomi MiMo-V3-Flash?' with the subtitle 'The evidence, as of September 4, 2026'. The left column, headed 'FOR — the analyst's case', reads 'CoT reads as DeepSeek V4 GA — "hmm", "fine", ✓ lists', 'Fast — a big coding task finished in under 10 minutes', 'DeepSeek itself doesn't run stealth promotions', 'MiMo output text clusters with DeepSeek', and 'Xiaomi already ran Hunter Alpha as MiMo-V2-Pro'. The right column, headed 'AGAINST — the community's leading read', reads 'CoT style is the weakest fingerprint class', 'No tokenizer or infra evidence points at Xiaomi', 'Backend "zhipu" namespace observed by developers', 'Model reportedly self-identifies as GLM-based', and 'Press reads Omen Alpha as Zhipu's 2nd anonymous model'. A footer reads 'No Xiaomi statement exists — both columns are inference, not fact.' The OrcaRouter logo is composited in the bottom-right corner.

Co by to rozstrzygnęło

• Oświadczenie Xiaomi — albo wagi. Xiaomi udostępnia swoje modele MiMo jako open source od MiMo-V2-Flash, a MiMo-V2.5 i MiMo-V2.5-Pro wydano na licencji MIT; prawdziwy Xiaomi MiMo-V3-Flash najprawdopodobniej zostałby potwierdzony tak samo jak GLM-5.3-Flash, czyli przez udostępnienie wag i karty modelu na Hugging Face.

• Twardy odcisk palca. Dopasowanie tokenizatorów było dowodem, który zidentyfikował Ox Alpha; test tokenizatora wskazujący na to, że Omen Alpha to Xiaomi, nie został opublikowany.

• Własna relacja modelu. Niektórzy testerzy podają, że Omen Alpha opisuje się jako model oparty na GLM. Samoopis modelu jest danymi, ale nie jest proweniencją.

• Niezależne benchmarki modelu Omen Alpha. Neutralne ewaluacje anonimowego modelu pozwoliłyby społeczności porównać go z wynikami MiMo-V3-Pro, które wyciekły w sierpniu.

• Ujawnienie po oknie Go. Wcześniejsze anonimowe modele były przypisywane dni lub tygodnie po starcie; ktokolwiek zgłosi Omen Alpha, poda dokładną nazwę modelu.

Co robić, póki trwa zgadywanie

Praktyczny wniosek nie zależy od tego, kto ma rację. Omen Alpha to anonimowy model dostępny w subskrypcji za 10 dolarów miesięcznie, a Xiaomi MiMo-V3-Flash to niepotwierdzona nazwa, którą mu przypisano; nie warto dziś budować produkcyjnego potoku na żadnym z nich. Gdy twórca w końcu ujawni się, a model trafi do zwykłych interfejsów API, właśnie wtedy warstwa routingu pokazuje, na co ją stać: OrcaRouter przekazuje cennikowe stawki dostawców z zerową marżą, więc nowo opublikowana stawka jest aktywna na tym samym API już w dniu publikacji, a automatyczne przełączanie awaryjne pozwala skierować część realnego ruchu na nieprzetestowanego debiutanta i wrócić do modelu, któremu już ufasz. Tymczasem to, na co trzeba patrzeć, jest proste — czy ktoś przyzna się do Omen Alpha i czy Xiaomi MiMo-V3-Flash kiedykolwiek pojawi się na karcie modelu? Jedno z tych dwojga się wydarzy.

A checklist infographic titled 'What would confirm the story' with four numbered rows reading '1. Xiaomi claims Omen Alpha — or ships MiMo-V3-Flash weights', '2. A tokenizer or infra fingerprint points at Xiaomi', '3. Neutral benchmarks of Omen Alpha appear', and '4. The reveal after the Go window names the maker'. A footer reads 'None has fired as of September 4, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

Na dzień 4 września 2026 roku Xiaomi MiMo-V3-Flash to nazwa, prawdopodobny kształt produktu i hipoteza prominentnego analityka — a nie wydany model. Generacja V3 jest na tyle realna, że doczekała się zapowiedzi w lipcu i przecieku w sierpniu. To, czy jej pierwsze publiczne pojawienie się ma miejsce właśnie teraz pod kryptonimem Omen Alpha, jest pytaniem, na które odpowiedź zna tylko Xiaomi — a Xiaomi nie odpowiedziało.

Porównane w tym artykule2

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

providers@orcarouter.ai

Dołącz do społeczności

Discordsupport@orcarouter.aiXGitHubYouTube