La card hero del titolo per l'articolo 'Xiaomi MiMo-V3-Flash' presenta l'occhiello 'OrcaRouter · radar dei modelli — leak', il titolo 'Xiaomi MiMo-V3-Flash' e il sottotitolo 'Un analista afferma che l'anonimo Omen Alpha di OpenCode è il modello veloce non ancora rilasciato da Xiaomi. Nessuno in Xiaomi lo ha confermato.'; a sinistra, una card intestata 'L'affermazione' riporta 'teortaxesTex, 4 set 2026 — ha condiviso in un quote-post un test in prima persona sulla velocità di Omen Alpha' e la riga 'Omen Alpha è Xiaomi MiMo-V3-Flash.'; a destra, una card intestata 'Lo stato' riporta 'Xiaomi non ha annunciato nulla — niente pesi, niente scheda del modello, niente pagina dei prezzi' e la riga 'Non confermato · solo inferenza'; infine, quattro chip riportano 'Produttore: non confermato', 'CoT riconducibile a DeepSeek V4 GA', 'Omen Alpha · solo OpenCode Go' e 'Ragionamento avanzato · veloce'. Il logo OrcaRouter è posizionato nell'angolo in basso a destra.
Guides & Insights

Xiaomi MiMo-V3-Flash: il modello veloce non ancora rilasciato è in esecuzione nell'Omen Alpha di OpenCode?

Autore

Gideon Frost

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Xiaomi MiMo-V3-Flash non è stato annunciato da Xiaomi. Non c'è una scheda del modello, né pesi su Hugging Face, né una pagina dei prezzi, né un post di lancio — il nome circola per un solo motivo: il 4 settembre 2026, teortaxesTex, un noto analista indipendente di IA, ha dichiarato pubblicamente di ritenere che Omen Alpha, il "modello stealth" anonimo che OpenCode ha iniziato a offrire ai suoi abbonati Go quella stessa mattina, sia Xiaomi MiMo-V3-Flash. La sua identificazione si basa soprattutto su ciò che interpreta come la catena di pensiero di un modello dell'era GA di DeepSeek V4 nella traccia di ragionamento visibile di Omen Alpha — il che, se regge, renderebbe Xiaomi MiMo-V3-Flash un livello veloce costruito da Xiaomi e addestrato sui pesi aperti di DeepSeek V4. Di questa identificazione non è confermato nulla, e questo articolo la tratta esattamente per quello che è: un'ipotesi ben argomentata in un gioco di speculazioni in corso.

Le regole di base per quanto segue: il lancio di Omen Alpha è un fatto confermato, e l'affermazione dell'analista è chiaramente etichettata come tale. L'esistenza della generazione V3 è supportata da un'anteprima della conferenza e da un benchmark trapelato, entrambi chiaramente contrassegnati come non confermati da Xiaomi. L'affermazione che esista un modello chiamato Xiaomi MiMo-V3-Flash è un'inferenza basata sul comportamento, non una dichiarazione di Xiaomi — e poiché Xiaomi non ne ha rilasciata alcuna, nessuna affermazione viene qui ripetuta come fatto.

L'affermazione, e le quattro ragioni dietro di essa.

L'innesco è stato un report di uno sviluppatore: @SPAC89, che stava testando Omen Alpha in OpenCode, ha scritto che "Omen Alpha High" — il modello con impostazione di ragionamento elevata — aveva completato un compito di codifica consistente in meno di dieci minuti, e che era in corso un'esecuzione molto più lunga, di diverse ore. Citando quel report, teortaxesTex ha detto di credere che il modello sia Xiaomi MiMo-V3-Flash e ha fornito quattro motivazioni, tutte comportamentali piuttosto che documentali:

• La traccia di ragionamento. La catena di pensiero visibile si presenta come DeepSeek V4 GA CoT — i suoi segnali rivelatori sono "hmm", "fine" e voci di checklist con prefisso ✓. Lo screenshot che ha allegato mostra Omen Alpha a metà build con l'impostazione "high" e una traccia che corrisponde allo schema.

• La velocità. Il modello è veloce — è questa l'osservazione a cui stava rispondendo — e il livello veloce di Xiaomi ha storicamente portato il nome "Flash".

L'operatore. DeepSeek non porta avanti promozioni occulte, quindi anche se il ragionamento è di origine DeepSeek V4 GA, chiunque sia dietro Omen Alpha è una terza parte che ha costruito su DeepSeek, non DeepSeek stessa.

Il clustering. L'output testuale dei modelli Xiaomi MiMo si raggruppa con quello di DeepSeek — la sua abbreviazione per indicare due generazioni i cui testi sono vicini a livello di distribuzione, il che è ciò che ci si aspetterebbe da un modello addestrato su DeepSeek. Nomina un'alternativa che si raggruppa anch'essa con DeepSeek, la Step-4 di StepFun, e dice di non essere sicuro riguardo all'attuale generazione di StepFun.

Il messaggero merita una clausola, perché lo stesso fatto è a doppio taglio. teortaxesTex è un dichiarato seguace di DeepSeek: sul suo profilo X si definisce fan di DeepSeek dal 2023. È il profilo di chi sa riconoscere a colpo d'occhio uno stile di ragionamento di DeepSeek V4, ma anche il profilo di chi è incline a vederne uno.

Dove si collocherebbe un MiMo-V3-Flash nella gamma Xiaomi

I modelli MiMo ufficialmente confermati oggi da Xiaomi sono MiMo-V2.5 e MiMo-V2.5-Pro, entrambi resi open source con licenza MIT alla fine di aprile 2026. MiMo-V2.5-Pro è un modello mixture-of-experts da 1.020 miliardi di parametri, con 42 miliardi di parametri attivi e una finestra di contesto di 1 milione di token; MiMo-V2.5 è la controparte più piccola e generalista, con 310 miliardi di parametri. Dietro di loro, nell'albero genealogico, si collocano MiMo-V2-Flash (dicembre 2025, un MoE aperto da 309 miliardi di parametri) e MiMo-V2-Pro (marzo 2026) – e MiMo-V2-Pro è importante per questa storia perché è arrivato al pubblico per la prima volta sotto un nome in codice anonimo, Hunter Alpha, prima che Xiaomi lo rivendicasse. I test sul campo anonimi non sono un'eccezione per Xiaomi; fanno parte del metodo di lancio di Xiaomi.

La generazione V3 è il punto in cui la narrazione passa dal prodotto distribuito al report. All'ICML del luglio 2026, Luo Fuli, la ricercatrice che guida il team MiMo, ha presentato in anteprima l'architettura di V3. Il punto centrale è un design che Xiaomi chiama High Sparse: un piccolo numero di layer ad attenzione completa funge da «oracolo» che seleziona i token a cui i layer sparsi circostanti devono prestare attenzione, e questi layer sparsi condividono la cache KV dei layer ad attenzione completa invece di mantenerne una propria. Xiaomi afferma che questo riduce la memoria della cache KV di circa dieci volte e ha validato un rapporto 11:1 tra layer sparsi e completi su un modello da circa 80 miliardi di parametri, eguagliando la qualità dell'attenzione completa, laddove una baseline ibrida a finestra scorrevole perdeva circa sette punti MMLU con la stessa sparsità. Si tratta delle affermazioni del team emerse da una presentazione a una conferenza, non di risultati indipendenti. Poi, il 21 agosto, ha cominciato a circolare un presunto screenshot di benchmark per un MiMo-V3-Pro, condiviso da Max For AI: SWE-Bench Pro 72.8, contro i 67.9 di GLM 5.3, i 65.8 di Kimi K3, i 74.6 di Claude Opus 5 e i 75.4 di GPT-5.6 Sol Max, più Terminal-Bench 2.0 70.6 e τ3-bench 76.4. Xiaomi non ha confermato nulla: l'esistenza di V3 e i tempi di rilascio restano non annunciati. La conclusione di questo articolo è più ristretta: la generazione V3 è chiaramente in movimento, ma nessun modello V3 è stato distribuito — ed è esattamente il motivo per cui un Xiaomi MiMo-V3-Flash non annunciato che emerge in sordina sarebbe una notizia, non un evento di routine.

Perché un Flash — e perché OpenCode Go — sarebbero adatti

Il tier Flash è il modo in cui Xiaomi semina capacità veloce ed economica; ha fatto lo stesso con MiMo-V2-Flash a dicembre. E OpenCode Go è un terreno di prova plausibile, perché esegue già il modello open attuale di Xiaomi: la stessa gamma Go che elenca Omen Alpha a 11.600 richieste ogni cinque ore elenca anche MiMo-V2.5 a 30.100, tra le quote più generose della pagina. Un team Xiaomi che testasse sul campo un V3-Flash accanto al proprio MiMo-V2.5 su un'unica piattaforma otterrebbe un confronto diretto con la generazione precedente a costo di marketing zero, su una piattaforma che questo mese ha già ospitato una rivelazione anonima. Questo è un argomento a favore della plausibilità, non una prova di identità.

A screenshot of the official OpenCode Go page, showing a 'New' promo banner reading 'GLM-5.3-Flash gets 2x usage limits for a limited time', the heading 'Low cost coding models for everyone', a 'Subscribe to Go $10/month' button, and the model lineup of per-model request allowances per five hours, including 'Omen Alpha — 11,600' and 'MiMo-V2.5 — 30,100' together with GLM-5.3-Flash (1,580, under the 2x banner), DeepSeek V4 Flash, LongCat-2.0, Kimi K3 and Muse Spark 1.3 Contributor (45,300).

Il profilo del prodotto indica la stessa direzione. Il fatto che Omen Alpha, con l'impostazione di ragionamento "high", completi in meno di dieci minuti corrisponde al comportamento che ci si aspetterebbe da un livello di ragionamento veloce; e le cifre di terze parti in circolazione su Omen Alpha — circa $0,20 per milione di token in ingresso e $0,66 per milione in uscita, secondo quanto riportato dalla stampa piuttosto che da un listino ufficiale — la collocano all'estremità economica del mercato, accanto a DeepSeek V4 Flash. Ecco come apparirebbe un livello "Flash" costruito su DeepSeek V4: un modello che si comporta come un reasoner veloce ed economico della generazione DeepSeek. Riportato e dedotto, ancora una volta, non confermato.

Il collegamento con DeepSeek è il punto cruciale — e la prova più debole.

Perché DeepSeek V4 GA è importante: la linea V4 di DeepSeek è passata dall'anteprima alla disponibilità generale nell'agosto 2026, quando DeepSeek V4 Pro ha pubblicato la sua build GA 0813 il 13 agosto con pesi open source con licenza MIT, insieme al fratello più economico DeepSeek V4 Flash. I pesi open source con licenza MIT significano che una terza parte può legalmente costruire su di essi, e il modo abituale con cui la community individua un modello del genere è lo stile di ragionamento che eredita: la catena di pensiero dell'era GA di DeepSeek ha abitudini verbali riconoscibili, e sono proprio quelle abitudini che teortaxesTex dice di vedere nella traccia di Omen Alpha. Se ha ragione sul fatto che la traccia sia DeepSeek V4 GA, e ha ragione sul fatto che l'operatore sia Xiaomi, allora Xiaomi MiMo-V3-Flash sarebbe il livello veloce di Xiaomi costruito sui pesi di ragionamento open source di DeepSeek — una scelta legale ma strategicamente notevole, e una che spiegherebbe perfettamente perché un modello apparentemente Xiaomi ragiona come un DeepSeek.

Ora la parte difficile. Una somiglianza nella catena di pensiero è la classe più debole di impronta digitale di un modello, perché è stile piuttosto che struttura. L'identificazione del modello anonimo che ha effettivamente retto questo mese — Ox Alpha come GLM-5.3-Flash — è stata decisa sulla base di prove molto più solide: corrispondenza del tokenizer e analisi forense della codifica video. Nessuna impronta digitale altrettanto solida è stata pubblicata che colleghi Omen Alpha a Xiaomi. La lettura prevalente della comunità, inoltre, punta altrove: gli sviluppatori riferiscono che le richieste al backend di Omen Alpha si risolvono sotto un namespace "zhipu", alcuni tester riferiscono che il modello si auto-identifica come basato su GLM, e la stampa legge il lancio come il secondo rilascio anonimo di Zhipu AI in nove giorni, dopo la run di Ox Alpha letta come GLM-5.3-Flash. Se questa lettura è corretta, il ragionamento dal sapore DeepSeek è o una coincidenza stilistica o un segno che il modello di Zhipu è stato a sua volta addestrato con tracce di DeepSeek — ma non è un prodotto Xiaomi. I due schieramenti non possono avere entrambi ragione, e nessuno dei due ha una dichiarazione dal laboratorio che nomina.

A two-column infographic titled 'Is Omen Alpha Xiaomi MiMo-V3-Flash?' with the subtitle 'The evidence, as of September 4, 2026'. The left column, headed 'FOR — the analyst's case', reads 'CoT reads as DeepSeek V4 GA — "hmm", "fine", ✓ lists', 'Fast — a big coding task finished in under 10 minutes', 'DeepSeek itself doesn't run stealth promotions', 'MiMo output text clusters with DeepSeek', and 'Xiaomi already ran Hunter Alpha as MiMo-V2-Pro'. The right column, headed 'AGAINST — the community's leading read', reads 'CoT style is the weakest fingerprint class', 'No tokenizer or infra evidence points at Xiaomi', 'Backend "zhipu" namespace observed by developers', 'Model reportedly self-identifies as GLM-based', and 'Press reads Omen Alpha as Zhipu's 2nd anonymous model'. A footer reads 'No Xiaomi statement exists — both columns are inference, not fact.' The OrcaRouter logo is composited in the bottom-right corner.

Cosa lo risolverebbe

• Una dichiarazione Xiaomi — o i pesi. Xiaomi ha reso open source i propri modelli MiMo sin da MiMo-V2-Flash, con MiMo-V2.5 e MiMo-V2.5-Pro rilasciati sotto licenza MIT; un vero Xiaomi MiMo-V3-Flash verrebbe molto probabilmente confermato nello stesso modo di GLM-5.3-Flash, cioè con i pesi e una model card su Hugging Face.

• Un'impronta digitale forte. La corrispondenza del tokenizer è stata la prova che ha identificato Ox Alpha; non è stato pubblicato un test del tokenizer che attribuisca Omen Alpha a Xiaomi.

• Il resoconto del modello stesso. Alcuni tester riferiscono che Omen Alpha si descrive come basato su GLM. Il resoconto di un modello è un dato, ma non è la provenienza.

• Benchmark indipendenti di Omen Alpha. Valutazioni neutrali del modello anonimo permetterebbero alla community di confrontarlo con i numeri di MiMo-V3-Pro trapelati ad agosto.

• La rivelazione dopo la finestra Go. In passato, i modelli anonimi sono stati rivendicati giorni o settimane dopo il lancio; chiunque rivendichi Omen Alpha darà un nome esatto al modello.

Cosa fare mentre continuano le congetture

La posizione pratica non dipende da chi ha ragione. Omen Alpha è un modello anonimo dietro un abbonamento da 10 dollari al mese, e Xiaomi MiMo-V3-Flash è un nome non confermato associato a esso; nessuno dei due è qualcosa su cui scommettere oggi una pipeline di produzione. Quando un creatore si fa avanti e il modello sottostante arriva alle API standard, è in quel momento che un layer di routing dimostra il proprio valore: OrcaRouter inoltra i prezzi di listino dei provider con un ricarico dello 0%, quindi una tariffa appena pubblicata è disponibile sulla stessa API il giorno stesso in cui il fornitore la pubblica, e il failover automatico ti consente di mandare una parte del traffico reale verso un nuovo arrivato non ancora collaudato, con un fallback su un modello di cui ti fidi già. Nel frattempo, la cosa da tenere d'occhio è semplice: qualcuno rivendicherà Omen Alpha? E Xiaomi MiMo-V3-Flash comparirà mai su una scheda del modello? Una di queste due cose accadrà.

A checklist infographic titled 'What would confirm the story' with four numbered rows reading '1. Xiaomi claims Omen Alpha — or ships MiMo-V3-Flash weights', '2. A tokenizer or infra fingerprint points at Xiaomi', '3. Neutral benchmarks of Omen Alpha appear', and '4. The reveal after the Go window names the maker'. A footer reads 'None has fired as of September 4, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

Al 4 settembre 2026, Xiaomi MiMo-V3-Flash è un nome, una plausibile forma di prodotto e l'ipotesi di un importante analista — non un modello rilasciato. La generazione V3 è abbastanza reale da aver avuto un'anteprima a luglio e un leak ad agosto. Se la sua prima apparizione pubblica stia avvenendo proprio ora sotto il nome in codice Omen Alpha è una domanda a cui solo Xiaomi può rispondere, e non ha risposto.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno

© 2026 OrcaRouter

Per i provider

Gestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.

providers@orcarouter.ai

Unisciti alla community

Discordsupport@orcarouter.aiXGitHubYouTube