Cartão de título em destaque para o artigo 'Xiaomi MiMo-V3-Flash', encabeçado pelo chapéu 'OrcaRouter · radar de modelos — vazamento', com o título 'Xiaomi MiMo-V3-Flash', o subtítulo 'Um analista afirma que o Omen Alpha anônimo da OpenCode é o modelo rápido ainda não lançado da Xiaomi. Ninguém na Xiaomi confirmou isso.', um cartão à esquerda intitulado 'A alegação' com o texto 'teortaxesTex, 4 de setembro de 2026 — publicando citação de um teste de velocidade em primeira mão do Omen Alpha' e a frase 'Omen Alpha é o Xiaomi MiMo-V3-Flash.', um cartão à direita intitulado 'O status' com o texto 'A Xiaomi não anunciou nada — sem pesos, sem ficha do modelo, sem página de preços' e a frase 'Não confirmado · apenas inferência', e quatro chips com os textos 'Fabricante: não confirmado', 'CoT sugere DeepSeek V4 GA', 'Omen Alpha · somente OpenCode Go' e 'Alto raciocínio · rápido'. O logotipo do OrcaRouter é posicionado no canto inferior direito.
Guides & Insights

Xiaomi MiMo-V3-Flash: O modelo rápido não lançado está rodando dentro do Omen Alpha da OpenCode?

Autor

Gideon Frost

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

A Xiaomi ainda não anunciou o Xiaomi MiMo-V3-Flash. Não há model card, não há pesos no Hugging Face, não há página de preços e não há post de lançamento — o nome circula por um único motivo: em 4 de setembro de 2026, teortaxesTex, um analista independente de IA de destaque, afirmou publicamente que acredita que o Omen Alpha, o "modelo stealth" anônimo que a OpenCode começou a oferecer aos seus assinantes Go na mesma manhã, é o Xiaomi MiMo-V3-Flash. A identificação dele se baseia principalmente no que ele interpreta como a cadeia de raciocínio de um modelo da era DeepSeek V4 GA dentro do trace de raciocínio visível do Omen Alpha — o que, se confirmado, tornaria o Xiaomi MiMo-V3-Flash um tier rápido construído pela Xiaomi e treinado sobre os pesos abertos do DeepSeek V4. Nada sobre essa identificação é confirmado, e este texto a trata exatamente como o que é: uma hipótese bem argumentada em um jogo de adivinhação ativo.

As regras básicas para o que segue: o lançamento do Omen Alpha é fato confirmado, e a alegação do analista é uma alegação rotulada. A existência da geração V3 é respaldada por uma prévia de conferência e um benchmark vazado, ambos claramente marcados como não confirmados pela Xiaomi. A afirmação de que existe um modelo chamado Xiaomi MiMo-V3-Flash é, em si, uma inferência a partir do comportamento, não uma declaração da Xiaomi — e, como a Xiaomi não fez nenhuma declaração, nenhuma é repetida aqui como fato.

A alegação, e as quatro razões por trás dela

O gatilho foi um relatório de desenvolvedor. Um desenvolvedor testando o Omen Alpha no OpenCode, postando como @SPAC89, escreveu que o "Omen Alpha High" — o modelo em sua configuração de raciocínio alto — havia concluído uma tarefa substancial de codificação em menos de dez minutos, e que uma execução muito mais longa, de várias horas, estava em andamento. Ao citar esse relatório, teortaxesTex disse que acredita que o modelo seja o Xiaomi MiMo-V3-Flash e deu quatro razões, todas comportamentais, em vez de documentais:

• O rastro de raciocínio. A cadeia de pensamento visível se lê como DeepSeek V4 GA CoT — seus sinais são "hmm", "fine" e itens de checklist prefixados com ✓. A captura de tela que ele anexou mostra o Omen Alpha no meio da compilação na configuração "alta", com um rastro que corresponde ao padrão.

A velocidade. O modelo é rápido — essa é a observação à qual ele estava respondendo — e o nível rápido da Xiaomi historicamente carrega o nome "Flash".

• O operador. {{1}}A DeepSeek não realiza promoções ocultas{{/1}}, {{2}}portanto, mesmo que o raciocínio seja originário do DeepSeek V4 GA{{/2}}, {{3}}quem está por trás do Omen Alpha{{/3}} {{4}}é um terceiro{{/4}} {{5}}que construiu algo com base na DeepSeek{{/5}}, {{6}}e não a própria DeepSeek{{/6}}.

• O agrupamento. O texto de saída dos modelos Xiaomi MiMo se agrupa com o da DeepSeek — sua forma resumida de dizer que duas gerações têm textos próximos em distribuição, que é como um modelo treinado pela DeepSeek se comportaria. Ele cita uma alternativa que também se agrupa com o da DeepSeek, o Step-4 da StepFun, e diz que não tem certeza sobre a geração atual da StepFun.

O mensageiro merece uma cláusula, porque o mesmo fato corta nos dois sentidos. teortaxesTex é um seguidor autodeclarado da DeepSeek — seu perfil no X o descreve como fã da DeepSeek desde 2023. Esse é o perfil de alguém que consegue reconhecer um estilo de raciocínio do DeepSeek V4 à primeira vista, e também o perfil de alguém inclinado a ver um.

Onde um MiMo-V3-Flash se posicionaria na linha da Xiaomi

Os modelos MiMo oficialmente confirmados pela Xiaomi hoje são o MiMo-V2.5 e o MiMo-V2.5-Pro, ambos com código aberto sob licença MIT no final de abril de 2026. O MiMo-V2.5-Pro é um modelo de mistura de especialistas com 1,02 trilhão de parâmetros, 42 bilhões de parâmetros ativos e uma janela de contexto de 1 milhão de tokens; o MiMo-V2.5 é o irmão menor de propósito geral, com 310 bilhões de parâmetros. Atrás deles na árvore genealógica estão o MiMo-V2-Flash (dezembro de 2025, um MoE aberto de 309 bilhões de parâmetros) e o MiMo-V2-Pro (março de 2026) — e o MiMo-V2-Pro é relevante para esta história porque chegou ao público primeiro sob um codinome anônimo, Hunter Alpha, antes de a Xiaomi reivindicá-lo. Testes de campo anônimos não são uma exceção para a Xiaomi; eles fazem parte de como a Xiaomi lança seus produtos.

A geração V3 é onde o registro transita de produto já lançado para relatório. Na ICML, em julho de 2026, Luo Fuli, a pesquisadora que lidera a equipe do MiMo, apresentou uma prévia da arquitetura do V3. O destaque é um design que a Xiaomi chama de High Sparse: um pequeno número de camadas de atenção completa atua como um “oráculo” que seleciona os tokens aos quais as camadas esparsas ao redor devem prestar atenção, e essas camadas esparsas compartilham o cache KV das camadas de atenção completa, em vez de manter um cache próprio. A Xiaomi afirma que isso reduz a memória do cache KV para cerca de um décimo e que validou uma proporção de 11:1 entre camadas esparsas e de atenção completa em um modelo na escala de 80 bilhões de parâmetros, igualando a qualidade da atenção completa — enquanto uma baseline híbrida com janela deslizante perdeu cerca de sete pontos no MMLU no mesmo nível de esparsidade. Essas são alegações da própria equipe em uma palestra de conferência, não resultados independentes. Depois, em 21 de agosto, uma suposta captura de tela de benchmark de um MiMo-V3-Pro começou a circular, compartilhada por Max For AI: SWE-Bench Pro 72,8; contra 67,9 do GLM 5.3, 65,8 do Kimi K3, 74,6 do Claude Opus 5 e 75,4 do GPT-5.6 Sol Max; além de Terminal-Bench 2.0 com 70,6 e τ3-bench com 76,4. A Xiaomi não confirmou nada, e a existência do V3 e o cronograma de lançamento seguem sem anúncio. A conclusão deste artigo é mais restrita: a geração V3 está comprovadamente em movimento, mas nenhum modelo V3 foi lançado — exatamente por isso um Xiaomi MiMo-V3-Flash não anunciado que surgisse sem alarde seria notícia, e não rotina.

Por que um Flash — e por que o OpenCode Go — se encaixariam

O nível Flash é como a Xiaomi distribui capacidade rápida e barata; fez o mesmo com o MiMo-V2-Flash em dezembro. E o OpenCode Go é um campo de testes plausível porque já executa o modelo aberto atual da Xiaomi: a mesma linha Go que lista o Omen Alpha com 11.600 solicitações por cinco horas também lista o MiMo-V2.5 com 30.100, entre as franquias mais generosas da página. Uma equipe da Xiaomi testando em campo um V3-Flash ao lado do seu próprio MiMo-V2.5 em uma única plataforma obteria uma comparação direta com a geração anterior a custo zero de marketing, em uma plataforma que já realizou uma revelação anônima neste mês. Isso é um argumento a favor da plausibilidade, não uma evidência de identidade.

A screenshot of the official OpenCode Go page, showing a 'New' promo banner reading 'GLM-5.3-Flash gets 2x usage limits for a limited time', the heading 'Low cost coding models for everyone', a 'Subscribe to Go $10/month' button, and the model lineup of per-model request allowances per five hours, including 'Omen Alpha — 11,600' and 'MiMo-V2.5 — 30,100' together with GLM-5.3-Flash (1,580, under the 2x banner), DeepSeek V4 Flash, LongCat-2.0, Kimi K3 and Muse Spark 1.3 Contributor (45,300).

A forma do produto aponta na mesma direção. O Omen Alpha, com sua configuração de raciocínio “alta” terminando em menos de dez minutos, corresponde ao comportamento que você esperaria de um nível de raciocínio rápido, e os números de terceiros circulando para o Omen Alpha — aproximadamente US$ 0,20 por milhão de tokens de entrada e US$ 0,66 por milhão de saída, conforme reproduções da imprensa, e não uma tabela de preços oficial — colocam-no no extremo barato do mercado, ao lado do DeepSeek V4 Flash. Um modelo que se comporta como um raciocinador rápido e barato da geração DeepSeek é o que um nível “Flash” construído sobre o DeepSeek V4 pareceria. Relatado e inferido, novamente, não confirmado.

A conexão com a DeepSeek é o ponto crucial — e a evidência mais fraca.

Por que o DeepSeek V4 GA é importante: a linha V4 da DeepSeek saiu da fase de preview para disponibilidade geral em agosto de 2026, quando o DeepSeek V4 Pro lançou seu build GA 0813 em 13 de agosto, com pesos abertos sob licença MIT, juntamente com o irmão mais barato, o DeepSeek V4 Flash. Pesos abertos sob MIT significam que terceiros podem legalmente usá-los como base, e a forma habitual de a comunidade identificar um modelo assim é o estilo de raciocínio que ele herda: o chain-of-thought da era GA da DeepSeek tem hábitos verbais reconhecíveis, e esses hábitos são exatamente o que teortaxesTex diz ver no trace do Omen Alpha. Se ele estiver certo de que o trace é do DeepSeek V4 GA, e certo de que o operador é a Xiaomi, então o Xiaomi MiMo-V3-Flash seria o nível rápido da Xiaomi construído sobre os pesos abertos de raciocínio da DeepSeek — uma escolha legal, mas estrategicamente notável, e que explicaria perfeitamente por que um modelo aparentemente da Xiaomi raciocina como um DeepSeek.

Agora a parte difícil. Uma semelhança de cadeia de pensamento é a classe mais fraca de impressão digital de modelo, porque é estilo, e não estrutura. A identificação de modelo anônimo que realmente se sustentou neste mês — Ox Alpha como GLM-5.3-Flash — foi resolvida com evidências muito mais sólidas: correspondência de tokenizador e perícia de codificação de vídeo. Nenhuma impressão digital difícil comparável foi publicada apontando Omen Alpha para a Xiaomi. A leitura predominante da comunidade, além disso, aponta para outro lugar: desenvolvedores relatam que as requisições de backend do Omen Alpha são resolvidas sob um namespace "zhipu", alguns testadores descrevem o modelo como autoidentificando-se como baseado em GLM, e a leitura da imprensa sobre o lançamento é que o Omen Alpha é o segundo lançamento anônimo da Zhipu AI em nove dias, após a execução do Ox Alpha que foi interpretada como GLM-5.3-Flash. Se essa leitura estiver correta, o raciocínio com sabor DeepSeek é uma coincidência estilística ou um sinal de que o modelo da Zhipu foi ele próprio treinado com vestígios de DeepSeek — mas não é um produto da Xiaomi. Os dois campos não podem estar ambos corretos, e nenhum dos campos tem uma declaração do laboratório que nomeia.

A two-column infographic titled 'Is Omen Alpha Xiaomi MiMo-V3-Flash?' with the subtitle 'The evidence, as of September 4, 2026'. The left column, headed 'FOR — the analyst's case', reads 'CoT reads as DeepSeek V4 GA — "hmm", "fine", ✓ lists', 'Fast — a big coding task finished in under 10 minutes', 'DeepSeek itself doesn't run stealth promotions', 'MiMo output text clusters with DeepSeek', and 'Xiaomi already ran Hunter Alpha as MiMo-V2-Pro'. The right column, headed 'AGAINST — the community's leading read', reads 'CoT style is the weakest fingerprint class', 'No tokenizer or infra evidence points at Xiaomi', 'Backend "zhipu" namespace observed by developers', 'Model reportedly self-identifies as GLM-based', and 'Press reads Omen Alpha as Zhipu's 2nd anonymous model'. A footer reads 'No Xiaomi statement exists — both columns are inference, not fact.' The OrcaRouter logo is composited in the bottom-right corner.

O que resolveria isso

• Uma declaração da Xiaomi — ou pesos. A Xiaomi disponibilizou seus modelos MiMo como código aberto desde o MiMo-V2-Flash, com o MiMo-V2.5 e o MiMo-V2.5-Pro lançados sob licença MIT; um verdadeiro Xiaomi MiMo-V3-Flash seria, muito provavelmente, confirmado da mesma forma que o GLM-5.3-Flash foi, com pesos e um cartão de modelo no Hugging Face.

• Uma impressão digital forte. A correspondência por tokenizer foi a evidência que identificou o Ox Alpha; um teste de tokenizer que aponta o Omen Alpha para a Xiaomi não foi publicado.

• O próprio relato do modelo. Alguns testadores relatam que o Omen Alpha se descreve como baseado em GLM. O autorrelato de um modelo é um dado, mas não é proveniência.

• Benchmarks independentes do Omen Alpha. Avaliações neutras do modelo anônimo permitiriam à comunidade compará-lo com os números do MiMo-V3-Pro que vazaram em agosto.

A revelação após a janela de Go. Modelos anônimos anteriores foram reivindicados dias ou semanas após o lançamento; quem reivindicar o Omen Alpha dará nome exato ao modelo.

O que fazer enquanto a adivinhação continua.

A posição prática não depende de quem está certo. O Omen Alpha é um modelo anônimo por trás de uma assinatura de US$ 10 por mês, e o Xiaomi MiMo-V3-Flash é um nome não confirmado associado a ele; nenhum dos dois é algo em que se deva apostar um pipeline de produção hoje. Quando um fabricante enfim se apresenta e o modelo subjacente chega às APIs comuns, é nesse momento que uma camada de roteamento prova seu valor: a OrcaRouter repassa os preços de tabela dos provedores com 0% de markup, de modo que um preço recém-publicado entra no ar na mesma API no dia em que o fornecedor o publica, e o failover automático permite enviar uma fatia de tráfego real para um novato ainda não comprovado, com fallback para um modelo em que você já confia. Enquanto isso, o que observar é simples: alguém reivindica o Omen Alpha, e o Xiaomi MiMo-V3-Flash chega a aparecer em um model card? Uma dessas duas coisas vai acontecer.

A checklist infographic titled 'What would confirm the story' with four numbered rows reading '1. Xiaomi claims Omen Alpha — or ships MiMo-V3-Flash weights', '2. A tokenizer or infra fingerprint points at Xiaomi', '3. Neutral benchmarks of Omen Alpha appear', and '4. The reveal after the Go window names the maker'. A footer reads 'None has fired as of September 4, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

Em 4 de setembro de 2026, Xiaomi MiMo-V3-Flash é um nome, um formato de produto plausível e a hipótese de um analista proeminente — não um modelo lançado. A geração V3 é real o suficiente para ser pré-visualizada em julho e vazar em agosto. Se a sua primeira aparição pública está acontecendo agora sob o codinome Omen Alpha é uma pergunta que só a Xiaomi pode responder, e ela não a respondeu.

Comparados neste artigo2

Detectado a partir deste artigo · Benchmarks: Artificial Analysis · atualizado diariamente

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

providers@orcarouter.ai

Junte-se à comunidade

Discordsupport@orcarouter.aiXGitHubYouTube