
Xiaomi MiMo-V3-Flash: ¿Está el modelo rápido sin lanzar ejecutándose dentro del Omen Alpha de OpenCode?
- googleNUEVOGoogle: Gemini 3.8 Flash2026-09-0259Inteligencia76Código
- qwenNUEVOQwen: Qwen3.8 Max (0902)2026-09-0258Inteligencia72Código
- anthropicNUEVOAnthropic: Claude Fable 5.12026-09-0166Inteligencia82Código
- AlibabaNUEVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiNUEVOZ.ai: GLM 5.3 Flash2026-08-2658Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1860Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1552Inteligencia68Código
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1261Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencia49Código
Xiaomi MiMo-V3-Flash no ha sido anunciado por Xiaomi. No hay ficha del modelo, ni pesos en Hugging Face, ni página de precios, ni publicación de lanzamiento: el nombre está circulando por una única razón: el 4 de septiembre de 2026, teortaxesTex, un destacado analista independiente de IA, declaró públicamente que cree que Omen Alpha, el anónimo «modelo furtivo» que OpenCode comenzó a ofrecer a sus suscriptores de Go esa misma mañana, es Xiaomi MiMo-V3-Flash. Su identificación se basa principalmente en lo que interpreta como la cadena de pensamiento de un modelo de la era GA de DeepSeek V4 dentro de la traza de razonamiento visible de Omen Alpha; si esa lectura se sostiene, Xiaomi MiMo-V3-Flash sería un nivel rápido construido por Xiaomi y entrenado sobre los pesos abiertos de DeepSeek V4. Nada de esa identificación está confirmado, y este artículo lo trata como exactamente lo que es: una hipótesis bien argumentada en un juego de adivinanzas en curso.
Las reglas básicas para lo que sigue: el lanzamiento de Omen Alpha es un hecho confirmado, y la afirmación del analista es una afirmación etiquetada. La existencia de la generación V3 se sustenta en una vista previa de conferencia y un benchmark filtrado, ambos claramente marcados como no confirmados por Xiaomi. La afirmación de que existe un modelo llamado Xiaomi MiMo-V3-Flash es una inferencia a partir del comportamiento, no una declaración de Xiaomi — y, dado que Xiaomi no ha hecho ninguna, ninguna se repite aquí como un hecho.
La afirmación, y las cuatro razones que la respaldan
El detonante fue un informe de un desarrollador. Un programador que probaba Omen Alpha en OpenCode, publicando como @SPAC89, escribió que "Omen Alpha High" — el modelo en su configuración de razonamiento alto — había completado una tarea de codificación sustancial en menos de diez minutos, y que una ejecución mucho más larga, de varias horas, estaba en curso. Citando ese informe, teortaxesTex dijo que cree que el modelo es Xiaomi MiMo-V3-Flash y dio cuatro razones, todas conductuales en lugar de documentales:
• El rastro de razonamiento. La cadena de pensamiento visible se lee como DeepSeek V4 GA CoT — sus muletillas son "hmm", "fine" y elementos de lista con prefijo ✓. La captura de pantalla que adjuntó muestra a Omen Alpha a medio construir en la configuración "high" con un rastro que coincide con el patrón.
• La velocidad. El modelo es rápido — esa es la observación a la que respondía — y la gama rápida de Xiaomi ha llevado históricamente el nombre de "Flash".
• El operador. DeepSeek no realiza promociones encubiertas, así que incluso si el razonamiento tiene su origen en DeepSeek V4 GA, quien esté detrás de Omen Alpha es un tercero que se basó en DeepSeek, no DeepSeek en sí.
• El agrupamiento. El texto de salida de los modelos Xiaomi MiMo se agrupa con el de DeepSeek — su forma abreviada de referirse a dos generaciones cuyo texto se sitúa cerca en la distribución, que es lo que cabría esperar de un modelo entrenado con DeepSeek. Menciona una alternativa que también se agrupa con DeepSeek, Step-4 de StepFun, y dice que no está seguro acerca de la generación actual de StepFun.
El mensajero merece una cláusula, porque el mismo hecho es de doble filo. teortaxesTex es un seguidor autoproclamado de DeepSeek: su perfil de X se ha llamado a sí mismo fan de DeepSeek desde 2023. Ese es el perfil de alguien que puede reconocer un estilo de razonamiento de DeepSeek V4 a primera vista, y también el perfil de alguien inclinado a ver uno.
Dónde se ubicaría un MiMo-V3-Flash en la gama de Xiaomi
Los modelos MiMo confirmados oficialmente por Xiaomi hoy son MiMo-V2.5 y MiMo-V2.5-Pro, ambos de código abierto bajo licencia MIT a finales de abril de 2026. MiMo-V2.5-Pro es un modelo de mezcla de expertos de 1,02 billones de parámetros con 42 mil millones de parámetros activos y una ventana de contexto de 1 millón de tokens; MiMo-V2.5 es el hermano menor de propósito general, con 310 mil millones de parámetros. Detrás de ellos en el árbol genealógico se encuentran MiMo-V2-Flash (diciembre de 2025, un MoE abierto de 309 mil millones de parámetros) y MiMo-V2-Pro (marzo de 2026), y MiMo-V2-Pro es relevante para esta historia porque llegó por primera vez al público bajo un nombre en clave anónimo, {{1}}Hunter Alpha{{/1}}, antes de que Xiaomi lo reclamara. Las pruebas de campo anónimas no son una excepción para Xiaomi; {{2}}son parte de cómo Xiaomi lanza sus productos{{/2}}.
La generación V3 es donde el registro pasa de producto ya enviado a informe. En el ICML de julio de 2026, Luo Fuli, la investigadora que lidera el equipo MiMo, presentó un adelanto de la arquitectura de V3. Lo más destacado es un diseño que Xiaomi llama High Sparse: un pequeño número de capas de atención completa actúa como un «oráculo» que selecciona los tokens a los que deben atender las capas dispersas circundantes, y esas capas dispersas comparten la caché KV de las capas de atención completa en lugar de mantener la suya propia. Xiaomi afirma que esto reduce la memoria de la caché KV por un factor de aproximadamente diez y validó una proporción de 11:1 entre capas dispersas y completas en un modelo de 80 mil millones de parámetros, igualando la calidad de la atención completa allí donde una línea base híbrida de ventana deslizante perdió unos siete puntos de MMLU con la misma dispersión. Son afirmaciones del propio equipo en una ponencia de conferencia, no resultados independientes. Luego, el 21 de agosto, comenzó a circular una supuesta captura de pantalla de resultados de un MiMo-V3-Pro, compartida por Max For AI: 72,8 en SWE-Bench Pro, frente a los 67,9 de GLM 5.3, los 65,8 de Kimi K3, los 74,6 de Claude Opus 5 y los 75,4 de GPT-5.6 Sol Max, además de 70,6 en Terminal-Bench 2.0 y 76,4 en τ3-bench. Xiaomi no ha confirmado nada, y la existencia de V3 y su fecha de lanzamiento siguen sin anunciarse. La conclusión de este artículo es más acotada: la generación V3 está demostrablemente en marcha, pero ningún modelo V3 se ha enviado, que es exactamente por lo que la aparición sigilosa de un Xiaomi MiMo-V3-Flash no anunciado sería noticia y no algo rutinario.
Por qué un Flash — y por qué OpenCode Go — encajarían
El nivel Flash es cómo Xiaomi siembra capacidad rápida y barata; hizo lo mismo con MiMo-V2-Flash en diciembre. Y OpenCode Go es un campo de pruebas plausible porque ya ejecuta el modelo abierto actual de Xiaomi: la misma línea Go que lista a Omen Alpha con 11 600 solicitudes por cada cinco horas también lista a MiMo-V2.5 con 30 100, entre las asignaciones más generosas de la página. Un equipo de Xiaomi probando en campo un V3-Flash junto a su propio MiMo-V2.5 en una misma plataforma obtendría una comparación directa contra la generación anterior a costo cero de marketing, en una plataforma que ya ha realizado una revelación anónima este mes. Eso es un argumento a favor de la plausibilidad, no una prueba de identidad.

La forma del producto apunta en la misma dirección. Omen Alpha, con su configuración de razonamiento "alta", terminando en menos de diez minutos, coincide con el comportamiento que cabría esperar de un nivel de razonamiento rápido, y las cifras de terceros que circulan sobre Omen Alpha —aproximadamente 0,20 $ por millón de tokens de entrada y 0,66 $ por millón de salida, según lo reproducido por la prensa y no una tarifa oficial— lo sitúan en el extremo económico del mercado, junto a DeepSeek V4 Flash. Un modelo que se comporta como un razonador rápido y barato de la generación DeepSeek es lo que parecería un nivel "Flash" construido sobre DeepSeek V4. Reportado e inferido, de nuevo, no confirmado.
La conexión con DeepSeek es el quid — y la evidencia más débil.
Por qué importa DeepSeek V4 GA: la línea V4 de DeepSeek pasó de vista previa a disponibilidad general en agosto de 2026, cuando DeepSeek V4 Pro publicó su compilación GA 0813 el 13 de agosto con pesos abiertos bajo licencia MIT, junto con el hermano más económico DeepSeek V4 Flash. Los pesos abiertos bajo MIT significan que un tercero puede construir legalmente sobre ellos, y la forma habitual que tiene la comunidad de detectar un modelo así es el estilo de razonamiento que hereda: el chain-of-thought de la era GA de DeepSeek tiene hábitos verbales reconocibles, y esos hábitos son precisamente lo que teortaxesTex dice ver en el rastro de Omen Alpha. Si tiene razón en que el rastro es DeepSeek V4 GA, y también en que el operador es Xiaomi, entonces Xiaomi MiMo-V3-Flash sería el nivel rápido de Xiaomi construido sobre los pesos de razonamiento abiertos de DeepSeek: una elección legal pero estratégicamente notable, y una que explicaría de forma natural por qué un modelo aparentemente de Xiaomi razona como un DeepSeek.
Ahora viene la parte difícil. Una similitud en el razonamiento de cadena de pensamiento es la clase más débil de huella de modelo, porque es estilo, no estructura. La identificación de modelo anónimo que realmente se sostuvo este mes — Ox Alpha como GLM-5.3-Flash — se resolvió con evidencia mucho más sólida: coincidencia de tokenizador y análisis forense de codificación de video. No se ha publicado ninguna huella dura comparable que señale a Omen Alpha como producto de Xiaomi. La lectura predominante de la comunidad, además, apunta en otra dirección: los desarrolladores informan que las solicitudes de backend de Omen Alpha se resuelven bajo un espacio de nombres "zhipu", algunos evaluadores describen el modelo como autoidentificándose como basado en GLM, y la lectura de prensa del lanzamiento es que Omen Alpha es el segundo lanzamiento anónimo de Zhipu AI en nueve días, después de la publicación de Ox Alpha que se interpretó como GLM-5.3-Flash. Si esa lectura es correcta, el razonamiento con sabor a DeepSeek es o una coincidencia estilística o un indicio de que el propio modelo de Zhipu fue entrenado con trazas de DeepSeek — pero no es un producto de Xiaomi. Los dos bandos no pueden tener razón a la vez, y ninguno de los dos cuenta con una declaración del laboratorio que señala.

¿Qué lo resolvería?
• Una declaración de Xiaomi — o los pesos. Xiaomi ha publicado como código abierto sus modelos MiMo desde MiMo-V2-Flash, con MiMo-V2.5 y MiMo-V2.5-Pro publicados bajo MIT; un Xiaomi MiMo-V3-Flash real se confirmaría muy probablemente del mismo modo que GLM-5.3-Flash: con pesos y una ficha del modelo en Hugging Face.
• Una huella contundente. La coincidencia del tokenizador fue la evidencia que identificó a Ox Alpha; no se ha publicado una prueba de tokenizador que apunte a Omen Alpha como Xiaomi.
• El propio relato del modelo. Algunos evaluadores informan que Omen Alpha se describe a sí mismo como basado en GLM. El autorreporte de un modelo es un dato, pero no es procedencia.
• Pruebas de referencia independientes de Omen Alpha. Las evaluaciones neutrales del modelo anónimo permitirían a la comunidad compararlo con las cifras de MiMo-V3-Pro que se filtraron en agosto.
• La revelación posterior a la ventana de Go. Los modelos anónimos anteriores fueron reclamados días o semanas después del lanzamiento; quien reclame Omen Alpha nombrará el modelo exactamente.
Qué hacer mientras continúa la especulación
La posición práctica no depende de quién tenga razón. Omen Alpha es un modelo anónimo detrás de una suscripción de 10 dólares al mes, y Xiaomi MiMo-V3-Flash es un nombre no confirmado asociado a él; ninguno de ellos es hoy un modelo en el que apostar un pipeline de producción. Cuando un creador da un paso al frente y el modelo subyacente llega a las APIs estándar, es entonces cuando una capa de enrutamiento justifica su existencia: OrcaRouter transmite los precios de lista de los proveedores con un margen del 0%, de modo que una tarifa recién publicada está activa en la misma API el día en que el proveedor la publica, y la conmutación automática por error te permite enviar una porción del tráfico real a un recién llegado no probado, con un respaldo a un modelo en el que ya confías. Mientras tanto, lo que hay que observar es simple: ¿alguien se atribuye Omen Alpha, y Xiaomi MiMo-V3-Flash aparece alguna vez en una ficha de modelo? Una de esas dos cosas sucederá.

Al 4 de septiembre de 2026, Xiaomi MiMo-V3-Flash es un nombre, una forma de producto plausible y la hipótesis de un analista destacado, no un modelo publicado. La generación V3 es lo bastante real como para previsualizarse en julio y filtrarse en agosto. Si su primera aparición pública está ocurriendo ahora mismo bajo el nombre en clave Omen Alpha es una pregunta que solo Xiaomi puede responder, y no la ha respondido.
Comparados en este artículo2
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
