Tarjeta principal con el título «MiMo-V2.6-Pro vs MiMo-V2.6» y el subtítulo «Uno es un checkpoint. El otro es una etiqueta.», y dos paneles: un panel izquierdo con el título «MiMo-V2.6-Pro» que dice «Pesos, precio, índice 46.3» y «Coste por tarea $0.13», y un panel derecho con el título «MiMo-V2.6» que dice «El nombre de la serie» y «Abarca Pro y Flash», sobre un pie de página que dice «Diferencia de precio entre los dos checkpoints que abarca: 3.1x».
Guides & Insights

MiMo-V2.6-Pro vs MiMo-V2.6: Cuando un nombre de modelo deja de ser un modelo

Autor

Magnus Corvin

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Artificial Analysis tiene una página para MiMo-V2.5. No tiene ninguna página para MiMo-V2.6. Esa ausencia es toda la historia de este enfrentamiento: en la generación anterior, el número de versión escueto apuntaba a un checkpoint que podías descargar e invocar. En esta generación, no. Xiaomi MiMo-V2.6-Pro es un modelo con pesos, un precio y una puntuación medida de forma independiente. "MiMo-V2.6" es una etiqueta que se sitúa por encima de él, y los dos no pertenecen a la misma categoría de cosa, lo que convierte esto en una comparación entre un checkpoint y un nombre, no entre dos modelos.

Eso merece ser precisado, porque la diferencia tiene un precio asociado. Xiaomi MiMo-V2.6-Pro tiene un precio de lista de $0.435 por millón de tokens de entrada y $0.87 por millón de tokens de salida. Xiaomi MiMo-V2.6-Flash, el otro checkpoint que cubre la etiqueta, tiene un precio de lista de $0.14 y $0.28. Si elegiste el incorrecto de esos porque un catálogo, un archivo de configuración o una hoja de adquisiciones decía "MiMo-V2.6" y nada más, te desvías por un factor de tres antes de haber hecho una sola llamada.

A qué se resuelve «MiMo-V2.6»

Tres cosas diferentes, según dónde lo leas.

El primero es la serie. El propio material de lanzamiento de Xiaomi describe la generación V2.6 como compuesta por dos checkpoints omnimodales nativos, Pro y Flash, publicados como ejecuciones de entrenamiento independientes. La colección de Hugging Face que los contiene se llama, sin más, MiMo-V2.6 —actualmente enumera tres elementos, contando el nivel de servicio Pro-UltraSpeed, y ese nombre de colección es el lugar más probable con diferencia para que alguien conozca el número de versión escueto y asuma que nombra a un modelo.

El segundo es una forma abreviada de referirse al modelo insignia. En la mayoría de la cobertura de lanzamiento y en la mayoría de las conversaciones abreviadas, «MiMo-V2.6» se refiere al nivel de un billón de parámetros, porque ese es el modelo del que trataba la cobertura. Esta es la lectura que produce el menor daño, ya que normalmente se resuelve en el modelo que la gente quería decir.

El tercero es el que cuesta dinero: un catálogo o una configuración en la que «MiMo-V2.6» se ha reducido al checkpoint que ese proveedor sirva en concreto. Los repositorios se llaman MiMo-V2.6-Pro-RL y MiMo-V2.6-Flash-RL, y el sufijo -RL denota linaje de post-entrenamiento, no un adaptador sobre un modelo base — un detalle que conviene saber antes de ir a buscar los pesos no-RL que los acompañan, porque no existen.

La gama media que dejó de existir

La ambigüedad es nueva, y la razón es que desapareció la parte media de la alineación.

Artificial Analysis sigue incluyendo un modelo llamado MiMo-V2.5, lanzado el 22 de abril de 2026, con una puntuación de 25,17 en el índice a $0,14 por millón de tokens de entrada y $0,28 de salida, con pesos abiertos. Se sitúa por debajo de MiMo-V2.5-Pro, que obtuvo 26,0 en la misma escala a $0,435 y $0,87, con 1M de contexto y 1023B de parámetros totales. Esa fue una generación de tres peldaños: un modelo barato con el nombre a secas, un buque insignia, y nada que te obligara a elegir entre los dos extremos.

La generación V2.6 tiene dos niveles que cualquiera puede invocar: Pro en la cima y Flash en la base. No existe un checkpoint de gama media que absorba el tráfico que queda entre ambos, y ninguno de los materiales de lanzamiento describe uno. Xiaomi sí publicó un punto de partida MiMo-V2.6-Distill-Qwen-9B y un framework de RL junto con los pesos, pero un punto de partida de destilación para tareas de entrenamiento no es una opción alojada de gama media para inferencia.

En la práctica, eso significa que la decisión que describe esta página —Pro o el nombre a secas— es en realidad una decisión sobre qué peldaño estás pisando. Si lo que realmente quieres es la antigua posición de MiMo-V2.5, lo más parecido en la nueva generación es Flash, al mismo precio de $0.14/$0.28 y con una afirmación de capacidad mucho más alta.

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6 — the scoreboard'. The left column, MiMo-V2.6-Pro, reads What it is a checkpoint, Index 46.3 measured, Price $0.435 / $0.87, Weights MIT on Hugging Face, Context 1M tokens, API providers one. The right column, MiMo-V2.6, reads What it is the series label, Index not measured, Price $0.14 to $0.87, Weights held by Pro and Flash, Context 1M on both, API providers none per the model cards. A footer reads 'Pro figures measured by Artificial Analysis v4.3.2; series facts per Xiaomi's release material.'

El upgrade que el nombre esconde

Si dejamos a un lado la cuestión del nombre, debajo hay un hecho claro, importante y bien documentado: que el buque insignia avanzó muchísimo en una sola generación sin cambiar su precio.

• Puntuación del índice — MiMo-V2.5-Pro 26,0 en el Artificial Analysis Intelligence Index, frente a 46,3 de Xiaomi MiMo-V2.6-Pro, ambos según las mediciones de Artificial Analysis y no de Xiaomi
• Precio por token — sin cambios: $0,435 de entrada, $0,87 de salida, en ambas generaciones
• Costo por tarea del índice — $0,054 para MiMo-V2.5-Pro frente a $0,1332 para MiMo-V2.6-Pro, y el aumento se debe a la verbosidad, no a un cambio de tarifa
• Parámetros — 1023B en total y 42B activos, frente a 1,02T en total y 42B activos
• Contexto — 1M de tokens, sin cambios
• Licencia — MIT, sin cambios
• Fecha de lanzamiento — 22 de abril de 2026, frente al 21 de septiembre de 2026

La puntuación es la parte que importa, y es la parte que la nomenclatura oculta. Veinte puntos de índice en cinco meses, con una tarifa sin cambios, es un salto generacional mayor de lo que enmarcó la cobertura del lanzamiento: la mayor parte se destinó a «modelo de pesos abiertos superior», que es una afirmación sobre el sector más que sobre la actualización. Si tienes en funcionamiento el anterior buque insignia y te preguntas si una migración merece el esfuerzo de ingeniería, esa sola línea es la respuesta, y es un argumento más sólido que cualquier cosa del material de marketing.

La salvedad es la misma que acompaña a todas las cifras de Xiaomi en este lanzamiento. Tanto el 26.0 como el 46.3 son mediciones de Artificial Analysis, lo que los hace comparables entre sí y con otros modelos de la misma versión del índice. Las propias tablas de benchmark del proveedor —DeepSWE v1.1, Terminal Bench, AutomationBench y las demás— no lo son, y no deberían usarse para calcular un delta de mejora. Mezclar una puntuación medida con una puntuación del proveedor para producir una cifra de "puntos ganados" es el error más común en la cobertura de este lanzamiento.

Por qué un nombre es un problema operativo

Nada de esto es pedantería una vez que la etiqueta llega a un sistema. Un identificador de modelo que se resuelve en dos checkpoints con una diferencia de precio de 3,1x es un incidente de facturación esperando un desencadenante, y hay tres lugares donde falla de forma sistemática. Los archivos de configuración y de entorno, donde una cadena como mimo-v2.6 se escribe una vez y nunca se vuelve a revisar. Las hojas de costos, donde una estimación por token se asocia al nombre de la serie y luego se aplica al nivel equivocado. Y las filas de evaluación, donde un resultado se archiva bajo la familia y después se lee como una propiedad del modelo insignia.

Hay un cuarto punto, y es el que afectó específicamente a esta versión: los recuentos de parámetros. Xiaomi MiMo-V2.6-Pro está documentado con 1,02 T en total y 42 B activos, y su repositorio de Hugging Face indica un tamaño de modelo Safetensors de 524 B. MiMo-V2.6-Flash está documentado con aproximadamente 309 B en total y 15 B activos, y su repositorio indica 159 B. Ninguno de los dos pares concuerda. Si tu planificación de capacidad se basa en la ficha del modelo y tu aprovisionamiento se basa en el repositorio, dimensionarás el mismo despliegue de dos maneras distintas.

Fija el nombre del punto de control en todas partes, no el de la serie. Ese es todo el remedio, y no cuesta nada hasta el día en que ahorra el presupuesto de un trimestre.

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the repository name, MIT licence and fp8 tags, a Safetensors panel reporting a model size of 524B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a collection block headed MiMo-V2.6 holding three items, and the model card introduction describing MiMo-V2.6-Pro-RL as the flagship checkpoint of the MiMo-V2.6 series with native omnimodal input and a 1M-token context.

Cómo se resuelve esto en un router

El problema de la nomenclatura es un problema de catálogo, y un catálogo es el único lugar donde es fácil de arreglar. Dirigirse a los modelos por un identificador preciso mediante una sola clave de API, en lugar de por el nombre de la familia en varias cuentas de proveedores, significa que la cadena de tu configuración es la misma cadena que ve el sistema de facturación, que es la propiedad que destruye un nombre como "MiMo-V2.6". Por eso también transmitimos el precio de lista del proveedor con un 0 % de margen en lugar de aplicar nuestro propio margen: el precio que aparece en la página es el precio que fijó el proveedor, así que un nivel que identificaste mal está equivocado en la misma dirección para todos, en lugar de estar equivocado en una dirección específica para nosotros.

Para ser claros sobre los límites: no alojamos ninguno de los dos checkpoints de MiMo-V2.6, así que hoy ninguno es enrutable a través de nosotros, y ninguno está desplegado por ningún proveedor de inferencia de terceros según su propio repositorio de Hugging Face. La ruta hacia ambos es la propia plataforma de Xiaomi y los catálogos que lo incluyen. Pero la disciplina de identificadores que defiende esta página se aplica a todos los modelos que invocas, y es la razón por la que vale la pena tener una capa de enrutamiento incluso para los modelos que aún no estás enrutando.

Qué llevarse

Si viniste aquí para comparar dos modelos, la comparación no está disponible: una de estas cosas no es un modelo. Xiaomi MiMo-V2.6-Pro es el checkpoint: 46.3 en el índice, $0.435 y $0.87 por millón de tokens, pesos MIT, contexto de 1M, y la única entrada de pesos abiertos en la línea de Pareto de costos de Artificial Analysis por encima del nivel casi gratuito. MiMo-V2.6 es la etiqueta que está encima y la etiqueta que está al lado, y abarca un checkpoint más barato a un tercio del precio y un nivel de servicio más rápido a diez veces el precio.

La comparación que vale la pena hacer, en cambio, es la que esconde el nombre: el buque insignia de esta generación frente al último que llevaba un número de versión sin más. Veinte puntos de índice, cinco meses, tasas sin cambios. Ese es el número que hay que poner delante de quien apruebe la migración, no el de ser el primero en la tabla de clasificación.

Screenshot of the Artificial Analysis model page for MiMo-V2.5-Pro, showing 'Released April 2026', an Intelligence card reading 26 ranked #24 of 114, a Speed card reading 45.9 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.05 cost per Intelligence Index task ranked #3 of 114, a Verbosity card reading 110M output tokens, and a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.