Una tarjeta principal generada encabezada por 'Dos carriles rápidos, separados por dieciséis días', con el subtítulo 'GPT-6.1 Ultrafast vs. Xiaomi MiMo v2.6 Pro Ultraspeed', un panel izquierdo que dice '6x estándar', 'API cerrada' y 'Múltiplo de velocidad tomado de GPT-6 Astra', y un panel derecho que dice 'Aproximadamente 10x estándar', 'Pesos MIT' y '1.02T en total / 42B activos', sobre un pie de página que dice 'Cifras del proveedor y del catálogo, septiembre-octubre de 2026; sin mediciones independientes de ninguno de los dos niveles.'
Engineering & Research

GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Dos carriles rápidos, uno dice lo que costó

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Las dos formas más rápidas de comprar un modelo de frontera salieron a la venta con dieciséis días de diferencia, y solo una de ellas te explicaba cómo se generaba esa velocidad. GPT-6.1 Ultrafast —el nivel de servicio sobre GPT-6.1 Sol, que O​penAI lanzó el 29 de septiembre de 2026 y que incorporó este nivel el 8 de octubre de 2026— es un buque insignia cerrado al que se accede mediante una API, con un precio seis veces superior al de Standard y sin ninguna explicación publicada de lo que ocurre entre los pesos y tu solicitud. X​iaomi MiMo v2.6 Pro Ultraspeed, lanzado el 22 de septiembre de 2026, es un nivel de velocidad sobre MiMo-V2.6-Pro, un checkpoint con licencia MIT cuyo entorno de aprendizaje por refuerzo X​iaomi también publicó. Ambos venden latencia a un múltiplo. Solo el múltiplo de X​iaomi se apoya en algo que un cliente puede inspeccionar, y esa diferencia pesa más en la decisión que cualquiera de las dos afirmaciones de velocidad.

El precio de los dos carriles es la parte fácil y se cubre a continuación. La parte difícil es que un nivel de velocidad es una promesa sobre el servicio, y los dos proveedores han hecho esa promesa con niveles de divulgación muy distintos: uno tomó prestada su cifra destacada de un modelo hermano, el otro publicó la receta de entrenamiento junto con la lista de precios. Si estás a punto de asignar una carga de trabajo de producción a un carril rápido, la brecha de divulgación es el riesgo que realmente estás asumiendo.

Los precios, con ambas partes en la misma línea

Ambos niveles se venden como un múltiplo de un carril estándar, y los múltiplos son lo suficientemente cercanos como para que el precio no sea lo que los separa.

• Línea estándar — GPT-6.1 Sol a $2.00 de entrada / $10.00 de salida por millón de tokens, frente a MiMo-V2.6-Pro a $0.44 / $0.87.

• Vía rápida — GPT-6.1 Ultrafast a $12.00 / $60.00, frente a MiMo-V2.6-Pro-UltraSpeed a $4.35 / $8.70.

• El multiplicador — exactamente 6x en cada línea para el nivel de O​penAI, aproximadamente 9,9x en la entrada y exactamente 10x en la salida para el de X​iaomi.

• Entrada en caché — GPT-6.1 Sol marca $0.10 por millón en Standard y $0.60 en Ultrafast; la tarjeta de tarifas de MiMo que podemos consultar no publica una línea separada de entrada en caché para ninguna de las dos vías.

• Contexto largo — GPT-6.1 Sol recotiza toda la solicitud a 2x las tarifas de entrada y de caché, y 1.5x la de salida por encima de 272.000 tokens de entrada, lo que sitúa a Ultrafast en $24.00 / $1.20 / $30.00 / $90.00. MiMo-V2.6-Pro cuenta con una ventana de contexto de 1M de tokens sin un salto de precio publicado equivalente.

• Diferencia absoluta: los dos carriles rápidos están separados por 2,8x en la entrada y 6,9x en la salida, que es la brecha entre un modelo cerrado de frontera y uno de pesos abiertos que aparece dentro del nivel de velocidad en lugar de en la tarifa estándar.

El resumen en una línea de ese bloque: Xiaomi cobra un múltiplo mayor por un modelo mucho más barato, y OpenAI cobra un múltiplo menor por uno mucho más caro. Por los tokens de salida pagas 60,00 $ por millón en el carril de OpenAI y 8,70 $ en el de Xiaomi. Ninguno de los dos proveedores ofrece un descuento por velocidad; ambos la cobran como un producto aparte, lo que es la primera señal de que, en ambos casos, el carril estándar sigue siendo el predeterminado y el carril rápido es una excepción que se justifica según la carga de trabajo.

Lo que cada proveedor te dirá sobre la velocidad

Aquí es donde los dos despliegues dejan de ser simétricos, y es lo más útil de la página.

El número publicado por O​penAI para Ultrafast es que GPT-6 Astra Ultrafast genera tokens hasta 8 veces más rápido que GPT-6 Astra en modo Estándar en Codex. Esa es una medición de un modelo diferente, en un cliente diferente, formulada como un techo. La documentación que cubre Ultrafast para GPT-6.1 Sol dice que el nivel reduce el tiempo entre tokens de salida generados y remite a una tabla de tarifas; no le pone ningún número al nivel Sol en absoluto. Así que la cifra destacada asociada a este lanzamiento está tomada prestada del modelo hermano que ha estado en Ultrafast desde el 29 de septiembre, y ninguna entidad independiente ha publicado una medición de tokens por segundo para ninguno de los dos. Bien podría sostenerse —misma pila de servicio, mismo mecanismo—, pero es un techo de proveedor que la propia O​penAI no midió para este modelo.

La divulgación de Xiaomi es de distinta índole, y la diferencia no radica en que sea más precisa. Sus propios materiales afirman que UltraSpeed alcanza hasta 20 veces la velocidad de salida del servicio Pro estándar con la misma calidad. Los listados de catálogos de terceros que describen el mismo modelo el mismo día indican aproximadamente 10 veces. Ambas cifras están en circulación, no son la misma cifra, y nadie ha publicado una medición que las reconcilie. Si se lee con honestidad: “hasta 20x” es un techo del proveedor bajo condiciones que Xiaomi no ha especificado, “aproximadamente 10x” es lo que un catálogo estaba dispuesto a afirmar como típico, y el multiplicador real se sitúa en algún punto dentro de una banda amplia hasta que alguien publique distribuciones de latencia por solicitud a un nivel de concurrencia declarado.

Así que Xiaomi te da dos cifras sin reconciliar, y OpenAI te da una cifra que pertenece a un modelo distinto. Ninguna es un dato con el que puedas planificar un presupuesto, y la consecuencia práctica es la misma en ambos casos: mide el nivel con tus propios prompts antes de comprometer una ruta de producción con él.

La asimetría que sí importa: qué compran los dígitos adicionales

Al margen de las promesas de velocidad, los dos carriles están ligados a tipos de producto muy distintos, y aquí es donde la elección deja de ser una comparación de precios.

MiMo-V2.6-Pro es un diseño de mezcla de expertos dispersa que Xiaomi ha descrito públicamente: 1,02 billones de parámetros totales con 42 mil millones activados por token, una ventana de contexto de 1 M de tokens, multimodalidad nativa en texto, imagen, video y audio, y una etiqueta de licencia MIT en los checkpoints publicados. El paquete de publicación incluye un informe técnico y notas de despliegue, y Xiaomi dice que está publicando como código abierto el entorno de entrenamiento de aprendizaje por refuerzo y su código, para que el post-entrenamiento pueda examinarse y reproducirse. La ejecución de RL también está documentada: 30 pasos y aproximadamente 750.000 trayectorias por modelo, en menos de seis días, con un gasto publicado combinado de unos $3.474.715 entre las ejecuciones de Pro y Flash. En DeepSWE v1.1, el propio harness de Xiaomi con mini-swe-agent en avg@3, la empresa informa que MiMo-V2.6-Flash pasa de 48,8 a 65,68 y MiMo-V2.6-Pro de 58,4 a 72,57 a lo largo de esa ejecución. Esos son datos reportados por el proveedor y no reproducidos; la distinción entre «el harness de Xiaomi dice 72,57» y «72,57 es la puntuación» es la diferencia entre una afirmación y un hecho.

GPT-6.1 Sol no publica nada de eso. No hay un número de parámetros, ni una nota de arquitectura, ni una cifra de gasto en entrenamiento, ni un checkpoint, ni una licencia que leer — hay una ficha de modelo, una ventana de contexto, una fecha de corte de conocimiento del 30 de abril de 2026 y una API. Esa es la disposición normal para un laboratorio de frontera y no es una crítica. Pero tiene una consecuencia para una decisión de compra que la cobertura de lanzamiento suele omitir: con la vía de pesos abiertos, un nivel rápido decepcionante es recuperable. Si UltraSpeed resulta no valer 10x tu tráfico, el mismo checkpoint se puede descargar y puedes servirlo tú mismo o a través de otro proveedor, lo que limita tu riesgo al costo de la migración. Con la vía cerrada, un nivel rápido decepcionante es una factura y un presupuesto de límite de velocidad que vuelves a ajustar a la baja; no puedes eludirlo ejecutando los pesos, porque no hay pesos que ejecutar.

Una advertencia sobre esa etiqueta MIT, porque se simplifica demasiado en la cobertura del lanzamiento. La licencia se aplica a los checkpoints que publicó X​iaomi. UltraSpeed es un servicio alojado, y los servicios alojados se rigen por términos de servicio, no por una licencia de pesos. Tener derecho a ejecutar el checkpoint en tu propio hardware y tener derecho a revender el servicio acelerado que alguien más ofrece de él son dos derechos distintos, y solo el primero proviene del archivo de licencia.

A screenshot of the XiaomiMiMo MiMo-V2.6-Pro-RL model card on Hugging Face, showing the released reinforcement-learning checkpoints, the parameter and context figures, the licence tag and the model-card sections describing the MiMo-V2.6 family.A generated disclosure card headed 'What each vendor published', with an 'OpenAI — GPT-6.1 Ultrafast' column reading 'No speed multiple for this model', 'Headline 8x figure is GPT-6 Astra's', 'No checkpoint, no parameter count' and 'No licence to read', and a 'Xiaomi — MiMo-V2.6-Pro-UltraSpeed' column reading '1.02T total / 42B active', '1M-token context', 'MIT-licensed checkpoints', 'RL environment and spend published' and 'Speed: up to 20x or roughly 10x', footnoted that all figures are vendor-reported and unreproduced.

Dos trampas de nomenclatura antes de copiar cualquiera de los dos identificadores

Ninguno de los dos nombres en el título de esta página es un punto de control, y la documentación de ambos proveedores hace que el error sea fácil de repetir.

• GPT-6.1 Ultrafast — no es un modelo. El identificador en la solicitud sigue siendo el mismo que el del modelo estándar; el nivel se establece mediante un campo de la solicitud, y el resultado es el mismo checkpoint programado de forma diferente.

• MiMo v2.6 Pro Ultraspeed — tampoco es un conjunto de pesos distinto. Es el checkpoint MiMo-V2.6-Pro servido en una ruta más rápida y con precio como su propia línea de facturación.

• Lo que eso significa para el benchmarking: si comparas los dos carriles de cualquiera de los dos modelos con prompts idénticos, el resultado esperado son las mismas respuestas a distintos ritmos. El contenido divergente ante la misma entrada es un defecto que debes reportar, no una capacidad que compraste.

• Qué significa eso para la verificación de la licencia — para X​iaomi, lee la tarjeta del modelo. Para O​penAI, no hay nada que leer, porque los pesos no se distribuyen.

También hay una asimetría más sutil que se manifiesta en cómo se vende cada nivel. GPT-6.1 Sol admite residencia de datos en EE. UU. y la UE, y procesamiento global, incluso bajo Ultrafast, por lo que una carga de trabajo anclada al procesamiento europeo tiene una respuesta documentada. La lista de precios de MiMo que podemos consultar no indica residencia en absoluto: Xiaomi vende un modelo y una ruta de servicio, no una postura de cumplimiento. Para un comprador sujeto a regulación, esa sola línea puede decidir la comparación antes de que se considere el precio.

Where each lane is actually callable

Ambas vías rápidas son accesibles a través de la propia API de su proveedor, y ambas aparecen en plataformas de terceros. Ninguna está en OrcaRouter, y merece la pena decirlo con claridad en lugar de dejar que una página de comparación insinúe lo contrario.

Lo que hay en OrcaRouter es el carril estándar del modelo de O​penAI: openai/gpt-6.1-sol a las tarifas propias de O​penAI de $2.00 por millón de tokens de entrada y $10.00 por millón de tokens de salida, con 0% de markup y el precio del proveedor pasado directamente, por lo que un cambio de precio del proveedor llega a nuestro lado el mismo día. Ultrafast es una marca de nivel de servicio que se factura en tu propia cuenta de O​penAI, y aquí no se aloja ningún modelo de X​iaomi. Lo que sí compra una clave es el carril estándar junto con más de otros 200 modelos detrás de un único endpoint compatible con O​penAI, con failover automático entre proveedores — que es la postura útil cuando la carga de trabajo que estás protegiendo es la que notaría un techo de rate-limit a las tres de la madrugada.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128,000 maximum output tokens, text and image input with text output, input price $2.00 and output price $10.00 per 1M tokens, with the EN language toggle visible in the page header.

Qué carril probar, en orden

Si tu carga de trabajo es interactiva y el tiempo de generación depende del reloj de una persona, vale la pena probar ambos niveles, y el factor decisivo no será el precio, sino la fecha de caducidad de tu confianza. El carril de pesos abiertos te permite verificar y luego marcharte; el carril cerrado te pide que verifiques con el único proveedor que puede servirlo y que te quedes. Esa asimetría es real, pero tampoco es gratuita: MiMo-V2.6-Pro-UltraSpeed es un servicio alojado, así que la salida es una migración y no un cambio de configuración, y es posible que el checkpoint al que migrarías no coincida con las optimizaciones de servicio de ese nivel.

Si tu carga de trabajo es por lotes o programada, ambas son la compra equivocada, tanto a 6x como a 10x, y lo honesto es ejecutarla en el carril estándar y gastar la diferencia en evaluación en su lugar.

Qué cambiaría esta página: una medición independiente de la velocidad de salida de cualquiera de los dos niveles a un nivel de concurrencia declarado, una declaración de residencia publicada por X​iaomi, o una cifra de límite de tasa de O​penAI para el nivel Sol con la que un comprador pueda planificar en lugar de tener que solicitarla. Hasta que esas cosas existan, la comparación es una lista de precios contra otra lista de precios, y uno de los dos proveedores ha publicado considerablemente más sobre el objeto al que se le está poniendo precio.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario