
GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: dos niveles de velocidad, un precio faltante
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 610 tok/s
- openaiNUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- openaiNUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- anthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- grokNUEVOGrok 4.72026-09-2146Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 189 tok/s
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
Dos proveedores lanzaron la misma idea de producto con tres semanas de diferencia, y la diferencia entre ellos es la mejor manera de ver qué está vendiendo realmente cada uno. El lado de Xiaomi llegó el 22 de septiembre de 2026: Xiaomi MiMo v2.6 Pro Ultraspeed es el mismo checkpoint de 1,02 billones de parámetros que MiMo-V2.6-Pro, servido más rápido, a $4,35 por millón de tokens de entrada y $8,70 por millón de salida, frente a los $0,44 y $0,87 del carril Pro estándar. El GPT-5.6 Sol Ultrafast del proveedor es la misma maniobra aplicada a GPT-5.6 Sol: pesos idénticos, hasta 750 tokens de salida por segundo, hasta 14× el nivel estándar, ejecutándose sobre hardware de escala de oblea de Cerebras —y ningún precio publicado en absoluto, seis semanas después de que el modo se anunciara el 13 de agosto.
Ponga los dos uno al lado del otro y la anomalía es inmediata. Xiaomi publicó una lista de precios antes de publicar la mayoría de los benchmarks. OpenAI publicó los benchmarks, el socio de hardware y los nombres de los clientes — y aún no ha publicado una cifra con la que se pueda presupuestar. Uno de estos niveles se puede comprar hoy. El otro es un valor en un esquema de API. Compararlos es, por tanto, menos una cuestión de cuál es más rápido y más una cuestión de cuánto vale un nivel de velocidad cuando un proveedor te ha dicho el precio y el otro no.
Lo que realmente es cada uno
Ninguno de los dos es un modelo nuevo. Esa es la premisa compartida y vale la pena afirmarla sin rodeos, porque ambos lanzamientos atrajeron cobertura que trató un cambio en la prestación del servicio como el lanzamiento de una capacidad.
MiMo v2.6 Pro Ultraspeed es una configuración de servicio del buque insignia de Xiaomi: el mismo checkpoint de mezcla de expertos dispersa de 1,02 T de parámetros con 42 B activados por token, el mismo contexto de 1 M de tokens, la misma multimodalidad nativa en texto, imagen, vídeo y audio, los mismos pesos con licencia MIT en los repositorios públicos. El material propio de Xiaomi afirma hasta 20 veces la velocidad de salida del servicio Pro estándar con la misma calidad; los listados de catálogos de terceros que describen el mismo modelo el mismo día indican aproximadamente 10 veces. Nadie ha publicado una medición que concilie ambas cifras.
GPT-5.6 Sol Ultrafast es una configuración de servicio del buque insignia de OpenAI: el mismo checkpoint, el mismo comportamiento de razonamiento, la misma ventana de contexto de 1.050.000 tokens, la misma salida máxima de 128K, las mismas respuestas. La aceleración es de hardware y no de planificación —los pesos del modelo residen en SRAM en chip sobre silicio a escala de oblea de Cerebras en lugar de ser transportados entre la memoria de la GPU y el cómputo—, y es el primer producto de la alianza de computación OpenAI–Cerebras de enero de 2026, valorada en aproximadamente 10.000 millones de dólares a lo largo de tres años.
Así que el eje honesto de comparación no es la inteligencia. Es qué eligió cambiar el proveedor, cuánto cobró por ese cambio y qué parte del cambio te permitió verificar.

Las tarjetas de tarifas, incluida la en blanco
• MiMo v2.6 Pro Ultraspeed — $4.35 de entrada / $8.70 de salida por millón de tokens, publicado por Xiaomi.
• MiMo-V2.6-Pro estándar — $0,44 / $0,87, publicado por los catálogos comerciales de Xiaomi. Aproximadamente 9,9× en la entrada y exactamente 10× en la salida.
• GPT-5.6 Sol Ultrafast — no hay tarifa publicada a fecha de 27 de septiembre de 2026. La página de precios de OpenAI aún tiene cuatro pestañas —Standard, Batch, Flex, Fast— y el nivel no está entre ellas.
• GPT-5.6 Sol estándar — $4,00 / $20,00 por millón, la tarifa promocional actual de OpenAI, con entrada en caché a $0,40 y un escalón de contexto largo a $8,00 / $30,00 a partir de aproximadamente 272K tokens de entrada.
• El único premium comparable que OpenAI ha llegado a tarifar jamás — Fast mode, a $8.00 / $40.00, exactamente el doble de la tarifa estándar por hasta aproximadamente 2.5× la velocidad de salida.
Esa última fila es la razón de que la casilla en blanco importe. El nivel de velocidad de Xiaomi cuesta diez veces más que el carril estándar y afirma ofrecer de diez a veinte veces la velocidad, lo cual, como intercambio, es al menos coherente en sí mismo: pagas proporcionalmente más por esperar proporcionalmente menos, y la apuesta es que el tiempo real es el producto. El nivel de velocidad de OpenAI es una demanda mayor sobre silicio más escaso que Fast mode, así que, sin importar lo que termine costando, el precedente indica un sobreprecio en lugar de un descuento. Pero «el precedente indica un sobreprecio» no es un número, y hasta que exista uno, el nivel no puede compararse con UltraSpeed en precio en absoluto —solo por el hecho de que Xiaomi estaba dispuesta a decir su número y OpenAI no.
De dónde vienen los números
Los dos niveles tienen problemas probatorios opuestos, y vale la pena nombrar ambos en lugar de buscar un término medio.
La afirmación de velocidad de Xiaomi es vaga en magnitud pero está anclada a un precio publicado. El 20× es un techo del proveedor bajo condiciones que Xiaomi no ha especificado, el 10× es lo que un listado de catálogo estaba dispuesto a afirmar como típico, y el multiplicador real está en algún lugar de una banda amplia que nadie ha medido en público a un nivel de concurrencia declarado. En contraste, el precio es exacto, los pesos son descargables bajo MIT, y el informe técnico y el entorno de entrenamiento de aprendizaje por refuerzo son públicos — puedes inspeccionar lo que hizo Xiaomi, simplemente aún no puedes verificar qué tan rápido se ejecuta.
La afirmación de velocidad de OpenAI es específica en magnitud, pero no se ancla a nada que se pueda comprar. Hasta 750 tokens de salida por segundo, hasta 14× lo estándar, dicho sin rodeos. También es una cifra de rendimiento de tokens de salida, no un multiplicador plano de extremo a extremo: el procesamiento de la entrada y el razonamiento propio del modelo no se comprimen en esa proporción, y por eso la empresa lo califica como un máximo. Los benchmarks de respaldo son reportados por el proveedor y, en un caso, entre proveedores: una ejecución de 2.500 preguntas de Humanity's Last Exam que, según se informa, terminó en 11 horas 11 minutos frente a 78 horas 27 minutos de Claude Fable 5, con una precisión comparable. La cobertura independiente del lanzamiento citó una comparación de velocidad de generación más estrecha, de aproximadamente 11×, en esa misma ejecución, mientras que las propias cifras de Cerebras implican alrededor de 7× para el tiempo total de la prueba. Tres partes, tres fracciones de una misma carga de trabajo, sin reproducción por terceros de ninguna de ellas. Cerebras, por su parte, reporta 5,6× de extremo a extremo en GDP-Val sin pérdida de calidad medible, también sin reproducción.
Ambos conjuntos de cifras los declara el proveedor. La diferencia es que la vaguedad de Xiaomi gira en torno a la velocidad y la de OpenAI en torno al costo, y para cualquiera que esté haciendo un presupuesto, el costo es el más difícil de adivinar.

Qué ocurrió esta semana y por qué no cierra la brecha
La razón por la que esta comparación tiene siquiera un gancho periodístico es un commit, y no un anuncio. El valor ultrafast lleva en el esquema público openai-openapi de OpenAI desde el 13 de agosto de 2026 —el mismo día en que se anunció el modo—, con la descripción que lo circunscribe a gpt-5.6-sol y lo califica de sujeto a control de acceso. El commit que se movió esta semana es posterior y más pequeño: el 25 de septiembre de 2026, fe4f7a1 añadió ultrafast a dos enumeraciones más, el parámetro service-tier a nivel de solicitud y el campo de política service-tier de los agentes. Antes de ese commit, esas dos listas decían auto, default, flex, priority, fast. Después de él, hay una entrada descrita como "Usa el nivel de servicio ultrafast".ultrafast a las service_tier enumeraciones de su especificación pública openai-openapi —el campo que el esquema describe como "el nivel de servicio utilizado para las solicitudes de modelo", y el campo de política asociado a los agentes. Antes del cambio, esa lista decía default, flex, priority, fast. Después de él, hay una entrada descrita como "Usa el nivel de servicio ultrafast".
La distinción importa para cualquiera que lea la cobertura. Este no es el nivel que se está creando; es el nivel que se está integrando en el campo con el que se configura un agente, lo que significa que con el tiempo se podrá escribir un cliente contra él sin ningún endpoint nuevo. El reporte del día siguiente describe un selector Fast / Standard / Ultrafast que llegará al Responses API Playground, con un acceso más amplio previsto después de la conferencia DevDay de OpenAI. No hemos visto el selector y OpenAI no ha publicado una nota de despliegue, así que esa parte es de una sola fuente. Lo que sí se puede verificar son las entradas de esquema añadidas y la continua ausencia de una lista de precios seis semanas después del anuncio.
Mientras tanto, el nivel de Xiaomi lleva cinco días disponible para compra y sigue siendo el único de los dos que puedes poner en una factura. Su propia cuestión abierta es distinta: si se mantiene una prima de 10×, o si se comporta como la mayoría de los precios de lanzamiento de un nuevo nivel premium y se desplaza hacia la banda estándar una vez que cesa la cobertura de lanzamiento. El Pro estándar a $0,44 / $0,87 es el ancla, y un nivel que arranca a diez veces su ancla rara vez termina ahí.
Elegir entre ellos, dado que probablemente no puedas
El incómodo hecho práctico es que, para la mayoría de los lectores, esto es una comparación entre un nivel que no puedes comprar y otro que probablemente no deberías comprar a precio de lista. GPT-5.6 Sol Ultrafast es una vista previa con lista de espera para clientes selectos, que se amplía a medida que crece la capacidad, sin fecha de disponibilidad general y sin precio; MiMo v2.6 Pro Ultraspeed está disponible, es caro y está diseñado para un tipo específico de comprador.
La prueba de carga de trabajo es la misma para ambos, y se trata de la forma de tu grafo de solicitudes más que del tamaño de tu prompt. Una única generación larga gana mucho menos que el multiplicador destacado, porque el procesamiento de entrada y el razonamiento no se aceleran en la misma proporción. Un bucle de agente de cuarenta pasos detrás de una única acción visible para el usuario gana algo mucho más cercano al número completo, porque cada ida y vuelta es latencia que una persona está soportando. Si tu tráfico se parece a la segunda forma, ambos niveles están dirigidos a ti; si se parece a la primera, el carril estándar en cualquiera de los modelos siempre fue la decisión correcta y el carril estándar de MiMo-V2.6-Pro a $0.44 / $0.87 es una de las formas más económicas de llamar a un modelo de clase de un billón de parámetros en cualquier lugar.
Lo que ninguno de los dos niveles cambia es que estás comprando latencia, no calidad. Si comparas el rendimiento de UltraSpeed o Ultrafast con su propio canal estándar usando prompts idénticos y obtienes respuestas diferentes, eso es un hallazgo que vale la pena reportar, no una característica: nada en la descripción de ninguno de los dos proveedores afirma que los pesos hayan cambiado.
Este es también el caso en el que un router se gana su lugar, y en concreto para el nivel que no puedes obtener. GPT-5.6 Sol está activo en OrcaRouter como openai/gpt-5.6-sol a la tarifa del propio proveedor, con cero margen sobre los tokens a través del endpoint compatible con OpenAI en api.orcarouter.ai/v1, así que la vía estándar a la que recurrirías está a un solo cambio de URL base de distancia, y la misma clave da acceso a más de 200 modelos. Eso importa porque la respuesta honesta a «¿debería usar Ultrafast?» hoy es «no puedes, así que decide qué canaliza el tráfico interactivo mientras tanto» — y la forma de comprar latencia sin lista de espera es enrutar las llamadas interactivas al modelo del catálogo que supere tu listón de calidad con el menor tiempo de reloj, y dejar el trabajo nocturno en la vía más barata que lo apruebe. Cuando se abra el nivel, ese es el interruptor que accionas. Señalar con claridad lo que no alojamos: ningún modelo de Xiaomi está en OrcaRouter, así que MiMo v2.6 Pro Ultraspeed proviene de la propia API de Xiaomi y de varias plataformas de terceros, y esta página no es una ruta hacia él.

¿Qué lo resolvería?
Tres mediciones, ninguna de las cuales existe todavía. Una tarjeta de tarifas de Ultrafast publicada haría que esta fuera la comparación que merece ser, en lugar de una comparación con un hueco. Una distribución de latencia independiente con un nivel de concurrencia declarado te diría si el multiplicador real de Xiaomi se sitúa más cerca de 10× o de 20×, y si se mantiene bajo carga en lugar de en una demostración de un solo flujo. Y una reproducción independiente de la suite de benchmarks de cualquiera de los dos proveedores sacaría ambos conjuntos de cifras de la columna de afirmaciones.
Hasta entonces, la interpretación defendible es limitada. Xiaomi lanzó un nivel de velocidad con un precio y una velocidad poco concreta; OpenAI lanzó un nivel de velocidad con una velocidad concreta y sin precio; ambos son el mismo modelo que la oferta frente a la que se comparan sus precios, y ninguno se ha medido de forma independiente. Si necesitas la latencia ahora y la carga de trabajo es interactiva, UltraSpeed es real, se puede comprar y tiene un precio pensado exactamente para el comprador que busca. Si lo necesitas ahora y la carga de trabajo no es interactiva, las vías estándar de ambos modelos son más baratas, están probadas y disponibles hoy —y el nivel del que todos están discutiendo seguirá ahí cuando alguien publique una cifra.
