
GPT-6.1 Ultrafast es Pro por solo $500, y ese detalle estaba tres publicaciones más abajo
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
GPT-6.1 Sol Ultrafast llegó el 8 de octubre de 2026 con lo más raro que puede incluir un nivel de velocidad: un precio publicado. $12.00 por millón de tokens de entrada, $60.00 por millón de tokens de salida, exactamente seis veces lo que GPT-6.1 Sol — el modelo que OpenAI lanzó el 29 de septiembre de 2026 en su keynote de DevDay 2026 — cuesta en la vía estándar. Lo que el hilo del anuncio no destacó es dónde puede activarlo realmente un suscriptor de ChatGPT, y la respuesta, tres publicaciones más abajo, es el plan Pro de $500. Ese orden merece más atención de la que recibió, porque la mitad de API y la mitad de suscripción de este lanzamiento están restringidas de maneras opuestas, y la diferencia decide si Ultrafast es algo que puedes probar esta semana o algo para lo que tienes que comprar un plan.
Nada del modelo ha cambiado. GPT-6.1 Sol Ultrafast es el mismo checkpoint, la misma ventana de contexto de 1.050.000 tokens, el mismo límite de salida de 128.000 tokens, la misma fecha de corte de conocimiento del 30 de abril de 2026 y las mismas respuestas que GPT-6.1 Sol. Ultrafast es un nivel de servicio —una prioridad de programación que solicitas—, no un segundo modelo. Todo el producto es latencia, que se vende a un múltiplo, y las dos únicas preguntas que importan son cuánta obtienes y quién tiene permitido comprarla.
Lo que el registro dice en realidad, en el orden en que lo dice
La versión del agravio de esta historia es que OpenAI enterró el escándalo. La versión precisa es más específica y se puede verificar línea por línea con la propia documentación de OpenAI.
El registro de cambios para desarrolladores contiene la entrada con fecha del 8 de octubre: se añade el modo Ultrafast para GPT-6.1 Sol en la API de Responses, solicitado al enviar model: "gpt-6.1-sol" con service_tier: "ultrafast", descrito como una reducción del tiempo entre los tokens de salida generados, y declarado como disponible para todos los usuarios de la API sujetos a límites de velocidad, con procesamiento global y residencia de datos en EE. UU. y la UE. Leído por sí solo, eso es un lanzamiento sin restricciones a una tarifa publicada.
La documentación de niveles dice que Ultrafast es el nivel de servicio más rápido de la API, disponible de forma general para GPT-6 Astra y GPT-6.1 Sol, con acceso de vista previa para GPT-5.6 Sol, y recomienda WebSockets para él. Sigue sin mencionarse ningún plan.

El detalle de la suscripción está en la página de velocidad del lado de ChatGPT, y son tres limitaciones apiladas en un solo párrafo: Ultrafast está disponible en Codex y ChatGPT Work, en Pro $500, y en los planes Enterprise y Edu elegibles. Los administradores de Enterprise lo tienen desactivado de forma predeterminada y deben habilitarlo por usuario o por espacio de trabajo. Y a la superficie de Chat de consumo no se le ofrece el nivel en absoluto — GPT-6.1 Sol en sí vive en Work y Codex, así que Chat nunca estuvo contemplado.
Junta las tres páginas y la conclusión es clara. Una clave de API es una entrada. Una suscripción a ChatGPT es una entrada solo si es la más cara que vende OpenAI, o si un administrador te la ha habilitado. Nadie que lea la primera publicación del anuncio lo deduciría.
Por qué existe la puerta, y no es algo arbitrario
La lectura obvia es que OpenAI está usando la vía rápida para vender planes de $500. El mecanismo subyacente es menos cínico y más útil: Ultrafast es un medidor caro, y un plan de $500 es el único plan de consumo en el que un medidor 8x encaja dentro del uso incluido.
En una suscripción, el uso incluido se consume a ocho veces la tarifa estándar cuando usas Ultrafast, por lo que un solo turno de Ultrafast consume la misma asignación que ocho turnos estándar. Eso es una consecuencia de lo que hace el nivel — compra tiempo de reloj a cambio de gastar capacidad de servicio, y una suscripción es un producto de capacidad fija. Cobra la misma asignación por ocho veces el consumo de capacidad y la economía del plan se rompe a $20 al mes. Cobra ocho veces la asignación y el nivel simplemente se vuelve poco atractivo en un plan pequeño. De cualquier manera, el nivel termina donde la asignación es lo suficientemente grande como para absorberlo.
La API no tiene esa restricción, porque se mide por consumo. Ahí, Ultrafast tiene su propio presupuesto de límite de velocidad, separado de los presupuestos de Standard y Fast, y OpenAI describe esos límites como establecidos por organización en lugar de publicados en la página del nivel. Esa es una segunda cosa que hay que vigilar y que el anuncio no destacó: cambiar una carga de trabajo a Ultrafast no solo multiplica la factura, sino que traslada la carga de trabajo a un techo distinto, y si aumentas el tráfico más allá de lo que se le concedió a la organización, los límites del propio nivel se convierten en el modo de fallo.
La aritmética de comprar velocidad de dos maneras diferentes
Esta es la decisión en números, y es la parte que vale la pena calcular con tus propios recuentos de tokens en lugar de con los míos. Toma una sesión de agente que envía 30.000 tokens de entrada y recibe 1.500 tokens de salida por turno, a lo largo de 40 turnos.
• Total de tokens por ejecución — 1.200.000 de entrada, 60.000 de salida, repartidos en 40 solicitudes que se sitúan cada una cómodamente por debajo del umbral de 272.000 tokens en el que OpenAI recalcula el precio de toda la solicitud.
• En GPT-6.1 Sol estándar: 1,2 millones de tokens a 2,00 $ por millón son 2,40 $, más 60.000 a 10,00 $ por millón son 0,60 $. Tres dólares por ejecución.
• Con GPT-6.1 Sol Ultrafast: 1,2 millones a $12,00 son $14,40, más 60.000 a $60,00 son $3,60. Dieciocho dólares por ejecución.
• La diferencia: $15.00 por ejecución para eliminar la mayor parte del tiempo de generación en un trabajo que, por lo demás, no cambia.
Esos $15.00 por ejecución son la cifra que hay que comparar con la suscripción. Si la única razón por la que estás considerando el plan Pro es Ultrafast, aproximadamente 33 ejecuciones al mes con estos recuentos de tokens es el punto en que los $500 del plan y el medidor por token de la API se cruzan: por debajo de eso, el medidor es la forma más barata de comprar el mismo nivel, y por encima, el plan empieza a ganar. Tus recuentos de tokens moverán ese punto de cruce, a veces bastante, así que haz tus propios cálculos antes de tratar 33 como un umbral. Es nuestra aritmética sobre una carga de trabajo declarada, no un punto de equilibrio publicado.

p>Dos notas estructurales que sobreviven a cualquier recuento de tokens.
La afirmación sobre la velocidad es prestada, y es lo único que hay que leer con atención.
Ultrafast se vende con la promesa de "hasta 8 veces más rápido", y la única medición específica del modelo que OpenAI publica detrás de esa frase pertenece a un modelo diferente. La frase en su documentación dice que GPT-6 Astra Ultrafast genera tokens hasta 8 veces más rápido que GPT-6 Astra en modo Standard en Codex. Esa es una cifra de Astra, medida en Codex. La documentación del nivel de GPT-6.1 Sol lo describe como una reducción del tiempo entre tokens y remite a una tabla de tarifas; no le pone una cifra, y ningún tercero independiente ha publicado tampoco una medición de tokens por segundo para la variante Sol.
Bien podría sostenerse. Ambos modelos se ejecutan sobre la misma pila de servicio y el mecanismo de niveles es el mismo, así que un múltiplo de Astra es un prior razonable para Sol. Pero "hasta 8x" es un techo del proveedor, sin reproducir, tomado de un modelo hermano — y el "hasta" hace un trabajo real en esa frase. Trata el múltiplo como una hipótesis que pones a prueba con tus propios prompts, porque la propia documentación del nivel nunca la prueba por ti.
La misma salvedad es más barata de formular en el caso de los niveles más antiguos. Ultrafast sobre GPT-5.6 Sol se anunció el 13 de agosto de 2026 con "hasta 14 veces más rápido que el procesamiento Standard" en vista previa limitada, y tres meses después la documentación sigue indicando acceso de vista previa, mientras que la tabla de tarifas de Ultrafast contiene exactamente dos filas: GPT-6 Astra y GPT-6.1 Sol. Un número de 14x sin precio publicado y sin disponibilidad general es más una afirmación que un producto, y es un recordatorio útil de cuánto de esta escalera de niveles sigue siendo aspiracional.
Si el plan de $500 no se va a llevar a cabo
Para quien no vaya a comprar Pro de $500 para probar un nivel de latencia, lo útil es separar las dos cosas que el anuncio agrupó. El nivel está disponible en la API para todos los usuarios de la API, así que la vía rápida se puede comprar sin suscripción —a $12.00 y $60.00 por millón de tokens, con su propio presupuesto de límite de tasa, en una carga de trabajo lo bastante pequeña como para medirla—. Pruébala ahí primero, con tus propios prompts, frente a la vía estándar.
El carril estándar es el que existe al margen de todo esto. OrcaRouter sirve GPT-6.1 Sol como openai/gpt-6.1-sol a las tarifas de lista de OpenAI — $2.00 por millón de tokens de entrada y $10.00 por millón de tokens de salida — con un 0 % de margen comercial y el precio del proveedor traspasado directamente, de modo que un cambio de precios del proveedor se refleja de nuestro lado el mismo día. Ultrafast no es algo que vendamos: es un indicador de nivel de servicio que se factura en tu propia cuenta de OpenAI, y preferimos decirlo con claridad antes que dejar que una página de modelo insinúe lo contrario. Lo que sí compra una sola clave es la capacidad de enrutar el carril estándar y el resto del catálogo — más de 200 modelos detrás de un único endpoint compatible con OpenAI — y de conmutar automáticamente entre proveedores cuando uno está degradado, lo que es el seguro más barato disponible si estás a punto de poner un nivel de latencia delante de una ruta de producción.

Y si tienes Plus o Team y la respuesta que buscabas era «¿puedo simplemente activar esto?», la respuesta es no, con un matiz concreto. Codex y ChatGPT funcionan en Pro de $500 o en un plan Enterprise o Edu elegible, habilitados por un administrador si es del tipo empresarial. Todo lo demás llega a Ultrafast a través de la API y paga por token.
Qué ver a continuación
Tres cosas convertirían esto de un despliegue restringido en uno normal, y las tres son observables. Un límite de velocidad de Ultrafast publicado para GPT-6.1 Sol acabaría con las conjeturas sobre si el propio techo del nivel se impone antes que la factura. Una medición de velocidad específica del modelo —o una independiente— sustituiría el número prestado de Astra por algo con lo que se pueda evaluar el nivel Sol. Y que Ultrafast llegue a ChatGPT Plus significaría que el cálculo de capacidad cambió, lo cual es la señal de que la restricción era escasez de lanzamiento y no la forma permanente del nivel.
Hasta entonces, el resumen honesto es acotado y verificable. GPT-6.1 Sol se lanzó el 29 de septiembre de 2026 y no ha cambiado. El 8 de octubre de 2026 obtuvo una vía rápida con un precio real, abierta a los usuarios de la API y restringida en ChatGPT al plan de $500 —un detalle que merecía la primera publicación en lugar de la tercera, y que decide para la mayoría de los lectores si esto es una partida o una orden de compra.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
