
GPT-6.1 Sol Ultrafast llega a la API, Codex y ChatGPT Work
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAIGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
OpenAI está lanzando el modo Ultrafast para GPT-6.1 Sol — el nivel de servicio más rápido que vende, y la primera vez que el nivel casi-Astra Sol ha tenido uno. La medida coloca a GPT-6.1 Sol en la misma categoría que GPT-6 Astra Ultrafast en la API, en Codex y en ChatGPT Work, y llega con una tarifa publicada en lugar de una lista de espera: $12.00 por millón de tokens de entrada y $60.00 por millón de tokens de salida, exactamente seis veces lo que el estándar GPT-6.1 Sol cuesta. La afirmación de velocidad en la etiqueta es "hasta 8x". La parte interesante es qué está midiendo esa frase, y la respuesta no es el modelo por el que estás a punto de pagar.
El registro de cambios para desarrolladores incluye la entrada con fecha del 8 de octubre: «Se añadió el modo Ultrafast para GPT-6.1 Sol en la API de Responses. Usa gpt-6.1-sol con service_tier: "ultrafast" para reducir el tiempo entre los tokens de salida generados. Está disponible para todos los usuarios de la API, sujeto a límites de tasa, con procesamiento global y residencia de datos en EE. UU. y la UE.» La página de documentación de Ultrafast ahora dice «disponible de forma general para GPT-6 Astra y GPT-6.1 Sol, con acceso en vista previa para GPT-5.6 Sol», y la página de velocidad del lado de ChatGPT confirma la parte de suscripción: Ultrafast está disponible en Codex y ChatGPT Work en Pro de $500 y en planes Enterprise y Edu elegibles.
Ultrafast es un nivel de servicio, no un segundo modelo
Nada de los pesos cambia. El mismo checkpoint, la misma ventana de contexto de 1,050,000 tokens, la misma entrada máxima de 922,000 tokens, el mismo techo de salida de 128,000 tokens, la misma fecha de corte de conocimiento del 30 de abril de 2026, las mismas respuestas. Lo que compras es una prioridad de programación: el modelo genera tokens más rápido, y el propio planteamiento de OpenAI es deliberadamente limitado — el nivel «reduce el tiempo entre los tokens de salida generados». No hace que el modelo sea más inteligente, ni acorta la fase de razonamiento.
Esa distinción lo decide todo. Para un bucle de agente que hace cuarenta llamadas a herramientas seguidas, la ganancia se multiplica porque la salida de cada turno llega antes. Para una única solicitud de razonamiento complejo que pasa la mayor parte de su tiempo real deliberando, puedes pagar seis veces más y ver el mismo indicador de carga.
La escalera de niveles, una vez, en términos sencillos:
• Batch and Flex — la mitad que Standard, el carril barato para trabajo que nadie está esperando
• Estándar — $2.00 de entrada / $0.10 en caché / $2.50 de escritura en caché / $10.00 de salida por millón de tokens
• Fast — el doble que Standard, o $4.00 / $0.20 / $5.00 / $20.00; OpenAI renombró Priority processing a modo Fast el 30 de julio de 2026
• Ultrarrápida — seis veces la Estándar, o $12.00 / $0.60 / $15.00 / $60.00
• Más de 272K tokens de entrada — toda la solicitud se vuelve a tarificar a 2x las tarifas de entrada y de caché, y 1.5x la de salida; Ultrafast de contexto largo es $24.00 / $1.20 / $30.00 / $90.00
La aritmética que nadie pone en la página de marketing
Pagar seis veces el precio por ocho veces la velocidad no es un intercambio deficitario, y tampoco es un almuerzo gratis. Ultrafast se factura por token, así que un trabajo que cuesta $1.00 en Standard cuesta $6.00 en Ultrafast —y termina en aproximadamente una octava parte del tiempo. El ahorro no está en la factura, sino en el tiempo de reloj. Estás pagando cinco dólares extra para eliminar siete octavos del tiempo de cola de ese trabajo, y que eso sea barato o absurdo depende por completo de cuánto vale por minuto la persona o el pipeline que espera al otro lado.
De ello se derivan dos implicaciones, y son precisamente las que se pasan por alto:
• El trabajo interactivo es el sí fácil. Un desarrollador viendo cómo aterriza un diff, un agente que no puede continuar hasta haber leído el resultado: esos son los casos en los que la latencia es el producto. Una salida ocho veces más rápida en un bucle de cuarenta turnos no es una mejora marginal para la percepción humana; es la diferencia entre una herramienta que usas y una herramienta que mandas a segundo plano.
• El trabajo programado y por lotes es un no fácil. Si un trabajo tiene hasta la mañana de todos modos, Ultrafast es una factura 6 veces mayor para nada, y el carril Batch a mitad de precio está ahí mismo.
La entrada en caché merece un segundo vistazo porque también se mueve: $0,60 por millón en Ultrafast frente a $0,10 en Standard, todavía el 5% de la tarifa de entrada sin caché. Los agentes con caché de prompt que reenvían un gran prompt de sistema en cada turno descubrirán que el descuento de caché escala con el nivel en lugar de protegerlos de él.

De dónde viene el número «hasta 8x»
Esta es la parte que hay que leer con atención, porque es donde el titular del despliegue y la documentación del despliegue describen, de forma sutil, cosas distintas.
La única medición de velocidad específica del modelo que OpenAI publica es esta frase: "GPT-6 Astra Ultrafast genera tokens hasta 8 veces más rápido que GPT-6 Astra en modo Estándar en Codex". Esa es una cifra de Astra, medida en Codex. No hay un múltiplo equivalente publicado para GPT-6.1 Sol. El documento que cubre Ultrafast para este modelo reduce el tiempo de generación de tokens de salida y apunta a un precio; no le pone un número. La velocidad del lado de ChatGPT repite la frase de Astra y se detiene.
Así que la lectura honesta de «hasta 8 veces más rápido» es: es el titular del nivel, proveniente del modelo hermano que ha estado en Ultrafast desde el 29 de septiembre, y es una afirmación del proveedor que ninguna parte independiente ha reproducido para ninguno de los dos modelos. Bien puede ser válido para GPT-6.1 Sol —los dos se ejecutan en la misma pila de servicio y el mecanismo del nivel es el mismo—, pero nadie fuera de OpenAI ha publicado una medición de tokens por segundo para la variante Sol, y el «hasta» desempeña una función real en esa frase.
También vale la pena mantener los niveles separados por modelo, porque el más antiguo sigue siendo un asunto pendiente. Ultrafast se anunció el 13 de agosto de 2026 para GPT-5.6 Sol con «hasta 14 veces más rápido que Standard processing», en vista previa limitada para clientes selectos. Tres meses después, la documentación sigue diciendo que GPT-5.6 Sol tiene «acceso de vista previa» y la tabla de precios de Ultrafast contiene exactamente dos filas: GPT-6 Astra y GPT-6.1 Sol. Un número de 14x que nunca ha alcanzado disponibilidad general y que no tiene tarifa publicada es una afirmación, no un producto.

¿Quién puede encenderlo de verdad?
El lado de la API es amplio; el lado de la suscripción es estrecho, y la diferencia pilla a la gente por sorpresa.
• API — disponible para todos los usuarios de API en gpt-6.1-sol, separado de Standard y Fast. Eso significa un segundo presupuesto que vigilar, no solo un segundo precio.
• Límites de velocidad ultrarrápidos para GPT-6.1 Sol — 1.000.000 de tokens por minuto en Build, 4.000.000 en Launch, 40.000.000 en Grow. OpenAI simplificó sus niveles de uso de cinco a tres el 6 de octubre, así que esos tres nombres son la escala actual, no una heredada del pasado.
• Residencia de datos — GPT-6.1 Sol admite residencia de datos en EE. UU. y la UE, así como procesamiento global, incluso con Fast y Ultrafast. Ultrafast de Astra no obtiene residencia en la UE, así que si tu carga de trabajo está fijada a la UE, esta es la primera configuración de Ultrafast que puedes contratar.
• Codex y ChatGPT Work — Ultrafast está disponible en el plan Pro de $500 y en los planes Enterprise y Edu elegibles. Los administradores de Enterprise lo tienen desactivado de forma predeterminada y deben activarlo por usuario o por espacio de trabajo.
• Chat — no incluido. GPT-6.1 Sol en sí mismo vive en Work y Codex; la superficie de Chat para consumidores no forma parte de esto.
• Cómo se factura en una suscripción — el uso incluido se consume a 8 veces la tarifa Estándar, y los créditos comprados o el pago por uso de Enterprise se facturan a 6 veces la tarifa Estándar. Vale la pena conocer ambos números antes de dejarlo activado.
Un detalle de implementación determina si llegas a ver algo de la velocidad en absoluto. La guía de OpenAI es tajante al respecto: usa WebSockets, «especialmente para aplicaciones agénticas que hacen muchas llamadas a herramientas en rápida sucesión», porque «sin una conexión persistente, la sobrecarga de red puede reducir las ganancias de latencia». Si tu cliente abre una conexión HTTP nueva por cada llamada, la sobrecarga por solicitud puede comerse toda la ventaja del nivel por el que acabas de pagar 6 veces más. HTTP sigue funcionando. Simplemente puede que no valga la pena para ese nivel.
Qué enrutamos y qué no
El GPT-6.1 Sol de nivel estándar está en OrcaRouter como openai/gpt-6.1-sol a los propios $2.00 de entrada y $10.00 de salida por millón de tokens del proveedor, servido con un 0% de recargo — el precio de lista del proveedor pasado tal cual, así que cuando OpenAI cambia una tarifa, el cambio llega a tu factura el mismo día en que llega a la tarifa, y no en tu siguiente renovación de contrato. La misma clave y el mismo endpoint cubren más de 200 modelos, de modo que una llamada a GPT-6.1 Sol y una llamada a Claude o Qwen quedan detrás de una única integración con conmutación por error automática y sin un segundo contrato, y el DSL de enrutamiento compondrá modelos en una sola llamada cuando una tarea necesite más de una opinión.
Ultrafast no es uno de esos modelos, y sería engañoso insinuar lo contrario. Es un indicador de nivel de servicio en una cuenta de OpenAI: usted envía service_tier: "ultrafast" a gpt-6.1-sol y OpenAI factura a su propia cuenta según las tarifas anteriores, así que forma parte de su integración directa con OpenAI. Si lo activa, mantenga el tráfico por niveles en la clave de su proveedor y dirija el tráfico de volumen estándar a través de nosotros. Esa es la división honesta, y también es la más económica para todo lo que no esté esperando a una persona.

Qué hacer con él hoy
Si tienes una licencia de Codex o ChatGPT Work en Pro $500, el interruptor ya está ahí y la prueba no te cuesta nada salvo el multiplicador de uso: ejecuta la misma tarea de las dos maneras y comprueba si el bucle que realmente ejecutas tiene suficientes turnos para que aparezca el factor de ocho. Si usas la API, el experimento que vale la pena ejecutar es más acotado de lo que sugiere el anuncio: instrumenta cuánto de tu latencia es generación de tokens y cuánto es el modelo pensando, y luego dirige Ultrafast a la parte que realmente puede comprimir.
Y si tienes la opción de elegir entre Fast a 2x y Ultrafast a 6x para la misma solicitud, Fast es el nivel que llegó primero y aquel cuyo comportamiento puedes razonar solo con una lista de tarifas. Ultrafast es nuevo para este modelo, ninguna medición independiente le ha puesto precio, y vale exactamente lo que diga tu propio cronómetro.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
