Una tarjeta hero generada con el título «Un nivel, tres modelos» y tres chips que dicen «GPT-6.1 Sol Ultrafast: disponible, $12.00 / $60.00», «GPT-6 Astra Ultrafast: disponible, $60.00 / $300.00» y «GPT-5.6 Sol Ultrafast: solo vista previa, sin tarifa publicada», sobre un pie de página que dice «Según lo leído en la documentación de OpenAI el 9 de octubre de 2026».
Guides & Insights

GPT-6.1 Sol Ultrafast vs GPT-5.6 Sol Ultrafast: Un nivel, tres modelos, uno de ellos aún en espera

Autor

Alistair Wren

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

GPT-6.1 Sol Ultrafast y GPT-5.6 Sol Ultrafast son el mismo nivel de servicio aplicado a dos generaciones distintas de Sol, y después del 8 de octubre de 2026 se encuentran en estados opuestos. GPT-6.1 Sol pasó de «próximamente» a una tarifa publicada — 12,00 $ por millón de tokens de entrada, 60,00 $ por millón de tokens de salida, seis veces la tarifa Estándar — disponible para todos los usuarios de la API, y para los usuarios de Codex y ChatGPT Work en el plan Pro de 500 $. GPT-5.6 Sol sigue donde empezó Ultrafast: un nivel anunciado, en vista previa limitada, sin ninguna fila en la página de precios. El mismo nombre, el mismo mecanismo, y solo uno de ellos es algo que puedes comprar.

Esa es la versión corta. La versión larga importa porque las cifras de velocidad destacadas del nivel corresponden a modelos distintos, se midieron en superficies distintas y, en un caso, tienen tres meses de antigüedad.

Qué es realmente "Ultrafast" en cada modelo

En ninguno de los dos modelos Ultrafast es un checkpoint aparte. Envías el mismo id de modelo y cambias el nivel de servicio — model: "gpt-6.1-sol" con service_tier: "ultrafast" en la API de Responses — y OpenAI programa tu solicitud en la ruta de baja latencia. Los pesos, las respuestas y la ventana de contexto no cambian. En GPT-6.1 Sol esa ventana es de 1,050,000 tokens, con un máximo de 922,000 tokens de entrada y 128,000 de salida; GPT-5.6 Sol tiene la misma ventana y el mismo techo de salida, y se diferencia principalmente en la fecha de corte de conocimiento (16 de febrero de 2026 frente al 30 de abril de 2026) y en la escalera de razonamiento, donde GPT-5.6 Sol todavía acepta none y GPT-6.1 Sol no.

Así que la comparación no es «qué modelo piensa más rápido». Es «qué generación del mismo nivel está disponible para ti», y la respuesta cambió hace cuatro días.

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the WebSockets recommendation warning that network overhead can reduce the latency gains without a persistent connection, the note that Ultrafast has separate rate limits from Standard and Fast modes, the line that GPT-6.1 Sol supports US and EU data residency, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

Los múltiplos publicados, y el único número que se mantuvo en 14x

OpenAI ha publicado dos afirmaciones de velocidad sobre este nivel, referidas a dos modelos, y ninguna constituye una declaración general sobre «Ultrafast».

• GPT-6 Astra Ultrafast — "genera tokens hasta 8 veces más rápido que GPT-6 Astra en modo Estándar en Codex". Este es el titular actual del nivel, repetido en la documentación de velocidad del lado de ChatGPT.

• GPT-5.6 Sol Ultrafast — anunciado el 13 de agosto de 2026 por ejecutarse "hasta 14 veces más rápido que el procesamiento Estándar", en vista previa limitada para clientes selectos.

Fíjate en lo que falta. No hay un múltiplo de velocidad publicado para GPT-6.1 Sol Ultrafast. Su página de documentación describe el nivel, indica sus límites de tasa y su postura de residencia de datos, y remite a la tabla de precios, pero el único múltiplo específico de un modelo en todo el conjunto de documentación pertenece a Astra. La postura honesta es que "hasta 8x" es la medición de Astra, en la misma pila de servicio, y es el número con el que se está vendiendo el despliegue sin que nadie lo haya reproducido para Sol, dentro de OpenAI o fuera.

El número 14x merece más sospecha de la que suele recibir, por lo antiguo que es. Anunciado a mediados de agosto para un nivel que todavía no ha alcanzado la disponibilidad general, ha permanecido sin revisión durante aproximadamente dos meses mientras el propio nivel se reconstruía en torno a otros dos modelos. En ese tiempo, lo obvio que cabía esperar —que 5.6 Sol's Ultrafast se graduara de la vista previa y recibiera un precio— nunca ocurrió. En cambio, GPT-6 Astra lo recibió el 29 de septiembre y GPT-6.1 Sol lo recibió el 8 de octubre. Un número que solo existe en un anuncio, vinculado a una configuración que nadie puede comprar, es texto de marketing hasta que figura en una hoja de tarifas.

Lado a lado: cuánto cuesta cada uno y quién puede acceder a él

• Tarifa estándar — GPT-6.1 Sol $2.00 de entrada / $0.10 en caché / $2.50 de escritura en caché / $10.00 de salida por 1M de tokens frente a GPT-5.6 Sol $4.00 / $0.40 / $5.00 / $20.00

• Tarifa ultrarrápida — GPT-6.1 Sol $12.00 / $0.60 / $15.00 / $60.00, publicada mediante la regla 6x-Standard y su propia fila en la tabla de precios de Ultrafast frente a GPT-5.6 Sol, sin tarifa publicada

• Contexto largo superior a 272K tokens de entrada — GPT-6.1 Sol con precios ajustados a 2x las tarifas de entrada y de caché y 1.5x las de salida para toda la solicitud, lo que da una línea de contexto largo Ultrafast de 24,00 $ / 1,20 $ / 30,00 $ / 90,00 $ frente al equivalente Ultrafast de GPT-5.6 Sol, que nadie ha publicado

• Disponibilidad del nivel — GPT-6.1 Sol: todos los usuarios de la API, sujeto a límites de uso independientes, y Codex, además de ChatGPT Work en Pro de $500 y en los planes Enterprise y Edu elegibles, frente a GPT-5.6 Sol: vista previa limitada para clientes selectos de la API

• Límites de uso en el lanzamiento — GPT-6.1 Sol tiene su propio presupuesto Ultrafast, independiente de los límites Standard y Fast, configurado por organización y ampliado a petición en comparación con GPT-5.6 Sol, no publicado

• Residencia de datos — GPT-6.1 Sol admite residencia en EE. UU. y la UE, y procesamiento global con Fast y Ultrafast, frente a GPT-5.6 Sol, residencia en EE. UU. y procesamiento global

• Múltiplo de velocidad — GPT-6.1 Sol, ninguno publicado vs. GPT-5.6 Sol, «hasta 14x» en el anuncio de agosto, no reproducido

• Límite de contexto y de salida — 1.050.000 y 128.000 para ambos

Hay una asimetría en esa lista que merece la pena destacar. GPT-6.1 Sol es la única configuración Ultrafast con residencia de datos en la UE: el Ultrafast de Astra es solo para EE. UU., y 5.6 Sol no está abierto en absoluto. Si tu carga de trabajo está restringida al procesamiento en la UE, el 8 de octubre es la primera fecha en la que este nivel estuvo disponible para ti en cualquier forma.

En una suscripción, la diferencia es un plan, no un modelo

En Codex y ChatGPT Work, ambas generaciones se comportan de la misma manera estructuralmente —Ultrafast es un ajuste de velocidad en un modelo que ya tienes—, pero la puerta frente a él es nueva. Ultrafast está disponible en Pro $500 y en planes Enterprise y Edu elegibles, y está desactivado de forma predeterminada en los espacios de trabajo de Enterprise hasta que un administrador lo habilite. Dentro de una suscripción, el uso incluido se consume a 8x la tarifa Estándar y los créditos comprados o el pago por uso de Enterprise se facturan a 6x; en la API, el multiplicador es el 6x fijo en cada línea de precios.

En el caso específico de GPT-5.6 Sol, todavía no se puede acceder a nada de eso. No hay una vía de suscripción —la documentación de velocidad del lado de ChatGPT enumera a Ultrafast como compatible con GPT-6 Astra y GPT-6.1 Sol— y la vía de la API sigue restringida a una cohorte de vista previa. Sea lo que sea que prometa la cifra de 14x, se lo está prometiendo a un conjunto de cuentas que no se ha ampliado en dos meses.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing exactly two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

¿Cuál usar realmente y cuándo esperar?

Si empiezas hoy, la pregunta casi se responde sola: GPT-6.1 Sol Ultrafast se puede comprar, tiene precio y está documentado, y GPT-5.6 Sol Ultrafast no. La razón para decantarse por el modelo anterior no es el nivel en absoluto — es que GPT-5.6 Sol está en circulación desde el 9 de julio de 2026, y si tienes suites de prompts, evaluaciones y modelos de costes construidos sobre él, el coste de migración de pasar a una actualización de Sol con un corte de conocimiento distinto y una escalera de razonamiento estrictamente más estrecha es real, incluso cuando el precio se reduce a la mitad. Haz ese cambio según su propio calendario, no porque por fin haya llegado una configuración de velocidad.

La regla de decisión para el propio nivel es la que implican los números de Astra y validan los de Sol: seis veces el precio por una reducción de latencia es un buen intercambio cuando un humano o un agente está bloqueado esperando la salida, y uno malo cuando un trabajo tiene hasta la mañana. Nada en el lanzamiento de GPT-6.1 Sol cambia esa aritmética; solo lo hace disponible en un modelo base más barato, donde la factura absoluta por un turno rápido es menor.

Y si en lugar de eso quieres el nivel Fast, puedes deducirlo únicamente a partir de la tabla de tarifas: 2x Standard, y Fast ha sido la opción intermedia estable desde que OpenAI renombró Priority processing el 30 de julio de 2026. Ultrafast sigue siendo el nivel en el que compras una promesa no medida y, en el lado de GPT-5.6 Sol, una que no puedes comprar en absoluto.

Llamar a cualquiera de los dos desde una sola tecla

GPT-5.6 Sol y GPT-6.1 Sol de nivel estándar están ambos en OrcaRouter: openai/gpt-5.6-sol a $4.00 de entrada y $20.00 de salida por millón de tokens, openai/gpt-6.1-sol a $2.00 y $10.00, servidos con un 0 % de margen, con el precio de lista del proveedor repercutido tal cual, de modo que un cambio de precio del proveedor llega a tu factura el mismo día en que llega al tarifario. Eso importa más de lo habitual en este par, porque el $4.00 / $20.00 de GPT-5.6 Sol es explícitamente promocional y OpenAI afirma que estará disponible al menos hasta el 21 de noviembre de 2026. Cuando esa ventana se cierre, la brecha entre las dos generaciones se estrechará, y una plataforma que repercute los precios tal cual significa que te enteras en tus cifras de uso en lugar de en un correo de renovación.

La misma clave y el mismo endpoint soportan más de 200 modelos, así que comparar las dos generaciones de Sol con tu propio tráfico no requiere dos integraciones ni dos contratos, y la conmutación automática por fallo mantiene en pie una ruta de producción si un proveedor se degrada. Cuando una sola respuesta no basta, el DSL de enrutamiento compone varios modelos en una única llamada y la fusión de modelos coloca un panel detrás de ella.

Lo que no servimos es Ultrafast. En cualquiera de los dos modelos, es un flag de nivel de servicio en una cuenta de OpenAI en lugar de un modelo enrutable por separado, así que permanece dentro de tu integración directa con OpenAI — y en GPT-5.6 Sol ni siquiera está disponible de forma general allí. Lo decimos claramente porque la alternativa es dar a entender una capacidad que no tenemos. Y esa no es una frase que queramos en este blog.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1,050,000-token context window, 128K maximum output, text and image input with text output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.36 s, a 2.86 s figure and 85.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario