Fecha de lanzamiento, características, precios y guía de acceso de GPT-5.6
Guides & Insights

Fecha de lanzamiento, características, precios y guía de acceso de GPT-5.6

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

GPT-5.6 Sol acaba de obtener un nivel de velocidad Ultrafast — hasta 14 veces más rápido que el procesamiento Standard, en vista previa en la API de Open​AI esta semana — mientras que GPT-5.6 Terra y GPT-5.6 Luna continúan el despliegue de la familia en ChatGPT. Dos meses después del lanzamiento de la API, la generación GPT​-5.6 está ampliamente disponible y sigue ganando capacidades: el mismo buque insignia que supera a GPT-5.5 en razonamiento ahora se puede previsualizar a hasta 750 tokens de salida por segundo. En la misma semana, Open​AI también amplió su programa de ciberseguridad Daybreak en Daybreak Blue para defensores y Daybreak Red, impulsado por un nuevo modelo GPT​-5.6-Cyber construido sobre Sol para la investigación autorizada de vulnerabilidades.

Open​AI lanzó la familia de modelos GPT​-5.6 el 9 de julio de 2026, y el 6 de agosto llevó el buque insignia a ChatGPT con una actualización centrada en la fiabilidad y un acceso gratuito ampliado. No se trata solo de otra actualización de un solo modelo. Es una familia escalonada diseñada para ofrecer a los desarrolladores opciones más claras en cuanto a inteligencia, velocidad y costo — y ahora también es la experiencia predeterminada para los usuarios gratuitos de ChatGPT.

El problema es que “GPT​-5.6” significa cosas diferentes en diferentes lugares.

La API está disponible desde el 9 de julio con precios públicos para los tres niveles. El despliegue de ChatGPT se realiza por fases: el Sol actualizado llegó a los usuarios de Plus y Pro el 6 de agosto, GPT-5.6 Luna se convierte en el modelo predeterminado para las cuentas Free y Go esta semana, y los chats de solo texto en esos niveles se vuelven ilimitados la semana del 10 de agosto. El Sol que impulsa las superficies Work y Codex de ChatGPT no se modificó con la actualización. La vista previa Ultrafast vuelve a ser independiente: un nuevo nivel de velocidad en la API, anunciado el 13 de agosto, inicialmente limitado a un pequeño grupo de clientes.

Así que GPT​-5.6 es oficial, está en distribución y es ampliamente accesible — y su buque insignia es ahora el modelo frontera más rápido sobre el papel. Para los desarrolladores, la parte interesante sigue siendo la decisión de enrutamiento: Sol para el razonamiento más difícil, Terra para el trabajo de producción equilibrado, Luna para el alto volumen — y, cuando se abra la vista previa, un nivel Ultrafast para cargas de trabajo de Sol con latencia crítica — con precios que cambiaron para dos de los tres niveles a finales de julio.

Esta guía explica qué es GPT​-5.6, qué está oficialmente confirmado, en qué se diferencian Sol, Terra y Luna, cómo funcionan los precios, qué significa la vista previa Ultrafast y por qué GPT​-5.6 hace que el enrutamiento de modelos sea más importante.

Respuesta rápida

¿Ya se ha lanzado GPT​-5.6? Sí. La API se lanzó el 9 de julio de 2026, y el acceso a ChatGPT se está implementando — Sol actualizado para Plus/Pro desde el 6 de agosto, Luna como la opción predeterminada para free/Go esta semana.

¿Puedo usar GPT-5.6 en ChatGPT? Sí. GPT-5.6 Sol es ahora el nuevo valor predeterminado en la experiencia de chat Plus/Pro (con un nuevo control deslizante de pensamiento), y GPT-5.6 Luna se convertirá en el modelo predeterminado para las cuentas Free y Go esta semana.

¿Puedo usar GPT-5.6 a través de la API? Sí. Sol, Terra y Luna están disponibles en la API pública con precios publicados, y en OrcaRouter con un margen del 0%.

¿Qué es el modo Ultrafast de GPT-5.6 Sol? Es un nivel de velocidad en vista previa en la API que ejecuta GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar, con hasta 750 tokens de salida por segundo. Inicialmente está limitado a un pequeño grupo de clientes, y Open​AI no ha publicado precios para él.

¿Hay una lista de espera? Para el acceso básico, no — la API es pública y el acceso a ChatGPT se está desplegando en todos los niveles, por lo que no hay nada a lo que apuntarse. El modo Ultrafast es diferente: es una vista previa limitada, abierta inicialmente a un pequeño grupo de clientes, con la posibilidad de registrarse para recibir notificaciones a medida que se amplíe la capacidad.

¿Cuándo estará disponible GPT​-5.6 de forma general? Ya está disponible, por fases: la API se lanzó el 9 de julio de 2026, el Sol actualizado llegó a ChatGPT Plus/Pro el 6 de agosto, Luna se convierte en la opción predeterminada de la versión gratuita/Go esta semana, y los chats de texto gratuitos ilimitados llegan la semana del 10 de agosto.

¿Deberías esperar a GPT-5.6? No si quieres usarlo — ya está disponible. La verdadera pregunta es a qué nivel enrutar cada tarea y cuánto razonamiento permitir, porque eso es ahora lo que determina tu costo por tarea.

¿Qué es GPT-5.6?

GPT​-5.6 es la familia de modelos más nueva de Open​AI y la generación sucesora de GPT-5.5.

La palabra clave es familia.

En lugar de lanzar un modelo para cada caso de uso, Open​AI está introduciendo tres niveles:

- GPT-5.6 Sol es el modelo insignia para los trabajos más difíciles: razonamiento profundo, codificación agéntica, investigación, trabajo de conocimiento profesional y tareas complejas con uso intensivo de herramientas.

- GPT-5.6 Terra es el modelo equilibrado para el trabajo diario. Está diseñado para ofrecer una gran capacidad a un menor coste, lo que lo hace más adecuado para aplicaciones de producción que no pueden enviar todas las solicitudes al modelo insignia.

- GPT-5.6 Luna es el nivel más rápido y rentable. Está diseñado para tareas de alto volumen, automatización ligera, resúmenes, clasificación, enrutamiento y otras cargas de trabajo donde la velocidad y el costo importan más que la máxima profundidad de razonamiento.

Esto cambia la pregunta principal que los desarrolladores deben hacerse.

La pregunta ya no es: ¿Debería usar GPT-5.6?

La mejor pregunta es: ¿Qué modelo GPT-5.6 debería manejar esta tarea?

No todas las solicitudes necesitan Sol. Algunas tareas requieren razonamiento máximo. Algunas necesitan menor latencia. Algunas necesitan el modelo confiable más económico. GPT-5.6 hace explícito ese equilibrio.

¿Qué está oficialmente confirmado?

GPT​-5.6 no debe tratarse como una recopilación de rumores. Open​AI ha confirmado oficialmente la familia de modelos y el acceso de vista previa.

Los puntos confirmados son:

GPT-5.6 es una familia de modelos con Sol, Terra y Luna.

Se lanzó en la API el 9 de julio de 2026, con precios públicos para los tres niveles.

- El acceso a ChatGPT se está implementando: Sol actualizado para Plus/Pro (6 de agosto), Luna como predeterminada para free/Go (esta semana), chats de texto gratuitos ilimitados (semana del 10 de agosto).

OpenAI informa que el Sol actualizado comete ~68% menos errores fácticos que GPT-5.5 Instant en evaluaciones internas financieras/médicas/legales (reportado por el proveedor; ~62% para Luna).

Los usuarios Plus y Pro obtienen un nuevo control deslizante de pensamiento para controlar cuánto razonamiento emplea cada respuesta.

- El precio de la API es público — y Terra y Luna se eliminaron a finales de julio de 2026 (Sol sin cambios).

GPT-5.6 introduce un almacenamiento en caché de prompts más predecible.

- GPT-5.6 Sol incluye un nuevo esfuerzo máximo de razonamiento.

GPT-5.6 introduce un modo ultra que utiliza subagentes para trabajos complejos.

OpenAI presentó el modo Ultrafast para GPT-5.6 Sol en la API el 13 de agosto de 2026 — hasta 14 veces más rápido que el procesamiento Standard, con hasta 750 tokens de salida por segundo, inicialmente para un pequeño grupo de clientes. Las cifras de velocidad son proporcionadas por el proveedor y aún no han sido reproducidas de forma independiente.

OpenAI amplió Daybreak, su programa de ciberseguridad verificado, a dos niveles el 10 de agosto de 2026: Daybreak Blue (GPT-5.6 Sol con las salvaguardas cibernéticas eliminadas, para trabajo defensivo) y Daybreak Red (GPT-5.6-Cyber, un modelo basado en Sol entrenado específicamente para investigación autorizada de vulnerabilidades). El acceso está restringido a clientes verificados y socios de seguridad, no a la API pública.

Las preguntas abiertas son diferentes:

¿Cómo se comparará el Sol ajustado con ChatGPT con el Sol de API en tareas reales?

¿Qué tan rápido será en flujos de trabajo de producción reales? La vista previa de Ultrafast es el primer dato real, y todavía es solo por invitación.

- ¿Con qué frecuencia las salvaguardas añadirán fricción?

- ¿Cómo se compararán Sol, Terra y Luna en tareas reales?

¿Cuánto razonamiento es suficiente, y cómo se dosifica el nuevo control deslizante de pensamiento?

¿Cómo se fijará el precio del nivel Ultrafast y con qué rapidez puede el suministro de Cerebras seguir el ritmo de la demanda?

Por eso el enfoque correcto es la preparación, no la migración ciega.

Fecha de lanzamiento y acceso a GPT-5.6

La respuesta más sencilla: GPT-5.6 se lanzó en la API el 9 de julio de 2026, y el acceso a ChatGPT se está implementando por fases a lo largo de agosto.

El acceso a la API ya está abierto para cualquier desarrollador con precios publicados. Lo que aún varía es la superficie: el Sol ajustado para la experiencia de Chat de ChatGPT no es el mismo que el modelo de API — Open​AI dice que la versión que impulsa Work y Codex no ha cambiado — por lo que el comportamiento puede diferir entre la aplicación de consumo y la API.

Para los usuarios de ChatGPT, el panorama de junio está invertido. Los usuarios de Plus y Pro obtienen el Sol actualizado con un nuevo control deslizante de pensamiento en web, móvil y escritorio, que intercambia la profundidad de la respuesta por la latencia. Los usuarios de Free y Go reciben Luna como opción predeterminada esta semana, además de un botón Think para preguntas más difíciles, y los chats de solo texto ilimitados llegarán la semana del 10 de agosto.

La parte más nueva de la historia del acceso es la vista previa Ultrafast. Anunciada el 13 de agosto de 2026, es un nuevo nivel de velocidad en la API para GPT-5.6 Sol — hasta 14 veces más rápido que el procesamiento Standard (según el proveedor) — y comienza con un pequeño grupo de clientes en lugar de un lanzamiento abierto. Open​AI dice que está probando el nivel en programación, comercio, investigación financiera, atención al cliente y aplicaciones interactivas para aprender dónde la velocidad crea valor real antes de ampliar el acceso. Otros clientes pueden inscribirse para recibir notificaciones cuando la capacidad aumente.

Para los desarrolladores, la frase segura ahora es: GPT-5.6 es una familia de API publicada y con precio. La incertidumbre restante es de comportamiento — cuánto piensa cada nivel, cuán verboso es, y qué cuesta por tarea completada — no si puedes obtener acceso. El nivel Ultrafast es el único lugar donde el acceso sigue siendo la pregunta.

Esa distinción importa. No planifiques un lanzamiento en torno a una fecha de acceso a GPT-5.6; planifica en torno al comportamiento de los niveles y al costo por tarea. Construye tu conjunto de evaluación, mide el esfuerzo de razonamiento y mantén una ruta de respaldo.

GPT-5.6: Sol, Terra y Luna explicados

GPT-5.6 Sol

Sol es el modelo a probar cuando la calidad importa más que el costo.

Úselo para:

ingeniería de software compleja

flujos de trabajo de codificación basados en agentes

uso de herramientas a largo plazo

depuración difícil

análisis de investigación

razonamiento empresarial de alto riesgo

- defensa de ciberseguridad e investigación de vulnerabilidades

Sol es el nivel insignia, pero eso no significa que deba gestionar cada solicitud.

El 6 de agosto de 2026, Open​AI también ajustó el Sol que se ejecuta en la experiencia de Chat de ChatGPT para la conversación cotidiana: más fiable con los datos, respuestas más directas y un tono constante entre Instant y Thinking. Las evaluaciones internas de Open​AI, no un laboratorio independiente, situaron los errores fácticos aproximadamente un 68% más bajos que GPT-5.5 Instant en consultas financieras, médicas y legales. El ajuste de ChatGPT es independiente del modelo de API; el Sol detrás de Work y Codex no ha cambiado.

Sol es también el nivel que recibe la vista previa de Ultrafast. El 13 de agosto de 2026, Open​AI presentó en vista previa un modo Ultrafast para Sol en la API que ejecuta el mismo modelo hasta 14X más rápido que el procesamiento estándar (según el proveedor), orientado a trabajos de latencia crítica. Aún no está disponible de forma general — la vista previa comienza con un pequeño grupo de clientes — pero es la primera señal de que la calidad de Sol no tiene que venir con la latencia del nivel estándar.

Sol es también el modelo detrás del programa Daybreak de Open​AI: Daybreak Blue sirve GPT-5.6 Sol con salvaguardas cibernéticas eliminadas a defensores verificados, y GPT​-5.6-Cyber está entrenado específicamente en Sol para la investigación autorizada de vulnerabilidades. Ambos niveles son de acceso restringido y se encuentran fuera de la API pública.

GPT-5.6 Terra

Terra es la opción equilibrada.

Úselo para:

- asistentes de IA cotidianos

- Redacción empresarial y análisis

herramientas de conocimiento interno

flujos de trabajo de atención al cliente

- Ayuda de codificación que no necesita razonamiento máximo

- procesamiento de documentos

- automatización de complejidad media

Terra podría convertirse en el nivel GPT-5.6 más práctico para muchas aplicaciones de producción porque equilibra capacidad y precio.

GPT-5.6 Luna

Luna es el nivel rápido y asequible.

Úselo para:

- solicitudes de alto volumen

- clasificación

- enrutamiento

- resumen

- transformaciones simples

pasos de agente ligero

- respuestas de respaldo

generación de borrador

Luna es útil cuando la tarea es lo suficientemente simple como para que pagar por Sol sería un desperdicio.

Luna ahora también es el modelo predeterminado para los consumidores: OpenAI convirtió a GPT-5.6 Luna en el modelo detrás de las cuentas Free y Go de ChatGPT en la semana del 3 de agosto de 2026, reemplazando a GPT-5.5 Instant. Un nuevo botón Think permite a esos usuarios solicitar un razonamiento más avanzado, y los chats de solo texto se vuelven ilimitados la semana del 10 de agosto.

Precios y caché de GPT-5.6

El precio de GPT-5.6 ya es público.

GPT-5.6 Sol

$5 por 1 millón de tokens

Salida: $30 por 1M tokens

- Mejor para razonamiento de primer nivel, codificación compleja y trabajo agéntico profundo

GPT-5.6 Terra

$2 por 1M de tokens (reducido desde $2,50 a finales de julio de 2026)

- Salida: $12 por 1M de tokens (reducido de $15)

- Mejor para el trabajo diario equilibrado

GPT-5.6 Luna

$0.20 por 1M de tokens (reducido de $1)

Salida: $1.20 por 1M de tokens (antes $6)

- Ideal para cargas de trabajo rápidas, asequibles y de alto volumen

Open​AI recortó Terra un 20% y Luna un 80% a finales de julio de 2026, citando ganancias en eficiencia de inferencia; Sol se mantuvo en $5/$30. Debido a que OrcaRouter traslada los precios de los proveedores con un margen del 0%, esos recortes aparecen en nuestras páginas de modelos el mismo día en que se publican.

La vista previa Ultrafast aún no tiene un precio publicado. Es una vista previa limitada para un pequeño grupo de clientes, y OpenAI no ha dicho cómo se facturará el nivel, así que no asumas que la tarifa Sol de $5/$30 se aplica a ella. Vale la pena observar eso junto con las cifras de velocidad: si un nivel de velocidad premium llega con un precio premium, el cálculo de costo por token para cargas de trabajo críticas en cuanto a latencia cambia.

El precio deja una cosa clara: GPT-5.6 no está pensado para usarse como un único modelo predeterminado para cada tarea.

Una estrategia de enrutamiento sensata podría verse así:

- usa Luna para tareas simples y de alto volumen;

- use Terra para el razonamiento cotidiano y los flujos de trabajo empresariales;

- usar Sol para las tareas más difíciles de codificación, investigación o agentes;

- almacenar en caché el contexto repetido de forma agresiva;

- evitar enviar todas las solicitudes a Sol por defecto.

GPT-5.6 también introduce un almacenamiento en caché de prompts más predecible, incluidos puntos de ruptura de caché explícitos y una vida mínima de caché de 30 minutos. Para flujos de trabajo de larga duración, agentes de codificación y asistentes empresariales, esto puede ser muy importante.

La conclusión práctica: Mide el costo por tarea completada, no solo el costo por token.

Un modelo más caro puede resultar más barato si completa el trabajo en menos intentos. Un modelo más barato puede ser mejor cuando la tarea es simple y de gran volumen.

¿Qué hay de nuevo en GPT-5.6?

GPT​-5.6 no debería describirse principalmente mediante números de ventana de contexto rumoreados o registros internos filtrados.

Los cambios importantes son los que Open​AI ha confirmado.

Una familia de modelos de tres niveles

Sol, Terra y Luna hacen que la selección de modelos sea más estructurada. Los desarrolladores pueden enrutar tareas según la dificultad, la latencia y el costo, en lugar de enviarlo todo a un modelo emblemático.

Flujos de trabajo agentivos y de codificación más potentes

GPT-5.6 Sol está posicionado en torno a la codificación agéntica, flujos de trabajo de línea de comandos, planificación, iteración y coordinación de herramientas.

Eso importa porque los agentes de codificación modernos hacen más que escribir fragmentos. Inspeccionan repositorios, ejecutan comandos, entienden fallos en pruebas, corrigen archivos, verifican cambios y repiten hasta completar la tarea.

Nuevo máximo esfuerzo de razonamiento

Sol introduce un nuevo máximo esfuerzo de razonamiento para tareas más difíciles.

Esto no debe usarse en todas partes. El razonamiento avanzado puede aumentar el costo y la latencia, por lo que debe reservarse para trabajos donde valga la pena una planificación más profunda: depuración compleja, migraciones, síntesis de investigación, revisión de seguridad o análisis de datos difícil.

Modo Ultra con subagentes

GPT-5.6 introduce un modo ultra que utiliza subagentes para trabajos complejos.

Esto apunta hacia un futuro en el que los modelos no solo responden a indicaciones. Coordinan el trabajo a través de múltiples pasos o agentes especializados.

Modo ultrarrápido: GPT-5.6 Sol a una velocidad de hasta 14X

El 13 de agosto de 2026, Open​AI presentó Ultrafast, un nuevo nivel de servicio en la API que ejecuta GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar, generando hasta 750 tokens de salida por segundo. Open​AI afirma que este nivel ofrece la misma inteligencia que GPT-5.6 Sol Standard — la aceleración se debe a la latencia, no a un modelo más pequeño o más débil. Estas cifras de velocidad son proporcionadas por el proveedor: Open​AI las anunció junto con su socio de inferencia Cerebras, y ningún laboratorio independiente las ha reproducido todavía.

La velocidad proviene de una pila de inferencia diferente, no de un modelo diferente. Ultrafast se ejecuta en la arquitectura Wafer-Scale Engine de Cerebras, que mantiene los pesos del modelo en el chip (44 GB de SRAM por chip del tamaño de una oblea) y elimina el cuello de botella del ancho de banda de memoria que limita la inferencia basada en GPU. Para este nivel, Open​AI está utilizando el hardware de Cerebras en lugar del suyo propio.

Ultrafast es inicialmente una vista previa limitada. Un pequeño grupo de clientes obtiene acceso primero, y Open​AI dice que está probando el nivel en programación, comercio, investigación financiera, atención al cliente y aplicaciones interactivas para aprender dónde la velocidad genera valor. Otros clientes pueden registrarse para recibir notificaciones cuando se amplíe la capacidad. Todavía no hay un precio publicado ni una fecha de disponibilidad general.

Open​AI y Cerebras también publicaron cifras comparativas, todas reportadas por los proveedores y basadas en datos de velocidad de salida de Artificial Analysis: Ultrafast afirma ser 5 veces más rápido que Claude Opus 4.8 en modo rápido y 11 veces más rápido que Claude Fable 5; en el conjunto de 2,500 preguntas de Humanity’s Last Exam, se dice que termina en poco más de 11 horas, frente a más de tres días para Claude Fable 5, con una precisión comparable; y en GDP-Val (escritos legales, modelos financieros, informes de ingeniería) afirma una aceleración de extremo a extremo de 5.6 veces sin pérdida de calidad. Trate esas cifras como afirmaciones de Open​AI y Cerebras hasta que ejecuciones independientes las confirmen.

El nivel también plantea dos preguntas abiertas. Primero, la capacidad: el suministro a escala de oblea de Cerebras es la limitación, y si la vista previa sigue siendo solo por invitación más allá de finales de 2026 indicará si el hardware puede mantener el ritmo de la demanda. Segundo, la estructura de precios: un nivel de velocidad premium podría segmentar los precios de la API de maneras que importan para los equipos sensibles a los costos.

Salvaguardias más fuertes

GPT-5.6 también incluye salvaguardas más sólidas, especialmente en torno a los flujos de trabajo de ciberseguridad y biológicos. Algunas solicitudes pueden tardar más o no devolver contenido mientras se ejecutan comprobaciones de seguridad adicionales.

Para equipos legítimos de defensa o investigación, esto no hace que GPT-5.6 sea inutilizable. Pero sí implica que los flujos de trabajo en dominios sensibles deben probarse cuidadosamente antes de la migración a producción.

Daybreak Blue and Red: GPT-5.6 con salvaguardas reducidas para equipos verificados

La otra cara de unas salvaguardas más sólidas es que Open​AI ahora también ofrece acceso con menos barreras de seguridad a la misma familia. El 10 de agosto de 2026, amplió Daybreak — su programa de ciberseguridad verificado — en dos niveles. Daybreak Blue ofrece a los defensores aprobados GPT-5.6 Sol con las barreras de ciberseguridad a nivel de sistema eliminadas, para el descubrimiento de vulnerabilidades, la revisión de código seguro, el análisis de malware, la ingeniería de detección, la respuesta a incidentes y la validación de parches. Open​AI lo describe como el punto de partida recomendado para la mayoría de los defensores.

Daybreak Red va más allá. Proporciona acceso a GPT-5.6-Cyber, un modelo entrenado específicamente en GPT-5.6 Sol para el descubrimiento de vulnerabilidades de día cero y el desarrollo de cadenas de exploits. El acceso está fuertemente restringido y monitorizado — verificación de identidad, restricciones de uso aprobado y declaraciones legales — y OpenAI afirma que las cuentas individuales de Daybreak deben adoptar llaves de seguridad de hardware a partir del 1 de septiembre de 2026.

Las cifras de capacidad son reportadas por el proveedor. En la tasa interna de finalización de ciberseguridad avanzada de Open​AI, GPT​-5.6-Cyber completó el 95% de las tareas sensibles que se le pidieron, frente al 57.3% de su predecesor GPT​-5.5-Cyber — mientras que Sol a través de Daybreak Blue completó el 2.0% (1.5% con salvaguardas estándar). Open​AI enmarca el cambio como un cambio en la tasa de rechazo más que un salto de inteligencia: el modelo subyacente responde en lugar de negarse. Open​AI también dice que el modelo ayudó a sacar a la luz dos vulnerabilidades previamente desconocidas en el motor V8 de Chrome, divulgadas a Google y corregidas como CVE-2026-15903.

Daybreak no es un producto de API pública. El acceso se realiza a través del programa de Open​AI y de una red de socios de proveedores de seguridad, por lo que la mayoría de los equipos lo encontrarán indirectamente: en mejores herramientas defensivas y en la señal de que Open​AI ahora lanza un modelo cuyo trabajo es atacar sistemas en nombre de los defensores.

Sol en ChatGPT: una puesta a punto de fiabilidad y un control deslizante de pensamiento

El anuncio del 6 de agosto de 2026 trataba sobre la experiencia del consumidor. Open​AI ajustó el Sol que se ejecuta en la experiencia de Chat de ChatGPT para que fuera más fiable con los hechos — fechas, números, fuentes, reglas y suposiciones — y más directo en las respuestas cotidianas, a la vez que acercaba las experiencias Instant y Thinking. Las cifras detrás de "más fiable" son las evaluaciones internas propias de Open​AI, no de un laboratorio independiente: en prompts financieros, médicos y legales, las respuestas con errores fácticos fueron aproximadamente un 68% menos comunes con Sol (y un 62% menos con Luna) que con GPT-5.5 Instant.

Los usuarios de Plus y Pro también obtienen un nuevo control deslizante de pensamiento en web, móvil y escritorio, que permite elegir cuánto razonamiento dedica cada respuesta, desde respuestas rápidas para preguntas cotidianas hasta una planificación, investigación, redacción, codificación o decisiones más profundas. Open​AI afirma que la versión de Sol detrás de Work y Codex no ha cambiado; el ajuste se aplica a la experiencia de Chat.

Free y Go: Luna por defecto, chats de texto ilimitados

Open​AI hizo de GPT-5.6 Luna el modelo predeterminado para las cuentas Free y Go de ChatGPT esta semana, reemplazando a GPT-5.5 Instant. A partir de la semana del 10 de agosto, los chats de solo texto en esos niveles son ilimitados — sin límites de velocidad, sujetos a medidas de protección contra el abuso — mientras que los límites aún se aplican a la carga de archivos, imágenes, generación de imágenes y voz. Un nuevo botón Think ofrece a los usuarios Free y Go una forma de pedirle a Luna que razone más, también sin límite para chats de solo texto. Open​AI también añadió entrenamiento de seguridad para usuarios menores de 18 años, incluidos límites en torno al juego de roles romántico y contenido restringido por edad.

GPT-5.6 vs GPT-5.5

En comparación con GPT-5.5, GPT-5.6 es el que más importa en seis áreas:

Selección de modelo: GPT-5.6 introduce Sol, Terra y Luna en lugar de un modelo predeterminado.

- Trabajo agentivo: Sol está mejor posicionado para agentes de codificación y flujos de trabajo con muchas herramientas.

- Control de razonamiento: el máximo esfuerzo de razonamiento y el modo ultra ofrecen a los desarrolladores más opciones para tareas difíciles.

- Flexibilidad de costos: Terra y Luna facilitan evitar el uso excesivo del modelo insignia.

Opciones de velocidad: GPT-5.6 Sol ofrece un nivel Ultrafast de hasta 14X la velocidad estándar; GPT-5.5 se lanzó con una única clase de velocidad.

- Estrategia de implementación: GPT​-5.6 llegó en fases — primero API, luego ChatGPT — por lo que los equipos aún necesitan respaldos a medida que cambian el comportamiento y los precios.

El punto clave es simple: GPT-5.6 no es solo un mejor modelo. Es una razón para dejar de codificar un único modelo en tu aplicación.

Cómo prepararse para GPT-5.6

Puedes prepararte con el acceso que ya tienes: Luna es el predeterminado gratuito de ChatGPT, Sol está en la experiencia Plus/Pro, y la API es pública. La preparación se trata de enrutamiento y medición, no de esperar.

Primero, crea un conjunto de evaluación real. No pruebes GPT​-5.6 solo con prompts triviales. Usa incidencias reales del código base, tickets de soporte, documentos de clientes, tareas de investigación y fallos de automatización.

Segundo, diseñe para el enrutamiento de modelos. Luna puede manejar resúmenes simples y clasificación. Terra puede manejar flujos de trabajo cotidianos orientados al usuario. Sol debe reservarse para razonamiento complejo, codificación e investigación. Si la latencia es un requisito en su hoja de ruta, trate la vista previa de Ultrafast como una razón para diseñar ahora una capa de enrutamiento que tenga en cuenta la velocidad en lugar de codificar de forma fija un único nivel — el nivel que hoy gana en latencia puede seguir en vista previa, pero la decisión de enrutamiento que implica ya es visible.

Tercero, rastrea el costo por tarea completada. Para flujos de trabajo agentivos, una solicitud de usuario puede desencadenar muchas llamadas al modelo. El precio del token más barato no siempre es el flujo de trabajo completado más barato.

Cuarto, prepárate para el almacenamiento en caché. Si tu aplicación envía repetidamente el mismo repositorio, documento de política o base de conocimiento, estructura las indicaciones para que se pueda reutilizar el contexto estable.

Por último, mantén un plan de respaldo. Los modelos de razonamiento son verbosos y los precios cambian — Terra y Luna cayeron ambas a finales de julio. Los sistemas de producción deberían poder recurrir a otro nivel de GPT​-5.6, a GPT-5.5, o a un proveedor diferente cuando la latencia, el costo o el comportamiento cambien.

Dónde encaja OrcaRouter

GPT-5.6 hace que el enrutamiento de modelos sea más importante.

OpenAI ya no presenta la nueva generación como un solo modelo. GPT-5.6 llega como una familia: Sol para el razonamiento más complejo y el trabajo agéntico, Terra para cargas de trabajo cotidianas equilibradas y Luna para tareas rápidas y de menor costo.

Eso crea una pregunta práctica para los desarrolladores: ¿Qué modelo debería manejar cada solicitud?

No todas las tareas necesitan Sol. Un resumen simple puede ser mejor servido por Luna. Un flujo de trabajo empresarial normal puede encajar con Terra. Una tarea difícil de agente de codificación puede justificar Sol.

Y aunque el acceso esté abierto, las aplicaciones de producción todavía necesitan opciones de respaldo cuando la latencia, los límites de tasa o el costo por tarea cambian: los recortes de precios de finales de julio son un recordatorio de que la tarifa es un objetivo en movimiento, y la vista previa de Ultrafast es un recordatorio de que las opciones de servicio también se están moviendo.

Aquí es donde encaja OrcaRouter.

OrcaRouter ofrece a los desarrolladores un único endpoint compatible con Open​AI para enrutar entre muchos modelos, con enrutamiento inteligente, conmutación automática por error, observabilidad y cero recargo por tokens. En lugar de reconstruir tu integración cada vez que se lanza un nuevo modelo, puedes mantener un único patrón de API y enrutar las tareas según la calidad, el costo, la latencia y la disponibilidad.

Para GPT-5.6, eso significa que puedes construir la capa del modelo ahora en lugar de esperar a que el acceso se estabilice.

{{1}}Los tres niveles estándar están hoy en OrcaRouter: GPT-5.6 Sol a $5/$30, GPT-5.6 Terra a $2/$12 y GPT-5.6 Luna a $0.20/$1.20 — con un margen del 0%, así que los recortes de precios de finales de julio están activos aquí el mismo día en que se lanzaron.{{/1}} {{2}}El nivel Ultrafast aún no está disponible de forma generalizada, así que no forma parte de esa lista — cuando se abra, se convertirá en un nivel de servicio más para enrutar, y el mismo endpoint es donde se toma esa decisión.{{/2}} {{3}}Daybreak Blue y Red son un programa aparte de acceso restringido en lugar de niveles públicos de API, así que tampoco se pueden enrutar a través de OrcaRouter — los niveles estándar son donde reside la decisión de enrutamiento.{{/3}}

El acceso a GPT-5.6 todavía está en proceso de definición, pero tu estrategia de enrutamiento no tiene por qué esperar.

Usando GPT-5.6 a través de OrcaRouter

GPT-5.6 es exactamente el tipo de familia a la que los desarrolladores quieren enrutar.

Pero el despliegue ha creado un problema práctico: el acceso se amplió por fases, los precios cambiaron para dos niveles a finales de julio, el ajuste de ChatGPT difiere del modelo de API, y ahora un nivel de velocidad está en vista previa. Los equipos necesitan una capa que absorba esos cambios.

OrcaRouter expone los tres niveles de GPT​-5.6 a través de un único endpoint compatible con Open​AI, junto con más de 200 modelos, para que puedas probar Sol, Terra y Luna contra GPT-5.5, Claude, Gem​ini y el resto en un solo lugar, sin reintegrar.

Esto es útil si quieres:

enruta cada solicitud al nivel más barato que la maneje;

- prueba Sol, Terra y Luna lado a lado con tu stack actual;

- enrutar tareas simples a modelos más baratos;

- reserva los modelos insignia para trabajos más difíciles;

- comparar GPT-5.6 con su stack de producción actual;

- Mantén los modelos de respaldo listos cuando cambien el comportamiento o los precios.

GPT-5.6 ya está en vivo en OrcaRouter — Sol, Terra y Luna — con un margen del 0% y failover automático, de modo que un nivel recién lanzado o con precio actualizado nunca derribe una ruta de producción.

Llama a cualquier nivel de GPT-5.6 a través de una sola API en OrcaRouter, y enruta por el resto del catálogo con la misma clave.

Veredicto final

GPT-5.6 es real, oficial e importante.

Pero ya no es una vista previa que esperas: la API ha estado disponible desde el 9 de julio, y el acceso a ChatGPT se está implementando en todos los niveles este mes.

El mayor cambio no es solo una mejor inteligencia. Es el paso de un modelo predeterminado a una familia de modelos enrutados: Sol, Terra y Luna.

Para los desarrolladores, la oportunidad no es simplemente actualizar a GPT​-5.6. La oportunidad es construir una capa de modelo más inteligente:

- Luna para tareas rápidas y baratas;

- Terra para cargas de trabajo de producción equilibradas;

- Sol para las tareas más difíciles de razonamiento y codificación;

- almacenamiento en caché para contexto repetido;

- modelos de respaldo para la confiabilidad.

Si estás lanzando hoy, ya no tienes que esperar: Luna es la opción gratuita predeterminada de ChatGPT, Sol está en la experiencia Plus/Pro, y la API es pública.

Si estás construyendo agentes de codificación, copilotos empresariales o flujos de trabajo de IA de larga duración, la preparación ahora significa enrutamiento, medición del esfuerzo de razonamiento y costo por tarea, no acceso. Y la vista previa de Ultrafast es un recordatorio de que la familia sigue avanzando: el buque insignia que evalúas hoy puede tener una capa más rápida —o, con Daybreak, una variante cibernética entrenada para un propósito específico— para cuando lo lances.

Preguntas frecuentes

¿Se ha lanzado GPT-5.6?

Sí. La API se lanzó el 9 de julio de 2026, y el acceso a ChatGPT se está implementando gradualmente — Sol actualizado para Plus/Pro desde el 6 de agosto, Luna como la opción predeterminada para Free/Go esta semana.

¿Puedo usar GPT​-5.6 en ChatGPT?

Sí. GPT-5.6 Sol ya está disponible en la experiencia de chat Plus/Pro con un nuevo control deslizante de pensamiento, y GPT-5.6 Luna se convertirá en la opción predeterminada para las cuentas Free y Go esta semana, con chats de solo texto ilimitados a partir de la semana del 10 de agosto.

¿Puedo usar GPT-5.6 a través de la API?

Sí. Los tres niveles están en la API pública con precios publicados — Sol $5/$30, Terra $2/$12, Luna $0.20/$1.20 — y a través de OrcaRouter con un margen del 0%.

¿Qué es el modo GPT-5.6 Sol Ultrafast?

Es un nivel de velocidad en vista previa en la API de Open​AI que ejecuta GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar, con hasta 750 tokens de salida por segundo, con la misma inteligencia que el modelo estándar (según lo declarado por el proveedor). Inicialmente está limitado a un pequeño grupo de clientes, y Open​AI no ha publicado precios para él.

¿Hay una lista de espera pública para GPT-5.6?

En los niveles base, no — la API es pública y el acceso a ChatGPT se está desplegando en todos los niveles, así que no hay nada a lo que unirse. La vista previa de Ultrafast es la excepción: inicialmente está limitada a un pequeño grupo de clientes, con un registro para recibir notificación a medida que se amplíe la capacidad.

¿Cuándo estará GPT-5.6 disponible de forma general?

Ya lo está, en etapas. La API se lanzó el 9 de julio de 2026; la versión actualizada de Sol llegó a ChatGPT Plus/Pro el 6 de agosto; Luna se convierte en la opción predeterminada de Free/Go esta semana; los chats de texto gratuitos ilimitados llegan la semana del 10 de agosto.

¿Qué son GPT-5.6 Sol, Terra y Luna?

Sol es el modelo insignia, Terra es el modelo equilibrado para el trabajo diario, y Luna es el modelo rápido y asequible.

¿Cuánto cuesta GPT-5.6?

GPT-5.6 Sol cuesta $5 por 1M de tokens de entrada y $30 por 1M de tokens de salida. GPT-5.6 Terra cuesta $2 por 1M de entrada y $12 por 1M de salida. GPT-5.6 Luna cuesta $0.20 por 1M de entrada y $1.20 por 1M de salida. Terra y Luna se redujeron a fines de julio de 2026; Sol no cambió. En OrcaRouter estos precios se transmiten con un margen del 0%. La vista previa Ultrafast aún no tiene un precio publicado.

¿Debería cambiar de GPT-5.5 a GPT-5.6?

No a ciegas. Mantén un respaldo estable, pero el cálculo ha cambiado: el precio de Luna la convierte en la opción predeterminada para trabajo de texto de alto volumen, y el ajuste de ChatGPT vale la pena probarlo para asistentes cotidianos. Evalúa con tus propias tareas y enruta por nivel.

¿Puedo acceder a GPT​-5.6 a través de OrcaRouter?

Sí. GPT-5.6 Sol, Terra y Luna están todos en OrcaRouter a través de un endpoint compatible con Open​AI con un margen de beneficio del 0%, con conmutación automática por error. Puedes probarlos contra GPT-5.5, Claude, Gem​ini y otros modelos sin cambiar las integraciones.

¿Qué son Daybreak Blue y Daybreak Red?

Son los dos niveles del programa de ciberseguridad verificado de Open​AI, ampliado el 10 de agosto de 2026. Daybreak Blue ofrece a los defensores aprobados GPT-5.6 Sol, con las salvaguardas cibernéticas eliminadas, para tareas defensivas como respuesta a incidentes, análisis de malware y revisión de código seguro. Daybreak Red proporciona GPT​-5.6-Cyber, un modelo basado en Sol entrenado específicamente para la investigación autorizada de vulnerabilidades y el trabajo de explotación, a equipos verificados por separado. Ninguno de los dos es un producto de API pública.

Comparados en este artículo4

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario