Precios de GPT-5.6 después del recorte: Luna vs Terra vs Sol, y qué nivel usar
Guides & Insights

Precios de GPT-5.6 después del recorte: Luna vs Terra vs Sol, y qué nivel usar

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Tras el recorte de precios de OpenAI del 30 de julio de 2026, la familia GPT-5.6 — GPT-5.6 Luna, GPT-5.6 Terra y GPT-5.6 Sol — nunca ha sido tan barata de ejecutar a escala. Una semana después, el 6 de agosto, OpenAI llevó los mismos niveles a ChatGPT: GPT-5.6 Luna se está convirtiendo en el modelo predeterminado para las cuentas gratuitas y Go, con chats de texto ilimitados, mientras que GPT-5.6 Sol se actualizó para Plus y Pro. El 19 de agosto, OpenAI y Replit anunciaron que el nuevo Modo Gratuito de Replit para suscriptores de Core y Pro funciona con GPT-5.6 Luna, la mayor apuesta de terceros hasta ahora por el nivel de volumen. Y a finales de agosto, OpenAI comenzó a implementar un respaldo para los usuarios más intensivos: una asignación de "Luna Reserve" que otorga a ciertas cuentas de ChatGPT Plus y Pro un uso limitado de GPT-5.6 Luna en Codex y ChatGPT Work cuando se agotan sus límites de uso habituales. Pero los tres niveles tienen precios muy distintos, y elegir el correcto (además de usar bien el almacenamiento en caché, el procesamiento por lotes y el enrutamiento) es la palanca más importante en tu factura de API. Esta guía detalla los precios tras el recorte, ejemplos de costos calculados, cómo se compara cada nivel con la competencia y cómo enrutar entre ellos a través de un único endpoint.

Los precios son por millón de tokens (entrada / salida), y reflejan la tarifa posterior al recorte según lo informado y según las páginas del modelo de traspaso de OrcaRouter; las tarifas por niveles y de caché provienen de las páginas del modelo de OrcaRouter, y las cifras de la competencia se atribuyen a sus fuentes. Los detalles del despliegue de ChatGPT en este artículo son tal como O​penAI los declaró el 6 de agosto de 2026, y los detalles del Modo Gratuito de Replit son tal como O​penAI y Replit los declararon el 19 de agosto de 2026 — información del proveedor, no medida de forma independiente. Los detalles de Luna Reserve son tal como O​penAI los documenta en su centro de ayuda y tal como el personal de O​penAI y los primeros usuarios los informaron a finales de agosto de 2026 — declaraciones del proveedor y de la comunidad, no verificadas de forma independiente. Los precios cambian — verifique antes de construir.

TL;DR

GPT-5.6 Luna ($0.20 / $1.20) es el caballo de batalla de alto volumen; Terra ($2 / $12) es el nivel medio equilibrado; Sol ($5 / $30) es el buque insignia para el razonamiento más difícil y la codificación agéntica. Los tres comparten un contexto de ~1.05M de tokens y una salida máxima de 128K. El almacenamiento en caché de prompts y la opción por lotes reducen aún más los costos, mientras que las entradas muy largas te suben a un nivel superior. En el lado del consumidor, O​penAI anunció el 6 de agosto que GPT-5.6 Luna se convertirá en el predeterminado para las cuentas Free y Go de ChatGPT con chats ilimitados de solo texto, y que una versión actualizada de GPT-5.6 Sol se está implementando para Plus y Pro. El 19 de agosto, Replit lanzó Free Mode en GPT-5.6 Luna para suscriptores Core y Pro, enrutando las tareas más difíciles a GPT-5.6 Sol según sea necesario. A finales de agosto, O​penAI también comenzó a implementar un respaldo llamado “Luna Reserve” que brinda a ciertas cuentas de ChatGPT Plus y Pro un uso limitado de GPT-5.6 Luna en Codex y ChatGPT Work una vez que se agotan sus límites regulares — documentado por O​penAI, con la implementación en cuentas seleccionadas reportada por los usuarios. Usa Luna para la mayoría fácil, Terra cuando necesites más, y Sol solo donde justifique su costo — y enruta por dificultad a través de un endpoint compatible con O​penAI para minimizar el gasto.

Puntos clave

• Luna: $0.20 / $1.20 por 1M de tokens — rápido, barato, para trabajo de alto volumen y sensible a la latencia.

• Terra: $2 / $12 — el nivel medio equilibrado para tareas más exigentes que no necesitan el modelo insignia.

• Sol: $5 / $30 — el buque insignia para razonamiento profundo, codificación a gran escala y agentes de largo horizonte.

• El almacenamiento en caché y el procesamiento por lotes reducen aún más los costos; las entradas largas te llevan a un nivel de contexto largo más costoso.

• ChatGPT (según OpenAI, 6 de agosto): Luna se convierte en la opción predeterminada gratuita/Go con chats de texto ilimitados; Sol recibe una actualización de fiabilidad para Plus/Pro.

• Replit (anunciado el 19 de agosto): el Modo Gratuito para Core/Pro funciona con GPT-5.6 Luna — hasta 30 veces más uso por Replit, con las tareas más difíciles enrutadas hasta GPT-5.6 Sol. Según lo declarado por Replit, no verificado de forma independiente.

Luna Reserve (finales de agosto, documentado por OpenAI): una asignación de respaldo limitada que permite que ciertas cuentas de ChatGPT Plus y Pro sigan usando GPT-5.6 Luna en Codex y ChatGPT Work después de agotar los límites habituales — no es ilimitada y no está disponible en espacios de trabajo de Business ni Enterprise.

• La mayor palanca de ahorro: enruta por dificultad — no pagues tarifas de Sol por trabajo que Luna puede hacer.

El nuevo precio base de {{1}}GP​T-5.​6{{/1}}

Este es el precio base tras el recorte por millón de tokens de entrada/salida: Luna $0.20 / $1.20 (bajó desde $1 / $6), Terra $2 / $12 (bajó desde $2.50 / $15) y Sol $5 / $30 (sin cambios). Los dos niveles más baratos se recortaron el 30 de julio de 2026; el insignia se mantuvo. En pocas palabras, los niveles bajos ahora tienen precios para escalar, mientras que el insignia sigue siendo premium.

Precios por niveles, en caché y por lotes

La tarifa base es solo el punto de partida. El precio de GP​T-5.​6 tiene tres modificadores que cambian materialmente tu costo efectivo:

• Niveles de contexto largo. Los precios aumentan para entradas muy largas. En las páginas de tránsito de OrcaRouter, Luna cuesta $0.20 / $1.20 hasta un nivel de contexto grande y $0.40 / $1.80 más allá de ese nivel; Sol cuesta $5 / $30 en su nivel base y $10 / $45 en el más grande. El nivel se elige según la cantidad de tokens de entrada de cada solicitud, por lo que algunas pocas solicitudes enormes pueden aumentar silenciosamente tu precio promedio.

• Caché de prompts. El contexto reutilizado se factura con un gran descuento: la lectura de caché de Luna cuesta aproximadamente $0.02 por millón de tokens (frente a $0.20 para tokens nuevos), con escrituras de caché alrededor de $0.25; la lectura de caché de Sol cuesta aproximadamente $0.50 (frente a $5 para tokens nuevos). Para agentes y chats con un prompt del sistema estable, el almacenamiento en caché suele ser el mayor ahorro.

Batch. Los trabajos no urgentes se ejecutan de forma asíncrona con descuento — ideal para clasificación masiva, evaluaciones y generación offline donde la latencia no importa.

Ejemplos resueltos: lo que realmente cuesta

Los números concretos hacen que los niveles sean reales. Tome 10 millones de tokens al mes con una división del 70% de entrada / 30% de salida (una combinación típica de chat/agente):

• Luna: unos $5 al mes (aproximadamente $4.37 con caché de prompts).

• Terra: alrededor de $50 al mes.

• Sol: alrededor de $125 al mes (aproximadamente $109 con caché).

Eso es una diferencia de 25x entre Luna y Sol para el mismo volumen, exactamente la razón por la que asignar cada solicitud al nivel capaz más barato importa más que cualquier tarifa individual. (Estos coinciden con la calculadora de costos en la página de OrcaRouter, que estima a partir del precio de lista; tus números reales dependen del almacenamiento en caché y de tu combinación de entrada/salida).

Para qué sirve realmente cada nivel

GPT-5.6 Luna — el caballo de batalla del volumen

Luna es el nivel rápido y rentable, optimizado para cargas de trabajo de alto volumen y sensibles a la latencia: chat, clasificación, extracción, enrutamiento y tareas agénticas ligeras, con un tiempo hasta el primer token (p50) de aproximadamente 1,65 segundos. Tras el recorte, a $0.20 / $1.20, compite directamente con los modelos abiertos baratos y es la opción predeterminada para la gran mayoría de las llamadas sencillas. También es el nivel hacia el que O​penAI está orientando ChatGPT para consumidores: según su anuncio del 6 de agosto, GPT-5.6 Luna se convertirá en el modelo predeterminado para las cuentas Free y Go, con chats de solo texto ilimitados y un nuevo botón Think para un mayor razonamiento en preguntas más difíciles que llegará la semana siguiente (los límites de archivos, imágenes y voz se mantienen). O​penAI afirma que Luna comete un 62% menos de errores factuales que el GPT-5.5 Instant al que reemplaza, una cifra reportada por el proveedor, pero una señal clara de que el nivel de volumen es hacia donde la empresa dirige la mayor parte de su tráfico.

El 19 de agosto de 2026, Replit convirtió a GPT-5.6 Luna en el motor de su nuevo Modo Gratuito — la experiencia predeterminada para los suscriptores de Core y Pro. Las tareas cotidianas de chat, ideación y codificación simple se ejecutan en Luna sin consumir el presupuesto de créditos de IA pagados del usuario; Replit afirma que los usuarios de Core ahora pueden crear hasta 30 veces más por mes, incluyendo hasta 30 horas de chat. Cuando una tarea requiere más razonamiento, el Agent de Replit enruta la solicitud a un modelo más grande para esa parte — sus modos Power/Max o GPT-5.6 Sol — y luego vuelve a Luna. Estos son detalles proporcionados por Replit y O​penAI, no verificados de forma independiente — pero la dirección coincide con el recorte de precios: una Luna un 80% más barata es lo que hace viable un nivel siempre activo e incluido por defecto.

Otra novedad para los consumidores llegó a fines de agosto de 2026: Luna Reserve. Como O​penAI documenta en su centro de ayuda, ciertas cuentas de ChatGPT Plus y Pro pueden obtener un conjunto limitado de uso de GPT-5.6 Luna en Codex y ChatGPT Work como respaldo una vez que se agota su asignación de uso regular — aparece un aviso o indicador de luna en el límite, y puedes seguir trabajando en Luna mientras dure la reserva. No es una extensión ilimitada: la reserva es separada de la asignación regular y también tiene su propio límite, solo sirve GPT-5.6 Luna (nunca Terra o Sol), no está disponible en espacios de trabajo de Business o Enterprise, y alcanzar un límite regular no garantiza el acceso. El personal de O​penAI confirmó la existencia de la reserva el 27 de agosto, y los primeros informes de usuarios describen que se está implementando en cuentas seleccionadas — declarado por el proveedor y la comunidad, no verificado de forma independiente. Algunos informes comunitarios tempranos también señalan que la reserva ejecuta el lado ligero del navegador de GPT-5.6 Luna, por lo que las tareas de inspección web en vivo pueden no funcionar mientras se está en la reserva.

GPT-5.6 Terra — el punto medio equilibrado

Terra se sitúa entre el modelo de volumen y el insignia: más capaz que Luna para razonamiento y codificación más exigentes, pero mucho más económica que Sol. A $2 / $12, es una opción sensata por defecto cuando Luna no es suficiente pero no necesitas el insignia: extracción de complejidad media, redacción y tareas de varios pasos que siguen ejecutándose a escala.

GPT-5.6 Sol — el buque insignia

Sol está construido para el trabajo más difícil: razonamiento profundo de múltiples pasos, ingeniería de software a gran escala y flujos de trabajo agénticos de largo horizonte, manteniendo la coherencia en un contexto de ~1,05 millones de tokens y hasta 128K de salida. A $5 / $30 (base) es una opción premium: resérvalo para tareas que realmente lo necesiten, como codificación compleja de múltiples archivos o ejecuciones de agentes largas. El 6 de agosto, OpenAI también actualizó GPT-5.6 Sol en ChatGPT para usuarios Plus y Pro: la empresa dice que la versión de chat es más confiable con los hechos — 68% menos errores fácticos, según OpenAI — y da respuestas más enfocadas, con un nuevo control deslizante para ajustar cuánto esfuerzo de razonamiento aplica. La actualización es solo para el chat (el Sol detrás de Work y Codex no cambia), y el nivel de API se mantiene en $5 / $30.

La advertencia del token de razonamiento

GP​T-5.​6 son modelos de razonamiento, por lo que el costo de salida efectivo puede exceder una estimación ingenua: cuando el razonamiento está activado, los tokens de razonamiento internos se facturan como salida. En prompts difíciles con alto esfuerzo de razonamiento, eso puede dominar tu factura. Ajusta el esfuerzo de razonamiento a la tarea (bajo o desactivado para llamadas simples), limita los tokens de salida donde puedas y mide el uso real. Las tarifas más baratas por token ayudan; generar menos tokens ayuda más.

Cómo se compara cada nivel con sus rivales

El recorte reposicionó a GP​T-5.​6 frente a la competencia. Según los informes, los $0.20 / $1.20 de Luna ahora subcotizan a Claude Haiku 4.5 por aproximadamente 5x en entrada y 4x en salida, y los $2 / $12 de Terra caen por debajo del precio estándar de Claude Sonnet 5 (reportado en $3 / $15). Frente a los pesos abiertos, Luna se sitúa cerca del mínimo establecido por la línea V4 de Deep​Seek y el GLM-5.2 de Zhi​pu (alrededor de $1.20 / $4.10), con los niveles de Qw​en y Gem​ini Flash cerca. La conclusión: para trabajos sensibles al costo, Luna ahora es competitiva con los modelos capaces más baratos, en lugar de una alternativa premium a ellos, mientras que Sol sigue siendo un nivel premium genuino para una capacidad que no se puede obtener a bajo precio.

La verdadera palanca de ahorro: enrutar por dificultad

La factura más barata no es un único nivel: es hacer coincidir cada solicitud con el modelo menos costoso que pueda realizarla. En la práctica: envía las llamadas fáciles y de alto volumen a Luna (o a un modelo abierto económico), sube a Terra para las tareas más difíciles y usa Sol solo para la minoría realmente difícil. Combinado con caché y lotes, esto reduce los costos de forma habitual mucho más que cualquier cambio de precio individual. El inconveniente es operativo: no quieres reintegrar tres niveles de O​penAI más alternativas de modelos abiertos por separado.

Accede a los tres (y rivales más baratos) a través de un único endpoint.

Aquí es donde un router independiente del proveedor resulta útil. OrcaRouter expone GPT-5.6 Luna, Terra y Sol — a los mismos precios posteriores al recorte, con un margen del 0% — a través de un endpoint compatible con O​penAI, junto a modelos abiertos más baratos como DeepSeek V4 Pro, GLM-5.2 y Qw​en. Cambiar de nivel (o hacer pruebas A/B entre Luna y un modelo abierto) es un cambio de configuración, no una nueva integración, y puedes enrutar cada solicitud a lo que sea más barato. Luna Reserve es la versión para consumidores de esa misma idea — un respaldo integrado que mantiene a usuarios seleccionados en GPT-5.6 Luna después de que se agoten sus cuotas habituales — y el equivalente del lado de la API es el failover automático, que OrcaRouter maneja cuando un proveedor limita la tasa de una solicitud o devuelve un error en ella.

La tarjeta de tarifas de Luna posterior al recorte es visible en la propia página del modelo de OrcaRouter a precio de lista — $0,20 / $1,20 por millón de tokens — porque el router transmite los precios de los proveedores con un margen del 0%, con una calculadora de costos en la página para una factura mensual típica. También hay un nivel gratuito y una página de ofertas para ahorros adicionales.

Preguntas frecuentes

¿Cuáles son los precios de GP​T-5.​6 después del recorte?

Luna $0.20 / $1.20, Terra $2 / $12 y Sol $5 / $30 por millón de tokens de entrada/salida. Luna y Terra se redujeron el 30 de julio de 2026; Sol se mantiene sin cambios.

¿Qué nivel de GP​T-5.​6 debería usar?

Luna para trabajo de alto volumen y sensible a la latencia; Terra para tareas más exigentes que no necesitan el modelo insignia; Sol para el razonamiento más complejo y codificación agéntica. Enruta según la dificultad para minimizar el costo.

¿Es GPT-5.6 Luna gratis en ChatGPT?

OpenAI anunció el 6 de agosto que GPT-5.6 Luna se convertirá en el modelo predeterminado para las cuentas gratuitas y de Go de ChatGPT, con chats ilimitados solo de texto; los límites continúan en la carga de archivos, imágenes y herramientas de voz, y un botón Think para razonamiento avanzado se está implementando por separado. Estos son planes declarados por OpenAI, no verificados de forma independiente.

¿Por qué Replit está usando GPT-5.6 Luna para el Modo Gratuito?

El modo gratuito de Replit, anunciado el 19 de agosto de 2026, ejecuta chat cotidiano, ideación y codificación simple en GPT-5.6 Luna por defecto para los suscriptores de Core y Pro, enrutando las tareas más difíciles a un modelo más grande — sus modos Power/Max o GPT-5.6 Sol — según sea necesario. Replit atribuye la viabilidad económica al recorte de precios de la API Luna del 30 de julio, de aproximadamente el 80%. Estos son planes declarados por el proveedor, no verificados de forma independiente.

¿Qué es Luna Reserve?

Una asignación de respaldo que O​penAI documenta para Codex y ChatGPT Work: las cuentas seleccionadas de ChatGPT Plus y Pro obtienen un pool limitado de uso de GPT-5.6 Luna una vez que se agota su límite de uso regular, para que sigan funcionando en lugar de ser cortadas. Solo sirve GPT-5.6 Luna — nunca Terra o Sol —, tiene su propio tope, es independiente del uso regular y no está disponible en espacios de trabajo de Business o Enterprise. La existencia está declarada por O​penAI (el personal lo confirmó el 27 de agosto); el despliegue a cuentas seleccionadas es reportado por la comunidad, no verificado de forma independiente.

¿Cuánto cuesta GP​T-5.​6 al mes?

Con 10M tokens al mes (70% de entrada): aproximadamente $5 en Luna, $50 en Terra y $125 en Sol — una diferencia de 25 veces, antes del caché. Su costo real depende del caché y de su combinación de entrada/salida.

¿Tienen los tres niveles la misma ventana de contexto?

Sí: aproximadamente un contexto de 1,05 millones de tokens y hasta 128 000 tokens de salida, con soporte de visión, herramientas, JSON y razonamiento.

¿Cómo afecta el almacenamiento en caché de prompts al costo?

El almacenamiento en caché reduce drásticamente el costo del contexto repetido: la lectura de caché de Luna cuesta alrededor de $0.02 por millón de tokens frente a $0.20 si es nueva, así que reutiliza los prompts almacenados en caché siempre que sea posible. Por el contrario, las entradas largas pueden llevarte a un nivel de contexto largo más costoso.

¿Cómo se comparan los niveles con Anthropic o los modelos abiertos?

Según los informes, Luna es más barata que Claude Haiku 4.5 (~5x entrada / 4x salida) y Terra está por debajo de Claude Sonnet 5 ($3 / $15). Luna también se acerca al umbral económico de los modelos abiertos (Deep​Seek, GLM-5.2 ~$1.20/$4.10).

¿Dónde puedo usar los tres niveles juntos?

A través del único endpoint compatible con O​penAI de OrcaRouter con un margen de beneficio del 0%, junto con modelos abiertos más baratos para el enrutamiento basado en la dificultad.

En resumen

Tras el recorte, GPT-5.6 Luna ($0.20 / $1.20) y Terra ($2 / $12) resultan convincentes para trabajo de alto volumen y de gama media, mientras que Sol ($5 / $30) sigue siendo el buque insignia premium: una diferencia de coste de 25x que premia el enrutamiento inteligente. El despliegue para consumidores refuerza la división: OpenAI está convirtiendo a Luna en la opción gratuita por defecto, mientras reserva la actualización de fiabilidad de Sol para los planes de pago, y el Modo Gratuito del 19 de agosto de Replit — basado en GPT-5.6 Luna, con las tareas más difíciles enrutadas a GPT-5.6 Sol — demuestra que los productos de alto tráfico se sitúan en el mismo nivel, y el respaldo Luna Reserve de finales de agosto amplía el patrón al mantener a algunos usuarios Plus y Pro en GPT-5.6 Luna incluso después de que agoten sus límites habituales. Para los desarrolladores de API, esa es una razón más para enrutar el tráfico fácil a Luna. Los mayores ahorros provienen de enrutar según la dificultad, apoyándose en el almacenamiento en caché y el procesamiento por lotes, y controlando los tokens de razonamiento en lugar de usar por defecto un solo nivel. Eso se consigue más fácilmente a través de un único endpoint con margen del 0% como OrcaRouter, donde los tres niveles (a los nuevos precios) se sitúan junto a los modelos abiertos más económicos con los que querrás compararlos.