
Precios de GPT-5.6 después del recorte: Luna vs Terra vs Sol, y qué nivel usar
- metaNUEVOMeta: Muse Spark 1.22026-08-0557Inteligencia72Código
- qwenNUEVOQwen: Qwen3.8 Max2026-08-0358Inteligencia72Código
- deepseekNUEVODeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencia69Código
- minimaxNUEVOMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens · 2275 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencia49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligencia71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencia76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencia71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencia77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencia77Código
- grokxAI: Grok 4.52026-07-0856Inteligencia72Código
- tencentTencent: Hy32026-07-0642Inteligencia59Código
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Inteligencia42Código
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Inteligencia39Código
- anthropicAnthropic: Claude Sonnet 52026-06-3055Inteligencia72Código
- klingKling: Kling 3.0 Turbo2026-06-1757Inteligencia52Código57Matemáticas
Tras el recorte de precios de OpenAI del 30 de julio de 2026, la familia GPT-5.6 — GPT-5.6 Luna, GPT-5.6 Terra y GPT-5.6 Sol — nunca ha sido tan barata de ejecutar a escala. Una semana después, el 6 de agosto, OpenAI incorporó los mismos niveles a ChatGPT: GPT-5.6 Luna se está convirtiendo en el modelo predeterminado para las cuentas gratuitas y Go con chats de texto ilimitados, mientras que GPT-5.6 Sol se actualizó para Plus y Pro. Pero los tres niveles tienen precios muy diferentes, y elegir el correcto (además de usar bien el almacenamiento en caché, el procesamiento por lotes y el enrutamiento) es la palanca más importante en tu factura de API. Esta guía presenta el precio completo tras el recorte, ejemplos de costos calculados, cómo se compara cada nivel con la competencia y cómo enrutar entre ellos a través de un único endpoint.
Los precios se expresan por millón de tokens (entrada / salida), según la tarifa posterior al recorte tal como se informó y las páginas del modelo de tránsito de OrcaRouter; las tarifas por niveles y de caché provienen de las páginas del modelo de OrcaRouter, y las cifras de la competencia están atribuidas. Los detalles del despliegue de ChatGPT en este artículo son tal como OpenAI los declaró el 6 de agosto de 2026, según lo reportado por el proveedor, no medidos de forma independiente. Los precios cambian: verifica antes de crear.
TL;DR
GPT-5.6 Luna ($0.20 / $1.20) es el caballo de batalla de alto volumen; Terra ($2 / $12) es el punto medio equilibrado; Sol ($5 / $30) es el buque insignia para el razonamiento más difícil y la codificación con agentes. Los tres comparten un contexto de ~1.05 millones de tokens y un máximo de salida de 128K. El almacenamiento en caché de prompts y la opción por lotes reducen aún más los costos, mientras que las entradas muy largas te llevan a un nivel superior. En el lado del consumidor, OpenAI anunció el 6 de agosto que GPT-5.6 Luna se convertirá en la opción predeterminada para las cuentas Free y Go de ChatGPT con chats ilimitados solo de texto, y que una versión actualizada de GPT-5.6 Sol se está implementando para Plus y Pro. Usa Luna para la mayoría de tareas fáciles, Terra cuando necesites más, y Sol solo donde justifique su costo — y enruta según la dificultad a través de un único endpoint compatible con OpenAI para minimizar el gasto.
Conclusiones clave
• Luna: $0.20 / $1.20 por 1M de tokens — rápido, barato, para trabajo de alto volumen y sensible a la latencia.
• Terra: $2 / $12 — el nivel medio equilibrado para tareas más exigentes que no necesitan el modelo insignia.
• Sol: $5 / $30 — el buque insignia para razonamiento profundo, codificación a gran escala y agentes de largo horizonte.
• El almacenamiento en caché y el procesamiento por lotes reducen aún más los costos; las entradas largas te llevan a un nivel de contexto largo más costoso.
• ChatGPT (según OpenAI, 6 de agosto): Luna se convierte en la opción predeterminada gratuita/Go con chats de texto ilimitados; Sol recibe una actualización de fiabilidad para Plus/Pro.
• La mayor palanca de ahorro: enruta por dificultad — no pagues tarifas de Sol por trabajo que Luna puede hacer.
El nuevo precio base de GPT-5.6
Este es el precio base tras el recorte por millón de tokens de entrada/salida: Luna $0.20 / $1.20 (bajó desde $1 / $6), Terra $2 / $12 (bajó desde $2.50 / $15) y Sol $5 / $30 (sin cambios). Los dos niveles más baratos se recortaron el 30 de julio de 2026; el insignia se mantuvo. En pocas palabras, los niveles bajos ahora tienen precios para escalar, mientras que el insignia sigue siendo premium.

Precios por niveles, en caché y por lotes
La tarifa base es solo el punto de partida. El precio de GPT-5.6 tiene tres modificadores que cambian materialmente tu costo efectivo:
• Niveles de contexto largo. Los precios aumentan para entradas muy largas. En las páginas de tránsito de OrcaRouter, Luna cuesta $0.20 / $1.20 hasta un nivel de contexto grande y $0.40 / $1.80 más allá de ese nivel; Sol cuesta $5 / $30 en su nivel base y $10 / $45 en el más grande. El nivel se elige según la cantidad de tokens de entrada de cada solicitud, por lo que algunas pocas solicitudes enormes pueden aumentar silenciosamente tu precio promedio.
• Caché de prompts. El contexto reutilizado se factura con un gran descuento: la lectura de caché de Luna cuesta aproximadamente $0.02 por millón de tokens (frente a $0.20 para tokens nuevos), con escrituras de caché alrededor de $0.25; la lectura de caché de Sol cuesta aproximadamente $0.50 (frente a $5 para tokens nuevos). Para agentes y chats con un prompt del sistema estable, el almacenamiento en caché suele ser el mayor ahorro.
Batch. Los trabajos no urgentes se ejecutan de forma asíncrona con descuento — ideal para clasificación masiva, evaluaciones y generación offline donde la latencia no importa.
Ejemplos resueltos: lo que realmente cuesta
Los números concretos hacen que los niveles sean reales. Tome 10 millones de tokens al mes con una división del 70% de entrada / 30% de salida (una combinación típica de chat/agente):
• Luna: unos $5 al mes (aproximadamente $4.37 con caché de prompts).
• Terra: alrededor de $50 al mes.
• Sol: alrededor de $125 al mes (aproximadamente $109 con caché).
Eso es una diferencia de 25x entre Luna y Sol para el mismo volumen, exactamente la razón por la que asignar cada solicitud al nivel capaz más barato importa más que cualquier tarifa individual. (Estos coinciden con la calculadora de costos en la página de OrcaRouter, que estima a partir del precio de lista; tus números reales dependen del almacenamiento en caché y de tu combinación de entrada/salida).
Para qué sirve realmente cada nivel
GPT-5.6 Luna — el caballo de batalla del volumen
Luna es el nivel rápido y rentable, optimizado para cargas de trabajo de alto volumen y sensibles a la latencia: chat, clasificación, extracción, enrutamiento y tareas agénticas ligeras, con un tiempo hasta el primer token (p50) de aproximadamente 1,65 segundos. Tras el recorte, a $0.20 / $1.20, compite directamente con los modelos abiertos baratos y es la opción predeterminada para la gran mayoría de las llamadas sencillas. También es el nivel hacia el que OpenAI está orientando ChatGPT para consumidores: según su anuncio del 6 de agosto, GPT-5.6 Luna se convertirá en el modelo predeterminado para las cuentas Free y Go, con chats de solo texto ilimitados y un nuevo botón Think para un mayor razonamiento en preguntas más difíciles que llegará la semana siguiente (los límites de archivos, imágenes y voz se mantienen). OpenAI afirma que Luna comete un 62% menos de errores factuales que el GPT-5.5 Instant al que reemplaza, una cifra reportada por el proveedor, pero una señal clara de que el nivel de volumen es hacia donde la empresa dirige la mayor parte de su tráfico.
GPT-5.6 Terra — el punto medio equilibrado
Terra se sitúa entre el modelo de volumen y el insignia: más capaz que Luna para razonamiento y codificación más exigentes, pero mucho más económica que Sol. A $2 / $12, es una opción sensata por defecto cuando Luna no es suficiente pero no necesitas el insignia: extracción de complejidad media, redacción y tareas de varios pasos que siguen ejecutándose a escala.
GPT-5.6 Sol — el buque insignia
Sol está construido para el trabajo más difícil: razonamiento profundo de múltiples pasos, ingeniería de software a gran escala y flujos de trabajo agénticos de largo horizonte, manteniendo la coherencia en un contexto de ~1,05 millones de tokens y hasta 128K de salida. A $5 / $30 (base) es una opción premium: resérvalo para tareas que realmente lo necesiten, como codificación compleja de múltiples archivos o ejecuciones de agentes largas. El 6 de agosto, OpenAI también actualizó GPT-5.6 Sol en ChatGPT para usuarios Plus y Pro: la empresa dice que la versión de chat es más confiable con los hechos — 68% menos errores fácticos, según OpenAI — y da respuestas más enfocadas, con un nuevo control deslizante para ajustar cuánto esfuerzo de razonamiento aplica. La actualización es solo para el chat (el Sol detrás de Work y Codex no cambia), y el nivel de API se mantiene en $5 / $30.
La advertencia del token de razonamiento
GPT-5.6 son modelos de razonamiento, por lo que el costo efectivo de salida puede exceder una estimación ingenua: cuando el razonamiento está activado, los tokens de razonamiento internos se facturan como salida. En prompts difíciles con alto esfuerzo de razonamiento, eso puede dominar tu factura. Ajusta el esfuerzo de razonamiento a la tarea (bajo o desactivado para llamadas simples), limita los tokens de salida donde puedas y mide el uso real. Las tarifas más baratas por token ayudan; generar menos tokens ayuda más.
Cómo se compara cada nivel con sus rivales
El recorte de precios reposicionó a GPT-5.6 frente a la competencia. Según los informes, los $0.20 / $1.20 de Luna ahora subcotizan a Claude Haiku 4.5 por aproximadamente 5x en entrada y 4x en salida, y los $2 / $12 de Terra quedan por debajo del precio estándar de Claude Sonnet 5 (reportado en $3 / $15). Frente a los modelos de pesos abiertos, Luna se sitúa cerca del mínimo establecido por la línea V4 de DeepSeek y el GLM-5.2 de Zhipu (alrededor de $1.20 / $4.10), con los niveles de Qwen y Gemini Flash cerca. La conclusión: para trabajos sensibles al costo, Luna ahora es competitiva con los modelos capaces más baratos, en lugar de una alternativa premium a ellos — mientras que Sol sigue siendo un nivel genuinamente premium para capacidades que no se pueden obtener a bajo precio.
La verdadera palanca de ahorro: enrutar por dificultad
La factura más barata no es un único nivel: es hacer coincidir cada solicitud con el modelo menos costoso que pueda realizarla. En la práctica: envía las llamadas fáciles y de alto volumen a Luna (o a un modelo abierto económico), sube a Terra para las tareas más difíciles y usa Sol solo para la minoría realmente difícil. Combinado con caché y lotes, esto reduce los costos de forma habitual mucho más que cualquier cambio de precio individual. El inconveniente es operativo: no quieres reintegrar tres niveles de OpenAI más alternativas de modelos abiertos por separado.
Accede a los tres (y rivales más baratos) a través de un único endpoint.
Aquí es donde un enrutador neutral al proveedor resulta útil. OrcaRouter expone GPT-5.6 Luna, Terra y Sol — a los mismos precios posteriores al recorte, con 0% de margen — a través de un único endpoint compatible con OpenAI, junto con modelos abiertos más económicos como DeepSeek V4 Pro, GLM-5.2 y Qwen. Cambiar de nivel (o probar A/B a Luna contra un modelo abierto) es un cambio de configuración, no una reintegración, y puedes enrutar cada solicitud a la opción más económica.

La tarjeta de tarifas de Luna posterior al recorte es visible en la propia página del modelo de OrcaRouter a precio de lista — $0,20 / $1,20 por millón de tokens — porque el router transmite los precios de los proveedores con un margen del 0%, con una calculadora de costos en la página para una factura mensual típica. También hay un nivel gratuito y una página de ofertas para ahorros adicionales.

Preguntas frecuentes
¿Cuáles son los precios de GPT-5.6 después del recorte?
Luna $0.20 / $1.20, Terra $2 / $12 y Sol $5 / $30 por millón de tokens de entrada/salida. Luna y Terra se redujeron el 30 de julio de 2026; Sol se mantiene sin cambios.
¿Qué nivel de GPT-5.6 debería usar?
Luna para trabajo de alto volumen y sensible a la latencia; Terra para tareas más exigentes que no necesitan el modelo insignia; Sol para el razonamiento más complejo y codificación agéntica. Enruta según la dificultad para minimizar el costo.
¿Es GPT-5.6 Luna gratis en ChatGPT?
OpenAI anunció el 6 de agosto que GPT-5.6 Luna se convertirá en el modelo predeterminado para las cuentas gratuitas y de Go de ChatGPT, con chats ilimitados solo de texto; los límites continúan en la carga de archivos, imágenes y herramientas de voz, y un botón Think para razonamiento avanzado se está implementando por separado. Estos son planes declarados por OpenAI, no verificados de forma independiente.
¿Cuánto cuesta GPT-5.6 al mes?
Con 10M tokens al mes (70% de entrada): aproximadamente $5 en Luna, $50 en Terra y $125 en Sol — una diferencia de 25 veces, antes del caché. Su costo real depende del caché y de su combinación de entrada/salida.
¿Tienen los tres niveles la misma ventana de contexto?
Sí: aproximadamente un contexto de 1,05 millones de tokens y hasta 128 000 tokens de salida, con soporte de visión, herramientas, JSON y razonamiento.
¿Cómo afecta el almacenamiento en caché de prompts al costo?
El almacenamiento en caché reduce drásticamente el costo del contexto repetido: la lectura de caché de Luna cuesta alrededor de $0.02 por millón de tokens frente a $0.20 si es nueva, así que reutiliza los prompts almacenados en caché siempre que sea posible. Por el contrario, las entradas largas pueden llevarte a un nivel de contexto largo más costoso.
¿Cómo se comparan los niveles con Anthropic o los modelos abiertos?
Según los informes, Luna es más barata que Claude Haiku 4.5 (~5x entrada / 4x salida) y Terra está por debajo de Claude Sonnet 5 ($3 / $15). Luna también se acerca al umbral económico de los modelos abiertos (DeepSeek, GLM-5.2 ~$1.20/$4.10).
¿Dónde puedo usar los tres niveles juntos?
A través del único endpoint compatible con OpenAI de OrcaRouter con un margen de beneficio del 0%, junto con modelos abiertos más baratos para el enrutamiento basado en la dificultad.
En resumen
Tras el recorte, GPT-5.6 Luna ($0.20 / $1.20) y Terra ($2 / $12) resultan atractivos para trabajo de alto volumen y de gama media, mientras que Sol ($5 / $30) sigue siendo el buque insignia premium: una diferencia de coste de 25x que premia el enrutamiento inteligente. El lanzamiento para consumidores refuerza la división: OpenAI está convirtiendo a Luna en la opción gratuita por defecto, mientras reserva la actualización de fiabilidad de Sol para los planes de pago, algo que para los desarrolladores de API es una razón más para enrutar el tráfico sencillo hacia Luna. Los mayores ahorros provienen de enrutar según la dificultad, apoyándose en el almacenamiento en caché y el procesamiento por lotes, y controlando los tokens de razonamiento en lugar de recurrir por defecto a un solo nivel. Hacerlo es más fácil a través de un único endpoint con margen del 0%, como OrcaRouter, donde los tres niveles (a los nuevos precios) se encuentran junto a los modelos abiertos más baratos con los que querrás compararlos.
Comparados en este artículo2
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
