
GPT-6 Luna y GPT-6 Sol: el nivel económico que OpenAI aún no ha lanzado
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Hay un único artefacto sólido y verificable en esta historia, y no es ninguno de los dos nombres del titular. El 21 de septiembre, varios desarrolladores informaron haber visto la cadena GPT-6 Sol medium dentro de los registros de fusión de código de NVIDIA —el repositorio de un tercero, no el del proveedor. En torno a ese único artefacto se ha congregado un rumor mucho mayor: que OpenAI está preparando el lanzamiento de GPT-6 Sol como un caballo de batalla de gama media y GPT-6 Luna como su gama económica, por debajo del buque insignia GPT-6 Astra que OpenAI lanzó realmente el 3 de septiembre de 2026. Ni GPT-6 Sol ni GPT-6 Luna tienen un identificador de modelo, un precio, una ventana de contexto, una tarjeta de sistema ni una línea en la documentación propia de OpenAI. No obstante, la gama que ocuparían ya tiene un ocupante activo en GPT-5.6 Luna —el miembro económico de la familia GPT-5.6, a la venta desde el 9 de julio de 2026 a 0,20 $ por millón de tokens de entrada y 1,20 $ por millón de salida. Esa asimetría lo es todo en esta historia, y es la razón por la que merece la pena leer este artículo en lugar de limitarse a cubrirse las espaldas.
¿Qué está realmente documentado y qué es inferencia?
Empieza con el artefacto, porque es lo único aquí que un lector puede ir a mirar. El registro de merge de NVIDIA es real en el sentido de que las personas que lo reportaban estaban leyendo un repositorio público, y el cambio de código descrito es anodino: un commit escrito con la asistencia de GPT-6 Astra y luego revisado por algo etiquetado como GPT-6 Sol. El artículo de 新智元 que llevó el hallazgo a una audiencia más amplia lo presentó como un ejemplo funcional de una "matriz de trabajadores de IA" — una cadena en la que un modelo escribe y otro revisa. Trata ese encuadre como comentario. El registro de merge en sí te dice que alguien dentro de la infraestructura de un tercero se está preparando para servir un modelo bajo ese nombre. No te dice que OpenAI haya lanzado uno, y no dice absolutamente nada sobre Luna.
El resto del argumento a favor de un lanzamiento de GPT-6 Sol es más débil de lo que sugiere la cobertura que lo rodea. La prensa tecnológica china ha informado de un precio filtrado de $2,50 por millón de tokens de entrada y $15 por millón de salida —aproximadamente la mitad de lo que cuesta GPT-5.6 Sol—, junto con afirmaciones de que se estaba implementando soporte en la API de OpenAI, Codex OAuth, la entrada de imágenes y el manejo de contexto largo, y un supuesto lanzamiento el martes 22 de septiembre. Parte de esos informes apuntaba a las 3 a. m. del martes. En el momento de escribir esto, no hay ningún anuncio de OpenAI, ninguna cadena identificadora, ninguna entrada en la página de precios y ningún avistamiento en el selector de modelos para GPT-6 Sol o GPT-6 Luna. Un medio que cubría la misma cadena de rumores señaló que sus propias cifras de precios no coincidían entre sí, citando $2,50/$15, $4/$30 y otras cifras en circulación —que es el aspecto que tiene un rumor después de pasar por cuatro traducciones, no el que tiene una lista de precios.
GPT-6 Luna es todavía más débil, y vale la pena ser directo al respecto. La presencia de Luna en la historia se remonta a una sola publicación del 6 de septiembre, en la que la cuenta de X @kimmonismus escribió que OpenAI "ya estaba preparando el lanzamiento de GPT-6 Sol" y luego razonó, a partir del patrón de nombres de GPT-5.6, que "Sol, Terra y Luna aún están por llegar". Eso es un argumento basado en la simetría de nombres. Luna nunca ha sido objeto de una afirmación por derecho propio —ninguna filtración, ninguna captura de pantalla, ninguna cadena de modelo, ningún precio. Aparece en recopilaciones posteriores solo porque apareció en la primera publicación.
Tres fechas, y lo que cada una demostró
Vale la pena leer las cronologías de filtraciones como una tarjeta de puntuación, porque esta ya tiene una.
• 6 de septiembre — la afirmación sobre la familia. Inferencia de la comunidad a partir del precedente de GPT-5.6, sin artefacto adjunto. Sin verificar entonces, sin verificar ahora.
• 15–16 de septiembre — Sam Altman publicó que OpenAI tenía un "gran lanzamiento esta semana, y luego para devday un lanzamiento x 6", y después se retractó de la primera mitad a la noche siguiente, diciendo que lo que más le entusiasmaba lanzar llegaría, en cambio, la semana siguiente y que "valdría la pena la espera". No nombró ningún producto en ninguna de las dos publicaciones. Este es el único elemento declarado por un ejecutivo en toda la historia, y se refiere al momento y a nada más.
• 21 de septiembre — el registro de fusión de NVIDIA, y el primer artefacto de la cadena. Un registro de fusión en el repositorio de otra persona es una señal real de que se está preparando un modelo para su servicio. No es un lanzamiento.
• martes, 22 de septiembre — hoy, y la fecha que el propio rumor mencionó. Al momento de escribir esto, no hay ningún anuncio de OpenAI, ni identificador de modelo, ni entrada en la lista de precios, ni avistamiento en el selector de modelos de GPT-6 Sol, y ninguno en absoluto para GPT-6 Luna.
El próximo hito con fecha es el DevDay, el martes 29 de septiembre en Fort Mason Center —el «ship x 6» al que se refirió Altman, y la fecha de respaldo a la que apuntaba el informe chino si el lanzamiento del martes no ocurría. Si un modelo de gama media o económica de sexta generación es real, ahí es donde es más plausible que aparezca, y una sola línea en la propia lista de modelos de OpenAI resolvería todo lo que este artículo tiene que matizar.
El nivel ya existe, y es barato.
Aquí está la parte de la historia que es totalmente verificable, y es la razón por la que un "GPT-6 Luna" es algo extraño de esperar. GPT-5.6 Luna ya está disponible, y es barato de una manera en que los modelos de frontera no lo son.
• Precio — $0.20 por millón de tokens de entrada y $1.20 por millón de salida, según la propia documentación de la API de OpenAI. Se lanzó el 9 de julio de 2026 a $1.00 / $6.00 y se redujo aproximadamente un 80 % a finales de julio.
• Tarifas de caché y de contexto largo — las lecturas de entrada en caché se aplican con un descuento de aproximadamente el 90%; las solicitudes que superan el umbral de contexto largo se facturan a unos $0.40 / $1.80 por la solicitud completa.
• Contexto y salida — una ventana de contexto de 1M de tokens con una salida máxima de 128K. El tiempo medio hasta el primer token se indica en 1,83 segundos.
• Rol — OpenAI sustituyó GPT-5.5 Instant por GPT-5.6 Luna como modelo predeterminado de ChatGPT Free y Go los días 6 y 7 de agosto de 2026, y añadió un botón "Think" para un razonamiento más profundo la semana siguiente.
• Efecto del recorte — el 9 de septiembre, la directora financiera de OpenAI, Sarah Friar, dijo en la conferencia Communacopia de Goldman Sachs que la reducción de precios produjo un aumento de aproximadamente diez veces en el uso, y sostuvo que desplegar Luna es más barato que ejecutar GLM 5.3 de Z.ai en una capa de nube. Ambas son cifras de proveedor presentadas por una ejecutiva en un evento de inversores: vale la pena reportarlas, no tratarlas como verificadas de forma independiente.

Pon los dos precios uno al lado del otro y la cuestión de los niveles se responde por sí sola. El precio reportado de GPT-6 Sol, $2.50 / $15, es más de doce veces la tarifa de entrada de GPT-5.6 Luna. Una Luna de sexta generación no competiría con Sol: competiría con el modelo que OpenAI ya está regalando como su opción predeterminada del nivel gratuito.
Por qué un nivel barato de GPT-6 es plausible de todos modos
Hay un argumento comercial real bajo el rumor, y tiene que ver con dónde están los tokens más que con dónde está la tabla de clasificación. GPT-6 Astra cuesta $10 por millón de tokens de entrada y $50 por millón de salida, y las solicitudes de contexto largo se facturan a un nivel superior. Indica una ventana de contexto de 1M de tokens — la misma clase que la generación 5.6, a una tarifa mucho más alta. En Artificial Analysis, la configuración de máximo razonamiento de Astra obtiene 53 en el Intelligence Index del rastreador, a unos $3.26 por tarea, lo cual es un precio defendible para trabajo de frontera y uno indefendible para clasificación, extracción, enrutamiento o bucles de agentes de alto volumen.
Esa brecha es exactamente la forma que produjo a Sol, Terra y Luna en la generación 5.6, y es la razón por la que los informes siguen apuntando a un Sol de gama media en lugar de a un segundo buque insignia. El propio comportamiento de precios de OpenAI respalda el rumbo: su respuesta a la presión de costos en julio fue reducir en un 80% el precio de la gama económica en lugar de reemplazarla, y su director financiero subió al escenario en septiembre para debatir sobre precios frente a modelos chinos de pesos abiertos. Una empresa que defiende la gama baja del mercado es una empresa que tiene la intención de seguir lanzando productos en la gama baja.
El contraargumento es igualmente real, y es la razón por la que la lógica de la filtración es más débil de lo que parece. Lanzar un modelo económico de la serie 6 implica pedir a todos los equipos que ya han ajustado prompts, almacenamiento en caché y arneses de evaluación en torno a GPT-5.6 Luna que vuelvan a validar todo ello por un beneficio marginal. Esa es una razón genuina por la que un GPT-6 Luna podría no anunciarse nunca — no porque el rumor sea falso, sino porque puede que la decisión de producto que presupone no se haya tomado.

Cómo prepararse sin apostar por un modelo que no existe
No puedes llamar a GPT-6 Sol ni a GPT-6 Luna. Nadie puede, y ninguna plataforma los aloja; lo máximo que se ha reportado es que un desarrollador vio que se devolvía una cadena de modelo GPT-6 Sol donde se esperaba una solicitud de GPT-5.6 Sol, lo cual es una curiosidad de enrutamiento más que una disponibilidad. Lo que sí puedes hacer es que la llegada eventual sea barata de adoptar y costosa de que te sorprenda.
La versión práctica consiste en mantener el nombre del modelo fuera del código de tu aplicación. Si tu stack llama a un modelo mediante una cadena codificada de forma fija, adoptar un modelo de gama media de sexta generación implica un despliegue, una pasada de recualificación de prompts y una nueva ejecución de evaluación. Si llama a una ruta, significa cambiar una sola línea. OrcaRouter expone más de 200 modelos detrás de una única API con 0 % de recargo — el precio de lista del proveedor se traslada directamente, así que cuando un proveedor baja un precio, la cifra de nuestro lado se mueve el mismo día, que es como la rebaja del 80 % de GPT-5.6 Luna apareció aquí sin que nadie renegociara nada. La conmutación por error automática hace el resto: apunta una ruta al nivel más barato que cumpla tu umbral de evaluación, y un modelo no lanzado se queda fuera de la ruta hasta que exista y pase.

Ese es el uso honesto de una filtración como esta: no planear una migración a un modelo que no se ha anunciado, sino notar qué hueco en tu stack llenaría un nuevo modelo de gama media, y asegurarte de que llenarlo más tarde sea un cambio de configuración y no un proyecto.
¿Qué contaría como evidencia?
La línea entre una filtración que vale la pena seguir y una filtración que vale la pena ignorar es si el artefacto es algo producido por el proveedor o por una parte neutral. Aplicado a este caso:
• Cuenta — un identificador de modelo en la documentación de la API de OpenAI, una tarjeta de sistema, una entrada en la página de precios de OpenAI, una aparición en el selector de modelos de ChatGPT, una primera ejecución de benchmark independiente en un rastreador como Artificial Analysis, o un listado en un catálogo de enrutamiento con un endpoint real detrás.
• No cuenta — un registro de fusión en el repositorio de otra persona por sí solo, una lista de rumores sin atribución en un resumen, una captura de pantalla filtrada de un precio que tres medios reportan de tres maneras distintas, la observación de un desarrollador anónimo o una probabilidad de un mercado de predicción. Los mercados de predicción cotizaban aproximadamente un 77–78 % para un lanzamiento de GPT-6 para el 30 de septiembre a finales de julio. Esa es la opinión de un mercado sobre una fecha, no evidencia sobre un modelo, y se cotizaba antes de que se lanzara Astra.
Hasta que llegue uno de los primeros de la lista, la postura precisa sobre ambos nombres es limitada y sin glamour. GPT-6 Sol es una cadena en un registro de fusión de NVIDIA y un precio en el que nadie se pone de acuerdo. GPT-6 Luna es un nombre que aparece en un rumor sobre la familia, en una lista que nadie ha reclamado, y ocupa un nivel que GPT-5.6 Luna ya llena a $0.20 de entrada y $1.20 de salida. No hay nada a lo que migrar, nada que evaluar con benchmarks y nada a lo que poner precio. Lo único que vale la pena hacer hoy es asegurarte de que, cuando exista, tu enrutamiento no tenga que reescribirse para alcanzarlo.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
