
GPT-6 Sol vs GPT-5.6 Sol: un punto de índice, la mitad del precio y una regresión que nadie anunció
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 610 tok/s
- openaiNUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- openaiNUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- anthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- grokNUEVOGrok 4.72026-09-2146Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 189 tok/s
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
Sí, actualiza — pero lee el segundo párrafo antes de hacerlo. GPT-6 Sol, lanzado el 22 de septiembre de 2026, obtiene 48 en el Intelligence Index de Artificial Analysis. GPT-5.6 Sol, lanzado el 9 de julio de 2026, obtiene 47. Un punto. El modelo que lo reemplazó cuesta la mitad: $2.00 por millón de entrada y $10.00 por millón de salida frente a $4.00 y $20.00. Según las cifras principales, esta es la decisión de actualización más fácil de la gama actual, y el recorte de precio es real, permanente y la mayor reducción única que el proveedor ha aplicado a un buque insignia.
La complicación es que la propia evaluación de Artificial Analysis de GPT-6 Sol encontró una combinación de mejoras y regresiones, en lugar de un salto limpio hacia arriba. Hay regresiones en GDPval-AA v2.1. También hay un tramo de reajuste de precios para contexto largo por encima de 272.000 tokens de entrada que duplica aproximadamente la tarifa de entrada y eleva la de salida en un 50 % — y 272K es exactamente la banda en la que GPT-5.6 Sol tiene una fortaleza publicada. Una migración que parece una reducción directa a la mitad de tu factura puede, en tráfico de contexto largo, acabar más cerca de un empate con una contrapartida de capacidades aparejada.
Lo que realmente significa una ganancia de un punto del índice
Ambos modelos se midieron en la misma placa, versión 4.3.2, lo que convierte esta en la comparación más limpia de toda la serie GPT-6 Sol: sin diferencias de entorno de pruebas, sin desajustes entre proveedor e independiente, un solo laboratorio midiendo dos modelos de un mismo proveedor.
• AA Intelligence Index — GPT-6 Sol 48, clasificado 18.º de 212 vs GPT-5.6 Sol 47, clasificado 19.º de 212
• Coste por tarea de Index — GPT-6 Sol aproximadamente la mitad de GPT-5.6 Sol
• Velocidad de salida — GPT-6 Sol 104.4 tokens/seg vs GPT-5.6 Sol 72.6 tokens/seg
• Tiempo hasta el primer token — GPT-6 Sol 107,18 s frente a GPT-5.6 Sol, que es más rápido; ambos en comparación con una mediana del panel de 3,87 s
• Precio de entrada — GPT-6 Sol $2.00 por 1M vs GPT-5.6 Sol $4.00 por 1M
• Precio de salida — GPT-6 Sol $10.00 por 1M frente a GPT-5.6 Sol $20.00 por 1M
• Entrada en caché — GPT-6 Sol alrededor de un 90% de descuento frente a GPT-5.6 Sol $0.40 por 1M
• Tarifa por lotes — GPT-6 Sol no publicada vs GPT-5.6 Sol $2.50 / $15.00
• Nivel de contexto largo — GPT-6 Sol cambia de precio por encima de 272K de entrada frente a GPT-5.6 Sol, que no tiene un paso equivalente
• Ventana de contexto — GPT-6 Sol 872K por AA, 1.05M declarados frente a GPT-5.6 Sol aproximadamente 1.05M a 1.1M
• Salida máxima — 128K en ambos
• Publicado — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

Mira las dos líneas de velocidad juntas. GPT-6 Sol genera resultados aproximadamente un 44 % más rápido que su predecesor, y es drásticamente más lento a la hora de producir el primer token: 107,18 segundos frente a una mediana de la tabla de 3,87. GPT-5.6 Sol tampoco es un modelo rápido según los estándares de la tabla, pero no está en ese terreno. Si migraste a GPT-5.6 Sol para un producto interactivo, GPT-6 Sol no es un sustituto directo, y eso es una regresión funcional independiente de cualquier benchmark.
Una línea es discretamente favorable: la tarifa estándar de GPT-6 Sol de $2/$10 es inferior a la tarifa por lotes de GPT-5.6 Sol de $2,50/$15. Incluso el nivel con descuento del modelo antiguo es más caro que el precio de lista del nuevo. Esa es la prueba más contundente de que la rebaja es estructural y no promocional.
La regresión es la parte interesante
Artificial Analysis descubrió que GPT-6 Sol reduce aproximadamente a la mitad el costo por tarea, a la vez que produce una mezcla de mejoras y regresiones. GDPval-AA v2.1 es la regresión señalada. Por separado, GPT-5.6 Luna de OpenAI también sufrió una regresión en el Coding Agent Index, lo que sugiere un patrón en esta generación más que un fallo aislado en un solo modelo.
Esto merece tomarse en serio precisamente porque es el hallazgo independiente. Los materiales de lanzamiento de OpenAI se articulan en torno al costo por tarea y a las filas de benchmark que seleccionó; Artificial Analysis no tiene ningún producto que vender e informa lo que produjo su arnés de evaluación. Un modelo que es más barato y aproximadamente igual en la puntuación compuesta, pero mensurablemente peor en subtareas específicas, no es un modelo estrictamente mejor. Es un punto distinto en la frontera.
La versión práctica de eso: si tu carga de trabajo tiene una forma muy parecida a GDPval-AA —trabajo de conocimiento económicamente valioso, el tipo de tarea que ese benchmark fue creado para valorar—, entonces la ganancia compuesta de un punto no te alcanza, y la regresión es el número que importa. Si tu carga de trabajo es general, la reducción a la mitad del costo por tarea es el número que importa y el compuesto dice que no renunciaste a nada medible.
Donde GPT-5.6 Sol sigue ganando
GPT-5.6 Sol tiene un resultado publicado de recuperación de contexto largo que GPT-6 Sol no iguala con nada equivalente: MRCR v2, 8-needle, 91,5 % en el rango de 256K a 512K. Esa es una cifra de precisión de recuperación en la banda donde cambia la tarjeta de tarifas de GPT-6 Sol.
Ponga los dos hechos uno al lado del otro. Por encima de 272.000 tokens de entrada, toda la solicitud de GPT-6 Sol se vuelve a tarificar a aproximadamente $4 de entrada y $15 de salida. Esa es, aproximadamente, la tarifa antigua de GPT-5.6 Sol en la entrada y tres cuartos de ella en la salida; por lo tanto, el ahorro del 50% por el que migró se desploma a alrededor del 0% en la entrada y del 25% en la salida, exactamente en el rango de contexto donde GPT-5.6 Sol tiene una fortaleza documentada y GPT-6 Sol no tiene un equivalente publicado.
Los otros resultados publicados de GPT-5.6 Sol siguen siendo respetables y son la razón por la que algunos equipos no harán el cambio:
• El último examen de los agentes — GPT-5.6 Sol 53.6
• Terminal-Bench 2.1 — GPT-5.6 Sol 88,8 / 88,0
• SWE-Bench Pro — GPT-5.6 Sol 64,6
• OSWorld 2.0 — GPT-5.6 Sol 62.6
• BrowseComp — GPT-5.6 Sol 90,4
• GDPval-AA v2 — GPT-5.6 Sol 1747,8 Elo
• HLE — GPT-5.6 Sol 49.5
• MRCR v2, 8-agujas — GPT-5.6 Sol 91.5% de 256K a 512K
Estos son reportados por OpenAI. Ten en cuenta que BrowseComp con 90,4 y la cifra de MRCR son los dos más difíciles de reemplazar: los agentes de investigación web y la recuperación de contexto largo son cargas de trabajo en las que un modelo de hace dos meses con una cifra publicada es una apuesta más segura que un modelo nuevo sin una medición equivalente.
Lo que aporta GPT-6 Sol que no está en la lista de tarifas
El precio es la noticia, pero otras tres cosas cambiaron.
Primero, el techo de contexto. GPT-6 Sol figura con 872.000 tokens según Artificial Analysis, frente a una afirmación de 1,05 M en otros materiales de OpenAI, con una entrada máxima de 922 K. GPT-5.6 Sol se sitúa alrededor de 1,05 M a 1,1 M según la fuente. Sobre el papel, eso supone un pequeño retroceso en la ventana utilizable — con la salvedad de que el límite del tramo de 272 K, y no el techo, es lo que determina el coste.
En segundo lugar, la disponibilidad. GPT-6 Sol está en la API y en ChatGPT Work y Codex en Plus, Pro, Business, Enterprise y Edu, y los administradores de Enterprise deben habilitarlo antes de que los usuarios lo vean. No está en ChatGPT Chat. GPT-5.6 Sol tuvo un despliegue más amplio. Si la ruta de acceso de tu equipo pasa por un administrador de empresa, la migración no es solo un cambio de código.
Tercero, el lanzamiento de un nuevo buque insignia generalmente significa que el antiguo se convierte en la alternativa más económica en lugar de retirarse. GPT-5.6 Sol a $4/$20 sigue siendo un modelo excelente con 47 en el Index, y para trabajo de recuperación de contexto largo tiene una cifra publicada que GPT-6 Sol no tiene.
Una migración que cuesta menos de lo que parece
La razón por la que esta actualización en particular es fácil es que los dos modelos son del mismo proveedor, tienen la misma estructura de API y son adyacentes en la clasificación —lo que significa que la migración es un cambio en la cadena del modelo en lugar de una rearquitectura, y la ruta de respaldo ya está en tu código. GPT-5.6 Sol está en OrcaRouter al precio de lista de OpenAI, bajo el modelo de traspaso directo que hace que un cambio de precios de OpenAI se aplique de nuestro lado el mismo día en lugar de después de que un revendedor renegocie.
GPT-6 Sol no está en nuestro catálogo al momento de escribir esto — se puede acceder a él a través de la API propia de OpenAI. Así que la forma honesta de una migración es una ruta con GPT-5.6 Sol detrás de ella con la misma clave: enviar el tráfico nuevo a GPT-6 Sol, mantener el modelo anterior a un solo cambio de configuración de distancia y dejar que la conmutación por error automática cubra la ventana en la que la disponibilidad de un nuevo buque insignia aún se está estabilizando. Para un modelo que tiene dos días de antigüedad, con un interruptor de habilitación para Enterprise delante y un nivel de contexto largo que cambia la economía por encima de 272K tokens, tener la generación anterior aún conectada no es cautela — es la diferencia entre una tarde mala y una semana mala.

La lista de verificación de migración
Mide tu distribución real de contexto antes que nada. Si el percentil 95 de tus solicitudes se sitúa por debajo de 272.000 tokens de entrada, migra — el ahorro es un auténtico 50% en ambos lados de la factura, el costo por tarea se reduce a la mitad, y el índice compuesto dice que no renunciaste a nada. Si una parte significativa del tráfico se sitúa por encima de esa línea, modela el nivel con cuidado: a aproximadamente $4/$15, la ventaja sobre los $4/$20 de GPT-5.6 Sol es del 25% en salida y nula en entrada, y lo estás pagando con la pérdida de un resultado documentado de recuperación de contexto largo.
Comprueba si alguien espera al primer token. 107 segundos es aproximadamente veintiocho veces la mediana del tablero y es el modo de fallo que aparecerá primero en producción. Cualquier cosa que tenga a un humano al otro lado debería permanecer en GPT-5.6 Sol o redirigirse a otro lugar.
Luego, revisa la ruta de habilitación. Los planes Enterprise necesitan que un administrador active GPT-6 Sol, y está completamente ausente de ChatGPT Chat. Confirma que tus usuarios realmente puedan acceder a él antes de anunciar una migración internamente.
Por último, vigila GDPval-AA v2.1 en tus propias evaluaciones durante el primer mes. El laboratorio independiente encontró una regresión allí, y una ganancia compuesta de un punto no te dice si tu conjunto de tareas específico subió o bajó. Ejecuta tus evaluaciones en ambos modelos antes de hacer la transición, no después.

Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
