Ilustración editorial de vector plano para el hero de un blog de tecnología sobre el precio de modelos insignia: un gran chip de modelo redondeado en azul profundo con un suave resplandor cian sobre un fondo claro, una etiqueta de precio de papel sujeta a su esquina, tres flujos de tokens que salen del chip hacia un indicador de precio circular con pequeñas marcas abstractas, una pequeña pila de bloques en caché junto al indicador, y una fina hoja de calendario que se desliza desde la izquierda. Fondo blanco con suaves acentos de degradado azul y cian y un sutil destello cálido; iconos minimalistas de línea plana; tipografía geométrica sans-serif moderna y limpia; sin texto legible.
Guides & Insights

Precios de la API de GPT-5.6 Sol: $4 / $20 por 1M de tokens después del recorte de precios

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

GPT-5.6 Sol cuesta $4.00 por millón de tokens de entrada y $20.00 por millón de tokens de salida en la API de GPT-5.6 Sol a partir de hoy — la misma tarifa de traspaso que el nivel insignia tiene en el directorio OrcaRouter, consultado el 2026-08-25 con margen cero. El 24 de agosto de 2026, OpenAI redujo el precio de la API de Sol en un 20% en entrada y aproximadamente 33% en salida, una promoción temporal que se extiende al menos hasta el 21 de noviembre de 2026. Sigue siendo el nivel más caro de la familia GPT-5.6, y es el primer nivel cuyo precio de lista se ha movido desde el recorte del 30 de julio, que omitió el nivel insignia. Las palancas importan más que el titular: la entrada reutilizada se factura a $0.40 por millón mediante el caché de prompts, la API por lotes baja a $2.00 / $10.00, y el modo rápido intercambia una prima de 2x por una velocidad de hasta 2.5x. Esta página es la referencia de precios para Sol específicamente — la tarjeta de tarifas exacta, cuánto cuesta realmente una solicitud, cómo se compara el nivel insignia con el resto, cuándo es una mala compra y cómo llamarlo a través de un endpoint compatible con OpenAI con tu propia clave.

Los precios son por millón de tokens (entrada / salida), a partir del 25 de agosto de 2026. El recorte — 20% en entrada, aproximadamente 33% en salida, vigente al menos hasta el 21 de noviembre de 2026 — es el anuncio propio de OpenAI, reportado a su valor nominal; las cifras en dólares se leen de las tarifas publicadas de la API de OpenAI y se contrastan con la página del modelo OrcaRouter para GPT-5.6 Sol. Las tarifas de caché, lote, modo rápido y contexto largo son anunciadas por OpenAI. Estas son tarifas promocionales, no un restablecimiento permanente: los precios se mueven, y pueden volver a moverse; verifica antes de construir.

El precio exacto, verificado hoy

Aquí está la lista de tarifas completa para GPT-5.6 Sol, verificada el 2026-08-25 a las tarifas promocionales. Las mismas tarifas se aplican a las solicitudes que utilizan el alias gpt-5.6, y las reducciones se están implementando en los planes de crédito elegibles de ChatGPT Work y Codex; las suscripciones de ChatGPT Pro, Plus y Business no cambian.

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

• Entrada — $4.00 por 1M de tokens en un fallo de caché (antes $5.00, 20% de descuento hasta el 21 de noviembre).

• Salida — $20.00 por 1M de tokens (antes $30.00, ~33% de descuento hasta el 21 de noviembre).

• Lectura de caché de prompt — $0.40 por 1M de tokens (antes $0.50), un descuento del 90% en cualquier entrada que reenvíes.

• Escritura de caché de prompt — $5.00 por 1M de tokens (antes $6.25).

• Nivel de contexto largo — las entradas de más de aproximadamente 272K tokens se facturan a $8.00 por entrada / $30.00 por salida (antes $10.00 / $45.00; los mismos múltiplos de 2x en entrada y 1.5x en salida ahora se aplican sobre la base más baja).

• Batch API — $2.00 de entrada / $10.00 de salida, un descuento fijo del 50 % (antes $2.50 / $15.00), asíncrona, normalmente lista en unas 24 horas.

• Modo rápido — $8.00 de entrada / $40.00 de salida (antes $10.00 / $60.00), un recargo de 2x por hasta aproximadamente 2.5x de velocidad de salida, sin cambios en la inteligencia.

• Ventana de contexto — ~1.05M tokens, hasta 128K de salida.

OrcaRouter traslada la tarifa del proveedor sin margen, por lo que la cifra en el directorio es la cifra que pagas — y una bajada del proveedor se refleja en el listado el mismo día en que entra en vigor. En la página del modelo en vivo, la tarjeta muestra $4.00 / $20.00 por 1M, lectura de caché $0.400, con insignias de Vision, Tools, JSON y Reasoning. Esta es la primera vez que el precio de lista de Sol se mueve desde la reducción del 30 de julio, que llevó a GPT-5.6 Luna a $0.20 / $1.20 y a GPT-5.6 Terra a $2 / $12 mientras que el buque insignia se mantuvo; el recorte del 24 de agosto es el turno del buque insignia.

Las palancas que cambian el precio efectivo

La tasa base es solo el punto de partida. Cuatro modificadores cambian lo que Sol realmente te cuesta:

• Almacenamiento en caché de prompts: el contexto reutilizado se factura a $0.40 por millón en lugar de $4 por contexto nuevo, y las escrituras en caché cuestan $5.00 por millón. Para cualquier agente o chat que reenvíe un prefijo grande en cada turno, el almacenamiento en caché es la palanca más importante en la factura. OpenAI vincula la caché por proyecto y clave de API, por lo que mantenerse en una sola clave (un solo canal) es lo que hace que los aciertos sigan llegando.

• Nivel de contexto largo: una solicitud cuya entrada supera aproximadamente 272K tokens pasa de la tarifa base a $8 / $30. Unos pocos prompts enormes pueden aumentar silenciosamente tu precio promedio, así que haz lotes o trunca cuando realmente no necesites el contexto profundo.

• Batch — la API Batch de OpenAI ejecuta trabajos de forma asíncrona con un tiempo de procesamiento de aproximadamente 24 horas a exactamente la mitad de precio: $2.00 / $10.00, con entrada en caché a $0.20 y escrituras en caché a $2.50. Se combina con el caché de prompts y es adecuada para evaluaciones, clasificación masiva y generación fuera de línea donde la latencia no importa.

• Modo rápido — $8 / $40 para hasta ~2.5x de rendimiento de salida, útil para trabajo crítico de latencia donde el usuario espera, como asistencia de codificación en vivo. Factura por token a 2x la tarifa estándar, no cuenta para los paquetes de TPM de Scale Tier comprados, y puede recurrir al procesamiento estándar si superas el límite de tasa compartido.

Lo que realmente cuesta una solicitud

Los precios por token son abstractos, así que aquí tienes ejemplos resueltos con las tarifas actuales:

• Llamada de chat única, 50K de entrada + 20K de salida: $0.20 + $0.40 = $0.60 (antes $0.85).

• 1M de entrada + 1M de salida — $4 + $20 = $24 (antes $35).

• Turno agéntico, 200K de contexto en caché + 20K de entrada nueva + 30K de salida — $0.08 + $0.08 + $0.60 = $0.76. El mismo turno con caché fría — 220K de entrada nueva a $0.88 más $0.60 de salida — suma $1.48. El caché lo reduce aproximadamente a la mitad.

• Un mes de 10M de tokens con una división 70% entrada / 30% salida, con el 80% de la entrada servida desde caché: 1.4M de entrada sin caché ($5.60) + 5.6M en caché ($2.24) + 3M de salida ($60) ≈ $68. Sin caché, el mismo mes es de $88 — y el mismo mes en GPT-5.6 Terra cuesta alrededor de $50, o alrededor de $5 en GPT-5.6 Luna. Esa diferencia de ~14x entre Sol y Luna es por lo que la correspondencia de niveles importa más que cualquier tarifa individual.

Dos advertencias elevan la tarifa efectiva. Sol es un modelo de razonamiento — los tokens de razonamiento interno se facturan como salida a 20 dólares por millón. Un prompt difícil con un ajuste de esfuerzo de razonamiento alto puede gastar una gran parte de su presupuesto de salida en pensar, por lo que el costo efectivo de salida en trabajos difíciles supera con creces una estimación ingenua. Además, el tokenizador de OpenAI es más verboso que el de la generación anterior en algunas entradas, por lo que el mismo texto puede costar más tokens de los que habría costado en GPT-5.5. Ajusta el esfuerzo de razonamiento a la tarea, limita la salida cuando puedas y mide el uso real antes de proyectar una factura.

Cómo se compara el precio de Sol con el resto del mercado

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Leído en comparación con los precios de lista publicados el 2026-08-25 (Sol a su tarifa promocional). La cobertura de prensa interpreta el recorte como una respuesta a la presión de precios de Anthropic y de los laboratorios chinos — eso es una interpretación de terceros, no una declaración de OpenAI.

• GPT-5.6 Terra — $2 / $12, el nivel medio tras el recorte. Sol ahora cuesta 2 veces más en entrada y ~1.7 veces más en salida; Terra es la opción por defecto cuando no necesitas razonamiento de gama alta.

• GPT-5.6 Luna — $0.20 / $1.20, el nivel de volumen posterior al recorte. Una brecha de entrada de 20x frente a Sol; Luna está pensada para la mayor parte del tráfico común.

• Claude Opus 5 — $5 / $25. Sol es ahora un 20% más barato tanto en entrada como en salida sobre el papel, en comparación con igualar a Opus 5 en entrada a las tarifas antiguas. La comparación ya favorecía a Sol antes del recorte: este blog midió anteriormente que Sol utiliza aproximadamente un 34,5% menos de tokens que un modelo de Anthropic en la misma muestra de inglés/mixto, y un análisis publicado de economía de tokens (TheBlockBeats) estimó que la factura total de Sol puede ser alrededor de un 21% más baja que la de Claude Opus 5 para un trabajo equivalente, incluso cuando la tarifa de salida de Sol era más alta. Mide tu propio tokenizador, no el precio de etiqueta.

• Claude Fable 5 — $10 / $50. Sol es ahora un 60% más barato en entrada y un 60% más barato en salida que el nivel superior de Anthropic (era 50% / 40% con las tarifas antiguas).

• Claude Opus 4.8 — $5 / $25. Sol ahora es un 20% más barato en entrada y un 20% más barato en salida — la ventaja de precio sobre el modelo insignia de Anthropic de la generación anterior se ha invertido por completo.

• Grok 4.6 — $2 / $6. El número más afilado del tablero: igualó a GPT-5.6 Sol en el índice de Artificial Analysis (ambos 61) con entrada 2x más barata y salida ~3.3x más barata, frente a una brecha de 2.5x / 5x con las tarifas anteriores.

• DeepSeek V4 Pro — $0.44 / $0.88 fuera de horas punta (en horas punta se duplica). Un universo de precios completamente distinto, para el carril de los pesos abiertos económicos.

El marco honesto: Sol sigue siendo un buque insignia premium, pero el recorte lo saca de la franja de precios más alta — los $20 de salida ahora están por debajo de los $25 de Claude Opus 5 y los $25 de Claude Opus 4.8, dejando los $50 de Claude Fable 5 como la única tarifa de salida de buque insignia cerrado por encima. Gana en costo efectivo por unidad de trabajo duro (su tokenizador, su razonamiento, su contexto largo) en lugar de en la tarifa absoluta, y el recorte del 24 de agosto refuerza ese argumento. Si tu tráfico son indicaciones cortas y tareas simples, un Terra de $2, una Luna de $0.20 o un Grok 4.6 de $2/$6 sigue siendo la opción más barata — y en el índice, Grok 4.6 no cede nada sobre el papel.

Cuando Sol es la elección equivocada

Four cases where this price is not the one you want:

Indicaciones breves y sencillas. Por debajo de unos 20K tokens y sin razonamiento profundo, el modelo premium insignia se desperdicia. GPT-5.6 Terra a $2 / $12 o GPT-5.6 Luna a $0.20 / $1.20 maneja el nivel de volumen por una fracción del costo, y un modelo de clase Grok 4.6 o DeepSeek cuesta todavía menos.

Volumen de alto razonamiento. Debido a que el razonamiento se factura como salida, un prompt difícil con un nivel de esfuerzo alto puede costar mucho más que la tarifa de salida nominal. Si tu carga de trabajo consiste en muchas llamadas difíciles, mide los tokens de salida reales antes de comprometerte — la tarifa efectiva puede sorprenderte.

Precio por token como único objetivo. Grok 4.6 empató con Sol en el índice a $2 / $6, y DeepSeek V4 Pro se sitúa en $0.44 / $0.88 fuera de horas pico. Si una puntuación de referencia de vanguardia no es el requisito estricto, esos modelos ofrecen tarifas por token mucho más bajas para la misma clase de trabajo.

Presupuestos de latencia estrictos. {{1}}Sol es un modelo de razonamiento grande, por lo que el tiempo hasta el primer token supera con creces al de un modelo de nivel Flash.{{/1}} {{2}}Para el chat en tiempo real donde importa un TTFT de menos de un segundo, el modo rápido a $8 / $40 ofrece rendimiento, no una menor latencia del primer token — y un modelo más pequeño sigue siendo la solución más barata.{{/2}}

¿Cómo llamarlo en OrcaRouter?

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol está alojado en OrcaRouter con el ID de modelo openai/gpt-5.6-sol, servido a través del endpoint compatible con OpenAI en api.orcarouter.ai/v1 a la tarifa del proveedor sin recargo. Si ya tienes un cliente de OpenAI, la migración es un cambio de URL base y de ID de modelo — nada más. La misma clave y endpoint dan acceso a más de 200 modelos, por lo que Sol está junto a GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 y los modelos de pesos abiertos con los que quieras compararlo, y puedes enrutar según la dificultad en lugar de integrar cada uno de nuevo.

Dos detalles específicos de OrcaRouter que vale la pena mencionar en una página de precios. BYOK: trae tu propia clave de OpenAI y OpenAI te factura directamente a sus propias tarifas — OrcaRouter añade $0 por token y mantiene intactos los límites de tasa y créditos de tu proveedor. Guardrails: el PII Shield y la política de contenido se ejecutan antes de la facturación, por lo que una solicitud bloqueada devuelve un 400 limpio y nunca se cobra, y el Agent Firewall evalúa las llamadas de herramientas y MCP antes de que se ejecuten.

La nota de honestidad que importa para una página de precios: enrutamos el modelo, no fijamos su precio. La cifra de $4 / $20 es la tarifa promocional de OpenAI trasladada directamente — y cuando OpenAI la cambió el 24 de agosto, el listado se actualizó ese mismo día, que es exactamente por lo que esta página está fechada. Si llamas a OpenAI directamente obtienes la misma tarifa; OrcaRouter existe para la ruta de una sola clave y sin recargo, si quieres un único endpoint en toda la línea de modelos.

Fuentes y fecha

Todos los precios anteriores se verificaron el 2026-08-25. Las cifras de GPT-5.6 Sol se leen de los precios publicados de la API de OpenAI, contrastadas con la página del modelo OrcaRouter para GPT-5.6 Sol (consultada el mismo día) y con los informes de prensa sobre el recorte del 24 de agosto (Indian Express, Economic Times, The Star); las tarifas de modo por lotes, modo rápido, escritura de caché y contexto largo son anunciadas por OpenAI. Las cifras de Claude, Grok y DeepSeek son los listados actuales del directorio de OrcaRouter, con DeepSeek V4 Pro mostrado a su tarifa fuera de horas punta. El precio de lista de Sol se mantuvo sin cambios desde su lanzamiento el 9 de julio hasta el recorte del 30 de julio y se movió por primera vez el 24 de agosto con esta promoción — que es exactamente por lo que la fecha importa aquí: las tarifas de $4 / $20 son temporales, y los precios cambian; trate cualquier página de "precios de GPT-5.6 Sol" anterior o posterior que encuentre con la fecha verificada. Las cifras aquí están actualizadas a día de hoy.

Cada precio anterior es la tasa en vivo en el GPT-5.6 Sol on OrcaRouter — verificado el 2026-08-25 con cero margen, listo para tu propia clave.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario