Ilustración editorial de vector plano para el hero de un blog de tecnología sobre el precio de modelos insignia: un gran chip de modelo redondeado en azul profundo con un suave resplandor cian sobre un fondo claro, una etiqueta de precio de papel sujeta a su esquina, tres flujos de tokens que salen del chip hacia un indicador de precio circular con pequeñas marcas abstractas, una pequeña pila de bloques en caché junto al indicador, y una fina hoja de calendario que se desliza desde la izquierda. Fondo blanco con suaves acentos de degradado azul y cian y un sutil destello cálido; iconos minimalistas de línea plana; tipografía geométrica sans-serif moderna y limpia; sin texto legible.
Guides & Insights

Precios de la API de GPT-5.6 Sol: $5 / $30 por 1M de Tokens, caché a $0.50, y lo que realmente cuesta

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

GPT-5.6 Sol cuesta $5.00 por millón de tokens de entrada y $30.00 por millón de tokens de salida en la API de GPT-5.6 Sol: la misma tarifa que el nivel insignia mantiene en el directorio de OrcaRouter, verificada el 18 de agosto de 2026, sin margen adicional. Es el nivel más caro de la familia GPT-5.6 y el único cuyo precio de lista no cambió en el recorte del 30 de julio, por lo que la tarjeta de tarifas en la página en vivo del modelo GPT-5.6 Sol es contra la que hay que presupuestar. Las palancas importan más que el titular: la entrada reutilizada se factura a $0.50 por millón mediante el caché de mensajes, la API por lotes baja a $2.50 / $15.00, y el modo rápido intercambia una prima de 2x por hasta 2.5x de velocidad. Esta página es la referencia de precios para Sol específicamente: la tarjeta de tarifas exacta, cuánto cuesta realmente una solicitud, cómo se compara el nivel insignia con el resto, cuándo no es la compra correcta y cómo llamarlo a través de un endpoint compatible con OpenAI con tu propia clave.

Los precios son por millón de tokens (entrada / salida), al 18 de agosto de 2026. Las cifras en dólares se toman de las tarifas API publicadas por OpenAI y se contrastan con la página del modelo OrcaRouter para GPT-5.6 Sol; las tarifas de caché, lote, modo rápido y contexto largo son anunciadas por OpenAI. Los precios cambian: verifica antes de construir.

El precio exacto, verificado hoy

Aquí está la tarjeta de tarifas completa para GPT-5.6 Sol, verificada el 2026-08-18:

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

Entrada — $5.00 por 1M de tokens en caso de fallo de caché.

Salida — $30.00 por 1M tokens.

Lectura de caché de prompts — $0.50 por 1M de tokens, un descuento del 90% en cualquier entrada que reenvíes.

Escritura de caché de prompt — $6.25 por 1M tokens.

Nivel de contexto largo — las entradas que superan aproximadamente 272K tokens se facturan a $10.00 por entrada / $45.00 por salida (2x entrada, 1.5x salida).

Batch API — $2.50 de entrada / $15.00 de salida, un 50 % de descuento fijo, asíncrono, normalmente listo en unas 24 horas.

Modo rápido — $10.00 de entrada / $60.00 de salida, un sobreprecio de 2x para hasta aproximadamente 2.5x de velocidad de salida sin cambios en la inteligencia.

Ventana de contexto — ~1.05M tokens, hasta 128K de salida.

OrcaRouter pasa la tarifa del proveedor sin recargo, por lo que la cifra en el directorio es la cifra que pagas. En la página del modelo en vivo, la tarjeta muestra $5.00 / $30.00 por 1M, lectura de caché $0.500, con insignias de Vision, Tools, JSON y Reasoning. El $5 / $30 de Sol también es el precio sin recorte: la reducción del 30 de julio de OpenAI se aplicó a GPT-5.6 Luna (ahora $0.20 / $1.20) y GPT-5.6 Terra (ahora $2 / $12), mientras que el buque insignia se mantuvo.

Las palancas que cambian el precio efectivo

La tasa base es solo el punto de partida. Cuatro modificadores cambian lo que Sol realmente te cuesta:

Caché de prompts — el contexto reutilizado se factura a $0.50 por millón en lugar de $5 por contexto nuevo, y las escrituras en caché cuestan $6.25 por millón. Para cualquier agente o chat que reenvíe un prefijo largo en cada turno, el almacenamiento en caché es la mayor palanca en la factura. OpenAI indexa la caché por proyecto y clave de API, así que mantenerse en una sola clave (un solo canal) es lo que hace que los aciertos sigan llegando.

Nivel de contexto largo — una solicitud cuya entrada supera aproximadamente 272K tokens pasa de la tarifa base a $10 / $45. Algunos prompts enormes pueden aumentar silenciosamente tu precio promedio, así que agrupa o recorta cuando realmente no necesites el contexto profundo.

Batch — La API de batch de OpenAI ejecuta trabajos de forma asíncrona con un tiempo de procesamiento de aproximadamente 24 horas a exactamente la mitad de precio: $2.50 / $15.00, con entrada en caché a $0.25 y escrituras de caché a $3.13. Se combina con el almacenamiento en caché de prompts y es adecuada para evaluaciones, clasificación masiva y generación offline donde la latencia no importa.

Modo rápido — $10 / $60 por hasta ~2.5x de rendimiento de salida, útil para trabajos críticos en latencia, en los que el usuario espera, como la asistencia de codificación en vivo. Factura por token a 2x la tarifa estándar, no cuenta para los paquetes de TPM de Scale Tier comprados, y puede recurrir al procesamiento estándar si superas el límite de tasa compartido.

Lo que realmente cuesta una solicitud

Los precios por token son abstractos, así que aquí tienes ejemplos resueltos con las tarifas actuales:

Una sola llamada de chat, 50K de entrada + 20K de salida — $0.25 + $0.60 = $0.85.

1M de entrada + 1M de salida — $5 + $30 = $35.

Turno agéntico, 200K de contexto en caché + 20K de entrada nueva + 30K de salida — $0.10 + $0.10 + $0.90 = $1.10. El mismo turno con caché fría — 220K de entrada nueva a $1.10 — totaliza $2.00. El almacenamiento en caché casi lo reduce a la mitad.

Un mes de 10M de tokens con una distribución de 70% entrada / 30% salida, con el 80% de la entrada servida desde caché: 1.4M de entrada nueva ($7.00) + 5.6M en caché ($2.80) + 3M de salida ($90) ≈ $100. Sin caché, el mismo mes cuesta $125 — y el mismo mes en GPT-5.6 Terra cuesta unos $50, o unos $5 en GPT-5.6 Luna. Esa brecha de 20x entre Sol y Luna es la razón por la que la elección del nivel adecuado importa más que cualquier tarifa individual.

Dos advertencias elevan la tasa efectiva. Sol es un modelo de razonamiento: los tokens de razonamiento interno se facturan como salida a $30 por millón. Un prompt difícil con un nivel alto de esfuerzo de razonamiento puede gastar una gran parte de su presupuesto de salida en pensar, por lo que el costo efectivo de salida en trabajos difíciles supera con creces una estimación ingenua. Además, el tokenizador de OpenAI es más verboso que el de la generación anterior en algunas entradas, por lo que el mismo texto puede costar más tokens de los que habría costado en GPT-5.5. Ajusta el esfuerzo de razonamiento a la tarea, limita la salida cuando puedas y mide el uso real antes de proyectar una factura.

Cómo se compara el precio de Sol con el resto del mercado

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Leído contra los precios de lista publicados el 2026-08-18:

GPT-5.6 Terra — $2 / $12, el nivel medio tras el recorte. Sol cuesta 2.5x más en entrada y salida; Terra es la opción por defecto cuando no necesitas razonamiento insignia.

GPT-5.6 Luna — $0.20 / $1.20, el tramo de volumen posterior al recorte. Una brecha de entrada de 25x frente a Sol; Luna tiene un precio orientado a la gran mayoría del tráfico.

Claude Opus 5 — $5 / $25. Misma entrada, salida un 20% más barata sobre el papel. En la práctica, la comparación se invierte para algunas cargas de trabajo: este blog midió anteriormente que Sol usa aproximadamente un 34,5% menos de tokens que un modelo de Anthropic en la misma muestra en inglés/mixta, y un análisis publicado de economía de tokens (TheBlockBeats) estimó que la factura total de Sol puede ser alrededor de un 21% más baja que la de Claude Opus 5 para un trabajo equivalente, a pesar de la tarifa de salida más alta. Mide tu propio tokenizador, no el precio de etiqueta.

Claude Fable 5 — $10 / $50. Sol es la mitad del precio de entrada y un 40% más barato en la salida que el nivel superior de Anthropic.

Claude Opus 4.8 — $5 / $25. Misma entrada que Sol, salida más barata: la insignia de Anthropic de la generación anterior.

Grok 4.6 — $2 / $6. El número más destacado del marcador: igualó a GPT-5.6 Sol en el índice de Artificial Analysis (ambos 61) con una entrada 2.5x más barata y una salida 5x más barata.

DeepSeek V4 Pro — $0.44 / $0.88 fuera de horas punta (en horas punta se duplica). Un universo de precios completamente distinto, para el carril de los pesos abiertos económicos.

El marco honesto: Sol es un modelo insignia premium con una tasa de salida premium — la tasa de salida más alta de los modelos insignia de código cerrado por debajo de Claude Fable 5. Gana en costo efectivo por unidad de trabajo duro (su tokenizador, su razonamiento, su contexto largo) más que en la tasa absoluta. Si tu tráfico consiste en prompts cortos y tareas simples, una Terra de $2, una Luna de $0.20, o una Grok 4.6 de $2/$6 es la opción más barata — y en el índice, Grok 4.6 no cede nada sobre el papel.

Cuando Sol es la elección equivocada

Four cases where this price is not the one you want:

Indicaciones breves y sencillas. Por debajo de unos 20K tokens y sin razonamiento profundo, el modelo premium insignia se desperdicia. GPT-5.6 Terra a $2 / $12 o GPT-5.6 Luna a $0.20 / $1.20 maneja el nivel de volumen por una fracción del costo, y un modelo de clase Grok 4.6 o DeepSeek cuesta todavía menos.

Volumen de alto razonamiento. Debido a que el razonamiento se factura como salida, un prompt difícil con un nivel de esfuerzo alto puede costar mucho más que la tarifa de salida nominal. Si tu carga de trabajo consiste en muchas llamadas difíciles, mide los tokens de salida reales antes de comprometerte — la tarifa efectiva puede sorprenderte.

Precio por token como único objetivo. Grok 4.6 empató con Sol en el índice a $2 / $6, y DeepSeek V4 Pro se sitúa en $0.44 / $0.88 fuera de horas pico. Si una puntuación de referencia de vanguardia no es el requisito estricto, esos modelos ofrecen tarifas por token mucho más bajas para la misma clase de trabajo.

Presupuestos de latencia estrictos. Sol es un modelo de razonamiento grande, por lo que el tiempo hasta el primer token es muy superior al de un modelo de nivel Flash. Para chat en tiempo real donde importa un TTFT de menos de un segundo, el modo rápido a $10 / $60 ofrece rendimiento, no una menor latencia del primer token — y un modelo más pequeño sigue siendo la solución más económica.

¿Cómo llamarlo en OrcaRouter?

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol está alojado en OrcaRouter con el ID de modelo openai/gpt-5.6-sol, servido a través del endpoint compatible con OpenAI en api.orcarouter.ai/v1 a la tarifa del proveedor sin recargo. Si ya tienes un cliente de OpenAI, la migración es un cambio de URL base y de ID de modelo — nada más. La misma clave y endpoint dan acceso a más de 200 modelos, por lo que Sol está junto a GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 y los modelos de pesos abiertos con los que quieras compararlo, y puedes enrutar según la dificultad en lugar de integrar cada uno de nuevo.

Dos detalles específicos de OrcaRouter que vale la pena mencionar en una página de precios. BYOK: trae tu propia clave de OpenAI y OpenAI te factura directamente a sus propias tarifas — OrcaRouter añade $0 por token y mantiene intactos los límites de tasa y créditos de tu proveedor. Guardrails: el PII Shield y la política de contenido se ejecutan antes de la facturación, por lo que una solicitud bloqueada devuelve un 400 limpio y nunca se cobra, y el Agent Firewall evalúa las llamadas de herramientas y MCP antes de que se ejecuten.

La nota de honestidad que importa para una página de precios: enrutamos el modelo, no fijamos su precio. La cifra de $5 / $30 es la tarifa de OpenAI transmitida, y cuando OpenAI la cambia, el listado la sigue, que es exactamente por qué esta página está fechada. Si llamas a OpenAI directamente obtienes la misma tarifa; OrcaRouter existe para la ruta de una sola clave y sin margen si quieres un solo endpoint en toda la línea de modelos.

Fuentes y fecha

Todos los precios anteriores fueron verificados el 18 de agosto de 2026. Las cifras de GPT-5.6 Sol se obtienen de los precios de API publicados por OpenAI y se contrastan con la página del modelo OrcaRouter para GPT-5.6 Sol (verificada el mismo día) y con nuestras propias páginas de precios de GPT-5.6 publicadas. Las tarifas por lotes, modo rápido, escritura en caché y contexto largo son las anunciadas por OpenAI. Las cifras de Claude, Grok y DeepSeek son los listados actuales del directorio de OrcaRouter, con DeepSeek V4 Pro mostrado a su tarifa fuera de horas punta. OpenAI no ha cambiado el precio de lista de Sol desde su lanzamiento el 9 de julio de 2026 — el recorte del 30 de julio no afectó al modelo insignia —, pero los precios se mueven; trata cualquier página anterior de "precios de GPT-5.6 Sol" que encuentres teniendo en cuenta la fecha en que se verificó. Las cifras aquí indicadas son las vigentes a día de hoy.

Cada precio anterior es la tasa en vivo en el GPT-5.6 Sol on OrcaRouter — verificada el 2026-08-18 sin margen, lista para tu propia clave.

Comparados en este artículo3

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario

© 2026 OrcaRouter

Para proveedores

¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.

providers@orcarouter.ai

Únete a la comunidad

Discordsupport@orcarouter.aiXGitHubYouTube