Una tarjeta de título generada con el encabezado «GPT-6.1 Sol Pricing» y el subtítulo «La tabla de tarifas, el único medidor que se movió y el acantilado de 272K», sobre una fila de cuatro chips redondeados que dicen «Entrada: $2.00 /M», «Entrada en caché: $0.10 /M», «Escritura de caché: $2.50 /M» y «Salida: $10.00 /M», con la leyenda «nivel estándar de OpenAI, consultado el 7 de octubre de 2026», con iconos de línea planos y minimalistas y el logotipo de OrcaRouter compuesto en la esquina inferior derecha.
Guides & Insights

Precios de GPT-6.1 Sol: la tabla de tarifas, el único medidor que se movió y el acantilado de 272K

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Esta página es la tarjeta de tarifas. GPT-6.1 Sol cuesta $2.00 por millón de tokens de entrada, $0.10 por millón de tokens de entrada en caché, $2.50 por millón de tokens de escritura de caché y $10.00 por millón de tokens de salida en el nivel estándar del proveedor, y GPT-6 Sol — el peldaño que este modelo reemplaza, y el que sirve nuestro catálogo — marca $2.00, $0.20, $2.50 y $10.00 para los mismos cuatro medidores. Un número difiere entre las dos tarjetas, el umbral a partir del cual ambos cambian de precio se sitúa en el mismo lugar, y los descuentos por debajo del precio de lista son multiplicadores en lugar de una segunda lista de precios. Todo en esta página está tomado de la propia página de precios para desarrolladores del proveedor y de sus dos páginas de modelo para GPT-6.1 Sol y GPT-6 Sol, todas consultadas el 7 de octubre de 2026, y de nuestras propias fichas de modelo cuando una cifra está etiquetada como nuestra. No se repite aquí ninguna narrativa de lanzamiento; si quieres lo que se lanzó, esa es otra página.

La tarjeta de tarifas, con los cuatro medidores de GPT-6 Sol justo debajo

OpenAI publica estos como precios por millón de tokens en el nivel de procesamiento estándar, para una solicitud de 272.000 tokens de entrada o menos. Las dos filas que importan están adyacentes a propósito, porque todo el argumento del lanzamiento se ve en el par: recorre cada medidor por turno y exactamente uno de ellos cambia.

• Entrada de GPT-6.1 Sol — $2.00 por millón de tokens, sin cambios respecto a GPT-6 Sol.
• Entrada en caché de GPT-6.1 Sol — $0.10 por millón de tokens, la mitad de los $0.20 de GPT-6 Sol.
• Escritura de caché de GPT-6.1 Sol — $2.50 por millón de tokens, sin cambios respecto a GPT-6 Sol.
• Salida de GPT-6.1 Sol — $10.00 por millón de tokens, sin cambios respecto a GPT-6 Sol.

• Entrada de GPT-6 Sol — $2.00 por millón de tokens.
• Entrada en caché de GPT-6 Sol — $0.20 por millón de tokens.
• Escritura en caché de GPT-6 Sol — $2.50 por millón de tokens.
• Salida de GPT-6 Sol — $10.00 por millón de tokens.

Tres de esas ocho líneas son el mismo número escrito dos veces, que es el punto: esto no es un reajuste de precios, es un medidor moviéndose en un modelo. Las escrituras en caché son 1.25× la tarifa de entrada sin caché en ambas tarjetas, así que $2.50 es $2.00 × 1.25 en ambas — la prima de escritura es una propiedad de la familia, no de la versión. Las lecturas en caché son la única línea donde los dos modelos se separan: en GPT-6.1 Sol una lectura en caché es el 5% de la tarifa de entrada, en GPT-6 Sol es el 10%, y OpenAI declara ambas como fracciones de la tarifa de entrada en lugar de como precios independientes.

Una nota sobre cómo esta página presenta las cifras. OpenAI publica la tarifa como un precio de lista plano por metro, sin ningún calificador de esfuerzo de razonamiento asociado a ninguna de las ocho líneas anteriores, por lo que ninguna de ellas se cita a un nivel de esfuerzo concreto. El esfuerzo cambia cuántos tokens consume una tarea, no cuánto cuesta un token, y por eso la tarifa es independiente del esfuerzo mientras que tu factura no lo es. Nada en esta página es una comparación directa con un modelo rival con el mismo esfuerzo, y no se implica ninguna comparación de ese tipo en ningún punto a continuación: cuando una cifra dependería del esfuerzo, esta página indica el esfuerzo con el que se generó.

A generated two-column scoreboard headed 'GPT-6.1 Sol vs GPT-6 Sol - the rate card'. Left column 'GPT-6.1 Sol' rows: 'Input: $2.00 /M', 'Cached input: $0.10 /M', 'Cache write: $2.50 /M', 'Output: $10.00 /M', 'Above 272K input: $4.00 /M', 'Above 272K cached: $0.20 /M'. Right column 'GPT-6 Sol' rows: 'Input: $2.00 /M', 'Cached input: $0.20 /M', 'Cache write: $2.50 /M', 'Output: $10.00 /M', 'Above 272K input: $4.00 /M', 'Above 272K cached: $0.40 /M'. A footer reads 'Standard tier prices per OpenAI's pricing page, read October 7, 2026; the whole request reprices above 272K input tokens.'

La única línea que se movió: entrada en caché, de $0.20 a $0.10

Un medidor de entrada en caché tarifica la parte de una solicitud que no cambió. Cuando un prefijo largo y estable —un prompt de sistema, un conjunto de esquemas de herramientas, un corpus recuperado, la transcripción acumulada de un bucle— se almacena deliberadamente para que la siguiente solicitud pueda reutilizarlo, los tokens reutilizados se facturan a la tarifa de caché en lugar de a la tarifa de entrada, y los tokens que se almacenan en primer lugar se facturan a la tarifa de escritura de caché. Es un descuento sobre la repetición, y existe porque, para el proveedor, la alternativa es recalcular el mismo prefijo desde cero en cada llamada.

Reducir a la mitad ese medidor no es el mismo tipo de noticia que reducir a la mitad el medidor de entrada, y merece la pena ser precisos con la diferencia. La tarifa de entrada es lo que cuesta cada token no cacheado de la familia, así que reducirla a la mitad sería un reajuste de precios de toda la línea del catálogo. La tarifa cacheada es una profundidad de descuento —cuánto por debajo de la tarifa de entrada se sitúa un token reutilizado—, así que moverla es un cambio en la recompensa por un comportamiento específico, más que un cambio en la línea base. La tarifa de entrada de GPT-6.1 Sol es de $2.00, exactamente lo que cobra GPT-6 Sol, por lo que una solicitud sin prefijo cacheado se factura de forma idéntica en los dos modelos. Reducir a la mitad el medidor cacheado lleva el descuento del 90% sobre la entrada al 95% sobre la entrada, y eso llega exactamente a las cargas de trabajo cuyos prefijos son lo bastante largos y se reutilizan con la suficiente frecuencia como para registrarse siquiera en la línea. Lee el medidor movido como «la misma tarea cuesta menos si usas caché» en lugar de «el modelo se abarató», y la tarjeta deja de ser sorprendente.

La aritmética se desprende de las dos filas y de nada más. Un millón de tokens de entrada en caché cuesta $0.10 en GPT-6.1 Sol y $0.20 en GPT-6 Sol, así que el lanzamiento vale diez centavos por millón cacheado —una cifra trivial en una sola llamada y significativa en una ejecución prolongada, porque un prefijo en caché se lee una vez por turno. Las escrituras en caché se mantienen sin cambios en $2.50, así que el punto de equilibrio para usar caché en absoluto no cambia con el lanzamiento: la amortización de una prima de escritura proviene de reutilizar el prefijo, no de cuál de las dos tarifas de caché se aplique.

Por encima de 272.000 tokens de entrada, se vuelve a calcular el precio de toda la solicitud.

Ambas tarjetas tienen un nivel de contexto largo, y la página de precios de OpenAI enuncia la regla de la misma manera para ambas: las solicitudes con más de 272K tokens de entrada se facturan a 2× las tarifas de entrada y de caché y 1,5× la de salida para la solicitud completa. La solicitud entera se recalcula —no solo los tokens que superan el umbral—. Esa frase es la que hay que llevarse de esta sección, porque es donde una tarifa deja de ser una tabla de consulta: con 272.001 tokens de entrada, toda la solicitud, incluido el primer token, se factura según las columnas de contexto largo.

La tarjeta de precios actualizados para GPT-6.1 Sol, por encima de 272.000 tokens de entrada:

• Entrada — $4.00 por millón de tokens, 2× la tarifa de contexto corto.
• Entrada en caché — $0.20 por millón de tokens, 2× la tarifa de contexto corto.
• Escritura en caché — $5.00 por millón de tokens, 2× la tarifa de contexto corto.
• Salida — $15.00 por millón de tokens, 1.5× la tarifa de contexto corto.

Y el mismo nivel en GPT-6 Sol, para que las dos filas puedan leerse en comparación entre sí:

• Entrada — $4,00 por millón de tokens.
• Entrada en caché — $0,40 por millón de tokens.
• Escritura de caché — $5,00 por millón de tokens.
• Salida — $15,00 por millón de tokens.

De nuevo, se recalcula el precio de toda la solicitud, no solo el del excedente, así que un prompt de 273.000 tokens se factura a $4.00 de entrada por los 273.000 tokens, en lugar de a $2.00 por los primeros 272.000 y $4.00 por los últimos mil. Eso hace que cruzar el umbral sea un escalón y no una pendiente, y hace que el cambio de entrada en caché se vea distinto por encima de la línea que por debajo de ella. Los $0.20 que GPT-6.1 Sol cobra por una lectura en caché por encima de 272K son exactamente la tarifa que GPT-6 Sol cobra por debajo de ella, así que una carga de trabajo de contexto largo con caché en el modelo más nuevo paga la tarifa previa al lanzamiento. El ahorro se mantiene en términos relativos por encima de la línea —$0.20 frente a los $0.40 de GPT-6 Sol sigue siendo una reducción a la mitad—, pero los diez centavos destacados no se aplican a la solicitud que cruza el umbral, porque esa solicitud no se factura con la tarifa de contexto corto en absoluto.

A screenshot of OpenAI's own developer pricing page headed 'Our latest models' and 'Prices per 1M tokens.', with column groups 'Short context' and 'Long context', each headed Model, Input, Cached input, Cache writes, Output. The gpt-6.1-sol row reads $2.00, $0.10, $2.50 and $10.00 in the short-context columns and $4.00, $0.20, $5.00 and $15.00 under long context; a gpt-6-astra row sits above it and a gpt-6-luna row below. Beneath the rows are three footnotes covering the 10% regional-processing uplift for models released on or after March 5, 2026, the rename of priority processing to Fast mode on July 30, 2026, and GPT-5.6 Sol's promotional pricing being available at least through November 21, 2026.

Los niveles de descuento, como multiplicadores

Todo lo que aparece debajo del precio de lista estándar es un multiplicador que se aplica a la tarjeta anterior, en lugar de ser una lista de precios independiente. Expresarlos como multiplicadores es lo que los hace portables: los mismos tres factores se aplican a los cuatro medidores de ambos modelos, de modo que un lector que tenga la tarjeta estándar dispone de toda la estructura de niveles.

• Lote — 50% del estándar. El precio por lotes de OpenAI es exactamente la mitad en los cuatro medidores de ambos modelos: $1.00 de entrada, $0.05 de entrada en caché, $1.25 de escritura en caché y $5.00 de salida por millón en GPT-6.1 Sol, y $1.00, $0.10, $1.25 y $5.00 en GPT-6 Sol.
• Flex — 50% del estándar, e idéntico a Lote en ambos modelos línea por línea, así que la elección entre ambos es una decisión de programación más que de precio.
• Modo rápido — 2× el estándar en los cuatro medidores de ambas tarjetas, sin ninguna excepción indicada en ninguna de las dos tablas de precios. El modo rápido cuesta $4.00 de entrada, $0.20 de entrada en caché, $5.00 de escritura en caché y $20.00 de salida por millón en GPT-6.1 Sol, frente a $4.00, $0.40, $5.00 y $20.00 en GPT-6 Sol — las dos filas difieren solo en la línea de caché, y solo por el mismo factor de 2× que ya lleva la propia tarifa estándar de caché de cada modelo.
• Procesamiento regional — un recargo del 10% sobre el nivel que corresponda, para los modelos publicados a partir del 5 de marzo de 2026, en cualquier residencia distinta de la predeterminada.

El modo rápido tiene una restricción de disponibilidad que el precio por sí solo no revela. La propia página del modelo de OpenAI para GPT-6.1 Sol indica que el modo rápido no está disponible con residencia de datos en la UE, y su guía sobre residencia de datos incluye a GPT-6.1 Sol entre los modelos que admiten residencia en la UE con procesamiento Standard, Flex y Batch. Por lo tanto, dentro de la UE la escalera de niveles es dos peldaños más corta, no uno: los niveles a mitad de precio están disponibles y el nivel al doble de precio no. Un lector que compare un despliegue europeo con uno estadounidense debería compararlo con Standard, porque ese es el nivel más rápido disponible para él: citar una cifra del modo rápido para una carga de trabajo en la UE describe una configuración que el proveedor no ofrece.

Nada en esta tarjeta es promocional, y nada tiene fecha de caducidad.

Las filas de GPT-6.1 Sol anteriores son la tarifa de lista. La página de precios de OpenAI no les adjunta ningún calificador promocional ni fecha de finalización, y ninguno de los cuatro medidores de la tarjeta de contexto corto o de la de contexto largo está marcado como una cifra por tiempo limitado. Vale la pena decirlo explícitamente, porque la familia tiene un contraejemplo en la misma página: el precio promocional de GPT-5.6 Sol lleva una nota al pie que lo compromete al menos hasta el 21 de noviembre de 2026, lo que significa que cualquier precio de GPT-5.6 Sol cotizado hoy es un precio con un punto de revisión conocido asociado. Nada en GPT-6.1 Sol tiene esa forma.

La consecuencia práctica es que esta página no necesita una advertencia de verificación de fecha sobre los propios números — la necesita en la página que estás leyendo, porque una tarifa de lista puede cambiar sin que se haya activado una fecha de vencimiento. También significa que la tarjeta de GPT-6.1 Sol es la fila correcta sobre la que construir un modelo de costos si estás eligiendo entre los dos niveles de Sol y quieres que la comparación se mantenga estable: el medidor de caché de $0.20 de GPT-6 Sol también es una tarifa de lista ordinaria sin promoción adjunta, por lo que la diferencia de diez centavos entre ellos es una diferencia estructural en las tarjetas y no un descuento temporal que un modelo esté aplicando contra el otro.

Cómo leer la afirmación de precio de Sol de GPT-6.1 de cualquier otra persona

Dos preguntas zanjan casi cualquier desacuerdo sobre cuánto cuesta un modelo de clase Sol, y ambas pueden responderse desde la ficha en lugar de desde la prosa que la rodea.

• ¿Qué tarifa se está citando? La entrada, la entrada en caché, la escritura en caché y la salida son cuatro números distintos en la misma solicitud, y un precio único de titular es casi siempre la tarifa de entrada, con las otras tres implícitas. Una afirmación que se lee como un costo total suele ser una tarifa de entrada multiplicada por una mezcla de tokens supuesta, y la discrepancia reside en esa mezcla supuesta.
• ¿Qué nivel de contexto se asumió? Las tarifas de contexto corto y contexto largo difieren en 2× en la entrada y la caché, y en 1.5× en la salida, y el nivel se selecciona según la solicitud completa y no según el exceso, así que una cifra citada sin un nivel es una cifra que cambia en el momento en que la solicitud supera los 272,000 tokens de entrada.
• ¿Qué nivel de procesamiento se asumió? Standard, Batch, Flex y Fast difieren en factores de 2× y 50%, y un precio citado sin decir cuál es un precio con un factor de cuatro de ambigüedad incorporado antes de que se plantee cualquier cuestión de tarifas.
• ¿Qué nivel de esfuerzo se asumió, si hay un recuento de tokens de por medio? Las tarifas son independientes del esfuerzo, pero los recuentos de tokens no lo son, así que cualquier cifra de costo por tarea hereda el esfuerzo de razonamiento con el que se midió, y una comparación entre dos modelos con distintos ajustes de esfuerzo no es una comparación de sus precios.

Responde a esas cuatro y una afirmación sobre el precio o sobrevive o no. Lo que no debería hacer es compararse con los cuatro medidores de esta página sin que se nombren primero el nivel y el medidor, porque las dos tarjetas son adyacentes precisamente para que la única línea en movimiento sea visible y nada más se confunda con ella.

A screenshot of the OrcaRouter model page for openai/gpt-6-sol showing the breadcrumb 'Home / Models / OpenAI', the title 'GPT-6 Sol', the slug openai/gpt-6-sol, 'Max output 128K', a context figure of 1M tokens, a chip row reading $2.00, $10.00, 1.44 s, 10.00 s and 950.6K, the buttons 'Get the GPT-6 Sol API', 'Try in playground' and 'Use via API', an OpenAI-compatible code sample against https://api.orcarouter.ai/v1, and a description stating that GPT-6 Sol is the cost-efficient high-end model in OpenAI's GPT-6 series, above the fast GPT-6 Luna tier and below the flagship GPT-6 Astra.

Dónde se sirve el peldaño GPT-6 Sol

OrcaRouter ofrece el nivel de GPT-6 a la tarifa de lista de OpenAI, sin añadir nada. La página del modelo en https://www.orcarouter.ai/models/openai/gpt-6-sol presenta GPT-6 Sol a $2.00 de entrada y $10.00 de salida por millón de tokens, coincidiendo línea por línea con la tarjeta de arriba, a 0 % de margen, y el catálogo contiene más de 200 modelos en los mismos términos. Nuestra tarjeta para esa ruta lleva las mismas cifras de $0.20 de entrada en caché y $2.50 de escritura de caché que publica OpenAI, así que los números coinciden medidor a medidor; tome cada cifra de caché de esta página como una repetición de la tarifa publicada por OpenAI y no como una cotización independiente nuestra. GPT-6.1 Sol también figura en nuestro catálogo: la tarjeta activa de openai/gpt-6.1-sol indica una fecha de lanzamiento del 29 de septiembre de 2026, con ambos niveles de precios reflejando los de OpenAI y un recuento de tokens de siete días en los cientos de millones, de modo que un lector que quiera el nivel más reciente debería consultar los números de esa propia página en lugar de considerar esta página como la última palabra al respecto. Los precios cambian; la página es la cotización.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario