
GPT-6 Sol Pro vs DeepSeek V4 Pro: Una tarifa plana contra un horario
- openaiNUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- openaiNUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- anthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- grokNUEVOGrok 4.72026-09-2146Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
GPT-6 Sol Pro y DeepSeek V4 Pro son las dos formas creíbles más baratas de ejecutar una carga de trabajo de razonamiento seria a través de una API en este momento, y tienen precios basados en principios completamente diferentes. GPT-6 Sol —el modelo del proveedor que ejecuta la configuración gpt-6-sol-pro, disponible de forma general desde el 22 de septiembre de 2026— cuesta $2.00 por millón de tokens de entrada y $10.00 por millón de tokens de salida, a todas horas de todos los días. DeepSeek V4 Pro, el buque insignia de pesos abiertos cuyo checkpoint 0813 alcanzó la disponibilidad general el 13 de agosto de 2026, cuesta $0.66 y $1.98 durante la mayor parte de la semana y exactamente el doble por dos ventanas estrechas en las mañanas de los días laborables. Cualquier comparación que cite una sola tarifa está citando la mitad del precio.
El calendario es la historia. Todo lo demás sobre esta comparación —las puntuaciones de índice, las ventanas de contexto, los términos de licencia— es consecuencia de que uno de estos dos proveedores haya decidido que su precio de lista es una función del reloj.
Qué es realmente cada línea de precio
La tabla de precios de GPT-6 Sol es de una sola fila. Entrada: $2.00; entrada en caché: $0.20; escritura de caché: $2.50; salida: $10.00 por millón de tokens, con un nuevo precio por contexto largo a partir de un umbral de entrada que, una vez superado, se aplica a toda la solicitud. No hay dimensión temporal ni ventana promocional. OpenAI redujo el modelo predecesor a estas cifras el 22 de septiembre y las describió como permanentes.
La tarjeta de tarifas de DeepSeek es una tabla. Tal como se lee en la propia página de precios del proveedor:
• Entrada fuera de horas pico — $0,66 por millón de tokens, fallo de caché; $0,022 por millón de tokens, acierto de caché
• Salida en horario de menor demanda — $1.98 por millón de tokens
• Entrada máxima — $1.32 por millón de tokens, fallo de caché; $0.044 por millón de tokens, acierto de caché
• Salida máxima — $3,96 por millón de tokens
• Ventanas de máxima actividad — 01:00–04:00 y 06:00–10:00 UTC, de lunes a viernes, excluidos los días festivos públicos de China
• Todo lo demás — fuera de horas pico, incluido todo el fin de semana, una norma que entró en vigor a medianoche, hora de Pekín, del 23 de agosto de 2026
Siete horas de pico de una semana de 168 horas, cinco días de cada siete, es aproximadamente el 21 % del calendario a la tarifa más alta y el 79 % a la más baja. Así que el resumen honesto en una sola cifra de DeepSeek V4 Pro no es $0.66 ni $1.32 — está en algún punto intermedio, y dónde depende de la forma de tu tráfico, no de la generosidad del proveedor.
La repreciación de la que salió esta tabla
Vale la pena saber qué tan reciente es esta estructura, porque casi todas las páginas de comparación siguen citando la cifra a la que reemplazó. El 22 de mayo de 2026, DeepSeek convirtió un descuento por tiempo limitado en V4 Pro en un precio permanente: una rebaja de aproximadamente el 75%, hasta unos $0,435 de entrada y $0,87 de salida por millón de tokens.
El 17 de agosto de 2026 a medianoche, hora de Pekín, eso se invirtió, y con creces. El sistema de horas punta/valle entró en vigor con un aumento medio en las filas afectadas de unas 3,5 veces y un máximo de 12 veces; el 12× recayó precisamente en la tarifa de entrada con acierto de caché, que pasó de ¥0,025 a ¥0,30 por millón de tokens en hora punta. La entrada con fallo de caché subió alrededor del 200 % y la salida, alrededor del 350 %. Seis días después se añadió la excepción de fin de semana, que recuperó parte de ello para cualquiera que pudiera trasladar sus trabajos por lotes.
Se derivan dos consecuencias. Primera: cualquier página que te diga que DeepSeek V4 Pro es un modelo por debajo del dólar está citando una lista de precios que ya ha sido sustituida dos veces. Segunda: la forma del aumento es una señal de aquello para lo que DeepSeek está optimizando: el mayor incremento proporcional corresponde a los aciertos de caché, que es la tarifa que más importa precisamente para la carga de trabajo —bucles largos de agentes que reenvían un prefijo estable— que hizo atractivo al modelo en primer lugar.

El número índice que todos están citando ha sido retirado.
Artificial Analysis es el marco neutral para esta comparación, y ha cambiado varias veces la versión de su Índice de Inteligencia a lo largo de 2026. En la tabla actual, GPT-6 Sol obtiene 48 con esfuerzo máximo a $1,06 por tarea del índice. DeepSeek V4 Pro, en el checkpoint 0813 con esfuerzo máximo, obtiene 36 a $0,67 por tarea del índice.
La cifra que circula para DeepSeek es 53. Ese número es real y se publicó —en una revisión anterior del índice, antes de una nueva versión que cambió las puntuaciones de la mayoría de los modelos. Comparar un 53 tomado de un artículo anterior a la v4.3 con un 48 actual es comparar una medición retirada con una vigente, y produce el error más común de este enfrentamiento: la afirmación de que los dos modelos están a un punto de diferencia. En el índice actual están separados por doce puntos, y la diferencia de precio por tarea completada no es el 3× que sugieren las tarifas anunciadas, sino más cercana a 1.6×, porque DeepSeek gasta más tokens para llegar a su respuesta.
Otros dos puntos de datos independientes van junto a esos, ambos etiquetados por lo que son. Vals AI, que ejecuta un arnés de pruebas aislado, sitúa a DeepSeek V4 Pro en 96,40 % en SWE-bench Verified a 0,103 $ por prueba —segundo en esa tabla tras el 97,00 % de Claude Opus 5, y barato por prueba por un amplio margen. La tabla de agentes de codificación de Artificial Analysis muestra un 14 % en Terminal-Bench 4.0 frente al 44 % de GPT-6 Sol. El primer número dice que DeepSeek es competitivo en una tarea de codificación acotada y bien definida. El segundo dice que no es competitivo en trabajo agéntico en la terminal. Ambos son ciertos y están midiendo cosas diferentes.
Cuando los dos modelos son estructuralmente diferentes, no solo difieren en precio.
• Licencia — GPT-6 Sol es una API cerrada sin pesos; DeepSeek V4 Pro tiene licencia MIT con checkpoints públicos en Hugging Face, incluidas variantes base para el preentrenamiento continuado
• Salida máxima — GPT-6 Sol 128.000 tokens frente a DeepSeek V4 Pro 384.000 tokens, el triple del límite máximo a una quinta parte de la tarifa de salida
• Ventana de contexto — GPT-6 Sol 1.050.000 tokens vs DeepSeek V4 Pro 1.048.576 tokens, prácticamente idénticas
• Modalidades — tanto texto de entrada como de salida; ninguna de las dos acepta imágenes en la API
• Precio de contexto largo — GPT-6 Sol recalcula el precio de toda la solicitud por encima de su umbral de entrada; el horario de pico/fuera de pico de DeepSeek V4 Pro es la única estructura de precios que tiene
• Escala — DeepSeek V4 Pro es un modelo de mezcla de expertos de 1,6 billones de parámetros con 49 mil millones de parámetros activos por token; OpenAI no publica una cifra comparable para GPT-6 Sol
Una aclaración sobre ese recuento de parámetros, porque es una fuente frecuente de confusión: la cifra de 1,7 billones que aparece en algunos listados es el tamaño del paquete de Hugging Face con el módulo opcional de decodificación especulativa DSpark incluido, no un modelo objetivo más grande. La arquitectura publicada es de 1,6 T en total. Restar las insignias redondeadas para inferir el tamaño del módulo de borrador no es un cálculo válido, y tampoco lo es interpretar el número mayor como evidencia de que el modelo creció.

La retirada que es el verdadero argumento a favor de los pesos abiertos
El 9 de septiembre de 2026, DeepSeek anunció que estaba retirando progresivamente V4 Pro, y que a partir de las 04:00 UTC del 14 de septiembre, toda solicitud a la cadena de modelo deepseek-v4-pro se enrutaría a DeepSeek V4.1 Flash y se facturaría a las tarifas de Flash, y así continuaría hasta que se lanzara un modelo V4.1 Pro. La cadena de modelo seguiría respondiendo. El modelo que estaría detrás no sería el que se había evaluado en los benchmarks.
Los desarrolladores se opusieron, y la redirección se retiró. El registro de cambios de DeepSeek ahora indica que el servicio de API de V4 Pro continúa más allá del 14 de septiembre con la facturación sin cambios, y la tabla de precios todavía incluye deepseek-v4-pro como una fila activa con sus propias tarifas y sin etiqueta de retiro. La página de anuncio anterior todavía contiene el lenguaje de enrutamiento, por lo que los dos documentos se contradicen — y la página de precios activa es la que describe lo que realmente sucede cuando lo llamas.
Ese episodio es el argumento más fuerte de todo este enfrentamiento, y no es un argumento de precio. Un modelo cerrado puede recibir un nuevo precio, ser redirigido o retirado según el calendario de un proveedor, y el único recurso es migrar. Un modelo con pesos MIT en un repositorio público puede servirse desde tu propia infraestructura, lo que significa que el checkpoint que evaluaste es el checkpoint que sigues sirviendo sin importar lo que diga la hoja de ruta del proveedor seis semanas después. DeepSeek demostró el riesgo y proporcionó la mitigación en la misma quincena.
El contrapeso honesto es que autoalojar un modelo de 1,6 billones de parámetros no es una decisión que la mayoría de los equipos tome a la ligera. Es una opción real con un costo fijo real, no una cobertura gratuita.
Donde una capa de enrutamiento cambia la aritmética
DeepSeek V4 Pro está en el catálogo de OrcaRouter. Tanto el checkpoint actual como la cadena del modelo base se resuelven — deepseek/deepseek-v4-pro-0813 y deepseek/deepseek-v4-pro — con las tarifas de lista de horas valle y el multiplicador de horas punta aplicado según el mismo horario UTC, una ventana de contexto de 1.048.576 tokens, un límite de salida de 384.000 tokens y un tiempo hasta el primer token p50 de 3,56 segundos, medido en nuestra propia página del modelo. El precio de lista del proveedor se traslada con sin ningún recargo adicional, lo que en este caso significa que el límite entre horas punta y horas valle llega a tu factura en el mismo momento en que llega a la de DeepSeek.
GPT-6 Sol no es una de nuestras rutas, así que nada de lo que aparece aquí constituye una afirmación sobre su precio a través de nosotros.

El horario es lo que hace que valga la pena tener un solo endpoint aquí en concreto. Una carga de trabajo que se puede desplazar vale el doble que una que no puede, y desplazarla es una decisión de enrutamiento, no una migración — la misma clave, la misma forma de solicitud, una hora distinta o un modelo distinto detrás. Emparejar DeepSeek V4 Pro con DeepSeek V4.1 Flash en un solo endpoint es la versión más nítida de eso: el modelo Flash es 4,4× más barato en entrada y 3,3× más barato en salida que la tarifa fuera de horas punta de V4 Pro, en la misma ventana de contexto y las mismas ventanas de máxima demanda, lo que lo convierte en el destino natural para el tráfico que no necesita en absoluto el modelo más grande. La conmutación automática por error importa por la misma razón de siempre — el nivel barato sobre el que está construido tu pipeline no debería ser un punto único de fallo.
La regla de decisión
• Trabajo por lotes y sin conexión que se puede programar — DeepSeek V4 Pro, y prográmalo. El noventa y cinco por ciento del calendario a $0.66 y $1.98, con los fines de semana completamente en horario valle, es la tarifa creíble más barata de este panel por un factor de tres en la entrada y cinco en la salida.
• El tráfico interactivo sensible a la latencia que cae en las ventanas pico — GPT-6 Sol. Una tarifa fija de $2.00 y $10.00 es más cara que la tarifa de DeepSeek fuera de horas punta y más barata que nada, pero se puede conocer de antemano, y durante dos horas al día es la más barata de las dos en cuanto a salida.
• Bucles de agente con un prefijo grande y estable: haz los cálculos de aciertos de caché antes de elegir. La entrada con acierto de caché de DeepSeek cuesta $0.022 fuera de horas punta, lo que es un noveno de los $0.20 de GPT-6 Sol, pero también es la fila que DeepSeek multiplicó por doce en horas punta. La ventaja es real y depende del reloj.
• Cualquier cosa regulada, o cualquier cosa que no pueda permitirse que se redirija — DeepSeek V4 Pro, autoalojado a partir del checkpoint del MIT. La retirada de septiembre es el caso de estudio, y es una razón mejor para aceptar el coste fijo que cualquier comparación por token.
• Cualquier cosa que necesite lo más alto del rango agéntico — GPT-6 Sol. Doce puntos de índice y treinta puntos de Terminal-Bench no son una diferencia de redondeo, y las propias cifras reportadas por el proveedor de DeepSeek no las cierran.
La tarifa plana y el horario son dos modelos de precios honestos. Solo responden a preguntas distintas: uno te dice cuánto cuesta un token, el otro te dice cuánto cuesta un token cuando lo necesitas.
Comparados en este artículo3
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
