Ilustración editorial de estilo vectorial plano para el hero de un blog de tecnología sobre precios de modelos: un gran chip de modelo redondeado en azul profundo con un suave resplandor cian, una etiqueta de precio de papel sujeta con un clip a su esquina, tres flujos de tokens que fluyen hacia un medidor de precios circular, y una fina hoja de calendario deslizándose en el encuadre, sobre un fondo azul claro suave con amplio espacio vacío en el tercio inferior. Sin texto.
Guides & Insights

Precios de la API de DeepSeek V4 Pro: $0.73/$2.18 en horario de menor demanda, y por qué se canceló el cierre del 14 de septiembre

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

DeepSeek V4 Pro no se retira. El 11 de septiembre de 2026, Deep​Seek dijo que seguirá sirviendo el modelo a través de su API después del 14 de septiembre, con el método de facturación sin cambios, revirtiendo así un plan anunciado dos días antes según el cual toda solicitud de deepseek-v4-pro se habría redirigido a DeepSeek V4.1 Flash y se habría facturado a las tarifas de Flash. Para cualquiera cuyos prompts, configuraciones de temperatura y esquemas de llamadas a herramientas estén ajustados para V4 Pro, ese es el hecho que importa esta semana: el modelo para el que hiciste tu desarrollo se queda donde está, y la migración que quizá tenías programada para el lunes no tiene por qué ocurrir.

El precio es otra historia, y esta página lo tuvo mal durante un mes. DeepSeek V4 Pro ya no cuesta $0.44/$0.88 por millón de tokens. Fuera de horas punta factura a $0.726 de entrada y $2.178 de salida por 1M de tokens en OrcaRouter, el doble, $1.452/$4.356, dentro de las ventanas de hora punta, con lecturas de caché a $0.024. Los fines de semana ahora son completamente fuera de horas punta. Y la propia tabla de tarifas del proveedor —la que está en la documentación de la API de DeepSeek— incluye el aviso de continuación como nota al pie de la misma tabla de precios, lo cual es lo más cerca que puede estar una página de precios de una fuente primaria.

Lo que DeepSeek dijo realmente, y lo que deshace

La cronología importa, porque dos de los tres anuncios se contradecían entre sí y el del medio es el que la gente recuerda.

• 9 de septiembre — DeepSeek informó a los usuarios de que, hasta que se lance V4.1 Pro, las solicitudes a V4 Pro se dirigirán a DeepSeek V4.1 Flash y se facturarán según las tarifas de V4.1 Flash.

• 10 de septiembre — V4.1 Flash se lanzó, y Deep​Seek fijó el cambio para un momento concreto: las 12:00, hora de Pekín, del 14 de septiembre de 2026, tras lo cual V4 Pro quedaría fuera de línea y su tráfico sería atendido por Flash.

• 11 de septiembre — Deep​Seek dio marcha atrás. Su redacción, ahora reproducida textualmente como nota al pie en la página Modelos y precios de su propia documentación de la API: "En respuesta a la demanda de los usuarios, hemos decidido seguir ofreciendo servicios de API para Deep​Seek V4 Pro después del 14 de septiembre de 2026, con el método de facturación sin cambios. Proporcionaremos más avisos si hubiera algún cambio."

Eso es el proveedor hablando de su propio producto, y es la fuente más sólida disponible aquí, pero lea lo que resuelve y lo que no resuelve. Resuelve la continuidad y la facturación: V4 Pro se mantiene, a las tarifas ya vigentes. No promete un plazo. Proporcionaremos aviso adicional es todo el compromiso, y la misma frase deja la puerta abierta para que el plan regrese. Si va a asumir un compromiso de varios trimestres, planifique para el modelo del que pueda salir en lugar del que pueda conservar.

Vale la pena entender la reacción negativa que obligó a dar marcha atrás, porque se corresponde con una decisión que puede que estés a punto de tomar por tu cuenta. Los desarrolladores no se oponían a V4.1 Flash —del que DeepSeek dice que supera a V4 Pro en rendimiento, precio, velocidad y tiempo total de tarea—, sino a la sustitución automática. Cambiar el modelo que hay detrás de un ID de modelo estable altera el comportamiento sin cambiar el código: un prompt ajustado, una temperatura que funciona, un esquema de llamada a herramientas que se parsea correctamente son propiedades de un checkpoint específico. La cobertura en CLS (科创板日报), 36Kr, IT之家 e ifeng, y en inglés en TheBlockBeats, describe que DeepSeek primero retrasó y luego abandonó el plan; los propios documentos de DeepSeek muestran el contraste con claridad, porque los nombres heredados de deepseek-v4-flash fueron retirados y ahora sirven a V4.1 Flash, y ese cambio se mantuvo. El cambio a Pro no.

El precio de hoy, cotejado con la tabla de tarifas del propio proveedor.

Price card titled 'DeepSeek V4 Pro — price per 1M tokens', sourced 'OrcaRouter directory, checked 2026-08-15'. Three highlight cells read Input $0.442, Output $0.884 and Cache read $0.060 USD at zero markup. A row reads DeepSeek official rate (CNY, today): ¥3 in, ¥6 out, cache hit ¥0.025. Two columns show the August 17 change: off-peak input ¥4.5, output ¥13.5, cache hit ¥0.15; peak input ¥9, output ¥27, cache hit ¥0.30. Footer: peak output is 4.5x today's ¥6, off-peak is half of peak, peak windows Beijing weekdays 09:00-12:00 and 14:00-18:00.

Dos cifras importan, y son el mismo precio de lista en dos monedas.

• Fuera de horas pico (cada hora fuera de las ventanas de horas pico que se indican a continuación) — entrada: $0,726 por 1 M en caso de fallo de caché, o ¥4,5; salida: $2,178, o ¥13,5; entrada con acierto de caché: $0,024, o ¥0,15.

• Pico — exactamente el doble. Entrada $1.452 / ¥9, salida $4.356 / ¥27, entrada con acierto de caché $0.048 / ¥0.30.

• La propia conversión a dólares de Deep​Seek — la documentación del proveedor muestra la misma lista en yuanes como $0.66 de entrada / $1.98 de salida fuera de horas punta y $1.32 / $3.96 en horas punta, con aciertos de caché a $0.022 y $0.044. La diferencia con las cifras en dólares de OrcaRouter es el tipo de cambio al que convierte cada lado, no una tarifa adicional por token: OrcaRouter pasa la tarifa del proveedor tal cual, sin margen, así que el número en el listado es el número que pagas.

• No hay plan gratuito para V4 Pro. Existe un nivel Flash gratuito en el directorio, pero el buque insignia es solo de pago.

• La hoja de especificaciones, para contexto — V4 Pro es un modelo de pesos abiertos bajo una licencia MIT, 1.6T de parámetros totales con 49B activos por token, una ventana de contexto de 1M de tokens y hasta 384K tokens de salida, con un límite de concurrencia de 500. Artificial Analysis indica 72.3 tokens de salida por segundo.

La versión del modelo que hay detrás de todo esto es DeepSeek-V4-Pro-0813, sin cambios desde el lanzamiento de disponibilidad general del 13 de agosto, que es precisamente la cuestión. Nada del checkpoint cambió el 11 de septiembre; solo lo hizo la decisión sobre su futuro.

Punta, valle y la regla de fin de semana que cambia las cuentas

El plan de horas punta y horas valle que la versión anterior de esta página describía como de llegada el 17 de agosto ya tiene un mes, y se ha modificado una vez desde entonces.

• Ventanas de hora punta: 01:00–04:00 y 06:00–10:00 UTC, de lunes a viernes. En hora de Pekín, eso es 09:00–12:00 y 14:00–18:00, el propio día laborable de DeepSeek. Las tarifas de hora valle son exactamente la mitad que las de hora punta, no una banda de descuento que se sume a estas.

• Los fines de semana son completamente de tarifa no pico. A partir de las 00:00 (hora de Pekín) del 23 de agosto de 2026, Deep​Seek dejó de aplicar las tarifas pico los sábados y domingos. Si tu trabajo por lotes se puede mover, trasladarlo al fin de semana reduce la factura a la mitad, y para los equipos que atienden a usuarios en las Américas, la mayor parte de la semana laboral ya cae fuera de las horas pico sin necesidad de programación alguna.

• Lo que costó el cambio, frente a los ¥3/¥6 con los que se lanzó el modelo el 13 de agosto: la salida actual fuera de horas punta es 2,25× la tarifa de lanzamiento y la salida en horas punta es 4,5×; la entrada con acierto de caché en horas punta es 12× los antiguos ¥0,025.

Hay una asimetría aquí que explica por qué la cuestión de la migración sigue surgiendo incluso después de que se cancelara la suspensión. El precio de V4 Pro subió en agosto, mientras que el de su sucesor bajó: Deep​Seek redujo los precios de la API de la serie Flash hasta en un 60 % a partir del 10 de septiembre. La presión para migrar nunca tuvo que ver realmente con el aviso del 14 de septiembre; el aviso solo la hizo urgente.

Lo que realmente cuesta una solicitud

Tres ejemplos prácticos con las tarifas valle de hoy. Cada uno de ellos se duplica dentro de una ventana de hora punta.

• 100K de entrada + 50K de salida — $0.0726 + $0.1089 ≈ $0.18.

• 1M de entrada + 1M de salida — $0.726 + $2.178 = $2.90. Esa misma llamada cuesta $5.81 en hora pico, y costaba $1.32 a mediados de agosto.

• Sesión agéntica, 500K de entrada + 200K de salida — $0.363 + $0.4356 ≈ $0.80.

La vista mensual está en la página del modelo y es la prueba honesta de si el titular anterior todavía describe tu factura: con 10 M de tokens al mes y una proporción de entrada del 70 %, la calculadora de costes arroja $11,62, o unos $9,16 con la caché de prompts activada. Si tu presupuesto se elaboró tomando como referencia $0,44, ahora cubre alrededor del 60 % de la factura.

La caché es la palanca que nadie pone sobre la mesa.

El almacenamiento en caché de prompts se volvió más valioso, no menos, cuando las tarifas subieron — y la dirección de los dos números es la razón. En OrcaRouter, una lectura de caché ahora se factura a $0.024 por 1M de tokens frente a $0.726 sin caché, un descuento del 96.7% en cualquier entrada que reenvíes. En la versión anterior de esta página, la tarifa de caché era de $0.060 frente a un precio de entrada de $0.442, un descuento del 86%. El precio de lectura de caché cayó a menos de la mitad, mientras que el precio de entrada sin caché subió un 64%, por lo que la brecha efectiva entre un token en caché y uno sin caché se amplió considerablemente.

Para un agente que reenvía un mensaje de sistema grande y un contexto largo en cada turno, la entrada en caché es la diferencia entre una factura que escala con la longitud de la conversación y una que no. La regla práctica no ha cambiado y vale la pena repetirla: pon primero el mensaje de sistema estable y el material de referencia, y al final el contenido volátil, para que el prefijo que reenvías realmente acierte en la caché. En este modelo, esa única decisión estructural vale más que cualquier decisión de enrutamiento o programación por debajo de ella.

Cómo se compara el precio de V4 Pro con la competencia

Comparison table card titled 'USD per 1M tokens — the field', sourced to the OrcaRouter directory checked 2026-08-15, with an input/output column pair per model: DeepSeek V4 Flash $0.15/$0.29; DeepSeek V4 Pro $0.44/$0.88 highlighted with a 'THIS PAGE' tag; MiniMax M3 $0.30/$1.20; Gemini 3.6 Flash $1.50/$7.50; Grok 4.5 $2.00/$6.00; Qwen 3.8 Max $2.00/$6.00; GPT-5.6 Terra $2.00/$12.00; Kimi K3 $3.00/$15.00; Claude Opus 5 $5.00/$25.00; GPT-5.6 Sol $5.00/$30.00; Claude Fable 5 $10.00/$50.00. Footer: V4 Pro is the cheapest 1M-context flagship, roughly 23x cheaper on input and 57x cheaper on output than Claude Fable 5.

Los precios de lista del directorio para entrada/salida por 1 millón de tokens, verificados el 2026-09-12, frente a los $0.726/$2.178 fuera de horas pico de V4 Pro. Dos de estos han cambiado desde que se publicó esta página por primera vez, y uno de ellos cambia la conclusión.

• Claude Fable 5 — $10 / $50. V4 Pro es 13,8× más barato en la entrada y 23× en la salida.

• Claude Opus 5 — $5 / $25. 6,9× / 11,5×.

• GPT-5.6 Sol — $4 / $20 hasta 272K de contexto, $8 / $30 más allá. 5.5× / 9.2× en el tramo más corto, 11× / 13.8× en el más largo.

• Kimi K3 — $3 / $15. 4,1× / 6,9×.

• Qwen3.8 Max — $2 / $6. 2,8× / 2,8×.

• Grok 4.5 — $2 / $6. 2.8× / 2.8×.

• Gemini 3.6 Flash — $0,75 / $3,75. Prácticamente en paridad en la entrada, con 1,03×, y 1,7× en la salida. Su precio se ha reducido a la mitad desde que se escribió esta página.

• MiniMax M3 — $0.30 / $1.20. Más barato que V4 Pro enambas líneas ahora: V4 Pro cuesta 2.4× más en entrada y 1.8× más en salida, con la misma ventana de 1M tokens.

• DeepSeek V4 Flash — $0.242 / $0.726 en el directorio. Aproximadamente 3× más barato en ambas líneas, mismo contexto de 1M.

El planteamiento honesto ha cambiado, y esta página debería decirlo en lugar de conservar el viejo superlativo. DeepSeek V4 Pro ya no es el modelo más barato con contexto de 1M en la tabla: tanto Gemini 3.6 Flash como MiniMax M3 le ganan en precio, y MiniMax M3 lo hace igualando la ventana de contexto. Lo que V4 Pro sigue siendo, por más de un orden de magnitud, es lo más barato del nivel frontera: todos los modelos occidentales de clase insignia de esa lista cuestan varias veces más que él en ambos apartados. Si la pregunta es «la llamada más barata posible con contexto de 1M», la respuesta ya no es este modelo. Si la pregunta es «el modelo más barato que se comporta como un modelo frontera», por ahora sigue siéndolo.

Cuando V4 Pro es la elección equivocada

• Si tu tráfico alcanza su punto máximo durante el horario diurno de Pekín. Las horas punta duplican la tarifa, y las ventanas de punta coinciden exactamente con la jornada laboral de China. Si tus usuarios están en América, la mayor parte de tu tráfico ya cae fuera de las horas punta, lo que constituye una verdadera ventaja estructural. Si estás desarrollando para usuarios en China, modela explícitamente la factura de las horas punta antes de comprometerte, y comprueba si la regla de fin de semana te ayuda a trasladar algo.

• Si tus prompts son cortos. Por debajo de aproximadamente 10K tokens de contexto, el nivel insignia es capacidad desperdiciada. DeepSeek V4 Flash a $0.242/$0.726 en el directorio maneja el mismo contexto de 1M por aproximadamente un tercio del precio, y para tareas genuinamente cortas, un modelo más barato sigue ganando.

• Si necesitas visión. V4 Pro es solo texto —sin entrada de imagen o audio— y Artificial Analysis enumera su modalidad de entrada como texto. Gemini 3.6 Flash o Claude Fable 5 son la mejor opción si lo que importa es la modalidad. La propia API de Deep​Seek también vale la pena señalar aquí: ahora sirve los nombres de sus modelos flash heredados con V4.1 Flash, que sí acepta imágenes.

• Si lo que buscas es una puntuación bruta que encabece los benchmarks, en lugar del precio por contexto. En la escala actual de Artificial Analysis, V4 Pro obtiene 36 en el Intelligence Index —8.º de 113 modelos en el momento de redactar esto— y 69 en el Coding index tal como figura en el directorio de OrcaRouter. Eso es competitivo, no líder: Claude Fable 5, Claude Opus 5 y GPT-5.6 Sol lo superan en programación. La propuesta de V4 Pro es una capacidad adyacente a la frontera a una fracción del precio por token, no lo más alto de todas las tablas.

¿Cómo llamarlo en OrcaRouter?

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (model ID deepseek/deepseek-v4-pro): FLAGSHIP FEATURED badge, '1M tokens' context and 384K max output, input and output price per 1M tokens (output shown at $0.88), /v1/chat/completions and /v1/responses endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

DeepSeek V4 Pro está alojado en OrcaRouter bajo el ID de modelo deepseek/deepseek-v4-pro, servido a través del endpoint compatible con OpenAI en api.orcarouter.ai/v1 a la tarifa del proveedor sin ningún recargo. Migrar desde un cliente OpenAI existente es un cambio de URL base y de ID de modelo, y nada más.

La reversión cambia lo que deberías hacer al respecto. Si tenías una migración para el 14 de septiembre en el calendario — redirigir de V4 Pro a DeepSeek V4.1 Flash porque Pro iba a desaparecer — puedes quitarla del calendario, o al menos rebajarla de fecha límite a prueba. Ambos modelos están detrás de una sola clave de OrcaRouter, así que compararlos es un cambio de ID de modelo en una solicitud en lugar de un segundo contrato y un segundo SDK; y si de verdad quieres evaluar V4.1 Flash con tráfico real sin apostar una ruta de producción a él, la conmutación por error automática es la forma de bajo riesgo de darle solicitudes en vivo mientras V4 Pro se mantiene como respaldo. Esa es la forma práctica de la decisión del 11 de septiembre: la elección sigue siendo tuya, y sigue siendo reversible.

La nota de honestidad que importa en una página de precios: enrutamos al modelo, no fijamos su precio. Las cifras de $0.726/$2.178 fuera de horas punta son las tarifas de DeepSeek trasladadas, y cambian cuando DeepSeek las cambia —que es exactamente por lo que esta página lleva fecha, y por lo que la versión que estás leyendo se reescribió en lugar de ampliarse.

Fuentes y fecha

Los precios y las especificaciones de esta página se volvieron a verificar el 12/09/2026. Las cifras en dólares de DeepSeek V4 Pro y de todos los modelos de la comparativa se toman de el directorio de modelos de OrcaRouter, comprobado ese mismo día; el número de parámetros, la licencia, la ventana de contexto, la modalidad y las cifras de velocidad proceden de la página de modelo de Artificial Analysis para DeepSeek V4 Pro 0813. Las tarifas en yuanes, las ventanas de máxima demanda y el aviso de continuación del 11 de septiembre proceden de la propia documentación de Modelos y Precios de Deep​Seek, que recoge la declaración textualmente como nota al pie de la tabla de precios. La secuencia de anuncios en tres pasos —el aviso de enrutamiento del 9 de septiembre, el aplazamiento del 10 de septiembre hasta las 12:00, hora de Pekín, del 14 de septiembre, y la reversión del 11 de septiembre— la reportan CLS (科创板日报), 36Kr, IT之家 e ifeng, y en inglés TheBlockBeats. La norma de facturación de fin de semana del 23 de agosto y la rebaja de precio del Flash del 10 de septiembre proceden de los anuncios de Deep​Seek tal como los cubrieron IT之家, The Paper y 21st Century Business Herald.

Una nota final sobre la fiabilidad, porque este precio en concreto ha cambiado tres veces en un mes — tarifas de lanzamiento el 13 de agosto, pico/fuera de pico el 17 de agosto, la enmienda de fin de semana el 23 de agosto. Considere cualquier página de "precios de V4 Pro" sin fecha como inutilizable. La versión anterior de esta citaba $0.44/$0.88 y un índice de Artificial Analysis Intelligence de 44.3; ambos eran correctos cuando se escribieron, y ninguno sobrevivió al mes.

Comparados en este artículo4

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario