Una tarjeta hero generada titulada «DeepSeek V4 Pro vs Kimi K3» con un icono de velocímetro a la izquierda etiquetado «DeepSeek V4 Pro» e insignia «~81 tok/s · /bin/bash.66/.98», y un icono de cerebro a la derecha etiquetado «Kimi K3» e insignia «Index 44 · .00/5.00», con un sutil separador de pista de carreras entre ambos y el pie de página «Velocidad y precio frente a un techo de razonamiento».
Guides & Insights

DeepSeek V4 Pro vs Kimi K3: Velocidad y precio frente a un techo de razonamiento de 44 puntos

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

DeepSeek V4 Pro y Kimi K3 son los dos buques insignia de razonamiento de pesos abiertos con una ventana de un millón de tokens, y su competencia se asentó en una forma estable hace un mes: Kimi K3 (el modelo de 2,8 billones de parámetros de Moonshot AI, lanzado el 16 de julio de 2026) es el líder en inteligencia, y DeepSeek V4 Pro (lanzado el 13 de agosto de 2026) es el líder en velocidad y precio. Lo nuevo es que la mitad barata de ese emparejamiento estuvo a punto de ser eliminada en la primera mitad de septiembre: DeepSeek puso a V4 Pro en una senda de retirada para el 14 de septiembre el día 8, la retrasó y luego, el día 11, canceló la retirada por completo, comprometiéndose a seguir sirviendo el modelo con la misma facturación. Eso importa más para este enfrentamiento que para la mayoría, porque "barato, rápido, contexto de 1M, pesos abiertos" es una combinación difícil de reemplazar cuando la alternativa cuesta cinco veces más.

Las cifras independientes son mediciones de Artificial Analysis. Los propios benchmarks de lanzamiento de DeepSeek y Moonshot están etiquetados como reportados por el proveedor, porque ninguno de los dos ha sido reproducido de forma independiente.

Kimi K3 gana en el índice; V4 Pro gana en la factura

El marcador independiente no deja lugar a dudas sobre quién es más inteligente. Kimi K3, con el máximo esfuerzo, obtiene 44 en el Artificial Analysis Intelligence Index, clasificado en el n.º 2 entre modelos comparables. DeepSeek V4 Pro obtiene 36, clasificado en el n.º 7 de su clase. Esa diferencia de nueve puntos es la única razón por la que alguien paga los precios de Kimi K3. Y los precios son la razón por la que el enfrentamiento no se decide solo por el índice: Kimi K3 tiene un precio de lista de 3,00 $ por millón de tokens de entrada y 15,00 $ por millón de tokens de salida, mientras que V4 Pro tiene un precio de lista de 0,66 $/1,98 $ fuera de horas pico (1,32 $/3,96 $ en horas pico). En salida, eso es aproximadamente 7,5 veces, antes del descuento de caché. Las lecturas de caché de V4 Pro cuestan alrededor de 0,02 $ por millón de tokens fuera de horas pico, un descuento del 97 %; el descuento de caché del 90 % de Kimi K3 parte de una base mucho más alta. Para una carga de trabajo intensiva en tokens, la brecha efectiva se amplía hasta cerca de diez veces.

• Índice de Inteligencia — Kimi K3 44 (#2/113) vs V4 Pro 36 (#7/113)

• Precio — Kimi K3 $3.00/$15.00 por 1M frente a V4 Pro $0.66/$1.98 fuera de hora punta ($1.32/$3.96 en hora punta)

• Velocidad — V4 Pro ~81 tokens/seg vs Kimi K3 ~35 tokens/seg

• Contexto — ambos 1M tokens

• Parámetros — Kimi K3 2,8T totales / 104B activos frente a V4 Pro 1,6T totales / 49B activos

• Pesos — ambos abiertos (Kimi K3 con pesos abiertos, V4 Pro MIT)

• Entrada — Kimi K3 texto e imagen vs V4 Pro solo texto

La velocidad es la parte que todos subestiman.

La brecha de la que nadie habla es el rendimiento. V4 Pro genera unos 81 tokens por segundo medidos de forma independiente; Kimi K3 consigue unos 35. En un bucle de agente en el que el modelo escribe varios miles de tokens por paso, esa es la diferencia entre una tarea que termina en minutos y otra que se arrastra durante toda una tarde —y la diferencia de coste lo agrava, porque pagas 15 $ por millón de tokens de salida a aproximadamente la mitad de velocidad. Para asistentes de programación interactivos, procesamiento masivo de documentos y cualquier carga de trabajo en la que el tiempo real sea una partida del presupuesto, la combinación de V4 Pro de una velocidad 2,3 veces mayor a un séptimo del precio de salida es la respuesta dominante.

Cuando los nueve puntos valen la pena

El argumento honesto a favor de Kimi K3 es el techo de razonamiento. Su coste de evaluación en el Intelligence Index fue de unos $3,658 por la ejecución —un reflejo de cadenas de razonamiento genuinamente largas y costosas, no una peculiaridad de los precios—. Si tu carga de trabajo es el razonamiento difícil —demostraciones matemáticas profundas, planificación de horizonte largo, tareas agénticas de varias horas en las que nueve puntos de índice adicionales se traducen en menos fallos—, Kimi K3 se gana su sobreprecio. El argumento honesto en contra es todo lo demás: la capacidad de procesamiento, la economía de la caché, el mero precio por token.

La otra razón por la que el giro de septiembre importa aquí: hace un mes, el consejo sensato era «si vas a adoptar como estándar el modelo abierto, barato y rápido, cúbrete: puede que lo retiren». Desde el 15 de septiembre, esa cobertura es obsoleta. Deep​Seek se ha comprometido públicamente, con la promesa de avisar si algo cambia, a mantener V4 Pro en la API, y la licencia MIT implica que el modelo sigue siendo desplegable en tu propio hardware, independientemente de lo que Deep​Seek haga con su API. Los pesos abiertos de Kimi K3 dan la misma libertad del otro lado, que es lo que convierte esto en una auténtica comparación entre dos pesos abiertos, en lugar de una pelea entre un servicio y un producto.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at .32 input and .96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Ambos modelos están en OrcaRouter — DeepSeek V4 Pro y Kimi K3 se enrutan a través de la plataforma con una sola clave, con los precios de lista de los proveedores transferidos sin margen de beneficio — y el DSL de enrutamiento es la forma natural de dividir este enfrentamiento: enruta las tareas de razonamiento de horizonte largo a Kimi K3, donde los nueve puntos rinden, y enruta el trabajo de rendimiento intensivo en tokens a DeepSeek V4 Pro, donde la brecha de precio de 7,5x y la brecha de velocidad de 2,3x hacen el trabajo por ti. Los dos son complementos con la misma frecuencia con la que son competidores, y la plataforma hace que ejecutar ambos suponga la misma cantidad de trabajo que ejecutar uno.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of /bin/bash.66 and output price of .98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs Kimi K3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price /bin/bash.66/.98 off-peak, Speed ~81 tok/s, Context 1M, Active params 49B/1.6T, Weights MIT; right column Kimi K3 rows AA Index 44 (#2/113), Price .00/5.00, Speed ~35 tok/s, Context 1M, Active params 104B/2.8T, Weights open; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

El resultado final

Kimi K3 es el modelo de pesos abiertos más inteligente, nueve puntos de índice por delante, y su sobreprecio —7,5 veces en tokens de salida, aproximadamente la mitad de velocidad— es un costo real, no un error de redondeo. DeepSeek V4 Pro es el caballo de batalla rápido, barato y duradero, y después del 11 de septiembre ya no es un riesgo de fuga. La respuesta práctica es la que señalan ambas columnas de precios: si tus tareas son de razonamiento complejo, compra Kimi K3; si son intensivas en tokens y sensibles al tiempo, compra DeepSeek V4 Pro; y si tienes ambos tipos, ejecuta ambos y enruta según la tarea.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario