Kimi K3 vs DeepSeek V4: Los dos titanes de pesos abiertos, comparados
Guides & Insights

Kimi K3 vs DeepSeek V4: Los dos titanes de pesos abiertos, comparados

Autor

Fengya Tian

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Este es el enfrentamiento de pesos abiertos más destacado de 2026. Kimi K3 y DeepSeek V4 son ambos grandes modelos de mezcla de expertos con pesos abiertos, aproximadamente contexto de 1 millón de tokens, y precios agresivos, y ambos provienen de laboratorios chinos. Si has decidido que quieres un modelo de clase frontier, abierto y auto-alojable, estos son tus dos finalistas.

Las diferencias son reales pero específicas: DeepSeek V4 es solo texto y tiene un precio al mínimo absoluto (con un recargo en horas pico que la mayoría pasa por alto); Kimi añade visión nativa y, en índices independientes, supera ligeramente a DeepSeek en inteligencia general. La licencia también difiere: DeepSeek es completamente MIT, Kimi es MIT Modificado. Aquí le mostramos cómo elegir.

Una nota de honestidad primero: a partir del 15 de julio de 2026, Moonshot no ha publicado especificaciones ni puntos de referencia oficiales de K3. El avance promocional filtrado es real, los números no están confirmados. Así que cuando comparamos capacidades utilizamos la línea de envío de Kimi, K2.6 y K2.7 Code, como el piso sobre el que se espera que K3 construya, y lo decimos cada vez. Trate cada cifra de K3 como un rumor hasta que la tarjeta del modelo esté activa.

Veredicto rápido

- Apertura: ambos son de pesos abiertos y autohospedables. DeepSeek V4 es completamente MIT; Kimi es MIT Modificado (agrega requisitos de marca a muy gran escala). DeepSeek es la licencia más permisiva.

- Precio: DeepSeek V4-Pro es el más barato con ~$0,435 de entrada / $0,87 de salida por 1M en horas valle, pero las horas punta aplican un recargo de aproximadamente 2x. La línea de Kimi está entre ~$0,60-$0,95 / $2,80-$4,00. DeepSeek gana en precio bruto; cuidado con su precio en horas punta.

- Inteligencia (independiente): Kimi K2.6 lidera en pesos abiertos en el Artificial Analysis Intelligence Index (54) justo por delante de DeepSeek V4-Pro (52).

- Modalidad: Kimi tiene visión nativa; DeepSeek V4 es solo texto. Si necesitas entrada de imagen en un modelo abierto, Kimi gana.

- Codificación: muy cerca, DeepSeek V4-Pro reporta SWE-Bench Verified 80.6 y LiveCodeBench 93.5; Kimi K2.6 reporta SWE-Bench Verified 80.2 y el líder en código abierto SWE-Bench Pro 58.6 (frente a los 55.4 de DeepSeek).

- Veredicto: elige DeepSeek V4 por el costo más bajo absoluto solo para texto y la licencia más permisiva; elige Kimi K3 por visión nativa, una ligera ventaja en inteligencia independiente y (según rumores) contexto más largo. Muchos equipos deberían conservar ambos y enrutar.

De un vistazo

Kimi K3 (esperado, basado en K2.6/K2.7): MoE de peso abierto, MIT modificado; rumoreados 2.5T-4T parámetros; rumoreado contexto de 1M; visión nativa; precio no anunciado (línea ~$0.60-$0.95 / $2.80-$4.00).

DeepSeek V4-Pro: MoE de pesos abiertos, MIT; 1.6T total / 49B activos; contexto de 1M / hasta 384K de salida; solo texto; ~$0.435 entrada / $0.87 salida fuera de horas pico (acierto de caché ~$0.0036), aproximadamente 2x en horas pico; lanzado el 24 de abril de 2026. (Una versión más ligera, V4-Flash, 284B/13B, cuesta ~$0.14/$0.28.)

- Nota: Los nombres de API heredados de DeepSeek (deepseek-chat / deepseek-reasoner) quedarán obsoletos el 24 de julio de 2026, planifique la migración si los usa.

Precio y la captura en hora punta

En teoría, DeepSeek V4-Pro es el modelo abierto capaz más barato disponible, con aproximadamente $0.435 por entrada y $0.87 por salida por millón de tokens, con aciertos de caché casi gratuitos. La línea de Kimi es un poco más alta: $0.60-$0.95 por entrada y $2.80-$4.00 por salida. Para volumen de texto puro, DeepSeek gana la guerra de precios.

El detalle que los competidores rara vez mencionan: DeepSeek convirtió su antiguo descuento de horas valle en un recargo por horas pico, por lo que durante el horario laboral chino (aproximadamente de 09:00 a 12:00 y de 14:00 a 18:00) los precios son aproximadamente el doble. Si tu tráfico es irregular y está alineado con el día en China, tu factura real de DeepSeek puede acercarse más a la de Kimi de lo que sugiere el titular. Este es precisamente el tipo de detalle de costo real que solo aparece cuando mides el gasto por hora, no por token.

Benchmarks: un auténtico empate

Estos dos están más cerca que cualquier otro par en esta serie. En codificación, DeepSeek V4-Pro reporta SWE-Bench Verified 80.6, LiveCodeBench 93.5 y una notable calificación de Codeforces de 3206; Kimi K2.6 reporta SWE-Bench Verified 80.2, LiveCodeBench v6 89.6 y un SWE-Bench Pro líder en código abierto de 58.6 frente al 55.4 de DeepSeek. En ciencia y matemáticas intercambian golpes (GPQA Diamond ~90 cada uno; AIME 2026 Kimi 96.4 contra DeepSeek 94.3).

Los desempates son independientes y estructurales. En el Artificial Analysis Intelligence Index, Kimi K2.6 (54) supera a DeepSeek V4-Pro (52) como el mejor modelo de peso abierto. Pero DeepSeek es solo texto, mientras que la visión nativa de Kimi y el supuestamente más largo Kimi K3 contexto amplían lo que puede hacer. Los números de codificación de primera parte de ambos proveedores merecen su propia verificación.

Licenciamiento, modalidad y autoalojamiento

Si estás eligiendo un modelo abierto, tres puntos prácticos lo definen. Licencia: el MIT simple de DeepSeek es el más permisivo, el MIT Modificado de Kimi añade requisitos de marca visible solo a escalas muy grandes (100M+ usuarios o $20M+/mes de ingresos), irrelevante para la mayoría de equipos pero digno de mención. Modalidad: Kimi maneja imágenes de forma nativa; DeepSeek es solo texto. Autoalojamiento: ambos son pesados, DeepSeek V4-Pro y el Kimi de calidad completa requieren cada uno aproximadamente 8 GPU de gama alta, por lo que muchos equipos los ejecutarán a través de hosts de jurisdicción neutral (OpenRouter, DeepInfra) en lugar de locales. Ambas API de primera parte están bajo jurisdicción china, así que enruta en consecuencia si la residencia de datos es importante.

¿Cuál deberías usar?

Elige DeepSeek V4 cuando quieras el costo más bajo posible solo de texto y la licencia más permisiva, y tu tráfico no esté concentrado en las horas punta de China. Elige Kimi K3 cuando necesites visión nativa, quieras una ligera ventaja de inteligencia independiente, o esperes usar el rumor de un contexto más largo. Para muchos equipos, la respuesta correcta es ambas, son lo suficientemente baratas como para mantenerlas como opciones redundantes de peso abierto.

Esa redundancia es una característica cuando ambos están detrás de un único punto de enlace de OrcaRouter. Puedes enrutar texto sin imágenes a granel hacia el que sea más barato en la hora actual (evitando automáticamente el recargo por hora pico de DeepSeek), enviar tareas de imagen a Kimi, y cambiar entre ellos si alguno de los proveedores limita el rendimiento, todo con el costo y la latencia por modelo en un solo panel. Dos modelos abiertos, una integración, y el más barato siempre al frente.

Preguntas frecuentes

¿Cuál es más barato, Kimi K3 o DeepSeek V4?

DeepSeek V4-Pro es más barato sobre el papel (~$0.435/$0.87 en horas valle frente a los ~$0.60-$0.95/$2.80-$4.00 de Kimi), pero su recargo de aproximadamente 2x en horas pico puede cerrar la brecha para el tráfico alineado con el horario diurno de China.

¿Cuál es más capaz?

Muy cerca. Kimi K2.6 supera a DeepSeek V4-Pro en el índice independiente Artificial Analysis Intelligence Index (54 vs 52) y en SWE-Bench Pro; DeepSeek lidera en el rating de Codeforces y en LiveCodeBench. Se espera que K3 eleve las cifras de Kimi, verificar en el lanzamiento.

¿Ambos admiten imágenes?

No. Kimi tiene visión nativa; DeepSeek V4 es solo texto. Si necesitas entrada de imágenes en un modelo abierto, elige Kimi.

¿Puedo ejecutar ambos y cambiar automáticamente?

Sí, ese es un patrón sólido. Una pasarela como OrcaRouter puede enrutar hacia el modelo abierto que sea más barato o más adecuado por tarea y hacer failover entre ellos detrás de un único endpoint.

¿Kimi K3 aún no tiene puntos de referencia oficiales, puedo confiar en esta comparación?

Buena pregunta. A partir del 15 de julio de 2026, K3 no está confirmado, por lo que esta comparación utiliza la línea K2.6/K2.7 de Kimi como base y etiqueta cada cifra de K3 como rumoreada. El consenso de la comunidad es "emocionados, pero esperen los números reales", y los rankings independientes suelen tardar de tres a seis semanas en publicarse después de un lanzamiento. La jugada de bajo riesgo: tratar el veredicto como indicativo, configurar el enrutamiento basado en tareas ahora y volver a evaluar el día en que lleguen los números oficiales de K3 de Moonshot.

El resultado final

Kimi K3 y DeepSeek V4 son los dos mejores modelos de peso abierto de 2026, y están lo suficientemente cerca como para que puedas ejecutar ambos razonablemente. Elige DeepSeek por un costo de solo texto extremadamente bajo y una licencia más limpia, elige Kimi por visión nativa y una ligera ventaja en capacidad, y si no estás seguro, enruta entre ellos y deja que el modelo más barato y mejor adaptado gane cada solicitud.




© 2026 OrcaRouter

Para proveedores

¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.

Contáctanos

Únete a la comunidad

DiscordEmailXGitHubYouTube