
Step 5 Preview vs. DeepSeek V4 Pro: uno es una promesa, el otro es una licencia MIT
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Todo en este enfrentamiento depende de una pregunta que no tiene nada que ver con los benchmarks: ¿qué puedes descargar realmente? DeepSeek V4 Pro — la versión que el proveedor lanzó como DeepSeek-V4-Pro-0813 el 13 de agosto de 2026 — es un modelo de mezcla de expertos de 1,6 billones de parámetros bajo licencia MIT, con los pesos disponibles en Hugging Face ahora mismo. Step 5 Preview, que StepFun anunció el 20 de septiembre de 2026, es un MoE disperso de 600 mil millones de parámetros que obtiene ocho puntos más en el mismo ranking independiente y tiene un repositorio en Hugging Face que contiene exactamente un archivo, .gitattributes. StepFun dice que el checkpoint BF16 llega el 15 de octubre. Así que la forma honesta de esta comparación no es "qué modelo es mejor". Es "cuál de estos dos puedes usar como base este trimestre y por cuál estás esperando".
Ese planteamiento es menos emocionante que una comparativa de benchmarks y bastante más útil, porque la diferencia de ocho puntos y la espera de veinticinco días no son el mismo tipo de hecho. Con uno de ellos ya puedes planificar hoy mismo.
Ocho puntos, y los cuatro que importan
Artificial Analysis somete a ambos modelos al Intelligence Index v4.3.2 —diez evaluaciones—, que es el único lugar donde estos dos se han medido con la misma mano.
• Índice de Inteligencia — Step 5 Preview 44 vs DeepSeek V4 Pro 36
• Posición en ese ranking — Step 5 Preview 24.º de 200 frente a DeepSeek V4 Pro 7.º de 113 en su categoría
• Terminal-Bench 4.0 — Step 5 Preview 33,3 %; DeepSeek V4 Pro no aparece en la misma tabla, por lo que no hay una fila agéntica equivalente que citar
• Velocidad de salida — Step 5 Preview 99.8 tokens/seg vs DeepSeek V4 Pro 88.8 tokens/seg
• Tiempo hasta el primer token — Step 5 Preview 2,96 s vs. DeepSeek V4 Pro 1,69 s
• Precio por 1M de tokens — Step 5 Preview $1.00 entrada / $2.70 salida frente a DeepSeek V4 Pro $1.32 entrada / $3.96 salida a la tarifa pico de DeepSeek, reduciéndose a la mitad a $0.66 / $1.98 fuera de horas pico
• Descuento de caché — Step 5 Preview 95% vs DeepSeek V4 Pro 97%
• Contexto — ambos de 1M de tokens; DeepSeek publica un límite máximo de salida de 384,000 tokens, StepFun no ha publicado ninguno
• Pesos — Step 5 Preview cerrado, checkpoint BF16 programado para el 15 de octubre; DeepSeek V4 Pro MIT, disponible para descargar ahora
Dos filas van en contra del titular. DeepSeek V4 Pro responde su primer token en 1,69 segundos frente a los 2,96 de Step 5 Preview —una ventaja inicial del 43% en cada llamada, que en un bucle de agente largo se acumula hasta convertirse en tiempo real de reloj. Y su descuento por caché es dos puntos mejor, algo que importa sobre todo para exactamente la carga de trabajo para la que se venden ambos modelos: un agente que reenvía el mismo prompt de sistema y el mismo contexto del repositorio en cada turno vive casi por completo dentro de ese descuento.
La diferencia agregada de ocho puntos es real, y además es más estrecha de lo que ocho puntos sugieren. Un índice es una composición de diez evaluaciones, y la composición es donde se separan los dos modelos. El 33,3 % de Step 5 Preview en Terminal-Bench 4.0 es un resultado agéntico genuino; la propia fortaleza destacada de DeepSeek V4 Pro es el razonamiento de horizonte largo a un precio que nada más en la categoría de pesos abiertos iguala. Ninguno de los dos tableros publica una fila donde los dos se enfrenten directamente, que es la razón honesta por la que esta comparación no puede resolverse con un solo número.

Lo que te aporta lo «abierto» cuando el proveedor cambia de opinión
Esta es la parte de este enfrentamiento que una ficha técnica no puede plasmar, y vale la pena decirlo con las fechas reales porque ocurrió once días antes de que se anunciara Step 5 Preview.
DeepSeek comunicó a los usuarios que retiraba V4 Pro. El 9 de septiembre la compañía dijo que las solicitudes se redirigirían al más reciente DeepSeek V4.1 Flash; el 10 de septiembre concretó la fecha para las 12:00, hora de Pekín, del 14 de septiembre. El 11 de septiembre dio marcha atrás: el servicio de la API de V4 Pro continúa más allá del 14 de septiembre, con la facturación sin cambios, en palabras de la propia DeepSeek. La cadena del modelo, el contexto de 1M de tokens y el límite de concurrencia de 500 solicitudes siguen siendo los mismos, y la página Models & Pricing de DeepSeek recoge la marcha atrás como una nota al pie en la fila deepseek-v4-pro.
Interpreta eso como una demostración de aquello de lo que los pesos abiertos realmente te protegen, y de aquello de lo que no. La API estuvo a punto de ser retirada por una decisión de planificación. Los pesos no pudieron serlo. Un checkpoint con licencia MIT en tu propio hardware no tiene ningún proveedor que pueda anunciar su retirada, y eso es un tipo de garantía diferente de una promesa de precio — no es una promesa en absoluto.
Que es precisamente la brecha en la que se encuentra Step 5 Preview. StepFun se ha comprometido a tener el checkpoint BF16 para el 15 de octubre, y el nombre del repositorio que ya ha reservado — stepfun-ai/Step-5-Preview-BF16 — es el formato a partir del cual se hace fine-tuning y se cuantiza, nombrado en su creación y rellenado después. Eso es una señal de planificación, no un artefacto. Hasta que el repositorio contenga algo más que un .gitattributes, Step 5 Preview es un modelo que alquilas, bajo los términos de un único proveedor, sin licencia para leer y sin alternativa si los términos cambian.
Las dos formas de ser la opción barata
Ambos modelos ofrecen precios muy por debajo de los de la frontera cerrada, por un amplio margen, y los mecanismos no son los mismos, lo que importa para la durabilidad del precio.
DeepSeek V4 Pro es barato porque un laboratorio publicó los pesos y un mercado de servicio competitivo eliminó el margen. Eso es un suelo estructural: cualquiera puede servir el checkpoint, así que el precio lo fija el coste de una hora de GPU en lugar de la estrategia de precios de una empresa. La propia API de DeepSeek lo tarifica en dos ventanas —1,32 $ y 3,96 $ durante las horas pico, la mitad fuera de ellas— y el pico es estrecho, unas pocas horas en las mañanas de los días laborables en UTC, por lo que la mayor parte del tráfico cae en la tarifa más barata y los fines de semana nunca ven la más alta.
El Step 5 Preview es barato porque StepFun decidió fijarle ese precio. Hay un único endpoint, una única lista de precios y ninguna segunda fuente. Eso no es una acusación: un modelo disperso de 600B/27B cuesta genuinamente menos de servir de lo que sugiere su número de parámetros, y la proporción de parámetros activados es la razón. Simplemente es otro tipo de precio, y la diferencia se nota el día en que StepFun decida que la preview ya ha cumplido su función.
La diferencia de precio entre los dos es lo bastante pequeña como para que no deba decidir nada: $1.00 y $2.70 frente a $1.32 y $3.96 es una diferencia del 24% en la entrada y del 32% en la salida, bien dentro del rango que puede borrar un descuento por caché, una diferencia en la longitud de salida o una tasa de reintentos. En la cuestión de la verbosidad, los dos están cerca: Step 5 Preview generó 160M tokens de salida en la ejecución de índice frente a una mediana de 92M, y la propia ejecución de DeepSeek V4 Pro está en la misma banda. Ninguno de los dos es un modelo frugal, y ambos se venden por ser baratos por token en lugar de baratos por tarea.

Dónde encaja cada uno en un stack real
Si necesitas un modelo que puedas ajustar, cuantizar, alojar en tu propia VPC o entregar a un equipo legal con un archivo de licencia que puedan leer, esto no es una decisión reñida y no se trata de benchmarks. DeepSeek V4 Pro está disponible bajo MIT hoy. Step 5 Preview no tiene licencia, ni configuración ni archivo de parámetros, y lo antes que puedes planificar es mediados de octubre. La diferencia de ocho puntos en el índice no cambia esa aritmética, porque un modelo que no puedes descargar no se puede desplegar.
Si lo que quieres es el resultado agéntico más potente disponible por un dólar por millón de tokens de entrada, Step 5 Preview va por delante en la única tabla comparativa que ha medido ambos, y es la mejor opción predeterminada para el trabajo de prueba y error que llena la mayor parte de un bucle de agente — extracción, clasificación, andamiaje de pruebas, las llamadas rutinarias entre los dos que importan. Sus 99,8 tokens por segundo además completan la salida más rápido que los 88,8 de DeepSeek V4 Pro, lo que acorta el propio bucle, no solo la factura.
El caso incómodo es aquel en el que de hecho se encuentran la mayoría de los equipos: quieres el número de Step 5 Preview, pero no puedes poner en una ruta de producción un endpoint de vista previa que se abrió el día del lanzamiento y que no tiene un techo de salida publicado. Eso es un problema de enrutamiento, y es aquel con el que termina esta comparación. Se puede acceder a DeepSeek V4 Pro a través de OrcaRouter a $0,66 y $1,98 por millón de tokens, la mitad correspondiente al horario valle de los $1,32 y $3,96 de la tarifa de DeepSeek, y junto a él los modelos de texto que lo rodean — detrás de una sola clave para más de 200 modelos con 0 % de recargo, de modo que un cambio de precios de DeepSeek llega a tu factura el mismo día en lugar de en la renovación. Dirige la porción exploratoria del tráfico a la vista previa y mantén la ruta de producción en el modelo que tiene una licencia detrás, con la conmutación por error automática entre proveedores haciendo el trabajo que la curva de capacidad de un endpoint de vista previa hace necesario.

¿Qué lo resolvería?
Tres cosas, y las tres son comprobables en lugar de discutibles.
El primero es la licencia. Cuando llegue el checkpoint BF16, ¿qué dice el repositorio que se le permite hacer a una empresa con él? Una licencia permisiva cierra por sí sola la mayor parte de esta brecha, porque convierte la ventaja de ocho puntos en algo que puedes poseer en lugar de alquilar. Una restrictiva deja a DeepSeek V4 Pro como el único modelo de la pareja sobre el que realmente puedes construir un producto.
El segundo es el techo de salida. DeepSeek publica 384.000 tokens. El anuncio de StepFun dice contexto de 1 M y no menciona un límite de salida, y una configuración de terceros independiente que circuló durante la filtración indicaba 350.000 de contexto con un máximo de salida de 64.000. Para el trabajo agéntico de horizonte largo para el que se venden ambos modelos, esa cifra no es una nota al pie.
El tercero es si el precio se mantiene una vez que se quita el sufijo de vista previa. Un precio de vista previa es una cifra de captación de clientes; un precio comercial es un modelo de negocio. El suelo de DeepSeek V4 Pro lo establece un mercado competitivo de servicio y no puede variar mucho. El de Step 5 Preview puede moverse un martes.
Hasta que se respondan las dos primeras, la interpretación práctica es que DeepSeek V4 Pro es el modelo que despliegas y Step 5 Preview es el modelo contra el que haces benchmark —con la advertencia de que un endpoint de vista previa con apenas unos días de antigüedad, situado ocho puntos por encima de un modelo insignia maduro con licencia MIT, es un resultado real, y la razón por la que el 15 de octubre merece una entrada en el calendario en lugar de un encogimiento de hombros.
Comparados en este artículo2
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
