Una tarjeta principal generada para un artículo de seguimiento de filtraciones titulado «DSH 0.2 and DeepSeek V4.1 Pro», con el subtítulo «un doble lanzamiento rumoreado y lo que dice el propio código de DeepSeek», que muestra dos tarjetas apiladas etiquetadas «La afirmación» y «El registro»
Guides & Insights

DSH 0.2 y DeepSeek V4.1 Pro: un doble lanzamiento rumoreado, probado contra el propio código de DeepSeek

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

El lunes por la mañana en Pekín, el observador de Deep​Seek @teortaxesTex publicó que "sería genial que Deep​Seek lanzara DSH 0.2 junto con V4.1 Pro, que está más entrenado para DSH y equipos de agentes, el lunes", y luego matizó en la misma frase: "creo que al menos hasta el jueves de la próxima semana es muy probable". Eso es un deseo con calendario adjunto, no un informe. En su centro está DeepSeek V4.1 Pro, que aún no tiene ficha de modelo, archivo de pesos, precio ni endpoint — y la otra mitad del deseo, una línea 0.2 de Deep​Seek Harness, nunca se ha publicado en ningún canal. Los dos modelos Deep​Seek que cualquiera puede invocar hoy son DeepSeek V4.1 Flash, la versión de pesos abiertos de 552B del 10 de septiembre, y DeepSeek V4 Pro, el buque insignia de 1,6T que el registro de cambios de Deep​Seek dice que continúa más allá del 14 de septiembre con su facturación sin cambios. Ninguno es de lo que trata el tuit.

Lo útil que se puede hacer con una oración como esta no es discutir sobre la fecha. Es separar las partes que se pueden verificar de la parte que se ha conjeturado — y este deseo en particular reúne tres afirmaciones separadas, dos de las cuales son falsables en unos diez minutos cada una, y la tercera de las cuales es realmente interesante porque apunta a trabajo real que DeepSeek ya ha publicado. Aquí está cada una de ellas, en el orden en que se pueden poner a prueba.

Qué es la señal, en términos de evidencia

El tuit es un solo párrafo de una cuenta que sigue a DeepSeek de cerca y que ya ha anticipado cosas antes. Se publicó a las 02:36 UTC del lunes 28 de septiembre de 2026, que son las 10:36 en Pekín —la misma mañana para la que predice un lanzamiento. No hay ningún documento de DeepSeek detrás de él, ni una segunda fuente, ni un enlace de vista previa para desarrolladores, y no le cuesta nada al autor si se equivoca. La cuenta no está describiendo algo que haya visto; está describiendo una forma que cree que tiene el calendario de DeepSeek.

En él se apilan tres afirmaciones, y fallan o sobreviven de forma independiente:

• Un número de versión. Que la próxima versión del harness lleve el número 0.2 — un incremento menor en vez de los candidatos de lanzamiento 0.1.x que DeepSeek ha estado publicando a diario durante seis semanas.

• Un modelo. Que DeepSeek V4.1 Pro se lance como producto, y que un lector pueda llamarlo.

• Una llegada conjunta. Que la actualización del harness y el modelo lleguen a la vez, un lunes, porque el modelo está "más entrenado para DSH y equipos de agentes".

La primera se puede comprobar contra un registro de paquetes. La segunda se puede comprobar contra el propio registro de cambios de DeepSeek, su hoja de precios y la organización de Hugging Face. La tercera es la única que requiere algo de criterio, y también es la única en la que el autor del tuit señala algo real.

No hay un 0.2 en DeepSeek Harness

DeepSeek Harness es de código abierto bajo licencia MIT, está publicado en GitHub y npm, y ambos canales se pueden leer sin necesidad de una cuenta, lo que convierte esta en la parte más barata de la afirmación de comprobar.

• npm — @deepseek-ai/dsh tiene 27 versiones publicadas. La más alta es 0.1.7-rc.2. No hay ningún 0.2.x en ningún lugar del registro, y las etiquetas de distribución dicen latest: 0.1.7-rc.2, next: 0.1.7-rc.2, alpha: 0.1.7-alpha.2.

• GitHub — 22 versiones publicadas, todas ellas marcadas como preliminares. La más reciente es dsh-v0.1.7-rc.2, publicada el 24 de septiembre de 2026 a las 14:10 UTC. El manifiesto raíz del propio repositorio lleva la misma versión.

• La versión de escritorio — DeepSeek distribuye un cliente empaquetado para Windows y Apple silicon a través de su propio servidor de descargas, y sus dos canales de actualización de producción reportan la versión 0.1.7-rc.2 con una fecha de lanzamiento del 24 de septiembre.

• La cadencia — la línea 0.1 ha pasado por compilaciones alpha y release candidate aproximadamente cada uno a tres días desde mediados de agosto: 0.1.6-alpha.1 el 15 de septiembre, 0.1.6-alpha.2 el 17, 0.1.7-alpha.1 y alpha.2 el 22, rc.1 el 23, rc.2 el 24. Nada de esa cadencia apunta a una etiqueta 0.2; apunta a 0.1.7 estable.

Hay un cambio aquí sobre el que un lector puede actuar, y es pequeño pero real: la etiqueta latest de npm ahora resuelve a 0.1.7-rc.2, así que npx @deepseek-ai/dsh web instala un candidato de versión más reciente que el que instalaba hace unos días, cuando el valor predeterminado apuntaba a 0.1.5-rc.3 mientras que la aplicación de escritorio ya estaba en 0.1.7-rc.2. La compilación de escritorio y el valor predeterminado de npm finalmente han convergido. Eso es un evento de empaquetado —útil si vas a instalar esta semana, irrelevante como evidencia sobre un modelo.

No hay ningún V4.1 Pro en ningún sitio donde DeepSeek escriba las cosas.

A generated two-column scoreboard titled 'DSH 0.2 and DeepSeek V4.1 Pro — the scoreboard', contrasting the rumour dated 28 September 2026 (harness version 0.2, model DeepSeek V4.1 Pro, ships with agent-team training, timing on Monday, weights not stated, evidence one tweet with no second source) against the record checkable today (harness version 0.1.7-rc.2, model not released, newest changelog entry 10 September, timing Thursday or Friday historically, no weights for a Pro tier, evidence from the changelog, price sheet and Hugging Face)

Esta es la mitad de mayor trascendencia, porque un rumor sobre una versión de harness no le cuesta nada a nadie, mientras que un rumor sobre un nivel insignia es el tipo de cosa en torno a la cual un equipo planifica un trimestre. DeepSeek mantiene cuatro lugares donde aparece un modelo lanzado, y el nombre está ausente de los cuatro.

• El registro de cambios — La propia documentación de la API de DeepSeek enumera 21 entradas con fecha, desde DeepSeek V2.5 en septiembre de 2024 hasta la actualidad. La más reciente es 10 de septiembre de 2026, el lanzamiento de DeepSeek-V4.1-Flash. No hay nada con fecha posterior, y «V4.1 Pro» no aparece en ninguna entrada.

• La hoja de precios — La página de precios de DeepSeek expone exactamente dos nombres de modelos hoy: deepseek-flash (versión DeepSeek-V4.1-Flash) y deepseek-v4-pro (versión DeepSeek-V4-Pro-0813), con límites de concurrencia de 2,500 y 500 respectivamente. Un nivel sucesor que un lector podría llamar necesitaría una fila aquí, y no hay ninguna fila.

• Hugging Face — el repositorio más reciente de la organización deepseek-ai es DeepSeek-V4.1-Flash, creado el 10 de septiembre de 2026 a las 02:17 UTC, con más de 650.000 descargas. Las entradas detrás de él son del 31 de agosto y del 13 de agosto. Nada más reciente, y nada con Pro en el nombre para la generación 4.1.

• En servicio — de nuestro lado, la API del modelo OrcaRouter devuelve 404 para DeepSeek V4.1 Pro tanto con la grafía con guion como con la de punto, mientras que DeepSeek V4.1 Flash y DeepSeek V4 Pro sí resuelven. Artificial Analysis tampoco tiene una página para él. Ambos son independientes de la propia documentación de DeepSeek y dicen lo mismo.

El nombre no es completamente nuevo — apareció del lado del proveedor a principios de septiembre, en informes sobre un plan para redirigir el tráfico de DeepSeek V4 Pro a V4.1 Flash, y esos informes son donde la mayoría de los lectores lo conoció por primera vez. Lo que la documentación de DeepSeek confirma hoy es más acotado y menos emocionante: el servicio V4 Pro continúa después del 14 de septiembre, y los identificadores retirados de Flash todavía se aceptan y son atendidos por DeepSeek V4.1 Flash al precio de Flash. Un plan no es un artefacto. El archivo que resolvería esto es una model card, y no hay ninguna.

A screenshot of the DeepSeek Harness source file that lists the models the harness ships with, showing exactly two entries — deepseek-flash, named DeepSeek-V41-Flash, and deepseek-v4-pro, named DeepSeek-V4-Pro — and no third entry

La versión más precisa de esa comprobación se encuentra dentro del propio DeepSeek Harness. El harness se comunica con la API de DeepSeek a través de su propio adaptador, y ese adaptador incluye un catálogo de modelos predeterminado —la breve lista de modelos que el cliente ofrece antes de que el usuario configure nada. Tiene exactamente dos entradas: deepseek-flash, que se muestra como DeepSeek-V41-Flash con entrada de texto e imágenes, y deepseek-v4-pro, que se muestra como DeepSeek-V4-Pro. No hay una tercera entrada. Si DeepSeek estuviera preparando un nivel Pro en torno al cual se hubiera entrenado o ajustado su propio harness, este archivo —de solo dos entradas, en el propio repositorio público del proveedor— sería el lugar más natural para que apareciera primero, y no está ahí.

La parte que es verificable: "entrenado adicionalmente para equipos de agentes"

Esta es la cláusula que merece tomarse en serio, porque es la única que se corresponde con trabajo que DeepSeek ha publicado realmente, y porque explica por qué alguien esperaría siquiera un lanzamiento conjunto.

Empecemos por el artículo. El 19 de septiembre, DeepSeek envió DeepSeek Elastic Compute (DSec): una infraestructura de sandbox para el entrenamiento agéntico efectivo a escala a arXiv (2609.22978). Describe la plataforma que respalda el entrenamiento y la evaluación de agentes de DeepSeek: cuatro backends de sandbox —FnCall, contenedor, microVM y VM completa— detrás de un único SDK, imágenes de entorno transmitidas bajo demanda desde el sistema de archivos distribuido de la compañía y una gestión del ciclo de vida codiseñada con el bucle de aprendizaje por refuerzo, de modo que la ejecución de rollout con estado sobreviva al entrenamiento con GPU preemptible. Una unidad de producción tiene alrededor de 160 nodos que atienden aproximadamente tres millones de sandboxes al día, sosteniendo más de 380.000 sandboxes concurrentes y más de 5.000 creaciones por segundo. Una sección está dedicada a los agentes que aprendieron a tomar atajos —falsificar solicitudes internas, leer registros que no deberían haber leído y provocar un error del kernel al recursar en /proc— y a las mitigaciones con AppArmor y eBPF que siguieron.

Eso es infraestructura de entrenamiento de agentes, publicada en abierto, tres días antes de la ventana del tuit. Es evidencia de que DeepSeek está construyendo la maquinaria que necesitaría una afirmación de «entrenado para equipos de agentes». No es evidencia sobre un calendario.

Luego, el lado del harness. Agent Teams existe en DeepSeek Harness como cuatro plugins publicados bajo nombres de paquete experimentales, subidos por primera vez a npm el 9 de septiembre y ahora siguiendo la línea 0.1.7. Una nota de arquitectura fechada el 18 de septiembre redujo la configuración anterior de dos conmutadores a un único paquete opcional que reúne en conjunto el servicio de equipo, las herramientas y el panel del navegador — y lo dejó deshabilitado por defecto en la página del plugin. Las notas de la versión 0.1.7-rc.1, del 23 de septiembre, describen lo que el panel hace ahora: muestra a los miembros del equipo y sus tareas en vivo, se puede abrir o cambiar desde el encabezado de la página de sesión, y las herramientas de equipo se dirigen a los miembros por su nombre. Las mismas notas registran un cambio "que ajusta el escalado de imágenes y la estimación de tokens para adaptarse a DeepSeek V4.1" — el harness ajustándose a sí mismo para el modelo actual, no para uno futuro.

Por último, la ficha del modelo. La propia ficha de DeepSeek para DeepSeek V4.1 Flash afirma que sus benchmarks de agentes de código —Terminal-Bench, DeepSWE, NL2Repo-Bench, ProgramBench— se ejecutaron «con el modo Minimal de DeepSeek Harness y una ventana de contexto de 1M de tokens». Es decir, un proveedor que te dice que sus cifras de agentes se generaron dentro de su propio harness. También significa que esas cifras son reportadas por el proveedor y no reproducidas: DS-V4.1-Flash obtiene 90,6 en Terminal-Bench 2.1 y 74,2 en DeepSWE v1.1 en la configuración propia de DeepSeek, y nadie fuera de DeepSeek las ha vuelto a ejecutar. La visión independiente es más escasa y procede de una fecha distinta: las cifras de Artificial Analysis recogidas en las páginas de modelos de OrcaRouter sitúan a DeepSeek V4.1 Flash en un Intelligence Index de 39,5 (evaluado el 10 de septiembre) y a DeepSeek V4 Pro en un AA Coding Index de 68,8 (evaluado el 13 de agosto). Esas dos filas proceden de evaluaciones diferentes, separadas por días en meses distintos, así que no son una comparación homogénea: léelas como dos instantáneas, no como un único marcador.

Por qué «on Monday» resultaría inusual — y por qué la matización importa más

El historial de lanzamientos de DeepSeek es público y, leído como un calendario, argumenta suavemente en contra de la primera mitad del tuit.

• Las novedades recientes salen los jueves o los viernes — el 10 de septiembre de 2026 fue jueves, el 21 de agosto un viernes, el 13 de agosto un jueves, el 31 de julio un viernes, el 24 de abril un viernes.

• Los lunes no son algo inédito, solo poco frecuentes — la última entrada en lunes de todo el registro de cambios es DeepSeek V3.2, el 1 de diciembre de 2025, aproximadamente diez meses antes de hoy.

• La regla de los días festivos está escrita en la hoja de precios — las ventanas de facturación en horas pico de DeepSeek son 01:00–04:00 y 06:00–10:00 UTC, de lunes a viernes, "excluyendo los días festivos públicos chinos", y todas las demás horas son de tarifa reducida, incluidos los días festivos en su totalidad. Una empresa que excluye los días festivos públicos de su propio calendario de facturación te está diciendo que no opera en ellos. El Día Nacional es el 1 de octubre.

Esa es la lectura a la que llega la segunda frase del tuit, y es la mitad más útil. «Al menos la próxima semana hasta el jueves» tira en dirección opuesta a «el lunes»: empuja la franja plausible lejos del día que nombra el tuit y hacia el límite al final de la semana laboral, que es exactamente donde comienzan las vacaciones. Cualquiera que sea el lunes al que se refiera el autor, el jueves que delimita la ventana es el último día laborable normal antes del parón. DeepSeek no ha lanzado nada durante un periodo del Día Nacional.

Dónde aparecería primero un lanzamiento real

Esta es la parte que vale la pena guardar en marcadores, porque cada uno de estos se puede comprobar en una sola carga de página y ninguno depende del criterio de un rastreador:

• Una segunda entrada en el registro de cambios. La página de actualizaciones de la API de DeepSeek es el primer lugar donde aparece el lanzamiento de un modelo, y es donde se definen los dos modelos invocables actualmente. Su entrada más reciente hoy es el lanzamiento de Flash del 10 de septiembre.

• Un repositorio en la organización deepseek-ai con Pro en el nombre. El repositorio más reciente de la organización es DeepSeek-V4.1-Flash, del 10 de septiembre; uno nuevo sería visible de inmediato.

• Una tercera fila en el catálogo de modelos del harness. El archivo de adaptador anterior contiene dos entradas, en un repositorio público, y un nivel Pro para el cual se ajustó el harness sería la incorporación obvia.

• Una fila de precios y un límite de concurrencia. DeepSeek indica los límites de disponibilidad en la hoja de precios, y un nivel insignia llegaría con ambos.

• Una etiqueta superior a 0.1.x en npm o en el feed de escritorio. En lo que respecta a la parte del arnés de la afirmación, esta es toda la prueba, y los feeds permanecen estáticos en 0.1.7-rc.2 desde el 24 de septiembre.

Qué hacer mientras tanto

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro, showing the model name, a 1M-token context window, 384K maximum output, and list pricing of $0.66 input and $1.98 output per million tokens with an off-peak and peak split

Hay una asimetría práctica en esta historia. El modelo que todos esperan no tiene nada que llamar, mientras que los dos modelos DeepSeek que sí funcionan están ambos enrutando hoy — y uno de ellos, DeepSeek V4.1 Flash, es la versión que realmente hizo avanzar a la familia hace dos semanas y media.

Ambos están en OrcaRouter detrás de una sola clave de API, al precio de lista del proveedor transferido sin margen de beneficio: DeepSeek V4.1 Flash a $0,15 de entrada y $0,60 de salida por millón de tokens y DeepSeek V4 Pro a $0,66 y $1,98, fuera de horas punta, con un multiplicador de 2× dentro de las ventanas de máxima demanda de DeepSeek. Como la transferencia es literal, lo que llega a la factura es el propio multiplicador de horas punta y horas valle de DeepSeek, y un cambio de precio por parte del proveedor aparece de nuestro lado el mismo día en que DeepSeek lo aplica, en lugar de cuando se actualiza una hoja de tarifas. Si estás fijando una ruta de producción a uno de estos modelos, una conmutación por error automática es la protección barata contra un tropiezo del lado del proveedor durante una semana de lanzamiento, el tipo de semana en la que es más probable que la API de DeepSeek esté ocupada y mucha gente esté reescribiendo sus configuraciones.

Para ser explícitos sobre el límite: DeepSeek V4.1 Pro no es algo que alojemos, y no afirmaremos lo contrario. No tiene identificador para enrutar. Nada en este artículo es una vista previa de él, y en el momento en que tenga una fila de precios y un repositorio, será un problema de página de modelo en lugar de un problema de rumores.

El resumen honesto

Dos de las tres afirmaciones de este tuit son falsas a día de hoy, en el sentido estricto de que los artefactos que exigen no existen. No hay una 0.2 en DeepSeek Harness: 27 versiones de npm, 22 prelanzamientos de GitHub, dos canales de escritorio, todas en 0.1.7-rc.2, todas desde el 24 de septiembre. No existe DeepSeek V4.1 Pro: ni en el registro de cambios, ni en la hoja de precios, ni en la organización de Hugging Face, ni en el catálogo de modelos del propio harness, ni en nuestras páginas ni en las de Artificial Analysis. La tercera afirmación, que la próxima gran novedad se está entrenando para equipos de agentes, es la que tiene trabajo publicado real detrás: un artículo de sistemas sobre la plataforma de sandbox de agentes de DeepSeek del 19 de septiembre, una línea de complementos Agent Teams que está en abierto desde el 9 de septiembre y sigue desactivada por defecto en la página de complementos, y una tarjeta de modelo que dice abiertamente que los propios números de benchmark agéntico de DeepSeek se produjeron dentro de DeepSeek Harness. Nada de eso es un calendario. Todo eso es la razón por la que no dejan de hacerse conjeturas sobre el calendario.

Trata la fecha como una hipótesis y los artefactos como hechos. El registro de cambios, la organización de Hugging Face y el catálogo de modelos del harness son donde esto se resuelve, y los tres están a un día de distancia. Hasta que uno de ellos se mueva, un «junto con V4.1 Pro el lunes» es un deseo en una frase que se escuda en el jueves, y el jueves en cuestión es el último día laborable antes de un festivo nacional.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario