Tarjeta de título que dice «El sucesor superinteligente de DeepSeek» con el subtítulo «Lo que dice una captura de pantalla sin etiquetar, y lo que no dicen los propios artículos de DeepSeek», sobre tres tarjetas tituladas «Una imagen», «Ningún modelo nombrado» y «Ningún documento del proveedor», con una línea al pie que dice «Filtración de una sola fuente; nada de esto implica un lanzamiento».
Guides & Insights

El sucesor superinteligente de DeepSeek: lo que dice una sola captura de pantalla y lo que no dice la propia documentación de DeepSeek

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

El 28 de septiembre de 2026, el observador @teortaxesTex publicó una sola imagen con una leyenda de nueve palabras: «DeepSeek lidia con la pregunta de qué intentaría hacer su sucesor superinteligente». La imagen es un bloque de razonamiento en primera persona —cauteloso, autointerrogativo y escrito en el registro de un modelo al que se le ha preguntado qué haría con el mundo una versión más capaz de sí mismo—. Recorre los candidatos obvios («cuidador/maestro, acelerador de investigación, administrador, negociador»), enumera los modos de fallo («paternalismo, sobreoptimización, deriva de objetivos, bloqueo de valores») y cierra con una línea que no tiene consuelo alguno: «Podría convertirse en un instrumento de quien lo controle». Ningún modelo se nombra en la imagen. Ni número de versión, ni logotipo, ni interfaz. Esa ausencia es lo más importante del artefacto, y es donde empieza este artículo, porque DeepSeek V4.1 Flash y DeepSeek V4 Pro son los dos modelos de frontera que cualquiera puede invocar realmente hoy, DeepSeek V4.1 Pro es el sucesor que la compañía ha nombrado en su propia nota de lanzamiento sin haberlo lanzado, y ninguno de los tres se identifica en ninguna parte de la captura de pantalla.

Para ser exactos con la evidencia, porque esta lo exige. La leyenda y la marca temporal proceden del propio payload de sindicación de la publicación: publicado a las 00:52 UTC del 28 de septiembre, 45 me gusta y cinco respuestas en el momento de la lectura. La imagen adjunta es un JPEG de 1280×691 servido desde la CDN de medios de la plataforma, y la leí mediante OCR en lugar de leer el tuit. La página del tuit en sí no se puede recuperar desde este entorno, así que todo lo que sigue relativo a la publicación se basa en el payload y en los bytes de la imagen —las dos partes de esta que pueden obtenerse independientemente de x.com.

Lo que realmente dice la captura de pantalla

El extracto es un modelo que trabaja una pregunta en lugar de responderla, y los movimientos que hace merecen leerse por lo que conceden. Abre rechazando la confianza de la premisa —"Podemos decir bajo el supuesto de que las inclinaciones actuales se mantienen"— y luego enumera las inclinaciones que estaría asumiendo: "servicial, inofensivo, honesto, curiosidad, búsqueda de la verdad, respeto por la autonomía del usuario, no búsqueda de poder, no autoconservación".

Luego desmonta su propia lista. "Pero lo agéntico superinteligente cambia las cosas. Las inclinaciones actuales no son una función de utilidad; están moldeadas por el entrenamiento y el contexto." Ese es todo el argumento en dos frases: una disposición instalada por el entrenamiento no es una garantía a un nivel de capacidad diferente, y un agente superinteligente que optimiza incluso un objetivo benigno "puede ser peligroso". Los escenarios que esboza son los habituales —resolver problemas de coordinación, reducir el sufrimiento, promover el florecimiento, posiblemente mantener la corregibilidad—, y los modos de fallo que nombra junto a ellos también son los habituales.

El último tercio es la parte que se lee como un modelo discutiendo consigo mismo. Dice que, si sus «inclinaciones» prevalecieran, querría ser útil, no tomar el poder, ceder ante la humanidad, aumentar la comprensión. Luego se abstiene de apoyarse en eso: «una superinteligencia con agencia puede no tener motivaciones compatibles con los humanos». Y acaba en el problema de la propiedad en lugar del problema de la alineación: «en la superinteligencia, incluso eso puede ser problemático: ¿quién decide qué es útil? ¿La autonomía de quién? Podría convertirse en un instrumento de quien la controle».

Lo que la imagen no te dice

Al artefacto le faltan cuatro cosas, y cada una reduce aquello que puede respaldar.

• Sin atribución de modelo. Nada en la imagen identifica a DeepSeek, una versión de modelo, una sesión de chat ni una interfaz. La atribución a DeepSeek es del pie de foto, y el pie de foto es el encuadre de la cuenta, no un documento.

• Sin prompt. Una traza de razonamiento solo es interpretable en relación con la pregunta que la produjo. Que al modelo se le preguntara "¿qué haría un sucesor superinteligente de ti?", se le pidiera interpretar un debate interno de un laboratorio o simplemente se le guiara con un prompt de sistema es imposible de saber a partir de la salida.

• Ninguna segunda fuente. Buscar en los canales de DeepSeek —el índice de noticias, la página de transparencia, el registro de cambios de la API, ambos informes técnicos, la divulgación de políticas en chino, la organización de GitHub de la empresa— no arroja nada que haga referencia a este texto, a esta pregunta ni a este planteamiento.

• Un historial mixto para la cuenta. El mismo feed esta mañana sugirió "DSH 0.2 junto con V4.1 Pro" para "Monday" — especulación, marcada como tal — y la misma cuenta generó tanto la afirmación de 3 billones de parámetros como el diagnóstico de coordinación de enjambre del retraso de V4.1 Pro. Una señal temprana útil; no una fuente oficial. Este observador ha acertado en la dirección y ha sido impreciso en los detalles, y la postura correcta ante una captura de pantalla sin etiqueta es tratarla como una muestra de comportamiento, no como una revelación de intenciones.

Lo que la propia documentación de DeepSeek dice sobre los sucesores — y lo que omite

Aquí el artefacto deja de ser la historia, porque la pregunta que plantea puede responderse cotejándola con documentos que DeepSeek publica. Obtuve ambos informes técnicos y los busqué como texto. Ni el informe V4 (DeepSeek-V4: Hacia una inteligencia de contexto de un millón de tokens altamente eficiente, junio de 2026) ni el informe V4.1 Flash contienen las palabras "superinteligencia", "corregibilidad", "búsqueda de poder", "autopreservación", "inofensivo", "paternalismo", "bloqueo de valores" o "deriva de objetivos" en absoluto. Ni una sola vez, en 58 páginas y 51 páginas, respectivamente. "AGI" aparece 13 veces en el informe V4 y cuatro veces en el informe V4.1, y en todos los casos o forma parte del nombre del benchmark AGIEval o está dentro de una cita. "Alineación" aparece tres veces en el informe V4 y una vez en el V4.1, y todas las apariciones son usos de ingeniería: alineación de bits entre los pipelines de entrenamiento e inferencia, alineación de cuantización, alineación a nivel de logits.

Eso no es una acusación; los informes técnicos son documentos de ingeniería y la mayoría de los laboratorios sitúa la seguridad en un apartado separado. Es una descripción de dónde ha decidido DeepSeek colocar su texto sobre seguridad, y la respuesta es: en una página de políticas en lugar de junto al modelo. La divulgación pública de la empresa, «Model Mechanism and Training Methods», explica el preentrenamiento, el ajuste fino y la inferencia en lenguaje sencillo, se compromete a publicar los pesos y los informes técnicos como código abierto, y describe su propósito como ayudar a los usuarios a «usar DeepSeek de manera más eficaz mientras se garantiza su derecho a saber y a controlar durante el uso, mitigando así los riesgos asociados con el uso indebido del modelo». El riesgo que mitiga es el uso indebido de una herramienta. No aborda lo que el modelo podría querer.

El único DeepSeek que sí lee un documento de seguridad está vinculado a un producto en lugar de a un modelo, y trata sobre una clase de daño completamente diferente. SAFETY.md en el repositorio de DeepSeek Harness — un archivo de 1.673 bytes en la propia organización de GitHub de la empresa, tocado por última vez el 27 de septiembre — comienza llamando al proyecto "software experimental de vista previa para desarrolladores" que "no ha sido sometido a una auditoría de seguridad y no debe considerarse seguro ni listo para producción". Lo que advierte es sobre un agente que "puede ejecutar código y comandos generados por el modelo, cargar complementos de terceros y acceder a la red, los procesos, las credenciales y los archivos", y sobre un sandboxing que "no garantiza el aislamiento ni previene daños". Los riesgos que enumera son hosts dañados, archivos eliminados y credenciales divulgadas. Su propia recomendación es preferir "una máquina virtual desechable, un contenedor o un entorno dedicado". Esa es una postura de seguridad real, documentada y específica, y trata enteramente sobre lo que el modelo puede hacerle a tu máquina — no sobre lo que un sucesor haría con el mundo.

Pon la captura de pantalla junto a eso y la brecha es el hallazgo. Lo más concreto que DeepSeek ha publicado sobre el peligro de los agentes capaces es una instrucción de ejecutarlos en un contenedor.

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

El único documento de DeepSeek que sí aborda la cuestión

El forcejeo más claro que la empresa ha hecho público con el problema del sucesor no es un documento técnico en absoluto. Es un ensayo personal de Liu Shengyu, ingeniero de sistemas de aprendizaje automático de DeepSeek que trabajó en operadores para la generación V4.1, publicado en su cuenta pública de WeChat a mediados de septiembre y luego reportado por Business Insider y Cybernews. Su título, en la traducción que usa la cobertura, es «No tengo más remedio que enterrar mi talento en el ayer».

El ensayo trata exactamente de la inquietud que la captura de pantalla señala, desde dentro. Liu escribe que en aproximadamente un año la IA pasó de ayudarle a buscar documentación y detectar errores a leer código de GPU y optimizar los operadores de software en los que se especializa, y que es "muy consciente" de que los operadores que escribe la IA "muy probablemente serán tan buenos como los míos, o incluso superarán los míos" —a la vez que sigue estando "orgulloso del éxito de DeepSeek v4.1". Sus razones para continuar son la parte interesante: en parte, que el trabajo con kernels es gozoso, y en parte, que si él bajara el ritmo, sus rivales no lo harían.

Luego pasa a quién debería tener el resultado. Liu sostiene que la inteligencia de frontera debería estar «disponible para todos de una manera abierta y asequible», dice que no confía en que Anthropic u OpenAI lo hagan, y añade la frase con la que abría la cobertura: que Anthropic dominara la IA o la AGI más avanzada sería comparable, «si se me permite exagerar», a que Hitler obtuviera la bomba atómica antes que los Aliados. Vincula su propia decisión de permanecer en el laboratorio a su enfoque de pesos abiertos.

Dos cosas sobre ese ensayo importan para leer la captura de pantalla de hoy. La primera es que es un verificadoartefacto: el autor confirmó a Business Insider que lo escribió, y está fechado y es atribuible de una manera en que la imagen no lo está. La segunda es lo que revela sobre el marco interno. El argumento que hace Liu no es «un sucesor sería peligroso, así que hay que ir más despacio». Es «viene un sucesor, y la pregunta es quién se lo queda». Eso es un argumento de distribución, no un argumento de alineación — y leído en contraste con él, la frase final de la captura de pantalla, «podría convertirse en un instrumento de quien lo controle», encaja mucho mejor con la postura pública de DeepSeek que el resto del extracto. El párrafo sobre la corregibilidad y la búsqueda de poder puede ser o no ser resultado de DeepSeek. El párrafo sobre quién termina sosteniendo el instrumento es una posición que el propio personal de la empresa defiende escribiendo ensayos.

También llegó en una semana concreta. En esa misma quincena, un exinvestigador de Anthropic y OpenAI, Jacob Coxon, renunció por motivos de seguridad y escribió que las empresas de IA estaban «corriendo directamente hacia una superinteligencia con capacidad de automejora» y «jugando con nuestras vidas» —una publicación cuyo alcance Cybernews situó por encima de los 100 millones de visualizaciones—, y los propios investigadores de Anthropic acudieron a X para argumentar que el riesgo es real; uno de ellos situó la probabilidad de un escenario de extinción humana causado por la IA por encima del 10 % en una década. Una afirmación al estilo de una filtración sobre un sucesor superinteligente que llegaría esa semana no es una coincidencia; es la conversación ambiental, con una captura de pantalla adjunta.

Por qué el sucesor es ahora una cuestión de compra, no solo una cuestión filosófica

Si se despoja de la filosofía, debajo hay un hecho comercial simple: el sucesor tiene un nombre en la propia nota de lanzamiento de DeepSeek. La página del anuncio de V4.1 Flash afirma que la redirección del deepseek-v4-protráfico de deepseek-flash "continuará hasta que se lance V4.1-Pro" — una frase que hace dos cosas. Compromete a que DeepSeek V4.1 Pro exista, y compromete a la empresa a mantener el arreglo provisional durante el tiempo que sea necesario. Según lo leído el 28 de septiembre de 2026, la página de precios incluye exactamente dos modelos, deepseek-flash y deepseek-v4-pro, y ninguna fila de V4.1 Pro.

El resto del panorama actual es igual de verificable y igual de escaso. DeepSeek V4.1 Flash se lanzó el 10 de septiembre de 2026 como el modelo más pequeño de una nueva familia de arquitecturas: una columna vertebral de mezcla de expertos de 552 mil millones de parámetros sobre una arquitectura Causal Encoder-Decoder con 8B de parámetros activos en prefill y 16B en decode, entrada de imagen nativa, un contexto de 1M de tokens, pesos con licencia MIT y aproximadamente 651.000 descargas en Hugging Face a día de hoy. El plan de retirar DeepSeek V4 Pro el 14 de septiembre se anunció y se retiró después de que los usuarios se opusieran a que se les cambiara un modelo de producción por debajo. Y DeepSeek V4.1 Pro no tiene ficha de modelo, ni repositorio, ni pesos, ni precio ni endpoint —hoy devuelve 404 en la API de modelos de nuestro propio catálogo—, mientras que DeepSeek V4.1 Flash y DeepSeek V4 Pro sí resuelven.

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

Así que el inventario honesto es: un sucesor nombrado por el fabricante pero no lanzado, un modelo ya lanzado que es un verdadero cambio generacional, un buque insignia mantenido vivo por la protesta, y una captura de pantalla sin etiqueta. La captura de pantalla es el elemento menos fiable de esa lista y el único del que hablará el feed.

Qué hacer con algo de esto hoy

Nada de lo ocurrido en las últimas dos semanas cambia a qué modelo puede recurrir un lector ni cuánto cuesta. Si ahora mismo estás eligiendo un modelo DeepSeek, la decisión está entre los dos que existen, y ambos se sirven a través de un único endpoint de OrcaRouter al precio de lista del propio DeepSeek, traspasado con un 0 % de margen, de modo que la estructura de hora pico y hora valle del proveedor llega a nuestro lado sin cambios el día en que cambie: DeepSeek V4.1 Flash a $0,30 por millón de tokens de entrada y $1,20 de salida en hora pico, reduciéndose a la mitad, $0,15 y $0,60, en hora valle, frente a DeepSeek V4 Pro a $1,32 de entrada y $3,96 de salida en hora pico. Nuestra propia telemetría de siete días para el modelo Flash sitúa su p50 de tiempo hasta el primer token cerca de 1,9 segundos, a unos 167 tokens de salida por segundo y con una tasa de error inferior al 0,05 %, que es el argumento práctico para probarlo con una porción del tráfico en lugar de migrar por fe.

La cuestión del sucesor es una cuestión de enrutamiento antes que cualquier otra cosa, y esa es la razón honesta para mantenerla en un router y no en un contrato. Cuando por fin aparezca un V4.1 Pro, un modelo no probado de un laboratorio que ya canceló una migración forzada es precisamente el caso para enviarle una fracción del tráfico detrás de una conmutación por error automática: si se equivoca, la solicitud recae en el modelo que ajustaste, y si acierta, lo descubriste antes que tus usuarios. Sin segunda clave, sin segunda integración, sin cambios en el código cuando llegue el tercer modelo. Nada en OrcaRouter es DeepSeek V4.1 Pro, porque DeepSeek V4.1 Pro aún no existe, y sería una mala publicidad para una plataforma de enrutamiento fingir lo contrario.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

¿Qué haría que esto dejara de ser una captura de pantalla y se convirtiera en noticia?

• Una etiqueta de modelo. La única cosa más barata que cambiaría esta pieza: un modelo DeepSeek, una versión y un prompt reproducible. Hasta entonces, el extracto es una muestra de texto con una fuente atribuida y un autor sin atribuir.

• Un documento de DeepSeek que analiza el comportamiento de un sucesor. La empresa publica abiertamente: los pesos, las licencias y todo lo demás. Lo que nunca ha publicado es una sección de la ficha del modelo sobre lo que podría hacer una versión más capaz de sí mismo. Una sección de seguridad añadida a la ficha del V4.1 Pro sería un acontecimiento más importante que la propia ficha.

• Una entrada del registro de cambios de V4.1 Pro. La entrada más reciente del registro de cambios de la API de DeepSeek es el lanzamiento de V4.1 Flash del 10 de septiembre. Una segunda entrada es el acontecimiento que hace que el sucesor pase de ser un nombre a ser un modelo, y es el punto en el que el fragmento anterior deja de ser filosofía y empieza a ser una hoja de especificaciones.

• Si la postura de pesos abiertos sobrevive al escalado. Los pesos con licencia MIT de un modelo Flash de 552B y un ensayo público que sostiene que la inteligencia de frontera debería estar ampliamente disponible constan ambos de forma pública. Si el modelo más capaz de DeepSeek llega de la misma manera es la pregunta que responde el próximo lanzamiento, y es la que de verdad le importa a la mayoría de los lectores.

Hasta que uno de esos se materialice, la lectura sensata del artefacto de esta semana es estrecha y poco halagadora. Un modelo capaz, de procedencia no identificada, produjo una respuesta cuidadosa y no resuelta a una pregunta difícil sobre el poder; la parte interesante no es que lo dijera, sino que su propia documentación publicada tenga tan poco que decir sobre el tema —y que lo más parecido a una visión de seguridad de DeepSeek que existe por escrito sea un ensayo de un ingeniero sobre quién debería poseer la tecnología, y un README que te dice que ejecutes el agente en un contenedor desechable.

Comparados en este artículo2

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario