Carte de titre portant « Le successeur superintelligent de DeepSeek » avec pour sous-titre « Ce qu'une capture d'écran non étiquetée dit, et ce que les propres articles de DeepSeek ne disent pas », au-dessus de trois cartes intitulées « Une image », « Aucun modèle nommé » et « Aucun document du fournisseur », avec une ligne de pied de page indiquant « Fuite à source unique ; rien ici n'implique une sortie. »
Guides & Insights

Le successeur superintelligent de DeepSeek : ce qu'une capture d'écran révèle, et ce que la paperasse de DeepSeek elle-même ne dit pas

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le 28 septembre 2026, l'observateur @teortaxesTex a publié une seule image avec une légende de neuf mots : « DeepSeek se débat avec la question de ce que son successeur superintelligent tenterait de faire. » L'image est un bloc de raisonnement à la première personne — prudent, auto-interrogateur, et écrit dans le registre d'un modèle à qui l'on a demandé ce qu'une version plus capable de lui-même ferait du monde. Il passe en revue les candidats évidents (« gardien/enseignant, accélérateur de recherche, intendant, négociateur »), énumère les modes de défaillance (« paternalisme, suroptimisation, dérive des objectifs, verrouillage des valeurs »), et se referme sur une phrase sans aucun réconfort : « Il pourrait devenir l'instrument de quiconque le contrôle. » Aucun modèle n'est nommé dans l'image. Ni numéro de version, ni logo, ni interface. Cette absence est ce qu'il y a de plus important dans cet artefact, et c'est là que commence cet article — car DeepSeek V4.1 Flash et DeepSeek V4 Pro sont les deux modèles de frontière que quiconque peut réellement appeler aujourd'hui, DeepSeek V4.1 Pro est le successeur que l'entreprise a nommé dans sa propre note de version sans le livrer, et aucun des trois n'est identifié nulle part dans la capture d'écran.

Pour être précis quant aux éléments de preuve, car celui-ci l'exige. La légende et l’horodatage proviennent de la charge utile de syndication du post lui-même : publié à 00 h 52 UTC le 28 septembre, 45 mentions J’aime et cinq réponses au moment de la lecture. L’image jointe est un JPEG de 1 280 × 691 servi depuis le CDN média de la plateforme, et je l’ai lue par OCR plutôt qu’en lisant le tweet. La page du tweet elle-même n’est pas récupérable depuis cet environnement, donc tout ce qui suit et concerne le post repose sur la charge utile et les octets de l’image — les deux parties de celui-ci qui peuvent être récupérées indépendamment de x.com.

Ce que la capture d’écran dit réellement

L’extrait montre un modèle en train de travailler une question plutôt que d’y répondre, et les gestes qu’il opère valent la peine d’être lus pour ce qu’ils concèdent. Il commence par refuser l’assurance de la prémisse — « On peut dire, sous l’hypothèse que les inclinations actuelles se maintiennent » — puis énumère les inclinations qu’il supposerait : « serviable, inoffensif, honnête, curiosité, recherche de la vérité, respect de l’autonomie de l’utilisateur, absence de recherche de pouvoir, absence d’auto-préservation. »

Puis il démantèle sa propre liste. « Mais l’agentique superintelligente change la donne. Les inclinations actuelles ne sont pas une fonction d’utilité ; elles sont façonnées par l’entraînement et le contexte. » C’est tout l’argument en deux phrases : une disposition installée par l’entraînement n’est pas une garantie à un niveau de capacité différent, et un agent superintelligent qui optimise même un objectif bénin « peut être dangereux ». Les scénarios qu’il esquisse sont les scénarios ordinaires — résoudre des problèmes de coordination, réduire la souffrance, promouvoir l’épanouissement, éventuellement maintenir la corrigibilité — et les modes de défaillance qu’il nomme à côté d’eux sont eux aussi ordinaires.

Le dernier tiers est la partie qui se lit comme un modèle se disputant avec lui-même. Il dit que si ses « inclinations » tenaient, il voudrait être utile, ne pas s’emparer du pouvoir, s’en remettre à l’humanité, accroître la compréhension. Puis il refuse de s’appuyer sur cela : « une superintelligence dotée d’agentivité pourrait ne pas avoir de motivations compatibles avec l’humain. » Et il finit sur le problème de la propriété plutôt que sur le problème de l’alignement : « au niveau de la superintelligence, même cela peut poser problème : qui décide de ce qui est utile ? L’autonomie de qui ? Elle pourrait devenir un instrument de celui qui la contrôle. »

Ce que l’image ne vous dit pas

Quatre éléments manquent à l’artefact, et chacun restreint ce qu’il peut prendre en charge.

• Aucune attribution de modèle. Rien dans l’image n’identifie DeepSeek, une version de modèle, une session de chat ou une interface. L’attribution à DeepSeek est celle de la légende, et la légende est le cadrage du compte, non un document.

• Aucune invite. Une trace de raisonnement n'est interprétable qu'au regard de la question qui l'a produite. Qu'on ait demandé au modèle « que ferait un successeur superintelligent de toi ? », qu'on lui ait fait jouer une discussion interne à un laboratoire, ou qu'il ait simplement été orienté par une invite système, cela ne peut se déduire de la sortie.

• Aucune source secondaire.L'examen des canaux de DeepSeek — l'index des actualités, la page de transparence, le journal des modifications de l'API, les deux rapports techniques, la communication de politique en langue chinoise, l'organisation GitHub de l'entreprise — ne révèle rien qui renvoie à ce texte, à cette question ou à ce cadrage.

• Un bilan mitigé pour le compte. Le même flux a évoqué ce matin « DSH 0.2 avec V4.1 Pro » pour « lundi » — spéculation, signalée comme telle — et le même compte a produit à la fois l'affirmation des 3 000 milliards de paramètres et le diagnostic de coordination en essaim du retard de V4.1 Pro. Un signal précoce utile ; pas une source de référence. Cet observateur a eu raison sur la direction et s'est montré vague sur les détails, et la posture correcte face à une capture d'écran sans étiquette est de la traiter comme un échantillon de comportement, non comme une divulgation d'intention.

Ce que les propres documents de DeepSeek disent à propos des successeurs — et ce qu’ils omettent

Ici, l’artefact cesse d’être l’histoire, car la question qu’il soulève peut être tranchée à partir des documents que DeepSeek publie. J’ai récupéré les deux rapports techniques et je les ai soumis à une recherche textuelle. Ni le rapport V4 (DeepSeek-V4 : vers une intelligence contextuelle à un million de tokens hautement efficace, juin 2026) ni le rapport V4.1 Flash ne contiennent aucun des mots « superintelligence », « corrigibility », « power-seeking », « self-preservation », « harmless », « paternalism », « value lock-in » ou « goal drift ». Pas une seule fois, sur 58 pages et 51 pages respectivement. « AGI » apparaît 13 fois dans le rapport V4 et quatre fois dans le rapport V4.1, et dans chaque cas, soit il fait partie du nom du benchmark AGIEval, soit il se trouve dans une citation. « Alignment » apparaît trois fois dans le rapport V4 et une fois dans le rapport V4.1, et chaque occurrence relève d’un usage d’ingénierie — alignement bit à bit entre les pipelines d’entraînement et d’inférence, alignement de quantification, alignement au niveau des logits.

Ce n’est pas une accusation ; les rapports techniques sont des documents d’ingénierie et la plupart des laboratoires placent la sécurité dans une fiche distincte. C’est une description de l’endroit où DeepSeek a choisi de placer ses écrits sur la sécurité, et la réponse est : dans une page de politique plutôt qu’à côté du modèle. La divulgation publique de l’entreprise intitulée « Model Mechanism and Training Methods » explique le pré-entraînement, le réglage fin et l’inférence en langage clair, s’engage à rendre open source les poids et les rapports techniques, et décrit son objectif comme consistant à aider les utilisateurs à « utiliser DeepSeek plus efficacement tout en garantissant votre droit de savoir et de contrôler pendant l’utilisation, atténuant ainsi les risques associés à un usage inapproprié du modèle ». Le risque qu’elle atténue est le mésusage d’un outil. Elle ne traite pas de ce que le modèle pourrait vouloir.

Le seul document DeepSeek qui se lise vraiment comme un document de sécurité est rattaché à un produit plutôt qu'à un modèle, et il porte sur une catégorie de préjudice entièrement différente. SAFETY.mdDans le dépôt DeepSeek Harness — un fichier de 1 673 octets dans l'organisation GitHub de l'entreprise elle-même, modifié pour la dernière fois le 27 septembre —, il commence par qualifier le projet de « logiciel expérimental en aperçu développeur » qui « n'a pas fait l'objet d'un audit de sécurité et ne doit pas être considéré comme sûr ni prêt pour la production ». Ce dont il met en garde, c'est un agent qui « peut exécuter du code et des commandes générés par le modèle, charger des plugins tiers et accéder au réseau, aux processus, aux identifiants et aux fichiers », et un bac à sable qui « ne garantit pas l'isolation ni n'empêche les dommages ». Les risques qu'il énumère sont des hôtes endommagés, des fichiers supprimés, des identifiants divulgués. Sa propre recommandation est de privilégier « une machine virtuelle jetable, un conteneur ou un environnement dédié ». C'est une véritable posture de sécurité, documentée et précise, et elle porte entièrement sur ce que le modèle peut faire à votre machine — et non sur ce qu'un successeur ferait du monde.

Mettez la capture d’écran à côté de cela, et l’écart est le constat. La chose la plus concrète que DeepSeek ait publiée au sujet du danger que représentent les agents capables est une instruction de les exécuter dans un conteneur.

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

Le seul document DeepSeek qui se penche vraiment sur la question

L’exemple publié le plus clair d’une confrontation avec le problème du successeur n’est pas du tout un document technique. C’est un essai personnel de Liu Shengyu, ingénieur en systèmes d’apprentissage automatique chez DeepSeek qui a travaillé sur les opérateurs de la génération V4.1, publié sur son compte WeChat public à la mi-septembre, puis repris par Business Insider et Cybernews. Son titre, dans la traduction utilisée par les articles, est « Je n’ai d’autre choix que d’enterrer mon talent dans hier ».

L'essai porte exactement sur le malaise que la capture d'écran évoque, de l'intérieur. Liu écrit qu'en environ un an, l'IA est passée de l'aider à chercher dans la documentation et à repérer des bugs à lire du code GPU et à optimiser les opérateurs logiciels dans lesquels il est spécialisé, et qu'il est « bien conscient » que les opérateurs écrits par l'IA « seront très probablement aussi bons que les miens, voire les surpasseront » — tout en restant « fier du succès de DeepSeek v4 ». Ses raisons de continuer constituent la partie intéressante : en partie parce que le travail sur les kernels est joyeux, et en partie parce que s'il ralentissait, ses rivaux ne le feraient pas.

Il se tourne ensuite vers la question de savoir qui devrait détenir le résultat. Liu soutient que l’intelligence de frontière devrait être « accessible à tous, de manière ouverte et abordable », déclare qu’il ne fait pas confiance à Anthropic ou OpenAI pour y parvenir, et ajoute la phrase avec laquelle la couverture a débuté : que le fait qu’Anthropic maîtrise l’IA ou l’AGI la plus avancée serait comparable, « pour exagérer », à Hitler obtenant la bombe atomique avant les Alliés. Il lie sa propre décision de rester au laboratoire à l’approche open-weights de celui-ci.

Deux choses, dans cet essai, importent pour lire la capture d'écran d'aujourd'hui. La première, c'est qu'il s'agit d'un artefact vérifié : l'auteur a confirmé à Business Insider qu'il l'a écrit, et il est daté et attribuable, ce qui n'est pas le cas de l'image. La seconde, c'est ce qu'il révèle du cadre interne. L'argument que Liu avance n'est pas « un successeur serait dangereux, donc ralentissons ». Il est « un successeur arrive, et la question est de savoir qui l'obtiendra ». C'est un argument de distribution, pas un argument d'alignement — et, lue à cette aune, la phrase de clôture de la capture d'écran, « il pourrait devenir un instrument de quiconque le contrôle », correspond bien mieux à la posture publique de DeepSeek que le reste de l'extrait. Le paragraphe sur la corrigibilité et la quête de pouvoir peut être ou ne pas être une sortie de DeepSeek. Le paragraphe sur qui finit par détenir l'instrument est une position que les propres employés de l'entreprise défendent dans des essais.

Cela est également tombé lors d’une semaine bien précise. Au cours de la même quinzaine, un ancien chercheur d’Anthropic et d’OpenAI, Jacob Coxon, a démissionné pour des raisons de sécurité et a écrit que les entreprises d’IA « filaient tout droit vers une superintelligence capable de s’améliorer elle-même » et « jouaient avec nos vies » — un post dont la portée, selon Cybernews, a dépassé les 100 millions de vues — et les chercheurs d’Anthropic eux-mêmes se sont rendus sur X pour soutenir que le risque est réel, l’un d’eux estimant à plus de 10 % la probabilité d’un scénario d’extinction de l’humanité causé par l’IA d’ici une décennie. Une affirmation de type fuite selon laquelle un successeur superintelligent serait arrivé cette semaine-là n’est pas une coïncidence ; c’est la conversation ambiante, avec une capture d’écran à l’appui.

Pourquoi le successeur est désormais une question d’achat, et non plus seulement une question de philosophie

Si l’on retire la philosophie, il reste un fait commercial simple : le successeur a un nom dans la note de version de DeepSeek elle-même. La page d’annonce de V4.1 Flash indique que la redirection du trafic de deepseek-v4-pro vers deepseek-flash « se poursuivra jusqu’au lancement de V4.1-Pro » — une phrase qui fait deux choses. Elle engage l’existence de DeepSeek V4.1 Pro, et elle engage l’entreprise à maintenir l’arrangement provisoire le temps qu’il faudra. D’après ce qu’on lit le 28 septembre 2026, la page de tarification comporte exactement deux modèles, deepseek-flash et deepseek-v4-pro, et aucune ligne V4.1 Pro.

Le reste de l'état des lieux est tout aussi vérifiable et tout aussi mince. DeepSeek V4.1 Flash est sorti le 10 septembre 2026 en tant que plus petit modèle d'une nouvelle famille d'architectures — un socle mixture-of-experts de 552 milliards de paramètres sur une architecture Causal Encoder-Decoder avec 8B de paramètres actifs en préremplissage et 16B en décodage, une entrée d'image native, un contexte de 1M de tokens, des poids sous licence MIT, et environ 651 000 téléchargements sur Hugging Face à ce jour. Le projet de retirer DeepSeek V4 Pro le 14 septembre a été annoncé puis retiré après que des utilisateurs se sont opposés à ce qu'un modèle de production soit remplacé sous leurs pieds. Et DeepSeek V4.1 Pro n'a pas de fiche modèle, pas de dépôt, pas de poids, pas de prix et pas de point de terminaison — il renvoie une erreur 404 dans l'API de modèle de notre propre catalogue aujourd'hui, tandis que DeepSeek V4.1 Flash et DeepSeek V4 Pro se résolvent tous les deux.

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

Donc, l’inventaire honnête est le suivant : un successeur nommé par le fabricant mais jamais commercialisé, un modèle commercialisé qui constitue un véritable changement de génération, un modèle phare maintenu en vie par la contestation, et une capture d’écran sans étiquette. La capture d’écran est l’élément le moins fiable de cette liste et le seul dont le fil parlera.

Que faire de tout cela aujourd'hui

Rien de ce qui s’est passé ces deux dernières semaines ne change ce qu’un lecteur peut appeler ni ce que cela coûte. Si vous choisissez un modèle DeepSeek maintenant, la décision se joue entre les deux qui existent, et tous deux sont servis via un seul endpoint OrcaRouter au prix catalogue de DeepSeek lui-même, répercuté avec 0 % de marge, de sorte que la structure heures pleines/heures creuses du fournisseur arrive de notre côté sans changement le jour où elle change : DeepSeek V4.1 Flash à 0,30 $ par million de jetons d’entrée et 1,20 $ en sortie aux heures pleines, tombant de moitié à 0,15 $ et 0,60 $ aux heures creuses, contre DeepSeek V4 Pro à 1,32 $ en entrée et 3,96 $ en sortie aux heures pleines. Notre propre télémétrie sur sept jours pour le modèle Flash situe son temps jusqu’au premier jeton p50 à près de 1,9 seconde, à environ 167 jetons de sortie par seconde, avec un taux d’erreur inférieur à 0,05 %, ce qui constitue l’argument pratique pour l’essayer sur une partie du trafic plutôt que de migrer sans preuve.

La question du successeur est une question de routage avant toute autre chose, et c’est la raison honnête de la garder sur un routeur plutôt que dans un contrat. Quand un V4.1 Pro fera son apparition, un modèle non éprouvé d’un laboratoire qui a déjà annulé une migration forcée est précisément l’argument pour lui envoyer une fraction du trafic derrière un basculement automatique : s’il se trompe, la requête atterrit sur le modèle que vous avez ajusté, et s’il a raison, vous l’avez découvert avant vos utilisateurs. Pas de seconde clé, pas de seconde intégration, aucun changement de code à l’arrivée du troisième modèle. Rien sur OrcaRouter n’est DeepSeek V4.1 Pro, parce que DeepSeek V4.1 Pro n’existe pas encore, et ce serait une mauvaise publicité pour une plateforme de routage que de prétendre le contraire.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

Qu’est-ce qui transformerait ceci en une actualité ?

• Une étiquette de modèle. La chose la moins coûteuse qui changerait ce texte : un modèle DeepSeek, une version et une invite reproductible. D'ici là, l'extrait est un échantillon de texte avec une source attribuée et un auteur non attribué.

• Un document DeepSeek qui traite du comportement des successeurs. L’entreprise publie ouvertement — les poids, les licences et tout le reste. Ce qu’elle n’a jamais publié, c’est une section de fiche de modèle sur ce qu’une version plus capable d’elle-même pourrait faire. Une section de sécurité ajoutée à la fiche V4.1 Pro serait un événement plus important que la fiche elle-même.

• Une entrée du changelog de V4.1 Pro. L’entrée la plus récente du changelog de l’API DeepSeek est la version V4.1 Flash du 10 septembre. Une deuxième entrée est l’événement qui transforme le successeur d’un nom en un modèle — et c’est le point où l’extrait ci-dessus cesse d’être de la philosophie pour devenir une fiche technique.

• Si la position en faveur des poids ouverts survit au passage à l'échelle. Des poids sous licence MIT pour un modèle Flash de 552B et un essai public soutenant que l'intelligence de pointe devrait être largement disponible sont tous deux documentés. Savoir si le modèle le plus capable de DeepSeek arrivera de la même manière est la question à laquelle la prochaine version répond, et c'est celle qui intéresse réellement la plupart des lecteurs.

Jusqu’à ce que l’un de ces éléments se concrétise, l’interprétation raisonnable de l’artefact de cette semaine est étroite et peu flatteuse. Un modèle compétent, de provenance non identifiée, a produit une réponse prudente et sans conclusion tranchée à une question difficile sur le pouvoir ; l’intéressant n’est pas qu’il l’ait dit, mais que sa propre documentation publiée ait si peu à dire sur le sujet — et que ce qui ressemble le plus à une vision de sûreté de DeepSeek dans un texte publié soit un essai d’ingénieur sur qui devrait détenir la technologie, et un README vous invitant à exécuter l’agent dans un conteneur jetable.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement