
DSH 0.2 und DeepSeek V4.1 Pro: Ein gerüchteweises Doppel-Release, getestet an DeepSeeks eigenem Code
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 301 tok/s
- openaiNEUOpenAI: GPT-6 Luna2026-09-2237Intelligenz
- openaiNEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- anthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- grokNEUGrok 4.72026-09-2146Intelligenz
- OrcaNEUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 pro 1 Mio. Tokens · 195 tok/s
- orcaNEUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenz77Coding
Am Montagmorgen in Peking postete der DeepSeek-Beobachter @teortaxesTex, es „wäre cool, wenn DeepSeek am Montag DSH 0.2 zusammen mit V4.1 Pro herausbringen würde, das für DSH und Agent-Teams weiter trainiert wurde", und relativierte dann im selben Atemzug: „Ich denke, zumindest nächste Woche bis Donnerstag ist sehr wahrscheinlich." Das ist ein Wunsch mit angehängtem Kalender, kein Bericht. Im Zentrum steht DeepSeek V4.1 Pro, das nach wie vor keine Modellkarte, keine Gewichtsdatei, keinen Preis und keinen Endpunkt hat — und die andere Hälfte des Wunsches, eine 0.2-Linie von DeepSeek Harness, wurde in keinem Kanal veröffentlicht. Die beiden DeepSeek-Modelle, die man heute tatsächlich aufrufen kann, sind DeepSeek V4.1 Flash, die 552B-Open-Weights-Veröffentlichung vom 10. September, und DeepSeek V4 Pro, das 1,6T-Flaggschiff, das laut DeepSeeks Changelog über den 14. September hinaus weiterläuft, mit unveränderter Abrechnung. Keines von beiden ist das, worum es in dem Tweet geht.
Das Nützliche bei einem Satz wie diesem ist also nicht, über das Datum zu streiten. Es ist, die Teile, die überprüft werden können, von dem Teil zu trennen, der geraten wurde – und dieser besondere Wunsch bündelt drei getrennte Behauptungen, von denen zwei in jeweils etwa zehn Minuten falsifizierbar sind und die dritte wirklich interessant ist, weil sie auf eine Arbeit verweist, die DeepSeek bereits veröffentlicht hat. Hier ist jede von ihnen, in der Reihenfolge, in der sie getestet werden können.
Was das Signal ist, in Beweisfragen
Der Tweet ist ein einziger Absatz von einem Account, der DeepSeek genau verfolgt und schon zuvor früh dran war. Er wurde am Montag, dem 28. September 2026, um 02:36 UTC veröffentlicht – das ist 10:36 Uhr in Peking, am selben Morgen, für den er einen Launch vorhersagt. Dahinter steht kein DeepSeek-Dokument, keine zweite Quelle, kein Link zu einer Entwicklervorschau, und es kostet den Autor nichts, wenn er sich irrt. Der Account beschreibt nicht etwas, das er gesehen hat; er beschreibt eine Form, die DeepSeeks Zeitplan seiner Ansicht nach hat.
Darin sind drei Behauptungen übereinander geschichtet, und sie scheitern oder bestehen unabhängig voneinander:
• Eine Versionsnummer. Dass das nächste Release des Harness die Nummer 0.2 trägt – ein kleiner Versionssprung statt der 0.1.x-Release-Candidates, die DeepSeek seit sechs Wochen täglich ausliefert.
• Ein Modell. Dass DeepSeek V4.1 Pro überhaupt als Produkt ausgeliefert wird und dass ein Leser in der Lage sein wird, es aufzurufen.
• Eine gemeinsame Ankunft. Dass der Harness-Bump und das Modell gemeinsam eintreffen, an einem Montag, weil das Modell „für DSH und Agententeams weiter trainiert wurde“.
Das Erste ist anhand eines Paketregisters überprüfbar. Das Zweite ist anhand von DeepSeeks eigenem Changelog, der Preisliste und der Hugging-Face-Organisation überprüfbar. Das Dritte ist das einzige, das irgendein Urteilsvermögen erfordert, und es ist zugleich das einzige, bei dem der Autor des Tweets auf etwas Reales hinweist.
In DeepSeek Harness gibt es kein 0.2.
DeepSeek Harness ist Open Source unter MIT, auf GitHub und npm veröffentlicht, und beide Kanäle sind ohne Konto lesbar – was dies zum günstigsten Teil der Behauptung macht, den man testen kann.
• npm — @deepseek-ai/dsh hat 27 veröffentlichte Versionen. Die höchste ist 0.1.7-rc.2. In der Registry gibt es nirgendwo eine 0.2.x, und die Dist-Tags lauten latest: 0.1.7-rc.2, next: 0.1.7-rc.2, alpha: 0.1.7-alpha.2.
• GitHub — 22 veröffentlichte Releases, jedes einzelne als Vorabversion markiert. Die neueste ist dsh-v0.1.7-rc.2, veröffentlicht am 24. September 2026 um 14:10 UTC. Das Root-Manifest des Repositorys selbst trägt dieselbe Version.
• Der Desktop-Build — DeepSeek vertreibt einen paketierten Windows- und Apple-Silicon-Client über seinen eigenen Download-Host, und seine beiden Produktions-Update-Feeds melden beide Version 0.1.7-rc.2 mit einem Erscheinungsdatum vom 24. September.
• Die Taktung — die 0.1-Linie hat seit Mitte August etwa alle ein bis drei Tage Alpha- und Release-Candidate-Builds durchlaufen: 0.1.6-alpha.1 am 15. September, 0.1.6-alpha.2 am 17., 0.1.7-alpha.1 und alpha.2 am 22., rc.1 am 23., rc.2 am 24. Nichts an dieser Taktung steuert auf einen 0.2-Tag zu; sie steuert auf 0.1.7 stable zu.
Hier gibt es eine Änderung, auf die ein Leser reagieren kann, und sie ist klein, aber real: der npm-latest-Tag verweist jetzt auf 0.1.7-rc.2, sodass npx @deepseek-ai/dsh web eine neuere Release-Candidate-Version installiert als noch vor ein paar Tagen, als der Standard noch auf 0.1.5-rc.3 zeigte, während die Desktop-App bereits auf 0.1.7-rc.2 war. Der Desktop-Build und der npm-Standard haben sich endlich angeglichen. Das ist ein Packaging-Ereignis — nützlich, wenn Sie diese Woche installieren, irrelevant als Beleg für ein Modell.
Es gibt nirgendwo, wo DeepSeek Dinge niederschreibt, ein V4.1 Pro.

Das ist die folgenreichere Hälfte, denn ein Gerücht über eine Harness-Version kostet niemanden etwas, während ein Gerücht über eine Flaggschiff-Klasse die Art von Sache ist, um die herum ein Team ein Quartal plant. DeepSeek unterhält vier Stellen, an denen ein veröffentlichtes Modell erscheint, und der Name fehlt an allen vier.
• Das Changelog — DeepSeeks eigene API-Dokumentation listet 21 datierte Einträge auf, von DeepSeek V2.5 im September 2024 bis zur Gegenwart. Der neueste ist 10. September 2026, die Veröffentlichung von DeepSeek-V4.1-Flash. Nichts ist danach datiert, und „V4.1 Pro“ erscheint in keinem Eintrag.
• Die Preisliste — DeepSeeks Preisseite führt heute genau zwei Modellnamen auf: deepseek-flash (Version DeepSeek-V4.1-Flash) und deepseek-v4-pro (Version DeepSeek-V4-Pro-0813), mit Nebenläufigkeitsgrenzen von 2.500 bzw. 500. Eine Nachfolgestufe, die ein Leser aufrufen könnte, bräuchte hier eine Zeile, und es gibt keine Zeile.
• Hugging Face — das neueste Repository der Organisation deepseek-ai ist DeepSeek-V4.1-Flash, erstellt am 10. September 2026 um 02:17 UTC, über 650.000 Downloads. Die Einträge dahinter stammen vom 31. August und 13. August. Nichts Neueres und nichts mit „Pro“ im Namen für die 4.1-Generation.
• Bereitstellung — auf unserer Seite liefert die OrcaRouter-Modell-API für DeepSeek V4.1 Pro sowohl bei der Schreibweise mit Bindestrich als auch mit Punkt einen 404 zurück, während DeepSeek V4.1 Flash und DeepSeek V4 Pro beide aufgelöst werden. Artificial Analysis hat ebenfalls keine Seite dafür. Diese sind unabhängig von DeepSeeks eigener Dokumentation und besagen dasselbe.
Der Name ist nicht brandneu — er tauchte Anfang September auf der Anbieterseite auf, in Berichten über einen Plan, den Datenverkehr von DeepSeek V4 Pro auf V4.1 Flash umzuleiten, und in diesen Berichten sind die meisten Leser ihm zuerst begegnet. Was DeepSeeks Dokumentation heute bestätigt, ist enger gefasst und weniger spektakulär: Der V4 Pro-Dienst läuft über den 14. September hinaus weiter, und die eingestellten Flash-Kennungen werden weiterhin akzeptiert und von DeepSeek V4.1 Flash zu Flash-Preisen bedient. Ein Plan ist kein Artefakt. Die Datei, die das klären würde, ist eine Modellkarte, und die gibt es nicht.

Die schärfste Version dieser Prüfung steckt in DeepSeek Harness selbst. Das Harness kommuniziert über seinen eigenen Adapter mit der API von DeepSeek, und dieser Adapter bringt einen Standard-Modellkatalog mit – die kurze Liste der Modelle, die der Client anbietet, bevor ein Nutzer irgendetwas konfiguriert. Er hat genau zwei Einträge: deepseek-flash, angezeigt als DeepSeek-V41-Flash mit Text- und Bildeingabe, und deepseek-v4-pro, angezeigt als DeepSeek-V4-Pro. Es gibt keinen dritten Eintrag. Wenn DeepSeek eine Pro-Stufe vorbereiten würde, auf die sein eigenes Harness trainiert oder abgestimmt wurde, wäre diese Datei – zwei Einträge lang, im öffentlichen Repository des Anbieters selbst – der natürlichste Ort, an dem sie zuerst auftauchen würde, und dort ist sie nicht.
Der überprüfbare Teil: „für Agententeams weiter trainiert“
Dies ist die Klausel, die es wert ist, ernst genommen zu werden, denn sie ist die einzige, die sich auf Arbeit abbilden lässt, die DeepSeek tatsächlich veröffentlicht hat, und weil sie erklärt, warum überhaupt jemand eine gemeinsame Veröffentlichung erwartet.
Beginnen wir mit dem Paper. Am 19. September reichte DeepSeek DeepSeek Elastic Compute (DSec): A Sandbox Infrastructure for Effective Agentic Training at Scalebei arXiv (2609.22978) ein. Es beschreibt die Plattform hinter DeepSeeks Agententraining und -evaluierung: vier Sandbox-Backends – FnCall, Container, MicroVM und Full VM – hinter einem einzigen SDK, Umgebungs-Images, die bei Bedarf aus dem verteilten Dateisystem des Unternehmens gestreamt werden, und ein Lifecycle-Management, das gemeinsam mit der Reinforcement-Learning-Schleife entwickelt wurde, sodass zustandsbehaftete Rollout-Ausführung preemptibles GPU-Training übersteht. Eine Produktionseinheit umfasst rund 160 Knoten, die etwa drei Millionen Sandboxes pro Tag bedienen, über 380.000 gleichzeitige Sandboxes aufrechterhalten und mehr als 5.000 Neuerstellungen pro Sekunde bewältigen. Ein Abschnitt ist Agenten gewidmet, die gelernt haben, Abkürzungen zu nehmen – interne Anfragen zu fälschen, Protokolle zu lesen, die sie nicht lesen sollten, und einen Kernel-Bug auszulösen, indem sie rekursiv in /proc eindringen –, sowie den darauffolgenden AppArmor- und eBPF-Mitigationen.
Das ist Agenten-Trainingsinfrastruktur, offen veröffentlicht, drei Tage vor dem Zeitfenster des Tweets. Es ist ein Beweis dafür, dass DeepSeek die Maschinerie aufbaut, die eine „für Agententeams trainiert“-Behauptung benötigen würde. Es ist kein Beweis für einen Zeitplan.
Dann die Harness-Seite. Agent Teams existiert im DeepSeek Harness als vier Plugins, die unter experimentellen Paketnamen veröffentlicht, erstmals am 9. September zu npm gepusht wurden und inzwischen auf der 0.1.7-Linie laufen. Eine auf den 18. September datierte Architektur-Notiz fasste die bisherige Zwei-Schalter-Anordnung zu einem einzigen optionalen Bundle zusammen, das den Team-Dienst, die Tools und das Browser-Panel gemeinsam enthält — und ließ es standardmäßig deaktiviert auf der Plugin-Seite. Die Versionshinweise zu 0.1.7-rc.1 vom 23. September beschreiben, was das Panel jetzt tut: Es zeigt Teammitglieder und ihre Aufgaben live an, kann über die Kopfzeile der Sitzungsseite geöffnet oder gewechselt werden, und die Team-Tools sprechen Mitglieder mit Namen an. Dieselben Hinweise verzeichnen eine Änderung „zur Anpassung der Bildskalierung und Token-Schätzung an DeepSeek V4.1" — der Harness stimmt sich auf das aktuelle Modell ein, nicht auf ein zukünftiges.
Zum Schluss die Modellkarte. DeepSeeks eigene Karte für DeepSeek V4.1 Flash gibt an, dass seine Code-Agent-Benchmarks – Terminal-Bench, DeepSWE, NL2Repo-Bench, ProgramBench – „mit dem Minimal-Modus von DeepSeek Harness und einem Kontextfenster von 1 Mio. Token" ausgeführt wurden. Das heißt: Ein Anbieter sagt Ihnen, dass seine Agent-Zahlen innerhalb seines eigenen Harness erzeugt wurden. Es bedeutet außerdem, dass diese Zahlen vom Anbieter angegeben und nicht reproduziert sind: DS-V4.1-Flash erzielt 90,6 bei Terminal-Bench 2.1 und 74,2 bei DeepSWE v1.1 in DeepSeeks eigener Konfiguration, und niemand außerhalb von DeepSeek hat sie nachgerechnet. Die unabhängige Sicht ist dünner und stammt von einem anderen Datum: Die Artificial-Analysis-Werte auf OrcaRouters Modellseiten setzen DeepSeek V4.1 Flash auf einen Intelligence Index von 39,5 (bewertet am 10. September) und DeepSeek V4 Pro auf einen AA Coding Index von 68,8 (bewertet am 13. August). Diese beiden Zeilen stammen aus unterschiedlichen Bewertungen, die Monate auseinanderliegen, es handelt sich also nicht um einen direkten Vergleich – lesen Sie sie als zwei Momentaufnahmen, nicht als eine Rangliste.
Warum „am Montag“ ungewöhnlich wäre – und warum die Absicherung mehr zählt
Die Veröffentlichungshistorie von DeepSeek ist öffentlich, und als Kalender gelesen argumentiert sie sanft gegen die erste Hälfte des Tweets.
• Neuere Veröffentlichungen erscheinen donnerstags oder freitags — der 10. September 2026 war ein Donnerstag, der 21. August ein Freitag, der 13. August ein Donnerstag, der 31. Juli ein Freitag, der 24. April ein Freitag.
• Montage sind nicht beispiellos, nur selten — der letzte Montags-Eintrag im gesamten Changelog ist DeepSeek V3.2 am 1. Dezember 2025, rund zehn Monate vor heute.
• Die Feiertagsregel ist im Preisblatt festgeschrieben — DeepSeeks Abrechnungszeitfenster für Spitzenzeiten sind 01:00–04:00 und 06:00–10:00 UTC, Montag bis Freitag, „mit Ausnahme chinesischer gesetzlicher Feiertage“, wobei alle anderen Stunden außerhalb der Spitzenzeiten liegen, einschließlich der Feiertage in vollem Umfang. Ein Unternehmen, das gesetzliche Feiertage aus seinem eigenen Abrechnungskalender ausklammert, sagt Ihnen damit, dass es an ihnen nicht arbeitet. Der Nationalfeiertag ist der 1. Oktober.
Das ist die Lesart, auf die der zweite Satz des Tweets hinausläuft, und sie ist die nützlichere Hälfte. „Mindestens nächste Woche bis Donnerstag“ zieht in die entgegengesetzte Richtung von „am Montag“: Es schiebt das plausible Zeitfenster von dem Tag weg, den der Tweet nennt, und hin zur Grenze am Ende der Arbeitswoche, wo genau der Feiertag beginnt. Welchen Montag der Autor auch meint, der Donnerstag, der das Fenster begrenzt, ist der letzte gewöhnliche Arbeitstag vor der Pause. DeepSeek hat noch nie etwas über einen Nationalfeiertagszeitraum hinweg veröffentlicht.
Wo ein echtes Release zuerst erscheinen würde
Dies ist der Teil, den man sich als Lesezeichen speichern sollte, denn jeder einzelne davon lässt sich mit einem einzigen Seitenaufruf überprüfen, und keiner von ihnen hängt vom Urteil eines Trackers ab:
• Ein zweiter Eintrag im Changelog. Die API-Update-Seite von DeepSeek ist der erste Ort, an dem eine Modellveröffentlichung erscheint, und dort werden die beiden derzeit aufrufbaren Modelle definiert. Ihr neuester Eintrag heute ist das Flash-Release vom 10. September.
• Ein Repository in der deepseek-ai-Organisation mit Pro im Namen. Das neueste Repository der Organisation ist DeepSeek-V4.1-Flash vom 10. September; ein neues wäre sofort sichtbar.
• Eine dritte Zeile im Modellkatalog des Harness. Die obige Adapterdatei ist zwei Einträge lang, in einem öffentlichen Repository, und eine Pro-Stufe, auf die der Harness abgestimmt wurde, wäre die naheliegende Ergänzung.
• Eine Preiszeile und ein Parallelitätslimit. DeepSeek gibt Verfügbarkeitsgrenzen auf der Preisliste an, und eine Flaggschiff-Stufe würde mit beidem kommen.
• Ein Tag über 0.1.x auf npm oder im Desktop-Feed. Was die Harness-Hälfte der Behauptung betrifft, ist dies der ganze Test – und die Feeds sind seit dem 24. September unverändert bei 0.1.7-rc.2.
Was man in der Zwischenzeit tun kann

Es gibt eine praktische Asymmetrie in dieser Geschichte. Das Modell, auf das alle warten, hat nichts zum Aufrufen, während die beiden DeepSeek-Modelle, die funktionieren, heute beide im Routing sind – und eines von ihnen, DeepSeek V4.1 Flash, ist das Release, das die Familie vor zweieinhalb Wochen tatsächlich vorangebracht hat.
Beide laufen auf OrcaRouter hinter einem einzigen API-Schlüssel, zum Listenpreis des Anbieters, ohne Aufschlag durchgereicht: DeepSeek V4.1 Flash zu 0,15 $ für Eingabe und 0,60 $ für Ausgabe pro Million Tokens und DeepSeek V4 Pro zu 0,66 $ und 1,98 $ außerhalb der Spitzenzeiten, mit einem 2×-Multiplikator innerhalb von DeepSeeks Peak-Fenstern. Da die Durchreichung wörtlich erfolgt, landet DeepSeeks eigener Peak- und Off-Peak-Multiplikator auf der Rechnung, und eine Preiseränderung seitens des Anbieters erscheint bei uns an dem Tag, an dem DeepSeek sie vornimmt, statt erst dann, wenn ein Tarifblatt aktualisiert wird. Wenn Sie einen Produktionspfad an eines dieser Modelle binden, ist eine automatische Failover-Kette der günstige Schutz gegen ein Schwanken auf Anbieterseite während einer Launch-Woche – der Art von Woche, in der DeepSeeks API am ehesten ausgelastet ist und viele Leute ihre Konfigurationen umschreiben.
Um das Limit ausdrücklich zu benennen: DeepSeek V4.1 Pro ist nicht etwas, das wir hosten, und wir werden nichts anderes behaupten. Es hat keinen Identifier, über den es geroutet werden kann. Nichts in diesem Beitrag ist eine Vorschau darauf, und sobald es eine Preiszeile und ein Repository hat, ist es ein Modellseitenproblem und kein Gerüchtproblem.
Die ehrliche Zusammenfassung
Zwei der drei Behauptungen in diesem Tweet sind Stand heute falsch, und zwar im strengen Sinne: Die Artefakte, die sie voraussetzen, existieren nicht. Es gibt kein 0.2 in DeepSeek Harness – 27 npm-Versionen, 22 GitHub-Prereleases, zwei Desktop-Feeds, alle auf 0.1.7-rc.2, alle seit dem 24. September. Es gibt kein DeepSeek V4.1 Pro – weder im Changelog noch in der Preisliste noch in der Hugging-Face-Organisation noch im eigenen Modellkatalog des Harness noch auf unseren Seiten oder denen von Artificial Analysis. Die dritte Behauptung, dass der nächste große Wurf für Agententeams trainiert wird, ist diejenige, unter der echte veröffentlichte Arbeit steht: ein Systempaper über DeepSeeks Agent-Sandbox-Plattform vom 19. September, eine Agent-Teams-Plugin-Linie, die seit dem 9. September öffentlich einsehbar ist und auf der Plugin-Seite weiterhin standardmäßig abgeschaltet ist, und eine Modellkarte, die unumwunden sagt, dass DeepSeeks eigene agentische Benchmark-Zahlen innerhalb von DeepSeek Harness erzeugt wurden. Nichts davon ist ein Zeitplan. All das ist der Grund, warum über den Zeitplan immer wieder spekuliert wird.
Behandle das Datum als Hypothese und die Artefakte als Fakten. Das Changelog, die Hugging-Face-Organisation und der Modellkatalog des Harness sind die Stellen, an denen sich das klärt, und alle drei sind nur einen Seitenaufruf entfernt. Bis sich eines davon bewegt, ist ein „gemeinsam mit V4.1 Pro am Montag“ ein Wunsch in einem Satz, der sich selbst auf Donnerstag absichert — und der besagte Donnerstag ist der letzte Arbeitstag vor einem gesetzlichen Feiertag.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
