
Qwen3.8-27B Erscheinungsdatum: Alles, was wir bisher wissen
- deepseekNEUDeepSeek: DeepSeek V4 Pro 08132026-08-12$0.44 / $0.88 pro 1 Mio. Tokens · 72 tok/s
- grokNEUSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaNEUMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenNEUQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens · 2304 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenz77Coding
- grokxAI: Grok 4.52026-07-0856Intelligenz72Coding
- tencentTencent: Hy32026-07-0642Intelligenz59Coding
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligenz42Coding
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligenz39Coding
Alibaba hat die offenen Gewichte von Qwen3.8-27B für die Woche ab dem 10. August 2026 versprochen, und dieses Zeitfenster kam und ging. Jetzt hat die Verzögerung ein konkretes Ziel: Die offizielle Qwen-Seite auf ModelScope zeigt einen Countdown bis Mitternacht am 15. August 2026 – 00:00 JST, wie PC Watch am 13. August über den Teaser berichtete. Die Gewichte sind bis heute noch nicht auf der offiziellen Qwen-Organisation bei Hugging Face erschienen, aber die Frage nach dem Erscheinungsdatum hat jetzt zum ersten Mal seit der Ankündigung vom 3. August eine Antwort. Hier ist, was bestätigt ist, was noch unbestätigt ist und worauf man achten sollte.
Was ist bestätigt?
Alibaba kündigte die Qwen3.8-Generation am 3. August 2026 an. An diesem Tag geschahen zwei Dinge: Qwen3.8-Max, das Flaggschiff mit 2,4 Billionen Parametern und Mixture-of-Experts-Architektur, ging mit einer kostenpflichtigen API live, und Alibaba verpflichtete sich, die Gewichte sowohl des Max als auch des kleineren Qwen3.8-27B „innerhalb von etwa einer Woche“ zu öffnen. Mehrere unabhängige Medien (36Kr, TrendForce, C114) berichteten über dieselbe Zusage: Hugging Face und ModelScope, die Woche ab dem 10. August.
Die 27B ist das selbst hostbare Mitglied der Generation — Alibaba positionierte es als für Einzel-GPU- und On-Premise-Betrieb ausgelegt, den direkten Nachfolger des weit verbreiteten Qwen3.6-27B. Diese Abstammung ist von Bedeutung. Qwen3.6-27B wurde zu einem der beliebtesten lokalen Code-Modelle seiner Generation, und die 3.8-Version erbt diesen etablierten Fragenkatalog: Was kostet der Betrieb, ist es besser bei Agenten, wann kann ich es herunterladen.
Was heute unabhängig verifizierbar ist, ist das Flaggschiff – und das umfasst inzwischen auch {{1}}offene Gewichte{{/1}}. Qwen3.8-Max ist live über die API verfügbar, und seine Repositories – Qwen3.8-2.4T-A95B (in vollem BF16) und eine offizielle FP8-Quantisierung – wurden in der Woche vom 10. August in der offiziellen {{KEEP}}Qwen{{/KEEP}}-Organisation auf Hugging Face veröffentlicht – das erste Mal, dass Alibaba ein Flaggschiff der Max-Klasse als Open Source bereitgestellt hat. Es wurde ebenfalls bereits bewertet: Artificial Analysis beziffert seinen Intelligence Index auf 58, {{2}}so nah an die Spitze dieser Tabelle ist bislang noch kein chinesisches Labor gekommen{{/2}}, seinen Coding Index auf 71,8 und seinen Preis auf $2.00 pro Million Input-Tokens und $6.00 pro Million Output-Tokens.

Wie eine „Veröffentlichung“ bei einem Open-Weights-Modell tatsächlich aussieht
Eine Datumsfrage bei einem geschlossenen Modell ist einfach – die API schaltet sich ein. Bei einem Open-Weights-Modell hat „veröffentlicht“ mehrere Ebenen, und jede Ebene erscheint im Abstand von Tagen:
Die Rohgewichte liegen als Hugging Face- und ModelScope-Repository vor, mit einer Modellkarte und einer LICENSE-Datei.
Inference-Frameworks folgen — vLLM und SGLang werden voraussichtlich innerhalb weniger Tage Unterstützung hinzufügen, was das Signal dafür ist, dass ein Modell bereit ist, bereitgestellt zu werden, und nicht nur heruntergeladen zu werden.
• Community-Quantisierungen (GGUF, AWQ) hinken in der Regel ein bis zwei Wochen hinterher, {{1}}was der Zeitpunkt ist, zu dem Ollama-, LM-Studio- und llama.cpp-Nutzer sie tatsächlich herunterladen und ausführen können.{{/1}}
{{1}}Wenn die Frage also lautet: „Wann kann ich die Gewichte herunterladen?“, dann ist die Antwort ein Repository, das in der offiziellen Qwen-Organisation erscheint. Wenn die Frage lautet: „Wann kann ich es mit einem einzigen Befehl ausführen?“, dann addiere ein bis zwei Wochen. Das Versprechen vom 3. August sah Ersteres für die Woche vom 10. August vor — und diese Stufe ist nun für ein Mitglied der Generation erreicht: Qwen3.8-2.4T-A95B wurde in jener Woche auf Hugging Face veröffentlicht. Die 27B selbst ist noch nicht auf Hugging Face erschienen — aber der ModelScope-Countdown nennt nun ein Ziel: 15. August 2026 um 00:00 Uhr JST.{{/1}}
Was ist noch unverifiziert?
Alles andere am 27B ist spekulativ, bis das Repository veröffentlicht wird. Lassen Sie nicht zu, dass selbstsichere Berichterstattung Projektionen in Spezifikationen verwandelt — nichts von dem Folgenden ist zum Zeitpunkt des Schreibens bestätigt:
• Architektur — dicht oder Mixture-of-Experts, und die Anzahl der aktiven Parameter bei MoE.
• Kontextfenster, Ausgabelimits und ob es nur Text oder multimodal ist. Der ModelScope-Teaser beschreibt laut PC Watch native multimodale und mehrsprachige Unterstützung für Bilder und Videos – vom Hersteller im Teaser angegeben, bis zur Veröffentlichung der Gewichte noch unbestätigt.
• Die Lizenz. Apache 2.0 ist keine sichere Annahme; neuere Qwen-Open-Source-Versionen wurden unter der Tongyi-Qianwen-Lizenz veröffentlicht, die eine Klausel über 100 Millionen monatlich aktive Nutzer enthält, die bei Überschreiten dieser Schwelle kommerzielle Gespräche auslöst.
• Alle Benchmark-Ergebnisse. Jede Zahl, die für die 3.8-Generation kursiert, wird vom Hersteller für das Max angegeben; die 27B hat überhaupt keine öffentlichen Evaluierungen.
• Exakte quantisierte Größen. Die im Umlauf befindlichen VRAM-Werte sind Projektionen, die von Qwen3.6-27B übernommen wurden, keine Messungen des 3.8-Modells.

Warum die Lizenz wichtiger ist als das Datum
Das Veröffentlichungsdatum bestimmt, wann Sie mit dem Testen beginnen können. Die Lizenz bestimmt, ob Sie ausliefern dürfen. Ein Qwen-Modell unter der Tongyi-Qianwen-Lizenz ist für unter 100 Millionen monatlich aktive Nutzer kostenlos nutzbar — darüber hinaus wird erwartet, dass Sie kommerzielle Bedingungen besprechen. Für ein lokales Modell, das Teams in Produkte und Agenten integrieren, kann diese Schwelle schneller erreicht werden, als es klingt. Die erste Datei, die im Repository geöffnet wird, ist die LICENSE, vor der Modellkarte und vor der README.
Wie man den Drop erwischt, bevor die Blogbeiträge ihn erwischen.
Die offizielle Qwen-Organisation auf Hugging Face ist die maßgebliche Quelle – wenn dort oder auf ModelScope ein Repository namens Qwen3.8-27B erscheint, ist das Release erfolgt. Der Mechanismus hat sich diese Woche bereits bewährt: Qwen3.8-2.4T-A95B und sein FP8-Gegenstück erschienen genau auf diese Weise in der Organisation, daher wird das 27B-Repository genauso unverkennbar sein. Auf ModelScope ist bereits eine Countdown-Seite für Qwen3.8-27B live, die auf Mitternacht am 15. August zeigt – das bisher Nächste, was es zu einem offiziellen Datum gibt. Drei frühere Signale sind einen Blick wert:
• Ein vLLM- oder SGLang-Pull-Request, der Qwen3.8-27B nennt. Framework-PRs sind häufig die erste öffentliche Spur eines Weight-Drops, da die Integrationsarbeit in dem Moment beginnt, in dem das Repository bereitgestellt wird.
Die eigenen Kanäle des Qwen-Teams (X, WeChat, der qwen.ai-Blog), die in der Regel den Drop selbst ankündigen.
• Community-Quantisierer — Unsloth und andere posten normalerweise innerhalb weniger Tage Quant-Dateien und echte VRAM-Messungen, wodurch die obigen Projektionen in messbare Zahlen umgewandelt werden.
Eine Warnung gilt die ganze Zeit: Bevor die offizielle Organisation veröffentlicht, ist jedes "Qwen3.8-27B", das man herunterladen kann, entweder ein Platzhalter oder ein Upload von Drittanbietern. Der Name allein ist keine Authentizität.
Was Sie heute nutzen können
Das 27B ist das Modell, auf das man warten sollte, aber nicht die einzige Option aus dieser Generation. Qwen3.8-Max ist jetzt live — und ebenfalls selbst hostbar, da seine Gewichte herunterladbar sind — und wird auf OrcaRouter zum Listenpreis des Anbieters abgerechnet: 2,00 $ pro Million Input-Tokens und 6,00 $ pro Million Output-Tokens, ohne Aufschlag. Der Preis auf der eigenen Preisseite des Anbieters ist also der Preis, den Sie zahlen. Ein einziger Schlüssel deckt es ab, und wenn das 27B erscheint und sich in öffentlichen Benchmarks Vertrauen verdient, wird derselbe Schlüssel auch dorthin weitergeleitet. Für ein Team, das heute auf Basis dieser Generation entwickeln und sich die Option eines selbst gehosteten 27B später offenhalten möchte, ist das der am wenigsten einschränkende Weg überhaupt.

Die einfache Zusammenfassung: Die Antwort zum Veröffentlichungstermin ist klarer als noch vor einer Woche. Das Fenster, das Alibaba genannt hatte – die Woche ab dem 10. August 2026 – kam und verging. Es lieferte die Gewichte des Flaggschiffs: Qwen3.8-2.4T-A95B und seine offizielle FP8-Quantisierung sind jetzt auf Hugging Face verfügbar. Die Gewichte der 27B-Version lieferte es nicht – aber die Verzögerung hat jetzt einen Zieltermin: Der ModelScope-Countdown läuft bis Mitternacht am 15. August 2026 (00:00 JST, laut PC Watch). Behalten Sie die offizielle Qwen-Organisation auf Hugging Face und die Qwen-Seite auf ModelScope im Auge, lesen Sie die LIZENZ, sobald das 27B-Repository veröffentlicht wird, und behandeln Sie alle kursierenden Spezifikations- und VRAM-Angaben als Prognose, bis die Gewichte sie messbar machen.
