Un carton-titre pour l'article « Qwen3.8-27B Release Date » montrant un calendrier marquant la semaine du 10 août 2026 comme fenêtre de sortie promise, avec un badge « statut : en attente », un sous-titre mentionnant l'annonce du 3 août 2026, et un graphique empilé de couches de modèle.
Guides & Insights

Qwen3.8-27B Date de sortie : tout ce que nous savons jusqu'à présent

Auteur

Jim Song

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Alibaba a promis les poids ouverts de Qwen3.8-27B pour la semaine du 10 août 2026, et cette fenêtre est passée. Désormais, le retard a une cible concrète : la page officielle de Qwe​n sur ModelScope affiche un compte à rebours jusqu'à minuit le 15 août 2026 — 00:00 JST, selon le rapport du 13 août de PC Watch sur ce teaser. Les poids ne sont toujours pas apparus sur l'organisation officielle Qwe​n sur Hugging Face à ce jour, mais la question de la date de sortie a désormais une réponse pour la première fois depuis l'annonce du 3 août. Voici ce qui est confirmé, ce qui reste non vérifié, et ce qu'il faut surveiller.

Qu'est-ce qui est confirmé

Alibaba a annoncé la génération Qwen3.8 le 3 août 2026. Deux choses se sont produites ce jour-là : Qwen3.8-Max, le fleuron à mélange d'experts de 2,4 billions de paramètres, est entré en service avec une API payante, et Alibaba s'est engagé à ouvrir les poids du Max ainsi que du plus petit Qwen3.8-27B « dans environ une semaine ». Plusieurs médias indépendants (36Kr, TrendForce, C114) ont relayé le même engagement : Hugging Face et ModelScope, la semaine du 10 août.

Le 27B est le membre auto-hébergeable de la génération — Alibaba l'a positionné comme étant conçu pour un travail sur GPU unique et sur site, le successeur direct du très utilisé Qwen3.6-27B. Cette lignée a son importance. Qwen3.6-27B est devenu l'un des modèles de codage locaux les plus populaires de sa génération, et la version 3.8 hérite de cette base installée et de ses questions : combien ça coûte à faire tourner, est-elle meilleure pour les agents, quand peut-on la récupérer.

Ce qui est indépendamment vérifiable aujourd'hui, c'est le modèle phare, et cela inclut désormais les poids ouverts. Qwen3.8-Max est disponible sur API, et ses dépôts — Qwen3.8-2.4T-A95B (BF16 complet) et une quantification FP8 officielle — ont été mis en ligne sur l'organisation officielle Qwe​n sur Hugging Face au cours de la semaine du 10 août, la première fois qu'Alibaba publie un modèle phare de classe Max en open source. Il est d'ailleurs déjà noté : Artificial Analysis situe son indice d'intelligence à 58, la note la plus proche du sommet de ce classement pour un laboratoire chinois, son indice de codage à 71,8, et son prix à 2,00 $ par million de jetons d'entrée et 6,00 $ par million de jetons de sortie.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

À quoi ressemble réellement une « release » pour un modèle open-weights

Une question de date sur un modèle fermé est simple — l'API s'active. Pour un modèle à poids ouverts, « publié » comporte des couches, et chaque couche arrive à quelques jours d'intervalle :

• Les poids bruts apparaissent sous forme de dépôt Hugging Face et ModelScope, avec une fiche de modèle et un fichier LICENSE.

• Les frameworks d'inférence suivent — vLLM et SGLang devraient ajouter la prise en charge d'ici quelques jours, ce qui est le signe qu'un modèle est prêt à être servi plutôt que simplement téléchargé.

Les quantifications communautaires (GGUF, AWQ) accusent généralement un retard d'une à deux semaines, c'est-à-dire le moment où les utilisateurs d'Ollama, de LM Studio et de llama.cpp peuvent effectivement les télécharger et les exécuter.

Donc si la question est « quand puis-je télécharger les poids », la réponse est un dépôt apparaissant sur l'org officielle Qwe​n. Si la question est « quand puis-je l'exécuter avec une seule commande », ajoutez une à deux semaines. La promesse du 3 août visait le premier de ces objectifs pour la semaine du 10 août — et ce volet est désormais en place pour un membre de la génération : Qwen3.8-2.4T-A95B est apparu sur Hugging Face cette semaine-là. Pour ce qui est du 27B spécifiquement, il n'est toujours pas arrivé sur Hugging Face — mais le compte à rebours ModelScope indique désormais une cible : le 15 août 2026 à 00:00 JST.

Qu'est-ce qui reste encore non vérifié ?

Tout le reste concernant le 27B est spéculatif jusqu'à la publication du référentiel. Ne laissez pas une couverture médiatique confiante transformer des projections en spécifications — aucun des éléments suivants n'est confirmé au moment de la rédaction :

• Architecture — dense ou mélange d'experts, et le nombre de paramètres actifs si MoE.

{{1}}Fenêtre de contexte, limites de sortie, et caractère textuel ou multimodal.{{/1}} {{2}}La bande-annonce ModelScope, selon PC Watch, décrit une prise en charge native multimodale et multilingue pour les images et les vidéos —{{/2}} {{3}}annoncé par le fournisseur sur la bande-annonce, mais non vérifié jusqu'à la publication des poids.{{/3}}

• La licence. Apache 2.0 n'est pas une hypothèse sûre ; les récentes versions open source de Qwe​n ont été publiées sous la licence Tongyi Qianwen, qui comporte une clause de 100 millions d'utilisateurs actifs mensuels déclenchant une discussion commerciale au-delà de ce seuil.

• Tout score de benchmark. Chaque chiffre circulant pour la génération 3.8 est rapporté par le fournisseur pour le Max ; le 27B n’a aucune évaluation publique du tout.

• Tailles quantisées exactes. Les chiffres de VRAM en circulation sont des projections reportées du Qwen3.6-27B, et non des mesures du modèle 3.8.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

Pourquoi la licence importe plus que la date

La date de sortie détermine quand vous pouvez commencer à tester. La licence détermine si vous pouvez distribuer le produit. Un modèle Qwen sous licence Tongyi Qianwen est libre d'utilisation en dessous de 100 millions d'utilisateurs actifs mensuels — au-delà, vous êtes tenu de discuter des conditions commerciales. Pour un modèle local que les équipes intégreront dans des produits et des agents, ce seuil peut être atteint plus vite qu'il n'y paraît. Le premier fichier à ouvrir dans le dépôt est le fichier LICENSE, avant la fiche du modèle et avant le README.

Comment saisir le drop avant que les articles de blog ne le fassent

L'organisation officielle Qwe​n sur Hugging Face est la référence absolue — lorsqu'un dépôt nommé Qwen3.8-27B y apparaît, ou sur ModelScope, la sortie a eu lieu. Ce mécanisme a déjà fait ses preuves cette semaine : Qwen3.8-2.4T-A95B et son jumeau FP8 sont apparus sur l'org exactement de cette façon, donc le dépôt 27B sera tout aussi reconnaissable. Sur ModelScope, une page de compte à rebours pour Qwen3.8-27B est déjà en ligne, pointant vers minuit le 15 août — la chose la plus proche d'une date officielle à ce jour. Trois signaux antérieurs méritent d'être surveillés :

• Une pull request vLLM ou SGLang nommant Qwen3.8-27B. Les PR de frameworks sont souvent la première trace publique d'une publication de poids, car le travail d'intégration commence dès que le dépôt est préparé.

• Les propres canaux de l'équipe Qwen (X, WeChat, le blog qwen.ai), qui ont tendance à annoncer la sortie elle-même.

• Quantificateurs de la communauté — Unsloth et d'autres publient généralement des fichiers quant et des mesures réelles de VRAM en quelques jours, ce qui transforme les projections ci-dessus en chiffres mesurables.

Un avertissement s'applique en permanence : avant toute publication par l'organisation officielle, tout « Qwen3.8-27B » que vous pouvez télécharger est soit un espace réservé, soit un téléversement tiers. Le nom seul ne garantit pas l'authenticité.

Ce que vous pouvez utiliser aujourd'hui

Le 27B est le modèle à attendre, mais pas la seule option de cette génération. Qwen3.8-Max est disponible dès maintenant — et auto-hébergeable également, puisque ses poids sont téléchargeables — et sur OrcaRouter, il est facturé au prix catalogue du fournisseur, soit 2,00 $ par million de jetons d'entrée et 6,00 $ par million de jetons de sortie, sans aucune majoration ; le prix affiché sur la page tarifaire du fournisseur est donc celui que vous payez. Une seule clé y donne accès, et lorsque le 27B sortira et gagnera la confiance sur les benchmarks publics, la même clé y acheminera également le trafic. Pour une équipe qui veut construire sur cette génération dès aujourd'hui tout en gardant l'option d'un 27B auto-hébergé plus tard, c'est la voie la moins verrouillée qui soit.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

Le résumé direct : la réponse concernant la date de sortie est plus claire qu'il y a une semaine. La fenêtre qu'Alibaba avait donnée — la semaine du 10 août 2026 — est passée. Elle a livré les poids du modèle phare : Qwen3.8-2.4T-A95B et sa quantification officielle FP8 sont désormais sur Hugging Face. Elle n'a pas livré ceux du 27B — mais le retard a maintenant une cible : le compte à rebours ModelScope court jusqu'à minuit le 15 août 2026 (00:00 JST, selon PC Watch). Surveillez l'organisation officielle Qwe​n sur Hugging Face et la page Qwe​n sur ModelScope, lisez la LICENSE dès que le dépôt du 27B arrive, et considérez chaque spécification et chaque chiffre de VRAM en circulation comme une projection jusqu'à ce que les poids les rendent mesurables.

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

Contactez-nous

Rejoignez notre communauté

DiscordEmailXGitHubYouTube