Carte de titre de la date de sortie de Wan 3.0 : sous-titre « Bêta publique en direct le 6 août · clips de 30 secondes · document-vers-vidéo », avec des puces de statistiques indiquant « exécution unique de 30 s », « 0.3-1.2 yuan/sec », « poids non confirmés ».
Guides & Insights

Wan 3.0 Date de sortie : Lancement confirmé le 24 août — Désormais sur ComfyUI et les API tierces

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le 24 août 2026, Alibaba Cloud a confirmé le lancement officiel de Wan 3.0 — la troisième génération de la famille de modèles vidéo Tongyi Wanxiang et le successeur de Wan 2.7 — 18 jours après son lancement en bêta publique le 6 août. Ce lancement transforme l’API de la bêta, facturée à l’usage et soumise à une demande d’accès, en une API entièrement ouverte, et apporte Wan 3.0 aux outils créatifs tiers : l’outil vidéo IA d’Envato a commencé à proposer le modèle qui alimente son moteur ModelMatch la même semaine, Leonardo.Ai a désormais ajouté Wan 3.0 à son générateur vidéo, et le modèle est désormais disponible nativement dans ComfyUI, où une seule génération peut produire jusqu’à 30 secondes. L’éditeur vidéo grand public PowerDirector (CyberLink) a également ajouté Wan 3.0, une annonce faite le 28 août sur les comptes X officiels d’Alibaba et reprise par le compte japonais de PowerDirector. Le compte X officiel d’Alibaba a également confirmé qu’une plateforme API tierce de génération vidéo propose désormais Wan 3.0 — vidéo et audio dans un seul modèle, jusqu’à 30 secondes, avec des références multimodales — au tarif fixe de 0,20 $ par seconde. C’est le signe le plus clair à ce jour que le modèle est entièrement disponible. La campagne de lancement d’Alibaba elle-même illustre ce point de la manière la plus directe qui soit : le fournisseur affirme que la publicité de lancement de Wan 3.0 a été réalisée avec le modèle, et le compte officiel Wan sur X a publié une analyse complète du travail — le concept, les fiches de personnages, les prompts, et même les générations ratées. Le compte a depuis mis en lumière des créateurs extérieurs — un entretien avec Liz Zhang de Pixmax_ai couvre le film conceptuel du lancement et la construction d’un flux de travail créatif complet autour du modèle. Le 3 septembre est arrivé le premier verdict indépendant sur le modèle lui-même : Artificial Analysis, qui classe les modèles vidéo sur la base de votes en tête-à-tête en aveugle plutôt que sur les affirmations des fournisseurs, a placé Wan 3.0 en tête de son classement du montage vidéo (avec audio) et à une deuxième place très serrée dans la catégorie texte-vers-vidéo avec audio. Le lancement n’inclut toujours pas de poids ouverts. La rumeur d’une version Apache-2.0 « 1.3B + 14B » qui circule autour de Wan 3.0 ne figure dans aucune annonce d’Alibaba, correspond presque exactement aux spécifications d’un modèle de 2025, et va à l’encontre de la manière dont Alibaba a réellement commercialisé ses modèles vidéo au cours de l’année écoulée. Voici ce que le lancement du 24 août a changé, ce qui a été confirmé le 6 août, et les parties de l’histoire de Wan 3.0 que vous devez encore considérer comme non vérifiées.

En préambule, une note sur les sources, car cette histoire comporte deux niveaux. Tout ce qui figure dans les sections consacrées aux capacités et aux tarifs est rapporté par Alibaba : cela provient de l’annonce officielle de la bêta publique et du blog en anglais d’Alibaba, et a été recoupé avec les articles de la presse chinoise. Le lancement officiel du 24 août a été annoncé par le fournisseur, et plusieurs médias l’ont relayé le jour même. Les intégrations Envato, Leonardo.Ai, ComfyUI, Pixmax et PowerDirector — ainsi que la plateforme tierce d’API de génération vidéo qui a commencé à proposer le modèle au cours de la semaine du lancement — ont été annoncées par Alibaba sur X et confirmées par les plateformes elles-mêmes : Envato sur son propre blog, Leonardo.Ai dans son annonce, ComfyUI sur son blog officiel, Pixmax sur sa propre page, PowerDirector sur le compte de CyberLink, et la plateforme d’API sur sa propre page dédiée au modèle, laquelle décrit un tarif unique de 0,20 $ par seconde, l’audio activé par défaut et des références omni-modales. Ce sont des déclarations du fournisseur et de ses partenaires, non des tests indépendants, et elles sont présentées comme telles. Le décryptage de la publicité de lancement, décrit ci-dessous, relève de la même catégorie : il s’agit du propre récit qu’Alibaba fait de sa propre production, publié sur X par le compte officiel Wan, et non d’un test indépendant.La vitrine des créateurs décrite ci-dessous porte la même étiquette : l’interview de Liz Zhang (Pixmax_ai) par le compte officiel est une sélection par Alibaba du récit qu’un partenaire fait de son propre travail, publiée sur X, et non un test indépendant.L’exception, en date du 3 septembre, est Artificial Analysis : ses classements constituent une mesure indépendante, et non une affirmation du fournisseur, et ils classent Wan 3.0 n° 1 en édition vidéo (avec audio) et n° 2 de justesse en génération texte-vers-vidéo avec audio — le premier score non-Alibaba pour ce modèle, dont il sera question plus bas. Il n’existe toujours pas de fiche de modèle, pas de nombre de paramètres, et aucun poids largement disponible pour faire tourner le modèle. L’affirmation relative aux poids ouverts, en particulier, n’est pas confirmée par le fournisseur ; c’est une rumeur communautaire que le lancement officiel contredit, et elle est présentée comme telle partout où elle apparaît.

Ce que Wan 3.0 propose réellement

Wan 3.0 est un modèle de génération texte, image, vidéo et audio vers vidéo. La fonctionnalité phare, reprise par tous les médias qui ont couvert la bêta, est la génération en une seule exécution de clips allant jusqu'à 30 secondes — soit le double du plafond de 15 secondes de Wan 2.7, et le segment natif unique le plus long parmi les modèles vidéo chinois. C'est ce que les testeurs décrivent comme « passer de la génération d'un plan à la narration d'une histoire complète » : 30 secondes suffisent pour un mouvement de caméra continu ou une scène en plan-séquence, ce que des clips plus courts ne peuvent pas faire.

Durée maximale — jusqu'à 30 secondes en une seule génération, soit le double des 15 secondes de Wan 2.7, avec une fonction de « durée intelligente » qui suggère une durée à partir du prompt et un outil d'extension vidéo pour enchaîner des récits plus longs.

Entrées — texte, image, vidéo et audio, plus, pour la première fois dans la famille, les documents : doc, xls, ppt, pdf, md, txt, key, pages et numbers, et les liens web. Un fichier unique de 100 Mo / 50 pages maximum peut être transformé directement en vidéo — la fonctionnalité « document-to-video » à l'origine de la plupart de l'intérêt marketing et éducatif.

Multi-reference — jusqu'à 10 images, 5 vidéos et 5 références audio par génération, pour la cohérence des personnages, des accessoires, de l'audio, de la disposition spatiale et du style entre les plans.

Édition — modification des visuels, de l'intrigue et du dialogue basée sur des instructions après génération, plutôt qu'une régénération complète.

Faiblesses déclarées — Alibaba reconnaît que la qualité audio et la précision du texte à l'écran doivent encore être améliorées ; cela provient de l'annonce du fournisseur lui-même, et non d'un verdict de critique.

Il convient de faire la distinction : des « clips de 30 secondes » et une « sortie 4K native » ont tous deux été évoqués pour Wan 3.0, mais l'annonce officielle de la version bêta ne s'engage que sur une génération de 30 secondes en 480p, 720p et 1080p. La 4K native apparaît sur des pages marketing tierces pour le modèle, pas dans l'annonce d'Alibaba. Considérez la 4K comme non confirmée.

A single-model scoreboard for Wan 3.0 showing max length 30s (2x Wan 2.7), resolutions 480p/720p/1080p, document input yes (doc/xls/ppt/pdf/md), price 0.3/0.6/1.2 yuan per second, open weights unverified, and no independent scores, with footer 'Vendor-reported; open-weights claim unverified; no independent scores yet.'

Tarification : une API facturée à l'usage, et le modèle qu'elle brise

Wan 3.0 est facturé à la seconde de vidéo générée. Les tarifs API annoncés par Alibaba sont de 0,3 yuan (environ 0,05 $) par seconde en 480p, 0,6 yuan (environ 0,10 $) par seconde en 720p, et 1,2 yuan (environ 0,20 $) par seconde en 1080p. Un clip complet de 30 secondes coûte donc environ 9 yuans (1,50 $) en 480p, 18 yuans (3,00 $) en 720p, ou 36 yuans (6,00 $) en 1080p. Le lancement du 24 août a confirmé la même structure à la seconde et a ajouté une remise temporaire de 30 % sur les plateformes d'IA Bailian et Qianwen d'Alibaba Cloud jusqu'au 23 septembre — un clip de 30 secondes en 1080p tombe à environ 25 yuans pendant la promotion, selon Alibaba. La presse chinoise a noté que le tarif 720p se situe autour de 60 % du prix à la seconde des concurrents dominants — le message tarifaire qu'Alibaba vise clairement à destination des petites et moyennes équipes.

Le modèle de tarification résume tout, car il constitue une rupture délibérée avec l'histoire de la famille. Wan 2.1 et 2.2 ont été publiés avec des poids entièrement ouverts sous Apache 2.0. Wan 2.5 a été annoncé comme ouvert, mais n'a jamais publié ses poids. Wan 2.6 était une API fermée. Wan 2.7 n'était que partiellement ouvert. Wan 3.0 poursuit cette lignée plutôt que celle de Wan 2.1 : il s'agit d'une API fermée et mesurée — la barrière d'inscription à la bêta a été levée lors du lancement du 24 août — et le lancement officiel ne dit rien sur la publication des poids. Quiconque se demande « devrais-je attendre des poids ouverts » attend quelque chose qu'Alibaba n'a pas promis et que la tendance récente contredit.

C'est également là que l'économie du routage compte. Lorsqu'un modèle vidéo est facturé de manière aussi granulaire — par seconde, par résolution — la différence entre les fournisseurs ne réside généralement pas dans le modèle mais dans la facturation. Sur OrcaRouter, les 200+ modèles que nous routons sont facturés au prix catalogue du fournisseur, transmis avec une marge de 0 %, de sorte qu'une baisse de prix d'un fournisseur est répercutée chez nous le jour même, plutôt qu'après un cycle contractuel. Wan 3.0 n'est aujourd'hui sur aucune plateforme générale de routage de modèles — il est accessible via les consoles d'Alibaba, via des outils créatifs tiers tels que Envato, Leonardo.Ai, ComfyUI, Pixmax et PowerDirector, et via la plateforme API de génération vidéo qui a commencé à le servir dès la semaine de lancement — mais ce qu'il faut vérifier, maintenant que l'API est entièrement ouverte, c'est si le tarif par seconde qui vous est proposé est bien le tarif du fournisseur lui-même. Nos pages de modèles affichent le prix catalogue, c'est ainsi que la comparaison doit être faite.

Screenshot of Alibaba Cloud Community's official announcement 'Alibaba Unveils Wan3.0 with Twice as Long Video Outputs from a Richer Variety of Inputs', dated August 7 2026, describing the Wan 3 public beta, 30-second video length and applying for model testing on Alibaba Cloud Model Studio.

Où vous pouvez réellement l'essayer

L'API est entièrement ouverte depuis le lancement du 24 août ; pendant la version bêta, elle était accessible sur demande. Alibaba énumère ces points d'accès dans l'annonce :

Model Studio (Bailian) — la plateforme d'IA d'Alibaba Cloud, où vous demandez à tester les modèles.

Qwen Cloud — le cloud natif IA d'Alibaba, qui affiche actuellement des limites de deux jobs simultanés, 30 requêtes par minute et 50 tâches dans la file d'attente asynchrone.

site officiel de Wanxiang et le client PC Qwen Creation — les surfaces destinées aux consommateurs.

WonderClip (Wanjing Yike), IF STUDIO et Duiyou — les outils de contenu d'Alibaba, répertoriés aux côtés des plateformes principales.

Qwen app — un déploiement progressif (gris) plutôt qu’une version complète.

• L'outil vidéo IA d'Envato — une surface créative tierce qui a ajouté Wan 3.0 la semaine du lancement, sélectionné en coulisses par ModelMatch d'Envato plutôt que choisi à chaque génération. Disponible pour les utilisateurs d'Envato ; annoncé par Alibaba et confirmé par le blog d'Envato lui-même.

Leonardo.Ai — une plateforme créative tierce qui a ajouté Wan 3.0 à son générateur de vidéos, annoncée par Alibaba sur X et confirmée par Leonardo.Ai dans sa propre annonce. Disponible pour les utilisateurs de Leonardo comme une autre voie d'accès non-Alibaba.

• ComfyUI — la plateforme de workflow basée sur des nœuds, qui a ajouté Wan 3.0 nativement avec sa mise à jour v0.33.4 et sur Comfy Cloud. Une seule génération prend jusqu'à 30 secondes en 480p, 720p ou 1080p, et les nœuds Omni-Reference de ComfyUI intègrent jusqu'à 20 références d'images, de vidéos et d'audio, ainsi que des documents et des pages web. Annoncé par Alibaba sur X et confirmé par ComfyUI sur son propre blog ; disponible pour les utilisateurs de ComfyUI et de Comfy Cloud.

Pixmax — une plateforme de création IA tierce qui a ajouté Wan 3.0 à peu près au même moment, annoncée par le compte officiel d'Alibaba le 25 août et confirmée sur la page de Pixmax, qui met en avant une « qualité cinéma » et une « cohérence visuelle irréprochable dans tous les styles artistiques ». C'est aussi le lieu du premier showcase de créateurs du compte officiel : Liz Zhang de Pixmax présente le film conceptuel de lancement et le flux de travail créatif construit autour du modèle. Annoncé par le fournisseur et confirmé sur la page de la plateforme.

PowerDirector — l'éditeur vidéo grand public de CyberLink, qui a intégré Wan 3.0 afin que les utilisateurs puissent transformer de simples invites en vidéo IA terminée directement dans l'éditeur. Annoncé sur les comptes X officiels d'Alibaba le 28 août et relayé par le compte japonais de PowerDirector ; le premier éditeur vidéo grand public à intégrer ce modèle. Information fournie par le fournisseur et ses partenaires, non issue d'un test indépendant.

• Les plateformes API tierces de génération vidéo — la voie la plus récente, annoncée par le compte X officiel d'Alibaba lors de la semaine de lancement. La première plateforme de ce type à servir le modèle l'expose via une simple API basée sur des tâches pour la génération vidéo à partir d'un prompt, au prix unique de 0,20 $ par seconde — le prix catalogue d'Alibaba pour une sortie en 1080p — avec un audio généré dans la même passe (activé par défaut), des durées de 2 à 30 secondes, et des références omni-modales : images, clips vidéo, audio, fichiers et liens web, ainsi que le conditionnement par première/dernière image comme alternative d'entrée. Annoncé par le fournisseur et confirmé sur la page du modèle de la plateforme elle-même.

{{1}}Depuis le lancement du 24 août, l’API est entièrement ouverte ; la restriction sur invitation décrite dans les articles de début août a été levée.{{/1}} {{2}}La réponse réaliste à « puis-je l’appeler aujourd’hui » est désormais oui{{/2}} {{3}}— via une console Alibaba, via un outil créatif tel qu’Envato, Leonardo.Ai, ComfyUI, Pixmax ou PowerDirector qui a intégré Wan 3.0,{{/3}} {{4}}ou via la plateforme API de génération vidéo tierce qui a commencé à la servir durant la semaine du lancement.{{/4}}

Le calendrier de sortie : bêta le 6 août, présentation le 10 août, lancement le 24 août.

L'événement signalé dans les signaux de suivi — un « lancement de Wan 3.0 » le 10 août à Hangzhou — nécessite un libellé précis. Il existe et il est officiel : le « Wan 3.0 Release and AI+Marketing Special Event », à 14h00 le 10 août au centre Alibaba dans la zone Weike de Hangzhou, organisé par le centre des services industriels et d'information de Hangzhou avec le centre Alibaba Weike. L'ordre du jour comprend l'évolution technique et les fonctionnalités du nouveau modèle, le partage de solutions IA+marketing et e-commerce, ainsi que des exercices pratiques sur Wan 3.0.

Mais le modèle était déjà en bêta publique à ce moment-là. L'événement du 10 août n'est pas le moment où le modèle est devenu réel — cela s'est produit le 6 août — et ce n'est pas non plus le lancement, qui a eu lieu le 24 août. Il s'agit de la vitrine formelle destinée aux entreprises : Alibaba positionnant Wan 3.0 auprès des acheteurs marketing et e-commerce, selon le même rythme de deux jours combinant consommateurs et entreprises qu'il avait utilisé pour l'application Qwen. Les dates comptent pour une seule raison : si vous avez lu « Wan 3.0 sort le 10 août », la déclaration exacte est que le modèle est entré en bêta publique le 6 août, a eu sa vitrine d'entreprise le 10 août, et a été officiellement lancé le 24 août. Le lancement du 24 août est la sortie qui compte.

Wan 3.0 release timeline with three cards: Aug 6 'Public beta live (confirmed)', Aug 10 'Hangzhou release & AI-marketing event (scheduled)', TBD 'Open weights on Hugging Face (rumored, unverified)', footer 'Confirmed events from Alibaba's announcement; open-weights date unverified.'

La pub de lancement a été réalisée avec Wan 3.0 — voici le workflow

La confirmation la plus directe que Wan 3.0 a réellement été lancé est qu'Alibaba l'a utilisé pour sa propre campagne de lancement. Le compte officiel Wan d'Alibaba sur X (@Alibaba_Wan) a publié une analyse détaillée de la publicité de lancement de Wan 3.0 — le concept, les fiches personnages, les prompts utilisés, et même les générations qui ont échoué. Pour être précis sur ce que c'est : il s'agit du propre compte rendu du fournisseur de sa propre production, pas d'un test indépendant, et c'est la preuve la plus solide que le fournisseur puisse offrir qu'un modèle fermé, accessible uniquement via API, effectue un véritable travail de production. L'existence même de cette analyse est en soi un signal de lancement — Alibaba a confié son propre marketing au modèle.

Alibaba a depuis diffusé les mêmes preuves vers l’extérieur. La série de créateurs du compte officiel — « Comment les créateurs utilisent-ils réellement Wan 3.0 dans des projets concrets — au-delà d’appuyer sur générer ? » — a débuté avec Liz Zhang de Pixmax_ai, qui a parlé du film concept de lancement, de la construction d’un flux de travail créatif complet autour du modèle, et de ce qui attend la plateforme. Il s’agit de la même catégorie de preuves que l’analyse de la publicité de lancement : une conversation publiée par le fournisseur avec un partenaire, non pas un test indépendant, mais un compte rendu concret du modèle effectuant un travail de production en dehors du marketing d’Alibaba lui-même.

Le workflow que décrit la décomposition est construit autour du problème le plus difficile de la famille : garder un personnage reconnaissable à travers plusieurs plans au sein d’une même séquence de 30 secondes. Le récit d’Alibaba s’articule autour de fiches de personnage qui ancrent l’identité à travers les plans. Les analystes de la communauté qui ont rétro-ingénié les exemples officiels décrivent la même discipline en termes structurels : lier chaque asset de référence à un sujet nommé dans le prompt plutôt que de le décrire une seule fois ; définir des règles globales qui s’appliquent à tout le clip, y compris une liste explicite « ne pas faire » pour les mouvements que le modèle adopte par défaut ; et écrire la timeline sous forme de beats horodatés plutôt que d’atmosphère. Ces constatations structurelles sont le fruit du travail de la communauté sur l’ensemble d’échantillons officiel, et non des recommandations du fournisseur, mais elles correspondent à ce qu’Alibaba présente.

Le détail qui distingue cette décomposition, c'est qu'elle montre les ratés. Alibaba publie les générations qui ont échoué — l'identité qui a dérivé, le rythme qui s'est effondré — plutôt que seulement les images qui ont abouti. C'est un regard honnête sur les points où le modèle peine encore et une norme pratique pour quiconque construit dessus : les échecs au premier essai font partie du flux de travail, pas un signe que le modèle est cassé.

La rumeur open-weight, et pourquoi elle n'est pas vérifiée

Autour de Wan 3.0, vous trouverez une affirmation spécifique : celle selon laquelle il propose des poids ouverts sous licence Apache 2.0 en deux tailles — un checkpoint grand public de 1,3B et un modèle professionnel de 14B — et que ces poids seront publiés sur Hugging Face aux alentours du 10 août. C'est l'affirmation à laquelle il faut prêter le plus d'attention, car c'est la plus largement répétée et la moins étayée.

Cela ne figure dans aucune annonce d'Alibaba. Les publications officielles de bêta publique décrivent une API payante à l'usage. Aucune licence, aucune publication des poids, aucun dépôt Hugging Face ou GitHub n'apparaît nulle part dans les propres documents d'Alibaba.

Ces chiffres semblent recyclés. L'association 1.3B + 14B correspond exactement à la configuration de Wan 2.1, sorti en février 2025. Une analyse indépendante des rumeurs sur Wan 3.0 publiée le 4 août — avant l'annonce de la version bêta — a signalé que les tableaux « 1.3B + 14B, Apache 2.0 » étaient sans source et cohérents avec les faits de Wan 2.1 plutôt qu'avec quoi que ce soit qu'Alibaba ait dit.

Cela va à contre-courant. Les poids ouverts de la famille Wan s'arrêtent à Wan 2.2 (août 2025). Wan 2.5, 2.6 et 2.7 n'ont jamais vu leurs poids principaux publiés ; ce qu'Alibaba a ouvert en 2026, ce sont des modèles périphériques — un modèle musique-à-danse, un rapport technique — tandis que la gamme vidéo principale restait fermée. Un Wan 3.0 ouvert inverserait cette tendance, c'est pourquoi la lecture sceptique le considère comme « possible, non promis, et contraire à la tendance récente ».

La rumeur concernant les poids du 10 août n'est pas vérifiée. Elle provient d'une note de suivi manuelle, et non d'Alibaba ou d'une source traçable, et l'ordre du jour de l'événement du 10 août concerne le marketing et le commerce électronique, et non une publication sur Hugging Face.

Rien de tout cela ne prouve que les poids ouverts ne verront pas le jour — un fournisseur peut changer de cap. Mais chaque élément de l'affirmation échoue actuellement à une vérification de source primaire, et le lancement officiel décrit le modèle de distribution opposé. Tant qu'Alibaba ne publie pas un dépôt ou une licence, l'étiquette exacte pour les poids ouverts de Wan 3.0 est : non confirmée, et contredite par l'annonce officielle.

Une vérification indépendante est arrivée cette semaine.

La ligne que tient ce billet depuis sa publication — chaque chiffre ci-dessus n'est qu'une affirmation d'Alibaba tant qu'aucun laboratoire indépendant n'a fait tourner le modèle — a changé le 3 septembre. Artificial Analysis, dont la Video Arena classe les modèles selon des votes en tête-à-tête à l'aveugle portant sur des générations réelles, et non selon des chiffres fournis par les éditeurs, a ajouté Wan 3.0 à ses classements et {{1}}le modèle a fait ses débuts à la première place sur le {{/1}}{{2}}Video Editing Leaderboard (With Audio){{/2}} : un Elo d'environ 1 189 issu de quelques milliers de votes, une avance nette sur MiniMax H3 (environ 1 129) et {{3}}Gemini Omni Flash{{/3}} (environ 1 124). Sur {{4}}Text to Video with Audio{{/4}}, il a décroché une deuxième place très serrée, avec un Elo d'environ 1 237, pratiquement à égalité avec {{5}}Gemini Omni Flash{{/5}} en tête (environ 1 238), et AA le place également en 5ᵉ position sur Image to Video with Audio. Les classements montrent aussi le bond générationnel au sein de la famille : le modèle précédent d'Alibaba, {{6}}Wan 2.7{{/6}}, se trouve en 5ᵉ position sur le même classement de montage vidéo, à environ 1 077. Ce que le verdict de l'arène prouve et ne prouve pas : un Elo obtenu par vote en aveugle mesure quelle sortie les gens préfèrent en confrontation directe — un signal de qualité fort et indépendant, mais pas un benchmark contrôlé en laboratoire — et Alibaba n'a toujours publié ni fiche technique du modèle, ni nombre de paramètres, ni poids largement disponibles. Le label {{7}}« non vérifié »{{/7}} ne s'applique plus à la qualité mise en avant du modèle ; il s'applique à tout ce qui se trouve sous le capot.

La question de la date de sortie, répondue

Pour les recherches ciblées par cet article, le résumé est court :

Quand Wan 3.0 est-il sorti ? Bêta publique : 6 août 2026, confirmé par Alibaba. Démonstration entreprise : 10 août 2026 à Hangzhou. Lancement officiel : 24 août 2026.

Est-ce open source ? Aucun poids confirmé. L'affirmation concernant Apache 2.0 / 1.3B + 14B n'est pas vérifiée, et le lancement officiel est réservé à l'API.

Combien ça coûte ? 0,3 / 0,6 / 1,2 yuan par seconde en 480p / 720p / 1080p ; environ 36 yuan (6,00 $) pour un clip de 30 secondes en 1080p.

Puis-je l'utiliser ? Oui. L'API est entièrement ouverte depuis le 24 août — via Model Studio ou Qwen Cloud, les surfaces grand public listées ci-dessus, des outils créatifs tiers tels que l'outil vidéo IA d'Envato, Leonardo.Ai, ComfyUI, Pixmax ou PowerDirector, ou une plateforme API tierce de génération vidéo qui a commencé à la proposer dès la semaine de lancement.

Les questions que les gens se posent réellement

Wan 3.0 est-il réellement sorti, ou s'agit-il encore d'une rumeur ?

C'est entièrement sorti : la bêta publique est devenue disponible le 6 août, l'événement entreprise s'est tenu le 10 août, et le lancement officiel a eu lieu le 24 août. Toute couverture qui présente encore Wan 3.0 comme une rumeur ou une bêta non publiée est périmée — y compris les analyses « pas encore annoncées » qui étaient exactes avant le 6 août.

Wan 3.0 aura-t-il des poids ouverts ?

Rien dans l'annonce d'Alibaba ne le dit, la spécification 1.3B + 14B largement diffusée correspond à Wan 2.1 plutôt qu'à quoi que ce soit de nouveau, et la trajectoire de la famille depuis Wan 2.2 s'est orientée vers des modèles vidéo fermés, réservés à l'API. Considérez « Wan 3.0 ouvert » comme une rumeur jusqu'à ce qu'un dépôt ou une licence apparaisse ; la tendance récente est la preuve la plus solide contre cela.

Combien coûte une vidéo Wan 3.0 de 30 secondes ?

Aux tarifs API indiqués, environ 36 yuan (6,00 $) en 1080p, 18 yuan (3,00 $) en 720p et 9 yuan (1,50 $) en 480p, par clip. Ce sont les prix catalogue d'Alibaba, par seconde, et l'API est désormais entièrement ouverte. Une promotion de lancement de 30 % est en cours jusqu'au 23 septembre sur Bailian et Qianwen AI.

La génération en 30 secondes est-elle réelle, et quel est le piège ?

La génération en une seule passe de 30 secondes est la fonctionnalité phare d'Alibaba, et c'est le segment natif unique le plus long parmi les modèles vidéo chinois, soit le double de Wan 2.7. Les bémols viennent du fournisseur lui-même : la qualité audio et la précision du texte à l'écran sont des points faibles reconnus. Le seul élément d'évaluation indépendant disponible est le verdict de l'Artificial Analysis Arena du 3 septembre — n°1 en édition vidéo (avec audio) et n°2 d'extrême justesse en texte-vers-vidéo avec audio — qui mesure la qualité globale des sorties à partir de votes à l'aveugle plutôt que de tester spécifiquement la limite des 30 secondes.

Quelque chose de réel a-t-il réellement été fabriqué avec Wan 3.0 ?

Oui — la publicité de lancement elle-même. Le compte officiel Wan d'Alibaba sur X indique que la campagne de lancement de Wan 3.0 a été produite avec le modèle et a publié une analyse complète du travail : le concept, les fiches de personnages, les prompts et les générations ratées. C'est un exemple fourni par le vendeur plutôt qu'un test indépendant, mais c'est une utilisation réelle en production de l'API fermée par ceux qui la vendent. Le compte officiel d'Alibaba a également mis en avant des créateurs externes réalisant un vrai travail avec le modèle : une interview de Liz Zhang de Pixmax_ai à propos du film conceptuel de lancement et du flux de travail créatif autour de Wan 3.0. Même étiquette — déclaré par le vendeur, sélectionné par Alibaba — mais cela fait évoluer la preuve d'utilisation en production au-delà du marketing d'Alibaba lui-même.

En résumé

Wan 3.0 est réel, il est lancé, et son prix est agressif — génération en 30 secondes, document-vers-vidéo, tarifs à la seconde qui cassent les prix des concurrents grand public en 720p, et désormais des voies créatives tierces via l’outil vidéo IA d’Envato, Leonardo.Ai, ComfyUI, Pixmax et PowerDirector, plus une plateforme API de génération vidéo qui sert le modèle à 0,20 $ fixe par seconde. La preuve la plus directe qu’il est bien distribué comme logiciel de production, c’est la campagne de lancement elle-même : Alibaba affirme que la publicité de lancement de Wan 3.0 a été réalisée avec le modèle et publie le détail complet, fiches de personnages et générations ratées comprises. Depuis, le compte officiel a montré la même preuve venue de créateurs externes : un entretien avec Liz Zhang de Pixmax_ai à propos du film conceptuel de lancement et du flux de travail créatif complet autour du modèle. Ce à quoi il faut résister, c’est l’histoire qui s’est construite autour de lui. L’affirmation des poids ouverts est une rumeur de spécifications recyclées que le lancement officiel contredit. L’histoire de la qualité n’appartient plus à Alibaba seul : moins de dix jours après le lancement, une arène indépendante classait Wan 3.0 n°1 en édition vidéo (avec audio) et tout juste n°2 en texte-vers-vidéo avec audio. Ce qui doit encore être vérifié indépendamment, c’est tout ce qui se cache sous le capot — architecture, nombre de paramètres, et toute affirmation qui dépend de l’exécution du modèle plutôt que d’un vote sur ses résultats.

Ce qui pourrait encore modifier cette lecture tient à des éléments précis : une fiche de modèle ou un nombre de paramètres répondrait aux questions ouvertes sur l’architecture ; un dépôt ou une licence donnerait corps à la rumeur de poids ouverts ; et un benchmark contrôlé en laboratoire — par opposition à l’Elo d’arène publié par Artificial Analysis cette semaine — transformerait les affirmations sur la qualité en faits entièrement vérifiables. Au moment de cette mise à jour, le résumé exact en une ligne de Wan 3.0 est : un lancement confirmé, au prix agressif, qui se place désormais n°1 des classements indépendants en montage vidéo et, de très peu, n°2 en texte-vers-vidéo avec audio — accessible via des outils créatifs tiers sur Envato, Leonardo.Ai, ComfyUI, Pixmax et PowerDirector, ainsi que via une plateforme API tierce de génération vidéo — avec des poids ouverts qui, d’après les éléments disponibles, ne devraient probablement pas suivre.