
Data premiery Wan 3.0: potwierdzona premiera 24 sierpnia — teraz w ComfyUI i API stron trzecich.
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleNOWOŚĆGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenNOWOŚĆQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencja72Kod
- anthropicNOWOŚĆAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencja69Kod
24 sierpnia 2026 roku Alibaba Cloud potwierdził oficjalną premierę Wan 3.0 — trzeciej generacji rodziny modeli wideo Tongyi Wanxiang i następcy Wan 2.7 — 18 dni po udostępnieniu go w publicznej becie 6 sierpnia. Premiera przekształca płatne, dostępne na zaproszenie API z fazy beta w całkowicie otwarte API i wprowadza Wan 3.0 do narzędzi kreatywnych stron trzecich: narzędzie AI do wideo od Envato zaczęło w tym samym tygodniu oferować model wykorzystywany przez silnik ModelMatch, Leonardo.Ai dodało Wan 3.0 do swojego generatora wideo, a model jest teraz natywnie dostępny w ComfyUI, gdzie pojedyncza generacja trwa do 30 sekund. Konsumencki edytor wideo PowerDirector (CyberLink) również dodał Wan 3.0, co ogłoszono na oficjalnych kontach Alibaba na X 28 sierpnia i powtórzono na japońskim koncie PowerDirectora. Oficjalne konto Alibaba na X potwierdziło również, że platforma API do generowania wideo zewnętrznego dostawcy obsługuje teraz Wan 3.0 — wideo i audio w jednym modelu, do 30 sekund, z referencjami multimodalnymi — po stałej cenie 0,20 USD za sekundę. To jak dotąd najwyraźniejszy sygnał, że model został w pełni wydany. Kampania premierowa samego Alibaba przedstawia to teraz w najbardziej bezpośredni sposób: dostawca twierdzi, że reklama premiery Wan 3.0 została stworzona przy użyciu tego modelu, a oficjalne konto Wan na X opublikowało szczegółowy opis prac — koncepcję, karty postaci, prompty, a nawet nieudane generacje. Od tego czasu konto skupiło się również na twórcach z zewnątrz — wywiad z Liz Zhang z Pixmax_ai omawia film z koncepcji premiery i budowanie pełnego przepływu pracy wokół modelu. 3 września pojawił się pierwszy niezależny werdykt na temat samego modelu: Artificial Analysis, która rankuje modele wideo na podstawie ślepych pojedynków, a nie deklaracji dostawców, zadebiutowała z Wan 3.0 na pierwszym miejscu w swoim Video Editing Leaderboard (With Audio) oraz na drugim miejscu z minimalną stratą w Text to Video with Audio. Premiera wciąż nie obejmuje jednak otwartych wag. Historia o Apache-2.0 "1.3B + 14B" krążąca wokół Wan 3.0 nie pojawia się w żadnym ogłoszeniu Alibaba, prawie dokładnie odpowiada specyfikacji modelu z 2025 roku i przeczy sposobowi, w jaki Alibaba faktycznie udostępniał swoje modele wideo w ciągu ostatniego roku. Oto, co zmieniła premiera z 24 sierpnia, co potwierdzono 6 sierpnia i które części historii Wan 3.0 należy wciąż traktować jako niezweryfikowane.
Na początek uwaga o źródłach, bo ta historia ma dwie warstwy. Wszystko w sekcjach o możliwościach i cenach pochodzi od Alibaby: to treść oficjalnego ogłoszenia publicznej wersji beta i anglojęzycznego bloga Alibaby, skonfrontowana z relacjami chińskiej prasy. Oficjalna premiera 24 sierpnia została ogłoszona przez producenta i tego samego dnia relacjonowana przez wiele serwisów. Integracje z Envato, Leonardo.Ai, ComfyUI, Pixmax i PowerDirector — oraz zewnętrzna platforma API do generowania wideo, która zaczęła oferować model w tygodniu premiery — zostały ogłoszone przez Alibabę na X i potwierdzone przez same platformy: Envato na własnym blogu, Leonardo.Ai w swoim ogłoszeniu, ComfyUI na oficjalnym blogu, Pixmax na własnej stronie, PowerDirector na koncie CyberLink, a platforma API na własnej stronie modelu, która opisuje jedną stawkę 0,20 USD za sekundę, domyślnie włączony dźwięk i odniesienia omnimodalne. To oświadczenia producenta i partnerów, a nie niezależne testy — i są tak oznaczone. Opisana poniżej analiza reklamy z premiery należy do tej samej kategorii: to własna relacja Alibaby dotycząca jej własnej produkcji, opublikowana na oficjalnym koncie Wan na X, a nie niezależny test. Opisana poniżej prezentacja twórców jest opatrzona taką samą etykietą: wywiad oficjalnego konta z Liz Zhang z Pixmax_ai to wybrana przez Alibabę relacja partnera o własnej pracy, opublikowana na X, a nie niezależny test. Wyjątkiem, według stanu na 3 września, jest Artificial Analysis: jego rankingi są niezależnym pomiarem, a nie twierdzeniem producenta, i plasują Wan 3.0 na 1. miejscu w edycji wideo (z dźwiękiem) oraz na 2. miejscu, tuż za liderem, w generowaniu tekstu na wideo z dźwiękiem — pierwszy niezależny od Alibaby wynik tego modelu, omówiony poniżej. Nadal nie ma karty modelu, liczby parametrów ani powszechnie dostępnych wag do uruchomienia. W szczególności twierdzenie o otwartych wagach nie zostało potwierdzone przez producenta; to plotka środowiska, której przeczy oficjalna premiera, i jest tak oznaczona wszędzie tam, gdzie się pojawia.
Co tak naprawdę dostarcza Wan 3.0
Wan 3.0 to model generujący wideo na podstawie tekstu, obrazu, wideo i dźwięku. Główną funkcją, powtarzaną we wszystkich mediach, które opisywały wersję beta, jest generowanie w pojedynczym przebiegu klipów o długości do 30 sekund — dwa razy więcej niż 15-sekundowy limit Wan 2.7 i najdłuższy natywny pojedynczy segment spośród chińskich modeli wideo. To właśnie recenzenci nieustannie opisują jako „przejście od generowania ujęcia do opowiadania całej historii”: 30 sekund wystarcza na ciągły ruch kamery lub scenę bez cięć, czego krótsze klipy nie mogą osiągnąć.
• Maksymalna długość — do 30 sekund w jednej generacji, dwukrotnie więcej niż 15 sekund w Wan 2.7, z funkcją „inteligentnego czasu trwania”, która sugeruje długość na podstawie promptu, oraz narzędziem do rozszerzania wideo w celu łączenia dłuższych narracji.
• Wejścia — tekst, obraz, wideo i audio, a także, po raz pierwszy w tej rodzinie, dokumenty: pliki doc, xls, ppt, pdf, md, txt, key, pages i numbers oraz linki internetowe. Pojedynczy plik o rozmiarze do 100 MB / 50 stron można zamienić bezpośrednio na wideo — funkcja „document-to-video”, która odpowiada za większość zainteresowania ze strony marketingu i edukacji.
• Multi-reference — do 10 obrazów, 5 filmów i 5 odniesień audio na generację, dla zachowania spójności postaci, rekwizytów, dźwięku, układu przestrzennego i stylu między ujęciami.
• Edycja — modyfikacja wizualizacji, fabuły i dialogów na podstawie instrukcji po wygenerowaniu, zamiast pełnej regeneracji.
• Wskazane słabości — Alibaba przyznaje, że jakość dźwięku i dokładność tekstu na ekranie wciąż wymagają poprawy; pochodzi to z ogłoszenia samego dostawcy, a nie z werdyktu recenzenta.
Warto rozdzielić: „30-sekundowe klipy” i „natywne wyjście 4K” były oba sugerowane dla Wan 3.0, ale oficjalne ogłoszenie wersji beta zobowiązuje się jedynie do 30-sekundowej generacji w 480p, 720p i 1080p. Natywne 4K pojawia się na stronach marketingowych podmiotów trzecich, a nie w ogłoszeniu Alibaba. Traktuj 4K jako niepotwierdzone.

Cennik: API rozliczane i wzorzec, który łamie
Wan 3.0 jest wyceniany za sekundę wygenerowanego wideo. Podane przez Alibaba stawki API wynoszą 0,3 juana (około 0,05 USD) za sekundę w 480p, 0,6 juana (około 0,10 USD) za sekundę w 720p i 1,2 juana (około 0,20 USD) za sekundę w 1080p. Pełny 30-sekundowy klip kosztuje zatem około 9 juanów (1,50 USD) w 480p, 18 juanów (3,00 USD) w 720p lub 36 juanów (6,00 USD) w 1080p. Premiera 24 sierpnia potwierdziła tę samą strukturę płatności za sekundę i dodała ograniczony czasowo 30% rabat na platformach AI Alibaba Cloud – Bailian i Qianwen – do 23 września; według Alibaba 30-sekundowy klip w 1080p spada w trakcie promocji do około 25 juanów. Chińskie media zauważyły, że stawka za 720p wynosi około 60% ceny za sekundę u głównych konkurentów – to przekaz cenowy, który Alibaba w wyraźny sposób kieruje do małych i średnich zespołów.
Model cenowy stanowi sedno sprawy, ponieważ jest celowym zerwaniem z historią rodziny. Wan 2.1 i 2.2 zostały wydane z pełnymi otwartymi wagami na licencji Apache 2.0. Wan 2.5 została zapowiedziana jako otwarta, ale wagi nigdy nie zostały udostępnione. Wan 2.6 była zamkniętym API. Wan 2.7 była tylko częściowo otwarta. Wan 3.0 kontynuuje tę linię, a nie linię Wan 2.1: jest to rozliczane, zamknięte API — bramka aplikacji beta została zniesiona podczas premiery 24 sierpnia — a oficjalna premiera nie wspomina nic o udostępnieniu wag. Każdy, kto zastanawia się: „czy powinienem czekać na otwarte wagi”, czeka na coś, czego Alibaba nie obiecała, a czemu przeczy ostatni wzorzec postępowania.
Tu właśnie liczy się ekonomia routingu. Gdy model wideo wyceniany jest tak granularnie — za sekundę, za rozdzielczość — różnica między dostawcami zwykle nie wynika z modelu, lecz z rozliczeń. W OrcaRouter ponad 200 modeli, które trasujemy, rozliczanych jest według cennika dostawcy, z zerową marżą, więc obniżka cen dostawcy jest u nas aktywna tego samego dnia, a nie po zakończeniu cyklu umownego. Wan 3.0 nie jest dziś dostępny na żadnej platformie routingu modeli ogólnego przeznaczenia — można do niego dotrzeć przez własne konsole Alibaba, przez zewnętrzne narzędzia kreatywne, takie jak Envato, Leonardo.Ai, ComfyUI, Pixmax i PowerDirector, oraz przez platformę API do generowania wideo, która zaczęła go udostępniać już w tygodniu premiery — ale teraz, gdy API jest w pełni otwarte, warto sprawdzić, czy podana Ci stawka za sekundę to stawka samego dostawcy. Na naszych stronach modeli pokazujemy cenę katalogową i właśnie tak należy dokonywać porównań.

Gdzie możesz to faktycznie wypróbować
API jest w pełni otwarte od momentu premiery 24 sierpnia; w fazie beta było dostępne tylko na podstawie zgłoszenia. Alibaba wymienia te punkty dostępu w ogłoszeniu:
• Model Studio (Bailian) — platforma AI firmy Alibaba Cloud, na której można ubiegać się o testowanie modeli.
• Qwen Cloud — AI-natywna chmura Alibaba, obecnie pokazująca limity dwóch równoczesnych zadań, 30 żądań na minutę i 50 zadań w kolejce asynchronicznej.
• Oficjalna strona internetowa Wanxiang oraz klient PC Qwen Creation — interfejsy skierowane do konsumentów.
• WonderClip (Wanjing Yike), IF STUDIO i Duiyou — narzędzia do tworzenia treści Alibaby, wymienione obok głównych platform.
• Qwen app — stopniowe (szare) wdrożenie zamiast pełnego wydania.
• Narzędzie AI do wideo od Envato — zewnętrzna powierzchnia kreatywna, która dodała Wan 3.0 w tygodniu premiery, wybrana za kulisami przez ModelMatch od Envato, a nie wybierana przy każdej generacji. Dostępna dla użytkowników Envato; ogłoszona przez Alibaba i potwierdzona na blogu Envato.
• Leonardo.Ai — zewnętrzna platforma kreatywna, która dodała Wan 3.0 do swojego generatora wideo, co zostało ogłoszone przez Alibaba na X i potwierdzone przez Leonardo.Ai we własnym komunikacie. Dostępne dla użytkowników Leonardo jako kolejna droga dostępu spoza Alibaba.
• ComfyUI — platforma workflow oparta na węzłach, która dodała natywną obsługę Wan 3.0 w aktualizacji v0.33.4 oraz w Comfy Cloud. Pojedyncza generacja trwa do 30 sekund w rozdzielczości 480p, 720p lub 1080p, a węzły Omni-Reference w ComfyUI pobierają do 20 referencji obrazów, wideo i audio, a także dokumenty i strony internetowe. Ogłoszone przez Alibaba na X i potwierdzone przez ComfyUI na własnym blogu; dostępne dla użytkowników ComfyUI i Comfy Cloud.
• Pixmax — zewnętrzna platforma do tworzenia treści AI, która dodała Wan 3.0 mniej więcej w tym samym czasie. Informację ogłosiło oficjalne konto Alibaba 25 sierpnia, a potwierdzono ją na własnej stronie Pixmax, która reklamuje „rezultaty klasy kinowej” i „nienaganną spójność wizualną w dowolnym stylu artystycznym”. Jest to także miejsce pierwszej prezentacji twórców oficjalnego konta: Liz Zhang z Pixmax omawia film koncepcyjny premiery i proces twórczy zbudowany wokół modelu. Ogłoszone przez dostawcę i potwierdzone na własnej stronie platformy.
• PowerDirector — konsumencki edytor wideo od CyberLink, w którym dodano Wan 3.0, aby użytkownicy mogli zamieniać proste polecenia w gotowe wideo AI bezpośrednio w edytorze. Ogłoszenie pojawiło się 28 sierpnia na oficjalnych kontach Alibaba w serwisie X, a japońskie konto PowerDirectora również je powtórzyło; to pierwszy mainstreamowy konsumencki edytor wideo, który udostępnił ten model. Informacja pochodzi od producenta i partnerów, a nie z niezależnego testu.
• Platformy API do generowania wideo od zewnętrznych dostawców — najnowsza droga dostępu, ogłoszona przez oficjalne konto X firmy Alibaba w tygodniu premiery. Pierwsza taka platforma udostępniająca model wystawia go przez proste, oparte na zadaniach API do generowania wideo z promptu, w cenie 0,20 USD za sekundę — cena katalogowa Alibaba dla wyjścia 1080p — z dźwiękiem generowanym w tym samym przebiegu (domyślnie włączonym), długością od 2 do 30 sekund oraz odniesieniami omnimodalnymi: obrazy, klipy wideo, audio, pliki i linki internetowe, a także warunkowaniem na podstawie pierwszej/ostatniej klatki jako alternatywnym wejściem. Ogłoszone przez dostawcę i potwierdzone na stronie modelu samej platformy.
Od czasu premiery 24 sierpnia API jest w pełni otwarte; ograniczenie zaproszeniowe opisane w relacjach z początku sierpnia zostało zniesione. Realistyczna odpowiedź na pytanie „czy mogę dziś z niego korzystać” brzmi teraz: tak — przez konsolę Alibaba, przez narzędzie kreatywne, takie jak Envato, Leonardo.Ai, ComfyUI, Pixmax czy PowerDirector, które zintegrowało Wan 3.0, lub przez platformę API do generowania wideo innej firmy, która zaczęła go udostępniać w tygodniu premiery.
Harmonogram wydania: 6 sierpnia beta, 10 sierpnia prezentacja, 24 sierpnia premiera
Wydarzenie oznaczone w sygnałach śledzących — „premiera Wan 3.0” 10 sierpnia w Hangzhou — wymaga precyzyjnej etykiety. Istnieje i jest oficjalne: „Wan 3.0 Release and AI+Marketing Special Event”, 14:00 10 sierpnia w Alibaba Center w dzielnicy Weike w Hangzhou, organizowane przez Hangzhou Industrial and Information Service Center wraz z Weike Alibaba Center. Agenda obejmuje ewolucję techniczną i funkcje nowego modelu, dzielenie się rozwiązaniami AI+marketing i e-commerce oraz praktyczne ćwiczenia z Wan 3.0.
Ale model był już wtedy w publicznej becie. Wydarzenie z 10 sierpnia nie jest momentem, w którym model stał się realny — to nastąpiło 6 sierpnia — i nie jest też premierą, która miała miejsce 24 sierpnia. To formalna, skierowana do przedsiębiorstw prezentacja: Alibaba pozycjonuje Wan 3.0 wobec nabywców z marketingu i e-commerce, w tym samym dwudniowym rytmie skierowanym do konsumentów i przedsiębiorstw, w którym odbyła się aplikacja Qwen. Daty mają znaczenie z jednego powodu: jeśli czytaliście, że „Wan 3.0 wychodzi 10 sierpnia", prawidłowe stwierdzenie brzmi: model wszedł w fazę publicznej bety 6 sierpnia, miał swoją prezentację dla przedsiębiorstw 10 sierpnia, a oficjalnie wystartował 24 sierpnia. Premiera 24 sierpnia jest tą, która się liczy.

Reklama premierowa została stworzona przy użyciu Wan 3.0 — oto przebieg prac
Najbardziej bezpośrednim potwierdzeniem, że Wan 3.0 faktycznie trafiło na rynek, jest fakt, że Alibaba wykorzystało je we własnej kampanii premierowej. Oficjalne konto Wan na X należące do Alibaby (@Alibaba_Wan) opublikowało pełną analizę reklamy premiery Wan 3.0 — koncepcję, karty postaci, użyte prompty, a nawet wygenerowane wersje, które nie przeszły selekcji. Mówiąc precyzyjnie, czym to jest: to relacja samego dostawcy na temat własnej produkcji, a nie niezależny test, i stanowi najmocniejszy dowód, jaki dostawca może przedstawić na to, że zamknięty model dostępny wyłącznie przez API wykonuje realną pracę produkcyjną. Sam fakt istnienia tej analizy jest sygnałem potwierdzającym premierę — {{1}}Alibaba powierzyło modelowi własny marketing{{/1}}. {{2}}To najlepszy dowód na realne wdrożenie{{/2}}.
Alibaba od tego czasu rozpowszechnia te same dowody na zewnątrz. Seria twórców na oficjalnym koncie — „Jak twórcy faktycznie korzystają z Wan 3.0 w prawdziwych projektach — poza wciskaniem generowania?” — rozpoczęła się od Liz Zhang z Pixmax_ai, która omówiła film koncepcyjny premiery, budowanie pełnego przepływu pracy twórczej wokół modelu oraz plany platformy na przyszłość. To ta sama kategoria dowodów co analiza reklamy premiery: opublikowana przez dostawcę rozmowa z partnerem, a nie niezależny test, ale konkretny opis modelu wykonującego pracę produkcyjną poza marketingiem samego Alibaby.
Workflow opisany w analizie zbudowany jest wokół najtrudniejszego problemu rodziny: utrzymania rozpoznawalności postaci w wielu ujęciach w ramach jednej 30-sekundowej sekwencji. Opis Alibaba koncentruje się na kartach postaci, które zakotwiczają tożsamość w poszczególnych ujęciach. Analitycy społeczności, którzy przeprowadzili inżynierię wsteczną oficjalnych przykładów, opisują tę samą dyscyplinę w kategoriach strukturalnych: powiąż każdy zasób referencyjny z nazwanym podmiotem w prompcie, zamiast opisywać go tylko raz; ustaw globalne reguły obowiązujące dla całego klipu, w tym wyraźną listę „nie rób” dla ruchów, które model domyślnie wykonuje; oraz zapisz oś czasu jako beaty z timestampami, a nie jako atmosferę. Te ustalenia strukturalne to praca społeczności nad oficjalnym zestawem próbek, a nie wytyczne dostawcy, ale są zgodne z tym, co pokazuje Alibaba.
Tym, co wyróżnia tę analizę błędów, jest to, że pokazuje niepowodzenia. Alibaba publikuje wygenerowane próbki, które się nie powiodły — tożsamość, która się rozmyła, rytm, który się rozpadł — a nie tylko te klatki, które się udały. To uczciwe spojrzenie na to, z czym model wciąż ma trudności, i praktyczna norma dla każdego, kto na nim buduje: niepowodzenia za pierwszym podejściem są częścią procesu pracy, a nie oznaką, że model jest zepsuty.
Plotka o open-weight i dlaczego jest niezweryfikowana
Wokół Wan 3.0 można znaleźć konkretne twierdzenie: że dostarcza ono otwarte wagi na licencji Apache 2.0 w dwóch rozmiarach — checkpoint konsumencki 1.3B i profesjonalny 14B — oraz że wagi pojawią się na Hugging Face około 10 sierpnia. To twierdzenie, na które należy uważać najbardziej, ponieważ jest najczęściej powtarzane, a najmniej poparte.
• Nie ma tego w żadnym ogłoszeniu Alibaby. Oficjalne wpisy dotyczące publicznej bety opisują płatne, taryfikowane API. Żadna licencja, żadne wydanie wag ani żadne repozytorium na Hugging Face czy GitHub nie pojawia się w żadnym materiale samej Alibaby.
• Liczby wyglądają na z recyklingu. Połączenie 1.3B + 14B to dokładna specyfikacja Wan 2.1, wydanego w lutym 2025 roku. Niezależna analiza plotek o Wan 3.0 opublikowana 4 sierpnia — przed ogłoszeniem wersji beta — wskazała, że tabele „1.3B + 14B, Apache 2.0” są niepoparte źródłami i zgodne z faktami dotyczącymi Wan 2.1, a nie z tym, co powiedział Alibaba.
• To przeczy trendowi. Otwarte wagi w rodzinie Wan kończą się na Wan 2.2 (sierpień 2025). Wan 2.5, 2.6 i 2.7 nigdy nie miały opublikowanych rdzeniowych wag; to, co Alibaba udostępniło w 2026 roku, to modele peryferyjne — model od muzyki do tańca, raport techniczny — podczas gdy główna linia wideo pozostała zamknięta. Otwarty Wan 3.0 odwróciłby ten schemat, dlatego sceptyczna interpretacja traktuje go jako „możliwy, nieobiecany i sprzeczny z ostatnim trendem”.
• Pogłoska o wagach z 10 sierpnia jest niezweryfikowana. Pochodzi z ręcznej notatki śledzącej, a nie od Alibaba ani z żadnego możliwego do prześledzenia źródła, a agenda wydarzenia z 10 sierpnia dotyczy marketingu i e-commerce, a nie publikacji na Hugging Face.
Nic z tego nie dowodzi, że otwarte wagi nie powstaną — dostawca może zmienić kurs. Ale każdy element tego twierdzenia obecnie nie przechodzi kontroli źródła pierwotnego, a oficjalna premiera opisuje przeciwny model dystrybucji. Dopóki Alibaba nie opublikuje repozytorium lub licencji, właściwą etykietą dla otwartych wag Wan 3.0 jest: niepotwierdzona i sprzeczna z oficjalnym ogłoszeniem.
Niezależna weryfikacja nadeszła w tym tygodniu.
Linia, którą ten post utrzymywał od premiery — każda liczba powyżej to własne twierdzenie Alibaby, dopóki niezależne laboratorium nie przetestuje modelu — zmieniła się 3 września. Artificial Analysis, którego Video Arena rankuje modele na podstawie ślepych głosów w bezpośrednich porównaniach realnych generacji, a nie liczb podawanych przez producentów, dodał Wan 3.0 do swoich tablic i model zadebiutował na #1 w Video Editing Leaderboard (With Audio): Elo około 1,189 z kilku tysięcy głosów, z wyraźną przewagą nad MiniMax H3 (około 1,129) i Gemini Omni Flash (około 1,124). W kategorii Text to Video with Audio zajął bliskie #2 z około 1,237, praktycznie remisując z Gemini Omni Flash na szczycie (około 1,238), a AA wymienia go również na #5 w Image to Video with Audio. Tablice pokazują też skok pokoleniowy w rodzinie: poprzedni model Alibaby, Wan 2.7, zajmuje #5 na tym samym rankingu edycji wideo z około 1,077. Co werdykt areny dowodzi, a czego nie: Elo ze ślepych głosowań mierzy, które wyjście ludzie preferują w bezpośrednim porównaniu — to silny, niezależny sygnał jakości, ale nie kontrolowany benchmark laboratoryjny — a Alibaba nadal nie opublikowała żadnej karty modelu, liczby parametrów ani powszechnie dostępnych wag. Etykieta „niezweryfikowany” nie dotyczy już flagowej jakości modelu; dotyczy wszystkiego pod maską.
Pytanie o datę premiery — odpowiedź
Dla wyszukiwań, których dotyczy ten post, podsumowanie jest krótkie:
• Kiedy ukazał się Wan 3.0? Publiczna beta: 6 sierpnia 2026 r., potwierdzona przez Alibaba. Prezentacja dla przedsiębiorstw: 10 sierpnia 2026 r. w Hangzhou. Oficjalna premiera: 24 sierpnia 2026 r.
• Czy jest open source? Brak potwierdzonych wag. Twierdzenie o Apache 2.0 / 1.3B + 14B jest niezweryfikowane, a oficjalna premiera jest tylko przez API.
• Ile to kosztuje? 0,3 / 0,6 / 1,2 juana za sekundę w 480p / 720p / 1080p; około 36 juanów (6,00 USD) za 30-sekundowy klip 1080p.
• Czy mogę z niego korzystać? Tak. API jest w pełni otwarte od 24 sierpnia — poprzez Model Studio lub Qwen Cloud, wymienione powyżej interfejsy konsumenckie, narzędzia kreatywne innych firm, takie jak narzędzie AI do tworzenia wideo od Envato, Leonardo.Ai, ComfyUI, Pixmax lub PowerDirector, albo platformę API do generowania wideo innej firmy, która zaczęła udostępniać to API w tygodniu premiery.
Pytania, które ludzie naprawdę zadają
Czy Wan 3.0 został faktycznie wydany, czy to wciąż tylko plotka?
Jest w pełni wydany: publiczna beta wystartowała 6 sierpnia, pokaz dla przedsiębiorstw odbył się 10 sierpnia, a oficjalna premiera miała miejsce 24 sierpnia. Wszelkie relacje, które wciąż nazywają Wan 3.0 plotką lub niewydaną betą, są nieaktualne — włącznie z analizami „jeszcze nie ogłoszono”, które były trafne przed 6 sierpnia.
Czy Wan 3.0 dostanie otwarte wagi?
Nic w ogłoszeniu Alibaby na to nie wskazuje, powszechnie krążąca specyfikacja 1.3B + 14B odpowiada raczej Wan 2.1 niż czemukolwiek nowemu, a trajektoria tej rodziny modeli od czasu Wan 2.2 zmierza w stronę zamkniętych modeli wideo dostępnych wyłącznie przez API. Traktuj „open Wan 3.0” jako plotkę, dopóki nie pojawi się repozytorium lub licencja; ostatni schemat postępowania jest najmocniejszym dowodem przeciwko temu.
Ile kosztuje 30-sekundowy film Wan 3.0?
Przy podanych stawkach API około 36 juanów ($6.00) przy 1080p, 18 juanów ($3.00) przy 720p i 9 juanów ($1.50) przy 480p za klip. Są to ceny katalogowe Alibaba, za sekundę, a API jest teraz w pełni otwarte. Promocja startowa -30% obowiązuje do 23 września na Bailian i Qianwen AI.
Czy 30-sekundowe generowanie jest prawdziwe i na czym polega haczyk?
Generowanie 30-sekundowego wideo w jednym przebiegu to funkcja, z którą Alibaba wychodzi na prowadzenie – to najdłuższy natywny pojedynczy segment wśród chińskich modeli wideo, dwukrotnie dłuższy niż w Wan 2.7. Zastrzeżenia pochodzą od samego producenta: jakość dźwięku i dokładność tekstu na ekranie to uznane słabe punkty. Niezależny obraz daje werdykt areny Artificial Analysis z 3 września — #1 w edycji wideo (z dźwiękiem) i bliskie #2 w generowaniu tekstu na wideo z dźwiękiem — który mierzy ogólną jakość wyników na podstawie ślepych głosów, a nie testuje konkretnie górnego limitu 30 sekund.
Czy coś realnego faktycznie zostało stworzone z użyciem Wan 3.0?
Tak — sam spot reklamowy. Oficjalne konto Wan na X należące do Alibaba twierdzi, że kampania promocyjna Wan 3.0 została wyprodukowana przy użyciu tego modelu i opublikowało pełny opis prac: koncepcję, karty postaci, prompty oraz nieudane generacje. To przykład deklarowany przez dostawcę, a nie niezależny test, ale to autentyczne produkcyjne użycie zamkniętego API przez ludzi, którzy go sprzedają. Oficjalne konto Alibaba zaprezentowało również zewnętrznych twórców wykonujących prawdziwą pracę z tym modelem: wywiad z Liz Zhang z Pixmax_ai na temat filmu koncepcyjnego premiery oraz procesu twórczego wokół Wan 3.0. Ta sama etykieta — deklaracja dostawcy, wybór Alibaba — ale przenosi dowody produkcyjnego użycia poza marketing samego Alibaba.
Najważniejsze
Wan 3.0 jest prawdziwy, wystartował i ma agresywną politykę cenową — 30-sekundowe generowanie, zamiana dokumentów na wideo, stawki za sekundę, które w 720p przebijają główną konkurencję, a teraz także zewnętrzne ścieżki kreatywne przez narzędzie do wideo AI od Envato, Leonardo.Ai, ComfyUI, Pixmax i PowerDirector oraz platformę API do generowania wideo obsługującą model po stałej stawce 0,20 USD za sekundę. Najbardziej bezpośrednim dowodem, że to już oprogramowanie klasy produkcyjnej, jest sama kampania premierowa: Alibaba twierdzi, że reklama premiery Wan 3.0 powstała przy użyciu modelu, i opublikowała pełny rozpis produkcji — z kartami postaci i nieudanymi generacjami włącznie. W kolejnych dniach oficjalne konto pokazywało ten sam dowód, tyle że ze strony zewnętrznych twórców: wywiad z Liz Zhang z Pixmax_ai o filmie koncepcyjnym premiery i pełnym procesie twórczym wokół modelu. Należy się oprzeć narracji, która wokół niego urosła. Twierdzenie o otwartych wagach to odgrzewana plotka oparta na starych specyfikacjach, której przeczy oficjalna premiera. Opowieść o jakości nie jest już wyłącznie domeną Alibaby: w ciągu dziesięciu dni od premiery niezależna arena rankingowa uplasowała Wan 3.0 na 1. miejscu w edycji wideo (z dźwiękiem) i na bliskim 2. miejscu w generowaniu tekstu na wideo z dźwiękiem. Tym, co wciąż wymaga niezależnej weryfikacji, jest wszystko, co kryje się pod maską — architektura, liczba parametrów i każde twierdzenie, które zależy od uruchomienia modelu, a nie od głosowania na jego wyniki.
Ten odbiór mogłyby jeszcze zmienić konkretne rzeczy: karta modelu lub liczba parametrów odpowiedziałyby na otwarte pytania dotyczące architektury; repozytorium lub licencja przekształciłyby pogłoskę o otwartych wagach w rzeczywistość; a kontrolowany benchmark laboratoryjny — w przeciwieństwie do Elo z areny opublikowanego przez Artificial Analysis w tym tygodniu — zamieniłby twierdzenia o jakości w w pełni weryfikowalne fakty. Stan na tę aktualizację: trafne jednozdaniowe podsumowanie Wan 3.0 brzmi: potwierdzona, agresywnie wyceniona premiera, która zajmuje obecnie pierwsze miejsce w niezależnych rankingach edycji wideo i jest bliska drugiego w generowaniu wideo z tekstu z dźwiękiem — dostępna za pośrednictwem narzędzi kreatywnych innych firm (Envato, Leonardo.Ai, ComfyUI, Pixmax i PowerDirector) oraz zewnętrznej platformy API do generowania wideo — z otwartymi wagami, które, jak wskazują dowody, raczej się nie pojawią.
