Karta tytułowa hero dla „Qwen 4 Max ogłoszony na Apsara 2026” z podtytułem „Co potwierdził Alibaba, a czego nie”, trzema plakietkami typu pill o treści „Zapowiedziano 4 poziomy”, „0 opublikowanych specyfikacji” i „22 września 2026” oraz logo OrcaRouter w prawym dolnym rogu.
Guides & Insights

Qwen 4 Max ogłoszony na Apsara 2026: co Alibaba potwierdził, a czego nie

Autor

Alistair Wren

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Konferencja Yunqi w Hangzhou — Apsara Conference — posłużyła 22 września 2026 r. do pokazania czterech modeli, które nie zostały jeszcze wydane. Liu Da Yiheng, lider ds. LLM w laboratorium, zaprezentował na scenie Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus i Qwen 4 27B, opisał tę rodzinę jako trenowaną na architekturze nowej generacji i powiedział jedynie, że pojawi się wkrótce. W chwili pisania tego tekstu nie ma karty modelu dla żadnego z tych czterech, otwartych wag, identyfikatora API, okna kontekstowego, ceny ani wyniku benchmarku. Najnowszym flagowcem, który faktycznie można dziś wywołać, jest Qwen3.8-Max, ogólnie dostępny od 3 sierpnia 2026 r., a ten dystans między zapowiedzią na scenie a wywoływalnym endpointem to część tej historii, którą warto uważnie przeczytać.

Cztery poziomy i czym każdy z nich ma być

Linia Qwen firmy Alibaba jest organizowana w poziomy możliwości od generacji Qwen 3, a ogłoszenie Qwen 4 zachowało ten układ, zamiast go zastąpić. To, co pokazano na scenie, było zestawieniem, a nie kartą specyfikacji:

• Qwen 4 Max — flagowa półka i ten, który Alibaba przeciwstawia najlepszemu modelowi z każdego innego czołowego laboratorium

• Qwen 4 Flash — poziom o wysokiej przepustowości, stworzony z myślą o zadaniach wrażliwych na opóźnienia i o dużej skali, a nie o szczytowej mocy rozumowania

• Qwen 4 Plus — zrównoważona średnia półka, historycznie ta o najszerszym zakresie wsparcia multimodalnego

• Qwen 4 27B — lokalna warstwa z otwartymi wagami, ta, którą pobierają, dostrajają i kwantyzują osoby, które nigdy nie korzystają z hostowanego API

• Architektura — opisywana jako nowa generacja i opisywana jako będąca w trakcie treningu, co nie jest tym samym, co bycie ukończoną

• Podstawowe obciążenie — zadania agentowe i korzystające z narzędzi, zgodnie z ujęciem konferencji, a nie czat

• Dostępność — brak. Żaden z poziomów nie ma daty wydania, ceny, okna kontekstowego, listy modalności ani opublikowanego wyniku

Poziom 27B jest tym, na który warto zwrócić uwagę, z powodu, który nie ma nic wspólnego z benchmarkami. To jedyny poziom w rodzinie, który historycznie był wydawany na otwartych wagach, a generacja Qwen 3.8 pokazała, jak wiele niezależnej pracy to odblokowuje: w ciągu kilku dni od pojawienia się wag 27B społeczność przygotowała konwersje MLX, kwantyzacje NVFP4 i nieocenzurowane wersje dostrojone. Zapowiedziany 27B to obietnica całego ekosystemu downstream, a to część tego planu, której realizacja jest najbardziej przewidywalna.

Liczba 5–10 bilionów parametrów nie należy do Qwen 4.

Relacjonowanie konferencji było nieprecyzyjne w kwestii jednej liczby. Docelowa wartość „5 do 10 bilionów parametrów”, która krążyła wraz z informacjami o Qwen 4, nie jest specyfikacją Qwen 4 — to stwierdzenie wybiegające w przyszłość, dotyczące kolejnych generacji, czyli horyzontu Qwen 4.5 i Qwen 5. Alibaba nie przypisała Qwen 4 Max żadnej liczby parametrów, a na podstawie dostępnych dowodów podanie takiej liczby byłoby błędem.

Ma to znaczenie, ponieważ liczba parametrów jest tym, na czym czytelnicy się opierają, i tym, co się rozprzestrzenia. Twierdzenie o 5T parametrów przypisane modelowi bez opublikowanej architektury jest niefalsyfikowalne w obu kierunkach: nikt nie może go potwierdzić i nikt nie może go poprawić, gdy zostanie już powtórzone. Jeśli w tym tygodniu zobaczysz Qwen 4 Max opisywany jako model o wielu bilionach parametrów, liczba ta została zapożyczona z innego slajdu.

Co można uczciwie powiedzieć, to że poprzedni flagowy model to mieszanka ekspertów o 2,4 biliona parametrów, z 95 miliardami parametrów aktywnych na token, potwierdzona na oficjalnej karcie modelu Qwen3.8-Max oraz w wydaniu z otwartymi wagami, które po nim nastąpiło. Cokolwiek okaże się Qwen 4 Max, to jest punkt odniesienia, który musi przebić, i jest to opublikowana, możliwa do sprawdzenia liczba, a nie aspiracja z planu rozwoju.

A two-column scoreboard titled "Qwen 4 Max vs the model you can call today". Left column Qwen 4 Max: Release date not given, Input price not given, Output price not given, Context window not given, Open weights not given, Benchmarks not given. Right column Qwen3.8-Max: Release date August 3 2026, Input price $2.00 per 1M tokens, Output price $6.00 per 1M tokens, Context window 1M tokens, Open weights published August 12 2026, Benchmarks vendor and independent. Footer reads "Qwen 4 Max status per Alibaba's September 22 2026 conference; Qwen3.8-Max from its published model card.", with the OrcaRouter logo bottom-right.

Architektura nie jest plotką: jej podglądowa wersja już została wydana.

Najbardziej przydatną rzeczą w ogłoszeniu Qwen 4 jest to, że część architektury została już udostępniona pod inną nazwą. Qwen3.8-Flash-Next został udostępniony jako open source pod koniec sierpnia 2026 r., a jego karta modelu wprost określa go jako zapowiedź architektury Qwen 4. To czyni go jedynym konkretnym dowodem, jaki ktokolwiek spoza Alibaba ma na temat tego, jak zbudowana jest rodzina Qwen 4.

To rzadki model o 125 miliardach parametrów głównych oraz 51 miliardach parametrów osadzeń N-gramowych, aktywujący około 6 miliardów na każdy krok wnioskowania. Ma natywny kontekst 262 000 tokenów, który według karty rozciąga się w stronę 1 miliona, a Alibaba podaje, że został wytrenowany przy koszcie około 90 procent niższym niż Qwen3.7-Plus. Na karcie wymieniono trzy techniki:

• QSA, specyficzny dla Qwena schemat rzadkiej uwagi, będący mechanizmem stojącym za twierdzeniem o tanim treningu z długim kontekstem

• Bramkowane połączenia rezydualne, miara stabilności dla głębokich rzadkich sieci

• Embeddingi N-gramowe, osobny 51-miliardowy magazyn parametrów, który jest wyszukiwany, a nie obliczany w sposób gęsty

Jeśli cztery poziomy Qwen 4 odziedziczą ten projekt, ciekawą konsekwencją będzie ekonomia, a nie architektura. Rodzina zaprojektowana tak, by osiągnąć jakość zbliżoną do czołówki przy około jednej dziesiątej kosztu treningu, to rodzina, którą można agresywnie wycenić, a agresywna polityka cenowa Alibaby od dwóch lat jest najbardziej niezawodną siłą w ekonomii modeli z otwartymi wagami. To prognoza, nie fakt, i jako prognozę należy ją oznaczyć — ale właśnie dlatego warto śledzić ten plan rozwoju, a nie go odrzucać.

Co uruchomić w czasie oczekiwania

Nic w ogłoszeniu Qwen 4 nie zmienia tego, co jest dostępne w tym tygodniu, a uczciwa odpowiedź dla każdego, kto buduje dziś, to generacja Qwen 3.8. Qwen3.8-Max jest ogólnie dostępny od 3 sierpnia 2026 r. w cenie 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, z jednakową stawką w całym kontekście 1 miliona tokenów i bez dopłaty za długie prompty, a jego wagi opublikowano 12 sierpnia 2026 r. jako Qwen3.8-2.4T-A95B zarówno w BF16, jak i FP8 na podstawie niestandardowej licencji Qwen. To model, względem którego będą oceniane poziomy Qwen 4, i już dziś obsługuje ruch produkcyjny.

Jeśli chcesz porównać dostępną generację Qwen z resztą czołówki, nie zarządzając osobnym kontem, kluczem i rachunkiem dla każdego laboratorium, OrcaRouter oferuje rodzinę Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash i Qwen3.8-27B — obok Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro Preview i GLM 5.3 w jednym punkcie końcowym zgodnym z OpenAI. To jedno API dla blisko 200 modeli bez marży, co oznacza, że cena katalogowa dostawcy jest przekazywana bez zmian, więc obniżka ceny przez dostawcę trafia na Twój klucz tego samego dnia, a nie w następnym cyklu rozliczeniowym. Gdy poziom Qwen 4 faktycznie się pojawi, to właśnie w tym samym katalogu by się znalazł; dziś żaden z nich nie jest dostępny.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the on-page nav, the 1M token context badge, the model ID qwen/qwen3.8-max, multi-modality shown as text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, the code-samples panel with the OpenAI-compatible Python import, the Public benchmarks and Community buzz blocks, and the opening line of the model description calling Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

Najważniejsze

Qwen 4 Max to prawdziwa zapowiedź, a nie prawdziwy produkt — i obie części tego zdania mają znaczenie. Lista jest potwierdzona: cztery poziomy, architektura nowej generacji, nacisk na agentowość oraz poziom 27B z otwartymi wagami, który będzie miał większe znaczenie dla większej liczby osób niż flagowiec. Brakuje wszystkiego, co jest potrzebne do decyzji zakupowej — ceny, kontekstu, modalności, wag, wyników, daty.

Traktuj to jako sygnał z roadmapy z wyjątkowo dobrą dokumentacją, ponieważ wydanie Qwen3.8-Flash-Next daje ci podgląd architektury za darmo, a Qwen3.8-Max daje ci obowiązujący punkt odniesienia z opublikowanymi wagami i opublikowaną ceną. Śledź poziom 27B ze względu na ekosystem, który stworzy, oraz poziom Flash ze względu na ekonomikę przepustowości. Nie publikuj ponownie liczby 5–10 bilionów parametrów jako faktu o Qwen 4 i nie planuj migracji wokół modelu, który nie ma daty wydania — zaplanuj ją wokół Qwen3.8-Max i przeprowadź migrację, gdy będzie endpoint, do którego można się przenieść.

A screenshot of the OrcaRouter model catalogue at www.orcarouter.ai/models (English UI), showing the header reading "199 models, 15 providers, one API key, one bill", the sort and filter rail with Newest selected alongside controls for input modalities and context length, the "How to call any model" panel showing a POST to api.orcarouter.ai/v1/chat/completions with a model and messages JSON body, and the first catalogue cards including openai/gpt-5-mini with a 200 Status badge.

Porównane w tym artykule2

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie