
Qwen 4 Max ogłoszony na Apsara 2026: co Alibaba potwierdził, a czego nie
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Konferencja Yunqi w Hangzhou — Apsara Conference — posłużyła 22 września 2026 r. do pokazania czterech modeli, które nie zostały jeszcze wydane. Liu Da Yiheng, lider ds. LLM w laboratorium, zaprezentował na scenie Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus i Qwen 4 27B, opisał tę rodzinę jako trenowaną na architekturze nowej generacji i powiedział jedynie, że pojawi się wkrótce. W chwili pisania tego tekstu nie ma karty modelu dla żadnego z tych czterech, otwartych wag, identyfikatora API, okna kontekstowego, ceny ani wyniku benchmarku. Najnowszym flagowcem, który faktycznie można dziś wywołać, jest Qwen3.8-Max, ogólnie dostępny od 3 sierpnia 2026 r., a ten dystans między zapowiedzią na scenie a wywoływalnym endpointem to część tej historii, którą warto uważnie przeczytać.
Cztery poziomy i czym każdy z nich ma być
Linia Qwen firmy Alibaba jest organizowana w poziomy możliwości od generacji Qwen 3, a ogłoszenie Qwen 4 zachowało ten układ, zamiast go zastąpić. To, co pokazano na scenie, było zestawieniem, a nie kartą specyfikacji:
• Qwen 4 Max — flagowa półka i ten, który Alibaba przeciwstawia najlepszemu modelowi z każdego innego czołowego laboratorium
• Qwen 4 Flash — poziom o wysokiej przepustowości, stworzony z myślą o zadaniach wrażliwych na opóźnienia i o dużej skali, a nie o szczytowej mocy rozumowania
• Qwen 4 Plus — zrównoważona średnia półka, historycznie ta o najszerszym zakresie wsparcia multimodalnego
• Qwen 4 27B — lokalna warstwa z otwartymi wagami, ta, którą pobierają, dostrajają i kwantyzują osoby, które nigdy nie korzystają z hostowanego API
• Architektura — opisywana jako nowa generacja i opisywana jako będąca w trakcie treningu, co nie jest tym samym, co bycie ukończoną
• Podstawowe obciążenie — zadania agentowe i korzystające z narzędzi, zgodnie z ujęciem konferencji, a nie czat
• Dostępność — brak. Żaden z poziomów nie ma daty wydania, ceny, okna kontekstowego, listy modalności ani opublikowanego wyniku
Poziom 27B jest tym, na który warto zwrócić uwagę, z powodu, który nie ma nic wspólnego z benchmarkami. To jedyny poziom w rodzinie, który historycznie był wydawany na otwartych wagach, a generacja Qwen 3.8 pokazała, jak wiele niezależnej pracy to odblokowuje: w ciągu kilku dni od pojawienia się wag 27B społeczność przygotowała konwersje MLX, kwantyzacje NVFP4 i nieocenzurowane wersje dostrojone. Zapowiedziany 27B to obietnica całego ekosystemu downstream, a to część tego planu, której realizacja jest najbardziej przewidywalna.
Liczba 5–10 bilionów parametrów nie należy do Qwen 4.
Relacjonowanie konferencji było nieprecyzyjne w kwestii jednej liczby. Docelowa wartość „5 do 10 bilionów parametrów”, która krążyła wraz z informacjami o Qwen 4, nie jest specyfikacją Qwen 4 — to stwierdzenie wybiegające w przyszłość, dotyczące kolejnych generacji, czyli horyzontu Qwen 4.5 i Qwen 5. Alibaba nie przypisała Qwen 4 Max żadnej liczby parametrów, a na podstawie dostępnych dowodów podanie takiej liczby byłoby błędem.
Ma to znaczenie, ponieważ liczba parametrów jest tym, na czym czytelnicy się opierają, i tym, co się rozprzestrzenia. Twierdzenie o 5T parametrów przypisane modelowi bez opublikowanej architektury jest niefalsyfikowalne w obu kierunkach: nikt nie może go potwierdzić i nikt nie może go poprawić, gdy zostanie już powtórzone. Jeśli w tym tygodniu zobaczysz Qwen 4 Max opisywany jako model o wielu bilionach parametrów, liczba ta została zapożyczona z innego slajdu.
Co można uczciwie powiedzieć, to że poprzedni flagowy model to mieszanka ekspertów o 2,4 biliona parametrów, z 95 miliardami parametrów aktywnych na token, potwierdzona na oficjalnej karcie modelu Qwen3.8-Max oraz w wydaniu z otwartymi wagami, które po nim nastąpiło. Cokolwiek okaże się Qwen 4 Max, to jest punkt odniesienia, który musi przebić, i jest to opublikowana, możliwa do sprawdzenia liczba, a nie aspiracja z planu rozwoju.

Architektura nie jest plotką: jej podglądowa wersja już została wydana.
Najbardziej przydatną rzeczą w ogłoszeniu Qwen 4 jest to, że część architektury została już udostępniona pod inną nazwą. Qwen3.8-Flash-Next został udostępniony jako open source pod koniec sierpnia 2026 r., a jego karta modelu wprost określa go jako zapowiedź architektury Qwen 4. To czyni go jedynym konkretnym dowodem, jaki ktokolwiek spoza Alibaba ma na temat tego, jak zbudowana jest rodzina Qwen 4.
To rzadki model o 125 miliardach parametrów głównych oraz 51 miliardach parametrów osadzeń N-gramowych, aktywujący około 6 miliardów na każdy krok wnioskowania. Ma natywny kontekst 262 000 tokenów, który według karty rozciąga się w stronę 1 miliona, a Alibaba podaje, że został wytrenowany przy koszcie około 90 procent niższym niż Qwen3.7-Plus. Na karcie wymieniono trzy techniki:
• QSA, specyficzny dla Qwena schemat rzadkiej uwagi, będący mechanizmem stojącym za twierdzeniem o tanim treningu z długim kontekstem
• Bramkowane połączenia rezydualne, miara stabilności dla głębokich rzadkich sieci
• Embeddingi N-gramowe, osobny 51-miliardowy magazyn parametrów, który jest wyszukiwany, a nie obliczany w sposób gęsty
Jeśli cztery poziomy Qwen 4 odziedziczą ten projekt, ciekawą konsekwencją będzie ekonomia, a nie architektura. Rodzina zaprojektowana tak, by osiągnąć jakość zbliżoną do czołówki przy około jednej dziesiątej kosztu treningu, to rodzina, którą można agresywnie wycenić, a agresywna polityka cenowa Alibaby od dwóch lat jest najbardziej niezawodną siłą w ekonomii modeli z otwartymi wagami. To prognoza, nie fakt, i jako prognozę należy ją oznaczyć — ale właśnie dlatego warto śledzić ten plan rozwoju, a nie go odrzucać.
Co uruchomić w czasie oczekiwania
Nic w ogłoszeniu Qwen 4 nie zmienia tego, co jest dostępne w tym tygodniu, a uczciwa odpowiedź dla każdego, kto buduje dziś, to generacja Qwen 3.8. Qwen3.8-Max jest ogólnie dostępny od 3 sierpnia 2026 r. w cenie 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, z jednakową stawką w całym kontekście 1 miliona tokenów i bez dopłaty za długie prompty, a jego wagi opublikowano 12 sierpnia 2026 r. jako Qwen3.8-2.4T-A95B zarówno w BF16, jak i FP8 na podstawie niestandardowej licencji Qwen. To model, względem którego będą oceniane poziomy Qwen 4, i już dziś obsługuje ruch produkcyjny.
Jeśli chcesz porównać dostępną generację Qwen z resztą czołówki, nie zarządzając osobnym kontem, kluczem i rachunkiem dla każdego laboratorium, OrcaRouter oferuje rodzinę Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash i Qwen3.8-27B — obok Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro Preview i GLM 5.3 w jednym punkcie końcowym zgodnym z OpenAI. To jedno API dla blisko 200 modeli bez marży, co oznacza, że cena katalogowa dostawcy jest przekazywana bez zmian, więc obniżka ceny przez dostawcę trafia na Twój klucz tego samego dnia, a nie w następnym cyklu rozliczeniowym. Gdy poziom Qwen 4 faktycznie się pojawi, to właśnie w tym samym katalogu by się znalazł; dziś żaden z nich nie jest dostępny.

Najważniejsze
Qwen 4 Max to prawdziwa zapowiedź, a nie prawdziwy produkt — i obie części tego zdania mają znaczenie. Lista jest potwierdzona: cztery poziomy, architektura nowej generacji, nacisk na agentowość oraz poziom 27B z otwartymi wagami, który będzie miał większe znaczenie dla większej liczby osób niż flagowiec. Brakuje wszystkiego, co jest potrzebne do decyzji zakupowej — ceny, kontekstu, modalności, wag, wyników, daty.
Traktuj to jako sygnał z roadmapy z wyjątkowo dobrą dokumentacją, ponieważ wydanie Qwen3.8-Flash-Next daje ci podgląd architektury za darmo, a Qwen3.8-Max daje ci obowiązujący punkt odniesienia z opublikowanymi wagami i opublikowaną ceną. Śledź poziom 27B ze względu na ekosystem, który stworzy, oraz poziom Flash ze względu na ekonomikę przepustowości. Nie publikuj ponownie liczby 5–10 bilionów parametrów jako faktu o Qwen 4 i nie planuj migracji wokół modelu, który nie ma daty wydania — zaplanuj ją wokół Qwen3.8-Max i przeprowadź migrację, gdy będzie endpoint, do którego można się przenieść.

Porównane w tym artykule2
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
