
Qwen 4 Max kontra DeepSeek V4 Pro: 95 miliardów aktywnych parametrów przeciwko 49 miliardom
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Ogłoszenie Qwen 4 Max na konferencji Yunqi 22 września 2026 r. dało branży nazwę i strukturę poziomów, i nic więcej — żadnych wag, żadnej ceny, żadnego okna kontekstowego, żadnej daty. DeepSeek V4 Pro jest wymieniany od 24 kwietnia 2026 r. jako mieszanina ekspertów o 1,6 biliona parametrów, z 49 miliardami parametrów aktywnych na token, kontekstem 1 miliona tokenów i ceną poza szczytem wynoszącą 0,66 USD za milion tokenów wejściowych oraz 1,98 USD za milion tokenów wyjściowych. Liczba, którą warto zestawić obok siebie, to nie całkowita liczba parametrów, lecz liczba aktywnych: ostatni opublikowany Qwen3.8-Max aktywuje 95 miliardów parametrów na token, około dwukrotnie więcej niż 49 miliardów aktywnych parametrów, które uruchamia DeepSeek V4 Pro, a ta jedna liczba odpowiada za większość trzykrotnej różnicy w cenie między oboma laboratoriami, jeszcze przed uwzględnieniem choćby jednego benchmarku.
Dwa różne zakłady na rzadkość
Oba laboratoria tworzą rzadkie modele typu mixture-of-experts. Nie zgadzają się jednak zdecydowanie co do tego, jak rzadkie powinny być. Qwen3.8-Max — flagowy, produkcyjny model Qwen i jedyny konkretny punkt odniesienia dla tego, jak będzie wyglądać Qwen 4 Max — to model o 2,4 biliona parametrów, który aktywuje 95 miliardów parametrów na token, czyli stosunek około jednej części na dwadzieścia pięć. DeepSeek V4 Pro to model o 1,6 biliona parametrów, który aktywuje 49 miliardów, czyli stosunek około jednej części na trzydzieści trzy, a swoje wagi ekspertów przechowuje w FP4, pozostawiając warstwy uwagi, routera i normalizacji w FP8, co dodatkowo obniża koszt obliczeń na token.
To nie są różnice w dostrajaniu. To dwie różne odpowiedzi na to samo pytanie — ile model czołowy powinien wydawać na token:
• Całkowita liczba parametrów — flagowy Qwen 3.8 2,4T kontra DeepSeek V4 Pro 1,6T
• Aktywne na token — flagowy Qwen 3.8 95B kontra DeepSeek V4 Pro 49B
• Wskaźnik aktywacji — około 1 na 25 w porównaniu z około 1 na 33
• Cena tokenów wejściowych poza godzinami szczytu — Qwen3.8-Max $2.00 za 1 mln w porównaniu z DeepSeek V4 Pro $0.66 za 1 mln
• Cena wyjściowa, poza szczytem — Qwen3.8-Max 6,00 USD za 1 mln w porównaniu z DeepSeek V4 Pro 1,98 USD za 1 mln
• Flagowe wagi — flagowy model Qwen 3.8 na niestandardowej licencji Qwen kontra DeepSeek V4 Pro opublikowany na licencji MIT
• Kontekst — Qwen3.8-Max 1 mln tokenów kontra DeepSeek V4 Pro 1 mln tokenów
• Modalność — Qwen3.8-Max: dane wejściowe tekstowe, obrazowe i wideo w porównaniu z DeepSeek V4 Pro, obsługującym wyłącznie tekst w swojej ofercie
• Zaobserwowana latencja — Qwen3.8-Max p50 czasu do pierwszego tokena 3,29 s w porównaniu z DeepSeek V4 Pro 3,52 s na tym samym katalogu
Tym razem różnica w rzadkości i różnica w cenie wskazują w tym samym kierunku, który nie jest kierunkiem sugerowanym przez łączną liczbę parametrów. Qwen aktywuje na token około dwa razy więcej parametrów niż DeepSeek i pobiera około trzy razy wyższą opłatę, a sama rzadkość nie zamyka tej luki. To, co zamyka resztę, to modalność: flagowy model Qwen ma w sobie kodery wizji i wideo, za które płaci się przy każdym żądaniu, niezależnie od tego, czy znajduje się w nim obraz, i dlatego stawka za wejście jest taka, jaka jest. DeepSeek V4 Pro przyjmuje tekst i zwraca tekst, a jego cena jest ustalona jak za model, który robi tylko to.
Jedno zastrzeżenie należy umieścić w kolumnie DeepSeek, zanim zostanie ona użyta do czegokolwiek. DeepSeek stosuje cennik według harmonogramu szczytowego i pozaszczytowego: kwoty 0,66 USD i 1,98 USD to stawki pozaszczytowe, a w oknach szczytu — od 01:00 do 04:00 i od 06:00 do 10:00 UTC w dni robocze, z wyłączeniem chińskich świąt publicznych — ten sam model jest rozliczany po 1,32 USD za dane wejściowe i 3,96 USD za dane wyjściowe. Wszystko inne, w tym wszystkie weekendy i święta, należy do okresu pozaszczytowego. Stawka, którą płacisz, zależy zatem od tego, kiedy przypada Twój ruch, a model kosztów oparty wyłącznie na stawce pozaszczytowej będzie błędny dla każdego obciążenia, które obejmuje poranek w dni robocze.

Kolumna Qwen 4 Max jest pusta i nie jest to stan tymczasowy
Kuszące jest wypełnienie porównania założeniem, że Qwen 4 Max znajdzie się blisko wyników Qwen 3.8 i zostanie wyceniony poniżej nich. Oprzyj się temu. Alibaba opisała architekturę Qwen 4 jako nową generację i powiedziała, że jest w fazie treningu; jedynym wydanym artefaktem opisującym tę architekturę jest Qwen3.8-Flash-Next, udostępniony jako open source pod koniec sierpnia 2026 r. i oznaczony na własnej karcie modelu jako zapowiedź projektu Qwen 4. To główny model o 125 miliardach parametrów, z 51 miliardami parametrów osadzeń N-gram, z których około 6 miliardów aktywuje się na krok, z rzadką uwagą QSA, bramkowanymi połączeniami rezydualnymi i natywnym kontekstem 262 000 tokenów rozszerzalnym do 1 miliona.
Jeśli ten projekt skaluje się do poziomu Max, liczba aktywnych parametrów powinna pozostać w dziesiątkach miliardów, a nie rosnąć w stronę całkowitej liczby parametrów DeepSeek — utrzymanie obliczeń na krok w przybliżeniu na stałym poziomie wraz ze wzrostem całkowitej liczby parametrów jest całym sensem QSA oraz osadzeń N-gram, które są wyszukiwane, a nie obliczane gęsto. To kierunek, a nie specyfikacja, i nie należy tego drukować jako specyfikacji.
To, co jest teraz poznawalne, to asymetria operacyjna. Model, który istnieje, można zmierzyć na twoim obciążeniu; modelu, który nie istnieje, nie można zmierzyć na niczym. Qwen 4 Max będzie osiągalny, gdy zostanie wydany, przez własne API dostawcy i kilka platform firm trzecich — tą samą ścieżką, którą obrał każdy flagowy produkt Alibaby. Nie ma go dziś w OrcaRouter: katalog ma zero wpisów dla rodziny Qwen 4. DeepSeek V4 Pro jest teraz w OrcaRouter, podobnie jak jego snapshot z datą.
Odtwarzalność to argument, którego nikt nie wysuwa.
DeepSeek dostarcza datowane migawki i utrzymuje je jako adresowalne. Katalog zawiera zarówno pływający identyfikator DeepSeek V4 Pro, jak i przypięty wariant z 2026-08-13 — przy czym ta data to kompilacja, którą sam DeepSeek wyznaczył jako wydanie ogólnie dostępne. To nieefektowne i ma większe znaczenie niż różnica w wynikach benchmarku dla każdego, kto uruchamia środowisko ewaluacyjne lub potok kontrolowany pod kątem zgodności: gdy przypinasz migawkę, twój zestaw testów regresyjnych mierzy twój kod, a nie rytm wydań dostawcy.
Generacja Qwen 3.8 zrobiła to samo — w tym samym katalogu obok pływającej nazwy znajduje się datowany snapshot Qwen3.8-Max — i nie ma powodu sądzić, że Alibaba przestanie to robić. Jest to jednak cecha wydanych modeli i warto powiedzieć wprost, że w dniu ogłoszenia Qwen 4 Max nie będzie miał snapshotu do przypięcia, stabilnego identyfikatora, względem którego można testować, ani sposobu, by przeprowadzić porównanie przed i po na własnych danych. Jakiekolwiek porównanie chcesz przeprowadzić, zrobisz je później.

Uruchamianie obu bez uruchamiania dwóch stosów
OrcaRouter kieruje DeepSeek V4 Pro jako deepseek/deepseek-v4-pro w cenie 0,66 USD za tokeny wejściowe i 1,98 USD za tokeny wyjściowe za milion tokenów, co stanowi własną cenę katalogową DeepSeek obowiązującą poza godzinami szczytu, przekazaną dalej z 0% marży. Ten ostatni element jest tu wart więcej niż w innych miejscach w tej partii, ponieważ 1,98 USD za wyjście jest już blisko dolnej granicy dla modelu klasy frontier: marża platformy wynosząca choćby dziesięć procent stanowiłaby jedną piątą różnicy między tym modelem a alternatywą średniej klasy, a przy 0% marży stawka widoczna na stronie to stawka publikowana przez DeepSeek — wraz z podziałem na godziny szczytu i poza szczytem, który jest przekazywany według tego samego harmonogramu, a nie uśredniany do jednej płaskiej stawki.
Ten sam punkt końcowy obsługuje rodzinę Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash i Qwen3.8-27B — obok DeepSeek V4 Pro, w ramach jednego API zgodnego z OpenAI, z blisko 200 modelami, z automatycznym przełączaniem awaryjnym, gdy ścieżka dostawcy ulega degradacji, oraz DSL routingu pozwalającym określić wybór wprost, zamiast zakodowywać go na sztywno. Jeśli DeepSeek obniży stawkę, zmiana trafia na Twój klucz tego samego dnia, bo nie ma warstwy marży, za którą obniżka mogłaby utknąć. Gdy pojawi się poziom Qwen 4, to właśnie w tym samym katalogu się znajdzie.
Gdzie cię to stawia
DeepSeek V4 Pro wygrywa to porównanie przez walkower i warto być precyzyjnym co do tego dlaczego, zamiast to upiększać. Jest tańszy w obu wymiarach o czynnik około trzech, aktywuje pięć razy więcej parametrów na token, jego okno kontekstowe jest takie samo i ma opatrzony datą snapshot, który można przypiąć. Qwen 4 Max ma nazwę poziomu i miejsce na konferencji.
Porównaniem, które jest obecnie faktycznie aktualne, jest DeepSeek V4 Pro kontra Qwen3.8-Max, i jest to prawdziwy wybór, a nie jednostronna klęska: DeepSeek to model wyłącznie tekstowy za około jedną trzecią ceny, z wagami opublikowanymi na licencji MIT i szczuplejszym profilem aktywacji na token, a flagowy model Qwen obsługuje obrazy i wideo na wejściu za 2,00 USD i 6,00 USD. Oceniaj pod kątem modalności i zmierzonego kosztu na ukończone zadanie, a nie liczby parametrów, i powtórz porównanie, gdy Alibaba opublikuje kartę modelu — wtedy ciekawym pytaniem będzie, czy Qwen 4 Max wycenia swoje możliwości multimodalne powyżej stawki DeepSeeka za tekst o mniej, niż robi to dziś.

Porównane w tym artykule4
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
