
Qwen3.8-27B z otwartymi wagami: Max się ukazał, 27B nie — co wiemy teraz
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 36 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 181 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
13 sierpnia 2026 roku tydzień otwartych wag, który Alibaba obiecała dla swojej generacji Qwen3.8, rozpadł się na dwa. Wagi flagowca klasy Max — Qwen3.8-2.4T-A95B, model sparse mixture-of-experts o 2,4 biliona parametrów i pierwsze w historii wydanie Qwen na poziomie Max, które w ogóle można było pobrać — faktycznie się ukazało, na Hugging Face i ModelScope, ogłoszone późnym wieczorem poprzedniej nocy za pośrednictwem społeczności ModelScope. Mniejszy model, o którym jest ta strona, Qwen3.8-27B, nie: zaplanowany na ten sam tydzień, czyli na tydzień od 10 sierpnia, wciąż nie ma oficjalnego repozytorium, karty modelu, pliku licencyjnego ani własnego benchmarku, a zewnętrzne serwisy śledzące opisują jego wydanie jako opóźnione, bez podania nowej daty. Pytanie, na które ta strona „co wiemy do tej pory” miała odpowiedzieć — „kiedy właściwie wyjdzie 27B?” — zmieniło się w dwa pytania: dlaczego wagi Maxa ukazały się pierwsze i co się stało z 27B?
To wciąż podsumowanie tego, co wiemy do tej pory, a nie recenzja. Qwen3.8-Max, flagowy model API, jest dostępny od 3 sierpnia w cenie 2/6 USD za milion tokenów; jego bazowy model o otwartych wagach, Qwen3.8-2.4T-A95B, został udostępniony do pobrania 13 sierpnia, a wagi Qwen3.8-27B nadal nie zostały opublikowane. Każde poniższe twierdzenie jest odpowiednio oznaczone jako potwierdzone, zgłoszone przez producenta lub oszacowane przez społeczność.
Sygnał i to, co tydzień faktycznie przyniósł
Wczesnym sygnałem był post na X autorstwa @kimmonismus, który wskazał „przyszły tydzień” jako ten, na który warto czekać: „Qwen-3.8 27b - Grok 4.6,” z listy wyraźnie nieobecna była Astra. Połowa Groka z tego tygodnia ukazała się 12 sierpnia. Połowa modelu Qwen rozdzieliła się na dwie części. To, co uchwycił ten post, to nastrój panujący wśród ludzi, którzy zawodowo śledzą premiery modeli — wydanie modelu Qwen3.8 z otwartymi wagami było wydarzeniem w kalendarzu, a tydzień nadszedł, a szczegóły wciąż nie były dopięte. Tydzień później szczegóły częściowo się wyjaśniły: jedna z dwóch obiecanych premier z otwartymi wagami już się ukazała i nie była to ta, którą wymienił post.
Co jest potwierdzone
• Rodzina jest prawdziwa i oficjalnie ogłoszona.Alibaba zaprezentował rodzinę modeli bazowych Qwen3.8 3 sierpnia 2026 r., po wersji zapoznawczej w połowie lipca.
• Qwen3.8-Max ukazał się tego samego dnia. Flagowy model API — będący mieszanką ekspertów o 2,4 biliona parametrów, z około 95 mld aktywnych parametrów, oknem kontekstowym 1M tokenów oraz obsługą tekstu, obrazu i wideo — zadebiutował w API Qwen w cenie $2/$6 za milion tokenów. Jest także dostępny przez OrcaRouter w tej samej cenie katalogowej, z zerową marżą (0%).
• Otwarte wagi modelu Max zostały udostępnione 13 sierpnia. Qwen3.8-2.4T-A95B — model bazowy, na którym opiera się API Qwen3.8-Max — stał się dostępny do pobrania z Hugging Face i ModelScope, wraz z wersją skwantyzowaną FP8. To pierwsza w historii publikacja otwartych wag Qwen na poziomie Max. Model do pobrania jest wyłącznie tekstowy, z wymuszonym trybem myślenia, ma natywny kontekst 256K tokenów, rozszerzalny do około 1M, i działa na SGLang, vLLM oraz TokenSpeed.
• Qwen3.8-27B to mniejszy model rodziny o otwartych wagach — nadal nie został udostępniony. Alibaba przedstawił go jako realistyczną ścieżkę do wdrożeń lokalnych i on-premise oraz zobowiązał się do udostępnienia jego wag na Hugging Face i ModelScope, obok wag modelu Max. Na dzień 13 sierpnia wciąż nie ma oficjalnego repozytorium Qwen3.8-27B. Zobowiązanie było realne; dostawa jeszcze nie nastąpiła.
• Powstał pierwszy niezależny wynik dla tej generacji. Artificial Analysis ocenia Qwen3.8-Max na wskaźnik inteligencji 56 przy około 1,14 dolara za zadanie — naprawdę dobrze, z zastrzeżeniami, jakie niesie każdy kilkudniowy flagowiec.
Co tak naprawdę wiemy o 27B
Uczciwe podsumowanie jest takie, że „Qwen3.8-27B" to wciąż w większości nazwa i liczba parametrów. Potwierdzone fakty są takie, że jest to model o około 27 miliardach parametrów, że jest członkiem generacji Qwen3.8 z otwartymi wagami i że jest przeznaczony do pracy na pojedynczym GPU i lokalnie, a nie na klastrze z setkami GPU. Daniel Han z Unsloth podaje, że po wydaniu powinien zmieścić się w około 17 GB VRAM — czyli na jednej karcie klasy prosumenckiej.
Wszystko inne jest niepotwierdzone. Alibaba nie opublikował ani tego, czy 27B jest modelem gęstym, czy mieszanką ekspertów, ani jego okna kontekstowego, ani jakie modalności przyjmuje, ani żadnych własnych wyników benchmarków. To, co zmieniło się w tym tygodniu, to termin: Max i 27B zapowiedziano na ten sam tydzień, a dotarł tylko Max. Zewnętrzne trackery odnotowują teraz opóźnienie 27B bez nowej daty — to odczyt społeczności, nie oficjalne oświadczenie Alibaby, i możliwe, że repozytorium wciąż pojawi się, zanim zapowiedziany tydzień dobiegnie końca. Jednak w momencie pisania tych słów oficjalna organizacja Qwen na Hugging Face nie wymienia Qwen3.8-27B, a kilka repozytoriów „Qwen3.8-27B-FP8”, „-GGUF” i „-MLX”, które pojawiają się w wynikach wyszukiwania, to społecznościowe karty zastępcze z jednocyfrową liczbą pobrań, a nie oficjalne wydanie.
Przydatnym punktem odniesienia jest wciąż 27B poprzedniej generacji: Qwen3.5-27B, otwarty model dense o wadze z oknem kontekstowym 32K. To rozsądna dolna granica tego, co Qwen3.8-27B musi pobić, oraz przypomnienie, że modele klasy Qwen 27B były historycznie budowane tak, aby działać na sprzęcie, który deweloper faktycznie posiada.
Max jest punktem odniesienia dla tego, co 27B może odziedziczyć.

27B nie dorówna surowemu sufitowi Maxa, ale wyniki Maxa — teraz opublikowane w prawdziwej karcie modelu — wyznaczają oczekiwania co do tego, jak wyglądają ulepszenia w tym pokoleniu. We własnych ewaluacjach Alibaby modelu o otwartych wagach, Qwen3.8-2.4T-A95B osiąga 93,0 w PaperBench, 86,1 w OSworld-Verified, 91,5 w parametrycznym CAD, 67,7 w SWE-bench Pro i 86,6 w Terminal-Bench 2.1, a producent twierdzi, że dorównuje Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol i Gemini 3.1 Pro. Są to dane raportowane przez producenta, opublikowane w materiałach premierowych i jeszcze niespotwierdzone przez niezależne laboratorium. Zysk agentowy, który ogłoszono przy premierze API — skok FrontierSWE z 40,7 do 73,5 w jednym pokoleniu — znajduje odzwierciedlenie w tych samych materiałach premierowych. Jeśli choć część tej poprawy trafi do 27B, zmieni to znaczenie określenia „dobry lokalny model kodowania” w tej klasie.
Jeden niuans, o którym warto pamiętać: pobierany Max nie jest identyczny z Maxem API. Qwen3.8-2.4T-A95B jest wyłącznie tekstowy, z wymuszonym trybem myślenia, podczas gdy API Qwen3.8-Max dodaje wejście wizyjne, tryb bez myślenia oraz domyślny kontekst 1 mln tokenów. Ta luka to dokładnie coś, co model 27B prawdopodobnie odziedziczy — i warto o tym pamiętać, czytając nagłówki o wynikach „Qwen3.8" bez sprawdzania, który wariant opisują.
Cena to obszar, w którym Max jest najbardziej obronny: 2/6 dolarów za milion tokenów w całym kontekście 1M tokenów w API, bez dopłaty za długie prompty. To agresywna stawka jak na API z najwyższej półki i ma znaczenie dla matematyki routingu — przy tych liczbach generacja 3.8 staje się opcją dla obciążeń, które wcześniej domyślnie trafiały do droższych flagowców.
Co faktycznie może to uruchomić

Dla 27B, Alibaba nadal nie opublikował wymagań sprzętowych, więc liczby w obiegu pozostają prognozami społeczności opartymi na tabeli kwantyzacji Qwen 3.6-27B — szacunkami, a nie specyfikacjami. Zakresy robocze, wokół których planuje większość ludzi, pozostają niezmienione:
• Kwantyzacja Q4_K_M, ~16 GB VRAM — RTX 4090 lub odpowiednik, najlepszy wybór, na który celuje większość lokalnych programistów.
• Kwantyzacja Q3_K_M, ~13GB VRAM — mieści się na karcie 12GB, takiej jak RTX 3060, przy obniżonej jakości.
• kwantyzacja Q6_K, ~21GB VRAM — prawie bezstratna na kartach z 24GB.
• Serwowanie FP8, ~27 GB VRAM — pojedynczy L40S, według wcześniejszych szacunków, do wnioskowania klasy produkcyjnej.
• Pełna precyzja, H100 80GB — ścieżka o jakości benchmarkowej, której większość zespołów nie będzie uruchamiać.
Nowym zgrzytem jest to, że stwierdzenie „możesz samodzielnie hostować generację Qwen3.8” jest prawdziwe, ale nie dotyczy modelu, wokół którego ludzie planowali się budowali plany. Otwarte wagi modelu Max to zupełnie inna klasa sprzętu: pełnoprecyzyjny model BF16 waży około 4,9 TB, a warstwowa selektywna kwantyzacja 1-bitowa od Unsloth zmniejsza go do około 397 GB — działa, ale tylko przy łącznej pamięci RAM i VRAM wynoszącej 410 GB lub więcej. To poważna infrastruktura, a nie karta w klasie prosumenckiej. To dokładnie ta luka, którą ma wypełnić 27B, co sprawia, że to właśnie przedłużająca się nieobecność 27B jest powodem, dla którego lokalna ścieżka na jednym GPU dla tej generacji jeszcze nie powstała.
Kwestia licencji: Max właśnie ustanowił precedens.
Pytanie o licencję dla 27B pozostaje bez odpowiedzi, ale „jak by to wyglądało" nie jest już zgadywanką. Otwarte wagi Maxa zostały wydane na podstawie niestandardowej licencji oznaczonej jako „qwen3.8-max" — a nie Apache 2.0. Jak podano w karcie modelu, jest ona generalnie bezpłatna do użytku komercyjnego i hostingu, ale przy większej skali wiąże się z dodatkowymi wymaganiami: produkty z ponad 100 milionami aktywnych użytkowników miesięcznie lub przychodami miesięcznymi przekraczającymi 20 milionów dolarów muszą wyświetlać nazwę modelu, a firmy z rocznymi przychodami przekraczającymi 50 milionów dolarów, które oferują usługi model-as-a-service lub asystenta pracy opartego na AI, potrzebują osobnej licencji. Krążące twierdzenie, że licencja zakazuje użytkowania w USA, UE, Wielkiej Brytanii i Korei, jest fałszywe — licencja nie zawiera żadnych ograniczeń terytorialnych.
Jeśli chodzi konkretnie o 27B, nie wskazano żadnej licencji. Ale Max został wydany na podstawie niestandardowej licencji Qwen, a nie Apache 2.0, co sprawia, że Apache 2.0 jest również słabym założeniem dla modelu bliźniaczego. Stara licencja Tongyi Qianwen — z klauzulą o 100 milionach MAU — nie jest tym, co otrzymał Max; licencja Maxa jest nowa i warstwowa w zależności od skali. Przeczytaj plik LICENSE w rzeczywistym repozytorium, zanim zaplanujesz wszystko wokół niego, i oczekuj, że licencja dla 27B zostanie ustalona dopiero, gdy pojawi się jego repozytorium.
Timing toolchaina: wsparcie od pierwszego dnia właśnie się potwierdziło.
Silniki serwujące zareagowały tak szybko, jak oczekiwano — w przypadku modelu, który trafił do wydania. Qwen3.8-2.4T-A95B wystartował z działającym wsparciem w SGLang, vLLM i TokenSpeed, co dla dużego wydania z otwartymi wagami oznacza „serwowalność przez API niemal natychmiast”. W przypadku 27B te same silniki będą najprawdopodobniej pierwszymi, które zapewnią wsparcie, gdy tylko pojawi się jego repozytorium, a objęcie Max wsparciem od pierwszego dnia sprawia, że odziedziczenie go przez 27B jest rozsądnym oczekiwaniem. Społecznościowe kwantyzacje GGUF i AWQ zwykle wciąż pozostają w tyle o jeden do dwóch tygodni, więc doświadczenie w stylu Ollama — „pobierz i uruchom” — prawdopodobnie nadal nie będzie dostępne w dniu wydania 27B; ręczna konfiguracja vLLM lub llama.cpp będzie początkowo najpewniejszą ścieżką lokalną.
Co wciąż pozostaje nieznane?
Uczciwy artykuł o przecieku zatrzymuje się na tym, co faktycznie jest publiczne, a granica jest szersza niż tydzień temu w jednym kierunku i węższa w drugim: na pytania Maxa odpowiedziano, a na pytania 27B nie.
• Nowa data wydania.Obietnica dotyczyła „tygodnia 10 sierpnia"; tydzień prawie minął, a repozytorium się nie pojawiło. Zewnętrzne trackery informują o opóźnieniu bez nowej daty, ale Alibaba nie wydał żadnego oficjalnego oświadczenia.
• Architektura. Dense lub MoE dla 27B, a jeśli MoE, liczba aktywnych parametrów.
• Karta specyfikacji. Okno kontekstu, modalności, limity wyjściowe, tryb rozumowania.
• Benchmarki. Model 27B nie ma oficjalnych wyników ani niezależnej ewaluacji.
• Licencja. Nierozstrzygnięte do czasu wydania repozytorium 27B; niestandardowa licencja Maxa to precedens, na który należy uważać.
• Ryzyko mirrorów. Problem z placeholderami jest teraz widoczny w praktyce — w społeczności istnieją karty „Qwen3.8-27B-FP8", „-GGUF" i „-MLX" bez żadnych oficjalnych plików. Dopóki oficjalna organizacja Qwen nie opublikuje repozytorium, pobieraj wyłącznie ze strony oficjalnej organizacji.
Co to oznacza dla budowniczych
Praktyczny podział dla generacji Qwen3.8 jest teraz trójstronny zamiast dwustronnego. Jeśli chcesz dziś API z najwyższej półki, Qwen3.8-Max działa przez OrcaRouter w cenie katalogowej dostawcy wynoszącej $2/$6, przekazywanej z 0% marżą — cena, którą widzisz, to cena ustalona przez Alibaba. Jeśli chcesz samodzielnie hostować model klasy Max, otwarte wagi są już dostępne do pobrania, ale potrzebujesz sprzętu do modelu o pełnej precyzji zajmującego około 4,9 TB lub skwantowanego o około 397 GB. A jeśli chcesz lokalnego wdrożenia na pojedynczej karcie GPU, które ta generacja miała zapewnić, wciąż czekasz na Qwen3.8-27B, który nie został wydany. Jeden klucz zgodny z OpenAI obejmuje dziś stronę API, a gdy hosting 27B się ustabilizuje, ten sam klucz będzie mógł do niego kierować.

Ta ostatnia część to ta bardziej ogólna teza i właśnie dla niej niezweryfikowane, opóźnione wydanie open-weight stanowi przypadek testowy. Model, który jeszcze w ogóle nie został wydany, nie ma ani udokumentowanych osiągnięć, ani niezależnego zestawu benchmarków, ani historii incydentów — a gdy już się pojawi, będzie zupełnie nowy. Routing to sposób, w jaki można go wypróbować, nie stawiając na niego ścieżki klienckiej: kieruj do niego ruch, który toleruje niespodzianki, automatycznie przełączaj się na sprawdzony model, gdy ten działa nieprawidłowo, a po zdobyciu zaufania przenieś na niego całe obciążenie. Warstwa routingu sprawia też, że kalkulacja cen jest uczciwa — gdy Alibaba obniży cenę modelu, który wywołujesz przez jeden endpoint, zmiana jest aktywna tego samego dnia, bo cena katalogowa przechodzi bez zmian.
Co obejrzeć
• Czy repozytorium 27B w ogóle się pojawi. Wpis w oficjalnej organizacji Qwen na Hugging Face lub ModelScope to wydarzenie, które kończy opóźnienie — a tydzień 10 sierpnia prawie minął bez niego.
• Plik licencji 27B. Max został wydany z niestandardową licencją warstwową, a nie Apache 2.0. To, czy 27B pójdzie za tym precedensem, jest najważniejszym punktem jego ostatecznego ogłoszenia.
• Architektura i długość kontekstu. Dense-vs-MoE oraz okno kontekstowe decydują o tym, do czego służy 27B.
• Pierwszy niezależny benchmark. Wynik 56 modelu Max na Artificial Analysis Intelligence Index wyznaczył poprzeczkę; pierwsza zewnętrzna ocena modelu 27B pokaże, ile z osiągnięć tej generacji przetrwa w rozmiarze konsumenckim.
• Pokrycie toolchainu. Czy 27B odziedziczy wsparcie w SGLang/vLLM/TokenSpeed, które Max miał od pierwszego dnia, i jak szybko pojawią się kwantyzacje społeczności.
Najczęściej zadawane pytania
Czy Qwen3.8-27B został już wydany?
Nie. Alibaba ogłosiło to 3 sierpnia 2026 r. i zobowiązało się do udostępnienia wag w Hugging Face i ModelScope w tygodniu zaczynającym się 10 sierpnia, ale na dzień 13 sierpnia nie ma oficjalnego repozytorium Qwen3.8-27B, karty modelu ani licencji. Otwarte wagi klasy Max — Qwen3.8-2.4T-A95B — zostały wydane 13 sierpnia; wersja 27B nie, a zewnętrzne trackery podają, że jest opóźniona bez nowej daty.
Jakiego sprzętu potrzebuję, aby uruchomić Qwen3.8-27B?
To niepotwierdzone, ale prognozy społeczności oparte na tabeli kwantyzacji Qwen 3.6-27B wskazują, że kwantyzacja Q4_K_M zajmie około 16 GB VRAM (RTX 4090), Q3_K_M około 13 GB (karty 12 GB), Q6_K około 21 GB (karty 24 GB), a serwowanie FP8 około 27 GB (pojedynczy L40S). Daniel Han z Unsloth podaje około 17 GB w momencie premiery. Traktuj te wartości jako szacunki, dopóki oficjalna karta modelu nie opublikuje zaleceń sprzętowych.
Czy Qwen3.8-27B jest dostępny przez OrcaRouter?
Jeszcze nie. {{1}}Qwen3.8-27B to model o otwartych wagach, hostowany samodzielnie, którego nie ma obecnie na platformie.{{/1}} Okręt flagowy tej samej rodziny — {{2}}Qwen3.8-Max{{/2}} — jest już dostępny przez {{3}}OrcaRouter{{/3}} po cenie katalogowej dostawcy $2/$6 za milion tokenów z 0% marżą, a gdy hosting 27B się ustabilizuje, będzie można go dodać do tego samego klucza {{4}}zgodnego z OpenAI{{/4}}.
Czy powinienem poczekać na Qwen3.8-27B, czy użyć Qwen3.8-Max już dziś?
To zależy od tego, gdzie uruchamiane jest obciążenie. Jeśli potrzebujesz teraz API z najwyższej półki, Qwen3.8-Max jest już dostępny i ma agresywną cenę 2/6 dolarów za milion tokenów. Jeśli chcesz dziś samodzielnie hostować klasę Max, Qwen3.8-2.4T-A95B jest już dostępny do pobrania, ale wymaga poważnego sprzętu — to model w pełnej precyzji o rozmiarze około 4,9 TB lub około 397 GB w wersji skwantowanej, z łączną pamięcią RAM i VRAM przekraczającą 410 GB. Jeśli potrzebujesz lokalnego modelu lub modelu on-premise na pojedynczej karcie konsumenckiej, Qwen3.8-27B to wciąż ten, na który warto czekać — to realistyczna ścieżka samodzielnego hostowania w tej generacji, a jego premiera jest teraz otwartym pytaniem, a nie ustaloną datą.
Obiecany tydzień prawie dobiegł końca, a połowa z tego nie nadeszła. {{1}}Qwen3.8-2.4T-A95B jest do pobrania, licencjonowany i gotowy do serwowania{{/1}}; {{2}}Qwen3.8-27B ma potwierdzone istnienie, wciąż deklaruje otwarte wagi i wciąż nie ma repozytorium, licencji, benchmarków ani nowej daty{{/2}}. Obserwuj, czy repozytorium 27B pojawi się, zanim obiecany tydzień w pełni minie, co mówi jego plik licencyjny w porównaniu z wersją Max i jak wypadnie w pierwszych niezależnych ocenach. Te trzy sygnały powiedzą ci, czy to rutynowa dwuetapowa publikacja otwartych wag, z mniejszym modelem wciąż w drodze, czy opóźnienie, które warto uwzględnić w planach.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
