Karta tytułowa artykułu „Qwen3.8-27B Release Date” przedstawiająca kalendarz z zaznaczonym tygodniem od 10 sierpnia 2026 r. jako obiecanym oknem premiery, z plakietką „status: oczekujący”, podtytułem informującym o ogłoszeniu z 3 sierpnia 2026 r. oraz grafiką ułożonych warstw modelu.
Guides & Insights

Qwen3.8-27B Data wydania: Wagi opublikowane 14 sierpnia

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Firma Alibaba udostępniła otwarte wagi modelu Qwen3.8-27B wieczorem 14 sierpnia 2026 roku, umieszczając repozytorium na Hugging Face i ModelScope na licencji Apache 2.0. To zamyka kwestię daty wydania, którą ten wpis śledził od ogłoszenia z 3 sierpnia, i przynosi pierwszy punkt danych dotyczący dostępności API: model pojawił się tego samego dnia na komercyjnym rynku API. Qwen3.8-27B to gęsty, nadający się do samodzielnego hostowania członek generacji Qwen3.8 — odpowiednik, który Alibaba pozycjonuje jako konkurencję dla flagowego modelu Qwen3.8-Max o 2,4 biliona parametrów, oraz następca szeroko stosowanego Qwen3.6-27B.

Co potwierdził drop z 14 sierpnia

Generacja Qwen3.8 została ogłoszona 3 sierpnia 2026 roku. Tego dnia Qwen3.8-Max, flagowy model mixture-of-experts, wystartował z płatnym API, a Alibaba obiecało otwarte wagi zarówno dla Max, jak i mniejszego Qwen3.8-27B „w ciągu około tygodnia”. Termin ten się wydłużał, aż w końcu zyskał konkretny termin, gdy teaser ModelScope rozpoczął odliczanie do północy 15 sierpnia (00:00 JST). Publikacja nastąpiła zgodnie z harmonogramem: wieczorem 14 sierpnia czasu pekińskiego, zarówno na Hugging Face, jak i ModelScope.

Potwierdzony zestaw specyfikacji: Qwen3.8-27B to gęsty model o 27 miliardach parametrów, natywnie multimodalny (tekst, obrazy, wideo, diagramy, dokumenty), z natywnym oknem kontekstowym wynoszącym 262 000 tokenów, które można rozszerzyć do 1 miliona tokenów za pomocą YaRN, oraz konfigurowalnym trybem reasoning_effort, który dostosowuje głębokość myślenia, aby oszczędzać moc obliczeniową. Są to specyfikacje podane przez producenta w materiałach wydawniczych — obecnie można je sprawdzić bezpośrednio w publicznych wagach, a nie przyjmować na wiarę.

W testach własnych Alibaba model 27B przewyższa swojego poprzednika, a nawet większy Qwen3.7-Plus: SWE-bench Pro 61.7 (w porównaniu z 53.5 dla Qwen3.6-27B), agentowe kodowanie terminalowe 73.0 (w porównaniu z 63.4) oraz JobBench 33.4 (w porównaniu z 21.8). To liczby podawane przez producenta — żaden niezależny benchmark nie opublikował jeszcze wyniku dla 27B, więc należy traktować je jako deklarację, którą społeczność będzie teraz próbowała odtworzyć.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

Które warstwy wydania zostały dostarczone?

Dla modelu o otwartych wagach „wydanie” ma warstwy, a pojawiają się one w odstępach dni. Surowe wagi to warstwa pierwsza — pojawiła się 14 sierpnia. Wsparcie frameworków inferencyjnych to warstwa druga: vLLM i SGLang zwykle dodają wsparcie w ciągu kilku dni od opublikowania wag, a to sygnał, że model jest gotowy do serwowania, a nie tylko do pobrania. Kwantyzacje społecznościowe to warstwa trzecia — wersje GGUF i AWQ, a wraz z nimi ścieżka jednego polecenia w Ollama, LM Studio i llama.cpp, zwykle tydzień lub dwa później.

Więc „kiedy mogę pobrać wagi” – odpowiedź brzmi: teraz. „Kiedy mogę uruchomić to jednym poleceniem” – odpowiadają na to warstwy frameworka i kwantyzacji, które wciąż są wdrażane.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

Kwestia licencji jest rozstrzygnięta.

Licencja była otwartym pytaniem, które liczyło się bardziej niż data, a premiera je rozstrzygnęła. Qwen3.8-27B jest wydawany na licencji Apache 2.0 — licencji permissive bez limitu liczby użytkowników i bez warunku uruchamiającego dyskusję komercyjną. Wcześniejsza obawa, że otwarte wydanie Qwen będzie objęte licencją Tongyi Qianwen z klauzulą 100 milionów MAU, nie zmaterializowała się w przypadku 27B. To usuwa główną przeszkodę prawną dla integracji modelu z produktami i agentami od pierwszego dnia.

Pierwszy punkt danych dotyczący dostępności API

Premiera przyniosła również pierwszy punkt danych dotyczący dostępności API dla modelu 27B: w ciągu kilku godzin od opublikowania wag model pojawił się na komercyjnym rynku API jako aktywny, działający endpoint. Ten wpis jest niezależnie weryfikowalny — to pozycja w katalogu strony trzeciej, a nie deklaracja dostawcy — i stanowi pierwszy dowód na to, że model można nie tylko pobrać, ale także wdrożyć za pośrednictwem zarządzanych interfejsów API.

Tu właśnie wkracza OrcaRouter do kalkulacji kosztów. Obecnym routowalnym członkiem generacji jest Qwen3.8-Max, serwowany na OrcaRouter w cenie katalogowej dostawcy — 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, z zerową marżą, więc cena dostawcy jest ceną, którą płacisz. Jeden klucz API obejmuje go oraz ponad 200 modeli w katalogu, z automatycznym przełączaniem awaryjnym. Gdy Qwen3.8-27B zasłuży na miejsce na routerze, ten sam klucz będzie kierować do niego; do tego czasu wagi Apache 2.0 są darmowe do samodzielnego hostowania w celach ewaluacyjnych.

Co zweryfikować dalej

Spadek odpowiada na pytanie o datę; nie odpowiada jeszcze na pytanie o jakość. W nadchodzących tygodniach warto obserwować trzy rzeczy:

• Wsparcie frameworków inferencji — pull requesty vLLM i SGLang wymieniające Qwen3.8-27B, czyli sygnał, że model jest gotowy do obsługi na dużą skalę, a nie tylko do uruchomienia z repozytorium.

• Kwantyzacje społeczności z rzeczywistymi pomiarami VRAM — Unsloth i inni zwykle w ciągu kilku dni publikują kompilacje GGUF i zmierzone zużycie pamięci, przekształcając prognozy przedpremierowe w liczby, na których można oprzeć wdrożenie.

• Niezależne benchmarki — wyniki Artificial Analysis i LMArena dla modelu 27B, gdy tylko się pojawią, powinny być podstawą decyzji o wdrożeniu produkcyjnym, a nie własne ewaluacje Alibaby.

Czego możesz użyć już dziś

Qwen3.8-27B jest teraz dostępny do pobrania — taki jest sens wydania na licencji Apache 2.0. Dla zespołów, które chcą już dziś tworzyć rozwiązania w oparciu o tę generację na zarządzanym API, Qwen3.8-Max jest dostępny na OrcaRouter w cenie katalogowej producenta (2,00 USD za milion tokenów wejściowych, 6,00 USD za milion tokenów wyjściowych, zero marży), z automatycznym przełączaniem awaryjnym i jednym kluczem w całym katalogu. Dopóki niezależne benchmarki nie potwierdzą wyników producenta, samodzielne hostowanie wag 27B w celu ewaluacji jest najbezpieczniejszą drogą wejścia.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

Kwestia daty premiery została zamknięta: Qwen3.8-27B ukazał się 14 sierpnia 2026 roku na licencji Apache 2.0, z natywnym oknem kontekstowym 262K i danymi o dostępności API tego samego dnia. Pozostają pytania mierzalne — jak odbywa się serwowanie, jak wygląda kwantyzacja i czy niezależne ewaluacje odtwarzają wyniki Alibaby. Przeczytaj LICENSE, pobierz wagi i poczekaj na wsparcie frameworków oraz buildy społeczności, zanim postawisz na to ścieżkę produkcyjną.