Wygenerowana karta hero zatytułowana „Dots vs Qwen 3.8 Max”, z podtytułem „Różnica polega na tym, gdzie wolno ci ją przenieść”. Pionowa linia dzieli kartę: lewy panel, oznaczony „Dots”, głosi „jedno miejsce, w którym może działać”; prawy, oznaczony „Qwen 3.8 Max”, głosi „trzy formaty przewodowe – pięć regionów – 2,00 $ / 6,00 $”. Logo OrcaRouter jest nałożone w prawym dolnym rogu.
Guides & Insights

Dots vs Qwen 3.8 Max: różnica polega na tym, gdzie wolno to przenieść

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Qwen 3.8 Max został opublikowany 3 sierpnia 2026 r. i jest najwyższym jak dotąd poziomem możliwości Alibaby: natywnie multimodalny, przyjmuje tekst, obrazy i wideo, a zwraca tekst, w oknie kontekstowym o rozmiarze 1 000 000 tokenów, udostępniany przez trzy formaty komunikacji: zgodny z OpenAI, zgodny z Anthropic i natywny DashScope, z Pekinu, Singapuru, Tokio, Frankfurtu i Wirginii, w cenie 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, a odczyty z pamięci podręcznej po 0,25 USD. Dots to stale aktywny agent firmy, ogłoszony podczas DevDay 29 września 2026 r.: otrzymuje własny komputer w chmurze i przeglądarkę, ma dostęp do ponad 4000 aplikacji, działa na GPT-6 Astra i jest wliczony w plany Pro i Business Premium. Postawione obok siebie, ciekawe pytanie nie brzmi: które z nich jest zdolniejsze. Brzmi ono: w ilu miejscach każde z nich ma prawo się znajdować i kto o tym decyduje.

To nie jest abstrakcyjne rozróżnienie. To ono decyduje o tym, czy narzędzie jest w ogóle dostępne na twoim rynku, czy może być audytowane przez twój zespół ds. zgodności i czy praca, którą na nim budujesz, przetrwa zmianę warunków. Możliwości to łatwa część tego porównania; przenośność to część, którą rozstrzyga się późno i kosztownie.

Trzy sposoby na wywołanie jednego modelu

Format transmisji brzmi jak drobny szczegół inżynieryjny, dopóki nie trzeba przenieść aplikacji między dostawcami. Interfejs zgodny z OpenAI sprawia, że istniejące biblioteki klienckie działają bez warstwy tłumaczącej. Interfejs zgodny z Anthropic sprawia, że bazy kodu napisanej pod kształt komunikatu innego dostawcy nie trzeba przepisywać. Natywny interfejs DashScope udostępnia pełny zestaw funkcji, w tym przełącznik trybu myślenia. Trzy interfejsy dla jednego modelu oznaczają, że koszt przełączenia to bazowy adres URL i klucz, a nie refaktoryzacja.

To ma największe znaczenie, gdy go brakuje. Kropka nie oferuje żadnego formatu, adresu URL ani klucza, ponieważ kropka nie jest czymś, co się wywołuje — to coś, z czym rozmawiasz wewnątrz czyjegoś interfejsu. Przeniesienie logiki twojego agenta gdzie indziej oznacza odbudowanie jej, a następnie ponowne podłączenie czterech tysięcy konektorów, od których zależała, a potem odkrycie, które z nich zachowywały się w sposób, którego nie zapisałeś.

• Co kupujesz — hostowanego pracownika działającego w ChatGPT, Slack i Teams (Dots) w przeciwieństwie do endpointu modelu, który możesz wywołać z dowolnego miejsca (Qwen 3.8 Max)

• Interfejsy — nie opublikowano żadnych dla kropki, wobec powierzchni zgodnych z OpenAI, zgodnych z Anthropic oraz natywnego DashScope (Qwen 3.8 Max)

• Gdzie to działa — chmurowy komputer OpenAI z własną przeglądarką (Dots) kontra pięć obsługiwanych regionów w Azji, Europie i Ameryce Północnej (Qwen 3.8 Max)

• Kontrola rozumowania — nie jest udostępniana dla kropki, w przeciwieństwie do przełącznika enable_thinking lub reasoning.effort w Responses API (Qwen 3.8 Max)

• Koszt za jednostkę — pierwsza kropka jest wliczona w Pro lub Business Premium, przydział niepublikowany (Dots) w porównaniu z 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, odczyty z pamięci podręcznej 0,25 USD (Qwen 3.8 Max)

• Niezależne dowody — prezentacje dostawców i deklaracje możliwości, ani jednego benchmarku, wobec wyniku 45,4 w Artificial Analysis Intelligence Index, na piętnastym miejscu spośród 145 zmierzonych modeli i 92,8 w GPQA Diamond (Qwen 3.8 Max)

Gdzie ląduje model — w liczbach, które możesz sprawdzić

Opublikowany profil Qwen 3.8 Max to profil ze środka czołówki i warto go czytać precyzyjnie, a nie wrażeniowo. Indeks inteligencji AA wynoszący 45,4 i plasujący go na piętnastym miejscu spośród 145 zmierzonych modeli umieszcza go w najlepszych dziesięciu procentach, ale nie na szczycie. Indeks kodowania AA wynoszący 76,2, przy dziewiątym miejscu na 138, jest mocniejszy, a 88,8 w Terminal-Bench 2.1 to naprawdę wysoki wynik wykonania agentowego — wyższy niż 88,0 GPT-5.6 Sol na tej samej tablicy wyników. Stosunkowo słabszy jest w przypominaniu długiego kontekstu na poziomie 80,3, które plasuje się poniżej 88,7 Kimi K3 i 83 MiniMax M3 mimo porównywalnego rozmiaru okna, oraz w SciCode na poziomie 52,1.

Własne pozycjonowanie Alibaby, zawarte w jej przewodniku migracyjnym, stawia ten model bezpośrednio naprzeciw GPT-5.5, Claude Opus 4.7 i Gemini 3.1 Pro, a uczciwa interpretacja liczb wskazuje, że to model, po który sięgasz, gdy mieszanka mocnego działania agentowego i danych wejściowych multimodalnych liczy się bardziej niż bycie pierwszym w rankingu inteligencji. Wszystkie te liczby to pomiary stron trzecich, przenoszone wraz z ich źródłami w naszym katalogu, a nie twierdzenia dostawcy — i właśnie dlatego są warte więcej niż prezentacja premierowa.

Brakuje jednej liczby i należy ją wypowiedzieć na głos, a nie uzupełniać: nasz katalog nie podaje maksymalnej długości wyjścia dla tego modelu. Udokumentowany jest kontekst miliona tokenów; limit wyjścia na odpowiedź już nie.

A screenshot of the OrcaRouter model page for Qwen3.8 Max, showing the identifier 'qwen/qwen3.8-max' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-03, a description of it as Alibaba's newest flagship with a 1M-token context window served through OpenAI-compatible, Anthropic-compatible and native DashScope interfaces across multiple regions, a side panel reading 1M tokens of context over text, image and video input, and a price strip reading $2.00 and $6.00 with a p50 time to first token of 2.44 seconds.

Czego Dots ci nie mówi i dlaczego jest to wybór projektowy

OpenAI opublikowało jedno zdanie o tym, ile kosztuje dot, i nie zawiera ono liczby: pierwszy dot jest wliczony w plany Pro i Business Premium, z rozszerzonymi limitami w pierwszym miesiącu i bez uszczuplania limitów użytkowania ChatGPT w rozmowach z nim. Poza tym nie ma żadnej liczby określającej przydział, ceny drugiego dot, stawki za dodatkową przepustowość ani kosztu za zadanie. Plan Pro 500 za 500 USD miesięcznie to przydział użycia plus tryb Ultrafast, a nie stawka za dot, więc nawet najdroższy plan nie przekłada się na koszt jednostkowy pracy agenta.

Kuszące jest odczytanie tego jako luki w dokumentacji. Dokładniej byłoby odczytać to jako kategorię: produkt wyceniany za stanowisko nie może mieć ceny za jednostkę, bo istotą stanowiska jest właśnie to, że koszt krańcowy korzystania z niego jest niewidoczny. Jest to naprawdę wygodne w pracach eksploracyjnych i naprawdę niewygodne w przypadku wszystkiego, co trzeba przypisać do projektu, klienta lub pozycji budżetowej.

Zauważ, do czego zoptymalizowano oba produkty. Qwen 3.8 Max jest zoptymalizowany pod kątem wywoływania z dowolnego miejsca, przez cokolwiek, w dowolnym formacie, w jakim wywołujący już mówi. Kropka jest zoptymalizowana do używania w jednym miejscu, przez jeden interfejs, z ukrytą infrastrukturą. Oba to spójne projekty; po prostu odpowiadają na różne pytania, a jeden z nich na pytanie „czy mogę to później przenieść” odpowiada „nie”.

A generated scoreboard titled 'Dots vs Qwen 3.8 Max - reach and reversibility', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; interfaces none published; regions OpenAI's cloud computer; connectors 4,000+ apps; independent benchmark none. The right column, 'Qwen 3.8 Max', lists: context 1,000,000 tokens; input text, image, video; interfaces OpenAI-compatible, Anthropic-compatible, DashScope; regions five; price $2.00 in / $6.00 out per 1M; AA Intelligence Index 45.4, 15th of 145. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Qwen 3.8 Max figures from independent listings as carried in the OrcaRouter catalogue.'

Dwie odpowiedzi na pytanie „co jeśli ten dostawca się zmieni”

Kwestia przenośności staje się konkretna w momencie, gdy dostawca zmienia cenę, oznacza identyfikator jako przestarzały lub zmienia zakres subskrypcji. W przypadku modelu rozliczanego na podstawie zużycia z trzema formatami transmisji reakcja jest mechaniczna: wystarczy wskazać klientowi inny bazowy adres URL albo zmienić jeden ciąg modelu, a aplikacja nadal działa. Nie ma nic więcej do przenoszenia, ponieważ model nigdy nie był niczym innym niż wywołaniem.

W przypadku dot odpowiedzią na zmianę warunków jest zatrzymanie. Komputer, przeglądarka, konektory i przydział należą do OpenAI i żadnego z nich nie można wyeksportować. To nie jest krytyka produktu; to uczciwy opis wynajmu. Oznacza to jednak, że praca, którą zbudujesz w całości wewnątrz dot, ma ścieżkę migracji prowadzącą przez przepisanie, a to fakt, który warto wliczyć w koszty, zanim zbudujesz coś, od czego zamierzasz zależeć przez rok.

OrcaRouter powstał z myślą o pierwszym przypadku. Qwen 3.8 Max jest kierowany jako qwen/qwen3.8-max po cenie katalogowej dostawcy Alibaba, przekazywanej dalej z 0% marży, w tym samym katalogu co ponad 200 innych modeli dostępnych za jednym kluczem, z automatycznym przełączaniem awaryjnym między dostawcami upstream oraz DSL routingu do składania kilku modeli w jedno żądanie. To właśnie sprawia, że pytanie o trzy regiony można rozstrzygnąć po swojej stronie, a nie po stronie dostawcy: ten sam identyfikator dociera do modelu wszędzie tam, gdzie jest on udostępniany, a zmiana stawki po stronie Alibaby trafia na Twój rachunek tego samego dnia, a nie dopiero przy kolejnym odnowieniu. Czego natomiast nie obejmuje, to wszystko, co znajduje się wewnątrz kropki — nie ma dla tego żadnego endpointu, żadnego identyfikatora ani zastępczej inteligencji, którą można by podstawić.

Pytanie, które trzeba zadać, zanim się zobowiążesz

Zapytaj, co stanie się z twoją pracą w dniu, w którym dostawca zmieni coś, czego nie kontrolujesz. Jeśli odpowiedź brzmi: „zmieniamy jeden ciąg znaków i idziemy dalej”, kupujesz model, a ten rozliczany za zużycie jest lepszym zakupem. Jeśli odpowiedź brzmi: „musielibyśmy go przebudować”, kupujesz produkt i powinieneś kupić go świadomie — wiedząc, że wygoda, za którą płacisz, jest okupiona odwracalnością.

Żadna z odpowiedzi nie jest błędna. Kupowanie przenośności, której nigdy nie wykorzystasz, jest tak samo marnotrawne jak kupowanie wygody, z której będziesz musiał uciekać. Błąd polega na tym, że nie wiesz, którą z nich kupiłeś.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards and credit top-up offers visible beneath.

Porównane w tym artykule2

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie