
Dots vs Qwen 3.8 Max: różnica polega na tym, gdzie wolno to przenieść
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 349 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 210 tok/s
- OrcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- xAISpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
Qwen 3.8 Max został opublikowany 3 sierpnia 2026 r. i jest najwyższym jak dotąd poziomem możliwości Alibaby: natywnie multimodalny, przyjmuje tekst, obrazy i wideo, a zwraca tekst, w oknie kontekstowym o rozmiarze 1 000 000 tokenów, udostępniany przez trzy formaty komunikacji: zgodny z OpenAI, zgodny z Anthropic i natywny DashScope, z Pekinu, Singapuru, Tokio, Frankfurtu i Wirginii, w cenie 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, a odczyty z pamięci podręcznej po 0,25 USD. Dots to stale aktywny agent firmy, ogłoszony podczas DevDay 29 września 2026 r.: otrzymuje własny komputer w chmurze i przeglądarkę, ma dostęp do ponad 4000 aplikacji, działa na GPT-6 Astra i jest wliczony w plany Pro i Business Premium. Postawione obok siebie, ciekawe pytanie nie brzmi: które z nich jest zdolniejsze. Brzmi ono: w ilu miejscach każde z nich ma prawo się znajdować i kto o tym decyduje.
To nie jest abstrakcyjne rozróżnienie. To ono decyduje o tym, czy narzędzie jest w ogóle dostępne na twoim rynku, czy może być audytowane przez twój zespół ds. zgodności i czy praca, którą na nim budujesz, przetrwa zmianę warunków. Możliwości to łatwa część tego porównania; przenośność to część, którą rozstrzyga się późno i kosztownie.
Trzy sposoby na wywołanie jednego modelu
Format transmisji brzmi jak drobny szczegół inżynieryjny, dopóki nie trzeba przenieść aplikacji między dostawcami. Interfejs zgodny z OpenAI sprawia, że istniejące biblioteki klienckie działają bez warstwy tłumaczącej. Interfejs zgodny z Anthropic sprawia, że bazy kodu napisanej pod kształt komunikatu innego dostawcy nie trzeba przepisywać. Natywny interfejs DashScope udostępnia pełny zestaw funkcji, w tym przełącznik trybu myślenia. Trzy interfejsy dla jednego modelu oznaczają, że koszt przełączenia to bazowy adres URL i klucz, a nie refaktoryzacja.
To ma największe znaczenie, gdy go brakuje. Kropka nie oferuje żadnego formatu, adresu URL ani klucza, ponieważ kropka nie jest czymś, co się wywołuje — to coś, z czym rozmawiasz wewnątrz czyjegoś interfejsu. Przeniesienie logiki twojego agenta gdzie indziej oznacza odbudowanie jej, a następnie ponowne podłączenie czterech tysięcy konektorów, od których zależała, a potem odkrycie, które z nich zachowywały się w sposób, którego nie zapisałeś.
• Co kupujesz — hostowanego pracownika działającego w ChatGPT, Slack i Teams (Dots) w przeciwieństwie do endpointu modelu, który możesz wywołać z dowolnego miejsca (Qwen 3.8 Max)
• Interfejsy — nie opublikowano żadnych dla kropki, wobec powierzchni zgodnych z OpenAI, zgodnych z Anthropic oraz natywnego DashScope (Qwen 3.8 Max)
• Gdzie to działa — chmurowy komputer OpenAI z własną przeglądarką (Dots) kontra pięć obsługiwanych regionów w Azji, Europie i Ameryce Północnej (Qwen 3.8 Max)
• Kontrola rozumowania — nie jest udostępniana dla kropki, w przeciwieństwie do przełącznika enable_thinking lub reasoning.effort w Responses API (Qwen 3.8 Max)
• Koszt za jednostkę — pierwsza kropka jest wliczona w Pro lub Business Premium, przydział niepublikowany (Dots) w porównaniu z 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, odczyty z pamięci podręcznej 0,25 USD (Qwen 3.8 Max)
• Niezależne dowody — prezentacje dostawców i deklaracje możliwości, ani jednego benchmarku, wobec wyniku 45,4 w Artificial Analysis Intelligence Index, na piętnastym miejscu spośród 145 zmierzonych modeli i 92,8 w GPQA Diamond (Qwen 3.8 Max)
Gdzie ląduje model — w liczbach, które możesz sprawdzić
Opublikowany profil Qwen 3.8 Max to profil ze środka czołówki i warto go czytać precyzyjnie, a nie wrażeniowo. Indeks inteligencji AA wynoszący 45,4 i plasujący go na piętnastym miejscu spośród 145 zmierzonych modeli umieszcza go w najlepszych dziesięciu procentach, ale nie na szczycie. Indeks kodowania AA wynoszący 76,2, przy dziewiątym miejscu na 138, jest mocniejszy, a 88,8 w Terminal-Bench 2.1 to naprawdę wysoki wynik wykonania agentowego — wyższy niż 88,0 GPT-5.6 Sol na tej samej tablicy wyników. Stosunkowo słabszy jest w przypominaniu długiego kontekstu na poziomie 80,3, które plasuje się poniżej 88,7 Kimi K3 i 83 MiniMax M3 mimo porównywalnego rozmiaru okna, oraz w SciCode na poziomie 52,1.
Własne pozycjonowanie Alibaby, zawarte w jej przewodniku migracyjnym, stawia ten model bezpośrednio naprzeciw GPT-5.5, Claude Opus 4.7 i Gemini 3.1 Pro, a uczciwa interpretacja liczb wskazuje, że to model, po który sięgasz, gdy mieszanka mocnego działania agentowego i danych wejściowych multimodalnych liczy się bardziej niż bycie pierwszym w rankingu inteligencji. Wszystkie te liczby to pomiary stron trzecich, przenoszone wraz z ich źródłami w naszym katalogu, a nie twierdzenia dostawcy — i właśnie dlatego są warte więcej niż prezentacja premierowa.
Brakuje jednej liczby i należy ją wypowiedzieć na głos, a nie uzupełniać: nasz katalog nie podaje maksymalnej długości wyjścia dla tego modelu. Udokumentowany jest kontekst miliona tokenów; limit wyjścia na odpowiedź już nie.

Czego Dots ci nie mówi i dlaczego jest to wybór projektowy
OpenAI opublikowało jedno zdanie o tym, ile kosztuje dot, i nie zawiera ono liczby: pierwszy dot jest wliczony w plany Pro i Business Premium, z rozszerzonymi limitami w pierwszym miesiącu i bez uszczuplania limitów użytkowania ChatGPT w rozmowach z nim. Poza tym nie ma żadnej liczby określającej przydział, ceny drugiego dot, stawki za dodatkową przepustowość ani kosztu za zadanie. Plan Pro 500 za 500 USD miesięcznie to przydział użycia plus tryb Ultrafast, a nie stawka za dot, więc nawet najdroższy plan nie przekłada się na koszt jednostkowy pracy agenta.
Kuszące jest odczytanie tego jako luki w dokumentacji. Dokładniej byłoby odczytać to jako kategorię: produkt wyceniany za stanowisko nie może mieć ceny za jednostkę, bo istotą stanowiska jest właśnie to, że koszt krańcowy korzystania z niego jest niewidoczny. Jest to naprawdę wygodne w pracach eksploracyjnych i naprawdę niewygodne w przypadku wszystkiego, co trzeba przypisać do projektu, klienta lub pozycji budżetowej.
Zauważ, do czego zoptymalizowano oba produkty. Qwen 3.8 Max jest zoptymalizowany pod kątem wywoływania z dowolnego miejsca, przez cokolwiek, w dowolnym formacie, w jakim wywołujący już mówi. Kropka jest zoptymalizowana do używania w jednym miejscu, przez jeden interfejs, z ukrytą infrastrukturą. Oba to spójne projekty; po prostu odpowiadają na różne pytania, a jeden z nich na pytanie „czy mogę to później przenieść” odpowiada „nie”.

Dwie odpowiedzi na pytanie „co jeśli ten dostawca się zmieni”
Kwestia przenośności staje się konkretna w momencie, gdy dostawca zmienia cenę, oznacza identyfikator jako przestarzały lub zmienia zakres subskrypcji. W przypadku modelu rozliczanego na podstawie zużycia z trzema formatami transmisji reakcja jest mechaniczna: wystarczy wskazać klientowi inny bazowy adres URL albo zmienić jeden ciąg modelu, a aplikacja nadal działa. Nie ma nic więcej do przenoszenia, ponieważ model nigdy nie był niczym innym niż wywołaniem.
W przypadku dot odpowiedzią na zmianę warunków jest zatrzymanie. Komputer, przeglądarka, konektory i przydział należą do OpenAI i żadnego z nich nie można wyeksportować. To nie jest krytyka produktu; to uczciwy opis wynajmu. Oznacza to jednak, że praca, którą zbudujesz w całości wewnątrz dot, ma ścieżkę migracji prowadzącą przez przepisanie, a to fakt, który warto wliczyć w koszty, zanim zbudujesz coś, od czego zamierzasz zależeć przez rok.
OrcaRouter powstał z myślą o pierwszym przypadku. Qwen 3.8 Max jest kierowany jako qwen/qwen3.8-max po cenie katalogowej dostawcy Alibaba, przekazywanej dalej z 0% marży, w tym samym katalogu co ponad 200 innych modeli dostępnych za jednym kluczem, z automatycznym przełączaniem awaryjnym między dostawcami upstream oraz DSL routingu do składania kilku modeli w jedno żądanie. To właśnie sprawia, że pytanie o trzy regiony można rozstrzygnąć po swojej stronie, a nie po stronie dostawcy: ten sam identyfikator dociera do modelu wszędzie tam, gdzie jest on udostępniany, a zmiana stawki po stronie Alibaby trafia na Twój rachunek tego samego dnia, a nie dopiero przy kolejnym odnowieniu. Czego natomiast nie obejmuje, to wszystko, co znajduje się wewnątrz kropki — nie ma dla tego żadnego endpointu, żadnego identyfikatora ani zastępczej inteligencji, którą można by podstawić.
Pytanie, które trzeba zadać, zanim się zobowiążesz
Zapytaj, co stanie się z twoją pracą w dniu, w którym dostawca zmieni coś, czego nie kontrolujesz. Jeśli odpowiedź brzmi: „zmieniamy jeden ciąg znaków i idziemy dalej”, kupujesz model, a ten rozliczany za zużycie jest lepszym zakupem. Jeśli odpowiedź brzmi: „musielibyśmy go przebudować”, kupujesz produkt i powinieneś kupić go świadomie — wiedząc, że wygoda, za którą płacisz, jest okupiona odwracalnością.
Żadna z odpowiedzi nie jest błędna. Kupowanie przenośności, której nigdy nie wykorzystasz, jest tak samo marnotrawne jak kupowanie wygody, z której będziesz musiał uciekać. Błąd polega na tym, że nie wiesz, którą z nich kupiłeś.

Porównane w tym artykule2
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
