
Step 5 Preview vs Qwen 3.8 Max Prime: jeden punkt indeksu, cztery dolary i trzydzieści osiem centów
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 za 1 mln tokenów
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 113 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 52 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 399 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
Zacznij od tego, czego nie powie ci pole wyszukiwania. Qwen 3.8 Max Prime nie jest modelem. To ścieżka serwowania — te same Qwen3.8-Max wagi, które dostawca wprowadził do ogólnej dostępności 3 sierpnia 2026 r., sprzedawane pod drugim identyfikatorem modelu za dokładnie dwukrotność międzynarodowego cennika. Step 5 Preview, zamknięty flagowiec StepFun, udostępnił swoje API 20 września 2026 r. i jest modelem w zwykłym sensie: jeden endpoint, jedna cena, jeden zestaw wag, których nie możesz posiadać. Uczciwa wersja tego starcia stawia więc zmierzony model przeciw niezmierzonej warstwie, a arytmetyka, która z tego wynika, jest bardziej dosadna, niż którykolwiek z dostawców umieściłby na slajdzie. W niezależnym Artificial Analysis Intelligence Index oba dzieli jeden punkt, 44 do 45, a koszt ukończonego zadania to 1,03 USD wobec 5,41 USD. Jeden punkt, cztery dolary i trzydzieści osiem centów na zadanie — i to zanim kupisz choć trochę szybkości, za którą Prime faktycznie pobiera opłatę.
To, co następuje, to rozbiór tej liczby: skąd się bierze, dlaczego standardowy Qwen ID jest już droższą połową porównania, zanim Prime cokolwiek podwoi, oraz co dodatkowe cztery dolary za zadanie kupują, a czego nie.
Nazwa robi robotę, której produkt nie robi
Alibaba ogłosiła Prime — 优速模式, tryb szybki — na konferencji Yunqi 22 września 2026 r. i opublikowała go jako wiersz w cenniku Model Studio. Dokumentacja samej firmy Alibaba nie pozostawia wątpliwości co do tego, co się zmienia: prędkość generowania wyników wzrasta do 1,5–2 razy w porównaniu ze standardowym API, a — jak ujmuje to dostawca — możliwości i ograniczenia użytkowania są identyczne jak w oryginalnym modelu. Żadnej nowej liczby parametrów, żadnego nowego kontraktu punktu końcowego, żadnej funkcji, której nie ma standardowy ID. Wystarczy zmienić nazwę modelu w treści żądania, aby znaleźć się na szybkiej ścieżce.

To czyni tę frazę wyszukiwania pułapką. Ktoś szukający flagowego modelu Qwen nowszego niż Qwen3.8-Max znajduje „Prime” i odczytuje je jako numer wersji. To cena. Wszystko, co nazwa sugeruje na temat możliwości, zapewnia sam Qwen3.8-Max: rzadki model mieszaniny ekspertów o 2,4 biliona parametrów, z około 95 miliardami parametrów aktywnych na token, 512 ekspertami na warstwę i kontekstem 983 616 tokenów w konfiguracji przetestowanej przez niezależny panel.
Step 5 Preview nie ma równoważnej niejednoznaczności i ma odwrotny problem. StepFun podaje, że ma około 600 miliardów parametrów całkowitych, z czego 27 miliardów aktywnych, wejście tekstowe, obrazowe i wideo, okno kontekstowe o rozmiarze 1 mln tokenów oraz udokumentowany limit wyjścia wynoszący 64 000 tokenów, a poziom wysiłku rozumowania można wybrać jako niski, średni lub wysoki. Jest własnościowy. Obiecano wersję BF16 na 15 października 2026 r. i nie została wydana; społecznościowe kopie kompilacji BF16 krążyły na Hugging od dnia otwarcia API, ale ponowne przesłania nie są wydaniem, a StepFun nie opublikował żadnego ogłoszenia o otwartych wagach.
Ta para jest więc naprawdę nierówna, jeszcze zanim pojawi się choćby jeden benchmark: model w wersji zapoznawczej, który może stać się plikiem do pobrania, kontra przeceniony poziom usług modelu, który nim nie zostanie.
Ile kosztuje jeden punkt indeksu
Oba modele zostały uruchomione przez tego samego niezależnego ewaluatora i właśnie w tym miejscu porównanie staje się niewygodne dla narracji o tańszym koszcie za token. Czytaj dalej 10 października 2026:
• Index — Step 5 Preview 44, znacznie powyżej mediany 26 dla porównywalnego modelu. Qwen3.8-Max w kompilacji 0902, 45. Jeden punkt.
• Koszt na ukończone zadanie indeksowania — 1,03 USD w porównaniu z 5,41 USD. Ponad pięciokrotnie lepiej.
• Cena za tokeny wyjściowe — 2,70 USD w porównaniu z 6,00 USD za milion tokenów w standardowym ID, która po przejściu na Prime staje się 9,902 USD. Step 5 Preview jest 2,2 razy tańszy niż standard i 3,7 razy tańszy niż Prime.
• Cena wejściowa — $1.00 wobec $2.00 w standardzie i $3.301 w Prime. Lustrzane odbicie kolumny wyjściowej, a zarazem ta, która ma większe znaczenie, gdy przeczytasz poniższe zestawienie kosztów.
• Trafienie w pamięć podręczną — 0,10 USD za milion tokenów w Step 5 Preview, 90-procentowy rabat; 0,25 USD w Qwen3.8-Max, 87,5-procentowy rabat, który własna strona dostawcy zaokrągla do 88 procent.
• Tokeny wyjściowe na sekundę — 87 wobec 35,4. Tutaj to Qwen jest tym wolnym i to około dwuipółkrotnie.
Kolumny kosztu na token i kolumna kosztu na zadanie nie zgadzają się, a wierzyć należy kolumnie kosztu na zadanie — z powodu, który ujawnia się dopiero po otwarciu rozbicia kosztów. W przebiegu indeksowania Step 5 Preview 0,85 USD z 1,03 USD to koszt wejściowy, a 0,17 USD to wyjściowy. W przypadku Qwen3.8-Max 4,76 USD z 5,41 USD to koszt wejściowy, a 0,65 USD to wyjściowy. Ceny katalogowe różnią się mniej więcej dwukrotnie; rachunki za zadania różnią się pięciokrotnie, ponieważ przebieg Qwen przepchnął przez harness około 9,9 mld tokenów wejściowych w porównaniu z 5,5 mld w Step 5 Preview, a także dlatego, że większość tego wolumenu to ruch z pamięci podręcznej odczytywany ponownie po dowolnym rabacie, jakiego udziela dostawca, a nie po stawce katalogowej.
Step 5 Preview jest opisywany przez tablicę jako bardzo rozwlekły, przy około 160 milionach tokenów wyjściowych w całym zestawie wobec mediany 82 milionów — a Qwen3.8-Max jest opisywany dokładnie tymi samymi słowami, przy około 190 milionach wobec tej samej mediany. Żaden z nich nie jest modelem, który odpowiada zwięźle. Jeśli długość wyjścia jest tym, co mieliście nadzieję optymalizować, żadna z tych kolumn wam nie pomoże.

To porównanie ma dziurę, a ona ma kształt Prime'a.
Każda wartość w poprzedniej sekcji została zmierzona na standardowym Qwen3.8-Max ID. Żadna z nich nie została zmierzona na Prime.
To nie jest kwestia techniczna. Cała propozycja Prime’a polega na tym, że tokeny docierają szybciej, a jedynym wskaźnikiem szybkości na tablicy dla tej rodziny jest 35,4 tokena wyjściowego na sekundę standardowego ID — to najwolniejszy wynik spośród trzech omawianych tu ID, i to z dużą przewagą; to także jedyny wiersz, w którym Qwen3.8-Max jest nie tylko drogi, ale i wyraźnie wypada słabiej. Jeśli Prime osiągnie górną granicę podanego przez Alibabę zakresu, te 35,4 zmienią się w coś około 70, wciąż poniżej 87 osiąganych przez Step 5 Preview, przy koszcie 3,7 razy większym na token wyjściowy. Jeśli osiągnie dolną granicę zakresu, będzie to około 53.
To szacunki oparte na mnożniku podanym przez dostawcę, a nie na pomiarach, i powinny być jako takie oznaczone. Nie udało nam się znaleźć nikogo, kto opublikowałby niezależny test przepustowości trybu Prime. Współczynnik od 1,5 do 2× pochodzi od samego Alibaba i jest jedynym twierdzeniem, na którym opiera się cały ten poziom.
Jedynym szczegółem strukturalnym, który przemawia na korzyść Prime, jest zasada ograniczania przepustowości, i łatwo ją przeoczyć. Dokumentacja Alibaby stwierdza, że w ramach Prime, gdy liczba wywołań osiągnie limit szybkości, jeśli platforma wciąż ma wolne zasoby, żądanie nie jest ograniczane — więc przepustowość dostępna dla ciebie nie spada poniżej podanego limitu. To miękki sufit z twardą podłogą: w warunkach rywalizacji otrzymujesz limit, przy niewykorzystanej przepustowości możesz otrzymać więcej. Dla pętli agenta wysyłającej dziesiątki sekwencyjnych wywołań ma to większe znaczenie niż mediana, ponieważ najwolniejsze wywołanie decyduje o tym, kiedy pętla się zakończy. Jest to również najjaśniejsze wyjaśnienie, dlaczego Prime w ogóle istnieje jako produkt. Alibaba sprzedaje pozycję w kolejce z przepustowości, którą już zbudowała, i pobiera podwójną opłatę za prawo do bycia obsłużonym jako pierwszy z niej.
Co mówią dwie karty stawek, gdy zestawi się je obok siebie
Alibaba publikuje swoje wiersze Qwen obok siebie, co sprawia, że arytmetyka tego poziomu jest wyjątkowo przejrzysta. Na stronie międzynarodowej wiersz Prime podaje 3,301 USD za wejście i 9,902 USD za wyjście za milion tokenów, w porównaniu z 1,65 USD i 4,951 USD dla standardowego ID i dla jego pinu 0902. To dokładnie 2,0 w obu kolumnach — nie zaokrąglone przybliżenie, lecz dosłowny stosunek opublikowanych liczb. Angielska strona cennika StepFun podaje Step 5 Preview na 1,00 USD za wejście, 0,10 USD przy trafieniu w pamięć podręczną i 2,70 USD za wyjście, przy czym wejście przy braku trafienia w pamięć podręczną obejmuje koszt zapisania nowej treści do pamięci podręcznej. Opublikowana przez dostawcę wartość dla trafienia w pamięć podręczną to 90-procentowy rabat; niezależny panel odnotowuje 95 procent na podstawie tych samych materiałów, i warto wiedzieć, względem której z tych dwóch wartości modelujesz.
Ustaw trzy karty w jednej kolumnie, a obraz staje się jasny. Wyjście Prime: 9,902 USD. Wyjście Standard Qwen: 6,00 USD według zapisu na tablicy wyników i 4,951 USD na własnej międzynarodowej stronie Alibaba. Wyjście Step 5 Preview: 2,70 USD. A na taniej ścieżce, której nikt nie reklamuje, odczyt z pamięci podręcznej w Step 5 Preview wynosi 0,10 USD wobec 0,25 USD w Qwen — co ma większe znaczenie niż kolumna wyjścia dla każdego obciążenia, które powtarza swój prefiks.
Jedno ostrzeżenie o nieaktualnych liczbach, ponieważ ta rodzina była ponownie wyceniona więcej niż raz w ciągu siedmiu tygodni. Powszechnie cytowane 2 USD za wejście i 6 USD za wyjście dla Qwen3.8-Max to sierpniowy nagłówek premiery i nadal to właśnie pokazuje zakładka Singapur w Alibaba. Wiersze międzynarodowe i globalne pokazują teraz 1,65 USD i 4,951 USD. Jeśli modelujesz wydatki, użyj cennika dla swojego regionu i przeczytaj go ponownie w dniu, w którym podejmujesz zobowiązanie.
Dwa sposoby odczytania 2×
Ponieważ Prime to ten sam model w cenie dwukrotnie wyższej niż standard ID, premia jest łatwa do wycenienia, ale trudna do uzasadnienia. W górnej części oferty Alibaby płacisz 2× za 2× większą szybkość, co jest neutralne kosztowo w przeliczeniu na sekundę usuniętego opóźnienia. Na dole płacisz 2× za 1,5×, czyli 33-procentową premię za każdą zaoszczędzoną sekundę. Żaden z tych skrajnych wariantów nie jest nierozsądny w zastosowaniach interaktywnych; żaden nie jest do obrony w przypadku nocnego przetwarzania wsadowego. Dlatego standardowa rada dotycząca tego poziomu — wywołania wrażliwe na opóźnienia na Prime, wszystko inne na standard ID — jest także właściwą radą.
Porównanie z Step 5 Preview to miejsce, w którym rozumowanie zmienia kształt, i właśnie tę część uwidacznia rama „vs”. Prime wcale nie konkuruje z Step 5 Preview ceną. Standardowy ID jest już droższy za token wyjściowy niż Step 5 Preview, pięć razy droższy za ukończone zadanie, a przy tym uzyskuje o jeden punkt więcej. Prime mnoży stronę kosztową równania, które już przegrywało, i odkupuje prędkość, której Step 5 Preview ma więcej za darmo. Jeśli prędkość jest tym, czego potrzebujesz od tej rodziny, uczciwym stwierdzeniem jest to, że model po drugiej stronie tej strony daje ci 87 tokenów na sekundę przy $2,70 za milion tokenów wyjściowych, a szybka ścieżka daje zakres, który według własnych liczb Alibaby sięga maksymalnie około 70 przy $9,902.
To nie jest argument, że Step 5 Preview wygrywa. To argument, że wartość Prime'a jest całkowicie wewnętrzna wobec własnej linii produktów Alibaba i że argumenty na jego rzecz opierają się na obciążeniach, w których jednopunktowa przewaga Qwen3.8-Max w indeksie, jego kontekst 983 616 tokenów albo jego odmienny profil zadań wykonują pracę, której nie wykonuje kontekst Step 5 Preview o rozmiarze 1 mln tokenów. Co jest porównaniem, którego nikt jeszcze nie może przeprowadzić, ponieważ wiersz Prime nie istnieje w żadnym niezależnym rankingu.

Co to oznacza dla kupującego
Żaden z tych dwóch nie znajduje się w OrcaRouter. Step 5 Preview jest dostępny przez własne API StepFun oraz przez garstkę platform zewnętrznych; Prime to poziom w Alibaba Cloud Model Studio udostępniany na endpoincie o zasięgu obszaru roboczego; a oba te twierdzenia możesz sprawdzić w naszym katalogu w tej samej minucie, w której je czytasz — co jest lepszym sprawdzianem niż branie nas na słowo.
To, co routingujemy, to inny produkt z tej samej rodziny — i okazuje się, że to właśnie ten, do którego nieustannie wraca arytmetyka tego artykułu. Standardowy Qwen3.8-Max i jego datowany pin Qwen3.8-Max-0902 znajdują się w katalogu pod tym samym kluczem co ich rodzeństwo Qwen3.8-Max-Preview, Qwen3.8-Flash i Qwen3.8-27B, wraz z ponad 200 innymi modelami, przy czym cena katalogowa dostawcy jest przekazywana dalej z 0-procentowym narzutem. Wynikają z tego dwie rzeczy i obie mają znaczenie dla powyższej decyzji. Po pierwsze, zmiana cennika u Alibaba pojawia się po naszej stronie tego samego dnia, w którym Alibaba ją publikuje — dokładnie ta właściwość, jakiej oczekujesz od dostawcy, który zdążył już dwukrotnie zmienić ceny tej rodziny w ciągu siedmiu tygodni. Po drugie, twój punkt odniesienia przestaje być zakładem na jednego dostawcę: standardowy identyfikator to poziom, który najprawdopodobniej pozostawisz na swojej domyślnej ścieżce, a trzymanie go za warstwą routingu, a nie w bezpośredniej integracji, sprawia, że decyzja o Prime staje się odwracalna osobno dla każdego endpointu, a nie dla całej umowy.
Jeśli wybierasz między dwiema nazwami w tytule tego artykułu, podział jest prosty. Sięgnij po Step 5 Preview, gdy chcesz wynik, wejście wideo i obrazu oraz 90-procentowy rabat na pamięć podręczną, i zaakceptuj, że wynajmujesz podgląd, którego punkt kontrolny jest obietnicą na 15 października, a nie licencją. Sięgnij po Qwen 3.8 Max Prime tylko wtedy, gdy już zdecydowałeś się na Qwen3.8-Max i zmierzyłeś na własnych promptach, że to 35 tokenów na sekundę standardowego ID jest tym, co kosztuje cię pieniądze — i wyceń tę decyzję względem 2×, a nie względem 1,5×, ponieważ górna granica zakresu dostawcy to nie liczba, którą zobaczysz w produkcji.
Pomiar, który rozstrzygnąłby tę sprawę, nie istnieje i warto powiedzieć to wprost, zamiast upiększać. Ktoś musi przepuścić Prime przez środowisko testowe, które uruchamia także Step 5 Preview, opublikować rozkład przepustowości, a nie mnożnik, i umieścić wartość kosztu na zadanie obok punktu indeksu, który się za to kupuje. Do tego czasu jedynymi liczbami, które obie strony mają wspólne, są dwie karty stawek, a mówią one to samo z przeciwnych kierunków: szybka ścieżka to najdroższy sposób kupienia tokena Qwen3.8-Max i najwolniejszy sposób kupienia sekundy czasu zegarowego w porównaniu z tym, co alternatywa liczy sobie za tę samą sekundę.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
