
Step 5 Preview vs GLM-5.5: Jeden model dostępny już dziś, drugi wciąż jest tylko zapowiedzią
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Step 5 Preview udostępnił swoje API 20 września 2026 r., tego samego dnia, w którym StepFun je ogłosiło, a już dziś po południu możesz je wywołać z jednego punktu końcowego za 1,00 USD za milion tokenów wejściowych i 2,70 USD za milion tokenów wyjściowych. GLM-5.5 nie istnieje. Nie ma karty modelu, identyfikatora API, ceny, checkpointu ani pliku licencji, a nigdzie nie ma strony Z.ai, która używałaby tej nazwy — ponieważ GLM-5.5 to potoczne określenie używane przez społeczność, którego firma nigdy nie przyjęła. Ta asymetria jest tematem tego artykułu. W dalszej części znajdziesz to, co StepFun faktycznie udostępnił, co jest naprawdę ustalone na temat następnego flagowego modelu Z.ai oraz bezpośrednie porównanie, które możesz przeprowadzić już dziś zamiast tego z tytułu.
Czym GLM-5.5 jest, a czym nie jest
Nazwa weszła do obiegu w połowie 2026 roku w związku z oknem wydania, a to okno ma możliwe do prześledzenia pochodzenie: prognoza analityka przekazana 25 czerwca 2026 r., która umiejscawiała kolejny flagowy model Z.ai w sierpniu. Było to okno obserwacyjne, a nie zobowiązanie dostawcy, i sierpień minął, a on się nie pojawił. Zamiast tego Z.ai wypuściło GLM-5.3, ogłoszone 14 sierpnia, z API działającym około 18 sierpnia i otwartymi wagami 28 sierpnia, a następnie 26 sierpnia GLM-5.3-Flash. Żaden checkpoint GLM-5.5 nie pojawił się w organizacji Hugging Face dostawcy, gdzie najnowsze repozytoria nadal sięgają co najwyżej serii GLM-5.3.
Nazewnictwo również pozostaje nierozstrzygnięte. GLM-5.3, GLM-5.4, GLM-5.5 i GLM-6 wszystkie były wymieniane w tym samym oknie czasowym, a Z.ai nie potwierdziło żadnego z nich. Jedynym sygnałem ze strony firmy jest wypowiedź współzałożyciela o wydaniu „epic plus”, co jest raczej nastrojem niż specyfikacją. Analitycy analizujący kadencję dostawcy — mniej więcej jeden flagowy model co 54 do 70 dni — obecnie przewidują, że następny model pojawi się w oknie trwającym od 8 października do 9 listopada 2026 r., i oczekują, że otrzyma numer GLM-5.4, a nie GLM-5.5.
Trzy twierdzenia krążą tak, jakby zostały potwierdzone, i warto zachować precyzję wobec wszystkich trzech. Najsłabsza jest liczba parametrów: nic oficjalnego nie potwierdza wartości „ponad 1 bilion”, a późniejsze posty w mediach społecznościowych, zawyżające ją do ponad 3 bilionów, nie powołują się na żadne źródła. Kontekst 1M tokenów to najbezpieczniejsze założenie, ponieważ zarówno GLM-5.2, jak i GLM-5.3 go mają. Otwarte wagi to raczej oczekiwanie niż obietnica — Z.ai udostępniło wagi dla kilku swoich ostatnich flagowych modeli, co jest wzorem, a nie zobowiązaniem.
Co tak naprawdę zawiera Step 5 Preview
Model StepFun to konkretna połowa tego porównania, a specyfikacja jest nietypowa. To rzadki model mieszaniny ekspertów o łącznej liczbie 600 mld parametrów, z około 27 mld aktywnych na token — współczynnik aktywacji blisko 4,5% — zbudowany na 92-warstwowym wąskim i głębokim transformerze z rzadką uwagą z grupowanymi zapytaniami i blokowym scalaniem tokenów. Okno kontekstowe wynosi 1 mln tokenów, dane wejściowe to tekst i obrazy, dane wyjściowe to tekst, a model rozumuje z wykorzystaniem rozszerzonego myślenia. StepFun pominął całą linię Step 4.x, aby tu dotrzeć, przechodząc bezpośrednio od Step-3.7-Flash do Step 5.
• Indeks inteligencji — 44 w Artificial Analysis, 24. miejsce spośród 200 ocenianych modeli, wobec mediany 24
• Szybkość generowania — 99,8 tokena na sekundę, 45. na 200
• Czas do pierwszego tokenu — 2,96 sekundy w tym samym niezależnym przebiegu
• Cena — 1,00 USD za 1 mln tokenów wejściowych, 2,70 USD za 1 mln tokenów wyjściowych, z 95% zniżką na pamięć podręczną
• Koszt na zadanie Intelligence Index — 0,71 USD, 27. miejsce na 200
• Wagi — dziś brak; punkt kontrolny BF16 zaplanowano na 15 października 2026
• Licencja — nie opublikowano żadnej. Model jest własnościowy, bez podanego przyznania prawa do użytku komercyjnego, prawa do redystrybucji ani zgody na dostrajanie.
Cena to przyciągający wzrok wiersz, podobnie jak wiersz, który stawia StepFun w mniej korzystnym świetle, niż się na pierwszy rzut oka wydaje: 160 mln tokenów wyjściowych w Intelligence Index wobec mediany 92 mln, 64. miejsce na 200 według tego wskaźnika. Model jest rozwlekły, a rozwlekłość jest mnożnikiem kosztów dokładnie w tych agentowych obciążeniach, dla których jest sprzedawany. Wskaźnik kosztu na zadanie wynoszący 0,71 USD już to uwzględnia, dlatego jest uczciwszą liczbą do przytoczenia niż cena katalogowa.
Własne ewaluacje StepFun nie zostały odtworzone i należy je czytać jako materiał dostawcy, dopóki ktoś niezależny ich nie przeprowadzi. Umieszczają model na poziomie 29,5 w ALE-CLI, 66,4 w FrontierFinance, 83,3 w DRACO, 80,5 w ProgramBench, 67,7 w DeepSWE v1.1 i 49,0 w StepCodeBench, z 33,3% w Terminal-Bench 4.0 i 1571 w GDPval-AA v2. StepFun podaje również szczyt MLA na poziomie 508 TFLOPS w 24-godzinnym zadaniu optymalizacji jądra GPU w porównaniu z 493 dla Claude Opus 5. To są liczby StepFun dotyczące modelu, którego StepFun nie otworzył.

Bezpośrednie porównanie, które możesz przeprowadzić zamiast tego
Jeśli chcesz porównania, które obiecuje tytuł, uczciwym zamiennikiem jest Step 5 Preview kontra GLM-5.3 — model, który Z.ai faktycznie wydało, wciąż będący jego obecnym otwartym flagowcem, i ten, którego zastąpiłby ewentualny GLM-5.5. W niezależnym rankingu oba dzieli jeden punkt. Pod niemal każdym innym względem już nie.
• Indeks Inteligencji — Step 5 Preview 44 vs GLM-5.3 45
• Parametry — łącznie 600B / 27B aktywnych vs łącznie 753B / 40B aktywnych
• Szybkość generowania — 99,8 tokenów/s vs 72,1 tokenów/s
• Czas do pierwszego tokena — 2,96 s vs 2,99 s
• Cena za 1 mln tokenów — 1,00 USD za wejście / 2,70 USD za wyjście vs 1,40 USD za wejście / 4,40 USD za wyjście
• Rabat na cache — 95% vs 81%
• Koszt na zadanie Intelligence Index — 0,71 USD vs 2,01 USD
• Modalność wejściowa — tekst i obrazy vs tylko tekst
• Licencja — nie opublikowano żadnej vs niestandardowa licencja Z.ai, która nie jest MIT
Ten układ powtarza to, co ustalono przy premierze Step 5 Preview na tle każdego wydanego modelu, z którym został on oceniony: zdecydowaną przewagę w wydajności i statystyczny remis pod względem możliwości. Generuje tokeny o około 38% szybciej, kosztuje około połowę stawki za milion tokenów w obu kierunkach i wypada 2,8 razy taniej na zadanie indeksowania w porównaniu z GLM-5.3 — mimo że uzyskuje o punkt niższy wynik. W rankingu ten wynik 44 stawia go również na równi z Kimi K3, co warto wiedzieć, zanim potraktuje się któregokolwiek z nich jako lidera.
Jedyny wiersz, w którym Step 5 Preview jest jednoznacznie w tyle, to ten, którego nie da się zbenchmarkować. GLM-5.3 ma plik licencji i wagi do pobrania; Step 5 Preview ma repozytorium Hugging Face zawierające pojedynczy .gitattributes oraz podaną datę 15 października dla checkpointu BF16. Jeśli następny flagowiec Z.ai pojawi się z otwartymi wagami na tych samych niestandardowych warunkach, których używał przez cały rok, trafi do jedynej kategorii, w której Step 5 Preview obecnie nie ma odpowiedzi — co jest prawdziwym powodem, dla którego warto poczekać na porównanie z GLM-5.5, zamiast je przeprowadzać.

Dlaczego czekanie na GLM-5.5 jest kosztowną opcją
Praktyczny problem z modelem, który od dwóch miesięcy ma premierę za dwa miesiące, polega na tym, że twoja praca ewaluacyjna nie może czekać tak długo, jak on. GLM-5.5 nie ma endpointu, więc nie można go poddać benchmarkom, porównać pod względem ceny, przetestować pod obciążeniem ani umieścić za regułą awaryjną. Każdy tydzień spędzony na planowaniu wokół niego to tydzień decyzji odłożonych w oparciu o prognozę — a prognoza już przegapiła jedno okno.
GLM-5.3 natomiast jest dostępny na OrcaRouter pod z-ai/glm-5.3 w cenie 1,26 USD za wejście i 3,96 USD za wyjście w porównaniu z 1,40 USD i 4,40 USD z cennika Z.ai na jego własnej stronie. Jest to przekazywane bez marży, co oznacza, że liczba, którą widzisz, to aktualna stawka dostawcy, a nie stawka ustalona przez nas, a zmiana ceny u dostawcy jest uwzględniana po naszej stronie tego samego dnia, a nie w następnym cyklu rozliczeniowym.
Step 5 Preview nie znajduje się w naszym katalogu i nie kierujemy do niego ruchu. Działa na własnym API i w Studio StepFun i to jedyne miejsce, w którym działa, dopóki nie pojawi się punkt kontrolny z 15 października. To, co w międzyczasie daje ci OrcaRouter, to wszystko po drugiej stronie tego porównania za jednym API dla ponad 200 modeli: GLM-5.3 w podanej wyżej stawce, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 i reszta, z automatycznym przełączaniem awaryjnym między dostawcami, które utrzymuje stabilną ścieżkę produkcyjną, gdy krzywa przepustowości wersji zapoznawczej jest jeszcze nieznana, a DSL routingu łączy kilka z nich w jedno wywołanie zamiast drugiej integracji. Zrób benchmark wersji zapoznawczej względem modelu produkcyjnego na tym samym kluczu; pozostaw ścieżkę produkcyjną tam, gdzie jest.

Co zmieniłoby odpowiedź?
Rozstrzygają to dwie daty. 15 października to dzień, w którym — jak zapowiedział StepFun — pojawi się checkpoint BF16 dla Step 5 Preview, a licencja, która pojawi się razem z nim, jest najistotniejszą niewiadomą w tym porównaniu — permisywna licencja sprawiłaby, że 2,8-krotna przewaga kosztu na zadanie stałaby się czymś, co posiadasz, a nie wynajmujesz, i wymazałaby jedyną oś, na której GLM-5.3 wyraźnie prowadzi. Restrykcyjna licencja sprawia, że GLM-5.3 pozostaje jedynym z tej dwójki, na którym możesz zbudować produkt, i zamienia jednopunktową różnicę w ciekawostkę o dwóch modelach, których i tak używałbyś inaczej.
Drugie to okno analityczne działające od 8 października do 9 listopada dla kolejnego flagowego modelu Z.ai, który może, ale nie musi, nazywać się GLM-5.5 i może, ale nie musi, przypominać pogłoskę. Jeśli w ogóle się pojawi, pojawi się jako model z licencją i checkpointem — dwóch rzeczy, których brakuje w Step 5 Preview — a porównanie staje się prawdziwym porównaniem.
Dopóki oba się nie rozstrzygną, użyteczne pytanie nie brzmi, które z tych dwóch jest lepsze, bo jednego z nich nie da się uruchomić. Brzmi ono: na których z istniejących modeli powinieneś teraz budować i czy odpowiedź zmieni się, gdy pojawi się kolejny checkpoint. To pytanie ma w tym tygodniu odpowiedź, którą można sprawdzić, i nie wymaga czekania, aż nazwa stanie się modelem.
Porównane w tym artykule3
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
