Titolo generato: 'Step 5 Preview vs GLM-5.5 — one ships, one does not' con due colonne: Step 5 Preview con AA Index 44, 600B totali / 27B attivi, prezzo $1,00 / $2,70, output 99,8 token/sec e un'API live dal 20 settembre; GLM-5.5 con righe che riportano nessuna model card, nessun identificatore API, nessun prezzo e nessun nome confermato. Un piè di pagina recita: 'Step 5 Preview figures per Artificial Analysis; GLM-5.5 is an unannounced, unreleased model.'

Hmm — the instruction says translate the user's message into Italian. Quoted strings should perhaps be translated too. But the title card title is English quoted — should be translated to Italian. Let me translate everything including quoted content, since they're part of the text. Actually the guideline: text inside quotes is still text to translate. Let's translate.

'Titolo generato: "Step 5 Preview vs GLM-5.5 — uno arriva sul mercato, l'altro no"...'

Let me produce a full translation.

"Titolo immagine generato: 'Step 5 Preview vs GLM-5.5 — uno viene rilasciato, l'altro no', con due colonne: Step 5 Preview con AA Index 44, 600B totali / 27B attivi, prezzo $1,00 / $2,70, output di 99,8 token/sec e un'API live dal 20 settembre; GLM-5.5 con righe che recitano: nessuna model card, nessun identificatore API, nessun prezzo e nessun nome confermato. Un piè di pagina recita: 'I dati di Step 5 Preview secondo Artificial Analysis; GLM-5.5 è un modello non annunciato e non rilasciato.'"

Good. "title card" = "scheda del titolo"? "Generated title card titled" — "Title card generata dal titolo"? Better: "Title card generata intitolata". I'll use "Title card generata intitolata '...'". Slightly awkward. Use "Scheda di titolo generata, intitolata...". I'll go with "Title card generata intitolata".

Decimal: Italian uses comma. $1.00 → $1,00. Fine.Title card generata, intitolata 'Step 5 Preview vs GLM-5.5 — uno viene rilasciato, l'altro no', con due colonne: Step 5 Preview con AA Index 44, 600B totali / 27B attivi, prezzo $1,00 / $2,70, output di 99,8 token/sec e un'API live dal 20 settembre; GLM-5.5 con righe che recitano: nessuna model card, nessun identificatore API, nessun prezzo e nessun nome confermato. Un piè di pagina recita: 'I dati di Step 5 Preview secondo Artificial Analysis; GLM-5.5 è un modello non annunciato e non rilasciato.'
Guides & Insights

Step 5 Preview vs GLM-5.5: un modello esce oggi, l'altro è ancora una previsione

Autore

Gideon Frost

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Step 5 Preview ha aperto la sua API il 20 settembre 2026, lo stesso giorno in cui StepFun l'ha annunciata, e puoi chiamarla questo pomeriggio da un unico endpoint a 1,00 $ per milione di token in input e 2,70 $ per milione di token in output. GLM-5.5 non esiste. Non c'è nessuna model card, nessun identificatore API, nessun prezzo, nessun checkpoint e nessun file di licenza, e non esiste da nessuna parte una pagina Z.ai che utilizzi quel nome — perché GLM-5.5 è una scorciatoia della community che l'azienda non ha mai adottato. Questa asimmetria è l'articolo. Quello che segue è ciò che StepFun ha effettivamente rilasciato, ciò che è realmente accertato sul prossimo flagship di Z.ai e il confronto testa a testa che puoi eseguire oggi al posto di quello del titolo.

Cos'è GLM-5.5 e cosa non è

Il nome è entrato in circolazione a metà 2026 associato a una finestra di lancio, e la finestra ha un'origine tracciabile: una previsione di un analista, rilanciata il 25 giugno 2026, che collocava il prossimo flagship di Z.ai ad agosto. Era una finestra di osservazione, non un impegno da parte del fornitore, e agosto si è concluso senza che arrivasse. Ciò che Z.ai ha pubblicato al suo posto è stato GLM-5.3, annunciato il 14 agosto, con l'API attiva intorno al 18 agosto e i pesi aperti il 28 agosto, seguito da GLM-5.3-Flash il 26 agosto. Nessun checkpoint di GLM-5.5 è apparso sull'organizzazione Hugging Face dello stesso fornitore, dove i repository più recenti si fermano ancora alla serie GLM-5.3.

Anche la denominazione è incerta. GLM-5.3, GLM-5.4, GLM-5.5 e GLM-6 sono stati tutti ipotizzati nella stessa finestra, e Z.ai non ne ha confermato nessuno. L'unico segnale dal lato aziendale è un'osservazione di un cofondatore su una release "epic plus", che è più uno stato d'animo che una specifica. Gli analisti che leggono la cadenza del fornitore — all'incirca un flagship ogni 54-70 giorni — ora collocano il prossimo modello in una finestra che va dall'8 ottobre al 9 novembre 2026, e si aspettano che sia numerato GLM-5.4 anziché GLM-5.5.

Tre affermazioni circolano come se fossero confermate, e vale la pena essere precisi su tutte e tre. Il conteggio dei parametri è il più debole: nulla di ufficiale supporta la cifra "più di 1 trilione", e i successivi post sui social che la gonfiano oltre 3 trilioni non citano assolutamente nulla. Il contesto da 1M token è l'ipotesi più sicura, perché sia GLM-5.2 sia GLM-5.3 lo prevedono. I pesi aperti sono un'aspettativa più che una promessa — Z.ai ha rilasciato i pesi per i suoi ultimi diversi modelli di punta, il che è una tendenza, non un impegno.

Cosa viene effettivamente rilasciato in Step 5 Preview

Il modello di StepFun è la metà concreta di questo confronto, e la specifica è insolita. È un modello sparse mixture-of-experts da 600B parametri totali con circa 27B attivi per token — un rapporto di attivazione vicino al 4,5% — costruito su un transformer stretto e profondo a 92 livelli con sparse grouped-query attention e block-wise token merging. La finestra di contesto è di 1M token, l'input è testo e immagini, l'output è testo, e ragiona con extended thinking. StepFun ha saltato l'intera linea Step 4.x per arrivare qui, passando direttamente da Step-3.7-Flash a Step 5.

• Intelligence Index — 44 su Artificial Analysis, 24° su 200 modelli valutati, contro una mediana di 24

• Velocità di output — 99,8 token al secondo, 45º su 200

• Tempo al primo token — 2,96 secondi sulla stessa esecuzione indipendente

• Prezzo — $1.00 per 1M token di input, $2.70 per 1M token di output, con uno sconto del 95% sulla cache

Costo per attività dell'Intelligence Index — 0,71 $, 27º su 200

• Pesi — nessuno oggi; un checkpoint BF16 è previsto per il 15 ottobre 2026

• Licenza — nessuna pubblicata. Il modello è proprietario e non sono indicati alcuna concessione per uso commerciale, diritto di ridistribuzione o permesso di fine-tuning.

Il prezzo è la riga che salta all'occhio, e lo è anche un dato che rende a StepFun meno favore di quanto sembri a prima vista: 160M token di output sull'Intelligence Index contro una mediana di 92M, 64º su 200 per quella misura. Il modello è prolisso, e la prolissità è un moltiplicatore di costi proprio nei carichi di lavoro agentici per cui viene venduto. Il valore di 0,71 $ di costo per attività lo include già, ed è per questo che è il numero più onesto da citare rispetto al prezzo di listino.

Le valutazioni di StepFun non sono state riprodotte e vanno considerate materiale del fornitore finché qualcuno indipendente non le esegue. Collocano il modello a 29,5 su ALE-CLI, 66,4 su FrontierFinance, 83,3 su DRACO, 80,5 su ProgramBench, 67,7 su DeepSWE v1.1 e 49,0 su StepCodeBench, con il 33,3% su Terminal-Bench 4.0 e 1571 su GDPval-AA v2. StepFun riporta anche un picco MLA di 508 TFLOPS in un'attività di ottimizzazione di kernel GPU di 24 ore, contro 493 di Claude Opus 5. Questi sono i numeri di StepFun su un modello che StepFun non ha aperto.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator with a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens against a 92M median, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning support, text and image input, and a 1M-token context window.

Il confronto diretto che puoi eseguire invece di questo

Se volete il confronto che il titolo promette, il sostituto onesto è Step 5 Preview contro GLM-5.3 — il modello che Z.ai ha effettivamente rilasciato, ancora il suo attuale flagship aperto, e quello che qualsiasi GLM-5.5 andrebbe a sostituire. Nella classifica indipendente i due sono distanti un punto. Su quasi tutto il resto no.

• Indice di Intelligenza — Step 5 Preview 44 vs GLM-5.3 45

• Parametri — 600B totali / 27B attivi vs 753B totali / 40B attivi

• Velocità di output — 99,8 token/sec vs 72,1 token/sec

• Tempo al primo token — 2,96 s vs 2,99 s

• Prezzo per 1M token — 1,00 $ in ingresso / 2,70 $ in uscita vs 1,40 $ in ingresso / 4,40 $ in uscita

• Sconto cache — 95% vs 81%

• Costo per attività dell'Intelligence Index — 0,71 $ vs 2,01 $

• Modalità di input — testo e immagini rispetto a solo testo

• Licenza — nessuna pubblicata vs una licenza Z.ai personalizzata che non è MIT

Il quadro ripete ciò che il lancio di Step 5 Preview ha stabilito contro ogni modello in distribuzione su cui è stato valutato: un vantaggio decisivo in efficienza e un pareggio statistico in capacità. Genera token circa il 38% più velocemente, costa all'incirca la metà per milione di token in entrambe le direzioni e risulta 2,8 volte più economico per attività di indicizzazione rispetto a GLM-5.3 — pur ottenendo un punto in meno. In classifica, quel 44 lo pone anche allo stesso livello di Kimi K3, cosa che vale la pena sapere prima di considerare l'uno o l'altro come leader.

L'unica riga in cui Step 5 Preview è inequivocabilmente indietro è quella che non puoi sottoporre a benchmark. GLM-5.3 ha un file di licenza e pesi scaricabili; Step 5 Preview ha un repository Hugging Face contenente un singolo .gitattributes e una data dichiarata del 15 ottobre per il checkpoint BF16. Se il prossimo flagship di Z.ai arriverà con pesi aperti secondo le stesse condizioni personalizzate che ha usato tutto l'anno, si colloca nell'unica categoria in cui Step 5 Preview attualmente non ha una risposta — che è la vera ragione per cui vale la pena aspettare un confronto con GLM-5.5 invece di eseguirlo.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.5 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and API live since September 20. The right column gives GLM-5.5 the rows AA Index no model to score, parameters more than 1T rumored and unconfirmed, price none, cache discount none, cost per index task none, and availability not released. A footer reads 'Step 5 Preview figures per Artificial Analysis Intelligence Index; GLM-5.5 is an unannounced, unreleased model with no vendor or independent figures.'

Perché aspettare GLM-5.5 è l'opzione costosa

Il problema pratico di un modello che è dato in arrivo tra due mesi ormai da due mesi è che il tuo lavoro di valutazione non può aspettare. GLM-5.5 non ha un endpoint, quindi non può essere sottoposto a benchmark, confrontato sul prezzo, testato sotto carico o messo dietro una regola di fallback. Ogni settimana spesa a pianificare in funzione di esso è una settimana di decisioni rinviate sulla base di una previsione — e la previsione ha già mancato una finestra.

GLM-5.3, al contrario, è attivo su OrcaRouter sotto z-ai/glm-5.3 a $1,26 in input e $3,96 in output rispetto ai $1,40 e $4,40 dei listini Z.ai sulla sua pagina. Viene passato senza alcun ricarico, il che significa che il numero che vedi è la tariffa attuale del provider e non una che stabiliamo noi, e una variazione di prezzo del fornitore è attiva dalla nostra parte lo stesso giorno anziché al ciclo di fatturazione successivo.

Step 5 Preview non è nel nostro catalogo e non lo instradiamo. Viene eseguito tramite l'API e lo Studio di StepFun, e questo è l'unico posto in cui viene eseguito fino all'arrivo del checkpoint del 15 ottobre. Nel frattempo, ciò che OrcaRouter ti offre è tutto ciò che sta dall'altra parte di quel confronto dietro un'unica API per più di 200 modelli: GLM-5.3 alla tariffa sopra indicata, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 e gli altri, con failover automatico tra provider che mantiene stabile un percorso di produzione mentre la curva di capacità di un'anteprima è ancora sconosciuta, e il DSL di routing che ne compone diversi in un'unica chiamata invece di una seconda integrazione. Confronta le prestazioni dell'anteprima con quelle di un modello di produzione sulla stessa chiave; lascia il percorso di produzione dov'è.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a seven-day median time to first token of 3.68 seconds and a 95th percentile of 10.00 seconds, seven-day traffic of 2296.2M tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

Cosa cambierebbe la risposta

A deciderlo sono due date. Il 15 ottobre è il giorno in cui, secondo StepFun, arriverà il checkpoint BF16 per Step 5 Preview, e la licenza che lo accompagna è la singola incognita più decisiva del confronto: una licenza permissiva trasformerebbe un vantaggio di 2,8 volte nel costo per attività in qualcosa che possiedi anziché noleggiare, e cancellerebbe l'unico asse su cui GLM-5.3 è chiaramente avanti. Una licenza restrittiva lascia GLM-5.3 come l'unico dei due su cui puoi costruire un prodotto, e trasforma il divario di un punto in un dettaglio trascurabile riguardo a due modelli che useresti comunque in modo diverso.

Il secondo è la finestra dell'analista che va dall'8 ottobre al 9 novembre per il prossimo flagship di Z.ai, che potrebbe o meno chiamarsi GLM-5.5 e potrebbe o meno assomigliare alla voce. Se arriva, arriva come un modello con una licenza e un checkpoint — le due cose che mancano a Step 5 Preview — e il confronto diventa reale.

Finché entrambi non si risolvono, la domanda utile non è quale dei due sia migliore, perché uno dei due non può essere eseguito. È su quale dei modelli che esistono dovresti costruire adesso, e se la risposta cambia quando compare il prossimo checkpoint. Questa domanda ha una risposta verificabile questa settimana, e non richiede di aspettare che un nome diventi un modello.

Confrontati in questo articolo3

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno