Scheda del titolo generata intitolata «Step 5 Preview vs GLM-5.3 — un punto di distanza» con due colonne e un badge «1 punto» tra di esse: Step 5 Preview ad AA Index 44, 600B totali / 27B attivi, prezzo $1,00 / $2,70, output 99,8 token/sec e pesi previsti per il 15 ottobre; GLM-5.3 ad AA Index 45, 753B totali / 40B attivi, prezzo $1,40 / $4,40, output 72,1 token/sec e pesi pubblicati con licenza personalizzata. Un piè di pagina recita «Entrambi secondo Artificial Analysis Intelligence Index v4.3.2; GLM-5.3 è valutato come GLM-5.3 (max)».
Guides & Insights

Step 5 Preview vs GLM-5.3: separati da un punto, e solo uno dei due ha un file di licenza

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Sulla scheda indipendente, Step 5 Preview e GLM-5.3 sono a un punto di distanza: 44 contro 45 sull'Artificial Analysis Intelligence Index v4.3.2, dove GLM-5.3 è valutato come GLM-5.3 (max) e Step 5 Preview non riporta alcuna etichetta di effort. È il divario più stretto di questa serie, ed è anche il numero meno utile del confronto. Il numero che decide è che GLM-5.3 ha pesi che puoi scaricare oggi — pubblicati da Z.ai con una licenza personalizzata che non è MIT — mentre Step 5 Preview, annunciato da StepFun il 20 settembre 2026, ha un repository Hugging Face che contiene un solo .gitattributes e una data di rilascio dichiarata del 15 ottobre per il checkpoint BF16. Il materiale di lancio di StepFun descrive il modello come un risultato open source tra i primi tre. Non è ancora open source. GLM-5.3 lo è, e la sua licenza è la cosa da leggere prima di impostare i tuoi piani su di esso.

Che cosa compra davvero un punto dell’indice

Entrambi i modelli sono stati sottoposti alle stesse dieci valutazioni dallo stesso laboratorio, il che rende il confronto insolitamente pulito e insolitamente poco utile allo stesso tempo.

• Indice di Intelligenza — Step 5 Preview 44 vs GLM-5.3 45

• Dove si colloca — GLM-5.3 è un punto sopra Step 5 Preview; Step 5 Preview è allo stesso livello di Kimi K3

• Parametri — Step 5 Preview 600B totali / 27B attivi vs GLM-5.3 753B totali / 40B attivi

• Velocità di output — Step 5 Preview 99,8 token/sec vs GLM-5.3 72,1 token/sec

• Tempo al primo token — Step 5 Preview 2,96 s vs GLM-5.3 2,99 s

• Prezzo per 1M di token — Step 5 Preview 1,00 $ in ingresso / 2,70 $ in uscita vs GLM-5.3 1,40 $ in ingresso / 4,40 $ in uscita

• Sconto cache — Step 5 Preview 95% vs GLM-5.3 81%

• Costo per attività dell'Intelligence Index — Step 5 Preview $0,71 vs GLM-5.3 $2,01

• Contesto — entrambi da 1 milione di token; il nostro catalogo elenca GLM-5.3 con un tetto di output di 131,1K, StepFun non ne ha pubblicato alcuno

• Pesi — Step 5 Preview chiuso, checkpoint BF16 previsto per il 15 ottobre; GLM-5.3 pubblicato con licenza personalizzata Z.ai

Leggi quelle righe insieme e il divario di un punto smette di essere il titolo principale. Step 5 Preview costa il 29% in meno sull'input, il 39% in meno sull'output, genera token il 38% più velocemente e porta uno sconto cache più profondo di 14 punti — e il valore di costo per attività di indicizzazione, che racchiude verbosità e comportamento della cache in un unico numero, è 2,8 volte inferiore. Lo fa con 600B totali contro i 753B di GLM-5.3, con 27B attivi contro 40B. Sull'asse dell'efficienza non è una sfida equilibrata; sulla capacità è il più vicino che la classifica consenta.

L'unica riga in cui Step 5 Preview non vince è quella più difficile da correggere: GLM-5.3 ha un file di licenza e Step 5 Preview no.

La licenza è tutta la differenza, e non è MIT

È facile presumere che il flagship open di un laboratorio cinese venga distribuito con licenza MIT, perché diversi lo fanno. GLM-5.2 e GLM-5.3-Flash di Z.ai stesso portano entrambi la MIT. Il flagship GLM-5.3 no: viene distribuito con una licenza personalizzata "glm-5.3" che consente l'uso commerciale soggetto a una serie di restrizioni. Si tratta di un documento sostanzialmente diverso dai termini MIT che accompagnano il suo fratello minore, e per un'azienda i cui legali leggono la licenza prima del README, è una conversazione, non una formalità.

Step 5 Preview non ha ancora alcuna licenza, il che è un problema diverso e non palesemente più piccolo. Una licenza restrittiva ti dice cosa puoi fare e ti lascia decidere se i termini sono accettabili. Nessuna licenza non ti dice nulla: nessuna concessione per uso commerciale, nessun diritto di ridistribuzione, nessun permesso di fine-tuning e nessun modo per valutare se il checkpoint del 15 ottobre sarà utilizzabile per il tuo prodotto finché non compare. Il nome del repository che StepFun si è riservata — stepfun-ai/Step-5-Preview-BF16 — indica un formato bfloat16, ovvero l'artefatto da cui fai fine-tuning e quantizzazione anziché quello che servi. Questo ti dice la forma della release. Non ti dice i suoi termini.

Quindi il confronto onesto è tra una licenza che puoi leggere e con cui puoi non essere d'accordo, e una licenza che non esiste. Per un team che deve fare fine-tuning, eseguire il self-hosting in un ambiente controllato o distribuire un prodotto derivato, GLM-5.3 è l'unico dei due ad avere una risposta, e la risposta è una revisione legale piuttosto che un via libera.

Il divario di efficienza è la parte che regge

Le affermazioni sull'efficienza meritano più scetticismo di quelle sui benchmark, perché sono più facili da fare e più difficili da verificare. Queste due reggono meglio della maggior parte, e il meccanismo è visibile nell'architettura.

I modelli sparse mixture-of-experts spendono capacità di calcolo solo sugli esperti a cui un token viene instradato, quindi la cifra attivata governa il comportamento in produzione mentre il totale è per lo più una questione di memoria. Con 27B attivi contro i 40B di GLM-5.3, Step 5 Preview svolge circa un terzo in meno di lavoro per token, e le misurazioni lo confermano: 99,8 token di output al secondo contro 72,1, e un costo per attività di indicizzazione di 0,71 $ contro 2,01 $. È la stessa storia raccontata in tre modi, ed è proprio questo che la rende credibile anziché un singolo numero lusinghiero.

Lo sconto sulla cache è la voce che conta di più per il carico di lavoro per cui entrambi i modelli sono venduti. Un ciclo di agente che rinvia lo stesso prompt di sistema e lo stesso contesto del repository a ogni turno vive quasi interamente all'interno di quello sconto, quindi 95% contro 81% si accumula nel corso di una sessione lunga in un modo che il prezzo di listino non fa. Con un mix 7:2:1 di cache-hit / input / output, la tariffa combinata di Step 5 Preview si attesta intorno a $0,51 per milione di token, contro la tariffa combinata sensibilmente più alta di GLM-5.3 — e il divario si allarga quanto più a lungo dura il ciclo.

Ciò che non è ancora verificabile è se quell'efficienza regga su larga scala. L'API di Step 5 Preview è stata aperta il giorno del lancio, su un singolo endpoint. GLM-5.3 gestisce traffico di produzione da metà agosto, da parte di molti chiamanti indipendenti, e un modello con cinque settimane di carico reale alle spalle ha modalità di guasto note a una popolazione abbastanza ampia da emergere pubblicamente. Un endpoint di pochi giorni non ha nulla di tutto ciò. I numeri sull'efficienza sono la lettura più favorevole; lo storico operativo è quella più utile.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator and a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second, cost per Intelligence Index task $0.71, verbosity 160M output tokens, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning, text and image input, and a 1M-token context window.

Su cosa puoi contare da ciascuna parte oggi

Questa è l'unica parte del confronto in cui i due non sono simmetrici, e vale la pena essere precisi al riguardo invece di approssimare a "entrambi sono disponibili".

GLM-5.3 è ora disponibile su OrcaRouter sotto la voce z-ai/glm-5.3 nella pagina del modello a $1.26 in input e $3.96 in output, contro i listini Z.ai di $1.40 e $4.40 sulla pagina del modello stessa — trasferiti senza alcun markup, quindi il numero che vedi è la tariffa attuale del provider, non una che abbiamo scelto noi. I pesi aperti sono su Hugging Face, quindi lo stesso modello è raggiungibile in tre modi: il nostro endpoint, l'API di Z.ai o il tuo hardware.

Step 5 Preview non è nel nostro catalogo, e non lo instradiamo. Viene eseguito sull'API e sullo Studio di StepFun, e questo è l'unico posto in cui viene eseguito finché i pesi non arrivano. Ciò che gli sta accanto dalla nostra parte è l'insieme di modelli con cui viene confrontato, dietro un'unica chiave per più di 200 modelli: GLM-5.3 alla tariffa scontata di cui sopra, DeepSeek V4 Pro a $0.66 e $1.98, e Claude Opus 5 a $5.00 e $25.00. Questo è ciò che rende le prossime quattro settimane gestibili invece che bloccate — puoi confrontare l'anteprima con un modello di produzione sulla stessa chiave, con failover automatico tra provider che mantiene il percorso di produzione mentre la curva di capacità dell'anteprima è ancora sconosciuta, e il DSL di routing che compone il ramo di produzione in una singola chiamata invece di una seconda integrazione.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.3 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and weights due October 15. The right column gives GLM-5.3 the rows AA Index 45, parameters 753B total / 40B active, price $1.40 / $4.40 list, $1.26 / $3.96 on OrcaRouter, cache discount 81%, cost per index task $2.01, and weights published under a custom licence. A footer reads 'Both per Artificial Analysis Intelligence Index v4.3.2; GLM-5.3 is scored as GLM-5.3 (max).'

Scegliere tra un potenziale cliente e un'esperienza comprovata

Se stai facendo fine-tuning, self-hosting o costruendo un prodotto derivato, GLM-5.3 è la risposta e non c'è partita — non perché totalizzi un punto in più, ma perché è l'unico dei due con una licenza da leggere e un checkpoint da scaricare. Metti in budget la revisione legale, perché i termini personalizzati non sono MIT e la differenza è di quel tipo che salta fuori in un audit di procurement piuttosto che in un benchmark.

Se chiami un modello tramite API e il tuo carico di lavoro è testo agentico ad alto volume, Step 5 Preview è in vantaggio su tutto ciò che sta a cuore alla fattura e all'orologio: costa meno per token, costa meno per attività, è più veloce da generare e offre uno sconto cache più profondo per il pattern di prefisso ripetuto che riempie un ciclo di agente. Rispetto a un endpoint a fonte singola vecchio di pochi giorni, senza un tetto di output pubblicato e senza licenza, l'argomento a favore del renderlo la tua scelta predefinita riguarda un benchmark, non un contratto.

Ciò che cambierebbe la risposta è il checkpoint del 15 ottobre. Una licenza permissiva renderebbe il vantaggio in efficienza qualcosa che puoi possedere anziché affittare, e a quel punto il deficit di un punto smette di contare — un modello che è 2,8 volte più economico per attività di indicizzazione e il 38% più veloce nella generazione non ha bisogno di vincere l'aggregato. Una licenza restrittiva lascia GLM-5.3 come l'unico della coppia su cui puoi costruire un prodotto, e il divario di un punto diventa un dettaglio insignificante su due modelli che useresti comunque in modo diverso.

L'unica specifica che vale la pena tenere d'occhio è il tetto di output. Entrambi i fornitori pubblicizzano un contesto di 1M token. Il nostro catalogo elenca GLM-5.3 con un output massimo di 131,1K; l'annuncio di StepFun indica un contesto di 1M e nessun limite di output, e una configurazione separata di terze parti, circolata durante il leak, elencava un contesto di 350.000 con un output massimo di 64.000. Per una coppia di modelli venduti per il lavoro agentico a lungo orizzonte, quel numero decide ciò che puoi effettivamente costruire, e al momento solo una delle due parti ha risposto.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a cache read rate of $0.25 per million tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno