Card hero generata intitolata Claude Sonnet 5.5 vs GLM-5.5, con sottotitolo: non c'è un GLM-5.5 con cui confrontarlo, che mostra due model card affiancate. Card a sinistra, Claude Sonnet 5.5: Model card sì, ID API claude-sonnet-5-5, Riga prezzo $2 / $10 per 1M, Rilasciato 2026-09-28. Card a destra, GLM-5.5: Model card nessuna, ID API nessuno, Riga prezzo nessuna, Rilasciato mai. Un footer recita 'Verificato rispetto all'organizzazione Z.ai Hugging Face e Artificial Analysis il 29 settembre 2026.'
Guides & Insights

Claude Sonnet 5.5 vs GLM-5.5: Non c'è alcun GLM-5.5 da confrontare

Autore

Magnus Corvin

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Cerca questo confronto e troverai pagine che mettono a confronto due modelli. Uno dei due è reale. Claude Sonnet 5.5ha una model card, un identificatore API, una riga di prezzo, una soglia di dismissione pubblicata e una voce nelle classifiche indipendenti; è stato rilasciato il 28 settembre 2026 ed è il secondo modello della generazione 5.5 del fornitore. GLM-5.5non ha nulla di tutto ciò. Al 29 settembre 2026 non esiste alcun GLM-5.5checkpoint nell'organizzazione Hugging Face di Z.ai, nessuna pagina ad esso dedicata nell'elenco dei modelli di Z.ai, nessuna riga nella documentazione del fornitore, nessun prezzo e nessuna voce su Artificial Analysis. Il nome è una previsione che si è consolidata in un sostantivo.

Ciò rende la versione onesta di questo articolo più breve di quanto prometta il titolo e più utile di quanto sarebbe una scheda tecnica: a cosa si riferisce il nome, qual è il modello reale più vicino, quanto ottengono effettivamente i due presunti avversari, e le prove specifiche che dovrebbero emergere prima che "GLM-5.5" diventi qualcosa che si può chiamare. Il confronto in sé non è indisponibile — semplicemente non è quello che la casella di ricerca ha chiesto.

Che cosa c'è realmente, controllato oggi

Cinque luoghi avrebbero in assortimento un flagship Z.ai rilasciato, e tutti e cinque sono stati controllati il 29 settembre 2026:

• La lista di modelli di Z.ai contiene esattamente tre schede: GLM-5.3, etichettato come l'ultimo flagship dell'azienda; GLM-5.3-FlashX, etichettato come nuovo; e GLM-5.2. Nessun 5.4, nessun 5.5

• L'elenco dei modelli consigliati nella documentazione del fornitore inizia con GLM-5.3, poi GLM-5.3-Flash, GLM-5.3-FlashX e GLM-5.2. Non esiste alcuna pagina GLM-5.5 in nessun percorso della documentazione

• L'organizzazione Z.ai su Hugging Face elenca i suoi repository più recenti come la serie GLM-5.3, creata il 25 agosto 2026. Una ricerca nei repository dell'organizzazione non restituisce alcun GLM-5.5 di qualsiasi dimensione, quantizzazione o variante

• Artificial Analysis non ha una pagina del modello GLM-5.5 da aprire. La sua copertura di GLM si ferma alla generazione 5.3

• Il catalogo di OrcaRouter non contiene alcuna voce GLM-5.5 di alcun tipo, quindi non c'è nulla da instradare o da citare

Ciò che esiste è GLM-5.3: annunciato il 14 agosto 2026, disponibile sul mercato tramite API intorno al 18 agosto, con i pesi pubblicati il 25 agosto. Accetta testo in input e restituisce testo in output, gestisce una finestra di contesto di 1.000.000 di token con un tetto di output di 128.000 token, conta 753 miliardi di parametri totali con circa 40 miliardi attivi, e costa 1,40 $ per milione di token di input e 4,40 $ per milione di token di output nel listino di Z.ai. Il suo thinking è sempre attivo — disattivarlo non è più consentito — e la profondità è controllata tramite reasoning_effort, impostabile su low, high o max, con valore predefinito max.

Da dove viene sempre il nome

Artificial Analysis model page for GLM-5.3 at max effort, released August 2026, showing an Intelligence Index of 45, an output speed of 86.8 tokens per second, a price of $1.40 per million input tokens and $4.40 per million output tokens, $2.01 per Intelligence Index task, 210M output tokens generated during the Index evaluation, a 1M-token context window, and 753 billion total parameters with 40 billion active.

Il nome è entrato in circolazione legato a una finestra di rilascio anziché a un prodotto. Una previsione di un analista rilanciata a fine giugno collocava il prossimo modello di punta di Z.ai entro agosto 2026, e da lì si è ipotizzato che la numerazione proseguisse verso l'alto. Agosto si è invece concluso con il rilascio di GLM-5.3, e da allora due cose hanno reso "GLM-5.5" meno probabile anziché più.

Il primo è l'inquadramento dello stesso fornitore. Nella conference call sui risultati del 31 agosto di Z.ai, il modello base di nuova generazione è stato indicato come GLM-6.0 — una nuova generazione, non un rilascio puntuale, e un numero che salta completamente 5.4 e 5.5. Il secondo è la cadenza. Gli analisti che interpretano il ritmo di rilascio di Z.ai, all'incirca un flagship ogni 54-70 giorni, ora collocano il prossimo in una finestra che va dall'8 ottobre al 9 novembre 2026, e la maggior parte di loro si aspetta che sia numerato GLM-5.4.

Nell'ultima settimana c'è stato un solo segnale davvero nuovo, e vale la pena descriverlo proprio perché è il tipo di cosa che diventa una falsa notizia di rilascio. Il 25 settembre 2026, sulla pagina pubblica dei dati di uno strumento di coding di terze parti sono state avvistate delle stringhe di pre-registrazione che recitavano «GLM 5.5 Flash» e «GLM-5.4» — stringhe senza utenti alle spalle, senza conferma del fornitore e senza alcun modello collegato. Ricontrollate il 29 settembre, nessuna delle due stringhe compare su quella pagina. Si tratta di un avvistamento di nomenclatura all'interno del prodotto di qualcun altro, non di un rilascio, e costituisce l'intera prova recente a disposizione.

Il confronto che puoi davvero eseguire

Se invece metti Claude Sonnet 5.5 contro GLM-5.3, il confronto è reale, attuale e insolitamente interessante — ma è un articolo diverso da quello che lascia intendere il titolo di questa pagina, quindi ecco la versione breve anziché una riproposizione di un confronto che abbiamo già pubblicato.

• Prezzo — Claude Sonnet 5.5 $2,00 / $10,00 per 1 milione contro GLM-5.3 $1,40 / $4,40 di listino, che il nostro catalogo attualmente riporta a $1,26 / $3,96

• Intelligence Index, v4.3.2 — Claude Sonnet 5.5 56 vs GLM-5.3 45, entrambi alle loro impostazioni di massimo sforzo

• Costo per attività Index — Claude Sonnet 5.5 $7,60 vs GLM-5.3 $2,01, un divario di 3,8× a fronte di un divario tariffario di 2,1×

• Velocità di output — Claude Sonnet 5.5 142 token/sec vs GLM-5.3 86.8 token/sec

• Verbosità sull'indice — Claude Sonnet 5.5 410M token di output vs GLM-5.3 210M

• Modalità — Claude Sonnet 5.5 accetta testo, immagini e file; GLM-5.3 è testo in entrata, testo in uscita

• Pesi — GLM-5.3 è scaricabile dall'organizzazione Hugging Face di Z.ai secondo la licenza del fornitore stesso; Claude Sonnet 5.5 non ne ha

La forma di tutto ciò è familiare e il meccanismo è lo stesso che attraversa ogni confronto con Sonnet 5.5: il divario di tariffa e il divario di attività differiscono perché i conteggi dei token sono diversi. Un modello che emette 410 milioni di token dove il suo rivale ne emette 210 milioni trasforma una differenza di prezzo di 2,1× in una fattura di 3,8×. Anche la posizione di GLM-5.3 sulla revisione attuale merita di essere dichiarata senza giri di parole, perché alcune coperture più vecchie lo citano ancora a 60 su una revisione dell'Index ormai superata: sulla v4.3.2 ottiene 45, il che lo colloca al secondo posto tra i modelli open-weights, dietro MiMo-V2.6-Pro a 46 e appena davanti a Kimi K3 a 44. Se avete visto 60 associato a questo modello, quella era una classifica diversa.

Entrambi i lati di una coppia reale su una sola chiave

Il motivo per cui tenere contemporaneamente un modello Anthropic e un modello Z.ai è che falliscono in modi diversi, e gestirli entrambi richiede normalmente due contratti. GLM-5.3 è nel catalogo di OrcaRouter come z-ai/glm-5.3 alla tariffa del provider senza alcun ricarico aggiunto — uno dei oltre 200 modelli dietro un unico endpoint compatibile con OpenAI, con failover automatico tra provider e un DSL di routing per comporre le chiamate. Poiché il catalogo applica il prezzo di listino del provider senza variazioni, una modifica delle tariffe di Z.ai arriva dalla nostra parte lo stesso giorno in cui arriva dalla loro. Claude Sonnet 5 è instradabile qui dal 30 giugno ai prezzi Anthropic di 2 e 10 dollari, e resta il modello su cui passa la maggior parte del traffico dell'API Claude.

Claude Sonnet 5.5 non è ancora nel nostro catalogo, quindi oggi l'unica via per raggiungerlo è l'API di Anthropic — e questo è anche il limite onesto del consiglio di routing che diamo qui: il trucco del failover è utile solo quando entrambi i modelli si trovano in un posto da cui puoi raggiungerli da un unico punto.

Cosa dovrebbe apparire

Trasformare "GLM-5.5" da un nome in un modello richiede circa un giorno di lavoro da parte del fornitore, e le prove sono facili da riconoscere quando arrivano. Una model card con un numero di parametri e una finestra di contesto. Un identificatore API nella lista di modelli di Z.ai stessa. Una riga di prezzo. Un repository Hugging Face sotto l'organizzazione Z.ai, con un file di licenza, se i pesi sono aperti. E una pagina su Artificial Analysis, perché un modello che nessuno ha misurato non è un modello che si può confrontare. Finché non esiste la maggioranza di quei cinque elementi, qualsiasi articolo che pubblichi una scheda tecnica di GLM-5.5 sta pubblicando la proiezione di qualcuno.

Il prossimo checkpoint è la finestra dall'8 ottobre al 9 novembre, e il numero da tenere d'occhio è 5.4 anziché 5.5. Se Z.ai segue la propria call sui risultati, la domanda più interessante è se la prossima release sia davvero un aggiornamento di punto o la generazione GLM-6.0 che l'azienda ha indicato. In ogni caso, il confronto in questa pagina sarà rieseguito la settimana in cui avverrà — e sarà un confronto tra due modelli con model card.

OrcaRouter model page for z-ai/glm-5.3, dated 2026-08-18, showing the Tools, JSON and Reasoning badges, a 1M-token context window, 128K max output, text-only input, an input price of $1.26 and output price of $3.96 per million tokens, a p50 time to first token of 3.88 seconds, and 1.81 billion tokens of recent traffic.

Confrontati in questo articolo3

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno