Card del titolo principale per l'explainer di Grok 4.5: il titolo 'Cos'è Grok 4.5?' sopra il sottotitolo 'Il flagship V9 che ha puntato sull'economia dei token, non sui punteggi più alti', poi tre card che riportano 'Contesto - 500K token', 'Prezzo di listino per 1M - $2.00 / $6.00' e 'AA Intelligence - 39', con una riga a piè di pagina 'Grok 4.5 rilasciato l'8 luglio 2026. Prezzo secondo i documenti xAI; dato AA secondo Artificial Analysis Intelligence Index v4.3.2.' e il logo OrcaRouter nell'angolo in basso a destra.
Guides & Insights

Che cos'è Grok 4.5? Il flagship V9 che ha venduto l'economia dei token invece dei punteggi più alti

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Grok 4.5 è un modello di ragionamento mixture-of-experts da 1.500 miliardi di parametri del fornitore — l'azienda che ora distribuisce e commercializza sotto il marchio SpaceXAI — rilasciato l'8 luglio 2026. Accetta testo e immagini in input, restituisce testo, ha una finestra di contesto di 500.000 token e ha un prezzo di listino di 2,00 $ per milione di token di input e 6,00 $ per milione di token di output. È stato il modello che ha messo i "token per attività completata" sulla copertina di una slide di lancio, ed è il modello su cui il laboratorio ha da allora costruito due nuovi modelli di punta.

Quell'ultima clausola è l'intera ragione per cui questa pagina deve essere scritta. Cerca "Grok 4.5" e ottieni la copertura del lancio di luglio: la partnership con Cursor, la citazione "classe Opus", l'affermazione degli 80 token al secondo. Quello che non ottieni è una risposta diretta alla domanda che uno sviluppatore si pone davvero a fine settembre, vale a dire se Grok 4.5 valga ancora la pena di essere integrato in qualcosa, quando Grok 4.6 e Grok 4.7 esistono allo stesso prezzo di listino. Quindi questa pagina è una voce di riferimento, non un pezzo di cronaca: cos'è il modello, dove si colloca, cosa fa bene in modo misurabile, cosa fa male in modo misurabile e chi dovrebbe scegliere qualcos'altro. Qui nulla è presentato come un lancio, perché non lo è.

Sulle fonti, dato che contano più del solito in una pagina come questa: ogni dato qui sotto è etichettato in base alla sua provenienza. I numeri che xAI ha pubblicato sul proprio modello sono contrassegnati come riportati dal fornitore. I numeri di Artificial Analysis sono misurazioni indipendenti, lette direttamente dalla pagina del modello il 23 settembre 2026. Laddove un numero non ha potuto essere confermato su una fonte primaria, la pagina lo dice invece di fare una stima.

Dove si colloca Grok 4.5 nella sua stessa famiglia — e non è al vertice

L'errore più comune in assoluto quando si parla di Grok 4.5 è considerarlo il modello di punta. Lo è stato, per circa cinque settimane. Da allora xAI ha rilasciato Grok 4.6 il 12 agosto 2026 e Grok 4.7 all'inizio di settembre, entrambi ancora al prezzo di $2,00 e $6,00 per milione di token. Grok 4.5 ora è nel mezzo della gamma: più capace della fascia economica, due generazioni indietro rispetto alla vetta e — questa è la parte che conta — l'unico modello dell'attuale linea Grok la cui tariffa per l'input in cache è più economica di quella dei suoi successori. Grok 4.5 ha un prezzo per l'input in cache di $0,30 per milione di token; Grok 4.6 e Grok 4.7 hanno entrambi un prezzo per l'input in cache di $0,50, secondo la tabella prezzi di xAI stessa.

Ecco la gamma così come la documentazione dei prezzi del fornitore la elenca attualmente, tutte le cifre per milione di token e tutte pubblicate dal fornitore:

• Grok 4.20 (tre varianti: multi-agente, ragionamento, non ragionamento) — contesto da 1M, $1,25 input / $2,50 output, $0,20 in cache, rilasciato il 31 marzo 2026

• Grok 4.3 — contesto da 1M, $1,25 input / $2,50 output, $0,20 in cache, più uno sconto batch; il modo più economico per ottenere un milione di token di contesto Grok

• Grok 4.5 — contesto da 500K, 2,00 $ input / 6,00 $ output, 0,30 $ in cache, rilasciato l'8 luglio 2026

• Grok 4.6 — contesto 500K, $2,00 input / $6,00 output, $0,50 in cache, rilasciato il 12 agosto 2026

• Grok 4.7 — contesto 500K, $2,00 input / $6,00 output, $0,50 in cache, rilasciato all'inizio di settembre 2026

• Grok Build 0.1 — contesto 256K, $1,00 input / $2,00 output, uno specialista della programmazione anziché un modello generalista

Da quell'elenco emergono due cose. Primo, Grok 4.5 non ha ricevuto un taglio di prezzo quando ha smesso di essere il modello di punta — ha mantenuto il prezzo da flagship, il che significa che ora Grok 4.6 offre un valore strettamente migliore a parità di spesa, a meno che tu non voglia specificamente la tariffa di cache più economica o non sia vincolato allo snapshot 4.5. Secondo, Grok 4.5 ha metà del contesto di Grok 4.3 e della famiglia 4.20, al doppio del prezzo di input. La base V9 è il motivo: 1,5 trilioni di parametri, circa tre volte la dimensione di Grok 4.3, ed è un modello di base più grande ad aver garantito quella capacità al costo della finestra.

Se ciò di cui hai davvero bisogno è un contesto lungo contenendo i costi, Grok 4.3 è la risposta onesta all'interno di questa famiglia, e Grok 4.5 no. Quel compromesso — capacità contro finestra — è la decisione decisiva nella linea Grok, e vale la pena dirlo chiaramente invece di fingere che il numero più recente sia migliore in tutto.

La scheda tecnica

Screenshot of the xAI developer documentation model page for grok-4.5, showing the model identifier and aliases grok-4.5-latest and grok-build-latest, the description 'intelligent coding model for agentic software, engineering, and workflow tasks', an At a glance block giving modalities 'Text, Image to Text' and a 500,000-token context window, capability rows for function calling, structured outputs and reasoning, and the pricing rows $2.00 input, $0.30 cached input and $6.00 output per million tokens, above a collapsed 'Higher context pricing' note about requests exceeding the 200K context window.

Queste sono le specifiche che xAI pubblica sulla propria pagina del modello, non stime di terze parti:

• Identificatore del modello — grok-4.5, con gli alias grok-4.5-latest e grok-build-latest

• Modalità — testo e immagini in input, testo in output. Le immagini sono accettate come input; il modello non le genera

• Finestra di contesto — 500.000 token condivisi tra prompt e risposta invece di 500K in input più una quota separata per l'output

• Licenza — proprietaria. Non ci sono pesi aperti né checkpoint scaricabili; si accede a Grok 4.5 tramite un'API o tramite i prodotti dello stesso fornitore.

• Prezzo di listino — $2,00 per milione di token di input, $6,00 per milione di output, $0,30 di input in cache

• Prezzi per contesto lungo — a partire da 200.000 token di prompt, la tariffa passa a 4,00 $ input / 12,00 $ output / 0,60 $ in cache, e la tariffa più alta si applica a ogni token nella richiesta, non solo ai token oltre la soglia. Questo è il singolo dettaglio più costoso da lasciarsi sfuggire in questa pagina

• Controllo del ragionamento — quattro livelli, basso, medio, alto e xhigh, predefinito su alto. Il ragionamento non può essere disattivato completamente, e i token di ragionamento vengono fatturati come token di output

• Supporto di strumenti e formati — la chiamata di funzioni e gli output strutturati sono supportati nativamente. Gli strumenti di ricerca lato server vengono fatturati in aggiunta all'utilizzo dei token; non abbiamo potuto confermare le attuali tariffe per chiamata nella pagina del modello del fornitore, solo che esistono

• Limiti di frequenza — 150 richieste al secondo e 50 milioni di token al minuto

• Batch API — non supportata su Grok 4.5, a differenza di Grok 4.3

• Regioni di servizio — us-east-1 e us-west-2 al lancio. La disponibilità europea non era esplicitamente disponibile fin dal primo giorno ed è stata descritta dal fornitore come prevista per metà luglio 2026; non abbiamo trovato una dichiarazione successiva di fonte primaria che confermasse la data esatta di apertura, quindi qui la tempistica UE va considerata non confermata

Una discrepanza che vale la pena registrare anziché attenuare: la voce di catalogo di OrcaRouter stessa per grok/grok-4.5 mostra una tariffa di lettura della cache di $0,50 per milione, che corrisponde a quanto xAI addebita per Grok 4.6 e Grok 4.7, anziché ai $0,30 indicati nella tabella prezzi del fornitore per Grok 4.5. La documentazione del fornitore è la fonte autorevole sul prezzo; la nostra pagina sembra riportare la tariffa cache del successore, ed è stata segnalata anziché ripetuta qui in sordina.

In cosa Grok 4.5 è misurabilmente bravo

L'affermazione principale al momento del lancio era l'economia dei token, ed è l'unica affermazione nella pagina di lancio ad avere un meccanismo dietro di sé anziché soltanto un punteggio. Su SWE-bench Pro, xAI riferisce che Grok 4.5 consuma in media 15.954 token di output per attività risolta, contro 67.020 per Claude Opus 4.8 eseguito al massimo sforzo — circa 4,2 volte meno token per completare lo stesso lavoro. Meno token di output per attività risolta è la differenza tra un modello che è più economico e un modello che è più economico e più veloce in termini di tempo effettivo, perché i token di output sono ciò che si attende. Riportato dal fornitore, sull'harness dello stesso fornitore, e non riprodotto da nessuno in modo indipendente — ma è un'affermazione strutturale, non una percentuale scelta ad arte.

La tabella di benchmark del fornitore, pubblicata insieme al modello e quindi basata interamente su dati dichiarati dal fornitore, si presenta così rispetto agli stessi modelli:

• DeepSWE 1.0 — Grok 4.5 62,0%, dietro Claude Fable 5 al 66,1% e GPT-5.5 al 64,31%, davanti a Claude Opus 4.8 al 55,75%

• SWE Marathon, tasso di risoluzione — Grok 4.5 29,0%, davanti a Claude Opus 4.8 al 26,0% e a Claude Fable 5 al 24,0%. Questo è l'unico benchmark di coding in cui Grok 4.5 ha dominato il campo

• Terminal-Bench 2.1 — Grok 4.5 83,3%, praticamente allo stesso livello di Claude Fable 5 all'84,3% e GPT-5.5 all'83,4%, davanti a Claude Opus 4.8 al 78,9%

• DeepSWE 1.1 — Grok 4.5 53%, dietro Claude Fable 5 al 70% e GPT-5.5 al 67%

• SWE-bench Pro — Grok 4.5 64,7%, dietro Claude Fable 5 all'80,4% e Claude Opus 4.8 al 69,2%

La lettura onesta è che Grok 4.5 vince sulla risoluzione di compiti a lungo orizzonte e sull'economicità del portare a termine un compito, e perde sui benchmark di codifica one-shot più difficili. È un buon modello per i cicli di agenti e uno mediocre per problemi difficili one-shot — e questa distinzione è esattamente ciò che il numero di efficienza in token predice che dovrebbe essere.

A single-column scoreboard card for Grok 4.5 titled 'Grok 4.5 - the scoreboard' with six rows reading: AA Intelligence Index 39 (#52 of 212); Output speed 55.1 tok/s (#126 of 212); Time to first token 10.94 s; Context window 500K tokens; Price per 1M $2.00 / $6.00, $0.30 cached; SWE-bench Pro 64.7% (vendor). Footer: 'Price and spec rows per xAI docs; AA Index and speed per Artificial Analysis Intelligence Index v4.3.2; SWE-bench Pro vendor-reported.'

Il quadro indipendente è più scarno, ed è qui che questa pagina deve prestare attenzione. Artificial Analysis attualmente colloca Grok 4.5 (high) a un punteggio di Intelligence Index di 39, classificato #52 su 212 modelli, sulla versione dell'indice v4.3.2 — sopra la mediana di 25 per modelli comparabili, ma non vicino alla vetta. Se hai visto un punteggio di 54 o 56 citato per questo modello nella copertura di luglio, non confrontarlo con 39: Artificial Analysis ha rivisto l'indice dal lancio e i due numeri provengono da revisioni diverse. È esattamente il tipo di confronto con cifre obsolete che rende inaffidabili le tabelle di benchmark, ed è per questo che questa pagina cita la versione dell'indice accanto al punteggio.

In cosa Grok 4.5 è misurabilmente scarso

Artificial Analysis riporta una velocità di output di 55,1 token al secondo, con il posizionamento n. 126 su 212 modelli e al di sotto della mediana di 74 — molto lontano dagli 80 token al secondo dichiarati da xAI al lancio e ancora di più dai ~340 token al secondo che raggiungono i modelli più veloci attuali. Riporta inoltre un tempo al primo token di 10,94 secondi contro una mediana di 3,86 secondi. Questi due numeri, insieme, descrivono il vero costo di un modello di ragionamento che per impostazione predefinita usa alto e non può essere disattivato: aspetti, e poi parla lentamente. Lascia il livello di ragionamento predefinito e Grok 4.5 ti sembrerà il modello più lento che hai sulla chiave.

Altri tre aspetti negativi misurati, in ordine di quanto dovrebbero incidere su una decisione:

• Artificial Analysis ha segnalato Grok 4.5 come deprecato e afferma di continuare a testarlo solo con il carico di lavoro predefinito da 10.000 token di input. Si tratta di una terza parte che ti dice che ha smesso di misurare appieno il modello che stai considerando, e consiglia invece Grok 4.6. Deprecato su una classifica non significa non disponibile su un'API — significa che la base di evidenze indipendenti è congelata

• Perde i due benchmark che più assomigliano a coding difficile in un unico tentativo: DeepSWE 1.1 e SWE-bench Pro, entrambi contro Claude Fable 5 e contro GPT-5.5, secondo la tabella di xAI stessa

• Ha metà del contesto di Grok 4.3 al doppio del prezzo di input, e nessuna API batch. Se il tuo carico di lavoro è l'elaborazione di documenti lunghi o l'inferenza batch offline, Grok 4.5 è il modello sbagliato nella sua stessa famiglia

Per quanto riguarda allucinazione e calibrazione, questa pagina non ha potuto confermare un dato indipendente attuale. La copertura di luglio ha fatto circolare un tasso di allucinazione intorno al 54%, ma non abbiamo potuto verificare quel numero sulla pagina del modello di Artificial Analysis che abbiamo letto, e non compare nemmeno sulla pagina del fornitore. Invece di ripetere un dato che non possiamo documentare, lo registriamo come non misurato qui.

Chi dovrebbe scegliere Grok 4.5, e chi dovrebbe scegliere qualcos'altro?

Scegli Grok 4.5 se esegui loop agentici in cui il costo per attività completata conta più del costo per token, e hai già misurato che il comportamento di economia dei token di V9 regge sul tuo carico di lavoro. È anche la scelta giusta se ti serve uno snapshot della famiglia Grok con una tariffa per input in cache di $0,30 su un prefisso ampio, stabile e colpito ripetutamente — quella tariffa di cache è davvero più economica di quanto facciano pagare Grok 4.6 e Grok 4.7, e su un carico di lavoro con forte uso della cache questa differenza può valere più di due generazioni di capacità.

Scegli invece Grok 4.6 o Grok 4.7 per quasi tutto il resto. Stesso prezzo di listino, stessa finestra da 500K, addestramento più recente, punteggi indipendenti migliori e la raccomandazione di Artificial Analysis stessa. Non esiste una versione di "Voglio il miglior Grok" in cui la risposta oggi sia 4.5.

Scegli Grok 4.3 se il contesto è il vincolo: 1M token a 1,25 $ e 2,50 $, con uno sconto batch che Grok 4.5 non offre. Il RAG su documenti lunghi e l'analisi dell'intero repository restano il suo territorio.

Scegli qualcosa al di fuori della famiglia se stai ottimizzando per il punteggio di picco anziché per il prezzo per attività — Claude Fable 5 guida ogni benchmark di programmazione nella tabella comparativa di xAI stessa, e GPT-5.5 si colloca davanti a Grok 4.5 su DeepSWE 1.0 e 1.1. Se vuoi pesi aperti e puoi accettare un modello più piccolo, quello è un acquisto del tutto diverso e nessun modello Grok è in competizione per esso.

Chiamare Grok 4.5 senza un secondo contratto

Grok 4.5 è attivo su OrcaRouter al prezzo di listino di xAI, con la tariffa del fornitore trasferita senza alcun ricarico — quindi i 2,00 $ e i 6,00 $ qui sopra sono esattamente ciò che paghi, e una variazione di prezzo del fornitore arriva dalla nostra parte lo stesso giorno in cui arriva dalla loro. Per questo modello in particolare la cosa conta più del solito, perché la decisione davanti alla maggior parte dei lettori non è «Grok 4.5 o niente» ma «Grok 4.5 o Grok 4.6 o Grok 4.3», e confrontare tre modelli di una stessa famiglia è proprio ciò che un unico endpoint su oltre 200 modelli rende economico. Una sola chiave, nessun secondo contratto e un test A/B che è un cambio di stringa anziché un'integrazione.

L'argomento del failover è insolitamente concreto in questo caso. Grok 4.5 è ancora instradabile ma non più completamente sottoposto a benchmark dai tracker indipendenti e non è più il modello di punta del fornitore — un modello che potresti voler inserire in una catena di fallback piuttosto che come unico percorso. Il failover automatico tra provider è il meccanismo che ti consente di mantenerlo per ciò in cui è valido senza scommettere una rotta di produzione su uno snapshot che l'ecosistema ha iniziato a superare.

Quello che questa pagina non farà è fingere che la scelta sia ovvia. Grok 4.5 è un buon modello con un punto di forza specifico, inserito in una famiglia in cui la stessa cifra ora ne compra uno più recente. Se stai partendo da zero oggi, la raccomandazione onesta è Grok 4.6. Se stai già usando Grok 4.5 in un loop di agenti e sta completando le attività con i conteggi di token che avevi preventivato, la raccomandazione onesta è non cambiare nulla e rimisurare tra un trimestre.

Screenshot of the OrcaRouter model page for Grok 4.5 (grok/grok-4.5), showing the SpaceXAI provider label, the Featured badge, capability tags for Vision, Tools, JSON and Reasoning, the 500K-token context window, the $2.00 per million input and $6.00 per million output pricing rows, and the benchmark table sourced from Artificial Analysis.

Grok 4.5 è instradabile su OrcaRouter oggi, e lo sono anche Grok 4.6, Grok 4.7 e Grok 4.3. OrcaRouter passa il prezzo di listino del fornitore senza ricarico, quindi una variazione di prezzo del fornitore si ripercuote su di noi lo stesso giorno in cui si ripercuote su di loro, e spostare un carico di lavoro tra due modelli Grok è una modifica di stringa anziché un secondo contratto.

Confrontati in questo articolo4

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno