
Claude Sonnet 5.5 vs Grok 4.5: due tariffe di input da $2 e un'attesa di sei minuti
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 931 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 192 tok/s
- OrcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- xAISpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
Claude Sonnet 5.5 e Grok 4.5 applicano lo stesso prezzo per l'input: 2,00 $ per milione di token. Qui finisce l'accordo, e un solo numero rende l'idea meglio di qualsiasi tabella di specifiche. Sulla revisione v4.3.2 dell'Intelligence Index di Artificial Analysis, il tempo mediano al primo token di risposta per Claude Sonnet 5.5 con l'impostazione Max Effort è di 370,8 secondi. Per Grok 4.5 è di 6,9 secondi. Stessa tariffa di input. Cinquantatré volte l'attesa prima che torni indietro qualcosa. Claude Sonnet 5.5, rilasciato il 28 settembre 2026, e Grok 4.5, rilasciato l'8 luglio 2026 e da allora superato due volte all'interno della propria famiglia, sono i due modi più economici per entrare nella metà anteriore della frontiera sulla carta — e la carta nasconde la decisione che conta davvero, cioè cosa stai comprando con l'attesa.
Quel dato richiede subito una precisazione, perché un numero di latenza senza una configurazione è privo di significato: 370,8 secondi è la modalità di ragionamento predefinita di Anthropic al massimo sforzo, che spende un budget di pensiero molto ampio prima di emettere un token di risposta. Un chiamante che vuole un primo token veloce configura qualcos'altro. Ma la direzione è reale e non è un artefatto: Artificial Analysis misura la velocità di output di Claude Sonnet 5.5 a 138,7 token al secondo, seconda solo a una manciata di modelli, e quella di Grok 4.5 a 59,2. Il modello che attende più a lungo è anche quello che scrive più velocemente. La scelta è tra una lunga deliberazione seguita da una risposta veloce, e una breve seguita da una più lenta.
Cosa è cambiato il 28 settembre
Claude Sonnet 5.5 ha un giorno di vita. Anthropic lo ha rilasciato il 28 settembre 2026 con l'identificatore API claude-sonnet-5-5, insieme a Bedrock, Google Cloud e Microsoft Foundry, e lo descrive come il 30% più veloce di Claude Sonnet 5 e fino al 30% meno costoso per attività sulla maggior parte dei carichi di lavoro. Si tratta di dati forniti dal produttore e non riprodotti in modo indipendente; il prezzo su cui si basa il confronto è però reale, perché il listino è rimasto invariato a 2,00 $ per milione di token di input, 10,00 $ per milione di output, 0,20 $ per le letture dalla cache e 2,50 $ per le scritture in cache. La finestra è di 1.000.000 di token con un limite di output sincrono di 128.000 token, e 300.000 token sull'API Message Batches dietro l'header output-300k-2026-03-24. Il knowledge cutoff è giugno 2026. La zero data retention è disponibile fin dal lancio e Anthropic non ritirerà il modello prima del 28 settembre 2027.

Anche la pagina della documentazione di Anthropic è insolitamente esplicita riguardo al costo dell'aggiornamento: cinque modifiche incompatibili separano Claude Sonnet 5.5 dal modello su cui attualmente gira la maggior parte del traffico di Claude, e sono trattate più avanti.
Grok 4.5 è la proposta più datata e anche la più complicata. SpaceXAI — la società che pubblica ancora con il marchio xAI sulle schede dei suoi modelli — lo ha rilasciato l'8 luglio 2026 come mixture of experts da 1,5 trilioni di parametri, addestrato insieme all'editor di codice Cursor, con una finestra da 500.000 token, input di testo, immagini e file, e un pitch di lancio basato quasi interamente sull'economia dei token anziché sui punteggi più alti. Non è più il flagship. Grok 4.6 e Grok 4.7 esistono entrambi, hanno lo stesso prezzo di listino di 2,00 $ / 6,00 $, e il nostro catalogo li elenca tutti e tre. La domanda interessante a settembre 2026 non è quindi se Grok 4.5 sia buono; è se ci sia ancora qualcosa che giustifichi ricorrere al più vecchio dei tre.
Il conto non è il listino prezzi.
Metti i due fianco a fianco sul tabellone indipendente e la forma dell'operazione emerge.
• Indice di Intelligenza, revisione v4.3.2 — Claude Sonnet 5.5 56 a Sforzo Massimo vs Grok 4.5 39
• Costo per attività Index — Claude Sonnet 5.5 $7.60 vs Grok 4.5 $1.04, entrambi misurati, non stimati
• Tariffa di output — Claude Sonnet 5.5 10,00 $ per milione vs Grok 4.5 6,00 $ per milione
• Velocità di output — Claude Sonnet 5.5 138,7 token/sec vs Grok 4.5 59,2 token/sec
• Tempo al primo token di risposta, Max Effort — Claude Sonnet 5.5 370,8 s vs Grok 4.5 6,9 s
• Token generati durante l'intera valutazione dell'Indice — Claude Sonnet 5.5 410M vs Grok 4.5 77M
• Contesto — Claude Sonnet 5.5 1.000.000 token vs Grok 4.5 500.000 token
La linea della verbosità è il meccanismo alla base del divario di costo per attività, ed è il singolo numero più utile di questa pagina. Un modello che emette 410 milioni di token nel corso di una valutazione in cui il suo rivale ne emette 77 milioni non ha bisogno di un tasso di output superiore del 67% per costare sette volte tanto per attività — eppure ne ha uno, ed entrambi gli effetti spingono nella stessa direzione. La stessa impostazione di Anthropic concorda con l'interpretazione anziché contraddirla: "fino al 30% in meno per attività" è un'affermazione sul numero di token, non sui tassi, perché i tassi non sono cambiati tra Claude Sonnet 5 e Claude Sonnet 5.5. Artificial Analysis giunge alla stessa conclusione dal lato opposto e descrive il modello in linguaggio semplice come notevolmente veloce ma molto verboso. Rispetto a un modello snello, questa stessa proprietà è il più grande rischio operativo di Claude Sonnet 5.5.

Dove la tariffa economica di Grok 4.5 smette di essere economica
La riga $2,00 / $6,00 è un livello, non una tariffa. Nella documentazione per sviluppatori di SpaceXAI stessa, quel prezzo si applica fino a 200.000 token di input e raddoppia a $4,00 di input e $12,00 di output oltre tale soglia. La finestra di Grok 4.5 è di 500.000 token, quindi la seconda metà della finestra che pubblicizza costa il doppio della prima metà. Caricare un prompt su scala di repository in Grok 4.5 non è un'operazione da $6,00 di output; è un'operazione da $12,00 di output, e a quel punto il modello con la tariffa di output "costosa" da $10,00 è quello più economico su qualsiasi richiesta che emetta anche molti token.
Claude Sonnet 5.5 non ha un livello equivalente. La tariffa di $2,00 / $10,00 vale per l'intera finestra di 1.000.000 di token, e le letture dalla cache vengono fatturate a $0,20 — un decimo della tariffa di input — ed è ciò che rende il caso del contesto lungo fattibile nella pratica, anziché solo sulla carta.
La dimensione della finestra è l'altra metà di quel ragionamento e va nella stessa direzione. La finestra di Grok 4.5 è di 500.000 token e ognuno di essi viene fatturato alla tariffa pubblicizzata. Claude Sonnet 5.5 ha 1.000.000 di token con cui lavorare, ed è la forma del carico di lavoro a rendere la cosa importante: un repository su cui ragionare, una lunga trascrizione di agente, una pila di documenti che deve restare in vista. Il doppio del tetto massimo, nessun cambio di fascia a metà di esso, e letture dalla cache a un decimo della tariffa di input sono ciò che trasforma il portare così tanto contesto attraverso molte chiamate in una voce di spesa invece che in un budget.
La divisione pratica non è sottile:
• Prompt brevi con output denso — Grok 4.5 vince sul tasso e vince ancora sull'abitudine ai token
• Prompt che superano i 200.000 token di input — la tariffa di Grok 4.5 raddoppia, mentre quella di Claude Sonnet 5.5 no
• Lavoro interattivo sensibile alla latenza — Grok 4.5 risponde per primo, con un ampio margine, con le impostazioni predefinite
• Esecuzioni agentiche a lungo orizzonte — il punteggio composito e il tetto di output di 128K di Claude Sonnet 5.5 sono ciò per cui stai pagando il costo aggiuntivo dell'attività, e il tetto di 300K di Batches lo estende ulteriormente
La migrazione non è una stringa del modello
Chiunque passi da Claude Sonnet 5 a Claude Sonnet 5.5 dovrebbe leggere la nota di migrazione di Anthropic prima di scrivere codice, perché sono cambiati cinque comportamenti e solo uno di essi fallisce in modo eclatante in un punto ovvio.
• I valori non predefiniti di temperature, top_p o top_k ora restituiscono un errore 400 — una pipeline basata su un campionamento intensivo smette di funzionare invece di degradare
• thinking: {"type": "disabled"} restituisce un 400 e deve diventare between_tools, con effort limitato a low, medium o high; xhigh e max vengono rifiutati
• Uso forzato degli strumenti — tool_choice impostato su "any" o su uno strumento denominato — viene rifiutato del tutto, quindi un ciclo che forza una chiamata conforme allo schema deve passare a auto con uso rigoroso degli strumenti o output strutturati
• Il vecchio computer_20251124 strumento computer-use è rifiutato sull'API di Claude e su Google Cloud
• I blocchi di pensiero sono vincolati al modello e all'account che li producono, quindi il ragionamento prosegue da Claude Sonnet 5 ma non trasversalmente verso una famiglia diversa — e lo strumento advisor non accetta più Claude Opus 4.8, Claude Opus 4.7 o Claude Sonnet 5 come advisor dietro un esecutore Sonnet 5.5
C'è una sesta modifica che non fa fallire assolutamente nulla, il che la rende quella pericolosa: il testo tra le chiamate agli strumenti ora viene restituito all'interno dei blocchi di pensiero. Un'applicazione che trasmette in streaming quel testo a un utente resta silenziosa tra una chiamata e l'altra finché non imposta un valore di visualizzazione o non disattiva del tutto il pensiero iniziale. Nulla genera errori. L'output semplicemente smette di comparire.
Grok 4.5 non richiede nulla di tutto ciò. È un modello in formato OpenAI con la superficie di campionamento intatta, e passare ad esso dai predecessori stessi di Grok 4.5 è un cambio di stringa del modello. Il costo della migrazione ricade interamente sul lato Claude, ed è un giorno di lavoro anziché un pomeriggio.
Entrambi su un'unica credenziale, e il limite onesto di ciò
Tenere a mente un confronto tra due fornitori è facile; è nell'eseguirlo che si nasconde il costo. OrcaRouter mette oltre 200 modelli dietro un unico endpoint compatibile con OpenAI, con il prezzo di listino dei provider passato tal quale e nessun ricarico aggiunto, così una variazione di tariffa da una delle due parti è attiva qui lo stesso giorno invece che al prossimo rinnovo contrattuale, con failover automatico tra i provider upstream e un DSL di routing per comporre le chiamate. L'intera gamma Grok è nel catalogo alle tariffe di SpaceXAI, e Grok 4.5 è instradabile come grok/grok-4.5 a $2,00 di input e $6,00 di output per milione di token su una finestra di 500.000 token.
Claude Sonnet 5.5 non è nel nostro catalogo, e questa pagina non ha alcuna intenzione di suggerire il contrario. Oggi l'unica via per arrivarci è l'API di Anthropic stessa, oppure Bedrock e Google Cloud, se è lì che risiede già la vostra infrastruttura. Claude Sonnet 5 è instradabile qui dal 30 giugno ai prezzi di Anthropic di 2,00 $ e 10,00 $ e resta il modello su cui passa la maggior parte del traffico dell'API di Claude, il che lo rende il naturale obiettivo di failover mentre Claude Sonnet 5.5 ha appena un giorno di vita ed è privo di qualsiasi evidenza produttiva.
Su tutto ciò va fatta una precisazione, e non è di poco conto. La riga di Grok 4.5 qui sopra è la presentazione del fornitore così come il nostro catalogo attualmente la riproduce; il contatore del traffico su quella voce segna zero negli ultimi sette giorni e il suo valore di throughput non viene misurato, con il tempo al primo token fermo al minimo di un secondo che un modello chiamato raramente tende a mostrare. Un modello senza traffico recente qui non è prova che il modello sia scarso — 4.6 e 4.7 sono dove sono finite le chiamate della famiglia — ma significa che i numeri operativi su quella pagina sono scarni, e il dato di latenza di cui fidarsi è la lettura di una rotta attiva.

Quale scegliere
Grok 4.5 è il modello giusto quando il prompt è breve, la risposta è densa e l'integrazione parla già OpenAI — e quando la richiesta non supererà i 200.000 token di input, perché oltre quella soglia l'aritmetica cambia mani. È anche la scelta giusta quando un primo token deve arrivare in secondi anziché in minuti. Ciò che non è è l'attuale flagship di Grok; Grok 4.6 e Grok 4.7 si collocano sopra di esso allo stesso prezzo di listino, e la ragione per scegliere 4.5 rispetto a uno dei due deve essere specifica.
Claude Sonnet 5.5 è il modello giusto quando il prompt è enorme, il lavoro è sufficientemente agentico perché diciassette punti Index e un tetto di output di 128K giustifichino un costo per attività sette volte superiore, oppure quando il punteggio composito è semplicemente ciò che si sta acquistando. La sua verbosità è una scelta di progettazione, non un difetto, ed è il numero da misurare sul proprio traffico prima di impegnarsi — perché 7,60 $ per attività Index contro 1,04 $ è un proxy per un valore che solo il vostro carico di lavoro può produrre.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
