Card hero per Claude Sonnet 5.5 intitolata "Un test stealth, o il listino prezzi che hai già", con tre pill che recitano "non rilasciato", "nessun ID del modello pubblicato" e "annunciato: nelle prossime settimane", un piè di pagina che cita un post su X del 24 settembre 2026 e il post di lancio di Opus 5.5 di Anthropic del 22 settembre 2026, e il logo OrcaRouter in basso a destra
Guides & Insights

Claude Sonnet 5.5: Una fuga di notizie su un test stealth costruita con quattro numeri già esistenti

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Il 24 settembre sono stati pubblicati su X quattro numeri come prova che Claude Sonnet 5.5 sia "già in fase di test stealth": una finestra di contesto da 1M di token, un output massimo di 128K token, 2 $ per milione di token in input e 10 $ per milione di token in output. Tutti e quattro compaiono proprio adesso nel listino prezzi di Anthropic, associati a Claude Sonnet 5 — il modello che un 5.5 andrebbe a sostituire, disponibile in generale dal 30 giugno 2026. Lo stesso prezzo di punta di 2 $ / 10 $ appartiene anche a GPT-6 Sol, che OpenAI ha lanciato il 22 settembre, ed è proprio questa sovrapposizione a far leggere il post come una risposta a OpenAI anziché un normale aggiornamento di fascia: "Per me questa è una risposta diretta a GPT-6-Sol. Stesso prezzo e presumibilmente p[restazioni] simili".

Niente di tutto ciò rende falsa l'affermazione. La rende infalsificabile, che è un problema diverso e più utile da mettere per iscritto. Un avvistamento in un test stealth vale solo quanto l'artefatto che vi sta dietro, e l'artefatto dietro questo è una scheda tecnica indistinguibile dal modello che Anthropic serve da dodici settimane.

Cosa è stato effettivamente pubblicato

La fonte è un singolo post su X dall'account @kimmonismus, datato 24 settembre 2026. Indica la finestra di contesto, il tetto di output e i due prezzi, confronta il prezzo con GPT-6 Sol e conclude che Sonnet 5.5 è in fase di test. Non c'è alcuno screenshot, nessuna stringa di modello, nessuna risposta API, nessun elenco di console, nessuna descrizione del comportamento da parte dei tester e nessun secondo osservatore collegato a nulla di tutto ciò. Il post è un'affermazione con dei numeri dentro, e i numeri sono i limiti pubblici del tier.

Vale la pena distinguerlo dall'altro tipo di storia di pre-rilascio di Anthropic, perché il 2026 li ha prodotti entrambi e non si somigliano affatto. Gli identificatori di accesso anticipato di agosto claude-marshmallow-eap e claude-melon-eap erano stringhe che esistevano nelle richieste — brutte, poco eleganti e verificabili. La storia di Opus 5.2 che attraversa settembre è un resoconto di routing: sviluppatori che notano che il backend dietro l'etichetta "Opus 5" rispondeva in modo diverso, e ne descrivono il comportamento. Entrambi sono artefatti. "Già sottoposto a test in modalità stealth" senza alcun artefatto allegato è un riassunto di ciò che il tier Sonnet già vende.

C'è anche uno schema degno di nota nella fonte stessa. Lo stesso account ha pubblicato il 20 settembre un riepilogo che si apriva con quattro modelli per cui, secondo quanto affermato, si vedevano "già dei test" — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 e Gemini 4 Pro. Di questi quattro nomi, le voci Opus e Fable hanno alle spalle resoconti separati e corroborati, e la voce Gemini ha avvistamenti propri. La voce Sonnet aveva una posizione in un elenco. Quattro giorni dopo, l'affermazione su Sonnet si è arricchita di una scheda tecnica, e la scheda tecnica è il modello che esiste già.

I quattro numeri sono i numeri di Claude Sonnet 5

Questa è la parte che richiede trenta secondi per essere verificata e che quasi nessuno ha verificato. La pagina di panoramica dei modelli di Anthropic, consultata oggi, riporta Claude Sonnet 5 con una finestra di contesto di 1M di token, un output massimo di 128K e $2 / $10 per milione di token. Metti il leak a confronto con questi dati:

• Finestra di contesto — 1M token dichiarati per Claude Sonnet 5.5; 1M token pubblicati per Claude Sonnet 5

• Output massimo — 128K token dichiarati; 128K token pubblicati

• Prezzo di input — $2 per milione dichiarato; $2 per milione pubblicato

• Prezzo dell'output — 10 $ per milione dichiarato; 10 $ per milione pubblicato

• ID modello — nulla di pubblicato per Claude Sonnet 5.5; claude-sonnet-5 per Claude Sonnet 5

• Punteggi indipendenti — nessuno per il modello dichiarato; Artificial Analysis colloca Claude Sonnet 5 a un Intelligence Index di 38, al rango 54 dei 210 modelli che misura, nella configurazione adaptive-reasoning, max-effort

Two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Sonnet 5 - the scoreboard'. The left column, Claude Sonnet 5.5 (leaked), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID none published; independent scores none. The right column, Claude Sonnet 5 (shipped June 30, 2026), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID claude-sonnet-5; independent scores AA Index 38. The footer reads 'Claude Sonnet 5 figures per Anthropic and Artificial Analysis; Claude Sonnet 5.5 figures unverified, single observer.'

C'è un secondo livello nella questione del prezzo che il leak capovolge. Quando è stato lanciato Claude Sonnet 5, 2 $ / 10 $ sono stati annunciati come prezzo introduttivo valido fino al 31 agosto 2026, con un aumento programmato a 3 $ / 15 $ il 1° settembre. Quell'aumento non si è verificato. La pagina dei prezzi di Anthropic ora riporta una nota a piè di pagina che afferma che 2 $ / 10 $ «è ora il prezzo standard» e che «l'aumento precedentemente programmato a 3 $ / 15 $ per milione di token di input/output il 1° settembre 2026 non avrà luogo». Quindi il prezzo che il leak presenta come l'arma competitiva del nuovo modello è la tariffa permanente dell'incumbent — il che significa che un Sonnet 5.5 lanciato a 2 $ / 10 $ verrebbe lanciato senza alcuno sconto, in un segmento già prezzato contro GPT-6 Sol.

L'unica cosa che Anthropic ha effettivamente detto

Elimina tutto ciò che proviene da leaker anonimi e sopravvive una sola frase di prima mano. Quando Anthropic ha lanciato Claude Opus 5.5 il 22 settembre 2026, ha affermato che Claude Sonnet 5.5 e Claude Haiku 5.5 sarebbero seguiti «nelle prossime settimane», portando miglioramenti comparabili in prestazioni, efficienza e sicurezza. Quella frase è l'intero resoconto confermato. Non riporta alcun ID di modello, alcuna finestra di contesto, alcun prezzo, alcun benchmark e alcuna data — e in particolare non dice nulla su un test stealth, una via grigia o qualsiasi tipo di test.

Il resto della superficie pubblica di Anthropic concorda con questa interpretazione. La panoramica dei modelli elenca ancora quattro modelli — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 e Claude Haiku 4.5 — senza una quinta riga, nessuna voce di prezzo e nessun indicatore "in arrivo" per un successore di Sonnet. Se un checkpoint di livello Sonnet fosse servito da qualche parte raggiungibile da uno sviluppatore, l'identificatore sarebbe la prima cosa a emergere, perché un modello servito deve avere un nome in una richiesta. Nulla è emerso.

Una cosa che l'annuncio di settembre ha chiarito: ha contraddetto la fuga di notizie precedente secondo cui la linea Haiku sarebbe stata ritirata e la generazione 5.5 avrebbe ristrutturato la gamma. Haiku 5.5 sta arrivando, secondo Anthropic, il che significa che la storia della ristrutturazione era sbagliata nella direzione in cui i leaker raramente lo sono: il livello economico resta.

Il leak di agosto diceva 2 milioni di token. Questo dice 1 milione.

Sei settimane prima del post del 24 settembre, il 9 agosto, un altro account X ha pubblicato una scheda tecnica "SONNET 5.5 LEAK" con un'affermazione molto più audace: una finestra di contesto da 2 milioni di token, il doppio di quella di Sonnet 5, inferenza più rapida, un uso migliore degli strumenti per browser e terminale, prestazioni vicine a quelle di Claude Fable 5 e un rilascio "il mese prossimo". Quella fuga di notizie includeva una grafica realizzata per sembrare una scheda di anteprima di Anthropic. Includeva anche un dettaglio fatale su cui i suoi critici si sono subito fissati: il nome in codice che attribuiva, "Fennec", era il nome in codice già distribuito con Claude Sonnet 5 il 30 giugno. Un nome in codice non può essere una prova nuova dell'esistenza di un successore del modello che lo ha usato.

Quindi le due ondate di leak non concordano sul singolo numero più citato. Agosto diceva 2M di contesto. Settembre dice 1M. Entrambi non possono descrivere la stessa build. L'interpretazione più probabile è quella noiosa: il post di settembre descrive i limiti pubblicati del livello Sonnet perché è così che appare dall'esterno un modello di livello Sonnet, e il post di agosto era una congettura su ciò che un refresh avrebbe plausibilmente raddoppiato. Nota in quale direzione si è mosso il numero — verso il basso, verso ciò che già esiste.

Quindi il confronto tra GPT-6 e Sol è corretto?

Per lo più, e il punto in cui si rompe è la parte interessante. GPT-6 Sol è stato rilasciato il 22 settembre 2026, lo stesso giorno di Claude Opus 5.5, e il suo prezzo di listino parte da $2 per milione di input e $10 per milione di output — esattamente la tariffa di Sonnet 5 ed esattamente ciò che il leak afferma per Sonnet 5.5. Offre una finestra di contesto di 1.050.000 token con un tetto di output di 128K, entrambi di poco distanti dai numeri di Claude Sonnet 5. Il fratello più economico, GPT-6 Luna, si attesta a $0,10 / $0,50.

La differenza sta nel contesto lungo. GPT-6 Sol applica prezzi su due fasce: 2 $ / 10 $ fino a 272.000 token di input, poi 4 $ / 15 $ oltre quella soglia. Anthropic non fa questo sulla linea Sonnet — Claude Sonnet 5 fattura l'intera finestra da 1M alle tariffe standard, quindi una richiesta da 900K token costa per token quanto una da 9K. Un vero Sonnet 5.5 rispetto a un vero GPT-6 Sol è quindi un pareggio di prezzo per i prompt ordinari e un divario di due volte per i carichi di lavoro su documenti lunghi e repository di grandi dimensioni su cui entrambi i modelli vengono venduti. «Stesso prezzo» è vero in titolo e falso nei carichi di lavoro in cui si sceglie la fascia.

Una seconda avvertenza si cela dietro l'intero confronto. Claude Sonnet 5 utilizza il tokenizer più recente di Anthropic, che produce circa il 30% di token in più per lo stesso testo rispetto al precedente. Una tariffa di facciata non è una fattura; la fattura è data dai token per attività, e questo è il numero che nessuna fuga di notizie ha mai riportato.

Cosa renderebbe rilevante un Sonnet 5.5?

Metti da parte la questione se esista e chiediti cosa cambierebbe per chi paga i token. Quattro cose, e nessuna di esse è una scheda tecnica.

Il primo è un prezzo inferiore a $2 / $10. Con l’aumento del 1º settembre annullato, la tariffa dell’operatore incumbent è ora permanente — quindi un successore che mantiene la stessa tariffa è una mossa laterale, e l’unica notizia di livello Sonnet che muove il denaro è un taglio.

Il secondo è il contesto oltre 1M. Quella era la proposta effettiva del leak di agosto ed è l'unico divario di capacità che il leak può nominare che l'incumbent non copre già.

Il terzo è il numero di token per attività. Il pensiero adattivo di Claude Sonnet 5 è attivo per impostazione predefinita e analisi indipendenti hanno misurato che genera sostanzialmente più token di output per attività rispetto al suo predecessore. Una versione che mantiene la tariffa di $2 / $10 e arresta questa inflazione ridurrebbe le fatture reali più di un taglio di prezzo che fa notizia.

Il quarto è un identificatore. Una stringa di modello API, una riga di documentazione, una voce di prezzo, una scheda modello — uno qualsiasi di questi chiude la questione, e l'assenza di tutti e quattro dopo una fuga così esplicita è di per sé il fatto più rivelatore di questa storia.

Cosa puoi chiamare oggi

Claude Sonnet 5 non è un segnaposto in attesa che il livello si definisca. È il modello su cui già gira la maggior parte del traffico dell'API Claude, con una finestra di 1M di token, un output di 128K e la tariffa di $2 / $10 che ora è standard anziché promozionale.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38 at rank 54 of 210, an output speed of 79.3 tokens per second at rank 77 of 210, a cost of $2.00 per million input tokens and $10.00 per million output tokens with a 90% cache discount and $5.09 cost per Intelligence Index task, a verbosity of 370M output tokens, reasoning enabled, and a 1M token context window

È su OrcaRouter da giugno ai prezzi di Anthropic stessi, 2 $ / 10 $, trasferiti al prezzo di listino del fornitore senza alcun ricarico, quindi una variazione di prezzo del fornitore sulla linea Sonnet sarebbe attiva qui lo stesso giorno anziché al ciclo di fatturazione successivo. La stessa chiave raggiunge già GPT-6 Sol a 2 $ / 10 $, il che conta più del solito in un pezzo come questo: il confronto su cui si basa il leak è un confronto che puoi eseguire tu stesso con una sola credenziale invece di due contratti.

OrcaRouter model page for anthropic/claude-sonnet-5, attributed to Anthropic and dated 2026-06-30, showing a 1M token context window, 128K maximum output, text plus image and file inputs, an INPUT price of $2.00 per million tokens and an OUTPUT price of $10.00 per million tokens, a p50 time to first token of 5.67 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

È anche il modo più economico per rispondere alla domanda sollevata dal leak. Se un Sonnet 5.5 dovesse effettivamente apparire, arriva nel catalogo come qualsiasi altra cosa, e dirotti una parte del traffico verso di esso dietro un failover automatico verso Claude Sonnet 5 — nessuna seconda integrazione, nessuna rinegoziazione e nessun percorso di produzione che dipende da un modello che nessuno ha sottoposto a benchmark indipendenti. Provare un livello non comprovato è una decisione di routing, non un progetto di migrazione.

Cosa guardare invece del prossimo post di leak

Tre segnali, in ordine decrescente di quanto ti direbbero. Un identificatore è decisivo, perché un modello servito deve avere un nome in una richiesta ed è così che ogni storia di pre-rilascio di Anthropic verificabile nel 2026 è diventata verificabile. Un riconoscimento da parte del fornitore — una model card, una riga nella documentazione, una voce di prezzo, o semplicemente la comparsa del modello nell'elenco di Anthropic stesso — la chiude del tutto; la frase "nelle prossime settimane" significa che uno di questi è davvero dovuto. Un resoconto di un tester che descrive il comportamento anziché le specifiche è il più debole dei tre, e comunque più di quanto esista oggi.

Finché una di queste non si concretizza, la sintesi onesta è che Anthropic ha promesso un aggiornamento di Sonnet nelle prossime settimane e un osservatore l’ha descritto usando i numeri del modello che sostituirà. Se il tuo stack esegue già claude-sonnet-5, non c’è nulla da aspettare e nulla su cui pianificare. Se stai soppesando Claude Sonnet 5 rispetto a GPT-6 Sol, i numeri su cui puoi basarti sono quelli già pubblicati — e sono gli stessi numeri che il leak sta cercando di venderti come notizia.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno