
La fuga di notizie del "Kettle" di Claude Fable 5: l'ID del modello interno nascosto nel pensiero firmato — cosa sappiamo finora
- z-aiNUOVOZ.ai: GLM 5.32026-08-1860Intelligenza75Codice
- obsidianNUOVOQwen3.8 27B Uncensored (Aggressive)2026-08-1552Intelligenza68Codice
- qwenNUOVOQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNUOVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenza69Codice
- grokNUOVOSpaceXAI: Grok 4.62026-08-1261Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0557Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaMeta: Muse Spark 1.12026-07-1653Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenza71Codice
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenza77Codice
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenza77Codice
- grokxAI: Grok 4.52026-07-0856Intelligenza72Codice
Il 16 agosto alle 23:29:45 PDT, un ricercatore su X ha pubblicato un'affermazione che ha trasformato un angolo poco appariscente dell'API di Anthropic in una storia del tipo "quello che sappiamo finora": decodificate la "firma" firmata dal server che accompagna ogni blocco di pensiero di Claude, hanno detto, e il campo sei indica il modello che vi ha effettivamente risposto. Nella loro lettura, le risposte pubblicamente etichettate come claude-fable-5 — il Claude Fable 5 di classe Mythos che Anthropic ha distribuito ampiamente dal 9 giugno 2026, a $10/$50 per milione di token — hanno iniziato a trasportare un identificatore interno che non appare da nessuna parte nella documentazione pubblica di Anthropic: claude-kettle-e2c95a10-v2-prod. Nulla è cambiato nell'etichetta della risposta. Non è stato dimostrato che cambiassero nemmeno la fatturazione, il campo di livello superiore dell'API dedicato al modello, o la garanzia dello snapshot bloccato di Anthropic. Quello che è cambiato è una stringa sepolta in un campo che la documentazione dice esplicitamente agli sviluppatori di non analizzare.
Questo è un rapporto di fuga di notizie, non un verdetto. Il ritrovamento risale a quattro giorni fa, si basa sulla decodifica di un singolo ricercatore che non è stata riprodotta in modo indipendente, e Anthropic non ha commentato a cosa si riferisca "Kettle" — o la sua etichetta associata MYCRO_MODEL_MANATEE. La domanda utile non è "Anthropic ha sostituito Fable 5?" Le prove non lo stabiliscono. La domanda utile è cosa significherebbe, se fosse reale, un ID di modello interno che appare sotto un ID di modello pubblico, e cosa non significherebbe. Ecco cosa sappiamo finora.
Cosa ha effettivamente scoperto la fuga
Il segnale è un singolo post su X di @chetaslua (status 2089783170896179632, pubblicato il 16 agosto 2026), scritto nel solito stile "prima con le prove" dell'account. L'affermazione, in breve:
I blocchi di pensiero di Claude trasportano un protobuf firmato dal server nel campo della firma.
Il campo sei di quel protobuf, dice il ricercatore, contiene l'identificatore del modello che ha effettivamente prodotto la risposta.
A partire dalle 23:29:45 PDT del 16 agosto, 2.582 firme campionate su 2.582 presentavano lo stesso valore: claude-kettle-e2c95a10-v2-prod.
• Anche una seconda etichetta interna, MYCRO_MODEL_MANATEE, è apparsa negli stessi metadati.
La cifra "2.582 su 2.582" svolge un lavoro retorico: è la prova del ricercatore che non si trattava di un caso isolato o di una porzione A/B, ma di un cambio integrale di qualunque cosa l'identificatore indichi. Ciò che il post non include è il metodo dietro la decodifica — nessuna firma grezza, nessuno script di decodifica, nessuno schema protobuf inferito, nessun metadato completo della risposta. L'evidenza pubblica è un grafico riassuntivo. Questo rende il risultato plausibile e, allo stesso tempo, attualmente non verificabile.

Perché la firma ha persino un "campo sei"
Ogni blocco di pensiero che Claude restituisce contiene un {{1}}campo firma{{/1}}. Secondo la {{2}}documentazione sul pensiero di Anthropic{{/2}}, quella firma è {{3}}"una copia crittografata dell'intero ragionamento"{{/3}} che si deve restituire invariata nelle conversazioni multi-turno e con uso di strumenti, e l'API la usa {{4}}"per verificare che i blocchi di pensiero siano stati generati da Claude."{{/4}} Su Claude Fable 5 il comportamento predefinito rende la firma l'unica traccia visibile: con display impostato su {{5}}"omitted"{{/5}} — il valore predefinito su {{6}}Fable 5, Mythos 5, Opus 5 e Sonnet 5{{/6}} — il {{7}}blocco di pensiero{{/7}} viene restituito con un {{8}}campo thinking{{/8}} vuoto e solo la {{9}}firma valorizzata{{/9}}.
La documentazione aggiunge poi una frase che conta per qualsiasi fuga costruita su questo campo: "Il campo firma è opaco: non interpretarlo né analizzarlo." Analizzarlo è esattamente ciò che fa l'affermazione di Kettle. Questo non è una prova che l'affermazione sia sbagliata — la firma deve essere leggibile dalla macchina per lo stack di servizio di Anthropic — ma significa che la decodifica è stata eseguita contro l'istruzione esplicita del fornitore, su un protocollo non documentato, e la ricostruzione di quel protocollo da parte del ricercatore non è stata pubblicata. Ogni inferenza costruita su "il campo sei indica il modello servito" eredita quella incertezza.
Ciò che non prova
Cominciamo da ciò che le prove effettivamente sono: una risposta etichettata pubblicamente come claude-fable-5 conteneva un identificatore interno mai segnalato in precedenza. Questo è tutto. L'identificatore da solo non dimostra che Anthropic abbia sostituito i pesi di Fable 5, che esista un successore più capace, che le risposte siano migliorate o peggiorate, o che una richiesta sia stata instradata a un modello più piccolo. "Kettle" potrebbe essere il nome di un deployment di serving interno per la stessa identica snapshot di Fable 5; potrebbe essere il nome di un componente router; potrebbe essere un classificatore nello stack di sicurezza. Il nome in codice non può distinguere tra queste possibilità.
La politica di versionamento di Anthropic spiega perché la fuga di notizie è compatibile con il fatto che nulla sia cambiato. Nella documentazione "Model IDs and versioning", due affermazioni si trovano fianco a fianco:
Anthropic non aggiorna i pesi o la configurazione di un ID modello esistente. Quando è disponibile una versione aggiornata, viene rilasciata con un nuovo ID modello.
I pesi del modello sono fissi per un dato ID, ma l'infrastruttura di serving attorno al modello può cambiare nel tempo. Questa infrastruttura include componenti come il router delle richieste, i classificatori di sicurezza e la logica di campionamento.

Quella seconda frase è l'intero divario concettuale tra "Kettle è uno scandalo" e "Kettle è un lunedì qualunque." I documenti prevedono persino la deriva comportamentale: "Occasionalmente, gli aggiornamenti dell'infrastruttura producono piccole differenze nel comportamento osservabile anche quando l'ID del modello e i pesi non sono cambiati." Un nuovo router o un deployment di servizio di nome Kettle rientrerebbe esattamente in quella frase. Perché la fuga sia davvero compromettente, dovrebbe mostrare o un nuovo modello dietro l'ID nonostante la policy, oppure un meccanismo che violasse le regole di visibilità di seguito.
Il routing di fallback documentato che Fable 5 già ha
Claude Fable 5 è già dotato di un meccanismo di cambio modello reale, documentato e pensato per essere visibile. I classificatori di sicurezza ispezionano le richieste e possono instradare un sottoinsieme — {{1}}Anthropic cita cybersecurity offensiva, biologia a duplice uso, distillazione di modelli e alcuni lavori all'avanguardia sui chip{{/1}} — verso un modello Claude Opus 5. Sulle superfici consumer, il fallback dovrebbe essere evidente: {{2}}un avviso, il nome del modello che fornisce la risposta e il selettore del modello che passa a Opus{{/2}}. Nell'API, la risposta espone il modello utilizzato tramite il campo model di primo livello e un blocco di contenuto di fallback dedicato.
L'affermazione su Kettle descrive qualcosa di diverso, e la differenza è la parte che avrebbe importanza: un identificatore interno che appare in una risposta che ha mantenuto l'etichetta pubblica Fable 5. Il post del ricercatore non mostra un avviso di fallback, un campo del modello API modificato o un blocco di fallback — se lo avesse fatto, la storia sarebbe "il fallback documentato è scattato", non "Anthropic sta instradando silenziosamente". Senza questo, la fuga di notizie non ha dimostrato che sia stata violata alcuna garanzia di visibilità, perché non ha mostrato cosa sia Kettle.
Perché è importante anche se non è cambiato nulla.
Gli ID di modello fissati sono un meccanismo di fiducia. La documentazione di Anthropic promette che "quando usi un ID di modello in una richiesta API, il modello sottostante rimane costante per l'intera durata di quell'ID" — è proprio il motivo per cui un team può fare benchmark contro claude-fable-5 e aspettarsi che il risultato abbia ancora senso il prossimo trimestre. Un identificatore nascosto sotto quell'ID, qualunque esso sia, è un promemoria del fatto che la garanzia copre pesi e configurazione, non l'intero percorso dalla richiesta al token. Se un modello davvero diverso fosse mai eseguito sotto un ID pubblico senza che fosse reso noto, ogni valutazione, ogni previsione di costo e ogni test di regressione della qualità legato a quell'ID sarebbe silenziosamente invalido.
La questione della fatturazione rende il quadro più nitido. Claude Fable 5 costa $10 per milione di token in ingresso e $50 per milione di token in uscita — la tariffa pubblicata più alta di Anthropic. Se il modello servito fosse mai stato diverso dall'ID fatturato, la domanda diventa quale tariffa si applica e chi lo decide. La fuga di notizie non offre prove che ciò sia accaduto; il punto è solo che il campo della firma è il primo posto dove cercheresti un segno.
Il tempismo è anche degno di nota. Questo è il terzo segnale di Anthropic in nove giorni: il 7 agosto l'azienda ha annunciato di aver riaddestrato il classificatore biologico di Fable 5, riducendo i fallback legati alla biologia di circa l'85% nei test interni; il 14 agosto il suo Responsible Scaling Policy Risk Report ha riconosciuto un "Model 2" interno non pubblicato che Anthropic definisce "un miglioramento notevole" rispetto a Claude Mythos 5 e che non prevede di rilasciare. Entrambe sono dichiarazioni del fornitore, ma insieme mostrano Anthropic mentre modifica attivamente i sistemi attorno a Claude Fable 5 — classificatori il 7, un successore interno riconosciuto il 14 — mantenendo fissa l'ID claude-fable-5. Kettle sarebbe la stessa forma di storia, meno la divulgazione.
Cosa fare al riguardo
Per chi chiama le API, la posizione pratica è banale e corretta: un identificatore non è prova di uno scambio, e nella fuga di dati non c'è ancora nulla su cui agire. Quello che puoi fare è produrre le tue prove. Registra il campo model di primo livello ed eventuali blocchi di fallback nelle risposte che ricevi effettivamente, e tieni d'occhio i delta di token e costi su un carico di lavoro fisso. Se un fallback documentato scatta, sarà visibile esattamente in quei punti. Questo è l'unico test che conta per il tuo carico di lavoro, e non dipende dal fatto che qualcuno decodifichi il formato di firma di Anthropic.
Se stai instradando verso Claude Fable 5 tramite OrcaRouter, la stessa forma di risposta che restituisce Anthropic torna indietro, e poiché trasmettiamo i prezzi di listino del provider senza alcun ricarico, non c'è un secondo set di prezzi da riconciliare — se Anthropic dovesse mai cambiare la tariffa di Fable 5, il nuovo numero è attivo sul nostro lato lo stesso giorno. Per una situazione non verificata come questa, il modo a basso rischio di continuare a usare il modello senza scommettere un percorso di produzione su una voce è instradare una parte del traffico reale verso Claude Fable 5 con failover automatico a un fallback comprovato — Claude Opus 5 a $5/$25 per milione, o un modello di livello coding più economico — così una regressione di qualità diventa una decisione di routing invece che un incidente. Stessa chiave, nessun secondo contratto, e il failover è una modifica al routing-DSL piuttosto che una riscrittura.

Cosa stiamo guardando
• Se Anthropic commenta. La soluzione più pulita è un riconoscimento in una sola riga di cosa sono Kettle e Manatee. Il silenzio è di per sé informativo.
• Una riproduzione indipendente. Qualcuno che pubblichi le firme grezze, il metodo di decodifica e lo schema protobuf dedotto sposterebbe questo da un grafico di una singola persona a un'affermazione verificabile. Fino ad allora è un "ciò che sappiamo finora", non una scoperta.
• La superficie di visibilità. Se le risposte di claude-fable-5 iniziano a mostrare avvisi di fallback, un campo modificato del modello API o blocchi di fallback, l'interpretazione del "fallback documentato" diventa più forte; in caso contrario, prevale quella della "rotta non documentata".
• Un nuovo ID di modello. La politica di versionamento di Anthropic dice che una versione genuinamente nuova viene rilasciata con un nuovo ID. La conferma più chiara che Kettle sia un vero successore sarebbe quindi che Anthropic rilasci qualcosa — non una semplice riconfigurazione interna. Tieni d'occhio un claude-fable-5.1 o simile.
• Se "Manatee" viene spiegato. La seconda etichetta è un filo che nessuno ha ancora tirato.
Domande frequenti
Anthropic sta davvero instradando Claude Fable 5 verso un modello diverso?
Non provato. La fuga mostra che le risposte etichettate claude-fable-5 portavano un identificatore interno, claude-kettle-e2c95a10-v2-prod, in una firma di pensiero firmata. Non dimostra che i pesi siano cambiati, che sia stato distribuito un successore, o che una qualsiasi richiesta sia stata declassata. "Kettle" potrebbe benissimo essere il nome di un deployment di servizio interno per lo stesso snapshot di Fable 5.
Come è stato trovato l'identificatore Kettle?
Il ricercatore @chetaslua afferma di aver decodificato un protobuf all'interno del campo firma dei thinking block di Claude e di aver letto l'identificatore del modello dal campo sei. La documentazione di Anthropic definisce la firma "opaca" e dice agli sviluppatori di non analizzarla, e il metodo di decodifica del ricercatore non è stato pubblicato, quindi l'affermazione non è ancora riproducibile in modo indipendente.
Questo viola la garanzia del modello bloccato di Anthropic?
Sconosciuto. La documentazione sul versioning di Anthropic afferma che non aggiorna mai i pesi o la configurazione di un ID di modello esistente e che le nuove versioni vengono distribuite con un nuovo ID — ma consente esplicitamente che l'infrastruttura di servizio attorno a un modello (il router delle richieste, i classificatori di sicurezza, la logica di campionamento) cambi. Un identificatore Kettle potrebbe essere esattamente quel tipo di modifica, che non violerebbe la garanzia.
Come farei a sapere se il modello che mi serve è cambiato?
Osserva il campo del modello di primo livello nelle risposte API, cerca i blocchi di contenuto di fallback e tieni traccia dei delta di token e costi su un carico di lavoro fisso. I fallback documentati di Anthropic sono pensati per essere visibili in quei punti. Non esiste un campo API pubblico che esponga l'identificatore Kettle.
La lettura onesta è che una fuga di notizie ha nominato qualcosa, non ha dimostrato cosa sia. L'identificatore Kettle è reale nell'unico senso in cui una stringa trapelata può esserlo: un ricercatore dice che c'è, 2.582 volte su 2.582, a partire dalla notte del 16 agosto. A cosa si riferisca — un nuovo modello, una distribuzione rinominata, un componente router, un classificatore — resta non verificato, e la documentazione di Anthropic offre una spiegazione perfettamente banale per il tutto. Questo è il valore dell'articolo e il suo limite. Finché non verrà pubblicata una firma grezza o Anthropic non dirà cos'è Kettle, l'atteggiamento giusto è trattarlo come un "quello che sappiamo finora": degno di attenzione, degno di registrare il proprio traffico, e non degno di cambiare la scelta del modello — soprattutto quando un livello di routing ti consente di mantenere aperta l'opzione in entrambi i casi.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
