Hero-kort för Claude Sonnet 5.5 med rubriken ”Ett smygtest, eller prislistan du redan har”, med tre piller med texten ”inte släppt”, ”inget modell-ID publicerat” och ”annonserad: kommande veckor”, en sidfot som citerar ett X-inlägg från 24 september 2026 och Anthropics lanseringsinlägg för Opus 5.5 från 22 september 2026, samt OrcaRouter-logotypen nere till höger
Guides & Insights

Claude Sonnet 5.5: En smygtestläcka byggd av fyra nummer som redan finns

Författare

Alistair Wren

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Fyra siffror publicerades på X den 24 september som bevis för att Claude Sonnet 5.5 ”redan smygtestas”: ett kontextfönster på 1M token, en maximal utdata på 128K token, $2 per miljon indatatoken och $10 per miljon utdatatoken. Alla fyra finns på Anthropics egen prislista just nu, kopplade till Claude Sonnet 5 – modellen som en 5.5 skulle ersätta, allmänt tillgänglig sedan 30 juni 2026. Samma prislapp på $2 / $10 gäller också GPT-6 Sol, som OpenAI släppte den 22 september, och den överlappningen gör att inlägget läses som ett svar på OpenAI snarare än en rutinmässig nivåuppdatering: ”Det här framstår för mig som ett direkt svar på GPT-6-Sol. Samma prissättning och förmodligen liknande p[restanda].”

Inget av det gör påståendet felaktigt. Det gör påståendet ofalsifierbart, vilket är ett annat och mer användbart problem att skriva ned. En iakttagelse i ett stealth-test är bara så bra som artefakten bakom den, och artefakten bakom den här är ett specifikationsblad som inte går att skilja från den modell Anthropic har serverat i tolv veckor.

Vad som faktiskt publicerades

Källan är ett enda X-inlägg från kontot @kimmonismus, daterat den 24 september 2026. Det anger kontextfönstret, utdatataket och de två priserna, jämför prissättningen med GPT-6 Sol och drar slutsatsen att Sonnet 5.5 är under testning. Det finns ingen skärmbild, ingen modellsträng, inget API-svar, ingen konsolutskrift, ingen beskrivning från testare av beteendet och ingen andra observatör kopplad till något av det. Inlägget är ett påstående med siffror i, och siffrorna är nivåns offentliga gränser.

Det är värt att skilja från den andra typen av Anthropic-berättelse före lansering, eftersom 2026 har producerat båda och de är inte alls lika. Augusti-identifierarna för tidig åtkomst claude-marshmallow-eap och claude-melon-eap var strängar som fanns i förfrågningar – fula, oglamorösa och kontrollerbara. Opus 5.2-historien som löper genom september är en routingrapport: utvecklare som lägger märke till att backend-systemet bakom etiketten ”Opus 5” svarade annorlunda och som beskriver beteendet. Båda är artefakter. ”Redan smygtestas” utan någon kopplad artefakt är en sammanfattning av vad Sonnet-nivån redan säljer.

Det finns också ett mönster värt att notera i själva källan. Samma konto publicerade en sammanställning den 20 september som inleddes med fyra modeller som det sades att man "redan såg tester för" — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 och Gemini 4 Pro. Av dessa fyra namn har Opus- och Fable-posterna separat, bekräftad rapportering bakom sig, och Gemini-posten har egna iakttagelser. Sonnet-posten hade en plats i en lista. Fyra dagar senare har Sonnet-påståendet vuxit till ett specifikationsblad, och specifikationsbladet är modellen som redan finns.

De fyra siffrorna är Claude Sonnet 5:s siffror

Det här är delen som tar trettio sekunder att kontrollera och som nästan ingen har gjort. Anthropics översiktssida över modeller, läst idag, listar Claude Sonnet 5 med ett kontextfönster på 1M tokens, 128K maximal utdata och $2 / $10 per miljon tokens. Jämför läckan med det:

• Kontextfönster — 1M tokens uppgivna för Claude Sonnet 5.5; 1M tokens publicerade för Claude Sonnet 5

• Maximal utdata – 128K tokens uppgivna; 128K tokens publicerade

• Indatapris — $2 per miljon begärda; $2 per miljon publicerade

• Utdatapris — $10 per miljon uppgivna; $10 per miljon publicerade

• Modell-ID — inget publicerat för Claude Sonnet 5.5; claude-sonnet-5 för Claude Sonnet 5

• Oberoende poäng — inga för den påstådda modellen; Artificial Analysis placerar Claude Sonnet 5 på ett Intelligence Index på 38 på plats 54 av de 210 modeller den mäter, i konfigurationen för adaptivt resonemang med maximal ansträngning

Two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Sonnet 5 - the scoreboard'. The left column, Claude Sonnet 5.5 (leaked), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID none published; independent scores none. The right column, Claude Sonnet 5 (shipped June 30, 2026), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID claude-sonnet-5; independent scores AA Index 38. The footer reads 'Claude Sonnet 5 figures per Anthropic and Artificial Analysis; Claude Sonnet 5.5 figures unverified, single observer.'

Det finns ett andra lager i prispunkten som läckan har fått om bakfoten. När Claude Sonnet 5 lanserades annonserades $2 / $10 som ett introduktionspris som gällde till och med den 31 augusti 2026, med en planerad höjning till $3 / $15 den 1 september. Den höjningen blev inte av. Anthropics prissida har nu en fotnot som säger att $2 / $10 "nu är standardpriset" och att "den tidigare planerade höjningen till $3 / $15 per miljon input/output-tokens den 1 september 2026 inte kommer att genomföras." Så priset som läckan presenterar som den nya modellens konkurrensvapen är den befintliga modellens permanenta pris — vilket innebär att en Sonnet 5.5 som lanseras till $2 / $10 skulle lanseras utan någon rabatt alls, i ett segment som redan är prissatt mot GPT-6 Sol.

Det enda som Anthropic faktiskt har sagt

Rensar man bort allt från icke namngivna läckare återstår en enda mening från förstapart. När Anthropic lanserade Claude Opus 5.5 den 22 september 2026 uppgav man att Claude Sonnet 5.5 och Claude Haiku 5.5 skulle följa "under de kommande veckorna", med jämförbara förbättringar i prestanda, effektivitet och säkerhet. Den meningen utgör hela det bekräftade underlaget. Den innehåller inget modell-ID, inget kontextfönster, inget pris, ingen benchmark och inget datum — och i synnerhet säger den ingenting om ett smygtest, en grå väg eller testning av något slag.

Resten av Anthropics offentliga yta stämmer med den tolkningen. Modellöversikten listar fortfarande fyra modeller – Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 och Claude Haiku 4.5 – utan någon femte rad, ingen prisuppgift och ingen ”kommande”-markering för en efterföljare till Sonnet. Om en checkpoint på Sonnet-nivå tillhandahölls någonstans där en utvecklare kunde nå den, skulle identifieraren vara det första som dök upp, eftersom en modell som tillhandahålls måste ha ett namn i en begäran. Inget har gjort det.

En sak som tillkännagivandet i september ändå klargjorde: det motsade den tidigare läckan som hävdade att Haiku-linjen skulle läggas ned och att 5.5-generationen skulle strukturera om utbudet. Haiku 5.5 är på väg, enligt Anthropic, vilket innebär att påståendet om omstrukturering var fel i den riktning där läckare sällan har fel – den billiga nivån blir kvar.

Augustiläckan sa 2 miljoner tokens. Den här säger 1 miljon.

Sex veckor före inlägget den 24 september, den 9 augusti, publicerade ett annat X-konto ett specifikationsblad om en "SONNET 5.5 LEAK" med ett mycket djärvare påstående: ett kontextfönster på 2 miljoner tokens, dubbelt så stort som Sonnet 5:s, snabbare inferens, bättre användning av webbläsar- och terminalverktyg, prestanda som närmar sig Claude Fable 5, och en lansering "nästa månad." Läckan kom med en grafik som var utformad för att se ut som ett förhandsvisningskort från Anthropic. Den kom också med en ödesdiger detalj som dess kritiker omedelbart hängde upp sig på: kodnamnet den angav, "Fennec", var kodnamnet som redan hade släppts med Claude Sonnet 5 den 30 juni. Ett kodnamn kan inte vara nya bevis för en efterträdare till modellen som använde det.

Så de två läckvågorna är oense om det enskilt mest citerade numret. Augusti sa 2M kontext. September säger 1M. Båda kan inte beskriva samma build. Den mest sannolika tolkningen är den tråkiga: septemberinlägget beskriver Sonnet-nivåns publicerade gränser, eftersom det är så en modell på Sonnet-nivå ser ut utifrån, och augustiinlägget var en gissning om vad en uppdatering rimligen skulle kunna dubbla. Notera åt vilket håll numret rörde sig – nedåt, mot det som redan finns.

Så är jämförelsen med GPT-6 Sol korrekt?

Mestadels, och stället där det brister är det intressanta. GPT-6 Sol släpptes den 22 september 2026, samma dag som Claude Opus 5.5, och dess listpris börjar på $2 per miljon indata och $10 per miljon utdata – exakt Sonnet 5:s pris och exakt vad läckan påstår för Sonnet 5.5. Den har ett kontextfönster på 1 050 000 tokens med ett utdatatak på 128K, båda en hårsmån från Claude Sonnet 5:s siffror. Det billigare syskonet, GPT-6 Luna, ligger på $0,10 / $0,50.

Det som skiljer är lång kontext. GPT-6 Sol prissätts i två nivåer: $2 / $10 upp till 272 000 indata-tokens, sedan $4 / $15 därutöver. Anthropic gör inte det på Sonnet-linjen – Claude Sonnet 5 debiterar hela 1M-fönstret till standardpriser, så en begäran på 900K tokens kostar samma per token som en på 9K. En riktig Sonnet 5.5 mot en riktig GPT-6 Sol är därför lika i pris för vanliga prompter och en tvåfaldig skillnad för arbetsbelastningar med långa dokument och stora repon, som båda modellerna säljs in för. "Samma prissättning" stämmer i rubriken och är fel vid de arbetsbelastningar där nivån väljs.

Ett andra förbehåll ligger under hela jämförelsen. Claude Sonnet 5 använder Anthropics nyare tokenizer, som producerar ungefär 30 % fler tokens för samma text än den tidigare. Ett pris i rubriken är inte en faktura; fakturan är tokens per uppgift, och det är den siffran som ingen läcka någonsin har innehållit.

Vad skulle få en Sonnet 5.5 att spela roll?

Bortse från huruvida det existerar och fråga vad som skulle förändras för någon som betalar för tokens. Fyra saker, och ingen av dem är ett specifikationsblad.

Det första är ett pris under $2 / $10. Med höjningen den 1 september inställd är den sittande aktörens pris nu permanent – så en efterträdare som behåller samma pris är en sidoförflyttning, och den enda nyheten på Sonnet-nivå som påverkar pengaflödet är en sänkning.

Det andra är kontext över 1M. Det var augustiläckans faktiska påstående, och det är det enda kapacitetsgap som läckan kan nämna som den etablerade aktören ännu inte täcker.

Det tredje är tokens per uppgift. Claude Sonnet 5:s adaptiva tänkande är aktiverat som standard och oberoende analys har uppmätt att det genererar väsentligt fler utdatatokens per uppgift än sin föregångare. En version som behåller priset $2 / $10 och stoppar den inflationen skulle sänka de verkliga kostnaderna mer än en prissänkning i rubrikerna.

Den fjärde är en identifierare. En API-modellsträng, en dokumentationsrad, en prisuppgift, ett modellkort – vilken som helst av dessa avgör saken, och avsaknaden av alla fyra efter en så explicit läcka är i sig det mest talande faktumet i den här historien.

Vad du kan ringa idag

Claude Sonnet 5 är inte en platshållare medan nivån reder ut sig. Det är modellen som merparten av Claude API-trafiken redan körs på, med ett 1M-tokenfönster, 128K utdata och priset $2 / $10 som nu är standard snarare än kampanj.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38 at rank 54 of 210, an output speed of 79.3 tokens per second at rank 77 of 210, a cost of $2.00 per million input tokens and $10.00 per million output tokens with a 90% cache discount and $5.09 cost per Intelligence Index task, a verbosity of 370M output tokens, reasoning enabled, and a 1M token context window

Det har funnits på OrcaRouter sedan juni till Anthropics eget $2 / $10, förmedlat till leverantörens listpris utan påslag, så en ändring av leverantörspriset på Sonnet-linjen skulle vara aktiv här samma dag i stället för vid nästa faktureringscykel. Samma nyckel når redan GPT-6 Sol till $2 / $10, vilket spelar större roll än vanligt i en text som denna: jämförelsen som läckan lutar sig mot är en jämförelse du själv kan köra med en enda autentiseringsuppgift i stället för två avtal.

OrcaRouter model page for anthropic/claude-sonnet-5, attributed to Anthropic and dated 2026-06-30, showing a 1M token context window, 128K maximum output, text plus image and file inputs, an INPUT price of $2.00 per million tokens and an OUTPUT price of $10.00 per million tokens, a p50 time to first token of 5.67 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

Det är också det billigaste sättet att besvara frågan som läckan väcker. Om en Sonnet 5.5 dyker upp kommer den in i katalogen som allt annat, och du dirigerar en del av trafiken till den bakom automatisk failover till Claude Sonnet 5 – ingen ytterligare integration, ingen omförhandling och ingen produktionsväg som hänger på en modell som ingen har benchmarkat oberoende. Att prova en obeprövad nivå är ett routingbeslut, inte ett migreringsprojekt.

Vad du kan se i stället för nästa läckta inlägg

Tre signaler, i fallande ordning efter hur mycket de skulle säga dig. En identifierare är avgörande, eftersom en serverad modell måste ha ett namn i en förfrågan och det är så varje kontrollerbar Anthropic-historia om förhandsläpp 2026 blev kontrollerbar. En leverantörsbekräftelse — ett modellkort, en dokumentationsrad, en prisrad, eller att modellen helt enkelt dyker upp i Anthropics egen lista — avslutar det direkt; meningen "kommande veckor" innebär att en av dessa verkligen är förväntad. En rapport från en testare som beskriver beteende snarare än specifikationer är den svagaste av de tre, och fortfarande mer än vad som finns idag.

Tills en av dem lanseras är den ärliga sammanfattningen att Anthropic har lovat en Sonnet-uppdatering de kommande veckorna, och en observatör har beskrivit den med siffrorna från modellen den ska ersätta. Om din stack redan kör claude-sonnet-5 finns det inget att vänta på och inget att planera kring. Om du väger Claude Sonnet 5 mot GPT-6 Sol är de siffror du kan agera på de som redan har publicerats – och de är samma siffror som läckan försöker sälja till dig som nyheter.

Jämförda i den här artikeln2

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen