Hero-kaart voor Claude Sonnet 5.5 met als kop 'Een stealthtest, of de prijslijst die je al hebt', met drie pillen met de teksten 'niet uitgebracht', 'geen model-ID gepubliceerd' en 'aangekondigd: komende weken', een voettekst die verwijst naar een X-post van 24 september 2026 en de Opus 5.5-lanceringspost van Anthropic van 22 september 2026, en het OrcaRouter-logo rechtsonder
Guides & Insights

Claude Sonnet 5.5: Een stealth-testlek opgebouwd uit vier getallen die al bestaan

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Vier getallen werden op 24 september op X geplaatst als bewijs dat Claude Sonnet 5.5 "al in het geheim wordt getest": een contextvenster van 1M tokens, een maximale output van 128K tokens, $2 per miljoen inputtokens en $10 per miljoen outputtokens. Alle vier staan op dit moment op Anthropics eigen prijslijst, gekoppeld aan Claude Sonnet 5 — het model dat een 5.5 zou vervangen, algemeen beschikbaar sinds 30 juni 2026. Dezelfde $2 / $10-prijs geldt ook voor GPT-6 Sol, die OpenAI op 22 september uitbracht, en die overlap zorgt ervoor dat de post wordt gelezen als een antwoord aan OpenAI in plaats van een routineuze tier-refresh: "Dit leest voor mij als een directe reactie op GPT-6-Sol. Dezelfde prijsstelling en vermoedelijk vergelijkbare p[restatie]."

Niets daarvan maakt de bewering onjuist. Het maakt de bewering onfalsifieerbaar, wat een ander en nuttiger probleem is om op te schrijven. Een waarneming in een stealthtest is slechts zo goed als het artefact erachter, en het artefact achter deze is een specificatieblad dat niet te onderscheiden valt van het model dat Anthropic al twaalf weken levert.

Wat er daadwerkelijk is gepost

De bron is een enkele X-post van het account @kimmonismus, gedateerd 24 september 2026. Erin staan het contextvenster, het outputplafond en de twee prijzen, wordt de prijsstelling vergeleken met GPT-6 Sol, en wordt geconcludeerd dat Sonnet 5.5 wordt getest. Er is geen schermafbeelding, geen modelstring, geen API-respons, geen console-uitdraai, geen beschrijving van gedrag door testers, en geen tweede waarnemer die aan een van die onderdelen is verbonden. De post is een bewering met cijfers erin, en de cijfers zijn de openbare limieten van de tier.

Dat is het waard om te onderscheiden van het andere soort Anthropic pre-releaseverhaal, want 2026 heeft beide voortgebracht en ze lijken in niets op elkaar. De early-access-identificaties van augustus claude-marshmallow-eap en claude-melon-eap waren strings die in requests voorkwamen — lelijk, onglamoureus en controleerbaar. Het Opus 5.2-verhaal dat door september loopt, is een routeringsrapport: ontwikkelaars die opmerken dat de backend achter het label "Opus 5" anders antwoordde, en het gedrag beschrijven. Beide zijn artefacten. "Already being stealth tested" zonder bijgevoegd artefact is een samenvatting van wat de Sonnet-tier al verkoopt.

Er is ook een patroon dat het vermelden waard is in de bron zelf. Hetzelfde account plaatste op 20 september een round-up die opende met vier modellen waarvan het zei dat ze "al tests zagen" — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 en Gemini 4 Pro. Van die vier namen hebben de Opus- en Fable-vermeldingen afzonderlijke, bevestigde berichtgeving achter zich, en de Gemini-vermelding heeft eigen waarnemingen. De Sonnet-vermelding had een positie in een lijst. Vier dagen later is er rond de Sonnet-bewering een specsheet gegroeid, en dat specsheet is het model dat al bestaat.

De vier getallen zijn de getallen van Claude Sonnet 5.

Dit is het onderdeel dat dertig seconden kost om te controleren, en bijna niemand doet het. De modellenoverzichtspagina van Anthropic, vandaag gelezen, vermeldt Claude Sonnet 5 met een contextvenster van 1M tokens, een maximale uitvoer van 128K en $2 / $10 per miljoen tokens. Vergelijk het lek hiermee:

• Contextvenster — 1M tokens geclaimd voor Claude Sonnet 5.5; 1M tokens gepubliceerd voor Claude Sonnet 5

• Maximale uitvoer — 128K tokens geclaimd; 128K tokens gepubliceerd

• Invoerprijs — $2 per miljoen geclaimd; $2 per miljoen gepubliceerd

• Prijs voor output — $10 per miljoen geclaimd; $10 per miljoen gepubliceerd

• Model-ID — niets gepubliceerd voor Claude Sonnet 5.5; claude-sonnet-5 voor Claude Sonnet 5

• Onafhankelijke scores — geen enkele voor het geclaimde model; Artificial Analysis plaatst Claude Sonnet 5 op een Intelligence Index van 38, op de 54e plaats van de 210 modellen die het meet, in de configuratie voor adaptief redeneren met maximale inspanning

Two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Sonnet 5 - the scoreboard'. The left column, Claude Sonnet 5.5 (leaked), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID none published; independent scores none. The right column, Claude Sonnet 5 (shipped June 30, 2026), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID claude-sonnet-5; independent scores AA Index 38. The footer reads 'Claude Sonnet 5 figures per Anthropic and Artificial Analysis; Claude Sonnet 5.5 figures unverified, single observer.'

Er is een tweede laag aan het prijspunt die het lek verkeerd voorstelt. Toen Claude Sonnet 5 werd gelanceerd, werd $2 / $10 aangekondigd als introductieprijs die tot en met 31 augustus 2026 zou lopen, met een geplande verhoging naar $3 / $15 op 1 september. Die verhoging is niet doorgegaan. De prijzenpagina van Anthropic bevat nu een voetnoot die stelt dat $2 / $10 "nu de standaardprijs is" en dat "de eerder geplande verhoging naar $3 / $15 per miljoen input-/outputtokens op 1 september 2026 niet zal plaatsvinden." De prijs die het lek als concurrentiewapen van het nieuwe model presenteert, is dus het permanente tarief van de gevestigde partij — wat betekent dat een Sonnet 5.5 die tegen $2 / $10 wordt gelanceerd, zonder enige korting zou lanceren, in een segment dat al is geprijsd ten opzichte van GPT-6 Sol.

Het enige wat Anthropic daadwerkelijk heeft gezegd

Schrap alles wat van naamloze lekkenbronnen komt, en één officiële zin blijft over. Toen Anthropic op 22 september 2026 Claude Opus 5.5 lanceerde, zei het bedrijf dat Claude Sonnet 5.5 en Claude Haiku 5.5 "in de komende weken" zouden volgen, met vergelijkbare verbeteringen op het gebied van prestaties, efficiëntie en veiligheid. Die zin is het volledige bevestigde record. Er staat geen model-ID in, geen contextvenster, geen prijs, geen benchmark en geen datum — en in het bijzonder staat er niets in over een stealthtest, een grijze route of welke vorm van testen dan ook.

De rest van het publieke oppervlak van Anthropic stemt overeen met die lezing. Het modellenoverzicht vermeldt nog steeds vier modellen — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 en Claude Haiku 4.5 — zonder een vijfde rij, zonder prijsvermelding en zonder een 'aanstaande'-markering voor een opvolger van Sonnet. Als een checkpoint uit de Sonnet-klasse ergens werd aangeboden op een plek die een ontwikkelaar kon bereiken, zou de identifier het eerste zijn dat opduikt, omdat een aangeboden model een naam in een request moet hebben. Niets daarvan.

Eén ding beslechtte de septemberaankondiging wel: ze sprak het eerdere lek tegen waarin werd beweerd dat de Haiku-lijn zou worden stopgezet en dat de 5.5-generatie de line-up zou herstructureren. Haiku 5.5 komt eraan, volgens Anthropic, wat betekent dat het verhaal over herstructurering fout zat in de richting waarin lekkenaars zelden fout zitten — het goedkope segment blijft.

Het augustuslek zei 2 miljoen tokens. Dit zegt 1 miljoen.

Zes weken voor het bericht van 24 september, op 9 augustus, plaatste een ander X-account een "SONNET 5.5 LEAK"-specsheet met een veel gewaagdere bewering: een contextvenster van 2 miljoen tokens, twee keer zo groot als dat van Sonnet 5, snellere inferentie, beter gebruik van browser- en terminaltools, prestaties die die van Claude Fable 5 naderen, en een release "volgende maand". Bij die leak zat een afbeelding die was opgemaakt om op een Anthropic-previewkaart te lijken. Er zat ook een fataal detail bij waar critici zich onmiddellijk op stortten: de codenaam die erin stond, "Fennec", was de codenaam die al op 30 juni met Claude Sonnet 5 was uitgebracht. Een codenaam kan geen nieuw bewijs zijn voor een opvolger van het model dat die gebruikte.

Dus de twee lekgolven zijn het oneens over het meest aangehaalde getal. Augustus zei 2M context. September zegt 1M. Beide kunnen niet dezelfde build beschrijven. De meest waarschijnlijke lezing is de saaie: de septemberpost beschrijft de gepubliceerde limieten van de Sonnet-tier, omdat dat is hoe een Sonnet-tier-model er van buitenaf uitziet, en de augustuspost was een gok naar wat een refresh waarschijnlijk zou verdubbelen. Let op in welke richting het getal bewoog — omlaag, naar wat al bestaat.

Dus klopt de GPT-6 Sol-vergelijking?

Grotendeels, en het punt waarop het misgaat is het interessante deel. GPT-6 Sol werd op 22 september 2026 uitgebracht, dezelfde dag als Claude Opus 5.5, en de lijstprijs begint bij $2 per miljoen input en $10 per miljoen output — precies het tarief van Sonnet 5 en precies wat de gelekte informatie voor Sonnet 5.5 claimt. Het biedt een contextvenster van 1.050.000 tokens met een uitvoerplafond van 128K, die beide een tikje afwijken van de cijfers van Claude Sonnet 5. Het goedkopere broertje, GPT-6 Luna, zit op $0,10 / $0,50.

Het verschil zit in lange context. GPT-6 Sol rekent in twee tariefniveaus: $2 / $10 tot 272.000 invoertokens, daarna $4 / $15 daarboven. Anthropic doet dat niet in de Sonnet-lijn — Claude Sonnet 5 factureert het volledige 1M-venster tegen standaardtarieven, dus een verzoek van 900K tokens kost per token hetzelfde als een van 9K. Een echte Sonnet 5.5 tegenover een echte GPT-6 Sol is daarom een gelijke prijs voor gewone prompts en een factor twee verschil voor de workloads met lange documenten en grote repo's waarop beide modellen worden verkocht. "Dezelfde prijs" klopt in de headline, maar is onjuist bij de workloads waarin het tariefniveau wordt gekozen.

Onder de hele vergelijking schuilt een tweede voorbehoud. Claude Sonnet 5 gebruikt de nieuwere tokenizer van Anthropic, die voor dezelfde tekst ongeveer 30% meer tokens produceert dan de vorige. Een tarief in de kop is geen rekening; de rekening is tokens per taak, en dat is het aantal dat in geen enkel lek ooit is genoemd.

Wat zou ervoor zorgen dat een Sonnet 5.5 ertoe doet?

Laat buiten beschouwing of het bestaat en vraag wat er zou veranderen voor iemand die voor tokens betaalt. Vier dingen, en geen ervan is een specblad.

Het eerste is een prijs onder $2 / $10. Nu de verhoging van 1 september is geannuleerd, is het tarief van de zittende aanbieder nu permanent — dus een opvolger die hetzelfde tarief aanhoudt, is een laterale zet, en het enige nieuws in de Sonnet-klasse dat geld in beweging brengt, is een verlaging.

Het tweede is context voorbij 1M. Dat was de eigenlijke propositie van de augustus-leak, en het is de enige capaciteitskloof die de leak kan noemen en die de gevestigde speler nog niet dekt.

Het derde punt is tokens per taak. Het adaptieve denken van Claude Sonnet 5 staat standaard aan en uit onafhankelijke analyse is gebleken dat het aanzienlijk meer outputtokens per taak genereert dan zijn voorganger. Een versie die het tarief van $2 / $10 aanhoudt en die inflatie stopt, zou de werkelijke rekeningen sterker verlagen dan een prijsverlaging die de krantenkoppen haalt.

Het vierde is een identificator. Een API-modelstring, een documentatieregel, een prijsvermelding, een modelkaart — elk daarvan beslecht de discussie, en het ontbreken van alle vier na een lek dat zo expliciet is, is op zichzelf het veelzeggendste feit in dit verhaal.

Wat je vandaag kunt bellen

Claude Sonnet 5 is geen tijdelijke oplossing terwijl de tier zichzelf uitkristalliseert. Het is het model waarop het grootste deel van het Claude API-verkeer al draait, met een contextvenster van 1M tokens, 128K output en het tarief van $2 / $10 dat inmiddels standaard is in plaats van promotioneel.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38 at rank 54 of 210, an output speed of 79.3 tokens per second at rank 77 of 210, a cost of $2.00 per million input tokens and $10.00 per million output tokens with a 90% cache discount and $5.09 cost per Intelligence Index task, a verbosity of 370M output tokens, reasoning enabled, and a 1M token context window

Het staat sinds juni op OrcaRouter tegen Anthropics eigen $2 / $10, doorgegeven tegen de leverancierslijstprijs zonder opslag, dus een prijswijziging van de leverancier op de Sonnet-lijn zou hier dezelfde dag live zijn in plaats van bij de volgende factureringscyclus. Dezelfde sleutel bereikt al GPT-6 Sol tegen $2 / $10, wat in een stuk als dit meer dan gebruikelijk van belang is: de vergelijking waarop het lek leunt, is een vergelijking die je zelf kunt uitvoeren met één credential in plaats van twee contracten.

OrcaRouter model page for anthropic/claude-sonnet-5, attributed to Anthropic and dated 2026-06-30, showing a 1M token context window, 128K maximum output, text plus image and file inputs, an INPUT price of $2.00 per million tokens and an OUTPUT price of $10.00 per million tokens, a p50 time to first token of 5.67 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

Dat is ook de goedkoopste manier om de vraag te beantwoorden die het lek oproept. Als er daadwerkelijk een Sonnet 5.5 verschijnt, komt die net als al het andere in de catalogus, en leid je een deel van het verkeer erheen achter automatische failover naar Claude Sonnet 5 — geen tweede integratie, geen heronderhandeling, en geen productiepad dat afhankelijk is van een model dat niemand onafhankelijk heeft gebenchmarkt. Het uitproberen van een onbewezen tier is een routeringsbeslissing, geen migratieproject.

Wat je kunt kijken in plaats van de volgende leak-post

Drie signalen, in aflopende volgorde van hoeveel ze je zouden vertellen. Een identificatie is beslissend, omdat een geserveerd model een naam moet hebben in een verzoek en dat is hoe elk controleerbaar Anthropic pre-releaseverhaal in 2026 controleerbaar werd. Een erkenning door de leverancier — een modelkaart, een documentatieregel, een prijsregel, of het model dat simpelweg in Anthropics eigen lijst verschijnt — maakt er definitief een einde aan; de "komende weken"-zin betekent dat een van die dingen echt verschuldigd is. Een testerrapport dat gedrag beschrijft in plaats van specificaties is de zwakste van de drie, en nog steeds meer dan wat er vandaag bestaat.

Totdat een van die dingen er is, is de eerlijke samenvatting dat Anthropic een Sonnet-refresh heeft beloofd voor de komende weken, en een waarnemer heeft die beschreven met de cijfers van het model dat het zal vervangen. Als je stack al claude-sonnet-5 draait, valt er niets af te wachten en is er niets om rekening mee te houden. Als je Claude Sonnet 5 afweegt tegen GPT-6 Sol, zijn de cijfers waarop je kunt handelen de cijfers die al gepubliceerd zijn — en het zijn dezelfde cijfers die het lek je als nieuws probeert te verkopen.

Vergeleken in dit artikel2

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt