
Claude Sonnet 5.2: één lijstvermelding, nul identificatoren — wat er daadwerkelijk bekend is
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Claude Sonnet 5.2 verscheen op het internet als het eerste item in een lijst. Op 20 september plaatste het X-account @kimmonismus een overzicht dat begon met de modellen waarvan het zei dat er "al tests voor werden gezien" — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 en Gemini 4 Pro — en ging daarna verder met de releases die het vervolgens verwachtte. Alles na die eerste naam heeft iets achter zich. Claude Opus 5.2 heeft een week aan berichtgeving over een stil routeringskanaal binnen Claude Code. Claude Fable 5.2 heeft zijn eigen lekthread. Gemini 4 Pro heeft afzonderlijke waarnemingen. Claude Sonnet 5.2 heeft een positie in een lijst. Dat is het volledige openbare record vanmorgen: één tweet, één kop op een aggregator met weinig verificatie, en nergens een identifier, prijs, contextvenster of benchmark. Claude Sonnet 5 — het model dat een 5.2 zou vervangen — is sinds 30 juni algemeen beschikbaar voor $2 per miljoen inputtokens en $10 per miljoen outputtokens, en is het standaardmodel op elk Claude-abonnementsniveau.
Die asymmetrie is het verhaal dat het waard is om op te schrijven, want het is precies datgene wat verloren gaat wanneer een round-up-tweet als een nieuwsfeit wordt gelezen. Een modelnaam die in een lijst voorkomt is niet hetzelfde soort bewering als een modelnaam die naast een model-ID staat, en dat verschil is het hele verschil tussen "er komt een Sonnet-refresh aan" en "iemand heeft het woord Sonnet bij het getal 5.2 gezet."
Wat de 20 september-post eigenlijk zegt
Lees de post aandachtig en de Sonnet-bewering is nog dunner dan de kop doet vermoeden. De lijst is in twee helften verdeeld, en Sonnet 5.2 staat in de eerste — de helft waarin 'al tests te zien zijn' — die de sterkere van de twee beweringen is. De tweede helft is expliciet afgezwakt: 'bevestiging of hints van aanstaande releases', met daarin Grok 4.7, GPT-6-Sol en Kimi K3.1, waarbij de GPT-6-Sol-regel zelfs een eigen voorbehoud bevat dat een grote release die voor dinsdag wordt geteased 'dat zou hem kunnen zijn.'
Dus de auteur is voorzichtig in de ene helft van de post en doet geen enkel voorbehoud in de andere, en Sonnet 5.2 zit in de helft zonder voorbehoud. Geen screenshot, geen API-respons, geen modelstring, geen testerrapport, geen timing. Een lezer die de bewering wil controleren, heeft niets om die aan af te toetsen.
De enige andere plek waar de naam publiekelijk opduikt, is een aggregatorpost van 19 september waarvan de kop luidt: "Fable 5.2, Opus 5.2, Sonnet 5.2 lek." Open het en Sonnet 5.2 verschijnt in de kop en daarna nooit meer in de tekst, waar de drie Claude-namen in één zin over "opmerkelijke vooruitgang" op het hele platform worden samengevoegd. Die post biedt geen bewijs voor geen van de drie, en waarschuwt expliciet dat nepbenchmarks met voorzichtigheid moeten worden behandeld. Twee verschijningen, dezelfde vorm: een naam binnen een groep, zonder dat er individueel iets aan is verbonden.
Wat ontbreekt, is het specifieke, controleerbare artefact dat elk echt Anthropic-lek in 2026 heeft opgeleverd. In augustus had het verhaal van Marshmallow en Melon waarneembaar API-verkeer op een string genaamd claude-marshmallow-ht-eap en schonere varianten daarna. Het Opus 5.2-verhaal van deze maand heeft ontwikkelaars die melden dat de backend-slug achter het label "Opus 5" naar iets nieuws wees. Sonnet 5.2 heeft geen van beide. Als een checkpoint op Sonnet-niveau ergens werd geserveerd waar een ontwikkelaar het kon bereiken, zou de identifier het eerste zijn dat uitlekte, omdat het het moeilijkst te verbergen is — hij moet in een request bestaan.
Het deel van het septemberverhaal dat wordt gestaafd, is geen Sonnet.
Hier zit de valkuil bij het lezen van die round-up. Het gestaafde verhaal over de Anthropic-graytest dat door september liep, is een verhaal van Opus-kaliber. Meerdere nieuwsmedia, in het Chinees en Engels, meldden dat Anthropic stilletjes een fractie van de verzoeken doorgaf aan een niet-uitgebracht checkpoint onder het Opus 5-label — een stille graytest die ontwikkelaars opmerkten aan veranderd gedrag, niet aan veranderde namen. Berichtgeving in de nacht van 17 september beschreef dat het kanaal zonder kennisgeving werd afgesloten en ongeveer een dag later werd hersteld, waarna het naar verluidt was uitgebreid van Claude Code naar de chat- en cowork-oppervlakken. De naam die in de berichtgeving aan dat checkpoint wordt gegeven, is Claude Opus 5.2.
Sonnet 5.2 erft de geloofwaardigheid van die berichtgeving zonder enig bewijs ervan over te nemen. Dat is een specifieke en veelvoorkomende faalmodus in lekverslaggeving: de ene tier wordt gedocumenteerd, de tweede tier wordt in één adem genoemd, en de tweede naam circuleert vervolgens alsof er ook over gerapporteerd is. Dat is niet gebeurd. Als je op zoek gaat naar een routeringsrapport voor de Sonnet-tier, vind je dat van Opus en een lijst.
Er loopt onder dit alles een aparte, beter onderbouwde lijn — de zakelijke berichtgeving dat Anthropic zijn beursnotering naar november heeft doorgeschoven en, volgens Reuters op basis van drie bronnen, overweegt of het daarvoor een nieuw model moet uitbrengen als antwoord op GPT-6 Astra. Die berichtgeving is echt en relevant. Opvallend is ook dat ze zwijgt over in welk segment het model zou vallen. Een workhorse-refresh en een flagship-lancering zijn heel verschillende zetten voorafgaand aan een IPO, en niets dat tot nu toe is gepubliceerd zegt welke van de twee wordt overwogen.
Vorige maand noemde de community een Sonnet die nooit is uitgebracht.
Het sterkste argument voor scepsis over "Sonnet 5.2" is niet dat de bewering zwak is. Het is dat dit exacte naamgevingspatroon een maand geleden, in het openbaar, faalde en dat die mislukking gedocumenteerd is.
Eind augustus deden twee early-access-identifiers de ronde: claude-marshmallow-eap en claude-melon-eap. Geen van beide strings bevat de woorden Opus, Sonnet of een versienummer. Op 24 augustus werden van buitenaf productnamen aan hen toegekend door posts op sociale media en geruchtenblogs — Marshmallow werd "Opus 5.1", Melon werd "Sonnet 5.1" — op basis van de indrukken van testers dat Marshmallow sterker aanvoelde dan Melon en sterker dan de toenmalige Opus 5. Een ontwikkelaar die onderzoek deed, ontdekte naar verluidt dat de kale strings geen verifieerbare first-party-output opleverden, waardoor het eerdere verkeer het enige waarneembare bewijs bleef.
Geen van beide namen werd uitgebracht. De volgende Anthropic-release in dat venster was Claude Fable 5.1, op 1 september — een heel andere tier, onder een naam die niemand aan een van beide identifiers had toegewezen. Het label "Sonnet 5.1" was een gevolgtrekking uit de gemeenschap die verhardde tot een gerucht en vervolgens verdampte.
Die geschiedenis is hier om een reden van belang die verder reikt dan algemene voorzichtigheid. Het betekent dat de Sonnet-tier nu twee keer in twee maanden in lekken is genoemd, zonder dat er beide keren ook maar één tierspecifiek artefact was. Het betekent ook dat de sterkste prior — de werkelijke cadans van Anthropic in 2026 — wijst op een andere vorm: Opus 5 eind juli, Fable 5.1 begin september, en een Opus 5.2-grijstest medio september. De Sonnet-tier is sinds 30 juni niet meer opgeschoven, wat precies is waarom een Sonnet-gerucht plausibel is en precies waarom het ong everifieerd is. Een lange tussenpoos is een reden om iets te verwachten, niet het bewijs dat een specifiek iets bestaat.
Wat je vandaag daadwerkelijk kunt uitvoeren
Claude Sonnet 5 is geen tijdelijke oplossing terwijl je wacht. Het is het model waarop het grootste deel van het Claude-verkeer al draait, en de cijfers ervan zijn concreet op een manier waarop niets in het gerucht over 5.2 dat is.

• Model-id — claude-sonnet-5, nu aanroepbaar; Claude Sonnet 5.2 heeft geen enkele gepubliceerde identificatie
• Prijs — $2 per miljoen inputtokens en $10 per miljoen outputtokens, op 10 augustus permanent gemaakt; het geplande standaardtarief van $3 / $15 geldt niet meer. Over de prijsstelling van 5.2 is niets bekend, omdat er niets te weten valt.
• Context — een 1M-tokenvenster met een maximale output van 128K. Het eigen bericht van Anthropic vermeldt het venster niet op de lanceringspagina; de herziene tokenizer is het detail dat het wel noemt, en dat is belangrijker dan het klinkt: identieke invoer kan, afhankelijk van het inhoudstype, worden omgezet in ongeveer 1,0–1,35× zoveel tokens.
• Door de leverancier gerapporteerde benchmarks — SWE-bench Pro 63,2%, Terminal-Bench 2.1 op 80,4–80,5%, Humanity's Last Exam 43,2% zonder tools en 57,4% met tools, OSWorld-Verified 81,2%, GDPval-AA v2 op 1.618. Dit zijn cijfers van Anthropic, hier niet gereproduceerd
• Onafhankelijk — Artificial Analysis plaatst Claude Sonnet 5 op een Intelligence Index van 32 in de configuratie met adaptief redeneren en maximale inspanning, ruim boven de mediaan van 24 voor zijn prijsklasse, en op 29 in de configuratie zonder redeneren met hoge inspanning
• De kostenkanttekening die elk versienummer overleeft — de tokenprijzen van Anthropic bleven gelijk, maar uit onafhankelijke analyse van de Intelligence Index bleek dat Sonnet 5 ongeveer 30–40% meer outputtokens per taak verbruikt dan zijn voorganger, omdat adaptive thinking standaard is ingeschakeld. De stickerprijs is niet de rekening.
Dat laatste punt is wat je moet meenemen in elke discussie over 5.2. Als er een Sonnet-refresh komt, is het interessante getal niet het tarief per miljoen. Het gaat om tokens per taak, en of een nieuw standaard inspanningsniveau het stilletjes weer verhoogt.
Wat een Sonnet 5.2 zou moeten veranderen om ertoe te doen
Laat buiten beschouwing of het bestaat. De nuttigere vraag is wat het de moeite waard zou maken om erop over te stappen, want dat bepaalt waar je op moet letten — en niets daarvan is "een uitgebrachte Sonnet-refresh."

Een betekenisvolle Sonnet 5.2 zou minstens één van vier dingen moeten veranderen. Het eerste zijn tokens per taak: een versie die het tarief van $2 / $10 aanhoudt maar de inflatie van 30–40% in output-tokens stopt, zou de werkelijke rekeningen meer verlagen dan een opvallende prijsverlaging zou doen. Het tweede is de agentische kloof met het niveau daarboven — Sonnet 5 werd gepositioneerd als ruwweg negen tiende van de weg naar het vorige vlaggenschip op agentisch werk tegen een fractie van de kosten, en die verhouding is wat het de standaard maakt. Het derde is het gedrag bij lange context dat de herziene tokenizer moeilijker te doorgronden maakte. Het vierde, en het minst waarschijnlijke om te worden aangekondigd, is of een 5.2 überhaupt als Sonnet verschijnt — de laatste keer dat de gemeenschap vol vertrouwen een Sonnet-opvolger benoemde, was het model dat werd uitgebracht een Fable.
Wat geen nieuws zou zijn: een checkpoint dat opduikt in een eval-harness, een codenaam die opduikt in een framework-repository, of weer een round-up-tweet. Geen daarvan verandert wat je kunt aanroepen, wat het kost of wat het scoort.
Hoe je gepositioneerd kunt zijn zonder erop te wedden
Het praktische probleem met een niet-geverifieerde tier-refresh is niet dat je die zou kunnen missen. Het is dat voorbereiding erop meestal werk betekent waar je een hekel aan zou hebben als je het twee keer moest doen — een tweede leverancierscontract, een tweede SDK-integratie, een tweede set sleutels en limieten en facturen.
Dat is het deel dat nu beter verwijderd kan worden dan later. Claude Sonnet 5 staat sinds juni op OrcaRouter tegen Anthropics eigen $2 / $10, doorgegeven tegen de lijstprijs van de provider zonder markup, dus een prijswijziging van de leverancier op de Sonnet-lijn zou hier dezelfde dag live zijn in plaats van bij de volgende factureringscyclus.

Dezelfde sleutel bereikt al de rest van de huidige Claude-line-up en de ruim 200 andere modellen op het platform, wat betekent dat een 5.2 die arriveert geen integratieproject start — hij verschijnt in de catalogus, en je stuurt een deel van het verkeer erheen achter een fallback naar Claude Sonnet 5, terwijl je uitzoekt of de rekensom van tokens-per-taak daadwerkelijk klopt voor jouw workload. Automatische failover is wat dat veilig maakt om te doen met een model dat nog niemand onafhankelijk heeft gebenchmarkt.
Voor iedereen van wie de stack al draait op claude-sonnet-5, is het eerlijke antwoord op "Moet ik wachten op Claude Sonnet 5.2" nee — er valt niets te wachten, geen datum, en geen reden om aan te nemen dat het huidige model binnenkort niet meer de juiste standaardkeuze is. Wat je moet doen, is de overstap goedkoop maken, niet om die vroeg te maken.
Wat zou dit oplossen?
Drie dingen, in aflopende volgorde van hoeveel ze je zouden vertellen. Een API-identifier zou beslissend zijn, want een model dat wordt geserveerd moet een naam hebben in een request, en zo werd het verhaal van Marshmallow en Melon controleerbaar en werden de routeringsrapporten van Opus 5.2 controleerbaar. Een bevestiging van de leverancier — een modelkaart, een documentatiepagina, een regel in een changelog — zou de discussie meteen beslechten. Een testersrapport voor een specifieke tier, met een beschrijving van gedrag in plaats van een naam, zou het zwakste van de drie zijn en nog steeds meer dan wat er vandaag bestaat.
Totdat een van die verschijnt, is Claude Sonnet 5.2 een naam in een lijst. Zie het als een aanleiding om te controleren of je stack een Sonnet-refresh goedkoop kan opvangen, en niet als een reden om daarop te plannen.
