
Claude Opus 5.5 lek: Een checkpoint genaamd "claude-wafer-eap" en een vermoedelijke dinsdagrelease
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
De claim die dit weekend de ronde doet is specifiek genoeg om te controleren en dun genoeg om onder de controle uit elkaar te vallen: een nieuw checkpoint voor de volgende Opus-update, nu gelabeld Claude Opus 5.5, zou volgens berichten al in handen zijn, met een interne codenaam — "claude-wafer-eap" — en een release die al op dinsdag 22 september zou kunnen verschijnen. De bron is het X-account @kimmonismus dat een lek genaamd Lyra doorgeeft. Er is geen modelkaart, geen API-identifier, geen prijslijst, geen benchmark, en geen tweede medium dat dezelfde checkpoint-string meldt. Wat er wel is, onder de claim, is een echte en goed gedocumenteerde gebeurtenis: Claude Opus 5.2, de niet-uitgebrachte Opus-build die tot medio september aan een deel van het verkeer werd geserveerd onder een ongewijzigd "Opus 5"-label, en die de leverancier in de nacht van 17 september kortstondig afsneed. Dat deel wordt door meerdere media bevestigd. Alles daarboven is het woord van één account. En er is een derde ding dat het opmerken waard is, namelijk wat het lek doet met het versienummer zelf: Claude Opus 5 werd op 24 juli uitgebracht voor $5,00/$25,00 per miljoen tokens en is nog steeds de beste algemeen beschikbare Opus van de leverancier; Claude Fable 5.1 kwam op 1 september. Als de volgende Opus echt 5.5 is, dan is de naamgeving voorbij 5.3 en 5.4 gesprongen — en het nummer doet in dit verhaal meer werk dan welke benchmark dan ook.
Wat het lek daadwerkelijk beweert
Haal de verpakking eraf en er zijn vier beweringen. Ten eerste dat er een checkpoint bestaat — een model dat is getraind, opgeslagen en ergens wordt klaargezet. Ten tweede dat het versienummer 5.5 is, niet 5.2 of 5.3. Ten derde dat het een codenaam draagt, "claude-wafer-eap", waarbij "eap" in de gebruikelijke leveranciersafkorting staat voor early-accessprogramma. Ten vierde dat de release op handen is, mogelijk dinsdag.
Elk daarvan is een ander soort bewering, en ze zijn niet even goed onderbouwd. De vierde is degene met extern bewijs erachter, en dat bewijs wijst naar een datum, niet naar een codenaam. Voorspellingsmarkten over de volgende release van Claude Opus openden op 16 september en hadden het grootste deel van hun impliciete waarschijnlijkheid geconcentreerd rond 21 tot en met 24 september, terwijl een aanzienlijk deel van het volume nog steeds inzette op "geen release voor 30 september." De resolutieregels van de markt zijn strikt: het model moet publiek toegankelijk zijn, en het moet expliciet Opus genoemd worden. Releases van Fable, Mythos, Sonnet en Haiku tellen niet mee. "Claude Opus 5.5" komt voor in de eigen lijst met in aanmerking komende namen van die markt — wat de meest plausibele plek is waar de tekenreeks in omloop is gekomen, en dat is een lijst met mogelijkheden, niet een melding van een waarneming.
De codenaam is de zwakste schakel. "claude-wafer-eap" staat in de signaaltekst en, voor zover wij kunnen vaststellen, nergens anders: geen repository-referentie, geen API-slug, geen configuratielek, geen bevestigend verslag. Codenamen zijn precies het soort detail dat zich verspreidt omdat het verifieerbaar klinkt. Behandel deze als ongverifieerd totdat een tweede, onafhankelijke bron dezelfde tekenreeks oplevert. Hetzelfde geldt voor de toeschrijving aan "Lyra" — een leaker-handle zonder staat van dienst waaraan we die kunnen toetsen.
Wat daadwerkelijk wordt geverifieerd
De geverifieerde basislijn is Claude Opus 5, en het is ongewoon goed gedocumenteerd, wat het nuttig maakt als meetlat. Anthropic bracht het uit op 24 juli 2026 — geen 5.1 daartussen — met een contextvenster van 1M tokens, tot 128K outputtokens (300K via een bètaheader op de Batch API), adaptief denken standaard ingeschakeld, en vijf niveaus van redeneerinspanning, van laag tot max. De prijs is vast: $5,00 per miljoen inputtokens en $25,00 per miljoen outputtokens, ongeacht de promptlengte, hetzelfde als bij Opus 4.8 daarvoor, waarbij de Batch API de helft daarvan kost. Artificial Analysis plaatst het bovenaan in de eigen Intelligence Index, waarbij de exacte score afhangt van welke variant van redeneerinspanning je bekijkt — een detail dat je moet onthouden, want een "5.5"-scorebord is niet vergelijkbaar met een "5"-scorebord, tenzij de instelling voor redeneerinspanning overeenkomt.

Daarbovenop komt de bevestigde gebeurtenis van september. Van ongeveer 14 tot 15 september meldden ontwikkelaars dat een klein, probabilistisch deel van de verzoeken die nominaal aan Opus 5 waren gericht, door een ander backend-model werd beantwoord, waarbij de requestmetadata wezen op een niet-uitgebrachte claude-opus-5.2 — een versienummer dat 5.1 volledig overslaat. Gerapporteerd gedrag was onder meer beknoptere output en ongevraagde zelfiteratie: code schrijven, tests uitvoeren, fouten oplossen, herhalen tot de tests slagen, in plaats van half afgerond stoppen. De detectietruc die daarnaast de ronde deed — het model een specifieke vraag stellen over een persoon dat het niet zou mogen kennen, met zoeken en geheugen uitgeschakeld — was een manier om te achterhalen welke backend antwoordde. In de nacht van 17 september kapte Anthropic het kanaal zonder waarschuwing af, een gebeurtenis die de ontwikkelaarsgemeenschap de "midnight shock" noemde; ongeveer een dag later kwam het kanaal terug en, volgens die berichten, breidde het zich uit van Claude Code naar de chat- en cowork-oppervlakken. Geen modelcard, geen prijstabel, geen API-identifier en geen officiële verklaring vergezelde iets daarvan.
Het versienummer is het verhaal
Dit is het deel waarin het lek structureel gelijk heeft, ook al klopt elk specifiek detail niet. Anthropic heeft dit jaar al twee keer laten zien dat het de Opus-tier zal itereren zonder lanceerevenement — 4.8 eind mei, 5 op 24 juli met 5.1 overgeslagen, en daarna een 5.2 die in productie bestond zonder publiekelijk te bestaan. Een leverancier die via backend-routing uitlevert en de uitrolratio beheerst, kan op het laatste moment ook beslissen welk nummer er op de doos wordt gedrukt. Als de volgende Opus als 5.5 wordt aangekondigd in plaats van 5.2, dan is dat een marketingbeslissing die na het technische werk is genomen, en het is het soort beslissing waar een lekende bron laat en onnauwkeurig over hoort.
Dat snijdt aan twee kanten voor iedereen die dit leest. Een uitgelekt versienummer is zwak bewijs over capaciteiten en sterk bewijs over positionering. Als het nummer echt 5.5 is, impliceert het een grotere stap dan 5.2 zou zijn geweest — en het impliceert dat Anthropic wil dat de markt het zo leest, vooruitlopend op een beursgang die het bedrijf naar verluidt richting november heeft opgeschoven. Reuters meldde op 18 september, onder verwijzing naar drie bronnen, dat Anthropic overweegt een nieuw model uit te brengen specifiek om een antwoord te bieden op het zakelijke momentum van GPT-6 Astra, terwijl zijn CEO de sector publiekelijk oproept om vaart te minderen. Een groter nummer op hetzelfde checkpoint kost niets en levert een krantenkop op. Dat is geen reden om de lek niet te geloven; het is een reden om het nummer niet in een beslissing te verdisconteren.
Wat zou er dinsdag waar moeten zijn
Een release op 22 september zou in ongeveer vijf minuten controleerbaar zijn, en het is de moeite waard de controles nu te benoemen, zodat de aankondiging — als die komt — gelezen kan worden in plaats van te worden geabsorbeerd.
• Beschikbaarheid — een openbare modelkaart, een API-model-id dat completions retourneert, of een open, doorlopende wachtlijst. Een gesloten bèta komt niet in aanmerking, en voorspellingsmarkten lossen het doorgaans negatief af. Dit is de scheidslijn tussen "uitgebracht" en "op enkele accounts getest."
• Prijsstelling — of de nieuwe Opus de prijsklasse van $5.00/$25.00 aanhoudt, verschuift of met een promotietarief komt. Opus 5 hield exact de prijs van Opus 4.8 aan, wat het te verwachten patroon is en dus het punt om te controleren.
• Context- en outputlimieten — de 1M-context en 128K-output van Opus 5 (300K bij Batch) zijn het huidige minimum. Een nieuwe Opus die met minder zou komen, zou een downgrade zijn die zich voordoet als een lancering.
• Onafhankelijke scoring — een Artificial Analysis-vermelding op een opgegeven inspanningsniveau, geen grafiek van een leverancier. Elke capaciteitsclaim in de leak is momenteel niet gereproduceerd, en een model card alleen zal daar niets aan veranderen.
• Het routeringsgedrag — of het beknopte, zelfitererende gedrag dat in de gray-testverslagen wordt gemeld nog steeds in de publieke build zit, of dat het een testartefact was. Die gedragsverandering is het meest concrete dat ontwikkelaars daadwerkelijk hebben waargenomen, en het is hetgene dat voor de release het waarschijnlijkst stilletjes wordt weggetuned.

Een onbewezen Claude uitproberen zonder er een productiepad op in te zetten
Het ongemakkelijke gat in een week als deze is dat het model dat iedereen wil evalueren, het model is dat niemand kan aanroepen. Wat je vandaag kunt aanroepen is Claude Opus 5 — en als er een 5.5 verschijnt, wordt de praktische vraag hoe je een deel van het echte verkeer daarop kunt richten zonder je integratie te herschrijven of een kritiek pad toe te vertrouwen aan een model zonder onafhankelijke benchmarks.
Dat is precies het geval waarvoor routing is gebouwd. OrcaRouter zet de huidige Claude-line-up achter één API-sleutel tegen de lijstprijs van de provider, met 0% markup — Claude Opus 5 tegen Anthropic's eigen $5,00/$25,00, dezelfde cijfers die de leverancier publiceert, zodat een prijswijziging van de leverancier dezelfde dag nog bij ons live staat in plaats van pas na een synchronisatie. Wanneer er een nieuwe Opus verschijnt, is dat één route extra in plaats van een tweede contract: je kunt een percentage van het verkeer erheen sturen, automatische failover gericht houden op een model dat je al hebt gekarakteriseerd, en outputs vergelijken op je eigen prompts in plaats van op een gelekte benchmark. Een call opbouwen over meerdere modellen — een concept van het ene, een verificatieronde van het andere — is een regel in de routing-DSL in plaats van een nieuwe service.

Om expliciet te zijn over wat we niet zeggen: er is geen Claude Opus 5.5 op OrcaRouter, omdat er geen Claude Opus 5.5 is om te routeren. We zullen er pas een hebben wanneer Anthropic er een uitbrengt, en dit artikel is geen preview van een productpagina. Alles in dit stuk over 5.5 is een verslag van een verslag.
Waar je op moet letten, en wat je moet negeren
Let op de modelidentificatie. Een werkende API-slug is het verschil tussen een lancering en een gerucht, en het is het enige artefact dat een lek niet lang kan vervalsen. Let op de prijstabel, want daar vertelt Anthropic je in welk tier het model volgens hen thuishoort. Let op of de gray-testroutering vóór een aankondiging wordt hervat — een opnieuw verbreed kanaal is een veel sterker signaal dan een tweet, en het afsluiten en herstellen van 17 september liet al zien hoe dat kanaal er van buitenaf uitziet.
Negeer voorlopig de codenaam. "claude-wafer-eap" is een string uit één bron zonder bevestiging, en hetzelfde geldt voor de "Lyra"-toeschrijving erachter. Negeer het versienummer als bewijs voor wat dan ook, behalve voor positionering. En negeer elk scorebord dat in de eerste 48 uur verschijnt waarin een publieke Opus 5 wordt vergeleken met een 5.5 die niemand onafhankelijk heeft gedraaid — inclusief het onze, als we er een bouwen, totdat er iets reëels aan beide zijden van de vergelijking is.
Als dinsdag verstrijkt zonder een release, is het lek daarmee niet weerlegd; het Opus 5.2-evenement van september was zelf een geval van een model dat dagenlang in productie bestond voordat iemand het een naam kon geven. De eerlijke positie tot dan is de positie die het bewijs ondersteunt: een week geleden werd er stilletjes een echte, niet-uitgebrachte Opus-build geserveerd, voor deze week is er een echt releasevenster in de markt ingeprijsd, en één account heeft er een nummer, een codenaam en een datum aan gekoppeld die niemand anders heeft bevestigd.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
