
Claude Opus 5.5-demo's kosten $3 tot $26: hoe je de eerste dagen van builds leest
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 495 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 186 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
Twee getallen uit de eerste week van Claude Opus 5.5 beschrijven hetzelfde model en verschillen een orde van grootte van elkaar. Eén bouwer meldt een afgerond interactief lenslab — een pagina waarop je een scherpstelring sleept en een gloeiend scherptevlak door een vallei ziet strijken — voor $25,66 aan API-uitgaven en een uur en 26 minuten kloktijd. Een veel gedeeld overzicht van lanceringsdemo's begroot een procedureel gebouwde Blender-kasteelanimatie, compleet met vuurwerk en een weerspiegeling in een meer, op $13,30 en 35 minuten. Een thread die de voorpagina van r/ClaudeAI haalde, zegt $3,21. De leverancier bracht Claude Opus 5.5op 22 september 2026 uit voor $4 per miljoen inputtokens en $20 per miljoen outputtokens, en geen van die drie cijfers is onjuist. Ze meten verschillende dingen, en als je op basis daarvan een budget opstelt, moet je weten welke.
De kloof is geen ruis. Het is het verschil tussen wat een agent-run produceert en wat deze verbruikt, en de afgelopen vier dagen hebben een opmerkelijke hoeveelheid van het laatste opgeleverd, met heel weinig verantwoording daarover. Dus hier is de rekensom die niemand naast de demo's heeft geplaatst, en dan het deel van de lancering dat daadwerkelijk op een tariefkaart staat en kan worden gecontroleerd.
Wat $25,66 daadwerkelijk kocht
Het dure uiteinde van het bereik is het nuttigste uiteinde, omdat de bouwer zowel het artefact als de rekening heeft gepubliceerd.
Ryan Sael's lens lab, getiteld "Het scherpstelvlak", is één enkele interactieve pagina die in één sessie vanuit één prompt is gebouwd. Het zet een camera-objectief op het scherm, laat je aan de scherpstelring slepen en toont je het ding waar elke fotograaf van weet maar dat bijna niemand heeft gezien: het dunne vlak in de wereld waar een foto daadwerkelijk scherp wordt. Draai aan de ring en het vlak beweegt, de glaselementen schuiven naar voren of naar achteren in de lensbehuizing om te laten zien waarom, en een console geeft de afstand, het diafragma en de scherpe zone weer — 60 cm, f/2, 1,9 cm scherptediepte, bij de instellingen waarmee de pagina opent. Stop het diafragma af van f/2 naar f/16 en de scherpe zone wordt breder naarmate de lichtkegel smaller wordt. Een uiteengenomen weergave haalt de glaselementen uit elkaar. Er zit nergens in de pijplijn een beeldmodel, en er zijn geen gedownloade assets: elk element wordt in code getekend en geanimeerd, waardoor de hele demonstratie van de cirkel van verwarring een live simulatie is in plaats van een diagram.
Dat is echt een goede uitleg, en de claim die eraan hangt is ongewoon precies: één poging, 1 uur 26 minuten, $25,66 aan API-gebruik, met de pagina live op lens.lab.sael.net toen ik hem las. Dat cijfer is zelfgerapporteerd en niet controleerbaar, maar het is ook de enige demo-kostenpost in omloop waar een sessielengte bij zit om door te delen.
Maak de rekensom op de tariefkaart. Bij de gepubliceerde tarieven van Claude Opus 5.5 — $4 per miljoen input en $20 per miljoen output — ligt $25,66 tussen 1,28 miljoen tokens en 6,4 miljoen tokens, afhankelijk van de mix: het hoogste uiteinde als de run alleen maar input was, het laagste uiteinde als het alleen maar output was. Een agentische build zoals deze zit ergens in het midden, en de reden dat het dichter bij de onderkant zit, is de regelpost die de meeste mensen overslaan: cache-reads op Claude Opus 5.5 kosten $0,20 per miljoen, een veertigste van het inputtarief, dus een lange sessie die steeds dezelfde groeiende codebase opnieuw leest, betaalt bijna niets voor dat verkeer. Tien miljoen gecachte inputtokens kosten $2. Aan de outputkant stapelt zich op wat anderhalf uur van een model dat code schrijft, nadenkt en die herschrijft, oplevert: bij $20 per miljoen is een miljoen outputtokens $20, en denktokens worden als output gefactureerd. Het getal van Sael is consistent met een run die in de orde van grootte van een miljoen outputtokens produceerde tegenover een grote, goedkope, gecachte inputkant — precies zoals een onbeheerde build van 86 minuten eruitziet.
Twee dingen volgen. Ten eerste: de verlaging van de stickerprijs die op de lanceringsdag de aandacht trok, van $5/$25 naar $4/$20, is een verandering van 20% per token en zou op zichzelf deze run niet goedkoop hebben gemaakt; de verlaging van de cache-read van $0,50 naar $0,20 is de regel die een lus van 90 minuten betaalbaar maakte. Ten tweede, en minder comfortabel: niets in het rapport van $25,66 vertelt je of de run goed verliep. Een goed uitgevoerde one-shot en een sessie die anderhalf uur worstelde en daarna slaagde, leveren dezelfde factuur op.
Het bedrag van $13,30 overleeft zijn eigen rekenwerk niet.
Het midden van het bereik is om een andere reden leerzaam. Een op 23 september gepubliceerd overzicht van launch-demo's doet verslag van een rechtstreekse vergelijking waarin Claude Opus 5.5 werd gevraagd om procedureel een Blender-animatie van tien seconden te bouwen op basis van één prompt — kasteel, meerweerspiegeling, vuurwerk — tegen GPT-6 Astra, zonder handmatige bewerking, en meldt 35 minuten en 199.600 outputtokens voor ongeveer $13,30, tegenover 28 minuten en ongeveer $14,50 voor GPT-6 Astra. Het aantal tokens is het interessante deel, omdat het niet te rijmen valt met de prijs.
199.600 outputtokens bij Claude Opus 5.5 tegen $20 per miljoen is $3,99, niet $13,30. Om alleen al met output $13,30 te bereiken, zou je 665.000 tokens nodig hebben. Het ontbrekende geld zit in de andere kolommen: input tegen $4 per miljoen, cache-writes tegen $5 per miljoen voor een breakpoint van vijf minuten en $8 per miljoen voor een uur, en eventuele retries. Dat is geen tegenstrijdigheid in het rapport — het is het rapport dat eerlijk is over een tokentelling die één ding telt en een rekening die vier dingen telt, wat de meest voorkomende verwarring is in kostenpraat tijdens de lanceerweek. Als je één getal uit een gepubliceerde demo overneemt, neem dan het dollarbedrag, en behandel elk tokenaantal ernaast als een gedeeltelijke beschrijving van de run.
Aan de goedkope kant wordt de boekhouding nog dunner. De r/ClaudeAI-thread die $3,21 API-gebruik meldt voor een afgeronde build is typerend voor het genre: een titel, een video en geen uitsplitsing. Het is plausibel een kortere sessie, een kleiner artefact of veel gecachte input. Het is niets om een budget op te baseren, en ik kon geen dollar ervan verifiëren.
Waarom elk van deze getallen een ondergrens is
De faalmodus hier is niet dat bouwers veinzen. Het is selectie. De demo's die circuleren, zijn de demo's die werkten, gepubliceerd door de mensen voor wie ze werkten, en de vier pogingen die een kapotte pagina opleverden, kostten evenveel als de ene die dat niet deed. De round-up die The Blender samenstelde, zegt hetzelfde ronduit — dat niemand de mislukkingen plaatst — en zijn eigen meest gedetailleerde item is een treffend voorbeeld: een website van een horlogemerk die de briefing niet haalde, bij de eerste poging een onleesbaar lettertype gebruikte en een tweede nodig had om de versie te worden die werd getoond.
"One shot" doet ook in dat vocabulaire stilletjes zijn werk. Het beschrijft één sessie, niet één enkele poging, en een sessie mag zoveel zelfcorrectie bevatten als het model kan genereren — wat bij een run van 86 minuten een heleboel is. Het model dat zijn eigen code tweemaal binnen één contextvenster herschrijft, is one shot en twee pogingen.
Dus de eerlijke lezing van de eerste vier dagen is drie niveaus van bewijs, en die mogen niet worden gemiddeld:
• Zelfgerapporteerde kosten met een sessieduur — bruikbaar voor de orde van grootte, niet verifieerbaar. Sael's $25,66 over 1u26m is het sterkste item in deze categorie.
• Zelfgerapporteerde kosten met een tokenaantal — vaak intern inconsistent, zoals het bedrag van $13,30 laat zien.
• Een dollarbedrag zonder enige onderbouwing — een signaal dat iemand iets heeft gebouwd, en niet meer dan dat.
Het deel van de lancering dat op een tariefkaart staat
Haal de demo-claims weg en het verifieerbare beeld is beperkt en helder. Alle onderstaande cijfers zijn de gepubliceerde tarieven van Anthropic, afkomstig uit de eigen modeldocumentatie en aankondiging van het bedrijf op 25 september 2026:
• Input — $4 per miljoen tokens. Output — $20 per miljoen, waarbij denktokens als output worden gefactureerd, en de adaptieve denkmodus van Claude Opus 5.5 staat altijd aan en kan niet worden uitgeschakeld.
• Cache-leesbewerkingen — $0,20 per miljoen, een vermenigvuldigingsfactor van 0,05x. Cache-schrijfbewerkingen — $5 per miljoen bij het breekpunt van vijf minuten, $8 per miljoen bij één uur. Batch API — 50% korting in beide richtingen, $2 en $10.
• Snelle modus — $8 input en $40 output per miljoen, tot 2,5x de snelheid, en Anthropic bestempelt het nog steeds als een onderzoekspreview.
• Envelope — 1M-tokencontext, 128K outputtokens synchroon en 300K op de Batch API met een bètaheader, betrouwbare kennisafsluitdatum van juni 2026, standaard effort medium in plaats van high, wat de standaard van Claude Opus 5 was.
• Beschikbaarheid — de Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry en Claude Platform on AWS, met buitengebruikstelling toegezegd voor niet eerder dan 22 september 2027.
De eigen prestatieclaims van de leverancier, als claims aangeduid: Claude Opus 5.5 presteert bij de meeste werkzaamheden op het niveau van Claude Fable 5.1, kost ongeveer 40% minder om te draaien dan Claude Opus 5 en genereert output meer dan 30% sneller. Die 40% is een door de leverancier gekozen workloadgemiddelde, geen getal van een tariefkaart, en de twee moeten niet worden aangehaald alsof het om hetzelfde soort feit gaat.
De onafhankelijke controle is kleiner dan de leverancierstabel en wijst met minder marge dezelfde kant op. Artificial Analysis geeft Claude Opus 5.5 een score van 57,6 op zijn Intelligence Index, naast 61,4 op Humanity's Last Exam, 66,9 op SciCode en 84,7 op long-context recall in de cijfers die zijn modelpagina vermeldt. Bij de coding-agentmeting van dezelfde publicatie, die kosten per taak rapporteert in plaats van kosten per token, beweegt het cijfer de andere kant op: bij maximale inspanning stijgt de kosten per taak tot ongeveer $13,04, tegenover $10,79 voor Claude Opus 5 in dezelfde testomgeving. Een goedkopere token waarvan het model er meer verbruikt, is nog geen goedkopere taak. Dat is dezelfde les die de demofacturen ons leren, en die nu van een derde partij komt.
Wat je in week twee anders moet doen
Als het getal $25,66 het getal is dat je ertoe bracht dit te willen proberen, dan is de nuttige zet niet om $25,66 in je budget op te nemen — het is om je eigen run een getal te laten opleveren dat je kunt uitleggen.
Stel effort expliciet in, in plaats van de standaardwaarde te accepteren, want het is de knop die het aantal tokens per taak sterker beïnvloedt dan de modelkeuze, en de standaardwaarde op dit model is veranderd ten opzichte van Claude Opus 5. Cache de stabiele prefix bewust: de minimale cachebare prompt op Claude Opus 5.5 is 512 tokens, gedaald van 1.024, dus korte gedeelde prefixen die voorheen nooit werden gecachet, worden dat nu wel. Geef elke langlopende taak speelruimte in max_tokens, aangezien thinking deel uitmaakt van dat budget en niet meer kan worden uitgeschakeld — Anthropics eigen migratieadvies adviseert om te beginnen bij 64K voor werk op de hoogste effortniveaus en van daaruit bij te stellen. En instrumenteer de run aan het einde, niet aan het begin: lees bij elk antwoord het modelveld op het hoogste niveau, want bij prompts die zijn classifiers markeren, routeert Anthropic het verzoek binnen dezelfde aanroep opnieuw, en de modelstring die je hebt verzonden beschrijft niet welk model heeft geantwoord.
Dat laatste punt is waar een router ophoudt een gemak te zijn. Een build die anderhalf uur onbeheerd draait en daarbij een safeguard-grens passeert, kan terugkomen terwijl er stilletjes een paar turns op een kleiner model zijn afgerond, en de enige manier om daarachter te komen is kijken. Claude Opus 5.5 staat op OrcaRouter tegen Anthropics eigen lijstprijs met 0% markup — het providertarief wordt rechtstreeks doorgegeven, dus een prijswijziging van een leverancier is hier live op dezelfde dag dat die wordt gepubliceerd — wat het minst interessante is dat routing hier doet. Het interessante is dat één API voor 200+ modellen het hele experiment op één sleutel zet, zodat "draai het op het frontiermodel, en val terug in plaats van te falen" een configuratieregel is in plaats van een tweede contract en een herschrijving. Automatische failover is wat een onbekend model veilig maakt om op een pad te zetten dat je belangrijk vindt, en een weigering waar je omheen kunt routeren is een weigering die je run niet op minuut 70 beëindigt.
Het nummer dat als volgende gaat bewegen
Anthropic heeft gezegd dat Claude Sonnet 5.5 en Claude Haiku 5.5 "in de komende weken" volgen, en dat zal de prijs van al deze demo's herzien zonder hun vorm te veranderen: een goedkoper tarief per token tegenover een tokenaantal dat niemand vooraf kan voorspellen. Dezelfde onzekerheid die de cijfers van de eerste week onbruikbaar maakte, zal ook gelden voor die van de volgende generatie, en dat is de reden om de gewoonte nu op te bouwen in plaats van nadat de prijsverlaging opnieuw is ingegaan.
Voorlopig is de eerlijke samenvatting kort. Claude Opus 5.5 is echt, algemeen beschikbaar en geprijsd op $4 en $20, met de goedkoopste cached reads die deze lijn ooit heeft gekend. De demo's die het in zijn eerste vier dagen produceerde, zijn opmerkelijk, en hun prijskaartjes zijn anekdotisch. Als je een kostenpost voor je eigen workload wilt, is het enige instrument dat die afleest je eigen run, met een maximum, waarbij de factuur achteraf wordt gelezen.



Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
