Een gegenereerde hero-kaart voor 'Het Amerikaanse kleine model is nu het goedkopere', met het label 'PRIJSPLAFOND' en de kicker '7 OKTOBER 2026' en de ondertitel 'Claude Haiku 5.5 voor $0.10 en $0.50 tegenover DeepSeek V4 Flash - tot 100.000 tokens.' Vier chips tonen '$0.10 vs $0.15 in', '$0.50 vs $0.60 uit', '100K-stap' en 'piekvensters'. Twee kaarten eronder hebben het label 'ONDER 100.000 TOKENS' ('Anthropic is goedkoper op beide meters') en 'DAARBOVEN' ('DeepSeek is drie tot vier keer goedkoper'). Een footer luidt 'Gepubliceerde lijsttarieven van leveranciers, gelezen op 8 oktober 2026.' Het OrcaRouter-logo is in de rechteronderhoek samengevoegd.
Guides & Insights

Claude Haiku 5.5 vs DeepSeek V4 Flash: Anthropic onderbiedt zojuist de prijsondergrens

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Twee jaar lang had het goedkope segment van de markt een vorm die iedereen kende: de Amerikaanse labs rekenden meer en de Chinese labs minder, en je koos daar je kant bij. Claude Haiku 5.5doorbrak dat op 7 oktober 2026 met een lancering tegen $0,10 per miljoen inputtokens en $0,50 per miljoen outputtokens — wat onder het gepubliceerde tarief ligt voor DeepSeek V4 Flash, het model dat sinds de zomer het referentiepunt voor goedkoop is.

Het is een kleinere overwinning dan het klinkt, en de redenen zijn meer waard dan de kop. Het Ant​hropic-tarief geldt alleen voor prompts tot 100.000 tokens. Daarboven wordt het $0,50 en $2,50, wat meerdere keren de prijs van Dee​pSeek is. En de eigen kaart van Dee​pSeek heeft een vorm die niemand kopieert: hij verdubbelt tijdens twee weekdagvensters. Twee leveranciers, twee totaal verschillende ideeën over wat "goedkoop" betekent.

Wat elke leverancier daadwerkelijk publiceert

Per miljoen tokens, in Amerikaanse dollars. De cijfers van Ant​hropic komen uit de prijsdocumentatie van Ant​hropic; de cijfers van Dee​pSeek komen van de eigen pagina Modellen & Prijzen van Dee​pSeek, die de gezaghebbende prijskaart voor het model is.

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• Invoer — Claude Haiku 5.5 $0,10 tot 100.000 tokens, $0,50 daarboven. DeepSeek V4 Flash $0,15 buiten de piek, $0,30 in de piekperiodes.

• Uitvoer — Claude Haiku 5.5 $0,50 tot 100.000 tokens, $2,50 daarboven. DeepSeek V4 Flash $0,60 buiten piekuren, $1,20 tijdens piekuren.

• Gecachte invoer — Claude Haiku 5.5 $0,01 tot 100.000 tokens en $0,05 daarboven. DeepSeek V4 Flash $0,003 buiten de piek en $0,006 tijdens de piek, wat meer dan een factor drie goedkoper is.

• Piekvensters — Ant​hropic heeft er geen; het tarief verandert met de promptlengte en met niets anders. Dee​pSeek verdubbelt het tarief tussen 01:00 en 04:00 en nogmaals tussen 06:00 en 10:00 UTC, van maandag tot vrijdag, met uitzondering van Chinese officiële feestdagen.

• Context en uitvoer — 1M tokens en 128.000 maximale uitvoer voor Claude Haiku 5.5; 1M tokens en 384.000 maximale uitvoer voor DeepSeek V4 Flash.

• Modaliteit — Claude Haiku 5.5 verwerkt tekst en afbeeldingen; DeepSeek V4 Flash is alleen tekst, en vision zit op het zustermodel in plaats van op dit model.

• Onafhankelijke score — Artificial Analysis Intelligence Index v4.3.2 plaatst Claude Haiku 5.5 (Max) op 43,40, tweede van 182 modellen, en DeepSeek V4 Flash 0731 (Max) op 34,33, tiende van 117.

Snelheid — dezelfde bron meet 241,9 outputtokens per seconde voor Claude Haiku 5.5 en 222,0 voor DeepSeek V4 Flash, de op een na snelste op zijn eigen ranglijst.

De crossover is het hele verhaal.

Breng de twee kaarten op één verzoek op één lijn en de vergelijking keert tweemaal om.

Onder de 100.000 tokens is Ant​hropic goedkoper op beide meters en op het prijskaartje dat ertoe doet: $0,10 tegen $0,15 in, $0,50 tegen $0,60 uit. Dat is de eerste keer dat een klein model van Ant​hropic onder een tarief van Dee​pSeek Flash uitkomt op gelijkwaardige basis, en het is het feit waarmee het lanceringsbericht opent.

Boven de 100.000 tokens slaat het hard om. De input van $0,50 bij Ant​hropic is meer dan drie keer het dalurentarief van Dee​pSeek, en de output van $2,50 is meer dan vier keer dat tarief. Een pijplijn voor retrieval of lange documenten die routinematig prompts van 150.000 tokens samenstelt, is helemaal geen klant voor Claude Haiku 5.5; die is een klant voor het model dat hij al gebruikte.

En in de twee doordeweekse vensters van DeepSeek vernauwt de tweede vergelijking zich vanuit de andere richting, omdat het eigen tarief van DeepSeek verdubbelt terwijl dat van Anthropic niet beweegt. Geen van beide leveranciers heeft in abstracto een betere structuur. De een rekent af op hoeveel je verstuurt, de ander op wanneer je het verstuurt, en slechts één daarvan is op het moment van het verzoek onder jouw controle.

Wat een voltooid gedicht kost, wat het enige eerlijke is

De tarieven op het prijskaartje zijn per token, en de twee modellen genereren niet hetzelfde aantal tokens voor hetzelfde werk. Dat is waar de rekensom rond de lancering ongemakkelijk wordt voor Ant​hropic.

Artificial Analysis zet Claude Haiku 5.5 (Max) op $0,21 per Intelligence Index-taak en DeepSeek V4 Flash 0731 (Max) op $0,22 per taak. Een tiende van het invoertarief, een ruimer venster en een verschil van 26 punten op de Intelligence Index — 43,40 tegen 34,33 — en de gemeten kosten om één taak gedaan te krijgen komen binnen één cent van het model dat het zou moeten onderbieden.

De reden staat op dezelfde pagina. Bij het evalueren van de Index genereerde Claude Haiku 5.5 440 miljoen outputtokens tegen een mediaan van 100 miljoen, en de evaluator noemt het zeer verbose. DeepSeek V4 Flash genereerde 240 miljoen tegen een mediaan van 140 miljoen en wordt ook zeer verbose genoemd. Beide modellen denken langdurig, beide factureren denken als output, en output is de meter die de rekening bepaalt. De verlaging van de input met negentig procent is reëel en wordt aangerekend op de kleinere helft van de factuur.

Er is een tweede, stiller effect. In Anthropic's eigen documentatie staat dat Claude Haiku 5.5 de nieuwere tokenizer gebruikt die gedeeld wordt met Claude 4.7 en later, dus dezelfde tekst telt ongeveer 30% meer tokens dan op Claude Haiku 4.5. Het tarief daalde met een factor tien; het aantal tokens daalde helemaal niet, en bij dezelfde tekst steeg het.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Het model achter de naam Dee​pSeek is ook veranderd

Iedereen die deze twee op basis van een maandenoude benchmarktabel vergelijkt, zou dit moeten weten voordat diegene dat doet.

Dee​pSeek's prijzenpagina vermeldt nu deepseek-flash als de modelnaam, ondersteund door Dee​pSeek-V4.1-Flash, en stelt dat de legacy deepseek-v4-flash id nog steeds wordt geaccepteerd, maar dat "de bijbehorende modellen buiten gebruik zijn gesteld" — verzoeken onder de oude naam worden bediend door het nieuwere model en gefactureerd tegen de Flash-prijs. Met andere woorden: de id behield zijn naam, zijn prijs en zijn plek in de line-up, en de gewichten daaronder verplaatsten mee.

Dat is geen kritiek; het is een waarschuwing over de datum waaraan een benchmarktabel is gekoppeld. Het Artificial Analysis-item dat dit stuk citeert, betreft de 0731-release van DeepSeek V4 Flash in zijn Max-configuratie, het model dat de benchmark heeft gemeten, en het is niet automatisch een uitspraak over wat vandaag op die id reageert. Claude Haiku 5.5 van Ant​hropic daarentegen is een vaste id zonder datumachtervoegsel en zonder alias, en de plaatsing ervan in de Index is gedateerd op zijn eigen lanceringsweek.

Twee modellen, één endpoint

De reden dat je deze vergelijking gemakkelijk zelf kunt beslechten in plaats van op een specificatieblad, is dat beide zijden vanaf dezelfde plek aanroepbaar zijn — met één uitzondering die het vermelden waard is.

DeepSeek V4 Flash staat vandaag in de OrcaRouter-catalogus, en automatische failover zit eronder, dus het DeepSeek-deel van deze vergelijking kunnen we vanochtend gewoon aanroepen in plaats van er alleen over te lezen. Eén waarschuwing wil ik zelf geven in plaats van die aan jou over te laten: ons eigen vermelde tarief voor dit model is $0,22 in en $0,66 uit per miljoen tokens, wat boven DeepSeeks off-peak-tarief en onder het peak-tarief ligt. Beschouw DeepSeeks pagina, niet de onze, als de autoriteit voor de peak- en off-peak-structuur, en de onze als één gecombineerd getal om een gemeten run tegen af te zetten. Claude Sonnet 5.5 en Claude Opus 5.5 staan ook in de catalogus. Een A/B tussen een DeepSeek Flash-deel en een Claude-deel is dus één key en één SDK, en de routing-DSL voegt ze samen tot één call als de escalatielogica in de route thuishoort en niet in de applicatie.

Claude Haiku 5.5 staat nog niet in de catalogus. Dat is geen slag om de arm — het betekent dat de Ant​hropic-kant van deze vergelijking vandaag de dag rechtstreeks bij Ant​hropic moet worden benaderd, en de Dee​pSeek-kant niet. Wil je de goedkope laag van de Dee​pSeek-lijn vandaag op dezelfde sleutel als de rest van je stack, dan is dat deel al live.

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Welke moet je kiezen?

Als je aanroepen kort zijn — classificatie, extractie, routering, samenvatting, beurten van subagents — en ze onder de 100.000 tokens blijven, is Claude Haiku 5.5 nu het goedkopere model op beide maatstaven en het sterkere op de onafhankelijke ranglijst, en de zaak is eenvoudig. Het is ook de enige van de twee die een afbeelding accepteert.

Als je calls lang zijn, als je een grote gedeelde prefix opnieuw verzendt, of als je kunt plannen, wijst de rekensom de andere kant op, en met een ruime marge: de gecachte input van Dee​pSeek tegen $0,003 buiten de piek ligt een orde van grootte onder de $0,01 van Ant​hropic, het outputplafond is drie keer hoger, en de korting buiten de piek is een planningsprobleem in plaats van een productbeperking.

Wat de lancering feitelijk heeft beslecht, is beperkter dan "Anthropic is nu goedkoop". Ze heeft beslecht dat de Amerikaanse labs voor de korte-promptcase onder de Chinese zullen prijzen, en dat de korte-promptcase is waar het meeste productieverkeer zit. Alles boven de 100.000 tokens is nog steeds de markt van het andere model.