
Claude Haiku 5.5 vs DeepSeek V4 Flash: Anthropic onderbiedt zojuist de prijsondergrens
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Twee jaar lang had het goedkope segment van de markt een vorm die iedereen kende: de Amerikaanse labs rekenden meer en de Chinese labs minder, en je koos daar je kant bij. Claude Haiku 5.5doorbrak dat op 7 oktober 2026 met een lancering tegen $0,10 per miljoen inputtokens en $0,50 per miljoen outputtokens — wat onder het gepubliceerde tarief ligt voor DeepSeek V4 Flash, het model dat sinds de zomer het referentiepunt voor goedkoop is.
Het is een kleinere overwinning dan het klinkt, en de redenen zijn meer waard dan de kop. Het Anthropic-tarief geldt alleen voor prompts tot 100.000 tokens. Daarboven wordt het $0,50 en $2,50, wat meerdere keren de prijs van DeepSeek is. En de eigen kaart van DeepSeek heeft een vorm die niemand kopieert: hij verdubbelt tijdens twee weekdagvensters. Twee leveranciers, twee totaal verschillende ideeën over wat "goedkoop" betekent.
Wat elke leverancier daadwerkelijk publiceert
Per miljoen tokens, in Amerikaanse dollars. De cijfers van Anthropic komen uit de prijsdocumentatie van Anthropic; de cijfers van DeepSeek komen van de eigen pagina Modellen & Prijzen van DeepSeek, die de gezaghebbende prijskaart voor het model is.

• Invoer — Claude Haiku 5.5 $0,10 tot 100.000 tokens, $0,50 daarboven. DeepSeek V4 Flash $0,15 buiten de piek, $0,30 in de piekperiodes.
• Uitvoer — Claude Haiku 5.5 $0,50 tot 100.000 tokens, $2,50 daarboven. DeepSeek V4 Flash $0,60 buiten piekuren, $1,20 tijdens piekuren.
• Gecachte invoer — Claude Haiku 5.5 $0,01 tot 100.000 tokens en $0,05 daarboven. DeepSeek V4 Flash $0,003 buiten de piek en $0,006 tijdens de piek, wat meer dan een factor drie goedkoper is.
• Piekvensters — Anthropic heeft er geen; het tarief verandert met de promptlengte en met niets anders. DeepSeek verdubbelt het tarief tussen 01:00 en 04:00 en nogmaals tussen 06:00 en 10:00 UTC, van maandag tot vrijdag, met uitzondering van Chinese officiële feestdagen.
• Context en uitvoer — 1M tokens en 128.000 maximale uitvoer voor Claude Haiku 5.5; 1M tokens en 384.000 maximale uitvoer voor DeepSeek V4 Flash.
• Modaliteit — Claude Haiku 5.5 verwerkt tekst en afbeeldingen; DeepSeek V4 Flash is alleen tekst, en vision zit op het zustermodel in plaats van op dit model.
• Onafhankelijke score — Artificial Analysis Intelligence Index v4.3.2 plaatst Claude Haiku 5.5 (Max) op 43,40, tweede van 182 modellen, en DeepSeek V4 Flash 0731 (Max) op 34,33, tiende van 117.
Snelheid — dezelfde bron meet 241,9 outputtokens per seconde voor Claude Haiku 5.5 en 222,0 voor DeepSeek V4 Flash, de op een na snelste op zijn eigen ranglijst.
De crossover is het hele verhaal.
Breng de twee kaarten op één verzoek op één lijn en de vergelijking keert tweemaal om.
Onder de 100.000 tokens is Anthropic goedkoper op beide meters en op het prijskaartje dat ertoe doet: $0,10 tegen $0,15 in, $0,50 tegen $0,60 uit. Dat is de eerste keer dat een klein model van Anthropic onder een tarief van DeepSeek Flash uitkomt op gelijkwaardige basis, en het is het feit waarmee het lanceringsbericht opent.
Boven de 100.000 tokens slaat het hard om. De input van $0,50 bij Anthropic is meer dan drie keer het dalurentarief van DeepSeek, en de output van $2,50 is meer dan vier keer dat tarief. Een pijplijn voor retrieval of lange documenten die routinematig prompts van 150.000 tokens samenstelt, is helemaal geen klant voor Claude Haiku 5.5; die is een klant voor het model dat hij al gebruikte.
En in de twee doordeweekse vensters van DeepSeek vernauwt de tweede vergelijking zich vanuit de andere richting, omdat het eigen tarief van DeepSeek verdubbelt terwijl dat van Anthropic niet beweegt. Geen van beide leveranciers heeft in abstracto een betere structuur. De een rekent af op hoeveel je verstuurt, de ander op wanneer je het verstuurt, en slechts één daarvan is op het moment van het verzoek onder jouw controle.
Wat een voltooid gedicht kost, wat het enige eerlijke is
De tarieven op het prijskaartje zijn per token, en de twee modellen genereren niet hetzelfde aantal tokens voor hetzelfde werk. Dat is waar de rekensom rond de lancering ongemakkelijk wordt voor Anthropic.
Artificial Analysis zet Claude Haiku 5.5 (Max) op $0,21 per Intelligence Index-taak en DeepSeek V4 Flash 0731 (Max) op $0,22 per taak. Een tiende van het invoertarief, een ruimer venster en een verschil van 26 punten op de Intelligence Index — 43,40 tegen 34,33 — en de gemeten kosten om één taak gedaan te krijgen komen binnen één cent van het model dat het zou moeten onderbieden.
De reden staat op dezelfde pagina. Bij het evalueren van de Index genereerde Claude Haiku 5.5 440 miljoen outputtokens tegen een mediaan van 100 miljoen, en de evaluator noemt het zeer verbose. DeepSeek V4 Flash genereerde 240 miljoen tegen een mediaan van 140 miljoen en wordt ook zeer verbose genoemd. Beide modellen denken langdurig, beide factureren denken als output, en output is de meter die de rekening bepaalt. De verlaging van de input met negentig procent is reëel en wordt aangerekend op de kleinere helft van de factuur.
Er is een tweede, stiller effect. In Anthropic's eigen documentatie staat dat Claude Haiku 5.5 de nieuwere tokenizer gebruikt die gedeeld wordt met Claude 4.7 en later, dus dezelfde tekst telt ongeveer 30% meer tokens dan op Claude Haiku 4.5. Het tarief daalde met een factor tien; het aantal tokens daalde helemaal niet, en bij dezelfde tekst steeg het.

Het model achter de naam DeepSeek is ook veranderd
Iedereen die deze twee op basis van een maandenoude benchmarktabel vergelijkt, zou dit moeten weten voordat diegene dat doet.
DeepSeek's prijzenpagina vermeldt nu deepseek-flash als de modelnaam, ondersteund door DeepSeek-V4.1-Flash, en stelt dat de legacy deepseek-v4-flash id nog steeds wordt geaccepteerd, maar dat "de bijbehorende modellen buiten gebruik zijn gesteld" — verzoeken onder de oude naam worden bediend door het nieuwere model en gefactureerd tegen de Flash-prijs. Met andere woorden: de id behield zijn naam, zijn prijs en zijn plek in de line-up, en de gewichten daaronder verplaatsten mee.
Dat is geen kritiek; het is een waarschuwing over de datum waaraan een benchmarktabel is gekoppeld. Het Artificial Analysis-item dat dit stuk citeert, betreft de 0731-release van DeepSeek V4 Flash in zijn Max-configuratie, het model dat de benchmark heeft gemeten, en het is niet automatisch een uitspraak over wat vandaag op die id reageert. Claude Haiku 5.5 van Anthropic daarentegen is een vaste id zonder datumachtervoegsel en zonder alias, en de plaatsing ervan in de Index is gedateerd op zijn eigen lanceringsweek.
Twee modellen, één endpoint
De reden dat je deze vergelijking gemakkelijk zelf kunt beslechten in plaats van op een specificatieblad, is dat beide zijden vanaf dezelfde plek aanroepbaar zijn — met één uitzondering die het vermelden waard is.
DeepSeek V4 Flash staat vandaag in de OrcaRouter-catalogus, en automatische failover zit eronder, dus het DeepSeek-deel van deze vergelijking kunnen we vanochtend gewoon aanroepen in plaats van er alleen over te lezen. Eén waarschuwing wil ik zelf geven in plaats van die aan jou over te laten: ons eigen vermelde tarief voor dit model is $0,22 in en $0,66 uit per miljoen tokens, wat boven DeepSeeks off-peak-tarief en onder het peak-tarief ligt. Beschouw DeepSeeks pagina, niet de onze, als de autoriteit voor de peak- en off-peak-structuur, en de onze als één gecombineerd getal om een gemeten run tegen af te zetten. Claude Sonnet 5.5 en Claude Opus 5.5 staan ook in de catalogus. Een A/B tussen een DeepSeek Flash-deel en een Claude-deel is dus één key en één SDK, en de routing-DSL voegt ze samen tot één call als de escalatielogica in de route thuishoort en niet in de applicatie.
Claude Haiku 5.5 staat nog niet in de catalogus. Dat is geen slag om de arm — het betekent dat de Anthropic-kant van deze vergelijking vandaag de dag rechtstreeks bij Anthropic moet worden benaderd, en de DeepSeek-kant niet. Wil je de goedkope laag van de DeepSeek-lijn vandaag op dezelfde sleutel als de rest van je stack, dan is dat deel al live.

Welke moet je kiezen?
Als je aanroepen kort zijn — classificatie, extractie, routering, samenvatting, beurten van subagents — en ze onder de 100.000 tokens blijven, is Claude Haiku 5.5 nu het goedkopere model op beide maatstaven en het sterkere op de onafhankelijke ranglijst, en de zaak is eenvoudig. Het is ook de enige van de twee die een afbeelding accepteert.
Als je calls lang zijn, als je een grote gedeelde prefix opnieuw verzendt, of als je kunt plannen, wijst de rekensom de andere kant op, en met een ruime marge: de gecachte input van DeepSeek tegen $0,003 buiten de piek ligt een orde van grootte onder de $0,01 van Anthropic, het outputplafond is drie keer hoger, en de korting buiten de piek is een planningsprobleem in plaats van een productbeperking.
Wat de lancering feitelijk heeft beslecht, is beperkter dan "Anthropic is nu goedkoop". Ze heeft beslecht dat de Amerikaanse labs voor de korte-promptcase onder de Chinese zullen prijzen, en dat de korte-promptcase is waar het meeste productieverkeer zit. Alles boven de 100.000 tokens is nog steeds de markt van het andere model.
