Eine generierte Hero-Karte für 'Das amerikanische kleine Modell ist jetzt das günstigere', mit dem Badge 'PREISUNTERGRENZE' versehen, mit dem Kicker '7. OKTOBER 2026' und dem Untertitel 'Claude Haiku 5.5 bei $0,10 und $0,50 gegen DeepSeek V4 Flash – bis 100.000 Tokens.' Vier Chips zeigen '$0,10 vs. $0,15 Eingabe', '$0,50 vs. $0,60 Ausgabe', '100K-Schritt' und 'Peak-Zeitfenster'. Zwei Karten darunter sind mit 'UNTER 100.000 TOKENS' ('Anthropic ist bei beiden Messwerten günstiger') und 'DARÜBER' ('DeepSeek ist drei- bis viermal günstiger') beschriftet. Eine Fußzeile lautet 'Die veröffentlichten Listenpreise der Anbieter, abgelesen am 8. Oktober 2026.' Das OrcaRouter-Logo ist in die untere rechte Ecke eingefügt.
Guides & Insights

Claude Haiku 5.5 vs. DeepSeek V4 Flash: Anthropic hat gerade den Preisboden unterboten

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Zwei Jahre lang hatte das Billigsegment des Marktes eine Gestalt, die jeder kannte: Die amerikanischen Labore verlangten mehr, die chinesischen Labore verlangten weniger, und man entschied sich entsprechend für seine Seite. Claude Haiku 5.5durchbrach das am 7. Oktober 2026 mit einem Startpreis von 0,10 $ pro Million Input-Tokens und 0,50 $ pro Million Output-Tokens – was unter dem veröffentlichten Tarif für DeepSeek V4 Flashliegt, das Modell, das seit dem Sommer der Referenzpunkt für Günstigkeit ist.

Der Sieg ist enger begrenzt, als es klingt, und die Gründe sind mehr wert als die Schlagzeile. Der Anthropic-Tarif gilt nur für Prompts bis zu 100.000 Token. Darüber werden es 0,50 $ und 2,50 $, was ein Mehrfaches von DeepSeeks Preis ist. Und DeepSeeks eigene Preiskarte hat eine Form, die niemand kopiert: Sie verdoppelt sich in zwei Zeitfenstern an Wochentagen. Zwei Anbieter, zwei völlig unterschiedliche Vorstellungen davon, was „billig“ bedeutet.

Was jeder Anbieter tatsächlich veröffentlicht

Pro Million Tokens, in US-Dollar. Die Ant​hropic-Zahlen stammen aus Ant​hropics Preisgestaltungsdokumentation; die Dee​pSeek-Zahlen stammen von Dee​pSeeks eigener Seite „Models & Pricing“, die die maßgebliche Preisübersicht für das Modell ist.

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• Eingabe — Claude Haiku 5.5 0,10 $ bis zu 100.000 Tokens, darüber 0,50 $. DeepSeek V4 Flash 0,15 $ außerhalb der Stoßzeiten, 0,30 $ in den Spitzenlastfenstern.

• Ausgabe — Claude Haiku 5.5 $0,50 für bis zu 100.000 Tokens, $2,50 darüber. DeepSeek V4 Flash $0,60 außerhalb der Spitzenzeiten, $1,20 zu Spitzenzeiten.

• Zwischengespeicherte Eingabe — Claude Haiku 5.5: 0,01 $ bis zu 100.000 Tokens und 0,05 $ darüber. DeepSeek V4 Flash: 0,003 $ außerhalb der Spitzenzeiten und 0,006 $ zu Spitzenzeiten, was um mehr als den Faktor drei günstiger ist.

• Spitzenzeiten — Anthropic hat keine; der Tarif ändert sich nur mit der Prompt-Länge und sonst nichts. DeepSeek verdoppelt den Tarif zwischen 01:00 und 04:00 Uhr und erneut zwischen 06:00 und 10:00 Uhr UTC, Montag bis Freitag, ausgenommen chinesische Feiertage.

• Kontext und Ausgabe — 1 Mio. Token und 128.000 maximale Ausgabe für Claude Haiku 5.5; 1 Mio. Token und 384.000 maximale Ausgabe für DeepSeek V4 Flash.

• Modalität — Claude Haiku 5.5 verarbeitet Text und Bilder; DeepSeek V4 Flash ist reiner Text, und Vision liegt beim Schwestermodell statt bei diesem.

• Unabhängige Bewertung — Der Artificial Analysis Intelligence Index v4.3.2 platziert Claude Haiku 5.5 (Max) mit 43,40 auf Platz zwei von 182 Modellen und DeepSeek V4 Flash 0731 (Max) mit 34,33 auf Platz zehn von 117.

• Geschwindigkeit — dieselbe Quelle misst 241,9 Ausgabe-Tokens pro Sekunde für Claude Haiku 5.5 und 222,0 für DeepSeek V4 Flash, zweitschnellstes auf seinem eigenen Leaderboard.

Der Crossover ist die ganze Geschichte

Richte die beiden Karten auf eine einzige Anfrage aus, und der Vergleich kehrt sich zweimal um.

Unter 100.000 Token ist Anthropic bei beiden Messwerten und beim entscheidenden Preisschild günstiger: 0,10 $ gegenüber 0,15 $ für Input, 0,50 $ gegenüber 0,60 $ für Output. Das ist das erste Mal, dass ein kleines Anthropic-Modell bei vergleichbaren Bedingungen unter einem DeepSeek-Flash-Tarif liegt, und genau das ist die Tatsache, mit der der Launch-Beitrag beginnt.

Bei mehr als 100.000 Tokens kehrt sich das Blatt deutlich um. Der Input von Anthropic zu 0,50 $ ist mehr als das Dreifache des Off-Peak-Tarifs von DeepSeek, und der Output zu 2,50 $ ist mehr als das Vierfache davon. Eine Retrieval- oder Langdokument-Pipeline, die routinemäßig Prompts mit 150.000 Tokens zusammenstellt, ist überhaupt kein Kunde für Claude Haiku 5.5; sie ist ein Kunde für das Modell, das sie bereits verwendete.

Und in den beiden Werktagsfenstern von Dee​pSeek verengt sich der zweite Vergleich von der anderen Seite her, weil sich der Tarif von Dee​pSeek verdoppelt, während der von Ant​hropic unverändert bleibt. Keine Struktur eines Anbieters ist abstrakt betrachtet besser. Der eine berechnet nach der Menge, die Sie senden, der andere nach dem Zeitpunkt, zu dem Sie senden, und nur eines davon liegt zum Anfragezeitpunkt in Ihrer Hand.

Was eine erledigte Aufgabe kostet, die einzig faire Zahl

Die Listenpreise gelten pro Token, und die beiden Modelle geben für dieselbe Arbeit nicht die gleiche Anzahl an Tokens aus. Genau hier wird die Kalkulation zum Marktstart für Anthropic unangenehm.

Artificial Analysis beziffert Claude Haiku 5.5 (Max) auf $0,21 pro Intelligence-Index-Aufgabe und DeepSeek V4 Flash 0731 (Max) auf $0,22 pro Aufgabe. Ein Zehntel der Eingaberate, ein breiteres Fenster und ein 26-Punkte-Abstand im Intelligence Index – 43,40 gegenüber 34,33 –, und die gemessenen Kosten für die Erledigung einer Aufgabe liegen nur einen Cent von denen des Modells entfernt, das es eigentlich unterbieten sollte.

Der Grund steht auf derselben Seite. Bei der Auswertung des Index erzeugte Claude Haiku 5.5 440 Millionen Ausgabe-Tokens gegenüber einem Median von 100 Millionen, und der Evaluator bezeichnet es als sehr geschwätzig. DeepSeek V4 Flash erzeugte 240 Millionen gegenüber einem Median von 140 Millionen und wird ebenfalls als sehr geschwätzig bezeichnet. Beide Modelle denken ausführlich, beide rechnen Denken als Ausgabe ab, und die Ausgabe ist der Zähler, der über die Rechnung entscheidet. Die neunzigprozentige Eingabe-Kürzung ist real, und sie wird auf der kleineren Hälfte der Rechnung abgerechnet.

Es gibt einen zweiten, leiseren Effekt. Anthropics eigene Dokumentation besagt, dass Claude Haiku 5.5 den neueren Tokenizer verwendet, den auch Claude 4.7 und spätere Versionen nutzen, sodass derselbe Text etwa 30 % mehr Tokens zählt als unter Claude Haiku 4.5. Der Preis fiel um den Faktor zehn; die Tokenanzahl sank überhaupt nicht, sondern stieg bei demselben Text.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Das Modell hinter dem Namen Dee​pSeek hat sich ebenfalls geändert.

Wer diese beiden anhand einer monatealten Benchmark-Tabelle vergleicht, sollte das wissen, bevor er es tut.

Die Preisseite von DeepSeek führt jetzt deepseek-flash als Modellnamen auf, dahinter steht DeepSeek-V4.1-Flash, und gibt an, dass die alte ID deepseek-v4-flash weiterhin akzeptiert wird, aber dass „die entsprechenden Modelle eingestellt wurden“ – Anfragen unter dem alten Namen werden vom neueren Modell bedient und zum Flash-Preis abgerechnet. Mit anderen Worten: Die ID behielt ihren Namen, ihren Preis und ihren Platz in der Modellpalette, und die darunterliegenden Gewichte wurden ausgetauscht.

Das ist keine Kritik; es ist eine Warnung davor, worauf eine Benchmark-Tabelle datiert ist. Der Eintrag bei Artificial Analysis, den dieser Artikel zitiert, bezieht sich auf das 0731-Release von DeepSeek V4 Flash in seiner Max-Konfiguration, also auf das Modell, das das Board gemessen hat, und er ist nicht automatisch eine Aussage über alles, was heute unter dieser ID läuft. Ant​hropics Claude Haiku 5.5 hingegen ist eine feste ID ohne Datums-Suffix und ohne Alias, und seine Platzierung im Index ist auf seine eigene Launch-Woche datiert.

Zwei Modelle, ein Endpunkt

Der Grund, warum sich dieser Vergleich leicht für sich selbst statt anhand eines Datenblatts klären lässt, ist, dass beide Seiten von derselben Stelle aus aufrufbar sind – mit einer Ausnahme, die erwähnenswert ist.

DeepSeek V4 Flash ist heute im OrcaRouter-Katalog, und automatisches Failover liegt darunter, sodass der Dee​pSeek-Teil dieses Vergleichs heute Morgen von uns aufrufbar ist, statt nur davon zu lesen. Eine Warnung, die man aussprechen sollte, statt sie Sie selbst finden zu lassen: unser eigener gelisteter Tarif für dieses Modell liegt bei 0,22 $ Eingabe und 0,66 $ Ausgabe pro Million Tokens, was über Dee​pSeeks Off-Peak-Tarif und unter seinem Peak-Tarif liegt. Behandeln Sie Dee​pSeeks Seite, nicht unsere, als maßgeblich für die Peak- und Off-Peak-Struktur, und unsere als eine einzelne gemischte Zahl, gegen die ein abgerechneter Lauf gestartet werden kann. Claude Sonnet 5.5 und Claude Opus 5.5 sind ebenfalls im Katalog. Ein A/B zwischen einem Dee​pSeek-Flash-Teil und einem Claude-Teil ist also ein Schlüssel und ein SDK, und die Routing-DSL fügt sie zu einem einzigen Aufruf zusammen, wenn die Eskalationslogik in die Route und nicht in die Anwendung gehört.

Claude Haiku 5.5 ist noch nicht bei Anthropic verfügbar. Das ist keine Relativierung — es bedeutet, dass die Anthropic-Seite dieses Vergleichs direkt bei Anthropic erreicht werden muss und die DeepSeek-Seite nicht. Wenn Sie die günstige Tarifstufe der DeepSeek-Linie heute mit demselben Schlüssel wie den Rest Ihres Stacks nutzen möchten, ist dieser Teil bereits live.

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Welches soll man wählen?

Wenn deine Aufrufe kurz sind – Klassifizierung, Extraktion, Routing, Zusammenfassung, Subagent-Turns – und unter 100.000 Tokens liegen, ist Claude Haiku 5.5 jetzt das günstigere Modell auf beiden Messskalen und das stärkere auf dem unabhängigen Board, und die Sache ist eindeutig. Es ist außerdem das einzige der beiden, das ein Bild entgegennimmt.

Wenn Ihre Aufrufe lang sind, wenn Sie ein großes gemeinsam genutztes Präfix erneut senden oder wenn Sie planen können, geht die Rechnung in die andere Richtung – und das mit großem Abstand: Die zwischengespeicherte Eingabe von DeepSeek zu 0,003 $ außerhalb der Spitzenzeiten liegt um eine Größenordnung unter den 0,01 $ von Anthropic, seine Obergrenze für die Ausgabe ist dreimal so hoch, und sein Rabatt außerhalb der Spitzenzeiten ist ein Planungsproblem und keine Produktbeschränkung.

Was der Launch tatsächlich geklärt hat, ist enger gefasst als „Ant​hropic ist jetzt günstig“. Geklärt hat er, dass die amerikanischen Labore im Kurz-Prompt-Fall ihre Preise unter denen der chinesischen Labore ansetzen werden und dass im Kurz-Prompt-Fall der Großteil des Produktionsverkehrs anfällt. Alles jenseits von 100.000 Tokens ist weiterhin der Markt des anderen Modells.