Wygenerowana karta hero dla „Amerykański mały model jest teraz tańszy”, z plakietką „PODŁOGA CENOWA”, nadtytułem „7 PAŹDZIERNIKA 2026” i podtytułem „Claude Haiku 5.5 za $0.10 i $0.50 wobec DeepSeek V4 Flash – do 100 000 tokenów”. Cztery chipy mają napisy „$0.10 vs $0.15 na wejściu”, „$0.50 vs $0.60 na wyjściu”, „krok 100K” i „okna szczytowe”. Dwie karty poniżej są oznaczone „PONIŻEJ 100 000 TOKENÓW” („Anthropic wypada taniej w obu miernikach”) i „POWYŻEJ TEGO” („DeepSeek jest od trzech do czterech razy tańszy”). Stopka głosi „Opublikowane stawki cennikowe dostawców odczytane 8 października 2026 r.”. Logo OrcaRouter jest wkomponowane w prawym dolnym rogu.
Guides & Insights

Claude Haiku 5.5 kontra DeepSeek V4 Flash: Anthropic właśnie przebił dolną granicę cenową

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Przez dwa lata tania półka rynku miała kształt, który wszyscy znali: amerykańskie laboratoria liczyły sobie więcej, a chińskie mniej, i odpowiednio wybierało się stronę. Claude Haiku 5.5przełamał to 7 października 2026 roku, wchodząc na rynek z ceną 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych — czyli poniżej publikowanej stawki DeepSeek V4 Flash, modelu, który od lata jest punktem odniesienia dla tanich rozwiązań.

To węższe zwycięstwo, niż to brzmi, a powody są warte więcej niż nagłówek. Stawka Ant​hropic obowiązuje tylko dla promptów do 100 000 tokenów. Powyżej tego staje się 0,50 USD i 2,50 USD, co jest kilkukrotnie wyższe niż cena Dee​pSeek. A własna karta Dee​pSeek ma kształt, którego nikt nie kopiuje: podwaja się w dwóch oknach w dni robocze. Dwóch dostawców, dwie zupełnie różne idee tego, co oznacza „tanio”.

Co faktycznie publikuje każdy dostawca

Za milion tokenów, w dolarach amerykańskich. Dane Ant​hropic pochodzą z dokumentacji cenowej Ant​hropic; dane Dee​pSeek pochodzą z własnej strony Models & Pricing firmy Dee​pSeek, która jest autorytatywnym cennikiem dla tego modelu.

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• Dane wejściowe — Claude Haiku 5.5: 0,10 USD do 100 000 tokenów, 0,50 USD powyżej. DeepSeek V4 Flash: 0,15 USD poza szczytem, 0,30 USD w oknach szczytowych.

• Wynik — Claude Haiku 5.5 0,50 USD do 100 000 tokenów, 2,50 USD powyżej. DeepSeek V4 Flash 0,60 USD poza godzinami szczytu, 1,20 USD w godzinach szczytu.

• Dane wejściowe z pamięci podręcznej — Claude Haiku 5.5 0,01 USD do 100 000 tokenów i 0,05 USD powyżej. DeepSeek V4 Flash 0,003 USD poza szczytem i 0,006 USD w szczycie, co czyni go ponad trzykrotnie tańszym.

• Okna szczytowe — Ant​hropic ich nie ma; stawka zmienia się wraz z długością promptu i niczym innym. Dee​pSeek podwaja stawkę między 01:00 a 04:00 oraz ponownie między 06:00 a 10:00 UTC, od poniedziałku do piątku, z wyłączeniem chińskich świąt publicznych.

• Kontekst i wyjście — 1 mln tokenów i maksymalnie 128 000 tokenów wyjściowych dla Claude Haiku 5.5; 1 mln tokenów i maksymalnie 384 000 tokenów wyjściowych dla DeepSeek V4 Flash.

• Modalność — Claude Haiku 5.5 przyjmuje tekst i obrazy; DeepSeek V4 Flash obsługuje wyłącznie tekst, a funkcje wizyjne należą do modelu siostrzanego, a nie do tego.

• Niezależny wynik — Artificial Analysis Intelligence Index v4.3.2 plasuje Claude Haiku 5.5 (Max) z wynikiem 43,40 na drugim miejscu wśród 182 modeli, a DeepSeek V4 Flash 0731 (Max) z wynikiem 34,33 na dziesiątym miejscu wśród 117.

• Szybkość — to samo źródło odnotowuje 241,9 tokenów wyjściowych na sekundę dla Claude Haiku 5.5 i 222,0 dla DeepSeek V4 Flash, drugiego najszybszego we własnym rankingu.

Crossover to cała historia

Ustaw obie karty w jednej linii przy pojedynczym żądaniu, a porównanie odwróci się dwukrotnie.

Poniżej 100 000 tokenów Ant​hropic jest tańszy i na obu licznikach, i na metce, która ma znaczenie: $0,10 wobec $0,15 za wejście, $0,50 wobec $0,60 za wyjście. To pierwszy raz, gdy mały model Ant​hropic zszedł poniżej stawki Dee​pSeek Flash na porównywalnych zasadach, i to jest fakt, od którego zaczyna się wpis ogłaszający premierę.

Powyżej 100 000 tokenów przewaga gwałtownie się odwraca. Koszt wejścia w Anthropic wynoszący 0,50 USD jest ponad trzykrotnie wyższy niż stawka DeepSeek poza godzinami szczytu, a koszt wyjścia w wysokości 2,50 USD jest ponad czterokrotnie od niej wyższy. Potok wyszukiwania lub przetwarzania długich dokumentów, który rutynowo składa prompty o długości 150 000 tokenów, wcale nie jest klientem Claude Haiku 5.5; jest klientem modelu, którego już używał.

A w dwóch oknach Dee​pSeek w dni powszednie drugie porównanie zwęża się z przeciwnego kierunku, ponieważ stawka samego Dee​pSeek podwaja się, a stawka Ant​hropic się nie zmienia. Żadna ze struktur tych dostawców nie jest lepsza sama w sobie. Jeden wycenia według tego, ile wysyłasz, drugi według tego, kiedy to wysyłasz, a tylko jeden z tych czynników jest pod twoją kontrolą w chwili składania żądania.

Ile kosztuje ukończone zadanie, która jest jedyną sprawiedliwą liczbą

Stawki cennikowe są naliczane za token, a oba modele nie generują tej samej liczby tokenów przy tej samej pracy. I tu arytmetyka premiery staje się niewygodna dla Anthropic.

Artificial Analysis wycenia Claude Haiku 5.5 (Max) na 0,21 USD za zadanie Intelligence Index, a DeepSeek V4 Flash 0731 (Max) na 0,22 USD za zadanie. Jedna dziesiąta stawki za dane wejściowe, szersze okno kontekstowe i 26-punktowa różnica w Intelligence Index — 43,40 wobec 34,33 — a zmierzony koszt wykonania jednego zadania mieści się w granicach centa od modelu, który miał przebić cenowo.

Powód jest na tej samej stronie. Oceniając Index, Claude Haiku 5.5 wygenerował 440 milionów tokenów wyjściowych wobec mediany 100 milionów, a oceniający nazywa go bardzo gadatliwym. DeepSeek V4 Flash wygenerował 240 milionów wobec mediany 140 milionów i również jest nazywany bardzo gadatliwym. Oba modele rozważają długo, oba rozliczają myślenie jako dane wyjściowe, a to dane wyjściowe są licznikiem decydującym o rachunku. Dziewięćdziesięcioprocentowe cięcie danych wejściowych jest realne i jest naliczane na mniejszej połowie faktury.

Jest jeszcze drugi, cichszy efekt. Własna dokumentacja Anthropic mówi, że Claude Haiku 5.5 używa nowszego tokenizera współdzielonego z Claude 4.7 i późniejszymi, więc ten sam tekst liczy się jako około 30% więcej tokenów niż w Claude Haiku 4.5. Stawka spadła dziesięciokrotnie; liczba tokenów nie spadła wcale, a w przypadku tego samego tekstu wzrosła.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Model kryjący się za nazwą Dee​pSeek również się zmienił.

Każdy, kto porównuje te dwa na podstawie kilkumiesięcznej tabeli benchmarków, powinien o tym wiedzieć, zanim to zrobi.

Strona cennika Dee​pSeek wymienia teraz deepseek-flashjako nazwę modelu, opartego na Dee​pSeek-V4.1-Flash, i podaje, że starszy deepseek-v4-flash identyfikator jest nadal akceptowany, ale „odpowiednie modele zostały wycofane” — żądania pod starą nazwą są obsługiwane przez nowszy model i rozliczane w cenie Flash. Innymi słowy, identyfikator zachował swoją nazwę, cenę i miejsce w ofercie, a wagi pod nim się zmieniły.

To nie jest krytyka; to ostrzeżenie o tym, czego dotyczy data w tabeli benchmarku. Cytowany w tym tekście wpis Artificial Analysis dotyczy wydania 0731 DeepSeek V4 Flash w konfiguracji Max, czyli modelu, który zmierzyła tablica, i nie jest automatycznie stwierdzeniem o tym, co dziś odpowiada temu identyfikatorowi. Claude Haiku 5.5 firmy Ant​hropic natomiast jest stałym identyfikatorem bez sufiksu daty i bez aliasu, a jego pozycja w Indexie jest datowana na tydzień jego własnej premiery.

Dwa modele, jeden punkt końcowy

Powód, dla którego to porównanie łatwo rozstrzygnąć samemu, a nie na podstawie karty specyfikacji, jest taki, że obie strony można wywołać z tego samego miejsca — z jednym wyjątkiem, który warto wspomnieć.

DeepSeek V4 Flash jest od dziś w katalogu OrcaRouter, a pod nim działa automatyczne przełączanie awaryjne, więc DeepSeek-ową część tego porównania możemy dziś rano wywołać, a nie tylko o niej czytać. Jedno zastrzeżenie warto powiedzieć wprost, zamiast zostawiać je wam do odkrycia: nasza własna stawka katalogowa dla tego modelu to 0,22 USD za wejście i 0,66 USD za wyjście za milion tokenów, co plasuje się powyżej poza szczytem w cenniku DeepSeek, a poniżej stawki szczytowej. To strona DeepSeek, a nie nasza, powinna być źródłem prawdy o strukturze szczytowej i pozaszczytowej, a nasza — jedną uśrednioną liczbą, od której można zacząć rozliczany przebieg. Claude Sonnet 5.5 i Claude Opus 5.5 również są w katalogu. Zatem porównanie A/B między odnogą DeepSeek Flash a odnogą Claude to jeden klucz i jedno SDK, a DSL routingu złoży je w jedno wywołanie, jeśli logika eskalacji należy do trasy, a nie do aplikacji.

Claude Haiku 5.5 nie ma jeszcze w katalogu. To nie jest asekuracja — oznacza to, że po stronie Ant​hropic w tym porównaniu trzeba obecnie sięgać bezpośrednio do Ant​hropic, a po stronie Dee​pSeek już nie. Jeśli chcesz już dziś mieć tani poziom linii Dee​pSeek na tym samym kluczu co reszta twojego stosu, ta część już działa.

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Który wybrać

Jeśli Twoje wywołania są krótkie — klasyfikacja, ekstrakcja, routing, streszczanie, tury podagentów — i mieszczą się poniżej 100 000 tokenów, Claude Haiku 5.5 jest teraz tańszym modelem w obu licznikach i mocniejszym w niezależnym rankingu, a sprawa jest prosta. To także jedyny z tych dwóch, który przyjmuje obraz.

Jeśli Twoje wywołania są długie, jeśli ponownie wysyłasz duży współdzielony prefiks albo jeśli planujesz, kalkulacja wskazuje przeciwny kierunek i to ze znacznym marginesem: wejście z pamięci podręcznej Dee​pSeek poza godzinami szczytu w cenie 0,003 USD jest o rząd wielkości poniżej 0,01 USD Ant​ropic, jego limit wyjściowy jest trzykrotnie wyższy, a zniżka poza godzinami szczytu to problem planowania, a nie ograniczenie produktu.

To, co faktycznie rozstrzygnęła premiera, jest węższe niż „Ant​ropic jest tani”. Rozstrzygnęła, że amerykańskie modele będą tańsze od chińskich w przypadku krótkich promptów oraz że krótkie prompty stanowią większość ruchu produkcyjnego. Wszystko powyżej 100 000 tokenów nadal należy do drugiego modelu.