
Claude Haiku 5.5 kontra DeepSeek V4 Flash: Anthropic właśnie przebił dolną granicę cenową
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Przez dwa lata tania półka rynku miała kształt, który wszyscy znali: amerykańskie laboratoria liczyły sobie więcej, a chińskie mniej, i odpowiednio wybierało się stronę. Claude Haiku 5.5przełamał to 7 października 2026 roku, wchodząc na rynek z ceną 0,10 USD za milion tokenów wejściowych i 0,50 USD za milion tokenów wyjściowych — czyli poniżej publikowanej stawki DeepSeek V4 Flash, modelu, który od lata jest punktem odniesienia dla tanich rozwiązań.
To węższe zwycięstwo, niż to brzmi, a powody są warte więcej niż nagłówek. Stawka Anthropic obowiązuje tylko dla promptów do 100 000 tokenów. Powyżej tego staje się 0,50 USD i 2,50 USD, co jest kilkukrotnie wyższe niż cena DeepSeek. A własna karta DeepSeek ma kształt, którego nikt nie kopiuje: podwaja się w dwóch oknach w dni robocze. Dwóch dostawców, dwie zupełnie różne idee tego, co oznacza „tanio”.
Co faktycznie publikuje każdy dostawca
Za milion tokenów, w dolarach amerykańskich. Dane Anthropic pochodzą z dokumentacji cenowej Anthropic; dane DeepSeek pochodzą z własnej strony Models & Pricing firmy DeepSeek, która jest autorytatywnym cennikiem dla tego modelu.

• Dane wejściowe — Claude Haiku 5.5: 0,10 USD do 100 000 tokenów, 0,50 USD powyżej. DeepSeek V4 Flash: 0,15 USD poza szczytem, 0,30 USD w oknach szczytowych.
• Wynik — Claude Haiku 5.5 0,50 USD do 100 000 tokenów, 2,50 USD powyżej. DeepSeek V4 Flash 0,60 USD poza godzinami szczytu, 1,20 USD w godzinach szczytu.
• Dane wejściowe z pamięci podręcznej — Claude Haiku 5.5 0,01 USD do 100 000 tokenów i 0,05 USD powyżej. DeepSeek V4 Flash 0,003 USD poza szczytem i 0,006 USD w szczycie, co czyni go ponad trzykrotnie tańszym.
• Okna szczytowe — Anthropic ich nie ma; stawka zmienia się wraz z długością promptu i niczym innym. DeepSeek podwaja stawkę między 01:00 a 04:00 oraz ponownie między 06:00 a 10:00 UTC, od poniedziałku do piątku, z wyłączeniem chińskich świąt publicznych.
• Kontekst i wyjście — 1 mln tokenów i maksymalnie 128 000 tokenów wyjściowych dla Claude Haiku 5.5; 1 mln tokenów i maksymalnie 384 000 tokenów wyjściowych dla DeepSeek V4 Flash.
• Modalność — Claude Haiku 5.5 przyjmuje tekst i obrazy; DeepSeek V4 Flash obsługuje wyłącznie tekst, a funkcje wizyjne należą do modelu siostrzanego, a nie do tego.
• Niezależny wynik — Artificial Analysis Intelligence Index v4.3.2 plasuje Claude Haiku 5.5 (Max) z wynikiem 43,40 na drugim miejscu wśród 182 modeli, a DeepSeek V4 Flash 0731 (Max) z wynikiem 34,33 na dziesiątym miejscu wśród 117.
• Szybkość — to samo źródło odnotowuje 241,9 tokenów wyjściowych na sekundę dla Claude Haiku 5.5 i 222,0 dla DeepSeek V4 Flash, drugiego najszybszego we własnym rankingu.
Crossover to cała historia
Ustaw obie karty w jednej linii przy pojedynczym żądaniu, a porównanie odwróci się dwukrotnie.
Poniżej 100 000 tokenów Anthropic jest tańszy i na obu licznikach, i na metce, która ma znaczenie: $0,10 wobec $0,15 za wejście, $0,50 wobec $0,60 za wyjście. To pierwszy raz, gdy mały model Anthropic zszedł poniżej stawki DeepSeek Flash na porównywalnych zasadach, i to jest fakt, od którego zaczyna się wpis ogłaszający premierę.
Powyżej 100 000 tokenów przewaga gwałtownie się odwraca. Koszt wejścia w Anthropic wynoszący 0,50 USD jest ponad trzykrotnie wyższy niż stawka DeepSeek poza godzinami szczytu, a koszt wyjścia w wysokości 2,50 USD jest ponad czterokrotnie od niej wyższy. Potok wyszukiwania lub przetwarzania długich dokumentów, który rutynowo składa prompty o długości 150 000 tokenów, wcale nie jest klientem Claude Haiku 5.5; jest klientem modelu, którego już używał.
A w dwóch oknach DeepSeek w dni powszednie drugie porównanie zwęża się z przeciwnego kierunku, ponieważ stawka samego DeepSeek podwaja się, a stawka Anthropic się nie zmienia. Żadna ze struktur tych dostawców nie jest lepsza sama w sobie. Jeden wycenia według tego, ile wysyłasz, drugi według tego, kiedy to wysyłasz, a tylko jeden z tych czynników jest pod twoją kontrolą w chwili składania żądania.
Ile kosztuje ukończone zadanie, która jest jedyną sprawiedliwą liczbą
Stawki cennikowe są naliczane za token, a oba modele nie generują tej samej liczby tokenów przy tej samej pracy. I tu arytmetyka premiery staje się niewygodna dla Anthropic.
Artificial Analysis wycenia Claude Haiku 5.5 (Max) na 0,21 USD za zadanie Intelligence Index, a DeepSeek V4 Flash 0731 (Max) na 0,22 USD za zadanie. Jedna dziesiąta stawki za dane wejściowe, szersze okno kontekstowe i 26-punktowa różnica w Intelligence Index — 43,40 wobec 34,33 — a zmierzony koszt wykonania jednego zadania mieści się w granicach centa od modelu, który miał przebić cenowo.
Powód jest na tej samej stronie. Oceniając Index, Claude Haiku 5.5 wygenerował 440 milionów tokenów wyjściowych wobec mediany 100 milionów, a oceniający nazywa go bardzo gadatliwym. DeepSeek V4 Flash wygenerował 240 milionów wobec mediany 140 milionów i również jest nazywany bardzo gadatliwym. Oba modele rozważają długo, oba rozliczają myślenie jako dane wyjściowe, a to dane wyjściowe są licznikiem decydującym o rachunku. Dziewięćdziesięcioprocentowe cięcie danych wejściowych jest realne i jest naliczane na mniejszej połowie faktury.
Jest jeszcze drugi, cichszy efekt. Własna dokumentacja Anthropic mówi, że Claude Haiku 5.5 używa nowszego tokenizera współdzielonego z Claude 4.7 i późniejszymi, więc ten sam tekst liczy się jako około 30% więcej tokenów niż w Claude Haiku 4.5. Stawka spadła dziesięciokrotnie; liczba tokenów nie spadła wcale, a w przypadku tego samego tekstu wzrosła.

Model kryjący się za nazwą DeepSeek również się zmienił.
Każdy, kto porównuje te dwa na podstawie kilkumiesięcznej tabeli benchmarków, powinien o tym wiedzieć, zanim to zrobi.
Strona cennika DeepSeek wymienia teraz deepseek-flashjako nazwę modelu, opartego na DeepSeek-V4.1-Flash, i podaje, że starszy deepseek-v4-flash identyfikator jest nadal akceptowany, ale „odpowiednie modele zostały wycofane” — żądania pod starą nazwą są obsługiwane przez nowszy model i rozliczane w cenie Flash. Innymi słowy, identyfikator zachował swoją nazwę, cenę i miejsce w ofercie, a wagi pod nim się zmieniły.
To nie jest krytyka; to ostrzeżenie o tym, czego dotyczy data w tabeli benchmarku. Cytowany w tym tekście wpis Artificial Analysis dotyczy wydania 0731 DeepSeek V4 Flash w konfiguracji Max, czyli modelu, który zmierzyła tablica, i nie jest automatycznie stwierdzeniem o tym, co dziś odpowiada temu identyfikatorowi. Claude Haiku 5.5 firmy Anthropic natomiast jest stałym identyfikatorem bez sufiksu daty i bez aliasu, a jego pozycja w Indexie jest datowana na tydzień jego własnej premiery.
Dwa modele, jeden punkt końcowy
Powód, dla którego to porównanie łatwo rozstrzygnąć samemu, a nie na podstawie karty specyfikacji, jest taki, że obie strony można wywołać z tego samego miejsca — z jednym wyjątkiem, który warto wspomnieć.
DeepSeek V4 Flash jest od dziś w katalogu OrcaRouter, a pod nim działa automatyczne przełączanie awaryjne, więc DeepSeek-ową część tego porównania możemy dziś rano wywołać, a nie tylko o niej czytać. Jedno zastrzeżenie warto powiedzieć wprost, zamiast zostawiać je wam do odkrycia: nasza własna stawka katalogowa dla tego modelu to 0,22 USD za wejście i 0,66 USD za wyjście za milion tokenów, co plasuje się powyżej poza szczytem w cenniku DeepSeek, a poniżej stawki szczytowej. To strona DeepSeek, a nie nasza, powinna być źródłem prawdy o strukturze szczytowej i pozaszczytowej, a nasza — jedną uśrednioną liczbą, od której można zacząć rozliczany przebieg. Claude Sonnet 5.5 i Claude Opus 5.5 również są w katalogu. Zatem porównanie A/B między odnogą DeepSeek Flash a odnogą Claude to jeden klucz i jedno SDK, a DSL routingu złoży je w jedno wywołanie, jeśli logika eskalacji należy do trasy, a nie do aplikacji.
Claude Haiku 5.5 nie ma jeszcze w katalogu. To nie jest asekuracja — oznacza to, że po stronie Anthropic w tym porównaniu trzeba obecnie sięgać bezpośrednio do Anthropic, a po stronie DeepSeek już nie. Jeśli chcesz już dziś mieć tani poziom linii DeepSeek na tym samym kluczu co reszta twojego stosu, ta część już działa.

Który wybrać
Jeśli Twoje wywołania są krótkie — klasyfikacja, ekstrakcja, routing, streszczanie, tury podagentów — i mieszczą się poniżej 100 000 tokenów, Claude Haiku 5.5 jest teraz tańszym modelem w obu licznikach i mocniejszym w niezależnym rankingu, a sprawa jest prosta. To także jedyny z tych dwóch, który przyjmuje obraz.
Jeśli Twoje wywołania są długie, jeśli ponownie wysyłasz duży współdzielony prefiks albo jeśli planujesz, kalkulacja wskazuje przeciwny kierunek i to ze znacznym marginesem: wejście z pamięci podręcznej DeepSeek poza godzinami szczytu w cenie 0,003 USD jest o rząd wielkości poniżej 0,01 USD Antropic, jego limit wyjściowy jest trzykrotnie wyższy, a zniżka poza godzinami szczytu to problem planowania, a nie ograniczenie produktu.
To, co faktycznie rozstrzygnęła premiera, jest węższe niż „Antropic jest tani”. Rozstrzygnęła, że amerykańskie modele będą tańsze od chińskich w przypadku krótkich promptów oraz że krótkie prompty stanowią większość ruchu produkcyjnego. Wszystko powyżej 100 000 tokenów nadal należy do drugiego modelu.
