
Claude Haiku 5.5 vs Gemini 3.8 Flash: dwa punkty w indeksie, sześciokrotny koszt na zadanie
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Claude Haiku 5.5 i Gemini 3.8 Flash są bliżej siebie pod względem zmierzonych możliwości niż jakakolwiek inna para w tym przedziale cenowym — 43,40 wobec 40,93 w Artificial Analysis Intelligence Index v4.3.2, oba znalazły się w pierwszej pięćdziesiątce rankingu 225 modeli. Różni je to, ile kosztuje jeden z tych punktów indeksu. W tym samym niezależnym pomiarze ukończone zadanie Intelligence Index kosztuje 0,21 USD w Claude Haiku 5.5 i 1,24 USD w Gemini 3.8 Flash.
To sześciokrotna przepaść przy różnicy w punktacji wynoszącej dwa i pół punktu — i to właśnie ta liczba powinna rozstrzygnąć to porównanie. Wszystko inne — stawki cennikowe, lista modalności, terminy powiązane z cennikiem Google'a — to spór o szczegóły.
Oba modele, jeśli chodzi o liczby, które mają znaczenie
Za milion tokenów w dolarach amerykańskich, na podstawie dokumentacji cenowej samych Anthropic i Google, z niezależnymi pomiarami przypisywanymi Artificial Analysis. Dane z pamięci podręcznej z 2026-10-08.

• Wejście — Claude Haiku 5.5: 0,10 USD do 100 000 tokenów i 0,50 USD powyżej; Gemini 3.8 Flash: 0,75 USD ryczałtowo, od 1 stycznia 2027 r. wzrośnie do 1,50 USD.
• Dane wyjściowe — Claude Haiku 5.5: 0,50 USD za maksymalnie 100 000 tokenów i 2,50 USD powyżej; Gemini 3.8 Flash: stawka stała 3,75 USD, rosnąca do 7,50 USD tego samego dnia.
• Buforowane dane wejściowe — Claude Haiku 5.5 0,01 USD i 0,05 USD; Gemini 3.8 Flash 0,075 USD, plus opłata za przechowywanie w wysokości 0,50 USD za milion tokenów na godzinę.
• Kontekst — 1 mln tokenów dla obu. Maksymalna odpowiedź — 128 000 tokenów dla Claude Haiku 5.5 w porównaniu do 65 536 dla Gemini 3.8 Flash.
• Modalność wejściowa — tekst i obrazy dla Claude Haiku 5.5; tekst, obrazy, mowa i wideo dla Gemini 3.8 Flash. To jedyna pozycja, w której lista Google jest ściśle dłuższa.
• Niezależny wynik — 43,40 dla Claude Haiku 5.5 (Max) wobec 40,93 dla Gemini 3.8 Flash (High), w Intelligence Index v4.3.2.
• Niezależny koszt jednego zadania — $0,21 wobec $1,24 na tej samej płytce.
• Szybkość — 241,9 tokena wyjściowego na sekundę w porównaniu ze 125,2, oba zmierzone przez Artificial Analysis.
Skąd bierze się sześciokrotność
Luka w koszcie przypadającym na zadanie jest większa niż luka w cenie z metki, a to właśnie jest interesujące, ponieważ oznacza to, że sam cennik stawek tego nie wyjaśnia.
Arytmetyka z metki jest dość prosta: $0,10 wobec $0,75 na wejściu to siedem i pół razy taniej, a $0,50 wobec $3,75 na wyjściu to ten sam stosunek. Gdyby oba modele generowały tę samą liczbę tokenów dla tej samej pracy, ten stosunek przełożyłby się wprost na fakturę.
Nie przekłada się to jednak na wynik, a oba efekty działają na korzyść Google. Claude Haiku 5.5 jest rozwlekły, co przyznaje jego własny dostawca: Artificial Analysis odnotował 440 milionów tokenów wyjściowych podczas przeprowadzania Index, wobec mediany 100 milionów, i nazywa ten model bardzo rozwlekłym. Gemini 3.8 Flash wygenerował 170 milionów wobec mediany 81 milionów — również oznaczony jako rozwlekły, ale to jedna trzecia liczby tokenów. Własna dokumentacja Anthropic dodaje drugi efekt: Claude Haiku 5.5 korzysta z nowszego tokenizatora współdzielonego z Claude 4.7 i nowszymi, więc ten sam tekst liczy się jako około 30% więcej tokenów niż w modelu, który zastępuje.
Podsumowując, uczciwa wersja twierdzenia o cenniku jest taka: przewaga dziesięć do jednego w stawce wejściowej i siedem i pół do jednego w stawce wyjściowej, które częściowo pochłania model piszący więcej tokenów na odpowiedź, co daje przewagę sześć do jednego w pomiarze rozliczającym całe zadanie. Wciąż pogrom, i to mniejszy, niż sugeruje cennik.
Cena Google ma na sobie datę.
Najbardziej przydatną rzeczą na stronie cennika Google jest zdanie, które większość tabel porównawczych pomija.
Gemini 3.8 Flash jest wyceniony na 0,75 USD za wejście i 3,75 USD za wyjście „do 31 grudnia 2026 r.”, a od 1 stycznia 2027 r. na 1,50 USD i 7,50 USD. Wejście z pamięci podręcznej zmienia się z 0,075 USD na 0,15 USD w tym samym dniu. To stawka wprowadzająca z wydrukowanym obok terminem ważności, około jedenastu tygodni od chwili pisania tego tekstu.
Nic w karcie Anthropic nie brzmi w ten sposób. Stawki Claude Haiku 5.5 są podane wprost jako stawki, z dwupoziomową strukturą uzależnioną od długości promptu, a nie od kalendarza, oraz z zobowiązaniem do wycofania nie wcześniej niż 7 października 2027 r. Jeśli modelujesz pipeline, który będzie działał w przyszłym roku, styczniowy krok Google'a to podwojenie i powinien znaleźć się w modelu; Anthropic nie ma odpowiednika takiego zdarzenia, które trzeba by uwzględnić w planach.
To działa w obie strony, a uczciwa interpretacja nie brzmi: „jeden dostawca jest uczciwy, a drugi nie”. Stawka promocyjna jest prawdziwą stawką tak długo, jak długo obowiązuje, a Google ma prawo wycenić premierę w ten sposób. To po prostu fakt dotyczący tego porównania, że ta wyglądająca na tańszą strona styczniowych liczb jest tą z terminem.

Ile warte są dwa punkty indeksu
Luka wynosząca 2,47 punktu w indeksie, który sięga sześćdziesiątek, nie jest błędem zaokrąglenia ani przepaścią. Oba modele mieszczą się w tym samym przedziale roboczym, a praktyczne pytanie brzmi, czy ta różnica ujawnia się w zadaniach, które faktycznie wykonujesz.
Według danych samych producentów te dwa modele nie są mierzone na tym samym środowisku testowym, więc nie można ich zestawić bezpośrednio — Anthropic publikuje wyniki GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 i FrontierCode dla Claude Haiku 5.5, a Google publikuje własny zestaw dla Gemini 3.8 Flash, przy czym żaden z producentów nie uruchomił zestawu drugiego. Jedynym dostępnym porównaniem jabłko do jabłka jest niezależny ranking, a tam odpowiedź brzmi: Anthropic jest z przodu o margines wymierny, lecz niewielki.
Różnica w możliwościach, która dla niektórych zespołów będzie miała większe znaczenie, dotyczy obsługiwanych modalności. Gemini 3.8 Flash przyjmuje dane wejściowe w postaci mowy i wideo; Claude Haiku 5.5 przyjmuje tekst i obrazy. Pipeline, który natywnie przyjmuje nagrania rozmów lub przechwytywanie ekranu, wcale nie wybiera między tymi dwoma modelami na podstawie ceny — jeden z nich nie może wykonać zadania bez poprzedzającego go etapu transkrypcji lub ekstrakcji klatek, a ten etap ma własny koszt i własne tryby awarii.
Prowadzenie tańszej strony pary
Gemini 3.8 Flash jest w katalogu OrcaRouter w cenie katalogowej Google z 0% marży, co ma tu większe znaczenie niż zwykle: stawka dostawcy jest przekazywana bezpośrednio, a nie uśredniana, więc jeśli chcesz zobaczyć, co styczniowa zmiana faktycznie robi z rachunkiem, liczba zmienia się wtedy, gdy zmienia się u Google. Claude Sonnet 5.5 i Claude Opus 5.5 również znajdują się w katalogu, co sprawia, że trójdrożny test routingu — segment Flash od Google, średnia warstwa Anthropic, a później mała warstwa Anthropic — to konfiguracja, a nie projekt. Jeden klucz, jeden SDK, automatyczne przełączanie awaryjne pod spodem oraz DSL routingu, jeśli wolisz wyrazić eskalację w trasie, a nie w kodzie aplikacji.
Sam Claude Haiku 5.5 nie znajduje się jeszcze w katalogu i lepiej powiedzieć to wprost, niż pozostawiać tę kwestię niejasną. Część Anthropic w tym porównaniu jest obecnie osiągalna wyłącznie u Anthropic, natomiast część Google można wywołać u nas już dziś w cenie pokazanej powyżej.

Który z nich i dla kogo
Jeśli Twoja praca polega na tekście na wejściu i tekście na wyjściu, Twoje prompty mieszczą się poniżej 100 000 tokenów, a płacisz za token przy rzeczywistym wolumenie, Claude Haiku 5.5 jest tańszym modelem pod każdym względem w tym artykule i tym z wyższym wynikiem na jedynym wspólnym rankingu — z zastrzeżeniem, że przewaga jest sześciokrotna w koszcie na zadanie, a nie dziesięciokrotna, jak sugeruje metka cenowa.
Jeśli potrzebujesz wejścia audio lub wideo, albo potrzebujesz odpowiedzi ponad 65 tys., albo Twoje prompty regularnie bywają długie, rachunek się zmienia: Gemini 3.8 Flash przyjmuje dane wejściowe, których mały poziom Anthropic nie może przyjąć, a powyżej 100 000 tokenów drugi poziom samego Anthropic jest wyceniony znacznie powyżej stałej stawki Google.
Jedyna rzecz, której trzeba się trzymać, to daty. Stawka Google'a obowiązuje do końca roku, a po nim się podwaja. Stawka Anthropic jest podana jako stała z progiem długości. Niezależnie od tego, po której stronie się znajdziesz, wbuduj kalendarz w arkusz, zanim zbudujesz potok.
