Wygenerowana karta hero dla „Sześciokrotny koszt za dwa punkty indeksu”, z plakietką „KOSZT NA ZADANIE”, zajawką „DWA MODELE KLASY FLASH, JEDNA TABLICA” i podtytułem „Claude Haiku 5.5 z wynikiem 43,40 przeciwko Gemini 3.8 Flash z 40,93 w Intelligence Index v4.3.2”. Cztery chipy głoszą „43,40 vs 40,93”, „0,21 USD vs 1,24 USD”, „0,10 USD vs 0,75 USD” oraz „wzrost od 1 stycznia 2027”. Dwie karty poniżej są oznaczone „PRZEWAGA ANTHROPIC” („wyżej na wspólnej tablicy i sześć razy taniej za ukończone zadanie”) oraz „PRZEWAGA GOOGLE” („obsługa mowy i wideo na wejściu oraz stała stawka w całym oknie”). Stopka głosi „Niezależne pomiary od Artificial Analysis; ceny katalogowe odczytane 8 października 2026 r.”. Logo OrcaRouter jest nałożone w prawym dolnym narożniku.
Guides & Insights

Claude Haiku 5.5 vs Gemini 3.8 Flash: dwa punkty w indeksie, sześciokrotny koszt na zadanie

Autor

Alistair Wren

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Claude Haiku 5.5 i Gemini 3.8 Flash są bliżej siebie pod względem zmierzonych możliwości niż jakakolwiek inna para w tym przedziale cenowym — 43,40 wobec 40,93 w Artificial Analysis Intelligence Index v4.3.2, oba znalazły się w pierwszej pięćdziesiątce rankingu 225 modeli. Różni je to, ile kosztuje jeden z tych punktów indeksu. W tym samym niezależnym pomiarze ukończone zadanie Intelligence Index kosztuje 0,21 USD w Claude Haiku 5.5 i 1,24 USD w Gemini 3.8 Flash.

To sześciokrotna przepaść przy różnicy w punktacji wynoszącej dwa i pół punktu — i to właśnie ta liczba powinna rozstrzygnąć to porównanie. Wszystko inne — stawki cennikowe, lista modalności, terminy powiązane z cennikiem Google'a — to spór o szczegóły.

Oba modele, jeśli chodzi o liczby, które mają znaczenie

Za milion tokenów w dolarach amerykańskich, na podstawie dokumentacji cenowej samych Ant​hropic i Google, z niezależnymi pomiarami przypisywanymi Artificial Analysis. Dane z pamięci podręcznej z 2026-10-08.

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.8 Flash - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.8 Flash reads input $0.75 now and $1.50 after January 1 2027, output $3.75 and $7.50, cached input $0.075 plus storage, maximum output 65,536 tokens, input modality text images speech and video, Intelligence Index v4.3.2 40.93, cost per task $1.24. A footer reads 'Vendors' published list rates; Google's lower rate runs through December 31, 2026; independent scores from Artificial Analysis.'

• Wejście — Claude Haiku 5.5: 0,10 USD do 100 000 tokenów i 0,50 USD powyżej; Gemini 3.8 Flash: 0,75 USD ryczałtowo, od 1 stycznia 2027 r. wzrośnie do 1,50 USD.

• Dane wyjściowe — Claude Haiku 5.5: 0,50 USD za maksymalnie 100 000 tokenów i 2,50 USD powyżej; Gemini 3.8 Flash: stawka stała 3,75 USD, rosnąca do 7,50 USD tego samego dnia.

• Buforowane dane wejściowe — Claude Haiku 5.5 0,01 USD i 0,05 USD; Gemini 3.8 Flash 0,075 USD, plus opłata za przechowywanie w wysokości 0,50 USD za milion tokenów na godzinę.

• Kontekst — 1 mln tokenów dla obu. Maksymalna odpowiedź — 128 000 tokenów dla Claude Haiku 5.5 w porównaniu do 65 536 dla Gemini 3.8 Flash.

• Modalność wejściowa — tekst i obrazy dla Claude Haiku 5.5; tekst, obrazy, mowa i wideo dla Gemini 3.8 Flash. To jedyna pozycja, w której lista Google jest ściśle dłuższa.

• Niezależny wynik — 43,40 dla Claude Haiku 5.5 (Max) wobec 40,93 dla Gemini 3.8 Flash (High), w Intelligence Index v4.3.2.

• Niezależny koszt jednego zadania — $0,21 wobec $1,24 na tej samej płytce.

• Szybkość — 241,9 tokena wyjściowego na sekundę w porównaniu ze 125,2, oba zmierzone przez Artificial Analysis.

Skąd bierze się sześciokrotność

Luka w koszcie przypadającym na zadanie jest większa niż luka w cenie z metki, a to właśnie jest interesujące, ponieważ oznacza to, że sam cennik stawek tego nie wyjaśnia.

Arytmetyka z metki jest dość prosta: $0,10 wobec $0,75 na wejściu to siedem i pół razy taniej, a $0,50 wobec $3,75 na wyjściu to ten sam stosunek. Gdyby oba modele generowały tę samą liczbę tokenów dla tej samej pracy, ten stosunek przełożyłby się wprost na fakturę.

Nie przekłada się to jednak na wynik, a oba efekty działają na korzyść Google. Claude Haiku 5.5 jest rozwlekły, co przyznaje jego własny dostawca: Artificial Analysis odnotował 440 milionów tokenów wyjściowych podczas przeprowadzania Index, wobec mediany 100 milionów, i nazywa ten model bardzo rozwlekłym. Gemini 3.8 Flash wygenerował 170 milionów wobec mediany 81 milionów — również oznaczony jako rozwlekły, ale to jedna trzecia liczby tokenów. Własna dokumentacja Ant​hropic dodaje drugi efekt: Claude Haiku 5.5 korzysta z nowszego tokenizatora współdzielonego z Claude 4.7 i nowszymi, więc ten sam tekst liczy się jako około 30% więcej tokenów niż w modelu, który zastępuje.

Podsumowując, uczciwa wersja twierdzenia o cenniku jest taka: przewaga dziesięć do jednego w stawce wejściowej i siedem i pół do jednego w stawce wyjściowej, które częściowo pochłania model piszący więcej tokenów na odpowiedź, co daje przewagę sześć do jednego w pomiarze rozliczającym całe zadanie. Wciąż pogrom, i to mniejszy, niż sugeruje cennik.

Cena Google ma na sobie datę.

Najbardziej przydatną rzeczą na stronie cennika Google jest zdanie, które większość tabel porównawczych pomija.

Gemini 3.8 Flash jest wyceniony na 0,75 USD za wejście i 3,75 USD za wyjście „do 31 grudnia 2026 r.”, a od 1 stycznia 2027 r. na 1,50 USD i 7,50 USD. Wejście z pamięci podręcznej zmienia się z 0,075 USD na 0,15 USD w tym samym dniu. To stawka wprowadzająca z wydrukowanym obok terminem ważności, około jedenastu tygodni od chwili pisania tego tekstu.

Nic w karcie Ant​hropic nie brzmi w ten sposób. Stawki Claude Haiku 5.5 są podane wprost jako stawki, z dwupoziomową strukturą uzależnioną od długości promptu, a nie od kalendarza, oraz z zobowiązaniem do wycofania nie wcześniej niż 7 października 2027 r. Jeśli modelujesz pipeline, który będzie działał w przyszłym roku, styczniowy krok Google'a to podwojenie i powinien znaleźć się w modelu; Ant​hropic nie ma odpowiednika takiego zdarzenia, które trzeba by uwzględnić w planach.

To działa w obie strony, a uczciwa interpretacja nie brzmi: „jeden dostawca jest uczciwy, a drugi nie”. Stawka promocyjna jest prawdziwą stawką tak długo, jak długo obowiązuje, a Google ma prawo wycenić premierę w ten sposób. To po prostu fakt dotyczący tego porównania, że ta wyglądająca na tańszą strona styczniowych liczb jest tą z terminem.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table beneath it, with the per-million-token input, output and cache rates and the prompt-length threshold at which the second tier begins.

Ile warte są dwa punkty indeksu

Luka wynosząca 2,47 punktu w indeksie, który sięga sześćdziesiątek, nie jest błędem zaokrąglenia ani przepaścią. Oba modele mieszczą się w tym samym przedziale roboczym, a praktyczne pytanie brzmi, czy ta różnica ujawnia się w zadaniach, które faktycznie wykonujesz.

Według danych samych producentów te dwa modele nie są mierzone na tym samym środowisku testowym, więc nie można ich zestawić bezpośrednio — Anthropic publikuje wyniki GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 i FrontierCode dla Claude Haiku 5.5, a Google publikuje własny zestaw dla Gemini 3.8 Flash, przy czym żaden z producentów nie uruchomił zestawu drugiego. Jedynym dostępnym porównaniem jabłko do jabłka jest niezależny ranking, a tam odpowiedź brzmi: Anthropic jest z przodu o margines wymierny, lecz niewielki.

Różnica w możliwościach, która dla niektórych zespołów będzie miała większe znaczenie, dotyczy obsługiwanych modalności. Gemini 3.8 Flash przyjmuje dane wejściowe w postaci mowy i wideo; Claude Haiku 5.5 przyjmuje tekst i obrazy. Pipeline, który natywnie przyjmuje nagrania rozmów lub przechwytywanie ekranu, wcale nie wybiera między tymi dwoma modelami na podstawie ceny — jeden z nich nie może wykonać zadania bez poprzedzającego go etapu transkrypcji lub ekstrakcji klatek, a ten etap ma własny koszt i własne tryby awarii.

Prowadzenie tańszej strony pary

Gemini 3.8 Flash jest w katalogu OrcaRouter w cenie katalogowej Google z 0% marży, co ma tu większe znaczenie niż zwykle: stawka dostawcy jest przekazywana bezpośrednio, a nie uśredniana, więc jeśli chcesz zobaczyć, co styczniowa zmiana faktycznie robi z rachunkiem, liczba zmienia się wtedy, gdy zmienia się u Google. Claude Sonnet 5.5 i Claude Opus 5.5 również znajdują się w katalogu, co sprawia, że trójdrożny test routingu — segment Flash od Google, średnia warstwa Anthropic, a później mała warstwa Anthropic — to konfiguracja, a nie projekt. Jeden klucz, jeden SDK, automatyczne przełączanie awaryjne pod spodem oraz DSL routingu, jeśli wolisz wyrazić eskalację w trasie, a nie w kodzie aplikacji.

Sam Claude Haiku 5.5 nie znajduje się jeszcze w katalogu i lepiej powiedzieć to wprost, niż pozostawiać tę kwestię niejasną. Część Anthropic w tym porównaniu jest obecnie osiągalna wyłącznie u Anthropic, natomiast część Google można wywołać u nas już dziś w cenie pokazanej powyżej.

A screenshot of the OrcaRouter catalogue page for Gemini 3.8 Flash, showing the model identifier in provider-slash-model form, the provider Google, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Który z nich i dla kogo

Jeśli Twoja praca polega na tekście na wejściu i tekście na wyjściu, Twoje prompty mieszczą się poniżej 100 000 tokenów, a płacisz za token przy rzeczywistym wolumenie, Claude Haiku 5.5 jest tańszym modelem pod każdym względem w tym artykule i tym z wyższym wynikiem na jedynym wspólnym rankingu — z zastrzeżeniem, że przewaga jest sześciokrotna w koszcie na zadanie, a nie dziesięciokrotna, jak sugeruje metka cenowa.

Jeśli potrzebujesz wejścia audio lub wideo, albo potrzebujesz odpowiedzi ponad 65 tys., albo Twoje prompty regularnie bywają długie, rachunek się zmienia: Gemini 3.8 Flash przyjmuje dane wejściowe, których mały poziom Ant​hropic nie może przyjąć, a powyżej 100 000 tokenów drugi poziom samego Ant​hropic jest wyceniony znacznie powyżej stałej stawki Google.

Jedyna rzecz, której trzeba się trzymać, to daty. Stawka Google'a obowiązuje do końca roku, a po nim się podwaja. Stawka Ant​hropic jest podana jako stała z progiem długości. Niezależnie od tego, po której stronie się znajdziesz, wbuduj kalendarz w arkusz, zanim zbudujesz potok.