Eine generierte Hero-Karte für „Sechsmal die Kosten für zwei Punkte Index“, versehen mit dem Badge „KOSTEN PRO AUFGABE“, mit dem Aufmacher „ZWEI MODELLE DER FLASH-KLASSE, EIN BOARD“ und dem Untertitel „Claude Haiku 5.5 mit 43.40 gegen Gemini 3.8 Flash mit 40.93 auf dem Intelligence Index v4.3.2.“ Vier Chips zeigen „43.40 vs. 40.93“, „$0.21 vs. $1.24“, „$0.10 vs. $0.75“ und „steigt am 1. Jan. 2027“. Zwei Karten darunter sind mit „ANTHROPICS VORTEIL“ („höher auf dem gemeinsamen Board und sechsmal günstiger pro abgeschlossener Aufgabe“) und „GOOGLES VORTEIL“ („Sprach- und Videoeingabe sowie eine Pauschale über das gesamte Zeitfenster“) beschriftet. Eine Fußzeile lautet: „Unabhängige Messungen von Artificial Analysis; Listenpreise abgelesen am 8. Oktober 2026.“ Das OrcaRouter-Logo ist in der unteren rechten Ecke eingefügt.
Guides & Insights

Claude Haiku 5.5 vs Gemini 3.8 Flash: Zwei Indexpunkte, sechsmal die Kosten pro Aufgabe

Autor

Alistair Wren

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Claude Haiku 5.5 und Gemini 3.8 Flash liegen in ihrer gemessenen Leistungsfähigkeit näher beieinander als jedes andere Paar in diesem Preissegment – 43,40 gegenüber 40,93 im Artificial Analysis Intelligence Index v4.3.2, beide landeten in den Top 50 eines Boards mit 225 Modellen. Was sie unterscheidet, ist der Preis eines dieser Indexpunkte. Bei derselben unabhängigen Messung kostet eine abgeschlossene Intelligence-Index-Aufgabe 0,21 $ bei Claude Haiku 5.5 und 1,24 $ bei Gemini 3.8 Flash.

Das ist eine sechsfache Lücke bei einem Punkteunterschied von zweieinhalb Punkten, und es ist die Zahl, die diesen Vergleich entscheiden sollte. Alles andere – die Listenpreise, die Modalitätenliste, die an Googles Preisgestaltung geknüpften Fristen – ist ein Streit um die Ränder.

Beide Modelle, bei den Zahlen, auf die es ankommt

Pro Million Tokens in US-Dollar, aus Anthropics und Googles eigener Preisdokumentation, mit den unabhängigen Messungen, die Artificial Analysis zugeschrieben werden. Zwischengespeichert am 08.10.2026.

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.8 Flash - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.8 Flash reads input $0.75 now and $1.50 after January 1 2027, output $3.75 and $7.50, cached input $0.075 plus storage, maximum output 65,536 tokens, input modality text images speech and video, Intelligence Index v4.3.2 40.93, cost per task $1.24. A footer reads 'Vendors' published list rates; Google's lower rate runs through December 31, 2026; independent scores from Artificial Analysis.'

• Eingabe — Claude Haiku 5.5 0,10 $ bis zu 100.000 Tokens und 0,50 $ darüber; Gemini 3.8 Flash 0,75 $ pauschal, steigt am 1. Januar 2027 auf 1,50 $.

• Ausgabe — Claude Haiku 5.5: 0,50 $ bis zu 100.000 Tokens und 2,50 $ darüber; Gemini 3.8 Flash: 3,75 $ pauschal, steigt am selben Datum auf 7,50 $.

• Zwischengespeicherte Eingabe — Claude Haiku 5.5 0,01 $ und 0,05 $; Gemini 3.8 Flash 0,075 $, zuzüglich einer Speichergebühr von 0,50 $ pro Million Tokens pro Stunde.

Kontext — 1 pro Haus. Maximale Ausgabe — 128.000 Token für Claude Haiku 5.5 gegenüber 65.536 für Gemini 3.8 Flash.

• Eingabemodalität — Text und Bilder für Claude Haiku 5.5; Text, Bilder, Sprache und Video für Gemini 3.8 Flash. Dies ist die eine Zeile, in der Googles Liste strikt länger ist.

• Unabhängige Bewertung — 43,40 für Claude Haiku 5.5 (Max) gegenüber 40,93 für Gemini 3.8 Flash (High), auf dem Intelligence Index v4.3.2.

• Unabhängige Kosten pro Aufgabe — 0,21 $ gegenüber 1,24 $ auf demselben Board.

• Geschwindigkeit — 241,9 Ausgabe-Tokens pro Sekunde gegenüber 125,2, beide gemessen von Artificial Analysis.

Woher die sechsfache Zahl kommt

Die Lücke bei den Kosten pro Aufgabe ist größer als die Lücke beim Listenpreis, und das ist der interessante Teil, denn es bedeutet, dass die Preisliste allein sie nicht erklärt.

Die Rechnung auf dem Preisschild ist einfach genug: 0,10 $ gegenüber 0,75 $ beim Input sind siebeneinhalbmal günstiger, und 0,50 $ gegenüber 3,75 $ beim Output ergeben dasselbe Verhältnis. Wenn beide Modelle für dieselbe Arbeit dieselben Tokens generierten, würde sich dieses Verhältnis direkt bis zur Rechnung durchziehen.

Es setzt sich nicht durch, und beide Effekte begünstigen Google. Claude Haiku 5.5 ist geschwätzig – das räumt sein eigener Anbieter ein: Artificial Analysis verzeichnete beim Durchlauf des Index 440 Millionen Ausgabe-Tokens, verglichen mit einem Median von 100 Millionen, und bezeichnet das Modell als sehr geschwätzig. Gemini 3.8 Flash generierte 170 Millionen gegenüber einem Median von 81 Millionen – ebenfalls als geschwätzig eingestuft, aber nur ein Drittel der Token-Anzahl. Anthropics eigene Dokumentation fügt den zweiten Effekt hinzu: Claude Haiku 5.5 verwendet den neueren Tokenizer, den es mit Claude 4.7 und späteren Modellen teilt, sodass derselbe Text rund 30 % mehr Tokens zählt als bei dem Modell, das es ersetzt.

Zusammengenommen sieht die ehrliche Version der Preisbehauptung so aus: ein Zehn-zu-eins-Vorteil bei der Eingangsrate und ein Siebeneinhalb-zu-eins-Vorteil bei der Ausgangsrate, teilweise aufgezehrt von einem Modell, das pro Antwort mehr Tokens schreibt, sodass ein Sechs-zu-eins-Vorteil bei der Messgröße herauskommt, die den gesamten Auftrag abrechnet. Immer noch ein Kantersieg – und ein kleinerer, als die Tarifkarte nahelegt.

Auf Googles Preis steht ein Datum.

Das mit Abstand Nützlichste auf der Preisseite von Google ist ein Satz, den die meisten Vergleichstabellen weglassen.

Gemini 3.8 Flash ist mit 0,75 $ für die Eingabe und 3,75 $ für die Ausgabe „bis zum 31. Dezember 2026“ gelistet und mit 1,50 $ und 7,50 $ „ab dem 1. Januar 2027“. Der Preis für zwischengespeicherte Eingabe steigt am selben Datum von 0,075 $ auf 0,15 $. Das ist ein Einführungstarif mit einem daneben angegebenen Ablaufdatum, das von diesem Text aus gerechnet etwa elf Wochen entfernt liegt.

Nichts in der Modellkarte von Ant​hropic liest sich so. Die Preise von Claude Haiku 5.5 werden als die Preise ausgewiesen, mit einer zweistufigen Struktur, die sich nach der Prompt-Länge statt nach einem Kalender richtet, und einer Zusage, nicht vor dem 7. Oktober 2027 stillgelegt zu werden. Wenn Sie eine Pipeline modellieren, die bis ins nächste Jahr läuft, ist Googles Januar-Schritt eine Verdopplung und gehört ins Modell; Ant​hropic hat kein vergleichbares Ereignis, auf das man planen müsste.

Das gilt in beide Richtungen, und die faire Lesart ist nicht „ein Anbieter ist ehrlich und der andere nicht“. Ein Aktionspreis ist ein echter Preis, solange er gilt, und Google ist berechtigt, eine Markteinführung so zu bepreisen. Es ist schlicht eine Tatsache des Vergleichs, dass die günstiger wirkende Seite der Januar-Zahlen die mit der Frist ist.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table beneath it, with the per-million-token input, output and cache rates and the prompt-length threshold at which the second tier begins.

Was sind zwei Indexpunkte wert?

Eine Lücke von 2,47 Punkten auf einem Index, der bis in die Sechziger reicht, ist kein Rundungsfehler und auch keine Kluft. Beide Modelle liegen im selben Arbeitsbereich, und die praktische Frage ist, ob sich die Lücke bei den Aufgaben zeigt, die Sie tatsächlich ausführen.

Den eigenen Zahlen der Anbieter zufolge werden die beiden nicht auf derselben Testumgebung gemessen, daher lassen sie sich nicht direkt gegenüberstellen — Ant​hropic veröffentlicht GDPval-AA v2.1-, OSWorld 2.1-, Terminal-Bench 4.0- und FrontierCode-Ergebnisse für Claude Haiku 5.5, und Google veröffentlicht ein eigenes Set für Gemini 3.8 Flash, und keiner der beiden Anbieter hat die Testsuite des anderen ausgeführt. Der einzige verfügbare Vergleich von Gleichem mit Gleichem ist die unabhängige Rangliste, und dort lautet die Antwort, dass Ant​hropic mit einem messbaren, aber kleinen Vorsprung vorne liegt.

Der Fähigkeitsunterschied, der für manche Teams mehr zählen wird, betrifft die Modalitäten. Gemini 3.8 Flash akzeptiert Sprach- und Videoeingaben; Claude Haiku 5.5 akzeptiert Text und Bilder. Eine Pipeline, die Anrufaufzeichnungen oder Bildschirmaufnahmen nativ verarbeitet, entscheidet sich zwischen diesen beiden Modellen überhaupt nicht anhand des Preises — eines von ihnen kann die Aufgabe nicht ohne einen vorgeschalteten Transkriptions- oder Frame-Extraktionsschritt erledigen, und dieser Schritt hat seine eigenen Kosten und seine eigenen Fehlermodi.

Die günstigere Seite des Paares betreiben

Gemini 3.8 Flash ist im OrcaRouter-Katalog zum Google-Listenpreis mit 0 % Aufschlag vertreten, was hier mehr als sonst zählt: Der Tarif des Anbieters wird durchgereicht statt gemischt, wer also sehen will, was der Januar-Schritt tatsächlich mit einer Rechnung macht, für den bewegt sich die Zahl, wenn Google sie bewegt. Claude Sonnet 5.5 und Claude Opus 5.5 sind ebenfalls im Katalog, was einen Drei-Wege-Routing-Test — Googles Flash-Zweig, eine mittlere Anthropic-Stufe und später eine kleine Anthropic-Stufe — zu einer Konfiguration statt zu einem Projekt macht. Ein Schlüssel, ein SDK, automatisches Failover darunter, und die Routing-DSL, wenn Sie die Eskalation lieber in der Route als im Anwendungscode ausdrücken möchten.

Claude Haiku 5.5 selbst ist noch nicht im Katalog, und es ist besser, das zu sagen, als es im Unklaren zu lassen. Der Ant​hropic-Teil dieses Vergleichs ist derzeit nur bei Ant​hropic erreichbar, während der Google-Teil heute zum oben angegebenen Preis bei uns abgerufen werden kann.

A screenshot of the OrcaRouter catalogue page for Gemini 3.8 Flash, showing the model identifier in provider-slash-model form, the provider Google, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Welche, und für wen?

Wenn Ihre Arbeit darin besteht, Text ein- und Text auszugeben, Ihre Prompts unter 100.000 Tokens liegen und Sie pro Token für echtes Volumen zahlen, ist Claude Haiku 5.5 nach jedem Maßstab in diesem Beitrag das günstigere Modell und das mit der höheren Punktzahl auf dem einzigen gemeinsamen Board – mit der Einschränkung, dass der Vorteil bei den Kosten pro Aufgabe sechsfach statt zehnfach ausfällt, wie es der Listenpreis nahelegt.

Wenn du Audio- oder Videoeingabe benötigst, oder eine Antwort mit mehr als 65K brauchst, oder deine Prompts regelmäßig lang ausfallen, ändert sich die Rechnung: Gemini 3.8 Flash akzeptiert Eingaben, die Anthropics kleine Stufe nicht verarbeiten kann, und jenseits von 100.000 Tokens ist Anthropics eigene zweite Stufe deutlich teurer als Googles Pauschalpreis.

Das Einzige, woran Sie sich festhalten sollten, sind die Termine. Googles Tarif gilt bis zum Jahresende und verdoppelt sich danach. Ant​hropics Tarif wird pauschal mit einem Längenschritt angegeben. Auf welcher Seite davon Sie auch landen, bauen Sie den Kalender in die Tabelle ein, bevor Sie die Pipeline bauen.