Generierte Hero-Titelkarte für den Artikel, angeführt von einem bernsteinfarbenen Pill-Badge mit der Aufschrift 'NEU IN OPENCODE GO' und dem Kicker 'ANTHROPIC, 7. OKTOBER 2026', mit dem Titel 'Claude Haiku 5.5 landet in einem 10-Dollar-Coding-Plan' über dem Untertitel 'Eine 90-prozentige Preissenkung, ein 15-Dollar-Kontingent, das den Verbrauch abrechnet, und ein 5-facher Sprung oberhalb von 100.000 Tokens.', einer Reihe von vier umrandeten Chips mit der Aufschrift '$0,10 Eingabe', '$0,50 Ausgabe', '3.850 Anfragen / 5 Std.' und '$15 monatliches Kontingent', und zwei abgerundeten Karten darunter — 'WAS GEKÜRZT WURDE' mit der Aufschrift 'Eingabe $1,00 auf $0,10, Ausgabe $5,00 auf $0,50 für Prompts bis zu 100.000 Tokens' und, in blassem Bernstein umrandet, 'WAS DER PLAN ABRECHNET' mit der Aufschrift '$15 an Tokens pro Monat im 10-Dollar-Plan, zum Anthropic-Listenpreis' — mit der Fußzeile 'Anthropic-Preise und OpenCode-Go-Dokumentation gelesen am 8. Oktober 2026.' Das OrcaRouter-Logo ist in der unteren rechten Ecke eingefügt.
Guides & Insights

Claude Haiku 5.5 in OpenCode Go: Was man für 10 $ im Monat tatsächlich bekommt

Autor

Gideon Frost

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Anthropic hat Claude Haiku 5.5 am 7. Oktober 2026 veröffentlicht, und innerhalb eines Tages stand es in den Go- und Zen-Katalogen von OpenCode — den Coding-Agent-Abonnements, die ein monatliches Dollar-Budget abrechnen statt Tokens in Rechnung zu stellen. Bei dieser zweiten Listung lohnt es sich, kurz innezuhalten, denn das Budget, das OpenCode für Claude Haiku 5.5 veröffentlicht, ist kein Rabatt auf das Modell. Es ist ein Budgetzähler, der auf Anthropics eigenem Listenpreis basiert, und jede Zahl dahinter lässt sich anhand der beiden Seiten überprüfen, die sie veröffentlichen. Wenn Sie noch entscheiden, was Sie anstelle von Claude Haiku 4.5 aufrufen sollen, ist das Budget die Entscheidung, nicht das Preisschild.

The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.

Was Ant​hropic am 7. Oktober zu Protokoll gab

Der Anbieter hat dies nicht still und heimlich veröffentlicht. In Anthropics Newsroom finden sich eine datierte Ankündigung, eine Produktseite mit einer Benchmark-Tabelle, eine System Card, eine Preistabelle und sechs namentlich genannte Kundenstimmen. Es gibt kein Repository und keine Veröffentlichung von Gewichten zum Prüfen, denn es gibt nichts zu veröffentlichen: Artificial Analysis führt Claude Haiku 5.5 als proprietär, wobei die Parameteranzahl nicht offengelegt wird. Wer dies als geleaktes oder nicht angekündigtes Modell beschreibt, liest ein Repository, das nicht existiert.

Anthropics eigene Einordnung ist eher ein Volumenmodell als ein Frontier-Modell:

• Positionierung — „das günstigste, schnellste und leistungsfähigste kleine Modell, das wir je veröffentlicht haben“, ausgerichtet auf Zusammenfassungen, Kompaktierungen, Datenbankabfragen und Klassifizierung und angepriesen als Subagent, der bei Coding-Arbeiten mit Claude Opus 5.5 und Claude Sonnet 5.5 zusammenarbeitet.

• Preis — 0,10 $ pro Million Eingabe-Tokens und 0,50 $ pro Million Ausgabe-Tokens für Prompts mit bis zu 100.000 Tokens; darüber hinaus 0,50 $ und 2,50 $. Cache-Lesevorgänge 0,01 $ / 0,05 $, Cache-Schreibvorgänge 0,125 $ / 0,625 $.

• Kontext und Ausgabe — ein 1-Million-Token-Fenster mit einer maximalen Ausgabe von 128.000 Token, derselbe Rahmen, den die größeren Modelle der 5.5-Klasse bieten, umgesetzt auf der günstigsten Stufe.

• Effort — das erste Modell der Haiku-Klasse mit einer anpassbaren Effort-Einstellung, die von Low bis Max reicht und standardmäßig auf medium steht. Antropic veröffentlicht Genauigkeits-gegen-Kosten-Kurven für jede Einstellung statt einer einzelnen Zahl.

• Benchmarks, vom Anbieter angegeben und nicht unabhängig reproduziert — GDPval-AA v2.1 1620 gegenüber 735 von Claude Haiku 4.5; AA-Briefcase v1.1 1578 gegenüber 614; OSWorld 2.1 72,4 % gegenüber 15,7 %; Humanity's Last Exam 45,9 % ohne Tools und 57,4 % mit ihnen, gegenüber 10,2 % und 18,7 %; Terminal-Bench 4.0 39,2 % gegenüber 0,0 %; Chartography 46,4 % gegenüber 6,4 %.

• Die eigene Obergrenze des Anbieters — der Kommentar von Anthropic zu seinem Terminal-Bench-Diagramm besagt, Claude Sonnet 5.5 und Claude Opus 5.5 „bleiben die besseren Optionen für komplexe agentische Coding-Aufgaben“. Bei den Kundenstimmen im selben Beitrag handelt es sich um Early-Access-Partner, die ihre eigenen Evaluierungen beschreiben, keine Audits: Asana berichtet von mehr als 30 % niedrigerer Latenz und bis zu 2,5-mal schnellerer Inferenz pro Agenten-Turn, HubSpot 92,8 %, gemittelt über drei Durchläufe, AlphaSense 0,84 gegenüber 0,76 über 400 Abfragen hinweg bei einer Arbeitslast von rund 8 Mio. Aufrufen pro Woche, Box 11 Punkte höher bei etwa halber Latenz und Cognition einen FrontierCode-Score von 66,2 mit Haiku 5.5 als Sidekick.

Generated two-column scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 — Anthropic's own harness'. The left column, 'Claude Haiku 5.5', reads GDPval-AA v2.1: 1620, AA-Briefcase v1.1: 1578, OSWorld 2.1: 72.4%, Humanity's Last Exam: 45.9%, Terminal-Bench 4.0: 39.2%, Chartography: 46.4%. The right column, 'Claude Haiku 4.5', reads GDPval-AA v2.1: 735, AA-Briefcase v1.1: 614, OSWorld 2.1: 15.7%, Humanity's Last Exam: 10.2%, Terminal-Bench 4.0: 0.0%, Chartography: 6.4%. A footer line reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.' The OrcaRouter logo is composited in the bottom-right corner.

Anthropic nutzte den Start außerdem, um zwei benachbarte Preise anzupassen: Die Cache-Lesevorgänge bei Claude Sonnet 5.5 wurden auf 0,10 US-Dollar pro Million Token halbiert – laut Unternehmen macht das Sonnet 5.5 bei den meisten agentischen Arbeiten etwa 20 % günstiger –, und für Abonnenten von Claude Max und Team gibt es ein neues monatliches API-Guthaben. Beides sind Änderungen an der darüberliegenden Stufe, und beides ist für ein Team, das bereits auf Sonnet standardisiert ist, wichtiger als für alle, die auf der Suche nach einem kleinen Modell sind.

Der Zuschuss ist ein Dollar-Budget, kein Rabatt.

Hier ist der Teil, den der Ankündigungs-Tweet nicht nennt. Die Go-Dokumentation von OpenCode gibt an, dass „Nutzungslimits als monatliche Dollarbeträge definiert sind“, dass die Token-Preise bei beiden Tarifen gleich sind und dass das Kontingent jedes Modells nach einem festen Zeitplan abnimmt: 20 % des monatlichen Limits pro fünf Stunden, 50 % pro Woche, 100 % pro Monat. Die Dokumentation veröffentlicht außerdem das Token-Profil pro Anfrage, das sie für dieses Modell annimmt – 1.100 Eingabe-Tokens, 55.000 gecachte Tokens, 240 Ausgabe-Tokens.

Rechnet man sie mit dem Listenpreis von Anthropic und den veröffentlichten Anfragezahlen durch, wirken sie nicht mehr wie eine willkürliche Zuteilung:

• Kosten pro Anfrage zum Listenpreis — 1.100 Eingabe bei $0,10/M plus 55.000 Cache-Lesevorgänge bei $0,01/M plus 240 Ausgabe bei $0,50/M belaufen sich auf $0,00078.

• Die monatliche Anfragenanzahl – 15 $ geteilt durch 0,00078 $ ergibt 19.230, was der Zahl entspricht, die in der Dokumentation steht. Das 60-$-Kontingent des 40-$-Tarifs ergibt geteilt 76.923, und die Dokumentation gibt 76.920 an.

• Das Ausschleichen — 20 % von 19.230 sind 3.846, angegeben als 3.850 pro fünf Stunden; 50 % sind 9.615, angegeben als 9.620 pro Woche. Go Plus folgt bei 15.380 und 38.460 derselben Rechnung.

• Was das in Dollar bedeutet – der Freibetrag hat einen Gegenwert von 15 $ an Tokens zu Anthropic-Preisen im 10-$-Tarif und von 60 $ im 40-$-Tarif. Ein 10-$-Abonnement bringt dir daher pro Monat höchstens Tokens dieses Modells im Wert von 15 $, wenn du den gesamten Freibetrag für Claude Haiku 5.5 und nichts anderes ausgibst.

Das ist die ehrliche Art, das „Neu“-Badge auf der Go-Seite zu lesen. Das Abo ist günstig, das Modell ist günstig, und die beiden Fakten sind unabhängig voneinander: Das Kontingent ist ein verbrauchsbasiertes Budget zum eigenen Tarif des Anbieters, der Plan begrenzt also, wie viel du ausgeben darfst, und nicht, wie wenig das Modell kostet. Vielnutzer stoßen an die Obergrenze und zahlen direkt an Anthropic – oder routen das Modell selbst.

Generated single-column card titled 'The $15 allowance, at Anthropic's list price', with six rows reading 'Go plan: $10 per month', 'Claude Haiku 5.5 allowance: $15', 'Cost per request: $0.00078', 'Requests per 5 hours: 3,850', 'Requests per month: 19,230' and 'Above 100,000 tokens: 5x input', over the footer line 'Allowance figures per OpenCode Go documentation; token prices per Anthropic, both read October 8, 2026. Arithmetic is ours.' The OrcaRouter logo is composited in the bottom-right corner.

Neunzig Prozent, fünfundsiebzig Prozent und die Fünffach-Klippe

Die Schlagzeile von Anthropic lautet, dass Claude Haiku 5.5 etwa 90 % weniger kostet als Claude Haiku 4.5 bei Prompts bis zu 100.000 Tokens und dass es im Durchschnitt „jetzt rund 75 % weniger kostet, ausgeführt zu werden“. Beide Zahlen stammen vom Anbieter. Sie sind auch beide korrekt, und die Lücke zwischen ihnen macht das gesamte Preisrisiko aus.

• Innerhalb des Bereichs — 0,10 $ Input und 0,50 $ Output, verglichen mit den pauschalen 1 $ und 5 $ von Haiku 4.5. Anthropic sagt, dass rund 90 % der Anfragen an sein früheres Haiku-Modell in diesen Bereich fielen, woher die 90-%-Zahl stammt.

• Oberhalb der Tarifstufe — dieselbe Anfrage wird mit 0,50 $ für Input und 2,50 $ für Output berechnet, ein fünffacher Anstieg beim Input. Das ist immer noch die Hälfte des Tarifs von Haiku 4.5, aber weit entfernt von einer Senkung um 90 %.

• Die gemischte Angabe – die 75-%-Zahl ist Ant​ropics eigene Schätzung über einen echten Traffic-Mix, keine Tarifkarte, und sie ist die Zahl, die in eine Prognose gehört.

• Der Tokenizer – der neuere Tokenizer, der mit Claude 4.7 und späteren Versionen gemeinsam verwendet wird, erzeugt laut der eigenen Dokumentation von Anthropic für denselben Text rund 30 % mehr Tokens, sodass sich eine Kürzung pro Token nicht eins zu eins in einer kleineren Rechnung niederschlägt.

Der Aufwandsregler verstärkt all das noch. Weil die Standardeinstellung medium ist und die veröffentlichten Kurven bis Max reichen, kann derselbe Prompt je nach einem Parameter, den die meisten Aufrufer nie festlegen, um ein Vielfaches teurer sein – und die Anfrageschätzungen von OpenCode gehen von einem festen Token-Profil bei einer impliziten Einstellung aus. Wenn Ihre Prompts nahe bei 100.000 Tokens liegen, Sie einen Subagenten mit begrenzter Nutzung ausführen oder den Aufwandsregler verstellen, ist die 90%-Schlagzeile nicht die Zahl, die Sie sehen werden.

Das unabhängige Gremium einigt sich auf die Punktzahl und bemängelt seine eigene Mathematik.

Artificial Analysis bewertet Claude Haiku 5.5 mit 43 auf dem Intelligence Index v4.3.2 in der Max-Konfiguration des Modells, gegenüber einem Board-Median von 13, und misst 241,9 Ausgabe-Token pro Sekunde gegenüber einem Median vergleichbarer Modelle von 110,9. Dieselbe Seite beziffert die Kosten auf 0,21 $ pro Aufgabe des Intelligence Index und berichtet, dass das Modell während der Evaluierung 440 Millionen Ausgabe-Token generierte, gegenüber einem Median von 100 Millionen – und beschreibt es als „sehr wortreich“.

Ausführlichkeit ist der Punkt, an dem die beiden Boards aufeinandertreffen. Die obige Kontingentrechnung erfolgt pro Token, sodass ein Modell, das ausführlich Reasoning betreibt, das Budget schneller aufbraucht, als die Anzahl der Anfragen vermuten lässt, und das Profil von 55.000 gecachten Tokens pro Anfrage bei OpenCode ist eine Annahme über Prompt-Caching, die ein Abonnement-Nutzer reproduzieren kann oder auch nicht. Zwei Angaben auf der Artificial Analysis-Seite sind mehr wert als ihre Schlagzeile: Die 43 ist die Max-Konfiguration und nicht die Effort-Einstellung, die man erhält, wenn man nichts unternimmt, und die Seite enthält einen ausdrücklichen Hinweis, dass Claude Haiku 5.5„bei Eingaben mit längerem Kontext einen fünfmal höheren Preis hat, der derzeit nicht in seinen Kostenangaben berücksichtigt wird".

A screenshot of Anthropic's own Claude Haiku 5.5 product page, showing the date 'OCTOBER 7, 2026' above the heading 'Claude Haiku 5.5', the site sections 'Pricing', 'Performance', 'Safety' and 'Further updates', a 'MODEL ID' field reading 'claude-haiku-5-5', and the top navigation 'Research', 'Policy Commitments', 'Learn' and 'News'.

Die Retention-Zeile, die die meisten Käufer überspringen werden

OpenCodes Go-Dokumentation enthält eine modellspezifische Datenschutztabelle, und dies ist die Zeile, in der Claude Haiku 5.5 vom Großteil des Katalogs abweicht. Die Darstellung des Anbieters selbst lautet: keine Aufbewahrung, mit Ausnahmen. Die meisten Modelle in dieser Go-Tabelle stehen auf „0 Tage“. Dieses hier steht auf „30 Tage“, mit dem Hinweis, dass Anfragen gemäß den Datenrichtlinien von Anthropic 30 Tage lang aufbewahrt werden — dieselbe Behandlung wie bei GPT-6 Luna und GPT-5.6 Luna und das Gegenteil der Null-Tage-Zeilen, die den Großteil der Liste ausmachen.

Für einen Coding-Agenten bedeutet das, dass Prompts, Dateipfade und eingefügter Quellcode einen Monat lang beim vorgelagerten Anbieter liegen können – bei einem Tarif, dessen Marketing-Sprache „Zero Retention“ lautet. Das ist kein Grund, das Modell zu meiden; es ist ein Grund, die Zeile statt des Banners zu lesen. Nichts in den Launch-Materialien von Ant​hropic ändert indes die API-seitige Position: Die Claude-API bietet Zero Data Retention, und die Aufbewahrungsbedingungen der Modellkarte sind diejenigen, die eine direkte Integration regeln.

Was ist bestätigt, und was nicht

Die bestätigte Menge ist groß und spezifisch, was für ein so neues Modell ungewöhnlich ist. Was nicht bestätigt ist, ist enger gefasst, und es lohnt sich, es zu benennen, statt es zu beschönigen:

• Bestätigt — das Modell existiert, ist unter der ID claude-haiku-5-5 ausschließlich über die API verfügbar, wurde am 7. Oktober über die Claude API sowie Amazon Web Services, Goo​gle Cloud und Microsoft Azure zu den oben genannten Preisen veröffentlicht, mit einem Kontextfenster von 1 Mio. Tokens, einstellbarem Aufwand und einer veröffentlichten System Card.

• Bestätigt — zwei Drittanbieter-Plattformen führen es am selben Tag mit Modell-IDs, Endpunkten und verbrauchsbasierten Kontingenten auf.

• Nicht bestätigt — kein unabhängiger Benchmark, den wir finden konnten, hat die Tabelle des Anbieters reproduziert. Jeder Genauigkeitswert in Ant​hropics Launch-Post stammt aus Ant​hropics eigenem Harness, und jedes Kundenzitat stammt aus selbst gemeldeten frühen Tests eines Partners.

• Nicht bestätigt — es gibt keine Gewichte, kein Repository, keinen Checkpoint und keine Lizenz zur Überprüfung. Das Modell ist geschlossen, und jede Behauptung über seine Architektur oder Größe ist eine Schlussfolgerung.

• Nicht bestätigt — ob die Request-Schätzungen der Plattform bei etwas anderem als ihrem angenommenen Token-Profil Bestand haben und ob (oder wann) die 5-fache Long-Context-Preisgestaltung in den Kostenzahlen der unabhängigen Boards ankommt.

Es neben dem laufen zu lassen, was Sie bereits nennen

Die praktische Frage, die diese Markteinführung aufwirft, lautet nicht: „Ist Haiku 5.5 gut?“ – die Tabelle des Anbieters sagt, dass es so ist, und niemand außerhalb von Anthropic hat es überprüft. Sie lautet: „Wie hoch ist die Rechnung, und was passiert, wenn die günstige Tarifstufe nicht die richtige Tarifstufe für diesen konkreten Aufruf ist?“ Beide Hälften sind Routing-Probleme.

Bei den Kosten ist die Messgröße die Token-Rechnung, nicht der Stickerpreis: Eine 90 %-Kürzung der Eingabe plus ein um 30 % größerer Tokenizer plus ein wortreiches Reasoning-Modell plus eine fünffache Long-Context-Erweiterung bedeutet, dass die Zahl, die du prognostizierst, und die Zahl, die du zahlst, auseinanderdriften, es sei denn, du misst deine eigene Prompt-Längenverteilung. Ein Modell, das oberhalb von 100.000 Tokens 5-mal teurer ist, belohnt Kompaktierung – und Haiku 5.5 wird selbst als das Kompaktierungsmodell beworben, was eine Schleife ist, die es zu bemerken lohnt.

Was das Risiko betrifft, ist eine nicht erprobte Stufe genau der Fall, in dem man keinen Produktionspfad darauf setzen sollte. Claude Haiku 4.5 ist bereits auf OrcaRouter zum Listenpreis von Anthropic mit 0 % Aufschlag verfügbar, sodass die alte Stufe keinen neuen Vertrag benötigt, und eine Route, die von einem neuen Modell auf ein bekanntes zurückfällt, ist eine Konfigurationsänderung statt einer Neuimplementierung. Der Effort-Parameter gilt pro Aufruf, was bedeutet, dass derselbe Endpunkt eine Zusammenfassung mit niedrigem Effort und eine schwierige Extraktion mit hohem Effort ausführen kann, ohne zwei Integrationen pflegen zu müssen — die Routing-DSL existiert genau für diese Art von Entscheidung, und automatisches Failover ist das, womit Sie ein tagealtes Modell vor echten Traffic setzen können, bevor Sie unabhängige Zahlen dafür haben. Was noch nicht zutrifft, ist die offensichtliche Sache: Claude Haiku 5.5 ist heute nicht auf unseren Routen, und wenn Sie es diese Woche wollen, rufen Sie Anthropic direkt an oder gehen über die Plattform, die es angekündigt hat.

Wer wechseln sollte: Teams, deren Volumen aus Zusammenfassungen, Klassifizierung, Kompaktierung und Subagenten-Arbeit besteht, wo das 90%-Band greift und die 30 % des Tokenizers Arithmetik sind, die Sie verkraften können. Wer warten sollte: alle, deren Prompts regelmäßig 100,000 Token überschreiten, alle, die vor einer Festlegung einen unabhängigen Benchmark benötigen, und alle, deren Code nicht in einem 30-Tage-Aufbewahrungsfenster liegen kann. Der Launch ist real und die Preisgestaltung ist real. Der Beweis liegt weiterhin beim Anbieter.

In diesem Artikel verglichen1

Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert