Ein generierter Hero-Titel mit dem Badge „Allgemein verfügbar in GitHub Copilot – 7. Oktober", dem Kicker „Modellverfügbarkeitsbericht", dem Titel „Claude Haiku 5.5 in GitHub Copilot", dem Untertitel „Zehnmal günstiger pro Token als das Haiku, das es ersetzt – bis eine Anfrage 100.000 Token überschreitet", drei Chips mit „0,10 $ / 0,50 $ pro Mio.", „1 KI-Credit = 0,01 $" und „Pro: 1.500 Credits/Monat" sowie drei Karten für „Kurze Stufe: unter 100K Token", „Lange Stufe: 5x jeder Tarif" und „Noch nicht in unserem Katalog: Claude Haiku 4.5 ist es".
Guides & Insights

Claude Haiku 5.5 ist jetzt in GitHub Copilot: Was das günstigste Anthropic-Modell innerhalb eines Credit-Budgets kostet

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Claude Haiku 5.5 erschien am 7. Oktober 2026 in der Modellauswahl von GitHub Copilot – am selben Tag, an dem der Anbieter es veröffentlichte – und der Changelog-Eintrag, der es ankündigte, widmet den größten Teil seiner Länge den Oberflächen. Visual Studio Code, Visual Studio, die Copilot CLI, der GitHub Copilot Cloud-Agent, die Copilot-App, github.com, GitHub Mobile für iOS und Android, die JetBrains-IDEs, Xcode, Eclipse. Der Satz, der zählt, wenn Sie das Budget verantworten, ist kürzer: Das Modell wird „zu den Listenpreisen des Anbieters im Rahmen einer nutzungsbasierten Abrechnung“ abgerechnet. Innerhalb von Copilot bedeutet das KI-Credits, und die Sätze von Claude Haiku 5.5 sind niedrig genug, dass die Credit-Arithmetik zum interessanten Teil des Launches wird und nicht zum nachträglichen Gedanken. Dieser Beitrag führt diese Rechnung durch, trennt, was GitHub tatsächlich demonstriert hat, von dem, was es lediglich behauptet hat, und behandelt zwei Sonderregelungen in der eigenen Dokumentation des Anbieters, die die Berichterstattung zur Markteinführung größtenteils übersprungen hat.

Was GitHub veröffentlicht hat, und an wen

Der Eintrag trägt schlicht den Titel „Claude Haiku 5.5 in GitHub Copilot“ und wurde am 7. Oktober um 13:12 Uhr pazifischer Zeit veröffentlicht. Er ist für Copilot Pro-, Pro+-, Max-, Business- und Enterprise-Abonnenten verfügbar – also für jede kostenpflichtige Stufe und bemerkenswerterweise nicht für die kostenlose Stufe, auf der die Modellauswahl weiterhin automatisch und nicht durch den Nutzer erfolgt. Der Rollout erfolgt schrittweise, daher kann das Auswahlmenü in Ihrem Editor dem Änderungsprotokoll um Tage hinterherhinken; das wird im Eintrag angegeben, statt es Sie selbst herausfinden zu lassen.

GitHubs eigene Darstellung dessen, wofür das Modell gedacht ist, ist es wert, genau gelesen zu werden, denn sie ist enger gefasst als die des Anbieters:

• Schnelle, umfangreiche Arbeit – Subagenten, schnelle Bearbeitungen und Terminal-Aufgaben, in GitHubs eigenen Worten • Nicht als Ersatz für die großen Modelle in der Auswahl positioniert, sondern als die günstige Stufe darunter • Allgemein verfügbar, laut GitHubs Referenz zu unterstützten Modellen, die Claude Haiku 5.5 als allgemein verfügbar mit dem Status GA aufführt • Ebenfalls in dieser Referenz aufgeführt, mit einer Zeile für die IDE-Version, die als TBD markiert ist, was der praktische Grund dafür ist, dass sich der Rollout aus Editor-Sicht schrittweise liest • Zum Listenpreis des Anbieters im Rahmen der nutzungsbasierten Abrechnung, statt zu einem Copilot-spezifischen Aufschlag img src="2.png"> p>Die umliegenden Changelog-Daten liefern den Takt-Kontext, den eine einzelne Modellseite nicht bieten kann. Claude Sonnet 5.5 kam am 28. September in Copilot an, Claude Opus 5.5 am 22. September und Claude Fable 5.1 am 1. September. Anthropic liefert etwa alle zwei bis vier Wochen eine Copilot-Integration aus, und GitHub setzt jede davon innerhalb weniger Tage um. Dieser Takt ist auch der Grund, warum hier die Uhr tickt: GitHub veröffentlichte Mitte September eine Deprecation-Mitteilung für „ausgewählte GitHub Copilot-Modelle" Mitte Oktober und dann am 2. Oktober ein Follow-up, das die Entfernungen bestätigte. Wenn Ihr Team ein Modell in einer Copilot-Konfiguration festnagelt, ist jetzt die Festlegung das, was am ehesten bricht – nicht der Preis.

A screenshot of GitHub's "Supported AI models in GitHub Copilot" reference page, showing its model availability and default settings prose and a Claude (by Anthropic) table that lists Claude Haiku 4.5 and Claude Haiku 5.5 alongside the Claude Opus and Claude Sonnet rows.

Die Tarifkarte, als Kreditbuch gelesen

Claude Haiku 5.5 wird nach zwei Tarifstufen abgerechnet, die anhand der Anfragegröße umgeschaltet werden und nicht über eine Einstellung, die Sie wählen. Alles Folgende ist GitHubs eigene veröffentlichte Preisliste, und all dies gilt pro Million Tokens:

• Bei 100.000 oder weniger Eingabe-Tokens — 0,10 $ Eingabe, 0,01 $ zwischengespeicherte Eingabe, 0,125 $ Cache-Schreibvorgang, 0,50 $ Ausgabe • Über 100.000 Eingabe-Tokens — 0,50 $ Eingabe, 0,05 $ zwischengespeicherte Eingabe, 0,625 $ Cache-Schreibvorgang, 2,50 $ Ausgabe • Claude Haiku 4.5, zum Vergleich — 1,00 $ Eingabe, 0,10 $ zwischengespeicherte Eingabe, 1,25 $ Cache-Schreibvorgang, 5,00 $ Ausgabe • Claude Sonnet 5.5, die darüberliegende Stufe — 2,00 $ Eingabe, 0,10 $ zwischengespeicherte Eingabe, 2,50 $ Cache-Schreibvorgang, 10,00 $ Ausgabe • Cache-Schreibvorgänge werden bei Anthropic-Modellen separat abgerechnet, zusätzlich zu zwischengespeicherter Eingabe — ein Posten, den es nicht bei jedem Anbieter in der Auswahl gibt img src="3.png"> p>Zwei Dinge ergeben sich, wenn man diese Zeilen zusammen liest. Erstens ist die kurze Stufe von Claude Haiku 5.5 sowohl bei Eingabe als auch Ausgabe rund zehnmal günstiger als Claude Haiku 4.5 und bei Eingabe etwa zwanzigmal günstiger als Claude Sonnet 5.5 — was der ganze Grund dafür ist, dass es in Subagent-Slots gehört, wo eine Flotte kleiner Aufrufe vervielfacht, was man pro Aufruf zahlt. Zweitens beträgt die Langkontext-Stufe genau das Fünffache der kurzen Stufe bei jedem Tarif zugleich, an derselben 100.000-Token-Grenze. Eine Anfrage mit 99.000 Tokens und eine mit 101.000 Tokens unterscheiden sich bei den Tokens, die die Grenze überschritten haben, nicht um 2 Prozent; sie unterscheiden sich bei allen um den Faktor fünf. Dieser Sprung ist direkt von Anthropics Listenpreis übernommen, und Copilots Credit-System glättet ihn nicht.

A screenshot of GitHub's "Models and pricing for GitHub Copilot" documentation page, listing per-million-token input, cached input, cache write and output rates for Claude Haiku 4.5, Claude Haiku 5.5, Claude Opus and Claude Sonnet, with the surrounding AI credit conversion notes.

Nun zu den Credits. Die nutzungsbasierte Abrechnung von Copilot rechnet die Modellnutzung zu einem dokumentierten Satz von 0,01 $ pro Credit in AI-Credits um, und jeder Plan umfasst ein monatliches Kontingent:

• Copilot Pro, 10 $ pro Monat — 1.500 Credits, angegeben als 1.000 Basis plus 500 flexibel • Copilot Pro+, 39 $ pro Monat — 7.000 Credits, angegeben als 3.900 Basis plus 3.100 flexibel • Copilot Max, 100 $ pro Monat — 20.000 Credits, angegeben als 10.000 Basis plus 10.000 flexibel • Copilot Business, 19 $ pro Sitzplatz pro Monat — 1.900 Credits pro Nutzer • Copilot Enterprise, 39 $ pro Sitzplatz pro Monat — 3.900 Credits pro Nutzer • Organisations- und Unternehmenspools werden über die Sitzplätze hinweg geteilt statt pro Nutzer abgeschottet • Nutzung über den Pool hinaus wird mit 0,01 $ pro Credit abgerechnet — dieselbe Umrechnung, angewandt auf die Überschreitung • Code-Vervollständigungen und Vorschläge für die nächste Bearbeitung liegen völlig außerhalb der Credit-Abrechnung und bleiben in kostenpflichtigen Tarifen unbegrenzt p>Fügt man beides zusammen, wird die Gestalt des Launches konkret. Nehmen wir einen mäßig großen Agent-Schritt — 40.000 Eingabe-Tokens, 2.000 Ausgabe-Tokens, kein Caching. In der kurzen Tarifstufe von Claude Haiku 5.5 sind das 40.000 mal 0,10 $ pro Million plus 2.000 mal 0,50 $ pro Million, also 0,005 $, was bei der dokumentierten Umrechnung einen halben Credit entspricht. Derselbe Aufruf zu den Sätzen von Claude Haiku 4.5 kommt auf 0,05 $, also fünf Credits. Die Arithmetik hier ist unsere, nicht die von GitHub, aber die Eingangswerte stammen alle aus der veröffentlichten Preistabelle, und die Schlussfolgerung ist nicht subtil: Der Pool von 1.500 Credits eines Pro-Abonnenten absorbiert rund 3.000 solcher Aufrufe beim neuen Haiku, während er beim alten rund 300 absorbierte. Der Pool wird zehnmal länger, ohne dass sich das Abonnement ändert.

Das ist das ehrliche Wertversprechen, und es bringt den ehrlichen Vorbehalt mit sich, dass der Pool in Credits statt in Dollar angegeben wird, sodass sich die tatsächliche Obergrenze eines Tarifs verschiebt, wann immer sich eine Preisliste ändert. Eine zehnfache Senkung bei einem Modell erweitert einen Pool nicht um das Zehnfache, wenn sich Ihr Traffic auf drei verteilt.

Was GitHub sagt, was das Modell tut, und was es nicht gezeigt hat

Der Changelog enthält eine Leistungsbehauptung, und diese leistet in der Berichterstattung mehr Arbeit, als sie tragen kann. GitHub schreibt, dass Claude Haiku 5.5 in frühen Tests „bei vielen Coding-Aufgaben mit Claude Sonnet 5 mithielt“, während es „deutlich weniger Tokens und Schritte verbrauchte“.

Lesen Sie die Einschränkungen der Reihe nach. Es handelt sich um frühe Tests. Es sind GitHubs Tests, an GitHubs Aufgaben, und GitHub ist der Anbieter, der die Integration verkauft. Kein Harness wird genannt, kein Aufgabenset wird veröffentlicht, keine Zahl begleitet eine der beiden Satzhälften, und „viele“ ist keine Zahl. Die Behauptung mag durchaus wahr sein – ein kleines Modell, das bei engen, auf Tools zugeschnittenen Programmieraufgaben mit einem großen mithält, ist 2026 ein plausibles Ergebnis –, aber so wie sie veröffentlicht wurde, ist sie eine Anbieterbehauptung, und sie sollte jedes Mal als solche gekennzeichnet werden, wenn sie wiederholt wird. Die Hälfte mit „weniger Tokens und Schritten“ ist die haltbarere der beiden, weil sie eine Aussage über Effizienz statt über Fähigkeit ist, und Effizienz auf dem Haiku-Preisniveau macht sich innerhalb einer Woche in Ihrer eigenen Nutzungstelemetrie bemerkbar. Die Fähigkeitshälfte braucht ein Harness eines Drittanbieters, bevor sie auf eine Folie kommt.

Die eigenen Zahlen von Anthropic sind eine separate Behauptung gegenüber denen von GitHub und weisen dasselbe Provenienzproblem auf. Anthropic gibt an, dass der Betrieb von Claude Haiku 5.5 im Durchschnitt etwa 75 Prozent günstiger ist und dass rund 90 Prozent der Anfragen, die zuvor an ein Modell der Haiku-Klasse gesendet wurden, unter 100.000 Tokens liegen, also in dem Bereich, in dem das Modell „besonders gutes Preis-Leistungs-Verhältnis“ bietet. In beiden Fällen beschreibt der Anbieter die Wirtschaftlichkeit seines eigenen Produkts. Sie decken sich mit der veröffentlichten Preisliste – eine starke Senkung für die kurze Tarifstufe, eine kleinere für die lange – und sie sind als Hinweis des Anbieters nützlich, nicht als gemessenes Ergebnis.

Das Einschalten ist eine Admin-Entscheidung, und standardmäßig ist es aktiviert.

Der Teil des Changelogs, den Käufer von Copilot Business und Enterprise zweimal lesen sollten, ist der Absatz zur Zugriffskontrolle. Administratoren verwalten den Modellzugriff über die Modellrichtlinie in den Copilot-Einstellungen, und das dokumentierte Standardverhalten von GitHub ist, dass neue Modelle automatisch aktiviert werden, es sei denn, ein Administrator hat die globale Standardeinstellung deaktiviert oder dieses spezifische Modell ausdrücklich deaktiviert. Die Standardeinstellung ist permissiv; die Einschränkung ist Opt-out.

Daraus folgen zwei Konsequenzen. Wenn Ihre Organisation eine strikte Modell-Governance hat, ist Claude Haiku 5.5 für Ihre Entwickler möglicherweise bereits auswählbar, ohne dass jemand es namentlich genehmigt hat. Und wenn Ihre Organisation stattdessen den globalen Standard bereits deaktiviert hat, wird das Modell bei Ihnen nicht erscheinen, egal was im Changelog steht – was die häufigste Support-Frage in der ersten Woche nach der Einführung eines jeden Copilot-Modells ist. Bevor Sie einen fehlenden Eintrag im Auswahlmenü debuggen, prüfen Sie die Modellrichtlinie.

Zwei Ausnahmen, von denen Anthropics Dokumentation angibt, dass die Launch-Posts sie nicht erwähnt haben.

Beide stammen aus der Plattformdokumentation von Anthropic und nicht aus irgendeiner Presseberichterstattung, und beide wirken sich darauf aus, was Sie bauen können, statt darauf, was Sie zahlen:

• Priority Tier ist auf Claude Haiku 5.5 nicht verfügbar – Anthropics Service-Tier-Dokumentation nennt das Modell in ihrer expliziten Ausschlussliste, neben Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1 und der Mythos-Linie. Wenn Ihre Architektur bereitgestellten Durchsatz auf der günstigen Stufe voraussetzt, gilt diese Annahme hier nicht. • Das vollständige Kontextfenster von 1 Million Token zum Standardpreis wird „Claude 4.6 und späteren Modellen (außer Claude Haiku 5.5)“ gewährt – der Klammerzusatz stammt von Anthropic, und Claude Haiku 5.5 ist das einzige aktuelle Modell, das davon ausgenommen wird. Das Fenster wird in der Spezifikationszeile des Modells weiterhin mit 1M angegeben, bei einer maximalen Ausgabe von 128.000 Token; die Ausnahme bedeutet, dass Sie die pauschale Preisgarantie für langen Kontext nicht so verstehen sollten, dass sie für dieses Modell gilt. • Der Tokenizer wurde geändert. Anthropic gibt an, dass Claude 4.7 und spätere Modelle einen neueren Tokenizer verwenden, der für denselben Text etwa 30 Prozent mehr Token erzeugt, was bedeutet, dass sich der Preis pro Token und der Preis pro Seite Ihres Texts in entgegengesetzte Richtungen entwickelt haben. In der Spezifikationszeile von Claude Haiku 5.5 ist „Fastest“ als seine Position aufgeführt, ein Standard für adaptives Denken von mittel, ein Wissensstichtag im Juni 2026 und eine Modell-ID von claude-haiku-5-5.

Keines davon ist ein Ausschlusskriterium für die Subagent- und Quick-Edit-Workloads, auf die GitHub das Modell ausrichtet. Sie sind der Unterschied zwischen dem Zitieren eines Launch-Posts und dem Zitieren der Dokumentation, und Letzteres ist das, was einen Lasttest übersteht.

Wenn Sie es lieber weiterleiten möchten, anstatt das Tool zu wechseln

Es gibt gute Gründe, Claude Haiku 5.5 aus dem eigenen Stack aufzurufen, statt nur über ein Chat-und-Editor-Abo: Man erhält die rohen Tarife der Kurzstufe ohne dazwischengeschaltete Guthabenumrechnung und behält die Routing-Entscheidung im eigenen Code. Das Bild zur Verfügbarkeit sieht, klar gesagt, so aus, dass Anthropic es über Claude sowie über Amazon Bedrock, Vertex AI und Microsoft Azure verkauft – und es ist noch nicht in unserem Katalog. OrcaRouter führt derzeit Claude Haiku 4.5, Claude Sonnet 5.5, Claude Opus 5.5 und Claude Fable 5.5 über einen Katalog von etwas mehr als 200 Modellen, und Claude Haiku 5.5 ist nicht dabei. Für das Modell selbst wende man sich direkt an Anthropic oder einen der Cloud-Anbieter.

A screenshot of OrcaRouter's Claude Haiku 4.5 model page, showing $1.00 per million input tokens and $5.00 per million output tokens, a 200K context window, the claude-haiku-4-5 model ID, availability across three providers, and an Anthropic SDK snippet that points the base URL at OrcaRouter while keeping the existing SDK.

Wo wir hineinpassen, ist die Ebene darum herum. OrcaRouter gibt den Listenpreis des Anbieters ohne Aufschlag weiter, sodass, wenn ein Anbieter ein Modell neu bepreist – wie Anthropic bei diesem hier –, der neue Tarif bei uns noch am selben Tag live ist und nicht erst nach einem Abrechnungszyklus. Automatisches Failover bedeutet, dass ein fehlschlagender Call der günstigen Stufe auf einer funktionierenden Route landet, statt die Anfrage scheitern zu lassen, was für eine Subagenten-Flotte, die Tausende kleiner Calls absetzt, wichtiger ist als für eine einzelne interaktive Sitzung. Und die Routing-DSL existiert genau für die Art von Entscheidung, die dieser Launch erzeugt: kurze, volumenstarke Arbeit an das jeweils günstigste Modell unterhalb der Schwelle senden und Long-Context-Arbeit an das jeweils günstigste oberhalb davon – von einem Endpoint auf einer Rechnung, statt diese Aufteilung in zwei Integrationen zu kodieren. Wenn Haiku 5.5 im Katalog erscheint, fügt es sich ohne Codeänderung in diese Policy ein.

Was ist damit vor dem nächsten Sprint zu tun?

Die enge Lesart ist, dass Anthropics derzeit günstigstes Modell nun in jeder bezahlten Copilot-Stufe auswählbar ist und pro Token ungefähr zehnmal günstiger ist als das Haiku, das es in der kurzen Stufe ersetzt. Wenn Ihr Team Subagenten oder terminalartige Automatisierung über Copilot laufen lässt, ist der Modellwechsel eine Einstellungsänderung mit großer und unmittelbarer Auswirkung darauf, wie weit ein monatliches Guthabenkontingent reicht.

Die beiden Dinge, die es sich zuerst anzusehen lohnt, sind genau die, die in der Ankündigung untergehen. Sehen Sie sich das 95. Perzentil Ihrer Anfragegrößen an: Wenn es über 100.000 Token liegt, ist die Stufe, nach der Sie tatsächlich abgerechnet werden, die zweite, und aus dem zehnfachen Vergleich wird ein fünffacher. Und prüfen Sie, ob in der Modellrichtlinie Ihrer Organisation die globale Standardeinstellung aktiviert ist – bei Business- und Enterprise-Lizenzen entscheidet diese eine Einstellung darüber, ob dieser Launch Ihren Entwicklern überhaupt zur Verfügung steht.

gibt den Listenpreis des Anbieters ohne Aufschlag weiter