Eine generierte Hero-Karte mit dem Titel „Claude Haiku 5.5 vs. Aion 3.5“, dem Kicker „30x DER INPUT-PREIS“ und dem Untertitel „Einer wird bewertet. Einer nicht.“, die Chips mit $0.10 vs. $3.00 pro Million Input-Tokens, AA Index 43 gegenüber keinem und 1M gegenüber 262K Kontext trägt.
Guides & Insights

Claude Haiku 5.5 vs. Aion 3.5: Dreißigfacher Eingabepreis für ein Modell, das noch niemand bewertet hat

Autor

Alistair Wren

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen →
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Claude Haiku 5.5 wird mit 0,10 $ pro Million Eingabe-Token gelistet. Aion 3.5 wird mit 3,00 $ gelistet. Das ist der dreißigfache Eingabepreis und der zwölffache Ausgabepreis für zwei Modelle, die beide eine lange Textaufforderung annehmen und Text zurückgeben, und die Kluft ist nicht durch die Leistungsfähigkeit zu erklären – sie erklärt sich dadurch, was jedes Unternehmen verkauft. Claude Haiku 5.5, veröffentlicht am 7. Oktober 2026, ist ein zum Massenware-Preis erhältliches Arbeitstier mit einem Aufwandsregler und einer unabhängigen Bewertung. Aion 3.5, veröffentlicht am 23. September 2026 von AionLabs, ist ein Ensemble mit obligatorischem Reasoning, das in zwei Größen erhältlich ist, von denen eine wirklich günstig ist. Ob sich der dreißigfache Aufpreis lohnt, hängt vollständig von einer Frage ab, die der Anbieter nicht beantwortet hat.

Hier vorweg der unangenehme Teil: Artificial Analysis hat Claude Haiku 5.5 bewertet und noch nie eine Punktzahl für Aion 3.5 veröffentlicht. Auch sonst haben wir niemanden gefunden, der das getan hat. Das ist also kein Vergleich zweier gemessener Dinge. Es ist ein Vergleich einer gemessenen Sache mit einem Satz Herstellerangaben, und die ehrliche Art, darüber zu schreiben, ist, das in jedem Abschnitt zu sagen statt nur einmal in einer Fußnote.

Die beiden Modelle, jeweils in einem Absatz

Claude Haiku 5.5 ist das kleine Modell des Anbieters, ID claude-haiku-5-5, Text und Bild als Eingabe und Text als Ausgabe, mit einem Kontextfenster von 1 Mio. Tokens, einer maximalen Ausgabe von 128.000 Tokens (300.000 mit einem Beta-Header in der Batch-API), einem Trainings-Cutoff im Juni 2026 und einer Zusage von Anthropic, es nicht vor dem 7. Oktober 2027 außer Betrieb zu nehmen. Die Effort-Stufe ist über Low, Medium, High, Xhigh und Max einstellbar, Standard ist Medium, wobei adaptives Denken standardmäßig aktiviert ist. Cache-Lesevorgänge kosten 0,01 $ pro Million Tokens. Bei über 100.000 Tokens Prompt werden sowohl die Eingabe- als auch die Ausgaberate mit fünf multipliziert.

Aion 3.5 ist das Flaggschiff von AionLabs, ID aion-labs/aion-3.5, und es ist in beide Richtungen Nur-Text. Der Kontext umfasst 262.144 Token – doppelt so viel wie die 131.072 von Aion 3.0 – bei einer maximalen Ausgabe von 32.768 Token. Reasoning ist verpflichtend statt optional, standardmäßig auf high, kann aber auf max erhöht oder auf low heruntergesetzt werden. Architektonisch wird es als Multi-Modell-Ensemble in der GLM-Familie beschrieben statt als ein einzelnes trainiertes Netzwerk, was das Interessanteste daran und zugleich das ist, was sich von außen am schwersten überprüfen lässt. Der Preis liegt bei 3,00 $ pro Million Eingabe-Token, 0,75 $ für gecachte Eingabe und 6,00 $ für Ausgabe, einheitlich über das gesamte Fenster. Aion 3.5 Mini, am selben Tag veröffentlicht, kostet 0,70 $ / 0,18 $ / 1,40 $ für denselben 256K-Kontext – und genau dieses kleinere Geschwistermodell ist es, das diesen Vergleich interessant macht.

A capture of the AionLabs documentation page listing available models and their pricing, showing Aion 2.0, Aion 3.0, Aion 3.0 Mini, Aion 3.5 and Aion 3.5 Mini with their context windows and per-million input, cached-input and output rates, including Aion 3.5 at 256K context and Aion 3.5 Mini at the lower tier.

• Die Abmessungen, jeweils eine Zeile

• Eingabepreis — Claude Haiku 5.5: 0,10 $ pro Million bis zu 100K Tokens, darüber steigend auf 0,50 $; Aion 3.5: 3,00 $ konstant über das gesamte 256K-Fenster.

• Ausgabepreis — Claude Haiku 5.5 0,50 $ pro Million bis 100K, danach 2,50 $; Aion 3.5 6,00 $ pauschal.

• Zwischengespeicherte Eingabe — Claude Haiku 5.5: $0.01 pro Million bei Lesevorgängen und $0.125 bei Fünf-Minuten-Schreibvorgängen; Aion 3.5: $0.75 für zwischengespeicherte Eingabe, ohne separat veröffentlichten Lesetarif.

• Kontextfenster — 1.000.000 Tokens gegenüber 262.144.

• Maximale Ausgabe — 128.000 Token gegenüber 32.768.

• Eingabemodalitäten — Text und Bilder gegenüber nur Text.

• Reasoning-Steuerung — ein Aufwandsregler mit fünf Stufen von Niedrig bis Max gegenüber drei Stufen, bei denen Hoch die Standardeinstellung ist.

• Unabhängige Bewertung — Artificial Analysis Intelligence Index 43 mit einer Max-Konfiguration bei 43,40, Zweiter von 182 Modellen; für Aion 3.5 wurde kein Wert veröffentlicht.

• Kosten pro abgeschlossener Aufgabe — 0,21 $ pro Aufgabe des Artificial-Analysis-Index für Claude Haiku 5.5; für Aion 3.5 ohne Score nicht messbar.

• Ausgabegeschwindigkeit — 243,4 Token pro Sekunde für Claude Haiku 5.5; keine Angabe für Aion 3.5.

Warum die Flatrate nicht der Vorteil ist, für den sie gehalten wird

Der pauschale Preis von 3,00 $ über 256K hinweg ist das Sauberste an der Preisgestaltung von Aion 3.5, und er ist eine direkte Antwort auf die Unannehmlichkeit aufseiten von Anthropic: Ein Prompt, der von 99.000 auf 101.000 Tokens wächst, kostet fünfmal mehr pro Token, was einen entweder dazu zwingt, deutlich unter der Grenze zu bleiben, oder das günstige Preisband vollständig aufzugeben. Aion 3.5 hat keine Grenze. Man kann 240.000 Tokens senden und zahlt denselben Preis pro Token, den man für 4.000 zahlen würde.

Dieser Vorteil verflüchtigt sich in dem Moment, in dem man die Rechnung für eine echte Arbeitslast aufmacht. Ein Aufruf mit 240.000 Token auf Aion 3.5 kostet etwa 0,72 $ für die Eingabe; derselbe Aufruf auf Claude Haiku 5.5 oberhalb der Schwelle kostet etwa 0,12 $. Selbst wenn man den benachteiligenden Post-100K-Tarif zahlt, ist Haiku 5.5 beim größten Prompt, den eines der beiden Modelle verarbeiten kann, ungefähr sechsmal günstiger. Der Pauschaltarif beseitigt eine Klippe, keine Kosten.

Wo Flat-Pricing wirklich hilft, ist die Planbarkeit. Eine Pipeline, deren Prompt-Größe zwischen 80.000 und 130.000 Tokens schwankt, lässt sich mit einem gestaffelten Abrechnungsschema nur mühsam budgetieren und mit einem Pauschalmodell mühelos – und wenn das Ihrem Nutzungsprofil entspricht, ist die Pauschalität von Aion 3.5 etwas wert, noch bevor die Leistungsfähigkeit überhaupt zum Thema wird.

Das Argument für Aion 3.5, so stark vorgetragen, wie es die Beweislage zulässt.

Drei Argumente halten stand. Erstens: obligatorisches Reasoning mit einem hohen Standardwert bedeutet weniger Prompt-Engineering: Es gibt keinen Effort-Parameter zum Justieren und kein Risiko, dass eine niedrige Einstellung still eine Aufgabe verschlechtert, die niemand erneut getestet hat. Zweitens: Ein Ensemble aus der GLM-Familie hat ein wirklich anderes Fehlerprofil als ein einzelnes kleines Anthropic-Modell, und wenn Sie Claude Haiku 5.5 bereits über eine große Oberfläche hinweg einsetzen, hat eine unkorrelierte zweite Meinung selbst beim Dreißigfachen des Eingabepreises einen Wert — Sie würden nur selten dorthin routen. Drittens: Aion 3.5 Mini mit $0.70 / $0.18 / $1.40 bei gleichem 256K-Kontext ist eine glaubwürdige günstige Stufe, und jeder Vergleich, der nur das Flaggschiff betrachtet, vergleicht das falsche Aion-Modell.

Nicht haltbar ist es, den dreißigfachen Preisaufschlag als Beleg für die dreißigfache Leistungsfähigkeit zu werten. AionLabs veröffentlicht keine Benchmarks für Aion 3.5, die wir finden können, kein unabhängiges Labor hat es bewertet, und die Ensemble-Behauptung hat keine öffentliche Evaluation, die daran geknüpft ist. Ein Anbieter, der ein stärkeres Modell als Claude Haiku 5.5 hat und das demonstrieren kann, würde es demonstrieren.

Wo Claude Haiku 5.5 klar gewinnt – und das nicht knapp.

Bildeingabe, zum einen. Aion 3.5 ist reiner Text, und Claude Haiku 5.5 akzeptiert Bilder, was über jede Dokument-, Screenshot- oder Diagramm-Workload entscheidet, bevor überhaupt der Preis erwähnt wird. Maximale Ausgabe, zum anderen: 128.000 Tokens gegenüber 32.768, mit einem Beta-Pfad von 300.000 Tokens bei Batch. Und der Effort-Regler, der eher ein Kostenkontrollmechanismus als eine Fähigkeit ist: Auf Low erzeugt Claude Haiku 5.5 weit weniger Reasoning-Tokens, und da Reasoning als Ausgabe abgerechnet wird, halten Sie damit einen ausführlichen Agenten im günstigen Bereich.

Der unabhängige Score ist hier das letzte Wort. Im Index von Artificial Analysis liegt Claude Haiku 5.5 insgesamt bei 43 und bei 43,40 in seiner Max-Konfiguration, auf Platz zwei von 182 Modellen, bei 0,21 $ pro Index-Aufgabe mit 243,4 Tokens Ausgabe pro Sekunde. Das sind unabhängig erhobene Zahlen. Aion 3.5 hat keinen, und bis es einen hat, lautet der Vergleich, den der Käufer tatsächlich anstellt: „ein Modell mit einem veröffentlichten Score und einem Preis, den ich vorhersagen kann“ gegen „ein Modell mit einem höheren Preis und ohne Score“ – was für einen Produktionspfad keine schwierige Entscheidung ist.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Aion 3.5 — the scoreboard'. Claude Haiku 5.5 reads input $0.10 to $0.50 per million, output $0.50 to $2.50, 1M-token context, 128K maximum output, AA Index 43, text and image in; Aion 3.5 reads input $3.00 flat, output $6.00 flat, 262K context, 32K maximum output, no published independent score, text only. A footer notes that Claude Haiku 5.5 figures are per Artificial Analysis and Aion 3.5 figures are vendor-reported and unreproduced.

Beides betreiben, ohne die Verkabelung zu verdoppeln

Aion 3.5 ist über die eigene API von AionLabs und mehrere Drittanbieter-Plattformen erreichbar. Claude Haiku 5.5 ist über die API von Anthropic verfügbar und von dort aus überall dort, wo Anthropics Modelle weiterverkauft werden. Keines von beiden steht heute im Katalog von OrcaRouter, und wir werden nichts anderes suggerieren: Was wir aus dieser Ecke des Marktes weiterleiten, ist anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 und anthropic/claude-fable-5.1 — die Stufe über dem Modell, um das es in diesem Artikel geht.

Der Grund, warum das hier wichtig ist: Die sinnvolle Architektur für diese Paarung ist ein kleiner Anteil des Traffics auf dem teuren Modell. Man verlegt keine Pipeline auf ein Ensemble für 3,00 $ pro Million; man schickt ihm die zwei Prozent der Aufrufe, bei denen eine zweite Meinung 3,00 $ wert ist, und alles andere bleibt auf dem günstigen Modell. Das bedeutet zwei Anbieter, zwei Schlüssel und zwei Abrechnungsoberflächen für eine Arbeitslast von zwei Prozent – genau die Form, für die ein Gateway da ist. OrcaRouter gibt den Listenpreis des Anbieters mit 0 % Aufschlag weiter, sodass eine Preisänderung eines Anbieters noch am selben Tag live ist statt erst im nächsten Preisanpassungszyklus, und der A/B-Test ist ein Modell-String statt eine zweite Integration. Wenn keiner der beiden Wege in unserem Katalog ist, ist die ehrliche Antwort, dass wir die falsche Schicht dafür sind und eine direkte Integration das Richtige ist.

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

Was würde das klären

Eine unabhängige Evaluation von Aion 3.5. Das ist das ganze fehlende Puzzlestück. Wenn ein neutrales Labor es irgendwo in die Nähe von Claude Haiku 5.5 mit 43 zu 0,21 $ pro Aufgabe einordnet, dann verlangt AionLabs den dreißigfachen Eingabepreis für Parität, und die Ensemble-Story ist eher eine Belastung als ein Feature. Wenn es deutlich höher abschneidet, dann ist der Aufpreis real, und der richtige Schritt ist, ihn für den kleinen Bruchteil der Aufrufe auszugeben, die ihn brauchen. Solange diese Zahl nicht existiert, wählt ein Käufer, der zwischen diesen beiden wählt, entweder ein gemessenes Modell zu einem veröffentlichten Preis oder ein ungemessenes zu einem höheren — und in diesem Paar gibt es nur eine vertretbare Standardwahl.

Das bedeutet zwei Anbieter, zwei Schlüssel und zwei Abrechnungsoberflächen für eine Arbeitslast von zwei Prozent – genau das, wofür ein Gateway gedacht ist.