Een gegenereerde hero-kaart met de titel 'Claude Haiku 5.5 vs Aion 3.5', de kicker '30x DE INPUTPRIJS' en de ondertitel 'De een heeft een score. De ander niet.', met chips waarop staat: $0,10 vs $3,00 per miljoen inputtokens, AA Index 43 tegenover niets, en 1M tegenover 262K context.
Guides & Insights

Claude Haiku 5.5 vs Aion 3.5: dertig keer de invoerprijs voor een model dat nog door niemand is beoordeeld

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Haiku 5.5 kost $0,10 per miljoen inputtokens. Aion 3.5 kost $3,00. Dat is dertig keer de inputprijs en twaalf keer de outputprijs voor twee modellen die beide een lange tekstprompt accepteren en tekst retourneren, en het verschil wordt niet verklaard door capaciteit — het wordt verklaard door wat elk bedrijf verkoopt. Claude Haiku 5.5, uitgebracht op 7 oktober 2026, is een werkpaard tegen commodityprijs met een effort-dial en een onafhankelijke score. Aion 3.5, uitgebracht op 23 september 2026 door AionLabs, is een ensemble met verplichte reasoning dat in twee groottes leverbaar is, waarvan er één echt goedkoop is. Of de dertigvoudige premie het waard is om te betalen, hangt volledig af van een vraag die de leverancier niet heeft beantwoord.

Het ongemakkelijke deel meteen vooraan: Artificial Analysis heeft Claude Haiku 5.5 gescoord en heeft nooit een score gepubliceerd voor Aion 3.5. Dat geldt ook voor iedereen anders die we kunnen vinden. Dit is dus geen vergelijking van twee gemeten zaken. Het is een vergelijking van één gemeten zaak met één reeks leveranciersclaims, en de eerlijke manier om het op te schrijven is om dat in elke sectie te zeggen in plaats van één keer in een voetnoot.

De twee modellen, elk in één alinea

Claude Haiku 5.5 is het kleine model van de leverancier, ID claude-haiku-5-5, tekst en afbeeldingen in en tekst uit, met een contextvenster van 1M tokens, een maximale uitvoer van 128.000 tokens (300.000 met een bèta-header op de Batch API), een trainingsafsluitdatum van juni 2026 en de toezegging van Anthropic om het niet vóór 7 oktober 2027 uit te faseren. De inspanning is aanpasbaar via Low, Medium, High, Xhigh en Max, met Medium als standaard, en adaptief denken staat standaard aan. Leesbewerkingen uit de cache kosten $0,01 per miljoen tokens. Boven 100.000 tokens aan prompt worden zowel het invoer- als het uitvoertarief met vijf vermenigvuldigd.

Aion 3.5 is het vlaggenschip van AionLabs, ID aion-labs/aion-3.5, en het ondersteunt in beide richtingen uitsluitend tekst. De context bedraagt 262.144 tokens — een verdubbeling ten opzichte van de 131.072 van Aion 3.0 — met een maximale uitvoer van 32.768 tokens. Redeneren is verplicht, niet optioneel, met een standaardwaarde van high die naar max kan worden verhoogd of naar low kan worden verlaagd. Architectonisch wordt het beschreven als een multi-model-ensemble in de GLM-familie en niet als één enkel getraind netwerk, wat het meest interessante eraan is en ook het moeilijkst van buitenaf te verifiëren. De prijs is $3,00 per miljoen invoertokens, $0,75 voor gecachte invoer en $6,00 voor uitvoer, een vaste prijs over het hele venster. Aion 3.5 Mini, die dezelfde dag werd gelanceerd, kost $0,70 / $0,18 / $1,40 voor dezelfde 256K-context — en die kleinere variant is degene die deze vergelijking interessant maakt.

A capture of the AionLabs documentation page listing available models and their pricing, showing Aion 2.0, Aion 3.0, Aion 3.0 Mini, Aion 3.5 and Aion 3.5 Mini with their context windows and per-million input, cached-input and output rates, including Aion 3.5 at 256K context and Aion 3.5 Mini at the lower tier.

• De afmetingen, één per regel

• Prijs van invoer — Claude Haiku 5.5 $0,10 per miljoen tot 100K tokens, daarboven stijgend naar $0,50; Aion 3.5 $3,00 vlak over het hele venster van 256K.

• Uitvoerprijs — Claude Haiku 5.5 $0,50 per miljoen tot 100K, daarna $2,50; Aion 3.5 $6,00 vast tarief.

• Gecachte invoer — Claude Haiku 5.5 $0,01 per miljoen bij leesbewerkingen en $0,125 bij schrijfbewerkingen van vijf minuten; Aion 3.5 $0,75 voor gecachte invoer, zonder afzonderlijk gepubliceerd leestarief.

• Contextvenster — 1.000.000 tokens tegenover 262.144.

• Maximale uitvoer — 128.000 tokens tegenover 32.768.

• Invoermodaliteiten — tekst en afbeeldingen versus alleen tekst.

• Redeneerbesturing — een inspanningsregelaar met vijf standen van Laag tot Max tegenover drie standen waarbij hoog de standaard is.

• Onafhankelijke score — Artificial Analysis Intelligence Index 43 met een Max-configuratie van 43,40, tweede van 182 modellen; niets gepubliceerd voor Aion 3.5.

• Kosten per voltooide taak — $0,21 per Artificial Analysis-indextaak voor Claude Haiku 5.5; niet meetbaar voor Aion 3.5 zonder een score.

• Uitvoersnelheid — 243,4 tokens per seconde voor Claude Haiku 5.5; niet gerapporteerd voor Aion 3.5.

Waarom het vaste tarief niet de winst is die het lijkt

Het vaste tarief van $3,00 over 256K van Aion 3.5 is het helderste aspect van zijn prijsstelling, en het is een direct antwoord op de ongemakkelijkheid aan de kant van Anthropic: een prompt die groeit van 99.000 naar 101.000 tokens kost vijf keer meer per token, waardoor je gedwongen wordt om ofwel ruim onder de grens te blijven ofwel de goedkope schijf helemaal op te geven. Aion 3.5 heeft geen grens. Je kunt 240.000 tokens verzenden en hetzelfde tarief per token betalen als voor 4.000.

Dat voordeel verdampt op het moment dat je de rekensom maakt voor een echte workload. Een aanroep van 240.000 tokens op Aion 3.5 kost ongeveer $0,72 aan input; dezelfde aanroep op Claude Haiku 5.5 boven de drempel kost ongeveer $0,12. Zelfs met het bestrafte tarief na 100K is Haiku 5.5 ongeveer zes keer goedkoper bij de grootste prompt die een van beide modellen aankan. Het vaste tarief verwijdert een prijsklif, niet een kostenpost.

Waar een vast tarief echt helpt, is bij voorspelbaarheid. Een pipeline waarvan de promptgrootte schommelt tussen 80.000 en 130.000 tokens is een ramp om te budgetteren volgens een getrapt tariefmodel en een fluitje van een cent volgens een vast tariefmodel, en als dat jouw situatie is, is de platte prijsstructuur van Aion 3.5 al iets waard nog voordat capaciteit ter sprake komt.

Het pleidooi voor Aion 3.5, zo sterk als het bewijs toelaat

Drie argumenten houden stand. Ten eerste: verplicht redeneren op een hoge standaardinstelling betekent minder prompt engineering: er is geen effort-parameter om af te stellen en geen risico dat een lage instelling stilletjes een taak verslechtert die niemand opnieuw heeft getest. Ten tweede: een ensemble uit de GLM-familie heeft een werkelijk ander faalprofiel dan één enkel klein Anthropic-model, en als je Claude Haiku 5.5 al op grote schaal draait, heeft een ongecorreleerde second opinion waarde, zelfs bij dertig keer de inputprijs — je zou er zelden naartoe routeren. Ten derde: Aion 3.5 Mini voor $0,70 / $0,18 / $1,40 met dezelfde 256K-context is een geloofwaardig goedkoop niveau, en elke vergelijking die alleen naar het flagship kijkt, vergelijkt het verkeerde Aion-model.

Wat geen stand houdt, is dat men de dertigvoudige premie aanziet voor bewijs van dertig keer de capaciteit. AionLabs publiceert geen benchmarks voor Aion 3.5 die wij kunnen vinden, geen enkel onafhankelijk lab heeft het gescoord, en aan de ensemblebewering is geen openbare evaluatie verbonden. Een leverancier die een sterker model dan Claude Haiku 5.5 heeft en dat kan aantonen, zou dat aantonen.

Waar Claude Haiku 5.5 overtuigend wint, en het is niet eens close

Beeldinvoer, ten eerste. Aion 3.5 is alleen tekst, en Claude Haiku 5.5 accepteert afbeeldingen, wat elke document-, screenshot- of diagramwerklast beslist voordat er überhaupt over prijzen wordt gesproken. Maximale uitvoer, ten tweede: 128.000 tokens tegenover 32.768, met een bètapad van 300.000 tokens op Batch. En de effort-dial, die eerder een kostenbeheersingsmechanisme dan een capaciteit is: op Low produceert Claude Haiku 5.5 veel minder redeneertokens, en omdat redeneren als uitvoer wordt gefactureerd, is dat waar je een breedsprakige agent binnen de goedkope band houdt.

De onafhankelijke score is hier het laatste woord over. Op de index van Artificial Analysis staat Claude Haiku 5.5 op 43 overall en 43,40 in zijn Max-configuratie, tweede van 182 modellen, tegen $0,21 per indextaak met 243,4 tokens per seconde aan output. Dat zijn onafhankelijk uitgevoerde cijfers. Aion 3.5 heeft er geen, en totdat dat wel zo is, is de vergelijking die de koper feitelijk maakt "een model met een gepubliceerde score en een prijs die ik kan voorspellen" tegenover "een model met een hogere prijs en geen score", wat voor een productiepad geen moeilijke keuze is.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Aion 3.5 — the scoreboard'. Claude Haiku 5.5 reads input $0.10 to $0.50 per million, output $0.50 to $2.50, 1M-token context, 128K maximum output, AA Index 43, text and image in; Aion 3.5 reads input $3.00 flat, output $6.00 flat, 262K context, 32K maximum output, no published independent score, text only. A footer notes that Claude Haiku 5.5 figures are per Artificial Analysis and Aion 3.5 figures are vendor-reported and unreproduced.

Beide draaien zonder de infrastructuur te verdubbelen

Aion 3.5 is bereikbaar via de eigen API van AionLabs en via verschillende platforms van derden. Claude Haiku 5.5 is beschikbaar via de API van Anthropic en van daaruit overal waar de modellen van Anthropic worden doorverkocht. Geen van beide staat vandaag in de catalogus van OrcaRouter, en dat zullen we ook niet suggereren: wat wij vanuit deze hoek van de markt routeren is anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 en anthropic/claude-fable-5.1 — het segment boven het model waar dit artikel over gaat.

De reden dat het hier uitmaakt, is dat de verstandige architectuur voor deze combinatie een klein aandeel van het verkeer op het dure model is. Je verhuist een pipeline niet naar een ensemble van $3,00 per miljoen; je stuurt er de twee procent aan calls naartoe waar een second opinion $3,00 waard is, en je houdt al het andere op het goedkope model. Dat betekent twee providers, twee sleutels en twee factuuroppervlakken voor een workload van twee procent, en dat is precies de vorm waarvoor een gateway bedoeld is. OrcaRouter geeft de lijstprijs van de provider door met 0% markup, dus een prijswijziging van een leverancier is dezelfde dag live in plaats van volgens een prijsherzieningscyclus, en de A/B is een modelstring in plaats van een tweede integratie. Wanneer geen van beide benen in onze catalogus staat, is het eerlijke antwoord dat wij de verkeerde laag daarvoor zijn en dat een directe integratie is wat je wilt.

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

Wat zou dit oplossen?

Eén onafhankelijke evaluatie van Aion 3.5. Dat is precies het ontbrekende stuk. Als een neutraal lab het ergens in de buurt van de 43 van Claude Haiku 5.5 scoort tegen $0,21 per taak, dan vraagt AionLabs dertig keer de inputprijs voor pariteit en is het ensembleverhaal een risico in plaats van een voordeel. Als het aanzienlijk hoger scoort, dan is de meerprijs reëel en is de juiste zet om die te besteden aan de kleine fractie van calls die het nodig hebben. Zolang dat getal er niet is, kiest een koper die tussen deze twee moet kiezen voor een gemeten model tegen een gepubliceerde prijs of voor een ongemeten model tegen een hogere prijs — en er is maar één verdedigbare standaardkeuze in dat paar.

Dat betekent twee providers, twee sleutels en twee facturatieoppervlakken voor een werklast van twee procent, wat precies de vorm is waarvoor een gateway bedoeld is.