
Claude Haiku 5.5 vs Aion 3.5: dertig keer de invoerprijs voor een model dat nog door niemand is beoordeeld
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Claude Haiku 5.5 kost $0,10 per miljoen inputtokens. Aion 3.5 kost $3,00. Dat is dertig keer de inputprijs en twaalf keer de outputprijs voor twee modellen die beide een lange tekstprompt accepteren en tekst retourneren, en het verschil wordt niet verklaard door capaciteit — het wordt verklaard door wat elk bedrijf verkoopt. Claude Haiku 5.5, uitgebracht op 7 oktober 2026, is een werkpaard tegen commodityprijs met een effort-dial en een onafhankelijke score. Aion 3.5, uitgebracht op 23 september 2026 door AionLabs, is een ensemble met verplichte reasoning dat in twee groottes leverbaar is, waarvan er één echt goedkoop is. Of de dertigvoudige premie het waard is om te betalen, hangt volledig af van een vraag die de leverancier niet heeft beantwoord.
Het ongemakkelijke deel meteen vooraan: Artificial Analysis heeft Claude Haiku 5.5 gescoord en heeft nooit een score gepubliceerd voor Aion 3.5. Dat geldt ook voor iedereen anders die we kunnen vinden. Dit is dus geen vergelijking van twee gemeten zaken. Het is een vergelijking van één gemeten zaak met één reeks leveranciersclaims, en de eerlijke manier om het op te schrijven is om dat in elke sectie te zeggen in plaats van één keer in een voetnoot.
De twee modellen, elk in één alinea
Claude Haiku 5.5 is het kleine model van de leverancier, ID claude-haiku-5-5, tekst en afbeeldingen in en tekst uit, met een contextvenster van 1M tokens, een maximale uitvoer van 128.000 tokens (300.000 met een bèta-header op de Batch API), een trainingsafsluitdatum van juni 2026 en de toezegging van Anthropic om het niet vóór 7 oktober 2027 uit te faseren. De inspanning is aanpasbaar via Low, Medium, High, Xhigh en Max, met Medium als standaard, en adaptief denken staat standaard aan. Leesbewerkingen uit de cache kosten $0,01 per miljoen tokens. Boven 100.000 tokens aan prompt worden zowel het invoer- als het uitvoertarief met vijf vermenigvuldigd.
Aion 3.5 is het vlaggenschip van AionLabs, ID aion-labs/aion-3.5, en het ondersteunt in beide richtingen uitsluitend tekst. De context bedraagt 262.144 tokens — een verdubbeling ten opzichte van de 131.072 van Aion 3.0 — met een maximale uitvoer van 32.768 tokens. Redeneren is verplicht, niet optioneel, met een standaardwaarde van high die naar max kan worden verhoogd of naar low kan worden verlaagd. Architectonisch wordt het beschreven als een multi-model-ensemble in de GLM-familie en niet als één enkel getraind netwerk, wat het meest interessante eraan is en ook het moeilijkst van buitenaf te verifiëren. De prijs is $3,00 per miljoen invoertokens, $0,75 voor gecachte invoer en $6,00 voor uitvoer, een vaste prijs over het hele venster. Aion 3.5 Mini, die dezelfde dag werd gelanceerd, kost $0,70 / $0,18 / $1,40 voor dezelfde 256K-context — en die kleinere variant is degene die deze vergelijking interessant maakt.

• De afmetingen, één per regel
• Prijs van invoer — Claude Haiku 5.5 $0,10 per miljoen tot 100K tokens, daarboven stijgend naar $0,50; Aion 3.5 $3,00 vlak over het hele venster van 256K.
• Uitvoerprijs — Claude Haiku 5.5 $0,50 per miljoen tot 100K, daarna $2,50; Aion 3.5 $6,00 vast tarief.
• Gecachte invoer — Claude Haiku 5.5 $0,01 per miljoen bij leesbewerkingen en $0,125 bij schrijfbewerkingen van vijf minuten; Aion 3.5 $0,75 voor gecachte invoer, zonder afzonderlijk gepubliceerd leestarief.
• Contextvenster — 1.000.000 tokens tegenover 262.144.
• Maximale uitvoer — 128.000 tokens tegenover 32.768.
• Invoermodaliteiten — tekst en afbeeldingen versus alleen tekst.
• Redeneerbesturing — een inspanningsregelaar met vijf standen van Laag tot Max tegenover drie standen waarbij hoog de standaard is.
• Onafhankelijke score — Artificial Analysis Intelligence Index 43 met een Max-configuratie van 43,40, tweede van 182 modellen; niets gepubliceerd voor Aion 3.5.
• Kosten per voltooide taak — $0,21 per Artificial Analysis-indextaak voor Claude Haiku 5.5; niet meetbaar voor Aion 3.5 zonder een score.
• Uitvoersnelheid — 243,4 tokens per seconde voor Claude Haiku 5.5; niet gerapporteerd voor Aion 3.5.
Waarom het vaste tarief niet de winst is die het lijkt
Het vaste tarief van $3,00 over 256K van Aion 3.5 is het helderste aspect van zijn prijsstelling, en het is een direct antwoord op de ongemakkelijkheid aan de kant van Anthropic: een prompt die groeit van 99.000 naar 101.000 tokens kost vijf keer meer per token, waardoor je gedwongen wordt om ofwel ruim onder de grens te blijven ofwel de goedkope schijf helemaal op te geven. Aion 3.5 heeft geen grens. Je kunt 240.000 tokens verzenden en hetzelfde tarief per token betalen als voor 4.000.
Dat voordeel verdampt op het moment dat je de rekensom maakt voor een echte workload. Een aanroep van 240.000 tokens op Aion 3.5 kost ongeveer $0,72 aan input; dezelfde aanroep op Claude Haiku 5.5 boven de drempel kost ongeveer $0,12. Zelfs met het bestrafte tarief na 100K is Haiku 5.5 ongeveer zes keer goedkoper bij de grootste prompt die een van beide modellen aankan. Het vaste tarief verwijdert een prijsklif, niet een kostenpost.
Waar een vast tarief echt helpt, is bij voorspelbaarheid. Een pipeline waarvan de promptgrootte schommelt tussen 80.000 en 130.000 tokens is een ramp om te budgetteren volgens een getrapt tariefmodel en een fluitje van een cent volgens een vast tariefmodel, en als dat jouw situatie is, is de platte prijsstructuur van Aion 3.5 al iets waard nog voordat capaciteit ter sprake komt.
Het pleidooi voor Aion 3.5, zo sterk als het bewijs toelaat
Drie argumenten houden stand. Ten eerste: verplicht redeneren op een hoge standaardinstelling betekent minder prompt engineering: er is geen effort-parameter om af te stellen en geen risico dat een lage instelling stilletjes een taak verslechtert die niemand opnieuw heeft getest. Ten tweede: een ensemble uit de GLM-familie heeft een werkelijk ander faalprofiel dan één enkel klein Anthropic-model, en als je Claude Haiku 5.5 al op grote schaal draait, heeft een ongecorreleerde second opinion waarde, zelfs bij dertig keer de inputprijs — je zou er zelden naartoe routeren. Ten derde: Aion 3.5 Mini voor $0,70 / $0,18 / $1,40 met dezelfde 256K-context is een geloofwaardig goedkoop niveau, en elke vergelijking die alleen naar het flagship kijkt, vergelijkt het verkeerde Aion-model.
Wat geen stand houdt, is dat men de dertigvoudige premie aanziet voor bewijs van dertig keer de capaciteit. AionLabs publiceert geen benchmarks voor Aion 3.5 die wij kunnen vinden, geen enkel onafhankelijk lab heeft het gescoord, en aan de ensemblebewering is geen openbare evaluatie verbonden. Een leverancier die een sterker model dan Claude Haiku 5.5 heeft en dat kan aantonen, zou dat aantonen.
Waar Claude Haiku 5.5 overtuigend wint, en het is niet eens close
Beeldinvoer, ten eerste. Aion 3.5 is alleen tekst, en Claude Haiku 5.5 accepteert afbeeldingen, wat elke document-, screenshot- of diagramwerklast beslist voordat er überhaupt over prijzen wordt gesproken. Maximale uitvoer, ten tweede: 128.000 tokens tegenover 32.768, met een bètapad van 300.000 tokens op Batch. En de effort-dial, die eerder een kostenbeheersingsmechanisme dan een capaciteit is: op Low produceert Claude Haiku 5.5 veel minder redeneertokens, en omdat redeneren als uitvoer wordt gefactureerd, is dat waar je een breedsprakige agent binnen de goedkope band houdt.
De onafhankelijke score is hier het laatste woord over. Op de index van Artificial Analysis staat Claude Haiku 5.5 op 43 overall en 43,40 in zijn Max-configuratie, tweede van 182 modellen, tegen $0,21 per indextaak met 243,4 tokens per seconde aan output. Dat zijn onafhankelijk uitgevoerde cijfers. Aion 3.5 heeft er geen, en totdat dat wel zo is, is de vergelijking die de koper feitelijk maakt "een model met een gepubliceerde score en een prijs die ik kan voorspellen" tegenover "een model met een hogere prijs en geen score", wat voor een productiepad geen moeilijke keuze is.

Beide draaien zonder de infrastructuur te verdubbelen
Aion 3.5 is bereikbaar via de eigen API van AionLabs en via verschillende platforms van derden. Claude Haiku 5.5 is beschikbaar via de API van Anthropic en van daaruit overal waar de modellen van Anthropic worden doorverkocht. Geen van beide staat vandaag in de catalogus van OrcaRouter, en dat zullen we ook niet suggereren: wat wij vanuit deze hoek van de markt routeren is anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 en anthropic/claude-fable-5.1 — het segment boven het model waar dit artikel over gaat.
De reden dat het hier uitmaakt, is dat de verstandige architectuur voor deze combinatie een klein aandeel van het verkeer op het dure model is. Je verhuist een pipeline niet naar een ensemble van $3,00 per miljoen; je stuurt er de twee procent aan calls naartoe waar een second opinion $3,00 waard is, en je houdt al het andere op het goedkope model. Dat betekent twee providers, twee sleutels en twee factuuroppervlakken voor een workload van twee procent, en dat is precies de vorm waarvoor een gateway bedoeld is. OrcaRouter geeft de lijstprijs van de provider door met 0% markup, dus een prijswijziging van een leverancier is dezelfde dag live in plaats van volgens een prijsherzieningscyclus, en de A/B is een modelstring in plaats van een tweede integratie. Wanneer geen van beide benen in onze catalogus staat, is het eerlijke antwoord dat wij de verkeerde laag daarvoor zijn en dat een directe integratie is wat je wilt.

Wat zou dit oplossen?
Eén onafhankelijke evaluatie van Aion 3.5. Dat is precies het ontbrekende stuk. Als een neutraal lab het ergens in de buurt van de 43 van Claude Haiku 5.5 scoort tegen $0,21 per taak, dan vraagt AionLabs dertig keer de inputprijs voor pariteit en is het ensembleverhaal een risico in plaats van een voordeel. Als het aanzienlijk hoger scoort, dan is de meerprijs reëel en is de juiste zet om die te besteden aan de kleine fractie van calls die het nodig hebben. Zolang dat getal er niet is, kiest een koper die tussen deze twee moet kiezen voor een gemeten model tegen een gepubliceerde prijs of voor een ongemeten model tegen een hogere prijs — en er is maar één verdedigbare standaardkeuze in dat paar.
Dat betekent twee providers, twee sleutels en twee facturatieoppervlakken voor een werklast van twee procent, wat precies de vorm is waarvoor een gateway bedoeld is.
