
Union Alpha vs Gemini 3.8 Flash: De een heeft een score, de ander een claim
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Union Alpha en Gemini 3.8 Flash zijn dezelfde pitch, geleverd op twee totaal verschillende niveaus van bewijs. De operator van Union Alpha beschrijft het als "prestaties op frontier-niveau voor een breed scala aan algemene taken" en heeft geen benchmark, geen parameteraantal, geen licentie en geen naam gepubliceerd. Gemini 3.8 Flash werd geleverd met een gedateerde evaluatietabel, een Artificial Analysis Intelligence Index, kostencijfers per taak van onafhankelijke testers, en een gedocumenteerd prijsschema dat doorloopt tot in 2027. Als je tussen hen kiest op basis van iets anders dan prijs, kies je tussen een getal dat je kunt controleren en een zin die je niet kunt controleren.
Zij aan zij, voor de ruzie
• Contextvenster — Union Alpha 262.144 tokens vs. Gemini 3.8 Flash 1.048.576 tokens.
• Maximale output — 131.072 tokens tegenover 65.536 tokens. Union Alpha wint dit punt, en het is de enige structurele as waarop dat zo is.
• Invoer — tekst en afbeelding bij beide, maar Gemini 3.8 Flash accepteert daarnaast ook video, audio en bestanden.
• Prijzen — Union Alpha $0 tijdens de preview versus Gemini 3.8 Flash: $0,75/M invoer, $3,75/M uitvoer, $0,075/M gecachete invoer, met een verdubbeling op 1 januari 2027 naar $1,50/$7,50.
• Reasoning-instellingen — geen enkele beschikbaar op Union Alpha versus denkniveaus op Gemini 3.8 Flash die zowel de kwaliteit als de kosten direct beïnvloeden.
• Gepubliceerde evaluatie — geen enkele van de operator van Union Alpha vs een volledige gedateerde tabel over Gemini 3.8 Flash.
• Herkomst — anonieme operator, geen gewichten vs de gedateerde release en gedocumenteerde afstamming van Gemini 3.8 Flash.

Wat de cijfers van Gemini 3.8 Flash eigenlijk zeggen
Gemini 3.8 Flash is op 2 september 2026 gelanceerd — Googles derde Flash-release in ongeveer zes weken, wat aangeeft dat het verhaal van dit model vooral om cadans draait en niet om een doorbraak. De gepubliceerde evaluatietabel vermeldt artificialanalysis.ai en deepmind.google samen als bron, dus lees die als een mix van onafhankelijke cijfers en leverancierscijfers in plaats van als een zuivere audit door een derde partij.
• AA Coding — 76.3, wat een oprecht sterke codeerscore is.
• AA Intelligence — 41,2. Let op: Artificial Analysis rapporteert afzonderlijk 59 op de Intelligence Index bij hoge reasoning-inspanning, dus het getal verschuift sterk mee met de inspanningsinstelling; vermeld de instelling, anders zegt het getal niets.
• GPQA Diamond — 95,3, veruit het hoogste individuele cijfer in deze vergelijking.
• HLE-Verified — 54,9, met het gewone Humanity's Last Exam op 47,8.
• Terminal-Bench 2.1 — 89,4 in Googles eigen tabel, een fractie hoger dan de 89,1 van Claude Opus 5.
• Recall bij lange context — 81,3; SciCode 56,6; tau_banking 44,9.
• Waargenomen doorvoer — 323 uitvoertokens per seconde over een recent venster van zeven dagen, met een foutpercentage van 0,63%, een mediane tijd-tot-eerste-token van 3,46 seconden, en 498,5M tokens aan gemeten verkeer.
De zwakke punten zijn even goed gedocumenteerd als de sterke punten. Op Terminal-Bench 4.0 scoort het 19,1 tegenover de 51,8 van Claude Opus 5. Op OSWorld 2.0 haalt het 59,0% tegenover 75,4%. Op GDPVal-AA v2 blijft het achter met 1545 Elo tegenover 1824. Gemini 3.8 Flash is uitstekend in een specifieke band van werk en gaat keihard onderuit bij de moeilijkste evaluaties voor algemene agents — precies het soort patroon dat een gepubliceerde tabel je laat zien.
De prijswending die mensen erin laat trappen
Google liet de prijs per token ongewijzigd ten opzichte van Gemini 3.7 Flash. Toch ging de rekening omhoog.
Het model werkt harder: meer redeneerstappen, meer iteratieve tool-aanroepen. Onafhankelijke tests door Artificial Analysis maten ongeveer 30% meer outputtokens per taak en ongeveer 40% hogere kosten per taak dan 3.7 Flash. Bij een hoge redeneerstand komt dat uit op ongeveer $0,58 per taak; medium ligt rond $0,41 en laag rond $0,24.
Dit is het allerbruikbaarste in de vergelijking voor iedereen die een budget opstelt, en het geldt ruimschoots buiten deze twee modellen: eenheidsprijs en kosten per taak zijn verschillende getallen, en slechts één ervan staat op een prijzenpagina. Google heeft 3.7 Flash beschikbaar gehouden als de goedkopere optie, wat een stilzwijgende erkenning van de verschuiving is.
Wat Union Alpha in plaats daarvan biedt
Union Alpha verscheen op 16 september 2026 in catalogi van derden en draait op het gratis niveau van OrcaRouter. Het is anoniem — geen lab, geen gewichten, geen licentie, geen kennisafsluitdatum — en gratis voor een aangegeven periode van ongeveer een week, met een limiet op het aantal verzoeken, zonder dat er een prijs na de preview is aangekondigd.
Zijn endpoint is verifieerbaar, zelfs waar zijn herkomst dat niet is: 262.144-tokencontext, 131.072-token maximale uitvoer, tekst- en afbeeldingsinvoer met alleen tekstuitvoer, tool calling en JSON-uitvoer, temperature, top_p, max_tokens, en geen enkele vorm van redeneerbesturing. Toolkeuze ondersteunt in feite alleen "auto".
Er is precies één onafhankelijke meting. SMF Clearinghouse voerde 157 Official A-tests uit met reasoning uitgeschakeld en scoorde 136/157 — 86,6%, nul fouten, tiende van zesentwintig. Redeneren was perfect met 30/30, tools 2/2, programmeren 26/30, wiskunde 24/30. Schrijven kwam uit op 2/5.
Dat is geen slecht resultaat. Het is alleen geen vergelijkbaar resultaat. Official A is een brede algemene suite van 157 tests; AA Coding en GPQA Diamond zijn verschillende instrumenten die verschillende dingen meten op verschillende moeilijkheidsniveaus. 136/157 naast 95,3 op GPQA Diamond zetten en vervolgens een winnaar uitroepen, zou precies het soort witwassen zijn waardoor leverancierscijfers nutteloos worden.


De kostenvergelijking die niemand echt kan afmaken
Hier is het uitgewerkte voorbeeld, en het is met opzet onvolledig.
Neem een taak die je duizend keer per maand uitvoert. Bij Gemini 3.8 Flash met hoog redeneervermogen brengt het gepubliceerde bedrag per taak van ongeveer $0,58 dat op circa $580 per maand. Dat is een reëel, verdedigbaar getal dat is opgebouwd uit gemeten tokenverbruik.
Op Union Alpha kosten diezelfde duizend taken vandaag $0. Wat ze over drie weken kosten, is onbekend, omdat er geen post-previewprijs bestaat. Wat ze aan betrouwbaarheid kosten, is ook onbekend, omdat het model aan een rate limit onderhevig is, op één enkel endpoint draait zonder fallbackprovider, en met HTTP 429 antwoordt zodra je een limiet overschrijdt die niemand heeft gepubliceerd.
Dus het eerlijke antwoord is dat Union Alpha de enige beschikbare kostenvergelijking wint en het vermogen verliest om de kosten te voorspellen. Voor een eenmalige vergelijkende test is dat prima. Voor een begrotingspost is het geen getal — het is een hoop met een URL.
Waar elk thuishoort
Gemini 3.8 Flash hoort thuis overal waar je een gemeten ondergrens nodig hebt: documentwerk met een lange context en video- of audio-invoer, coderingstaken waarbij de AA Coding-score van 76.3 het relevante instrument is, en elke werklast met een budget eraan verbonden, omdat je de kosten kunt berekenen voordat je je vastlegt en je weet dat ze op 1 januari 2027 verdubbelen.
Union Alpha hoort op de verkennende plek — het uitproberen van een 256K-model met vision-capaciteiten waarvan het uitvoerplafond het dubbele is van dat van Gemini, voor werk waarbij een verdwenen endpoint je niets kost.
De reden om ze achter één endpoint te draaien in plaats van twee integraties is dat deze vergelijking herhaaldelijk van vorm zal veranderen. Een routing-DSL laat je de twee samenvoegen tot één aanroep — Gemini 3.8 Flash als het gemeten pad, Union Alpha als de experimentele tak — in plaats van een beslissing hard te coderen die je opnieuw wilt bekijken wanneer het gratis venster sluit of wanneer het introductietarief van Google verstrijkt. Geen van die datums is ver weg, en beide zullen de rekensom veranderen.
Wat zou het beslechten?
Eén gedateerde vermelding voor Union Alpha op een leaderboard dat ook Gemini 3.8 Flash bevat. Dat is het hele ontbrekende stuk. Tot dan is de verdedigbare positie niet "Union Alpha is net zo goed als Gemini 3.8 Flash" — het is "Union Alpha is een week gratis en niemand heeft het gemeten tegen iets dat Google publiceert." Dat zijn heel verschillende zinnen, en slechts één ervan is momenteel waar.
De gemeten helft van het paar wordt hier gedocumenteerd: Gemini 3.8 Flash-modelpaginabevat de tarieven van $0,75/$3,75, de korting van 90% op gecachte input en het uitvoerplafond van 65.536 tokens dat bepalend is voor werk aan lange rapporten.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
