Gegenereerde titelkaart met als titel "Union Alpha vs Gemini 3.8 Flash" en als ondertitel "De een heeft een score, de ander een claim", boven drie afgeronde kaarten met de tekst "Gemini 3.8 Flash: gedateerde evaluatietabel, gepubliceerde prijs", "Union Alpha: geen benchmarks van zijn operator", en "Max. uitvoer: 131.072 vs. 65.536 tokens". In de voettekst staat dat de cijfers van Union Alpha niet-gecontroleerd zijn en de cijfers van Gemini volgens Google en Artificial Analysis.
Guides & Insights

Union Alpha vs Gemini 3.8 Flash: De een heeft een score, de ander een claim

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Union Alpha en Gemini 3.8 Flash zijn dezelfde pitch, geleverd op twee totaal verschillende niveaus van bewijs. De operator van Union Alpha beschrijft het als "prestaties op frontier-niveau voor een breed scala aan algemene taken" en heeft geen benchmark, geen parameteraantal, geen licentie en geen naam gepubliceerd. Gemini 3.8 Flash werd geleverd met een gedateerde evaluatietabel, een Artificial Analysis Intelligence Index, kostencijfers per taak van onafhankelijke testers, en een gedocumenteerd prijsschema dat doorloopt tot in 2027. Als je tussen hen kiest op basis van iets anders dan prijs, kies je tussen een getal dat je kunt controleren en een zin die je niet kunt controleren.

Zij aan zij, voor de ruzie

• Contextvenster — Union Alpha 262.144 tokens vs. Gemini 3.8 Flash 1.048.576 tokens.

• Maximale output — 131.072 tokens tegenover 65.536 tokens. Union Alpha wint dit punt, en het is de enige structurele as waarop dat zo is.

• Invoer — tekst en afbeelding bij beide, maar Gemini 3.8 Flash accepteert daarnaast ook video, audio en bestanden.

• Prijzen — Union Alpha $0 tijdens de preview versus Gemini 3.8 Flash: $0,75/M invoer, $3,75/M uitvoer, $0,075/M gecachete invoer, met een verdubbeling op 1 januari 2027 naar $1,50/$7,50.

• Reasoning-instellingen — geen enkele beschikbaar op Union Alpha versus denkniveaus op Gemini 3.8 Flash die zowel de kwaliteit als de kosten direct beïnvloeden.

• Gepubliceerde evaluatie — geen enkele van de operator van Union Alpha vs een volledige gedateerde tabel over Gemini 3.8 Flash.

• Herkomst — anonieme operator, geen gewichten vs de gedateerde release en gedocumenteerde afstamming van Gemini 3.8 Flash.

Generated two-column comparison scoreboard for Union Alpha and Gemini 3.8 Flash. Union Alpha column: context window 262,144 tokens, max output 131,072 tokens, text and image input, $0 preview price, no published evals from its operator, 10.00 s p50 time to first token. Gemini 3.8 Flash column: context window 1,048,576 tokens, max output 65,536 tokens, text, image, video and audio input, $0.75 input and $3.75 output per 1M tokens, a full dated evaluator table, 3.46 s p50 time to first token. Footer reads latency per OrcaRouter over the last 7 days with Union Alpha benchmarks unaudited.

Wat de cijfers van Gemini 3.8 Flash eigenlijk zeggen

Gemini 3.8 Flash is op 2 september 2026 gelanceerd — Googles derde Flash-release in ongeveer zes weken, wat aangeeft dat het verhaal van dit model vooral om cadans draait en niet om een doorbraak. De gepubliceerde evaluatietabel vermeldt artificialanalysis.ai en deepmind.google samen als bron, dus lees die als een mix van onafhankelijke cijfers en leverancierscijfers in plaats van als een zuivere audit door een derde partij.

• AA Coding — 76.3, wat een oprecht sterke codeerscore is.

• AA Intelligence — 41,2. Let op: Artificial Analysis rapporteert afzonderlijk 59 op de Intelligence Index bij hoge reasoning-inspanning, dus het getal verschuift sterk mee met de inspanningsinstelling; vermeld de instelling, anders zegt het getal niets.

• GPQA Diamond — 95,3, veruit het hoogste individuele cijfer in deze vergelijking.

• HLE-Verified — 54,9, met het gewone Humanity's Last Exam op 47,8.

• Terminal-Bench 2.1 — 89,4 in Googles eigen tabel, een fractie hoger dan de 89,1 van Claude Opus 5.

• Recall bij lange context — 81,3; SciCode 56,6; tau_banking 44,9.

• Waargenomen doorvoer — 323 uitvoertokens per seconde over een recent venster van zeven dagen, met een foutpercentage van 0,63%, een mediane tijd-tot-eerste-token van 3,46 seconden, en 498,5M tokens aan gemeten verkeer.

De zwakke punten zijn even goed gedocumenteerd als de sterke punten. Op Terminal-Bench 4.0 scoort het 19,1 tegenover de 51,8 van Claude Opus 5. Op OSWorld 2.0 haalt het 59,0% tegenover 75,4%. Op GDPVal-AA v2 blijft het achter met 1545 Elo tegenover 1824. Gemini 3.8 Flash is uitstekend in een specifieke band van werk en gaat keihard onderuit bij de moeilijkste evaluaties voor algemene agents — precies het soort patroon dat een gepubliceerde tabel je laat zien.

De prijswending die mensen erin laat trappen

Google liet de prijs per token ongewijzigd ten opzichte van Gemini 3.7 Flash. Toch ging de rekening omhoog.

Het model werkt harder: meer redeneerstappen, meer iteratieve tool-aanroepen. Onafhankelijke tests door Artificial Analysis maten ongeveer 30% meer outputtokens per taak en ongeveer 40% hogere kosten per taak dan 3.7 Flash. Bij een hoge redeneerstand komt dat uit op ongeveer $0,58 per taak; medium ligt rond $0,41 en laag rond $0,24.

Dit is het allerbruikbaarste in de vergelijking voor iedereen die een budget opstelt, en het geldt ruimschoots buiten deze twee modellen: eenheidsprijs en kosten per taak zijn verschillende getallen, en slechts één ervan staat op een prijzenpagina. Google heeft 3.7 Flash beschikbaar gehouden als de goedkopere optie, wat een stilzwijgende erkenning van de verschuiving is.

Wat Union Alpha in plaats daarvan biedt

Union Alpha verscheen op 16 september 2026 in catalogi van derden en draait op het gratis niveau van OrcaRouter. Het is anoniem — geen lab, geen gewichten, geen licentie, geen kennisafsluitdatum — en gratis voor een aangegeven periode van ongeveer een week, met een limiet op het aantal verzoeken, zonder dat er een prijs na de preview is aangekondigd.

Zijn endpoint is verifieerbaar, zelfs waar zijn herkomst dat niet is: 262.144-tokencontext, 131.072-token maximale uitvoer, tekst- en afbeeldingsinvoer met alleen tekstuitvoer, tool calling en JSON-uitvoer, temperature, top_p, max_tokens, en geen enkele vorm van redeneerbesturing. Toolkeuze ondersteunt in feite alleen "auto".

Er is precies één onafhankelijke meting. SMF Clearinghouse voerde 157 Official A-tests uit met reasoning uitgeschakeld en scoorde 136/157 — 86,6%, nul fouten, tiende van zesentwintig. Redeneren was perfect met 30/30, tools 2/2, programmeren 26/30, wiskunde 24/30. Schrijven kwam uit op 2/5.

Dat is geen slecht resultaat. Het is alleen geen vergelijkbaar resultaat. Official A is een brede algemene suite van 157 tests; AA Coding en GPQA Diamond zijn verschillende instrumenten die verschillende dingen meten op verschillende moeilijkheidsniveaus. 136/157 naast 95,3 op GPQA Diamond zetten en vervolgens een winnaar uitroepen, zou precies het soort witwassen zijn waardoor leverancierscijfers nutteloos worden.

The OrcaRouter model page for Gemini 3.8 Flash, showing a 1M-token context window, a 65K max output, text plus image, video, file and audio input, $0.75 per million input tokens and $3.75 per million output tokens, a p50 time to first token of 3.46 s, and 498.5M tokens of traffic over seven days.The OrcaRouter model page for Union Alpha (Free), listed under the stealth vendor, showing a FREE badge, a 262K-token context window, 131K max output, text and image input with text output, and pricing shown as Free and rate-limited with model usage at $0.

De kostenvergelijking die niemand echt kan afmaken

Hier is het uitgewerkte voorbeeld, en het is met opzet onvolledig.

Neem een taak die je duizend keer per maand uitvoert. Bij Gemini 3.8 Flash met hoog redeneervermogen brengt het gepubliceerde bedrag per taak van ongeveer $0,58 dat op circa $580 per maand. Dat is een reëel, verdedigbaar getal dat is opgebouwd uit gemeten tokenverbruik.

Op Union Alpha kosten diezelfde duizend taken vandaag $0. Wat ze over drie weken kosten, is onbekend, omdat er geen post-previewprijs bestaat. Wat ze aan betrouwbaarheid kosten, is ook onbekend, omdat het model aan een rate limit onderhevig is, op één enkel endpoint draait zonder fallbackprovider, en met HTTP 429 antwoordt zodra je een limiet overschrijdt die niemand heeft gepubliceerd.

Dus het eerlijke antwoord is dat Union Alpha de enige beschikbare kostenvergelijking wint en het vermogen verliest om de kosten te voorspellen. Voor een eenmalige vergelijkende test is dat prima. Voor een begrotingspost is het geen getal — het is een hoop met een URL.

Waar elk thuishoort

Gemini 3.8 Flash hoort thuis overal waar je een gemeten ondergrens nodig hebt: documentwerk met een lange context en video- of audio-invoer, coderingstaken waarbij de AA Coding-score van 76.3 het relevante instrument is, en elke werklast met een budget eraan verbonden, omdat je de kosten kunt berekenen voordat je je vastlegt en je weet dat ze op 1 januari 2027 verdubbelen.

Union Alpha hoort op de verkennende plek — het uitproberen van een 256K-model met vision-capaciteiten waarvan het uitvoerplafond het dubbele is van dat van Gemini, voor werk waarbij een verdwenen endpoint je niets kost.

De reden om ze achter één endpoint te draaien in plaats van twee integraties is dat deze vergelijking herhaaldelijk van vorm zal veranderen. Een routing-DSL laat je de twee samenvoegen tot één aanroep — Gemini 3.8 Flash als het gemeten pad, Union Alpha als de experimentele tak — in plaats van een beslissing hard te coderen die je opnieuw wilt bekijken wanneer het gratis venster sluit of wanneer het introductietarief van Google verstrijkt. Geen van die datums is ver weg, en beide zullen de rekensom veranderen.

Wat zou het beslechten?

Eén gedateerde vermelding voor Union Alpha op een leaderboard dat ook Gemini 3.8 Flash bevat. Dat is het hele ontbrekende stuk. Tot dan is de verdedigbare positie niet "Union Alpha is net zo goed als Gemini 3.8 Flash" — het is "Union Alpha is een week gratis en niemand heeft het gemeten tegen iets dat Google publiceert." Dat zijn heel verschillende zinnen, en slechts één ervan is momenteel waar.

De gemeten helft van het paar wordt hier gedocumenteerd: Gemini 3.8 Flash-modelpaginabevat de tarieven van $0,75/$3,75, de korting van 90% op gecachte input en het uitvoerplafond van 65.536 tokens dat bepalend is voor werk aan lange rapporten.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt