Titelkaart met kop "MODELVERGELIJKING" en tekst "Gemini 4 vs Gemini 4 Argon", met de ondertitel "Een ervan werd aangekondigd op 30 september. De andere is een familieprefix." en vier chips met de tekst "Gemini 4 · geen model-ID", "Gemini 4 Argon · aangekondigd op 2026-09-30", "$2 / $10 introductietarief" en "AA Index 53 · Vals #1", boven een voettekst met de tekst "Google-cijfers zijn door de leverancier gerapporteerd en niet gereproduceerd; indexcijfers volgens Artificial Analysis; rang volgens Vals." Het OrcaRouter-logo is in de rechteronderhoek gecompositeerd.
Guides & Insights

Gemini 4 vs Gemini 4 Argon: Een van deze twee modellen bestaat niet

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Google kondigde op 30 september 2026 een frontier-model aan. Het is niet het model dat de meeste mensen voor zich zien. Gemini 4 Argon is een echte naam die aan een echte aankondiging, een echte prijslijst en een gepubliceerde benchmarkset is verbonden. Gemini 4 is het familievoorvoegsel waaronder die naam valt — en volgens de gegevens die vandaag beschikbaar zijn, is het geen product. Er is geen model-ID voor, geen endpoint, geen modelkaart en geen prijs per miljoen tokens. Dit is dus geen vergelijking van twee systemen. Het is een vergelijking van één aangekondigd model met een naam die veel mensen, deze blog inbegrepen, al maanden als een model behandelen.

Aan dat onderscheid hangt een prijskaartje. Gemini 4 Argon heeft een introductietarief van $2 per miljoen inputtokens en $10 per miljoen outputtokens, dat na een door Google niet gedefinieerde introductieperiode stijgt naar $4 en $20. Dat zijn door de leverancier opgegeven cijfers uit het eigen aankondigingsbericht van Google. Als je een migratie naar de pro-tier voor 2026 begroot, is $2/$10 het bedrag waarop je je kunt baseren, en "wat Gemini 4 ook kost" is helemaal geen bedrag — er is niets voor gepubliceerd, omdat er nog niets te publiceren valt.

Wat "Gemini 4" officieel gezien eigenlijk is

Zoek je naar een productpagina van Gemini 4, dan vind je één document: het eigen bericht van Google met de titel Gemini 4 Argon: ons volgende tijdperk van grensverleggende intelligentie, gepubliceerd op 30 september 2026 om 20:00 UTC en toegeschreven aan Koray Kavukcuoglu. Lees het aandachtig en "Gemini 4" komt nooit voor als een op zichzelf staand model. Elke capaciteitsclaim, elke prijs en elke benchmark in het bericht is aan de volledige naam gekoppeld. De kale vorm komt alleen voor waar de naam als voorvoegsel wordt gebruikt — "de capaciteiten van Gemini 4 Argon" — wat dezelfde grammaticale positie is die Gemini 3 innam voordat Gemini 3 Pro, Gemini 3.1 Pro en vier Flash-varianten elk hun eigen ding werden.

De generatiegeschiedenis ondersteunt die lezing. De winstcall van Alphabet op 23 juli legde de framing officieel vast: Sundar Pichai zei dat de volgende generatie frontiermodellen "veel grotere basismodellen vereist", en noemde coderen en agentisch coderen als de gebieden die verbetering behoeven. Op 23 september, tijdens een evenement dat door The Information werd georganiseerd, zei Kavukcuoglu dat de pre-training was afgerond en dat het model zich in de vroege fasen van post-training bevond, dat het team de resultaten had gezien, en dat hij hoopte een vroege post-trainingsversie ruim vóór het einde van het jaar uit te brengen. Business Insider beschreef de aankondiging van 30 september als het eerste model van de 4-serie — een serie, wat veelzeggend is. Alle drie zijn het leveranciersverklaringen over het eigen werk van de leverancier, doorgegeven door derden.

Wat dat in de praktijk betekent: "Gemini 4" is de generatie, en de generatie heeft één benoemd lid. De tierstructuur die Google al twee jaar heeft uitgebracht — een Pro bovenaan, een Flash daaronder, een Cyber-variant achter hetzelfde programma — is voor generatie 4 nog niet ingevuld. Een "Gemini 4 Pro" of een "Gemini 4 Ultra" is een gevolgtrekking uit Googles eigen naamgevingspatroon, geen lek en geen roadmapitem. Beschouw elk artikel dat Gemini 4 Argon met "Gemini 4" vergelijkt als een vergelijking van één model met zijn eigen achternaam.

Wat Gemini 4 Argon eigenlijk is

Gemini 4 Argon werd op 30 september 2026 aangekondigd op de blog van Google, en Demis Hassabis kondigde die avond op X hetzelfde model in zijn eigen woorden aan. De uitrol verloopt in fasen, en alleen de eerste fase heeft een datum: Argon gaat als eerste naar gescreende cyberverdedigers via het Fairwind Program, het niveau dat alleen op aanvraag toegankelijk is en dat Google heeft gebouwd voor overheden en nationale cyberautoriteiten, exploitanten van kritieke infrastructuur en kerntechnologieplatforms. In Hassabis' eigen bericht stond dat het bedrijf het aan het uitrollen was, "vandaag te beginnen met de overheid en vertrouwde cyberverdedigers via ons Fairwind Program." Daarna plaatst de formulering van Google betalende API-klanten en abonnees van Google AI Ultra als volgende, dan ontwikkelaars, ondernemingen en consumenten. Geen van die latere fasen heeft een datum.

Wat niet in die lijst staat, is het deel dat ertoe doet voor iedereen die werk plant: een datum voor algemene beschikbaarheid, een model-ID, een contextvenster, een parameteraantal, een modelkaart of een systeemkaart. Google publiceerde een outputlimiet, geen contextvenster. Het gaat om 1 miljoen tokens, een stijging ten opzichte van het plafond van 64K dat de vorige Gemini-familie gebruikte, en Google noemt het toonaangevend in de branche. Een toename met een orde van grootte in hoeveel één enkele aanroep kan retourneren, is een echte verandering voor lange agenttrajecten en single-shot-rendering, en het is het enige technische cijfer in de aankondiging zonder enige ambiguïteit.

A capture of Google's own blog post announcing Gemini 4 Argon, carrying a Published Time of 2026-09-30T20:00:00+00:00 and the headline "Gemini 4 Argon: our next era of frontier intelligence" credited to Koray Kavukcuoglu, followed by the Fairwind Program rollout and the vendor-reported benchmark set: DeepSWE v1.1 77.9%, AutomationBench 51.3%, LVBench 91.7%, CWE-bench v1 68%, an output limit of 1 million tokens up from 64K, and pricing of $2 / $10 stepping to $4 / $20.

De benchmarkset is breed en volledig niet gereproduceerd. Google rapporteert DeepSWE v1.1 op 77,9%, een eerste plaats op AutomationBench met 51,3%, LVBench met 91,7%, een gedeelde eerste plaats op CWE-bench v1 met 68%, toonaangevende resultaten op de Vals Index, zijn Vals Finance Agent v2, Harvey's Legal Agent Benchmark en de sterkste prestatie op Gray Swan's Indirect Prompt Injection-benchmark. Elk van die cijfers is het eigen cijfer van de leverancier, gepubliceerd door de leverancier, en geen ervan is onafhankelijk gereproduceerd. Een afzonderlijke reeks cijfers die in september circuleerde, gepresenteerd als voorspelde Gemini 4-benchmarks met een AutomationBench-score van 48,7%, bleek te zijn gerecycled van een niet-gerelateerde lancering en is geen publicatie van Google. Het daadwerkelijk door Google gerapporteerde AutomationBench-cijfer is 51,3%, wat een ander cijfer uit een andere bron is.

Het scorebord dat de twee namen produceren

Zet de twee naast elkaar op de zes dimensies waar deze combinatie in feite op draait, en de vorm van het probleem is duidelijk:

• Bestaat als een product met een naam — Gemini 4: nee. Gemini 4 Argon: ja, aangekondigd op 2026-09-30.

• Vandaag aanroepbaar — Gemini 4: er bestaat geen model-ID of endpoint. Gemini 4 Argon: er bestaat evenmin een model-ID of endpoint; de toegang wordt door Fairwind beperkt en is alleen op aanvraag.

• Prijs — Gemini 4: niets gepubliceerd. Gemini 4 Argon: $2 / $10 per miljoen tokens als introductieprijs, daarna $4 / $20. Volgens de leverancier.

• Maximale output — Gemini 4: niets gepubliceerd. Gemini 4 Argon: 1 miljoen tokens, tegenover 64K voor de vorige generatie. Door de leverancier opgegeven.

• Intelligence index — Gemini 4: niet geëvalueerd. Gemini 4 Argon: 53 op de Intelligence Index van Artificial Analysis bij hoge redeneerinspanning, met een kostprijs van $1,99 per indextaak. Volgens Artificial Analysis.

• Onafhankelijke positie op de ranglijst — Gemini 4: niet gerangschikt. Gemini 4 Argon: eerste op de Vals Index met 68,90% tegen een kostenpost van $15,68 per test, verdeeld over 13,40B input- en 142,01M outputtokens. Volgens Vals.

A two-column scoreboard card headed "Gemini 4 vs Gemini 4 Argon — the scoreboard", with the subtitle "One announced model against a name with nothing behind it". The left column, headed Gemini 4, reads: exists as a named product, no; callable today, no model ID or endpoint; published price, none; maximum output, none published; intelligence index, not evaluated; independent rank, not ranked. The right column, headed Gemini 4 Argon, reads: exists as a named product, yes, announced 2026-09-30; callable today, no, Fairwind-gated; published price, $2 / $10, then $4 / $20; maximum output, 1M tokens, up from 64K; intelligence index, 53, $1.99 per task; independent rank, 1st, Vals 68.90%. A footer reads that the Argon price and output limit are per Google's own announcement, the index and per-task cost per Artificial Analysis, the rank and score per Vals, and that no figure on the left has a published source because Gemini 4 has no product page. The OrcaRouter logo is composited in the bottom-right corner.

Als je de laatste twee rijen samen leest, krijg je de enige echt interessante onenigheid in deze vergelijking. Artificial Analysis plaatst Gemini 4 Argon op 53, wat op hetzelfde niveau ligt als Claude Fable 5.1 en GPT-6 Astra, en vijf punten achter Claude Opus 5.5 op 58. Vals zet het zonder meer op de eerste plaats. Beide zijn onafhankelijk, beide meten iets reëels, en ze meten verschillende dingen — de index van AA weegt een vaste set van tien evaluaties op het gebied van programmeren, redeneren en kenniswerk, terwijl de Vals Index vier sectoren weegt op basis van hun aandeel in de Amerikaanse economische toegevoegde waarde. Een model kan de ene ranglijst aanvoeren en de andere niet, zonder dat een van beide ranglijsten ongelijk heeft.

Er is nog iets dat opvalt in de Vals-rij, en dat is het punt waar een zakelijke koper om zou moeten geven. Vals registreert de tariefkaart van Argon als $4/$20 — de prijs na de introductieperiode — terwijl de eigen aankondiging van Google $2/$10 zegt. Als de kosten van $15,68 per test zijn berekend op basis van $4/$20, dan zou een koper die het introductietarief accepteert een wezenlijk lager bedrag voor hetzelfde werk zien, en een koper die het introductievenster mist niet. Google heeft niet gezegd hoe lang dat venster loopt. Die ene ongedefinieerde variabele beïnvloedt het meest beslissingsrelevante cijfer in de hele lancering.

Wat je vandaag kunt bellen

Niets onder de naam Gemini 4, en dat geldt ook voor ons. We hebben de catalogus gecontroleerd: google/gemini-4, google/gemini-4-argon, google/gemini-4-pro en google/gemini-3.8-flash-cyber geven allemaal "model not found" terug, en hetzelfde geldt voor elk ander routeringsplatform, omdat geen van hen een model-ID heeft om te routeren. De eigen modellenlijst van de Gemini API — Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.1 Pro, Gemini 3 Flash — bevat op geen enkele manier een Gemini 4-vermelding. Totdat Argon de Fairwind-wachtrij heeft weggewerkt en een identifier krijgt, bestaat er nergens een gefactureerde prijs en nergens een endpoint.

De live Google pro-tier is een ander verhaal. Gemini 3.1 Pro Preview staat sinds 19 februari 2026 in onze catalogus voor $2,00 input en $12,00 output per miljoen tokens, met een contextvenster van 1.048.576 tokens, een maximale output van 65.536 tokens en multimodale input voor tekst, afbeelding, audio, video en bestand. Acht maanden later staat het nog steeds als Preview vermeld op de eigen modellenlijst van de Gemini API, wat op zichzelf al het argument is waarom Argon bestaat. Ga je voorbij de 200.000 inputtokens, dan verdubbelt het tarief naar $4 en $18.

A capture of the OrcaRouter model page for Gemini 3.1 Pro Preview, showing the Google provider, a release date of 2026-02-19, a 1,048,576-token context window, a 65,536-token maximum output, pricing of $2.00 input and $12.00 output per million tokens with $4.00 and $18.00 over the 200,000-token threshold, multimodal input icons for text, image, video, audio and file, and capability chips for reasoning, tool calling, structured outputs, prompt caching, assistant prefill, computer use and web search.

Dat is de enige plek waar deze vergelijking een operationeel antwoord heeft. Gemini 3.1 Pro Preview is live achter hetzelfde OpenAI-compatibele endpoint als de andere ruim 200 modellen die wij routeren, tegen de lijstprijs van de provider zonder opslag — dus wanneer Google uiteindelijk een identifier en een gefactureerd tarief voor Gemini 4 Argon publiceert, en daarna een Pro-tier-broertje als het naamgevingspatroon standhoudt, betekent die doorvoer dat die tarieven aan onze kant verschijnen op de dag dat ze bij Google verschijnen. Wil je in de tussentijd de pro-tier meten in plaats van erover lezen, dan is dat het model om te meten. Wil je een model proberen waarvan het gedrag nog wordt gekarakteriseerd, automatische failover tussen providers is hoe je dat doet zonder een productiepad te verwedden op een preview waarvan Google zelf zegt dat die geleidelijk wordt ingevoerd.

Eén voorbehoud dat in één adem met de prijs thuishoort.

Bloomberg meldde op 30 september dat sommige Google-medewerkers met directe toegang tot Argon zeggen dat het minder goed presteert op echt werk dan de benchmarkscores suggereren, waarbij front-endontwerp specifiek wordt genoemd en twee medewerkers de term "benchmaxxing" gebruiken. Google betwist die karakterisering. Het is de moeite waard om dit naast de benchmarklijst te houden, juist omdat de benchmarklijst de volledige openbare bewijsbasis voor dit model is. Wanneer er cijfers van één leverancier zijn en er geen manier is om ze te reproduceren, is een bericht dat de cijfers niet het hele verhaal vertellen geen voetnoot. Het is de helft van het bewijs.

Wie moet welke kiezen

Als je tussen deze twee namen kiest, ben je nog niets aan het kiezen, en de eerlijke aanpak is om daarop te plannen in plaats van op een vergelijking.

• Als je dit kwartaal een Google-model uit de pro-tier in productie nodig hebt, is het antwoord Gemini 3.1 Pro Preview. Het is aanroepbaar, er is een prijs voor, en het is de tier die Argon moet gaan vervangen. Wachten op Argon is wachten op een wachtrij waar je niet kunt aansluiten.

• Als u tot het publiek behoort waarvoor de toegang tot Argon beperkt is — een overheidsinstantie voor cyberbeveiliging, een exploitant van kritieke infrastructuur, een softwareonderhouder — dan is het Fairwind Program de enige route, en de specificiteit van die toegangsbeperking is een feit over de capaciteiten van het model, geen marketing. Google heeft het getraind voor het ontdekken en patchen van kwetsbaarheden en heeft het niet algemeen uitgebracht.

• Als u een migratie in 2026 budgetteert, gebruik dan $2/$10 voor het introductievenster en $4/$20 voor alles daarna. Gebruik geen enkel samengevoegd cijfer, en gebruik de kosten per test van $15,68 uit Vals niet zonder na te gaan volgens welke tariefkaart deze zijn berekend.

• Als je op "Gemini 4" wacht, wacht dan op een model-ID. De naam krijgt er een — Googles naamgevingspatroon over drie generaties geeft aan dat de Pro-tier en de Flash-tier hun eigen identifiers krijgen — maar het patroon is geen aankondiging, en er is niets gepubliceerd over wat een kale Gemini 4 zou zijn, zou kosten of zou doen.

Het bredere punt is er een dat deze blog al eerder heeft moeten maken en vermoedelijk opnieuw zal moeten maken: een generatienaam is geen model. Gemini 4 Argon is het enige waar Google een naam, een prijs, een benchmarkset en een toegangsplan achter heeft gezet. De rest van de familie is een patroon, en een patroon is iets dat je kunt voorspellen, maar niet iets dat je kunt noemen.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt