
Gemini 4 Argon: wat Google heeft aangekondigd, en waaraan de naam is gekoppeld
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Gemini 4 Argon is de enige Gemini 4 die er is. Die zin klinkt triviaal tot je hem doorrekent, en dat doorrekenen is waar deze pagina voor dient. Google kondigde Gemini 4 Argon aan op 30-09-2026, in een DeepMind-post op naam van Koray Kavukcuoglu; het is een echte modelnaam op een echte first-party-pagina, het is door Artificial Analysis gemeten op een Intelligence Index van 52,56 in de v4.3.2-revisie, en het zit binnen een halve punt van GPT-6 Astra op 52,67 en Claude Fable 5.1 op 53,35 — terwijl het vijf punten onder Claude Opus 5.5 op 57,62 en Claude Sonnet 5.5 op 56,00 zit, en binnen een punt van GPT-6.1 Sol op 51,83. Wat het niet heeft, is het ding dat al die rivalen wél hebben: een model-identifier die je in een request kunt zetten.
Dus het eerlijke antwoord in één regel op “wat is Gemini 4 Argon” is dat het een model is dat Google heeft aangekondigd en gebenchmarkt, maar nog niet aanroepbaar heeft gemaakt, dat de naam verbonden is aan een beperkte uitrol in plaats van aan een product, en dat “Gemini 4” op zichzelf aan helemaal niets verbonden is. Beide helften van die zin zijn vanaf een terminal te controleren, en daarom controleert deze pagina ze in plaats van ze te beweren.
De naam is echt. Het product niet.
Begin met wat een entiteitscheck feitelijk oplevert. Met ingang van 8 oktober 2026 voert Googles familiepagina op deepmind.google/models/gemini/Gemini 4 Argon als hoofdkaart, onder de slogan “Ons volgende tijdperk van frontier-intelligentie”, met een beschrijving van de capaciteiten waarin software-engineering, enterprise-kenniswerk op het gebied van juridische zaken en financiën, en defensieve cybersecurity worden genoemd. Het aankondigingsbericht staat op het pad blog.google/innovation-and-ai/models-and-research/gemini-models/. Er is een pagina over de modelfamilie. Er is een leveranciersbenchmarktabel met negentien rijen. Er is een PDF van vijf pagina's met evaluatiemethodologie. Dat is een aanzienlijk papieren spoor, en dat is meer dan wat een lek krijgt.
Som nu op wat eraan ontbreekt, want de lijst van wat ontbreekt is het artikel.
• Een model-ID — de modellenlijst van de Gemini API bevat nul voorkomens van “argon” en nul voorkomens van “gemini-4”. De nieuwste identifiers die de documentatie van Google herkent, zijn de 3.8-familie.
• Een endpoint of prijs waartegen je gefactureerd kunt worden — de $2 input / $10 output per miljoen tokens in de aankondiging is een introductietarief voor een uitrol die nog geen betalende klanten heeft bereikt.
• Een modelkaart of systeemkaart — de DeepMind-modelkaartenindex heeft geen Argon-rij, en het modelkaartpad van de familie geeft een 404.
• Een contextvenster — Google publiceerde een uitvoerlimiet van 1 miljoen tokens, een verhoging ten opzichte van een eerder plafond van 64K, en publiceerde de invoerzijde van dat paar niet. Artificial Analysis registreert 1M voor het model dat het heeft gemeten.
• Een datum van algemene beschikbaarheid — de aankondiging beschrijft een gefaseerde uitrol zonder data voor enige fase na de eerste.
• Een parameteraantal, dat Google voor geen enkele Gemini heeft gepubliceerd.
De uitrol die Google beschrijft, verloopt in drie fasen waarvan de duur niet wordt genoemd. Eerst een genoemd cohort cyberverdedigers via het Fairwind Program. Ten tweede betalende API-klanten en abonnees van Google AI Ultra. Ten derde ontwikkelaars, ondernemingen en consumenten. Alleen de eerste fase is live in welke zin dan ook die een lezer kan verifiëren, en Google verbindt geen datum aan fase twee en drie. Dat is geen voetnoot. Het is het verschil tussen een model en een aftelling.

Wat Google's eigen tabel beweert, en wie het werkelijk heeft gemeten
De familiepagina van Google bevat een benchmarktabel met vier kolommen met Gemini 4 Argon, GPT-6 Astra, Claude Fable 5.1 en Claude Opus 5.5. Het is de moeite waard om die te lezen, en het is de moeite waard om die te lezen met de herkomst voor ogen, omdat Google die herkomst in de methodologie-PDF bekendmaakt en die bekendmaking verandert hoeveel de tabel kan dragen.
De claims, aangeduid als die van Google: Argon leidt op de Vals Index met 68,9 tegen de 67,0 van Opus 5.5 en de 65,8 van Fable 5.1; op AutomationBench met 51,3 tegen 42,5, 31,4 en 41,4; op Vals Finance Agent v2 met 65,4; op Harvey’s Legal Agent Benchmark met 19,6 tegen 3,8, 6,7 en 5,4 — een verschil van vier tot vijf keer; op DeepSWE v1.1 met 77,9 tegen 74,2, 67,4 en 74,1; op Vibe Code Bench met 91,9, een marge van 1,6 punt; op LABBench 2 met 88,8 tegen 73,1, 68,6 en 85,4; op RiemannBench met 76,0; op beide GraphWalks-rijen, 99,7 bij ≤128k en 84,2 bij 256k–1M; op Agent’s Last Exam met 39,5; op Terminal-Bench Science 0.1 met 57,6; op Chartography met 71,6; en op LVBench met 91,7 als state of the art.
En het verliest op Google’s eigen pagina: FrontierSWE v2 met 55,0 tegen Astra’s 65,5 en Opus 5.5’s 62,3; Terminal-bench 4.0 met 57,4 tegen Opus 5.5’s 66,4; PostTrainBench met 45,3 tegen Opus 5.5’s 49,3; en OSWorld-2.0 met 69,2 tegen Astra’s 72,6. CWE-bench v1 staat gelijk op 68,0 met Astra.
De herkomstregel is belangrijker dan welke afzonderlijke rij dan ook. De methodologie van Google stelt dat resultaten pass@1 zijn, met één poging, bij de hoogste denkinstellingen, en — cruciaal — dat de niet-Gemini-cijfers in die tabel de door de aanbieders zelf gerapporteerde cijfers zijn, waarbij GPT-6 Astra, Claude Fable 5.1 en Claude Opus 5.5 waar beschikbaar op maximale denkstand zijn meegenomen. Een leverancierstabel waarvan de concurrentiekolommen de persberichten van de concurrenten zijn, is een nuttig document, maar het is geen gecontroleerde vergelijking. Elk van die rijen is door Google gerapporteerd, en sommige daarvan zijn Google die rapporteert wat iemand anders heeft gerapporteerd. Behandel de marges, niet alleen de waarden, dienovereenkomstig.
Eén model, drie indexnummers, en waarom ze allemaal correct zijn
De onafhankelijke positie van Argon is interessanter dan één enkel cijfer, omdat het cijfer verschuift afhankelijk van waar je het leest, en die verschuiving is geen fout.
Artificial Analysis meet Gemini 4 Argon (High) op 52,56 in de v4.3.2-revisie van zijn Intelligence Index. Dezelfde index plaatst Claude Opus 5.5 op 57,62, Claude Sonnet 5.5 op 56,00, Claude Fable 5.1 op 53,35, GPT-6 Astra op 52,67, GPT-6.1 Sol op 51,83 en Gemini 3.8 Flash op 40,93. In de weergegeven volgorde van het leaderboard beslaan de bovenste tien of zo modellen samen ongeveer zes indexpunten, en Argon belandt in die dichte groep in plaats van eronder.
Dan ziet een lezer een tweede getal — 53 — in de afgeronde weergave van de ranglijst, en een derde als die het vergelijkt met een andere configuratie van een zustermodel, en concludeert dat een van de bronnen onjuist is. Geen ervan is onjuist. De afgeronde 53 is dezelfde meting als 52.56. Wat tussen configuraties verschilt, is denkinspanning: Artificial Analysis meet elk model op meerdere inspanningsniveaus, en hetzelfde model op een hoger inspanningsniveau kan enkele punten uit elkaar liggen. Daarom vermeldt de ranglijst Opus 5.5 vier afzonderlijke keren, met 58, 56, 54 en 51. Argon verschijnt één keer, bij hoge inspanning, omdat dat de enige configuratie is die Google beschikbaar heeft gesteld om te meten. Als Google een Argon-variant met maximale denkinspanning uitbrengt, zal die rij verschuiven, en het eerlijke dat je er vandaag over kunt zeggen, is dat die nog niet is verschoven.
Nog drie van Argons onafhankelijke cijfers zijn het waard om te onthouden, allemaal afkomstig van Artificial Analysis en allemaal gemeten op de (High)-configuratie. De mediane uitvoersnelheid is 60,69 tokens per seconde. De mediane tijd tot het eerste antwoordtoken is 2,92 seconden. De kosten per Intelligence Index-taak — de indexscore genormaliseerd tegen de tokenbesteding die nodig is om die te behalen — bedragen $1,99. Dat laatste cijfer is het cijfer om aan vast te houden, want daar wordt Argons positie ongemakkelijk: Opus 5.5 scoort vijf punten hoger en kost $5,98 per Index-taak, dus Argon is drie keer goedkoper per eenheid gemeten capaciteit. Maar GPT-6.1 Sol scoort een half punt lager en kost $0,72, wat ongeveer een derde van Argons cijfer is. Argon is niet de keuze met de beste prijs-kwaliteitverhouding in zijn eigen indexband. Het zit in het midden ervan.
Er bestaan nog twee onafhankelijke metingen die een zorgvuldige lezer niet met elkaar mag verwarren. Artificial Analysis registreert Argon’s AutomationBench-waarde als een gedeeltelijke score van 0,7751 op een schaal van 0–1, terwijl de tabel van Google 51,3 van 100 op het AutomationBench-scorebord rapporteert. Dat zijn niet dezelfde maatstaven, en ze naast elkaar zetten is precies het soort vergelijking dat een verzonnen getal oplevert. Dezelfde waarschuwing geldt voor de kenniswerk-groeperingen van de leverancierstabel: “toonaangevend op het gebied van kenniswerk” is de samenvatting die Google van zijn eigen tabel geeft.
Naar welke “Gemini 4”-pagina bent u eigenlijk op zoek?
Dit is de verwarring die de naam veroorzaakt, en het is de moeite waard om die op één plek op te lossen, want de blog heeft inmiddels over vijf verschillende “Gemini 4”-dingen geschreven en het zijn geen varianten van één artikel.
• Als je de releasedatum en de uitroltijdlijn wilt — wanneer Argon werd aangekondigd, wat de gefaseerde uitrol is, en wat de arena boards ermee deden — dan is dat het artikel over de releasedatum, het stuk dat de tijdlijn en de Text Arena- en Code Arena-readings beheert.
• Als je wilt weten "is Gemini 4 Argon een tier of een model", en of er een Gemini 4 Ultra bestaat — het stuk over tier-positionering, dat de ladder afleest van Google's eigen paden en uitlegt waarom het Ultra-pad uitkomt op een abonnementspagina.
• Als je het wilt hebben over de naamgevingskwestie zelf, het argument dat van “Gemini 4” en “Gemini 4 Argon” precies één een model is en één een generatieprefix zonder model-ID, zonder endpoint en zonder prijs — dat is de directe confrontatie tussen de twee Google-namen.
• Als je het resultaat van FrontierSWE v2 op de derde plaats en de observatie van zelfkritiek die daarmee gepaard ging wilt, dan is dat het FrontierSWE-evaluatiestuk.
• Als je Argon cijfermatig tegenover een specifieke rivaal wilt zetten, dan staan er dertien vergelijkingspagina's op de site die de frontier-band behandelen, en die zijn de juiste plek voor een vergelijking van twee modellen.
Wat geen van hen is, en wat deze pagina wel is, is de pijler: de enige plek die zegt wat de entiteit is, wat elk cijfer dat eraan is gekoppeld wel en niet betekent, en wat je er vandaag daadwerkelijk mee kunt doen. De gerelateerde pagina “Gemini 4 vs Gemini 4 Argon” voert de argumentatie over de naamgeving al volledig en deze pagina zal die niet herhalen. Alles hieronder is nieuw.

De druk die ons nog niets heeft verteld
Twee van de sterkste signalen in het Argon-verhaal wijzen op een op handen zijnde ontwikkelaarsrelease, en geen van beide is bewijs dat er een ontwikkelaarsrelease heeft plaatsgevonden.
Het eerste is dat Google's eigen API-oppervlakken verder zijn gegaan zonder Argon. De nieuwste vermelding in de changelog van de Gemini API is 6 oktober 2026 — Gemini Nano Banana 2.1 algemeen beschikbaar, onder de identifier gemini-nano-banana-2.1. Met andere woorden, in de acht dagen sinds Argon werd aangekondigd, heeft Google een naamgevingsconventie gekozen voor een Gemini-model in productie en een GA-identifier uitgebracht voor een ander model, en de gemini-4 naamruimte is nog steeds leeg. Een model waarvan de uitrol echt is, laat een spoor na in de changelog. Deze heeft er geen achtergelaten.
Het tweede is de framing rond nationale veiligheid. Google stelt dat het “actief betrokken is bij het vrijwillige proces van de Amerikaanse overheid voor toegang tot modellen vóór release”, en de eerste uitrolfase is een met naam genoemd cohort van cyberverdedigers. Dat strookt met een gefaseerde uitrol waarbij het publiek voor frontier-capabilities het model eerder krijgt dan de publieke API, en het strookt evenzeer met het simpelweg nog niet klaar zijn van het model voor algemeen verkeer. Niets aan die framing zegt je welke van de twee het is. Wie zegt dat het dat wel doet, leest de theeblaadjes, en Google heeft geen datum aan de API-fase gehangen om dat te beslechten.
Wat je vandaag kunt noemen, en wat niet
Dit is het deel van de pagina dat het snelst veroudert, dus het draagt zijn datum. Met ingang van 8 oktober 2026 retourneert de OrcaRouter-model-API HTTP 404 voor google/gemini-4-argon. Die staat niet in onze routes. Ook niet google/gemini-4, noch google/gemini-4-argon-high, noch google/gemini-4-pro — geen van die identifiers wordt herkend, omdat geen ervan ergens als aanroepbaar model bestaat.
Wat staat er vandaag op onze routes, van dezelfde leverancier, en wat elk ervan kost volgens de lijstprijs van de aanbieder:
• google/gemini-3.8-flash — uitgebracht op 2 september 2026, een contextvenster van 1.048.576 tokens en een maximale uitvoer van 65.536 tokens, voor $0,75 aan invoer en $3,75 aan uitvoer per miljoen tokens. Dit is het model waarmee Argon uiteindelijk vergeleken zal worden door mensen die een creditcard bezitten, en het komt het dichtst in de buurt van een aan Argon verwante workload die je vanmiddag kunt draaien.
• google/gemini-3.6-flash — uitgebracht op 2026-07-21, voor $0,75 en $3,75.
• google/gemini-3.5-flash — uitgebracht op 2026-05-23, voor $1,50 en $9,00.
• google/gemini-3.5-flash-lite — uitgebracht op 2026-07-21, voor $0,30 en $2,50.
• google/gemini-3.1-flash-lite — tegen $0,25 en $1,50.
• google/gemini-3.1-pro-preview — uitgebracht op 2026-02-19, voor $2,00 en $12,00. Dit is de enige Gemini in het Pro-slot die je kunt aanroepen, en hij loopt drieënhalf generaties achter op de nieuwste toevoeging van de Flash-lijn.
Al die modellen draaien op dezelfde key als de frontiermodellen van Claude en OpenAI in dezelfde indexband — Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5.1, GPT-6 Astra en GPT-6.1 Sol zitten allemaal op dezelfde routes — wat betekent dat het interessante aan Argons positie testbaar is zonder Argon. Als je wilt weten hoe zo'n 52 indexpunten kenniswerk voelen voor een vijfde van de prijs, kun je dat vandaag meten tegen google/gemini-3.8-flash op 40,93, en als je de top van de band wilt, kun je Claude Opus 5.5 op 57,62 meten op dezelfde dag, in hetzelfde account, zonder een tweede contract en zonder codewijziging. Dat is de praktische vorm van het hele artikel: één API voor meer dan 200 modellen, 0% markup op de lijstprijs van de provider die wordt doorgegeven, zodat een prijsverlaging van een leverancier je dezelfde dag bereikt dat ze ingaat, en automatische failover tussen providers voor de dag dat een model waarop je vertrouwt niet meer antwoordt. We beschrijven dat hier omdat het waar is voor de Gemini 3.8 Flash die je kunt aanroepen, niet omdat het iets over Argon zegt. Argon is er geen van.
Als je Argon zelf wilt, bestaan je opties vandaag uit het Fairwind cyber-defender-cohort en wachten. De eigen API van Google serveert het niet, en wij evenmin, en geen enkele route via derden kan een model serveren dat geen identifier heeft om te adresseren.
De openstaande vragen, en precies wat ze zou afsluiten
Vier dingen zijn onopgelost, en elk ervan heeft een specifieke, controleerbare trigger. Die lijst kort houden is juist het punt — een pagina zoals deze is alleen nuttig zolang die falsifieerbaar is.
• Krijgt Argon een Gemini API-identifier? Houd de API-modellenlijst in de gaten voor een gemini-4-geprefixte ID. Zodra er een verschijnt, wordt de vraag over de prijsstelling concreet en wordt het introductietarief van $2 / $10 een bedrag dat op je factuur kan verschijnen in plaats van een blogpost. Let ook op of het introductietarief überhaupt de API-fase haalt, en of het opschuift naar $4 / $20 of naar iets anders.
• Verandert de gemeten configuratie? Argon wordt op één denkniveau gemeten en scoort 52,56. Als Google een configuratie met hogere inspanning beschikbaar stelt, verschuift die rij; de concurrenten die het nastreeft, staan allemaal vermeld met twee tot vier inspanningsniveaus, dus dat Argon slechts één keer wordt vermeld, is een gegeven over beschikbaarheid, niet over het plafond van het model.
• Houden de juridische en financiële claims stand bij een onafhankelijke run?Harvey’s Legal Agent Benchmark met 19,6 tegen 3,8 van een concurrent, en Vals Finance Agent v2 met 65,4 aan de leiding, zijn de twee grootste relatieve marges in de tabel van Google. Het zijn ook de twee rijen die het meest waarschijnlijk opnieuw worden gedraaid door iemand die niet voor Google werkt. Een vier- tot vijfvoudige marge op een domeinbenchmark is ofwel de belangrijkste zin in de aankondiging, ofwel een verschil in de testopstelling, en de manier om daarachter te komen is te letten op een tweede run.
• Is er een broertje of zusje? De aankondigingspost van Argon noemt geen familie, laat geen Pro zien en laat geen Ultra zien. Een tweede gemini-4-* pad, een tweede kolom of een modelkaart-vermelding zouden elk die interpretatie binnen een dag omdraaien. Het stuk over tier-positionering somt de falsifieerders volledig op.
De bottom line
Gemini 4 Argon is een echt frontiermodel met een echte benchmarktabel en een echte indexscore van 52,56 van Artificial Analysis — en het is geen product, in de specifieke zin dat er geen model-identifier, endpoint, modelkaart, contextvenster of algemene beschikbaarheidsdatum voor bestaat, en zowel de eigen documentatie van Google als de meetdiensten van derden zijn het erover eens dat precies één provider het host. De “Gemini 4” in de naam is een generatielabel; de “Argon” is het deel waaraan het model is gekoppeld. Als je deze maand iets kiest om op voort te bouwen, gaat de beslissing niet over Argon: het gaat over de Gemini 3.8 Flash die je vandaag kunt aanroepen voor $0,75 / $3,75 en de frontiermodellen in dezelfde indexband die op dezelfde sleutel zitten. Lees deze pagina opnieuw wanneer een gemini-4 identifier in de API-lijst verschijnt. Tot die tijd is alles over Argon een claim die Google heeft gedaan over een model dat niemand buiten het eerste cohort kan aanspreken.

Vergeleken in dit artikel3
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
