
Gemini 4 Argon vs GPT-6 Astra: een gelijkspel op de index, en een prijsstap die twee derde omlaag gaat
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 144 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 933 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 50 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Twee frontier-modellen, 0,11 punten uit elkaar op de Intelligence Index van Artificial Analysis. Gemini 4 Argon scoort 52,56. GPT-6 Astra scoort 52,67. Als je op basis van gemeten algemene capaciteit tussen hen moest kiezen, zou je een muntje kunnen opgooien, en het verschil tussen de twee scores is kleiner dan het betrouwbaarheidsinterval van elk van beide. Dat is een werkelijk zeldzame situatie in een markt waar de top tien modellen in totaal ongeveer vijftien punten beslaan, en het maakt dit de gemakkelijkste van Gemini 4 Argon's matchups om over te redeneren, omdat het capaciteitsargument al voorbij is voordat het begint en alles wat overblijft economie en toegang is.
De twee zijn echter geen tweeling. Argon werd op 30-09-2026 aangekondigd door Google DeepMind en wordt gefaseerd uitgerold, te beginnen met vertrouwde cyberverdedigers in het Fairwind Program. GPT-6 Astra is begin september uitgebracht — onze cataloguskaart dateert het op 04-09-2026, Artificial Analysis vermeldt 03-09-2026 — en is een live route die je vanmiddag kunt aanroepen voor $10 in en $50 uit per miljoen tokens, met een contextvenster van 1.050.000 tokens en een uitvoerplafond van 128.000 tokens. Een van deze modellen heeft een prijs waartegen je vandaag gefactureerd kunt worden.
Waar een verschil van 0,11 punt reëel is en waar het ruis is
Een index is een samengesteld geheel, dus twee modellen die gelijk scoren op het samengestelde cijfer kunnen betekenisvol van elkaar verschillen op de onderdelen. Hier komen de onderdelen grotendeels overeen, met drie uitzonderingen die het vermelden waard zijn.
Terminal-Bench 4.0 — GPT-6 Astra 59,1% tegenover Gemini 4 Argon 57,1%. Astra leidt, zij het nipt.
• Redeneren met lange context — GPT-6 Astra 80,7% versus Gemini 4 Argon 79,7%.
• GPQA Diamond — GPT-6 Astra 96,1%. Argon publiceert geen cijfer op dit board.
• CritPt — GPT-6 Astra 31,7% versus Gemini 4 Argon 27,1%.
• SciCode — Gemini 4 Argon 61,8% versus GPT-6 Astra 56,5%.
• Humanity's Last Exam — Gemini 4 Argon 57,1% tegenover GPT-6 Astra 54,7%.
• AutomationBench-AA — Gemini 4 Argon 77,5% tegenover GPT-6 Astra 68,5%.
• GDPval — Gemini 4 Argon 1.611 versus GPT-6 Astra 1.542.
• Alwetendheid — GPT-6 Astra 43,4 versus Gemini 4 Argon 42,4.
• ITBench-SRE — GPT-6 Astra 48,6% tegenover geen gepubliceerd Argon-cijfer.
• Uitvoersnelheid — GPT-6 Astra 51,2 tokens per seconde tegenover Gemini 4 Argon 48,9. In de praktijk gelijk.
• Latentie van de eerste token op de index-harness — Gemini 4 Argon 2,8 seconden versus GPT-6 Astra 320,2 seconden.
Astra heeft voordelen bij wetenschappelijk meerkeuzeredeneren, bij natuurkundeproblemen met kritieke punten en op de SRE-benchmark. Argon heeft voordelen bij wetenschappelijk programmeren, bij de moeilijkere end-to-endtaakset en bij werk met GDP-waarde. Geen van beide voorsprongen is groot genoeg om op zichzelf de basis voor een migratie te vormen.

De latentie-regel is een ander verhaal. 320 seconden tot het eerste token betekent vijf en een halve minuut stilte voordat er iets wordt geproduceerd, tegenover minder dan drie seconden voor Argon. Beide meten hetzelfde — de tijd tot de eerste chunk in de indexruns van Artificial Analysis — dus dit is vergelijkbaar. Het redeneervermogen van Astra staat altijd aan en is configureerbaar van lage tot maximale inspanning; een run met maximale inspanning op een moeilijke taak denkt echt minutenlang na voordat hij iets zegt. Of dat een defect is, hangt volledig af van je interface. Voor een batchtaak kost het niets. Voor alles waarbij een gebruiker naar een spinner zit te kijken, is het het meest zichtbare verschil voor de gebruiker tussen deze twee modellen, groter dan welk benchmarkverschil dan ook op de pagina.
De prijsstap, die het eigenlijke onderwerp is
Dit is waar de knoop wordt doorgehakt, en wel op een manier die gemakkelijk verkeerd wordt gemodelleerd, omdat Astra's tariefkaart drie niveaus heeft die op elkaar lijken.
• Standaard, tot 272.000 invoertokens — GPT-6 Astra $10,00 in / $50,00 uit, cached reads tegen $1,00, cache writes tegen $12,50.
• Lange context, boven 272.000 invoertokens — GPT-6 Astra $20,00 in / $75,00 uit, gecachte reads tegen $2,00. De hele aanvraag wordt tegen het hogere tarief geprijsd, niet alleen het overschot: 2× input en 1,5× output.
• Snelle modus — 2× het geldende standaardtarief, dus $20,00 in / $100,00 uit. Dit is het bedrag van $100 dat wordt genoemd alsof het het tarief voor lange context is; dat is het niet.
• Gemini 4 Argon — $2,00 in / $10,00 uit, vast op introductiebasis, gecachte input tegen $0,10, zonder gepubliceerde step en zonder gepubliceerde fast tier.
Dus Argon is vijf keer goedkoper op input en vijf keer goedkoper op output dan het standaardniveau van Astra, en tien keer goedkoper op input boven 272K. Twee onafhankelijke kostenmetingen komen vanuit een andere invalshoek tot dezelfde conclusie: Artificial Analysis zet Argon op $1,99 per indextaak tegenover de $3,26 van Astra, en $2.407 om de hele index te draaien tegenover de $5.324 van Astra. De verhouding per taak is kleiner dan de verhouding per token, om dezelfde reden als bij DeepSeek — Argon verwerkt minder tokens om klaar te zijn — maar die is nog steeds 1,6×.
De GDP-gewogen ranglijst van Vals vertelt een derde versie van hetzelfde verhaal: Argon eerste met 68,90% en $15,68 per run, Astra zesde met 63,13% en $18,46. Astra is daar duurder en scoort lager. Het materiaal van Google zegt expliciet dat de prijsstelling een introductietarief is, een woord dat betekent dat het kan veranderen, en de eerlijke interpretatie is dat Argons prijsvoordeel reëel is en dat de bestendigheid ervan niet gegarandeerd is.
Twee architectuurfeiten die meer bepalen dan benchmarks

Eerst het outputplafond. Gemini 4 Argon genereert tot 1.000.000 tokens in één traject — de aankondiging van Google noemt dit een uitbreiding van 64K in de vorige generatie. GPT-6 Astra is gemaximeerd op 128.000. Beide hebben een contextvenster van ongeveer een miljoen tokens, dus dit gaat puur om hoeveel het model in één keer kan schrijven. Voor het genereren van lange teksten, codewijzigingen met volledige patches of het in één keer opstellen van documenten is dat een achtvoudig verschil in wat één enkele aanroep kan produceren. Voor chat, extractie en korte agentstappen zijn beide plafonds feitelijk onbeperkt en kost het verschil je niets.
Ten tweede modaliteit, en hier loopt het voordeel in één opzicht de andere kant op. GPT-6 Astra accepteert tekst, afbeeldingen en bestanden. Gemini 4 Argon accepteert tekst, afbeeldingen, video en bestanden, en het lanceringsmateriaal van Google leunt specifiek op het begrijpen van lange video's — een LVBench-cijfer van 91,7% dat door de leverancier wordt gerapporteerd. Als je pijplijn video inneemt, is Astra geen vervanging. Audio wordt evenmin genoemd in de gepubliceerde modaliteitenlijst van Argon, dus ga er niet van uit dat de upgrade audio meebrengt.
Wat je daadwerkelijk moet doen
Astra is beschikbaar en Argon niet, en daarmee zijn de meeste beslissingen voor de komende maand bezegeld. Het concrete pad dat geen werk verspilt: bouw voort op GPT-6 Astra als je workload een altijd actief redeneermodel nodig heeft met sterke wetenschappelijke nauwkeurigheid en een bewezen agentische staat van dienst, houd je modelnaam in de configuratie, en stel de time-outs van je client in op basis van Astra's gemeten gedrag in plaats van op basis van optimisme — een run van vijf minuten tot het eerste token laat een standaard time-out van 60 seconden afgaan, en een stream die na 300 seconden sterft, ziet eruit als een storing. Als je kostenbewust bent boven 272K invoertokens, modelleer de prijsherziening dan expliciet voordat je je vastlegt, want de stap verdubbelt de invoer en verhoogt de uitvoer met de helft bij één grens.

Het interessante middenpad is dat je niet één enkele standaardoptie hoeft te kiezen. Astra en Argon — wanneer Argon verschijnt — zijn hetzelfde type model, gericht op dezelfde soort taken, wat hen tot natuurlijke failover-partners maakt in plaats van concurrenten voor dezelfde plek. Op OrcaRouteropenai/gpt-6-astra staat live tegen de lijstprijs van de provider, zonder opslag, op hetzelfde OpenAI-compatibele endpoint alsmeer dan 200 andere modellen, metautomatische failover tussen providers en een routing-DSL om een primary-en-backup-opstelling op één key uit te drukken. Wanneer Argon aan de catalogus wordt toegevoegd onder welke id Google ook publiceert, is de overstap een string — geen tweede contract, geen integratiewerk en geen herbouw van wat je in de tussentijd rond Astra hebt gebouwd.
Wat zou de gelijke stand voorgoed doorbreken?
Een gepubliceerde Argon-prijs na de introductieperiode, en een onafhankelijke reproductie van de agentische claims van Google — het DeepSWE v1.1-cijfer van 77,9% en het CWE-bench v1-resultaat van 68% zijn beide door de leverancier gerapporteerd en geen van beide heeft een externe run achter zich. Elk van beide kan Argon wezenlijk omhoog of omlaag bewegen, omdat een indexvoorsprong van 0,11 punt geen buffer is tegen een kostennadeel van 1,6× als het kostenvoordeel tijdelijk blijkt te zijn, en het is geen tekort als Google het introductietarief aanhoudt en Astra's long-context-tier in productie harder toeslaat dan verwacht.
Voorlopig: op gemeten algemene capaciteit zijn deze twee hetzelfde model in twee wrappers. Astra is degene met een live route, een bekende prijsstap en een denkpauze van vijf minuten. Argon is degene met een goedkopere kaart en geen endpoint. De gelijkstand is echt, en één kant ervan is koopbaar.
