
Gemini 4 Carbon-lek: het interne checkpoint van Google dat volgens medewerkers codeert zoals Claude Opus 5.5
- OrcaNIEUWOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 per 1 mln tokens · 84 tok/s
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 122 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 53 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 354 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
Er is een versie van dit verhaal die nieuws is en een versie die ruis is, en het verschil zit hem volledig in waaraan de namen zijn gekoppeld. Op 9 en 10 oktober 2026 meldde Business Insider — en het op lekken gespecialiseerde medium TestingCatalog gaf het door — dat medewerkers van de zoekgigant intern een extra Gemini 4-checkpoint testen, genaamd Carbon, dat vroege interne feedback Carbon als vergelijkbaar met Claude Opus 5.5 voor coderen bestempelt, dat Barium-B het checkpoint is dat is geselecteerd voor de publieke Gemini 4 Argon release, en dat Carbon, getest via het interne Jetski-platform van het bedrijf, een aparte en mogelijk sterkere iteratie is. Wat dat de moeite van het lezen waard maakt in plaats van slechts scannen, is de laatste zin: of Carbon wordt uitgebracht als een Gemini 4 Argon update of als een eigen release, is in de eigen woorden van het rapport onbevestigd. En dat is de hele stand van het bewijs — geen aankondiging, geen modelidentificatie, geen endpoint, geen prijs, geen modelkaart en geen commentaar van de leverancier. Alles wat concreet is op deze pagina is een lek, een gevolgtrekking uit een lek, of een feit over een ander, daadwerkelijk uit te brengen model waaraan het lek wordt afgemeten.
Wat het rapport eigenlijk beweert
Het signaal is zwak, en het is specifiek genoeg om falsifieerbaar te zijn, wat de enige reden is dat het op een pagina als deze thuishoort. Ontdaan van framing luiden de beweringen als volgt:
• Google-medewerkers testen intern een Gemini 4-checkpoint met de naam Carbon. Het is geen publiek model en kan niet via een API worden aangeroepen.
• Naar verluidt blijkt uit vroege interne feedback dat Carbon voor programmeren vergelijkbaar aanvoelt met Claude Opus 5.5 — een indruk uit tests door medewerkers, geen benchmarkresultaat, en geen getal dat iemand buiten Google kan reproduceren.
• De checkpoint achter het model waar het publiek daadwerkelijk van heeft gehoord — Gemini 4 Argon — heet Barium-B, en Carbon wordt beschreven als een afzonderlijke en mogelijk krachtigere iteratie, in plaats van dezelfde build onder twee labels.
• Carbon zou naar verluidt via Jetski worden gebruikt, die volgens dezelfde berichtgeving het interne van Google is dat met Antigravity, zijn agentische codeeromgeving, in verband wordt gebracht.
• Of Carbon een toekomstige Gemini 4 Argon-update wordt of een afzonderlijke Gemini 4-release, is onbekend. Google heeft zich hier niet over uitgelaten.
Dat is het lek. Het bevat één vergelijking, één codenaamrelatie en één echte open vraag, en geen enkel deel ervan is een release.

De codenaamladder, en welke sport ertoe doet
De reden dat dit rapport een decodeerring nodig heeft, is dat de gewoonte van Google om het periodiek systeem te gebruiken drie namen in één alinea zet die parallel lijken maar dat niet zijn. Gesorteerd op wat een lezer met elk ervan daadwerkelijk kan doen:
• Gemini 4 Argon — aangekondigd. Een echte modelnaam met een first-party aankondigingsbericht en een familiepagina, een gepubliceerde introductieprijs van $2 per miljoen invoertokens en $10 per miljoen uitvoertokens, een gepubliceerde uitvoerlimiet van 1 miljoen tokens, en een uitrol met beperkte toegang die begon met gescreende cyberverdedigers en naar verluidt vervolgens zou worden verbreed naar betalende API-klanten. Het heeft nog steeds geen model-ID dat je in een verzoek kunt zetten, en dat is de grens tussen een aangekondigd model en een aanroepbaar model.
• Barium-B — een checkpointnaam, geen product. Volgens dezelfde berichtgeving is het de build die is gekozen voor de publieke Argon-release. Dat is het nuttige aan het label: het vertelt je dat de naam Argon een releasebeslissing is die om een interne build heen is gewikkeld in plaats van een build zelf.
• Carbon — een intern controlepunt met daaraan alleen indrukken van medewerkers en verder niets. Geen ID, geen prijs, geen lanceervenster, geen datum. Het is een gerucht met een codenaam, en codenamen zijn goedkoop.
Zo gelezen gaat het verhaal niet over "een nieuwe Gemini die is uitgelekt". Het gaat erom dat Google meer dan één frontier-checkpoint parallel lijkt te draaien, dat degene waar het zijn publieke naam aan heeft verbonden niet degene is waarover zijn engineers het meest enthousiast zijn, en dat niemand buiten het bedrijf weet welk van die twee feiten uiteindelijk van belang zal blijken te zijn.
Waarom "voelt als Claude Opus 5.5" de dragende zin is
Van alles in het rapport verzet de vergelijking het meeste werk en is die het minst verifieerbaar, dus het is de moeite waard precies te zijn over waarmee die wordt vergeleken. Claude Opus 5.5 is het vlaggenschip van Anthropic en, volgens onafhankelijke meting, het sterkste breed aanroepbare codeermodel van de huidige generatie — het referentiepunt waarnaar een Google-engineer grijpt wanneer die wil zeggen "dit is de goede" zonder een benchmark te noemen. Tegen de gepubliceerde lijstprijs kost het $4,00 per miljoen inputtokens en $20,00 per miljoen outputtokens, met cache-reads tegen $0,20 per miljoen, en het heeft een inputvenster van 1M tokens en een maximale output van 128K tokens.
Daartegenover gezet zegt de vergelijking twee dingen tegelijk, en het tweede is het punt dat mensen overslaan. Het eerste is competitief: een interne Google-checkpoint wordt in één adem genoemd met het vlaggenschip van de toonaangevende rivaal, en dat is een compliment dat Google niet in een blogpost zou zetten. Het tweede is positioneel: de vergelijking is een indruk van medewerkers over het codeergevoel, en dat is precies het soort bewering dat contact met een chatvenster overleeft en sneuvelt bij contact met een leaderboard. Niemand heeft een benchmark voor Carbon gepubliceerd. Er is geen Artificial Analysis-vermelding, geen benchmarktabel van een leverancier, geen pdf met evaluatiemethodologie — die bestaan voor Gemini 4 Argon en niet voor dit. Een gevoel is geen score, en deze pagina gaat het ene niet als het andere opdirken.
Er is ook een consequentie voor de prijsstelling die het benoemen waard is, zonder te doen alsof we het antwoord kennen. Als een checkpoint dat "aanvoelt als Claude Opus 5.5 voor coderen" zich binnen Google bevindt en het model dat Google daadwerkelijk heeft aangekondigd vijf punten lager op de onafhankelijke index staat, dan is de interessante vraag niet of Carbon goed is — maar welke prijs Google ervoor zou vragen, en of het ooit zou worden verkocht tegen de werkpaardtarieven waartegen de rest van de Gemini-lijn is uitgebracht.
Wat ontbreekt, en waarom is de lijst langer dan het nieuws
De eerlijke inventaris van wat niet bestaat, is het hele artikel, dus hier is het:
• Een model-ID — Carbon heeft er geen, en Gemini 4 Argon ook niet. Geen van beide namen komt voor op enige plek waaraan een verzoek kan worden gericht.
• Een prijs — niets gepubliceerd voor Carbon op welk niveau dan ook, zelfs geen introductietarief.
• Een modelkaart of systeemkaart — geen, en geen gepubliceerde evaluatiemethodologie erachter.
• Een contextvenster, een uitvoerlimiet of een parameteraantal — geen daarvan gepubliceerd, en Google heeft voor geen enkele Gemini een parameteraantal gepubliceerd.
• Een benchmarkresultaat — de vergelijking met Opus 5.5 is een indruk van medewerkers, wat betekent: geen cijfer, geen test en geen reproduceerbaarheid.
• Een datum — geen aankondiging, geen gefaseerde uitrol, geen tijdvenster, en geen enkel commentaar van Google over of er überhaupt een Carbon-release gepland is.
• Een verband — of Carbon de volgende Argon-update is of een losstaand Gemini 4-model. Dit is de allerbelangrijkste onbekende in het rapport en deze wordt in het rapport zelf expliciet niet bevestigd.
Alles wat niet op die lijst staat, is gevolgtrekking, inclusief het meeste van wat de komende twee weken hierover geschreven zal worden.
Wat een ontwikkelaar hier vandaag mee kan doen
Het nuttige antwoord is dat er bijna niets verandert, en het is de moeite waard om precies te zeggen waarom. Noch Gemini 4 Argon noch Carbon staan op OrcaRouter — als we onze eigen catalogus naar een van beide doorzoeken, levert dat niets op, en dat zal niets blijven opleveren totdat Google een van beide aanroepbaar maakt. De naam Gemini 4 is niet iets waarnaar je kunt routeren; het is een naam die aan een afgeschermde uitrol hangt. Elk account dat nu toegang tot "Gemini 4 Carbon" aanbiedt, verkoopt een label.
Wat echt is, is het model waaraan de lek wordt afgemeten. Claude Opus 5.5 is live op OrcaRouter tegen de lijstprijs van Anthropic — $ 4,00 in en $ 20,00 uit per miljoen tokens, cache-reads tegen $ 0,20 per miljoen, doorgegeven zonder enige opslag — dus het specifieke model waarmee Carbon wordt beschreven als vergelijkbaar, is er een dat je vandaag kunt aanroepen, met dezelfde API-sleutel als al het andere. Dat is een nuttiger feit dan de lek, want het is de helft van de vergelijking die te testen is.
De houding die een gerucht overleeft, is degene die het gerucht niet nodig heeft om waar te zijn. Zet Claude Opus 5.5 in voor je zwaarste programmeerworkloads en houd een failover-regel naar een goedkopere tier aan voor verkeer dat het niet nodig heeft; op de dag dat een echte Gemini 4-identifier in een providercatalogus verschijnt, worden onze lijstprijzen bijgewerkt op dezelfde dag dat Google ze vaststelt, omdat er geen heronderhandelingsstap is tussen het publiceren van een prijs door een leverancier en het doorgeven daarvan door ons. Eén API voor 200+ modellen verandert "moeten we migreren?" in een aanpassing van de routing-DSL en een A/B-test op liveverkeer in plaats van een herschrijving. Routeer op resultaten die je kunt meten, niet op namen waarover je leest.


Wat we bekijken
• Of Google überhaupt iets zegt. Een opmerking, een wijziging op een familiepagina of één regel in een lanceringsbericht zou dit allemaal in één keer uit de lekkenrubriek halen. Stilte houdt het waar het is.
• De tweede fase van de Argon-uitrol. In de aankondiging werden betaalde API-klanten en Ultra-abonnees beschreven als het volgende cohort na gescreende verdedigers, en de komst van een Gemini 4-identifier is de gebeurtenis die "aangekondigd" verandert in "aanroepbaar". Als er een uitvoerbaar eindpunt beschikbaar komt, wordt de vraag of het checkpoint Barium-B is of iets nieuwers concreet.
• Elke onafhankelijke meting van Carbon. Zodra een checkpoint als dit op een neutrale leaderboard opduikt in plaats van in een indruk van een medewerker, houdt de uitspraak over Opus 5.5 op een vibe te zijn en wordt het een datapunt — of is ze niet langer waar.
• De prijslijst. Waar Google een frontier-checkpoint beprijst dat zijn eigen ingenieurs verkiezen, is het signaal of Carbon een Argon-update is of een aparte tier.
• Of de relatie tussen de codenamen het contact met een lancering overleeft. Barium-B achter Argon en Carbon ernaast is vandaag een zuiver verhaal; lanceringsposts hebben de gewoonte zuivere verhalen te laten instorten tot één model met één ID.
De samenvatting die dit niet te mooi voorstelt, is kort. Google-medewerkers testen naar verluidt een interne Gemini 4-checkpoint genaamd Carbon; hun eerste indruk is dat hij codeert als Claude Opus 5.5, de checkpoint achter de publieke Gemini 4 Argon-release is een andere, genaamd Barium-B, en of Carbon ooit een product wordt — een update, een apart model of niets — is onbevestigd. De helft van die zin waarop je kunt handelen, is de helft die Claude Opus 5.5 noemt, want het is het enige model in de alinea met een model-ID, een prijs en een endpoint. Blijf aanroepen wat je kunt aanroepen, en houd een failoverregel klaar voor de dag dat de andere naam er ook een wordt.
