Hero-titelkort för artikeln "Gemini 4 Carbon — LEAK REPORT" med en "UNVERIFIED"-badge, undertiteln "En intern Google-checkpoint som allmänheten inte kan anropa — vad rapporten säger", tre chips med texten "Källa: Business Insider via TestingCatalog", "9–10 oktober 2026" och "Testad på Jetski, Googles interna plattform", ett vänsterkort med texten "Påståendet: tidig intern feedback gör Carbon jämförbar med Claude Opus 5.5 för kodning", och ett högerkort med texten "Kontexten: Barium-B är den checkpoint som valts för den publika lanseringen av Gemini 4 Argon". OrcaRouter-logotypen är komponerad i det nedre högra hörnet.
Guides & Insights

Gemini 4 Carbon-läcka: Googles interna checkpoint som personalen säger kodar som Claude Opus 5.5

Författare

Elias Hawthorne

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Det finns en version av den här historien som är nyheter och en version som är brus, och skillnaden ligger helt och hållet i vad namnen är kopplade till. Den 9 och 10 oktober 2026 rapporterade Business Insider – och mediet TestingCatalog, som bevakar läckor, förmedlade – att personal hos sökgiganten internt testar en ytterligare Gemini 4-checkpoint som kallas Carbon, att tidig intern feedback gör att Carbon känns jämförbar med Claude Opus 5.5 för kodning, att Barium-B är den checkpoint som valts för den offentliga Gemini 4 Argon-releasen, och att Carbon, testad via företagets interna Jetski-plattform, är en separat och möjligen starkare iteration. Det som gör det värt att läsa i stället för att skumma är den sista satsen: huruvida Carbon släpps som en Gemini 4 Argon-uppdatering eller som en egen release är, enligt rapportens egna ord, obekräftat. Och det är hela bevisläget – inget tillkännagivande, ingen modellidentifierare, ingen endpoint, inget pris, inget modellkort och ingen kommentar från leverantören. Allt konkret på den här sidan är en läcka, en slutledning dragen från en läcka, eller ett faktum om en annan, leveransklar modell som läckan mäts mot.

Vad rapporten faktiskt hävdar

Signalen är tunn, och den är tillräckligt specifik för att vara falsifierbar, vilket är det enda skälet till att den hör hemma på en sida som den här. Utan inramning är påståendena följande:

• Anställda på Google testar internt en Gemini 4-checkpoint med namnet Carbon. Den är inte en offentlig modell och kan inte anropas från något API.

• Tidig intern feedback uppges få Carbon att kännas jämförbart med Claude Opus 5.5 för kodning — ett intryck från personaltester, inte ett benchmarkresultat, och inte en siffra som någon utanför Google kan reproducera.

• Checkpointen bakom modellen som allmänheten faktiskt har hört talas om – Gemini 4 Argon – kallas Barium-B, och Carbon beskrivs som en separat och potentiellt mer kapabel iteration snarare än samma bygge under två etiketter.

• Carbon uppges användas via Jetski, som samma rapportering beskriver som Googles interna namn kopplat till Antigravity, dess agentiska kodningsmiljö.

• Huruvida Carbon blir en framtida Gemini 4 Argon-uppdatering eller en fristående Gemini 4-version är okänt. Google har inte kommenterat något av det.

Det där är läckan. Den innehåller en jämförelse, en kodnamnsrelation och en genuint öppen fråga, och ingen del av den är en release.

A two-column infographic titled 'Gemini 4 Carbon — what the report says / what it does not'. Left column 'What the report says': '9–10 Oct 2026 — Business Insider, relayed by TestingCatalog', 'Google staff testing a Gemini 4 checkpoint named Carbon', 'Early internal feedback: feels comparable to Claude Opus 5.5 for coding', 'Barium-B is the checkpoint chosen for the public Gemini 4 Argon release', 'Tested via Jetski, tied to Antigravity'. Right column 'What it does not say': 'Whether Carbon ships as an Argon update or a separate Gemini 4 release', 'No model ID, endpoint or price of any kind', 'No model card, context window or parameter count', 'No benchmark number behind the Opus 5.5 comparison', 'No date, and no comment from Google'. Footer: 'All leak claims unverified; Google has not commented.'

Kodnamnsstegen, och vilket trappsteg som spelar roll

Anledningen till att den här rapporten behöver en avkodningsring är att Googles varna att göra som med det periodiska systemet placerar tre namn i ett och samma stycke som ser parallella ut men inte är det. Sorterat efter vad en läsare faktiskt kan göra med vart och ett:

• Gemini 4 Argon — tillkännagiven. Ett riktigt modellnamn med ett tillkännagivandeinlägg från första part och en familjesida, ett publicerat introduktionspris på 2 USD per miljon indatatokens och 10 USD per miljon utdatatokens, en publicerad gräns på 1 miljon utdatatokens, och en grindad utrullning som började med granskade cyberförsvarare och beskrevs som att den härnäst skulle utökas till betalande API-kunder. Den har fortfarande ingen modellidentifierare som du kan lägga in i en begäran, vilket är gränsen mellan en tillkännagiven modell och en anropbar.

• Barium-B — ett namn på en checkpoint, inte en produkt. Enligt samma rapportering är det den build som valts för den publika Argon-releasen. Det är det användbara med etiketten: den säger att namnet Argon är ett utgivningsbeslut som omsluter en intern build snarare än en build i sig.

• Carbon — en kontrollpunkt med bifogade personalintryck och inget annat. Inget ID, inget pris, inget fönster, inget datum. Det är ett rykte med ett kodnamn, och kodnamn är billiga.

Läst på det sättet är historien inte ”en ny Gemini har läckt”. Den är att Google tycks köra mer än en frontier-checkpoint parallellt, att den som företaget satte sitt offentliga namn på inte är den som dess ingenjörer är mest entusiastiska över, och att ingen utanför företaget vet vilket av dessa två fakta som kommer att visa sig spela roll.

Varför ”känns som Claude Opus 5.5” är den bärande meningen

Av allt i rapporten är jämförelsen den som gör det tyngsta arbetet och är minst verifierbar, så det är värt att vara precis om vad den jämförs med. Claude Opus 5.5 är Anthropics flaggskepp och, enligt oberoende mätningar, den starkaste brett anropbara kodningsmodellen i den nuvarande generationen – den referenspunkt som en Google-ingenjör tar till när de vill säga "den här är den bra" utan att nämna ett benchmark. Enligt dess publicerade listpris ligger den på $4.00 per miljon indatatoken och $20.00 per miljon utdatatoken, med cacheläsningar på $0.20 per miljon, och den har ett indatafönster på 1M token och en maximal utdata på 128K token.

Ställt mot det säger jämförelsen två saker samtidigt, och den andra är den som folk hoppar över. Det första är konkurrensmässigt: en intern Google-checkpoint beskrivs i samma andetag som den ledande rivalens flaggskepp, vilket är en komplimang som Google inte skulle skriva i ett blogginlägg. Det andra är positionellt: jämförelsen är ett anställdsintryck av kodkänsla, vilket är exakt den typ av påstående som överlever kontakt med ett chattfönster och dör vid kontakt med en resultattavla. Ingen har publicerat ett benchmark för Carbon. Det finns ingen Artificial Analysis-post, ingen leverantörsbenchmark-tabell, ingen PDF med utvärderingsmetod – de finns för Gemini 4 Argon och de finns inte för detta. En känsla är inte en poäng, och den här sidan tänker inte klä ut den ena till den andra.

Det finns också en prissättningskonsekvens som är värd att nämna utan att låtsas veta svaret. Om en checkpoint som ”känns som Claude Opus 5.5 för kodning” finns inne hos Google och modellen som Google faktiskt tillkännagav ligger fem punkter under den på det oberoende indexet, då är den intressanta frågan inte huruvida Carbon är bra — utan var Google skulle prissätta det, och huruvida det någonsin skulle säljas till de arbetshästpriser som resten av Gemini-linjen har släppts till.

Vad saknas, och varför är listan längre än nyheterna?

Den ärliga inventeringen av det som inte finns är hela artikeln, så här är den:

• En modellidentifierare – Carbon har ingen, och inte heller Gemini 4 Argon. Inget av namnen förekommer någonstans dit en begäran kan adresseras.

• Ett pris — inget publicerat för Carbon på någon nivå, inte ens ett introduktionspris.

• Ett modellkort eller systemkort — inget, och ingen publicerad utvärderingsmetodik bakom det.

• Ett kontextfönster, en utdatalimit eller ett parameterantal – inget av dem publicerat, och Google har inte publicerat ett parameterantal för någon Gemini.

• Ett benchmarkresultat – jämförelsen med Opus 5.5 är ett intryck från personalen, vilket innebär inget tal, inget test och ingen reproducerbarhet.

• Ett datum – inget tillkännagivande, ingen stegvis utrullning, inget tidsfönster och ingen kommentar från Google om en Carbon-utgåva överhuvudtaget är planerad.

• Ett samband — huruvida Carbon är nästa Argon-uppdatering eller en separat Gemini 4-modell. Detta är den enskilt mest betydelsefulla okända faktorn i rapporten och den är uttryckligen obekräftad i själva rapporten.

Allt som inte står på den listan är slutledningar, inklusive det mesta av det som kommer att skrivas om detta under de kommande två veckorna.

Vad en utvecklare kan göra med detta idag

Det användbara svaret är att nästan ingenting förändras, och det är värt att säga exakt varför. Varken Gemini 4 Argon eller Carbon finns på OrcaRouter — att söka i vår egen katalog efter någon av dem returnerar inget, och det kommer att fortsätta returnera inget tills Google gör någon av dem anropbar. Namnet Gemini 4 är inte något man kan routa till; det är ett namn kopplat till en begränsad utrullning. Varje konto som erbjuder åtkomst till "Gemini 4 Carbon" just nu säljer en etikett.

Det som är verkligt är den modell som läckan mäts mot. Claude Opus 5.5 är live på OrcaRouter till Anthropics listpris — 4,00 $ in och 20,00 $ ut per miljon tokens, cache-läsningar till 0,20 $ per miljon, vidarebefordrat utan påslag — så den specifika modell som Carbon beskrivs som jämförbar med är en du kan anropa idag, med samma API-nyckel som allt annat. Det är ett mer användbart faktum än läckan, eftersom det är den halva av jämförelsen som kan testas.

Den hållning som överlever ett rykte är den som inte behöver att ryktet är sant. Sätt Claude Opus 5.5 bakom dina svåraste kodningsarbetsbelastningar och behåll en failover-regel till en billigare nivå för trafiken som inte behöver det; den dag en riktig Gemini 4-identifierare dyker upp i en leverantörskatalog uppdateras våra listpriser samma dag som Google sätter dem, eftersom det inte finns något omförhandlingssteg mellan att en leverantör publicerar ett pris och att vi för det vidare. Ett API för 200+ modeller förvandlar "bör vi migrera?" till en redigering i routing-DSL och ett A/B-test på livetrafik i stället för en omskrivning. Rutta efter resultat du kan mäta, inte namn du läser om.

A screenshot of Google's own Gemini API models documentation page, listing the Gemini 3.8 family and earlier models with their model codes and pricing, and containing no entry for Gemini 4 Argon or Gemini 4 Carbon.A screenshot of the OrcaRouter model page for anthropic/claude-opus-5.5, showing the model id, its capability chips, a 1M-token context window, a 128K maximum output, and pricing of .00 per 1M input tokens and 0.00 per 1M output tokens with cache reads at /bin/bash.20 per 1M.

Vad vi tittar på

• Huruvida Google säger något alls. En kommentar, en ändring på familjesidan eller en rad i ett lanseringsinlägg skulle på en gång flytta allt detta ur läckagekolumnen. Tystnad håller det kvar där det är.

• Argon-utrullningens andra etapp. Tillkännagivandet beskrev betalande API-kunder och Ultra-prenumeranter som nästa grupp efter granskade försvarare, och ankomsten av en Gemini 4-identifierare är händelsen som förvandlar "aviserad" till "anropbar". Om en körbar slutpunkt släpps blir frågan huruvida dess checkpoint är Barium-B eller något nyare konkret.

• Varje oberoende mätning av Carbon. I samma stund som en kontrollpunkt som denna dyker upp på en neutral resultattavla i stället för i ett intryck från personalen, upphör meningen om Opus 5.5 att vara en vibe och börjar bli en datapunkt – eller upphör att vara sann.

• Priset. Var Google prissätter en frontier-checkpoint som dess egna ingenjörer föredrar är ledtråden till huruvida Carbon är en Argon-uppdatering eller en egen nivå.

• Huruvida kodnamnsförhållandet överlever kontakt med en lansering. Barium-B bakom Argon och Carbon vid sidan av det är en tydlig historia idag; lanseringsinlägg har en tendens att reducera tydliga historier till en modell med ett ID.

Sammanfattningen som inte överdriver det här är kort. Googles anställda uppges testa en intern Gemini 4-checkpoint som kallas Carbon, deras tidiga intryck är att den kodar som Claude Opus 5.5, checkpointen bakom den publika lanseringen av Gemini 4 Argon är en annan som kallas Barium-B, och huruvida Carbon någonsin blir en produkt – en uppdatering, en separat modell eller ingenting – är obekräftat. Den hälft av den meningen som du kan agera på är den hälft som namnger Claude Opus 5.5, eftersom det är den enda modellen i stycket med en modellidentifierare, ett pris och en slutpunkt. Fortsätt anropa det du kan anropa, och håll en failover-regel redo för den dag då det andra namnet blir anropbart.