Carte de titre principale pour l'article « Gemini 4 Carbon — RAPPORT DE FUITE » avec un badge « NON VÉRIFIÉ », le sous-titre « Un checkpoint interne de Google que le public ne peut pas appeler — ce que dit le rapport », trois puces indiquant « Source : Business Insider via TestingCatalog », « 9–10 octobre 2026 » et « Testé sur Jetski, la plateforme interne de Google », une carte de gauche indiquant « L'affirmation : les premiers retours internes positionnent Carbon comme comparable à Claude Opus 5.5 pour le codage », et une carte de droite indiquant « Le contexte : Barium-B est le checkpoint choisi pour la version publique de Gemini 4 Argon ». Le logo OrcaRouter est incrusté dans le coin inférieur droit.
Guides & Insights

Fuite de Gemini 4 Carbon : le checkpoint interne de Google que les employés disent coder comme Claude Opus 5.5

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Il existe une version de cette histoire qui relève de l'information et une version qui relève du bruit, et la différence tient entièrement à ce à quoi les noms sont rattachés. Les 9 et 10 octobre 2026, Business Insider a rapporté — et le média spécialisé dans le suivi des fuites TestingCatalog a relayé — que des employés du géant de la recherche testent en interne un checkpoint supplémentaire de Gemini 4 baptisé Carbon, que les premiers retours internes placent Carbon comme comparable à Claude Opus 5.5 pour le codage, que Barium-B est le checkpoint retenu pour la sortie publique de Gemini 4 Argon, et que Carbon, testé via la plateforme interne de l'entreprise Jetski, est une itération distincte et potentiellement plus puissante. Ce qui rend cela digne d'être lu plutôt que survolé, c'est la dernière proposition : savoir si Carbon sera livré comme une mise à jour de Gemini 4 Argon ou comme une version à part entière est, selon les propres termes du rapport, non confirmé. Et c'est là tout l'état des preuves — aucune annonce, aucun identifiant de modèle, aucun endpoint, aucun prix, aucune fiche de modèle, et aucun commentaire du fournisseur. Tout ce qui est concret sur cette page est une fuite, une déduction tirée d'une fuite, ou un fait concernant un autre modèle, livrable, au regard duquel la fuite est évaluée.

Ce que le rapport affirme réellement

Le signal est, et il est suffisamment précis pour être falsifiable, ce qui est la seule raison pour laquelle il a sa place sur une page comme celle-ci. Dépouillés de tout cadrage, les faits sont les suivants :

• Des employés de Google testent en interne un checkpoint de Gemini 4 nommé Carbon. Ce n’est pas un modèle public et il ne peut être appelé depuis aucune API.

• Selon les premiers retours internes, Carbon serait perçu comme comparable à Claude Opus 5.5 pour le codage — une impression issue de tests réalisés par le personnel, et non le résultat d'un benchmark, ni un chiffre que quiconque en dehors de Google peut reproduire.

• Le checkpoint derrière le modèle dont le public a réellement entendu parler — Gemini 4 Argon — s’appelle Barium-B, et Carbon est décrit comme une itération distincte et potentiellement plus performante plutôt que comme la même version sous deux étiquettes.

• Selon les informations rapportées, Carbon serait exercé via Jetski, que le même rapport décrit comme le nom interne de Google associé à Antigravity, son environnement de codage agentique.

• On ne sait pas si Carbon deviendra une future mise à jour de Gemini 4 Argon ou une version distincte de Gemini 4. Google n’a fait aucun commentaire à ce sujet.

Voilà la fuite. Elle contient une comparaison, une relation de nom de code et une question véritablement ouverte, et aucune partie n'en constitue une publication.

A two-column infographic titled 'Gemini 4 Carbon — what the report says / what it does not'. Left column 'What the report says': '9–10 Oct 2026 — Business Insider, relayed by TestingCatalog', 'Google staff testing a Gemini 4 checkpoint named Carbon', 'Early internal feedback: feels comparable to Claude Opus 5.5 for coding', 'Barium-B is the checkpoint chosen for the public Gemini 4 Argon release', 'Tested via Jetski, tied to Antigravity'. Right column 'What it does not say': 'Whether Carbon ships as an Argon update or a separate Gemini 4 release', 'No model ID, endpoint or price of any kind', 'No model card, context window or parameter count', 'No benchmark number behind the Opus 5.5 comparison', 'No date, and no comment from Google'. Footer: 'All leak claims unverified; Google has not commented.'

L’échelle des noms de code, et quel échelon compte

La raison pour laquelle ce rapport a besoin d’un anneau de décodage, c’est que l’habitude qu’a Google de recourir au tableau périodique met trois noms dans un même paragraphe qui semblent parallèles et ne le sont pas. Classés selon ce qu’un lecteur peut réellement faire de chacun :

• Gemini 4 Argon — annoncé. Un véritable nom de modèle avec un billet d'annonce officiel et une page de famille, un prix de lancement publié de 2 $ par million de tokens d'entrée et de 10 $ par million de tokens de sortie, une limite de sortie publiée de 1 million de tokens, et un déploiement restreint qui a commencé avec des cyberdéfenseurs vérifiés et a été décrit comme devant s'élargir ensuite aux clients API payants. Il n'a toujours pas d'identifiant de modèle que vous pouvez mettre dans une requête, ce qui est la frontière entre un modèle annoncé et un modèle appelable.

• Barium-B — un nom de point de contrôle, pas un produit. D'après le même rapport, il s'agit de la build retenue pour la version publique d'Argon. C'est là tout l'intérêt de ce libellé : il vous indique que le nom Argon est une décision de mise à disposition enveloppant une build interne, plutôt qu'une build à part entière.

• Carbon — un point de contrôle interne auquel sont jointes des impressions du personnel, et rien d’autre. Pas d’identifiant, pas de prix, pas de fenêtre, pas de date. C’est une rumeur avec un nom de code, et les noms de code ne valent pas cher.

Lu ainsi, l’histoire n’est pas « un nouveau Gemini a fuité ». C’est que Google semble faire tourner plus d’un checkpoint de frontière en parallèle, que celui sur lequel l’entreprise a apposé son nom public n’est pas celui pour lequel ses ingénieurs sont les plus enthousiastes, et que personne en dehors de l’entreprise ne sait lequel de ces deux faits finira par compter.

Pourquoi « on se croirait sur Claude Opus 5.5 » est la phrase porteuse

De tout ce qui figure dans le rapport, c’est la comparaison qui porte le plus et qui est la moins vérifiable, il vaut donc la peine d’être précis sur ce à quoi elle est comparée. Claude Opus 5.5 est le modèle phare d’Anthropic et, selon des mesures indépendantes, le modèle de codage le plus puissant largement accessible de la génération actuelle — le point de référence auquel un ingénieur Google a recours lorsqu’il veut dire « c’est le bon » sans citer de benchmark. À son prix catalogue publié, il coûte 4,00 $ par million de jetons d’entrée et 20,00 $ par million de jetons de sortie, les lectures de cache étant à 0,20 $ par million, et il dispose d’une fenêtre d’entrée de 1 M de jetons et d’une sortie maximale de 128 K de jetons.

Face à cela, la comparaison dit deux choses à la fois, et c’est la seconde que les gens ignorent. La première est compétitive : un checkpoint interne de Google est décrit du même souffle que le modèle phare du principal rival, ce qui est un compliment que Google ne mettrait pas dans un article de blog. La seconde est positionnelle : la comparaison est une impression d’employés sur le ressenti en matière de codage, exactement le genre d’affirmation qui survit au contact d’une fenêtre de chat et meurt au contact d’un classement. Personne n’a publié de benchmark pour Carbon. Il n’y a pas d’entrée Artificial Analysis, pas de tableau de benchmark de fournisseur, pas de PDF de méthodologie d’évaluation — ces éléments existent pour Gemini 4 Argon et n’existent pas pour ce cas-ci. Un ressenti n’est pas un score, et cette page ne va pas maquiller l’un en l’autre.

Il y a aussi une conséquence tarifaire qu'il vaut la peine de nommer, sans prétendre connaître la réponse. Si un checkpoint qui « donne l'impression d'être Claude Opus 5.5 pour le code » se trouve à l'intérieur de Google, et que le modèle que Google a réellement annoncé se situe cinq points en dessous dans l'index indépendant, alors la question intéressante n'est pas de savoir si Carbon est bon — c'est de savoir à quel prix Google le positionnerait, et s'il serait un jour vendu aux tarifs ordinaires auxquels le reste de la gamme Gemini a été lancé.

Qu'est-ce qui manque, et pourquoi la liste est plus longue que les nouvelles

L’inventaire honnête de ce qui n’existe pas constitue tout l’article, alors le voici :

• Un identifiant de modèle — Carbon n’en a aucun, et Gemini 4 Argon non plus. Aucun des deux noms n’apparaît dans un emplacement auquel une requête peut être adressée.

• Un prix — rien de publié pour Carbon, à quelque niveau que ce soit, pas même un tarif d'introduction.

• Une fiche de modèle ou une fiche système — aucune, et aucune méthodologie d'évaluation publiée derrière.

• Une fenêtre de contexte, une limite de sortie ou un nombre de paramètres — aucun n'est publié, et Google n'a publié de nombre de paramètres pour aucun Gemini.

• Un résultat de benchmark — la comparaison avec Opus 5.5 est une impression du personnel, ce qui signifie pas de chiffre, pas de test et pas de reproductibilité.

• Une date — aucune annonce, aucun déploiement progressif, aucune fenêtre, et aucun commentaire de Google sur le fait de savoir si une sortie de Carbon est même prévue.

• Une relation — que Carbon soit la prochaine mise à jour d’Argon ou un modèle Gemini 4 distinct. Il s’agit de l’inconnue la plus lourde de conséquences du rapport, et elle est explicitement non confirmée dans le rapport lui-même.

Tout ce qui ne figure pas sur cette liste relève de l’inférence, y compris la plupart de ce qui sera écrit à ce sujet au cours des deux prochaines semaines.

Ce qu'un développeur peut faire avec ceci aujourd'hui

La réponse utile est que presque rien ne change, et il vaut la peine de dire précisément pourquoi. Ni Gemini 4 Argon ni Carbon ne se trouvent sur OrcaRouter — interroger notre propre catalogue pour l’un ou l’autre ne renvoie rien, et continuera de ne rien renvoyer tant que Google ne rendra pas l’un d’eux appelable. Le nom Gemini 4 n’est pas une chose vers laquelle on peut router ; c’est un nom attaché à un déploiement à accès restreint. Tout compte qui propose un accès à « Gemini 4 Carbon » en ce moment vend une étiquette.

Ce qui est réel, c'est le modèle par rapport auquel la fuite est mesurée. Claude Opus 5.5 est disponible sur OrcaRouter au prix catalogue d'Anthropic — 4,00 $ en entrée et 20,00 $ en sortie par million de tokens, les lectures de cache à 0,20 $ par million, répercutées sans aucune marge — donc le modèle précis auquel Carbon est présenté comme comparable est un modèle que vous pouvez appeler dès aujourd'hui, avec la même clé API que tout le reste. C'est un fait plus utile que la fuite, car c'est la moitié de la comparaison qui peut être testée.

La posture qui survit à une rumeur est celle qui n’a pas besoin que la rumeur soit vraie. Placez Claude Opus 5.5 derrière vos charges de travail de codage les plus exigeantes et conservez une règle de basculement vers un palier moins cher pour le trafic qui n’en a pas besoin ; le jour où un véritable identifiant Gemini 4 apparaît dans un catalogue de fournisseur, nos prix catalogue sont mis à jour le jour même où Google les fixe, car il n’existe aucune étape de renégociation entre la publication d’un prix par un fournisseur et sa répercussion par nos soins. Une seule API pour plus de 200 modèles transforme « devons-nous migrer ? » en une modification du DSL de routage et un A/B sur le trafic en direct plutôt qu’en une réécriture. Routez selon des résultats que vous pouvez mesurer, pas selon des noms dont vous entendez parler.

A screenshot of Google's own Gemini API models documentation page, listing the Gemini 3.8 family and earlier models with their model codes and pricing, and containing no entry for Gemini 4 Argon or Gemini 4 Carbon.A screenshot of the OrcaRouter model page for anthropic/claude-opus-5.5, showing the model id, its capability chips, a 1M-token context window, a 128K maximum output, and pricing of .00 per 1M input tokens and 0.00 per 1M output tokens with cache reads at /bin/bash.20 per 1M.

Ce que nous regardons

• Que Google dise quoi que ce soit. Un commentaire, une modification de la page famille ou une ligne dans un billet de lancement déplacerait tout cela hors de la colonne des fuites d’un seul coup. Le silence le maintient là où il est.

• La deuxième étape du déploiement d’Argon. L’annonce présentait les clients payants de l’API et les abonnés Ultra comme la prochaine cohorte après les défenseurs vérifiés, et l’arrivée d’un identifiant Gemini 4 est l’événement qui fait passer « annoncé » à « appelable ». Si un point de terminaison exécutable voit le jour, la question de savoir si son checkpoint est Barium-B ou quelque chose de plus récent devient concrète.

• Toute mesure indépendante de Carbon. Dès qu’un point de contrôle comme celui-ci apparaît sur un classement neutre plutôt que dans une impression du personnel, la phrase sur Opus 5.5 cesse d’être un ressenti et devient un point de données — ou cesse d’être vraie.

• La grille tarifaire. Le prix que Google applique à un checkpoint de frontière que ses propres ingénieurs préfèrent est l’indice qui permet de savoir si Carbon est une mise à jour d’Argon ou un palier à part entière.

• Si la relation entre noms de code survit au contact d’un lancement. Barium-B derrière Argon, avec Carbon à ses côtés : voilà un récit limpide aujourd’hui ; les publications de lancement ont pour habitude de réduire les récits limpides à un seul modèle avec un seul ID.

Le résumé qui ne survend pas tout cela est bref. Des employés de Google testeraient, selon les informations, un point de contrôle interne de Gemini 4 appelé Carbon ; leur première impression est qu’il code comme Claude Opus 5.5 ; le point de contrôle derrière la version publique Gemini 4 Argon est un autre, appelé Barium-B ; et que Carbon devienne un jour un produit — une mise à jour, un modèle distinct ou rien du tout — n’est pas confirmé. La moitié de cette phrase sur laquelle vous pouvez agir est celle qui nomme Claude Opus 5.5, car c’est le seul modèle du paragraphe à avoir un identifiant de modèle, un prix et un point de terminaison. Continuez à appeler ce que vous pouvez appeler, et gardez une règle de basculement prête pour le jour où l’autre nom deviendra lui aussi appelable.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement