
Gemini 4 vs Gemini 4 Argon : l'un de ces deux modèles n'existe pas
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 221 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAINOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 110 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Google a annoncé un modèle de frontière le 30 septembre 2026. Ce n'est pas celui que la plupart des gens imaginent. Gemini 4 Argon est un nom réel attaché à une annonce réelle, une grille tarifaire réelle et un ensemble de benchmarks publié. Gemini 4 est le préfixe de famille sous lequel ce nom se situe — et d'après les informations disponibles aujourd'hui, ce n'est pas un produit. Il n'existe pas d'ID de modèle pour lui, pas de point de terminaison, pas de fiche de modèle et pas de prix par million de tokens. Il ne s'agit donc pas d'une comparaison de deux systèmes. Il s'agit d'une comparaison entre un modèle annoncé et un nom que beaucoup de gens, y compris ce blog, traitent comme un modèle depuis des mois.
Cette distinction a des implications financières. Gemini 4 Argon affiche un tarif d’introduction de 2 $ par million de tokens d’entrée et de 10 $ par million de tokens de sortie, puis passe à 4 $ et 20 $ après une période d’introduction que Google n’a pas définie. Ce sont des chiffres déclarés par le fournisseur dans le propre article d’annonce de Google. Si vous budgétisez une migration vers l’offre pro pour 2026, 2 $/10 $ est le chiffre sur lequel vous pouvez vous baser, et « le coût de Gemini 4, quel qu’il soit » n’est pas un chiffre du tout — rien n’a été publié à son sujet, car il n’y a encore rien à publier.
Ce que « Gemini 4 » est réellement, officiellement
Cherchez une page produit Gemini 4 et vous ne trouverez qu'un seul document : le billet publié par Google lui-même, intitulé Gemini 4 Argon : notre nouvelle ère d'intelligence de pointe, mis en ligne le 30 septembre 2026 à 20:00 UTC et attribué à Koray Kavukcuoglu. Lisez-le attentivement : « Gemini 4 » n'apparaît jamais comme un modèle autonome. Chaque affirmation de capacité, chaque prix et chaque benchmark du billet est rattaché au nom complet. La forme seule n'apparaît que là où le nom sert de préfixe — « les capacités de Gemini 4 Argon » — soit exactement le même emplacement grammatical qu'occupait Gemini 3 avant que Gemini 3 Pro, Gemini 3.1 Pro et quatre variantes Flash ne deviennent chacune une entité à part.
L’historique générationnel étaye cette lecture. La conférence de résultats d’Alphabet du 23 juillet a officialisé ce cadrage : Sundar Pichai a déclaré que la prochaine génération de modèles de frontière « nécessite des modèles de base bien plus grands », et a désigné le codage et le codage agentique comme les domaines à améliorer. Le 23 septembre, lors d’un événement organisé par The Information, Kavukcuoglu a déclaré que le pré-entraînement était terminé et que le modèle en était aux premiers stades du post-entraînement, que l’équipe avait vu les résultats, et qu’il espérait livrer une première version post-entraînée bien avant la fin de l’année. Business Insider a décrit l’annonce du 30 septembre comme le premier modèle de la série 4 — une série, c’est là l’indice. Ces trois éléments sont des déclarations d’un fournisseur sur son propre travail, relayées par des tiers.
Ce que cela signifie concrètement : « Gemini 4 » est la génération, et cette génération compte un seul membre nommé. La structure de gammes que Google propose depuis deux ans — un Pro au sommet, un Flash en dessous, une variante Cyber dont l'accès est conditionné au même programme — n'a pas encore été complétée pour la génération 4. Un « Gemini 4 Pro » ou un « Gemini 4 Ultra » relève d'une déduction à partir du schéma de nommage de Google, et non d'une fuite ni d'un élément de feuille de route. Considérez tout article qui compare Gemini 4 Argon à « Gemini 4 » comme comparant un modèle à son propre nom de famille.
Ce qu'est réellement Gemini 4 Argon
Gemini 4 Argon a été annoncé le 30 septembre 2026 sur le blog de Google, et Demis Hassabis a annoncé le même modèle, dans ses propres mots, sur X ce soir-là. Le déploiement se fait par étapes, et seule la première phase a une date : Argon est d'abord déployé auprès des défenseurs cyber vérifiés via le Fairwind Program, le palier accessible uniquement sur candidature que Google a conçu pour les gouvernements et les autorités nationales de cybersécurité, les opérateurs d'infrastructures critiques et les plateformes technologiques essentielles. Le post de Hassabis lui-même indiquait que l'entreprise le déployait « en commençant aujourd'hui par les gouvernements et les défenseurs cyber de confiance via notre Fairwind Program ». Ensuite, la formulation de Google place les clients payants de l'API et les abonnés à Google AI Ultra juste après, puis les développeurs, les entreprises et les consommateurs. Aucune de ces étapes ultérieures n'est assortie d'une date.
Ce qui ne figure pas dans cette liste, c’est la partie qui compte pour quiconque planifie un travail : une date de disponibilité générale, un ID de modèle, une fenêtre de contexte, un nombre de paramètres, une fiche de modèle ou une fiche système. Google a publié une limite de sortie, pas une fenêtre de contexte. Elle est de 1 million de jetons, contre le plafond de 64K utilisé par la précédente famille Gemini, et Google la présente comme étant à la pointe du secteur. Une augmentation d’un ordre de grandeur de ce qu’un seul appel peut renvoyer constitue un vrai changement pour les longues trajectoires d’agents et le rendu en un seul passage, et c’est le seul chiffre technique de l’annonce sans ambiguïté.

L'ensemble des benchmarks est vaste et entièrement non reproduit. Google rapporte DeepSWE v1.1 à 77,9 %, la première place sur AutomationBench à 51,3 %, LVBench à 91,7 %, une égalité pour la première place sur CWE-bench v1 à 68 %, des résultats en tête sur le Vals Index, son Vals Finance Agent v2, le Legal Agent Benchmark de Harvey et la meilleure performance sur le benchmark Indirect Prompt Injection de Gray Swan. Chacun de ces chiffres est le propre chiffre du fournisseur, publié par le fournisseur, et aucun n'a été reproduit indépendamment. Un ensemble distinct de chiffres ayant circulé en septembre, présenté comme des benchmarks prédits de Gemini 4 avec un score AutomationBench de 48,7 %, s'est avéré être recyclé d'un lancement sans rapport et n'est pas une publication de Google. Le chiffre AutomationBench réellement rapporté par Google est de 51,3 %, ce qui est un nombre différent provenant d'une source différente.
Le tableau de score que les deux noms produisent
Mettez les deux côte à côte sur les six dimensions que cet appariement met réellement en jeu, et la forme du problème est évidente :
• Existe en tant que produit nommé — Gemini 4 : non. Gemini 4 Argon : oui, annoncé le 30 septembre 2026.
• Appelable dès aujourd'hui — Gemini 4 : aucun ID de modèle ni point de terminaison n'existe. Gemini 4 Argon : aucun ID de modèle ni point de terminaison n'existe non plus ; l'accès est contrôlé par Fairwind et uniquement sur candidature.
• Prix — Gemini 4 : aucun publié. Gemini 4 Argon : 2 $ / 10 $ par million de tokens en tarif d’introduction, puis 4 $ / 20 $. Déclaré par le fournisseur.
• Sortie maximale — Gemini 4 : aucune publiée. Gemini 4 Argon : 1 million de tokens, contre 64K pour la génération précédente. Déclaré par le fournisseur.
• Indice d'intelligence — Gemini 4 : non évalué. Gemini 4 Argon : 53 sur l'Indice d'intelligence d'Artificial Analysis avec un effort de raisonnement élevé, pour un coût de 1,99 $ par tâche d'indice. Selon Artificial Analysis.
• Rang indépendant au classement — Gemini 4 : non classé. Gemini 4 Argon : premier sur le Vals Index à 68,90 % avec un coût de 15,68 $ par test, sur 13,40 Md de tokens d’entrée et 142,01 M de tokens de sortie. Selon Vals.

Lisez les deux dernières lignes ensemble et vous obtenez le seul désaccord vraiment intéressant de cette comparaison. Artificial Analysis place Gemini 4 Argon à 53, à égalité avec Claude Fable 5.1 et GPT-6 Astra, et cinq points derrière Claude Opus 5.5 à 58. Vals le place carrément en tête. Les deux sont indépendants, les deux mesurent quelque chose de réel, et ils mesurent des choses différentes — l'indice d'AA pondère un ensemble fixe de dix évaluations couvrant le code, le raisonnement et le travail de connaissance, tandis que le Vals Index pondère quatre secteurs selon leur part de la valeur ajoutée économique américaine. Un modèle peut être en tête dans l'un et pas dans l'autre sans que l'un ou l'autre classement soit erroné.
Il y a une deuxième chose à remarquer dans la ligne Vals, et c’est celle dont un acheteur d’entreprise devrait se soucier. Vals indique la grille tarifaire d’Argon à 4 $/20 $ — le prix après la période d’introduction — alors que l’annonce de Google elle-même mentionne 2 $/10 $. Si le coût de 15,68 $ par test a été calculé à 4 $/20 $, un acheteur qui accepte le tarif d’introduction verrait un chiffre nettement inférieur pour le même travail, et un acheteur qui rate la fenêtre d’introduction ne le verrait pas. Google n’a pas précisé combien de temps dure cette fenêtre. Cette seule variable non définie déplace le chiffre le plus déterminant pour la décision de tout le lancement.
Ce que vous pouvez appeler aujourd'hui.
Rien sous le nom Gemini 4, et cela nous inclut. Nous avons vérifié le catalogue : google/gemini-4, google/gemini-4-argon, google/gemini-4-pro et google/gemini-3.8-flash-cyber renvoient tous « model not found », et il en va de même pour toutes les autres plateformes de routage, car aucune d’elles n’a d’ID de modèle à router. La liste de modèles de l’API Gemini elle-même — Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.1 Pro, Gemini 3 Flash — ne contient aucune entrée Gemini 4, quelle qu’elle soit. Tant qu’Argon n’a pas franchi la file d’attente Fairwind et obtenu un identifiant, il n’existe ni prix facturé ni point de terminaison nulle part.
L’offre Google Pro en production est une autre histoire. Gemini 3.1 Pro Preview figure dans notre catalogue depuis le 19 février 2026, à 2,00 $ en entrée et 12,00 $ en sortie par million de tokens, avec une fenêtre de contexte de 1 048 576 tokens, une sortie maximale de 65 536 tokens et une entrée multimodale pour le texte, l’image, l’audio, la vidéo et les fichiers. Huit mois plus tard, il est toujours étiqueté Preview dans la liste de modèles de l’API Gemini elle-même, ce qui est en soi l’argument qui justifie l’existence d’Argon. Au-delà de 200 000 tokens en entrée, le tarif double pour atteindre 4 $ et 18 $.

C'est le seul endroit où cette comparaison a une réponse opérationnelle. Gemini 3.1 Pro Preview est en production derrière le même endpoint compatible OpenAI que les autres plus de 200 modèles que nous routons, au prix catalogue du fournisseur sans marge — donc quand Google publiera finalement un identifiant et un tarif facturé pour Gemini 4 Argon, puis un modèle frère de niveau Pro si le schéma de nommage tient, la répercussion signifie que ces tarifs apparaissent de notre côté le jour même où ils apparaissent côté Google. En attendant, si vous voulez mesurer le niveau pro plutôt que de lire à son sujet, c'est le modèle à mesurer. Si vous voulez essayer un modèle dont le comportement est encore en cours de caractérisation, le basculement automatique entre fournisseurs est la façon de le faire sans parier un chemin de production sur une preview que Google lui-même décrit comme en cours de déploiement progressif.
Une réserve qui doit être mentionnée dans le même souffle que le prix
Bloomberg a rapporté le 30 septembre que certains employés de Google ayant un accès direct à Argon affirment qu'il réussit moins bien sur du travail réel que ne le suggèrent les scores de benchmark, la conception front-end étant citée expressément et deux employés employant le terme « benchmaxxing ». Google conteste cette caractérisation. Cela vaut la peine de le placer à côté de la liste des benchmarks, précisément parce que cette liste constitue toute la base de preuves publiques pour ce modèle. Quand il n'y a que les chiffres d'un seul fournisseur et aucun moyen de les reproduire, un rapport selon lequel ces chiffres ne racontent pas toute l'histoire n'est pas une note de bas de page. C'est la moitié des preuves.
Qui devrait choisir lequel ?
Si vous êtes en train de choisir entre ces deux noms, vous ne choisissez encore rien à proprement parler, et le conseil honnête est de planifier autour de cela plutôt que d’une comparaison.
• Si vous avez besoin d’un modèle Google de gamme pro en production ce trimestre, la réponse est Gemini 3.1 Pro Preview. Il est appelable, son tarif est défini, et c’est la gamme dont Argon est positionné comme le remplaçant. Attendre Argon, c’est attendre dans une file d’attente que vous ne pouvez pas rejoindre.
• Si vous faites partie du public pour lequel Argon est à accès restreint — une autorité gouvernementale en cybersécurité, un exploitant d'infrastructures critiques, un mainteneur de logiciels — le programme Fairwind est la seule voie, et la spécificité de cette restriction est un fait concernant les capacités du modèle, pas du marketing. Google l'a entraîné pour la découverte et la correction de vulnérabilités et ne l'a pas distribué au grand public.
• Si vous établissez le budget d'une migration 2026, utilisez 2 $/10 $ pour la fenêtre d'introduction et 4 $/20 $ pour tout ce qui suit. N'utilisez pas un seul chiffre combiné, et n'utilisez pas le coût par test de 15,68 $ de Vals sans vérifier à quelle grille tarifaire il a été calculé.
• Si vous attendez « Gemini 4 », attendez un identifiant de modèle. Le nom en obtiendra un — le schéma de nommage de Google sur trois générations indique que le niveau Pro et le niveau Flash ont leurs propres identifiants — mais le schéma n’est pas une annonce, et rien n’a été publié sur ce que serait, ce que coûterait ou ce que ferait un Gemini 4 tout court.
Le point plus général est un point que ce blog a déjà dû faire valoir et qu'il devra sans doute faire valoir à nouveau : un nom de génération n'est pas un modèle. Gemini 4 Argon est la seule chose que Google a dotée d'un nom, d'un prix, d'un ensemble de benchmarks et d'un plan d'accès. Le reste de la famille est un schéma, et un schéma est une chose que l'on peut prévoir mais pas une chose que l'on peut nommer.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
