
Dots vs Grok 4.6 : l'agent qui réserve ses propres réunions face au modèle qui répond
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 349 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAINOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 210 tok/s
- OrcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- xAISpaceXAI: Grok 4.62026-08-1244Intelligence77Code
Essayez d’écrire un numéro de téléphone pour un dot et vous échouerez, et cet échec est ce qu’il y a de plus utile dans ce duo. Dots est l’agent toujours actif de l’entreprise, annoncé lors du DevDay du 29 septembre 2026 : chaque dot dispose de son propre ordinateur cloud et navigateur, se connecte à plus de 4 000 applications et est joignable dans ChatGPT, Slack et Teams, fonctionne sur GPT-6 Astra et est inclus avec Pro et Business Premium sans frais supplémentaires. Grok 4.6 est le modèle de pointe de SpaceXAI, publié le 12 août 2026, et c’est un tout autre type d’objet : une fenêtre de contexte de 500 000 jetons, une entrée texte, image et fichier avec sortie texte, un effort de raisonnement configurable, un appel natif d’outils et des sorties structurées, au prix de 2,00 $ par million de jetons d’entrée et de 6,00 $ par million de jetons de sortie en dessous d’un prompt de 200 000 jetons, et le double au-dessus. L’un d’eux est un collègue avec un emploi du temps. L’autre est une fonction que vous appelez.
Tous deux sont véritablement solides dans le travail agentique, ce qui explique la fréquence de cette confusion. Grok 4.6 obtient 88,4 sur Terminal-Bench 2.1 et 50,7 sur le volet d'utilisation d'outils τ-banking — le genre de chiffres qui font qu'un modèle est décrit comme « un agent ». Ce n'en est pas un. C'est le moteur de raisonnement à partir duquel on en construirait un.
Ce que chacun est réellement
• Identité — un produit hébergé sans identifiant de modèle que vous pouvez adresser (Dots), par opposition à un modèle nommé et routable doté d’une chaîne stable que vous pouvez mettre dans un fichier de configuration (Grok 4.6)
• Où l’exécution a lieu — sur l’ordinateur cloud d’OpenAI, avec son propre navigateur, isolé de votre machine sauf si vous les reliez (Dots), par opposition à l’endroit où vous exécutez l’appel : un conteneur que vous contrôlez, un worker de file d’attente, une tâche cron (Grok 4.6)
• Portée — plus de 4 000 applications via les connecteurs d’OpenAI (Dots), face aux outils que vous connectez vous-même, car l’appel d’outils est un protocole et non un répertoire (Grok 4.6)
Mémoire d’un produit — portée par le produit à travers, à travers les applis, à travers de nouveaux fils (Dots) face à une fenêtre de 500 000 tokens et tout ce que vous persistez vous-même (Grok 4.6)
• Coût — inclus avec un abonnement, allocation non publiée (Dots) contre 2,00 $ et 6,00 $ par million de tokens, doublant au-delà de 200 000 tokens d’entrée, avec des lectures mises en cache à 0,50 $ (Grok 4.6)
• Preuves — démonstration du fournisseur et déclarations de capacités, aucun benchmark indépendant (Dots) face à un Artificial Analysis Coding Index de 76,8, cinquième sur 138 modèles mesurés, et 94,9 sur GPQA Diamond (Grok 4.6)
Le chiffre qui tranche la plupart des questions : l'allocation
OpenAI a publié un seul prix pour les dots, et ce n’est pas un prix exprimé dans une unité quelconque permettant de mesurer un travail. Le premier dot est inclus avec Pro ou Business Premium ; les conversations avec lui n’entament pas les limites d’utilisation de ChatGPT ; des limites étendues s’appliquent le premier mois. Voilà toute la structure de coûts publiée. Aucun chiffre d’allocation, aucun prix du deuxième dot, aucun tarif par tâche, aucun prix entreprise pour les dots spécialisés dont on rapporte qu’ils sont en test interne. Le compte rendu de la keynote par CNBC indique que la directrice financière Sarah Friar présente le niveau Pro 500 à 500 $ par mois comme une allocation d’utilisation plus le nouveau mode Ultrafast, plutôt que comme un tarif par dot, ce qui signifie que le plan le plus cher de la grille tarifaire d’OpenAI ne permet toujours pas d’obtenir un coût par unité de travail d’agent.
Grok 4.6 fait l'inverse et publie tout, y compris ce qui fait mal. La frontière de palier à 200 000 tokens d'entrée est une falaise : une requête à 199 000 tokens est facturée à la moitié du tarif d'une requête à 201 000. Ce n'est pas un piège caché, c'est un chiffre dans la grille tarifaire, et cela change la façon dont vous concevez une tâche à contexte long. Vous découpez à la frontière ou vous acceptez le deuxième palier en connaissance de cause.

Un successeur est sorti pendant que cette paire était comparée.
Grok 4.7 a été publié le 21 septembre 2026 et constitue désormais le fleuron de la gamme Grok, avec le même contexte de 500 000 tokens, la même surface d’entrée, la même tarification de base et une sortie maximale bien plus grande de 450 000 tokens. Grok 4.6 reste disponible et toujours répertorié comme modèle actuel — un changement de version n’est pas un retrait — mais quiconque choisit un modèle Grok aujourd’hui devrait choisir entre 4.6 et 4.7 plutôt que de supposer que 4.6 est la frontière. La raison de le dire aussi clairement, c’est que l’article que vous lisez porte sur une comparaison qui survit à la transition : quel que soit le nom donné au sommet de la gamme Grok au trimestre prochain, il reste un modèle à compteur avec une grille tarifaire, et un point reste un abonnement avec une allocation non publiée.
C’est aussi l’argument en faveur de faire passer vos appels de modèle par une abstraction plutôt que par un fournisseur codé en dur. Lorsque le successeur sera disponible, changer de modèle se fera en modifiant une seule ligne plutôt qu’en effectuant une migration.

Construire l'agent plutôt que de le louer
La conséquence intéressante de cette association, c'est que Grok 4.6 vous permet de construire ce que Dots vend, mal, puis mieux. Une boucle qui lit une file d'attente, appelle le modèle avec des outils attachés, écrit les résultats et réessaie en cas d'échec n'est pas difficile ; ce qui est difficile, ce sont les parties qu'un dot vous offre gratuitement — un navigateur qui se comporte comme celui d'une personne, des connecteurs écrits par les éditeurs d'applications, un flux d'approbation et un journal d'activité. Celles-ci valent un abonnement précisément parce qu'elles sont fastidieuses.
Là où le côté facturé à l'usage l'emporte, c'est au moment où le travail cesse d'être générique. Le moment où vous avez besoin que le même appel s'exécute auprès d'un autre fournisseur le trimestre prochain, qu'il soit rejoué à partir d'un journal, facturé au centime près, ou basculé en pleine exécution vers un homologue moins cher lorsqu'un fournisseur en amont vacille. Sur OrcaRouter, Grok 4.6 est servi comme grok/grok-4.6 au tarif catalogue de SpaceXAI avec 0 % de marge en sus — le tarif propre du fournisseur, répercuté tel quel, pour qu'une baisse tarifaire d'un fournisseur apparaisse sur votre facture le jour même — dans le même catalogue que plus de 200 autres modèles derrière une seule clé, avec un basculement automatique et un DSL de routage pour composer plusieurs modèles en un seul appel. Il n'existe pas d'équivalent pour un point : pas de point de terminaison, pas d'identifiant, rien depuis quoi basculer.
Le test à appliquer
Demandez si le travail existerait encore si personne ne le regardait. Si la réponse est oui — cela doit se produire selon un planning, à travers plusieurs outils, sans qu’une personne ouvre une fenêtre de chat — un dot est le produit conçu pour cela, et le modèle facturé à l’usage est un composant au sein de ce que vous construisez. Si la réponse est non, si quelqu’un attend le résultat et que le résultat a un format et une échéance, alors un modèle facturé à l’usage est le bon achat et un agent est un détour coûteux.
L’erreur qu’il vaut mieux éviter, c’est d’acheter un point pour obtenir une meilleure réponse. Un point n’est pas un modèle plus intelligent ; c’est une laisse plus longue sur un modèle. Et la deuxième erreur, c’est de payer un abonnement pour obtenir une capacité qu’une grille tarifaire vous vend déjà au token, avec le calcul visible à l’avance.

Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
