Une carte héros générée intitulée « Dots vs Grok 4.6 », sous-titrée « L’agent qui réserve ses propres réunions face au modèle qui répond ». Un filet vertical divise la carte : le panneau de gauche, intitulé « Dots », affiche « ordinateur personnel, navigateur, 4 000+ applications » ; celui de droite, intitulé « Grok 4.6 », affiche « contexte 500K - 88,4 Terminal-Bench - 2,00 $ / 6,00 $ ». Le logo OrcaRouter est incrusté dans le coin inférieur droit.
Guides & Insights

Dots vs Grok 4.6 : l'agent qui réserve ses propres réunions face au modèle qui répond

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Essayez d’écrire un numéro de téléphone pour un dot et vous échouerez, et cet échec est ce qu’il y a de plus utile dans ce duo. Dots est l’agent toujours actif de l’entreprise, annoncé lors du DevDay du 29 septembre 2026 : chaque dot dispose de son propre ordinateur cloud et navigateur, se connecte à plus de 4 000 applications et est joignable dans ChatGPT, Slack et Teams, fonctionne sur GPT-6 Astra et est inclus avec Pro et Business Premium sans frais supplémentaires. Grok 4.6 est le modèle de pointe de SpaceXAI, publié le 12 août 2026, et c’est un tout autre type d’objet : une fenêtre de contexte de 500 000 jetons, une entrée texte, image et fichier avec sortie texte, un effort de raisonnement configurable, un appel natif d’outils et des sorties structurées, au prix de 2,00 $ par million de jetons d’entrée et de 6,00 $ par million de jetons de sortie en dessous d’un prompt de 200 000 jetons, et le double au-dessus. L’un d’eux est un collègue avec un emploi du temps. L’autre est une fonction que vous appelez.

Tous deux sont véritablement solides dans le travail agentique, ce qui explique la fréquence de cette confusion. Grok 4.6 obtient 88,4 sur Terminal-Bench 2.1 et 50,7 sur le volet d'utilisation d'outils τ-banking — le genre de chiffres qui font qu'un modèle est décrit comme « un agent ». Ce n'en est pas un. C'est le moteur de raisonnement à partir duquel on en construirait un.

Ce que chacun est réellement

• Identité — un produit hébergé sans identifiant de modèle que vous pouvez adresser (Dots), par opposition à un modèle nommé et routable doté d’une chaîne stable que vous pouvez mettre dans un fichier de configuration (Grok 4.6)

• Où l’exécution a lieu — sur l’ordinateur cloud d’OpenAI, avec son propre navigateur, isolé de votre machine sauf si vous les reliez (Dots), par opposition à l’endroit où vous exécutez l’appel : un conteneur que vous contrôlez, un worker de file d’attente, une tâche cron (Grok 4.6)

• Portée — plus de 4 000 applications via les connecteurs d’OpenAI (Dots), face aux outils que vous connectez vous-même, car l’appel d’outils est un protocole et non un répertoire (Grok 4.6)

Mémoire d’un produit — portée par le produit à travers, à travers les applis, à travers de nouveaux fils (Dots) face à une fenêtre de 500 000 tokens et tout ce que vous persistez vous-même (Grok 4.6)

• Coût — inclus avec un abonnement, allocation non publiée (Dots) contre 2,00 $ et 6,00 $ par million de tokens, doublant au-delà de 200 000 tokens d’entrée, avec des lectures mises en cache à 0,50 $ (Grok 4.6)

• Preuves — démonstration du fournisseur et déclarations de capacités, aucun benchmark indépendant (Dots) face à un Artificial Analysis Coding Index de 76,8, cinquième sur 138 modèles mesurés, et 94,9 sur GPQA Diamond (Grok 4.6)

Le chiffre qui tranche la plupart des questions : l'allocation

OpenAI a publié un seul prix pour les dots, et ce n’est pas un prix exprimé dans une unité quelconque permettant de mesurer un travail. Le premier dot est inclus avec Pro ou Business Premium ; les conversations avec lui n’entament pas les limites d’utilisation de ChatGPT ; des limites étendues s’appliquent le premier mois. Voilà toute la structure de coûts publiée. Aucun chiffre d’allocation, aucun prix du deuxième dot, aucun tarif par tâche, aucun prix entreprise pour les dots spécialisés dont on rapporte qu’ils sont en test interne. Le compte rendu de la keynote par CNBC indique que la directrice financière Sarah Friar présente le niveau Pro 500 à 500 $ par mois comme une allocation d’utilisation plus le nouveau mode Ultrafast, plutôt que comme un tarif par dot, ce qui signifie que le plan le plus cher de la grille tarifaire d’OpenAI ne permet toujours pas d’obtenir un coût par unité de travail d’agent.

Grok 4.6 fait l'inverse et publie tout, y compris ce qui fait mal. La frontière de palier à 200 000 tokens d'entrée est une falaise : une requête à 199 000 tokens est facturée à la moitié du tarif d'une requête à 201 000. Ce n'est pas un piège caché, c'est un chiffre dans la grille tarifaire, et cela change la façon dont vous concevez une tâche à contexte long. Vous découpez à la frontière ou vous acceptez le deuxième palier en connaissance de cause.

A screenshot of the OrcaRouter model page for Grok 4.6, showing the identifier 'grok/grok-4.6' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-12, a description of it as SpaceXAI's smartest model to date and the current flagship of the Grok line with a 500K-token context window, a side panel reading 500K tokens of context over text, image and file input, and a price strip reading $2.00 and $6.00 with tiered rates above a 200,000-token prompt.

Un successeur est sorti pendant que cette paire était comparée.

Grok 4.7 a été publié le 21 septembre 2026 et constitue désormais le fleuron de la gamme Grok, avec le même contexte de 500 000 tokens, la même surface d’entrée, la même tarification de base et une sortie maximale bien plus grande de 450 000 tokens. Grok 4.6 reste disponible et toujours répertorié comme modèle actuel — un changement de version n’est pas un retrait — mais quiconque choisit un modèle Grok aujourd’hui devrait choisir entre 4.6 et 4.7 plutôt que de supposer que 4.6 est la frontière. La raison de le dire aussi clairement, c’est que l’article que vous lisez porte sur une comparaison qui survit à la transition : quel que soit le nom donné au sommet de la gamme Grok au trimestre prochain, il reste un modèle à compteur avec une grille tarifaire, et un point reste un abonnement avec une allocation non publiée.

C’est aussi l’argument en faveur de faire passer vos appels de modèle par une abstraction plutôt que par un fournisseur codé en dur. Lorsque le successeur sera disponible, changer de modèle se fera en modifiant une seule ligne plutôt qu’en effectuant une migration.

A generated scoreboard titled 'Dots vs Grok 4.6 - product against protocol', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; computer its own cloud computer and browser; connectors 4,000+ apps; channels ChatGPT, Slack, Teams; independent benchmark none. The right column, 'Grok 4.6', lists: context 500,000 tokens; input text, image, file; price $2.00 in / $6.00 out per 1M; above 200K input $4.00 in / $12.00 out per 1M; cached reads $0.50 per 1M; AA Coding Index 76.8, 5th of 138. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Grok 4.6 figures from independent listings as carried in the OrcaRouter catalogue.'

Construire l'agent plutôt que de le louer

La conséquence intéressante de cette association, c'est que Grok 4.6 vous permet de construire ce que Dots vend, mal, puis mieux. Une boucle qui lit une file d'attente, appelle le modèle avec des outils attachés, écrit les résultats et réessaie en cas d'échec n'est pas difficile ; ce qui est difficile, ce sont les parties qu'un dot vous offre gratuitement — un navigateur qui se comporte comme celui d'une personne, des connecteurs écrits par les éditeurs d'applications, un flux d'approbation et un journal d'activité. Celles-ci valent un abonnement précisément parce qu'elles sont fastidieuses.

Là où le côté facturé à l'usage l'emporte, c'est au moment où le travail cesse d'être générique. Le moment où vous avez besoin que le même appel s'exécute auprès d'un autre fournisseur le trimestre prochain, qu'il soit rejoué à partir d'un journal, facturé au centime près, ou basculé en pleine exécution vers un homologue moins cher lorsqu'un fournisseur en amont vacille. Sur OrcaRouter, Grok 4.6 est servi comme grok/grok-4.6 au tarif catalogue de SpaceXAI avec 0 % de marge en sus — le tarif propre du fournisseur, répercuté tel quel, pour qu'une baisse tarifaire d'un fournisseur apparaisse sur votre facture le jour même — dans le même catalogue que plus de 200 autres modèles derrière une seule clé, avec un basculement automatique et un DSL de routage pour composer plusieurs modèles en un seul appel. Il n'existe pas d'équivalent pour un point : pas de point de terminaison, pas d'identifiant, rien depuis quoi basculer.

Le test à appliquer

Demandez si le travail existerait encore si personne ne le regardait. Si la réponse est oui — cela doit se produire selon un planning, à travers plusieurs outils, sans qu’une personne ouvre une fenêtre de chat — un dot est le produit conçu pour cela, et le modèle facturé à l’usage est un composant au sein de ce que vous construisez. Si la réponse est non, si quelqu’un attend le résultat et que le résultat a un format et une échéance, alors un modèle facturé à l’usage est le bon achat et un agent est un détour coûteux.

L’erreur qu’il vaut mieux éviter, c’est d’acheter un point pour obtenir une meilleure réponse. Un point n’est pas un modèle plus intelligent ; c’est une laisse plus longue sur un modèle. Et la deuxième erreur, c’est de payer un abonnement pour obtenir une capacité qu’une grille tarifaire vous vend déjà au token, avec le calcul visible à l’avance.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with model cards visible in a grid beneath.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement