
Dots vs Grok 4.6: de agent die zijn eigen vergaderingen boekt tegenover het model dat antwoordt
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 349 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 210 tok/s
- OrcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- xAISpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
Probeer een telefoonnummer voor een dot te schrijven en je zult falen, en dat falen is het nuttigste aan deze combinatie. Dots is de altijd actieve agent van het bedrijf, aangekondigd tijdens DevDay op 29 september 2026: elke dot krijgt zijn eigen cloudcomputer en browser, maakt verbinding met meer dan 4.000 apps en is bereikbaar binnen ChatGPT, Slack en Teams, draait op GPT-6 Astra en is inbegrepen bij Pro en Business Premium zonder aparte kosten. Grok 4.6 is het frontier-model van SpaceXAI, gepubliceerd op 12 augustus 2026, en het is een heel ander soort object: een contextvenster van 500.000 tokens, tekst-, afbeeldings- en bestandsinvoer met tekstuitvoer, configureerbare redeneerinspanning, native toolaanroepen en gestructureerde outputs, geprijsd op $2,00 per miljoen invoertokens en $6,00 per miljoen uitvoertokens voor prompts onder 200.000 tokens, en het dubbele daarboven. Een van deze is een collega met een agenda. De andere is een functie die je aanroept.
Beide zijn echt sterk in agentisch werk, en dat is wat de verwarring zo gewoon maakt. Grok 4.6 scoort 88,4 op Terminal-Bench 2.1 en 50,7 op de τ-banking tool-use-slice — het soort cijfers waardoor een model als "een agent" wordt omschreven. Het is er geen. Het is de redeneermotor waaruit je er een zou bouwen.
Wat elk ervan eigenlijk is
Identiteit — een gehost product zonder een model-ID dat je kunt aanspreken (Dots), tegenover een genoemd, routeerbaar model met een stabiele string die je in een configuratiebestand kunt zetten (Grok 4.6)
• Waar de uitvoering plaatsvindt — op de cloudcomputer van OpenAI, met zijn eigen browser, geïsoleerd van jouw machine tenzij je ze (Dots) koppelt aan waar je de aanroep ook uitvoert: een container die je zelf beheert, een queue worker, een cronjob (Grok 4.6)
• Bereik — 4.000+ apps via de connectors van OpenAI (Dots), tegenover welke tools je ook zelf aansluit, want tool calling is een protocol en geen directory (Grok 4.6)
• Geheugen van een taak — gedragen door het product over dagen, apps en nieuwe threads (Dots) heen, afgezet tegen een venster van 500.000 tokens en wat je zelf persisteert (Grok 4.6)
• Kosten — inbegrepen bij een abonnement, tegoed niet gepubliceerd (Dots) tegen $2,00 en $6,00 per miljoen tokens, verdubbelt boven de 200.000 invoertokens, met gecachte reads tegen $0,50 (Grok 4.6)
• Bewijs — demonstratie door de leverancier en capaciteitsverklaringen, geen onafhankelijke benchmark (Dots) tegenover een Artificial Analysis Coding Index van 76,8, de vijfde van 138 gemeten modellen, en 94,9 op GPQA Diamond (Grok 4.6)
Het getal dat het spel bepaalt: {{1}}...
OpenAI heeft één prijs voor dots gepubliceerd, en het is geen prijs in een eenheid waarmee je werk kunt meten. De eerste dot is inbegrepen bij Pro of Business Premium; gesprekken ermee verbruiken de gebruikslimieten van ChatGPT niet; in de eerste maand gelden uitgebreide limieten. Dat is de volledige gepubliceerde kostenstructuur. Geen opgegeven gebruiksquotum, geen prijs voor een tweede dot, geen tarief per taak, geen enterprise-prijs voor de gespecialiseerde dots die naar verluidt intern worden getest. In het verslag van CNBC over de keynote prijst financieel directeur Sarah Friar het Pro 500-abonnement van $500 per maand als een gebruiksquotum plus de nieuwe Ultrafast-modus, in plaats van als een tarief per dot, wat betekent dat zelfs het duurste abonnement op de prijslijst van OpenAI nog steeds geen kosten per eenheid agentwerk oplevert.
Grok 4.6 gaat de andere kant op en publiceert alles, inclusief het deel dat pijn doet. De niveaugrens bij 200.000 inputtokens is een klif: een verzoek met 199.000 tokens wordt tegen de helft van het tarief gefactureerd vergeleken met een verzoek met 201.000. Dat is geen verborgen valkuil, het is een getal op de tariefkaart, en het verandert hoe je een taak met een lange context ontwerpt. Je splitst op bij de grens of je accepteert het tweede niveau bewust.

Een opvolger werd uitgebracht terwijl dit tweetal werd vergeleken.
Grok 4.7 is gepubliceerd op 21 september 2026 en is nu het vlaggenschip van de Grok-lijn, met dezelfde context van 500.000 tokens, hetzelfde inputoppervlak, dezelfde basisprijsstelling en een veel grotere maximale uitvoer van 450.000 tokens. Grok 4.6 blijft beschikbaar en staat nog steeds vermeld als een actueel model — een versieverhoging is geen uitfasering — maar wie vandaag een Grok-model kiest, zou moeten kiezen tussen 4.6 en 4.7 in plaats van aan te nemen dat 4.6 de frontier is. De reden om dit ronduit te zeggen is dat het artikel dat u leest over een vergelijking gaat die de overgang overleeft: hoe het topmodel van de Grok-lijn volgend kwartaal ook heet, het blijft een model met verbruiksmeting en een tariefkaart, en een dot blijft een abonnement met een niet-gepubliceerd tegoed.
Dat is ook het argument om je modelaanroepen via een abstractie te laten lopen in plaats van via een hardgecodeerde leverancier. Wanneer de opvolger er is, is het wijzigen van het model een aanpassing van één regel in plaats van een migratie.

De agent bouwen in plaats van deze te huren
Het interessante gevolg van deze combinatie is dat Grok 4.6 je het ding dat Dots verkoopt laat bouwen, slecht en dan beter. Een lus die een wachtrij leest, het model aanroept met hulpmiddelen eraan gekoppeld, resultaten schrijft en bij een fout opnieuw probeert, is niet moeilijk; wat moeilijk is, zijn de onderdelen die een dot je gratis geeft — een browser die zich gedraagt als die van een persoon, connectors die door de app-leveranciers zijn geschreven, een goedkeuringsproces en een activiteitenlogboek. Die zijn een abonnement waard, juist omdat ze omslachtig zijn.
Waar de op verbruik gebaseerde kant wint, is het moment waarop het werk ophoudt generiek te zijn. Het moment waarop je dezelfde call volgend kwartaal tegen een andere leverancier wilt laten draaien, vanuit een log opnieuw wilt laten afspelen, tot op de cent wilt laten prijzen, of tijdens de vlucht naar een goedkopere zustermodel wilt failoveren wanneer een upstream-provider hapert. Op OrcaRouter wordt Grok 4.6 aangeboden als grok/grok-4.6 tegen de lijstprijs van SpaceXAI met 0% opslag erbovenop — het eigen tarief van de provider, doorgegeven, zodat een prijsverlaging van een leverancier dezelfde dag op je factuur terechtkomt — in dezelfde catalogus als meer dan 200 andere modellen achter één sleutel, met automatische failover en een routing-DSL om meerdere modellen in één enkele call samen te stellen. Er is geen equivalent voor een punt: geen endpoint, geen identifier, niets om vanaf te failoveren.
De toe te passen test
Vraag je af of het werk nog zou bestaan als niemand ernaar keek. Als het antwoord ja is — het moet volgens een schema gebeuren, over meerdere tools heen, zonder dat iemand een chatvenster opent — is een dot het product dat daarvoor gevormd is, en het verbruiksgebaseerde model is een component binnen wat je ook bouwt. Als het antwoord nee is, als iemand op de output wacht en de output heeft een formaat en een deadline, dan is een verbruiksgebaseerd model de juiste aankoop en is een agent een dure omweg.
De fout die je beter vermijdt, is het kopen van een bot om een beter antwoord te krijgen. Een bot is geen slimmer model; het is een langere leiband aan een model. En de tweede fout is het betalen voor een abonnement om een mogelijkheid te krijgen die een tariefkaart je al per token verkoopt, waarbij de rekensom vooraf zichtbaar is.

Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
