
Dots vs Gemini 3.1 Pro: Een agent met een desktop tegen een model met vijf zintuigen
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 349 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 210 tok/s
- OrcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- xAISpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
The word "multimodal" hides the real difference between these two, so start with what each one does with the world. Gemini 3.1 Pro Preview is Google's flagship reasoning model, released in preview on February 19, 2026: it accepts text, images, audio, video and files as input and returns text, works across a 1,048,576-token context window with up to 65,536 tokens of output, and costs $2.00 per million input tokens and $12.00 per million output tokens below a 200,000-token prompt, repricing to $4.00 and $18.00 above it. Dots is the company's always-on agent, announced at DevDay on September 29, 2026: an agent with its own cloud computer and browser that works across more than 4,000 connected apps, runs on GPT-6 Astra, and comes included with Pro and Business Premium. Gemini 3.1 Pro watches the world and describes it; a dot acts inside it. Those are different verbs, and almost every practical question about this pair follows from which verb your problem needs.
Input is niet hetzelfde als actie
De mediabereik van Gemini 3.1 Pro is echt breed — een opname van twee uur, een productfoto, een spreadsheet-export en een contract kunnen allemaal in hetzelfde verzoek terechtkomen — maar elk van die inputs is iets dat al bestond vóór de aanroep. De output van het model is tekst: een antwoord, een extractie, een plan, een concept. Niets buiten het gesprek verandert doordat het model heeft gedraaid.
Een punt keert dat om. De invoer ervan is alledaags — je berichten, je app-gegevens, een taak die je hebt beschreven — en de uitvoer is een verandering in de wereld: een bestand verplaatst, een ticket bijgewerkt, een bericht verzonden na jouw goedkeuring, een pagina geopend in zijn eigen browser. Het introductiemateriaal van OpenAI beschrijft hoe het meerdere projecten tegelijk vooruitbrengt, leert van feedback en nieuwe taken aanneemt zonder een nieuwe thread. Dat is een beschrijving van een werknemer, niet van een model, en het verklaart waarom OpenAI er geen benchmark voor publiceerde: je benchmarkt een collega niet op een ranglijst, je kijkt naar wat het voor elkaar krijgt en controleert de Activity View.
• Wat het opneemt — berichten, taakbeschrijvingen en gegevens van gekoppelde apps aan de ene kant; tekst, afbeelding, audio, video en bestand aan de andere kant
• Wat het oplevert — wijzigingen in andere software, onderworpen aan regels en goedkeuringspoorten, ten aanzien van tekst die je daarna zelf verwerkt
• Waar het draait — de cloudcomputer van OpenAI met zijn eigen browser, geïsoleerd van je machine, tenzij je ze aan elkaar koppelt, tegenover de serveerinfrastructuur van Google, bereikbaar via een API vanaf elke plek die je maar wilt
• Context — ongedocumenteerd voor een punt, tegenover 1.048.576 tokens in en 65.536 tokens uit
• Bewijs — leveranciersdemo's, geen onafhankelijke benchmark, tegenover een Artificial Analysis Intelligence Index van 29,7 met 94,1 op GPQA Diamond en 82 op lang-contextrecall, onafhankelijk van Google vermeld
Wat Gemini 3.1 Pro waard is om te hebben
De reden om een model als dit erbij te houden, is dat perceptie moeilijk is en de meeste agents er slecht in zijn. Het gepubliceerde onafhankelijke profiel van Gemini 3.1 Pro is ongewoon: 94,1 op GPQA Diamond is een resultaat dat de frontier nadert, 82 op long-context recall is het op een na beste cijfer in de set modellen die wij vermelden, en 58,7 op SciCode zet het bovenaan die specifieke ranglijst. Waar het niet uitblinkt, is agentische besluitvorming — een τ²-Bench-score van 95,6 is respectabel, maar de τ-banking slice, degene die meerstaps toolgebruik tegen de systemen van een bank meet, komt uit op 21,4. Allemaal zijn het metingen van derden die in onze catalogus bij hun bron staan vermeld, geen cijfers van de leverancier, en dat is de reden waarom ze meer waard zijn dan een lanceringspresentatie.
De andere helft van dat verhaal per verzoek is dat het model niet gratis is. Het ging in februari in preview, maanden voordat de huidige frontier werd uitgebracht, en het is geprijsd boven de goedkope tier: $2,00 en $12,00 per miljoen tokens is ongeveer $0,0006 aan input per pagina dichte tekst, wat niets voorstelt totdat je een video-ingest over een bibliotheek draait, en dan is het een kostenpost. Het lezen van een videoframe kost hetzelfde als het lezen van een alinea, en het model factureert je met alle plezier voor beide.

Twee kostenmodellen die weigeren te converteren
De kosten van een dot bestaan uit een abonnement met een niet-gepubliceerd gebruiksquotum: de eerste is inbegrepen bij Pro of Business Premium, in de eerste maand gelden verruimde limieten, gesprekken met je dot doen geen beroep op de gebruikslimieten van ChatGPT, en er is geen gepubliceerde prijs voor een tweede dot, voor extra snelheid of capaciteit, of voor een voltooide taak. In CNBC's verslag van de keynote prijst Sarah Friar de nieuwe Pro 500-tier van $500 als een gebruiksquotum plus de Ultrafast-modus, in plaats van als een tarief per dot, dus ook het duurste abonnement op het overzicht van OpenAI levert geen kosten per eenheid agentwerk op.
Gemini 3.1 Pro zet alles om in tokens, inclusief de delen die geen tekst zijn. Audio, video en afbeeldingen worden als input gefactureerd, dus de kosten van een taak hangen af van hoeveel van de wereld je het model hebt laten bekijken — een nuttige eigenschap, omdat je die kunt meten, en een gevaarlijke, omdat het grootste getal op de factuur vaak precies het getal is waar niemand op had gerekend. Modelroutering helpt hier op een specifieke in plaats van generieke manier: met meer dan 200 modellen achter één sleutel tegen de lijstprijs van de provider zonder opslag, kunnen de dure multimodale leesstap en het goedkope vervolgwerk op verschillende modellen in dezelfde pijplijn zitten, en een tariefwijziging van Google komt dezelfde dag op je account terecht in plaats van bij verlenging.

Waar de twee samenwerken
De natuurlijke combinatie is een dot die coördineert en een multimodaal model dat waarneemt. Er komt werk binnen, een dot routeert het: alles wat bekeken of beluisterd moet worden, gaat naar Gemini 3.1 Pro voor een gestructureerde beschrijving, en die beschrijving gaat terug de workflow in, waar een planning of een regel erop kan reageren. De dot regelt het opvolgen; het model regelt het lezen. Door het zo op te splitsen blijven de dure modaliteitsaanroepen ook auditeerbaar, wat belangrijk is, want juist die verrassen mensen.
Op OrcaRouter wordt het model gerouteerd als google/gemini-3.1-pro-preview tegen de lijstprijs van de provider, doorgegeven met 0% opslag, naast de rest van de catalogus, met automatische failover tussen upstreamproviders wanneer er één degradeert en een routing-DSL om meerdere modellen in één aanroep te combineren. Het is de moeite waard om precies te zijn over wat dat niet omvat: dots staan niet in onze catalogus, er is geen endpoint voor, en er bestaat geen model-id om een verzoek naar te verwijzen. Als je de perceptielaag onder je eigen controle wilt — en een previewmodel van februari is precies het soort afhankelijkheid dat het waard is om in te perken — hoort het model achter je eigen endpoint en blijft de agent waar je die hebt gehuurd.
Welk werkwoord heeft jouw probleem nodig?
Als het werk erin bestaat naar iets te kijken of te luisteren en een antwoord te produceren, is Gemini 3.1 Pro het hulpmiddel en is een dot de verkeerde aankoop. Als het werk erin bestaat iets over meerdere applicaties heen af te ronden zonder dat je zelf aan het stuur zit, is een dot het hulpmiddel en geen enkele hoeveelheid multimodale input komt daarvoor in de plaats. De teams die dit goed doen, zetten beide in en houden de grens expliciet: waarneming op een model met verbruiksmeting dat je kunt meten, actie achter een product dat je kunt opzeggen.

Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
