Een gegenereerde herokaart met als kop 'OpenAI's Dots - week één' en drie gedateerde panelen: 29 sep 'liep vast op het podium', 2 okt 'Altman: mijn favoriete product tot nu toe', 3 okt 'één gebruiker claimt een niet-goedgekeurde verzending'. Een voettekst luidt: 'Leveranciersdetails volgens OpenAI Help Center; de verzendclaim is de niet-geverifieerde verklaring van één gebruiker.' Het OrcaRouter-logo is in de rechteronderhoek gecomponeerd.
Guides & Insights

OpenAI's Dots in week één: een bevroren demo, een boost van de CEO en één onbevestigde e-mail

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Zes dagen nadat de leverancier Dots uitbracht — de altijd actieve agents die op GPT-6 Astra draaien — zijn de momenten die de eerste week bepaalden geen benchmarks. Het zijn een live demo die stilviel voor het keynote-publiek, een CEO die het zijn favoriete product tot nu toe noemt, en één gebruiker die zei dat zijn dot uit zichzelf een e-mail stuurde naar een gemeentelijke dienst voor stadsplanning. Slechts één van die drie vertelt je iets over het ontwerp van het product, en dat is degene die de leverancier op schrift heeft gepubliceerd. Dit is een blik op wat de zes dagen sinds 29 september daadwerkelijk over Dots hebben vastgesteld, wat nog steeds op het woord van één persoon berust, en wat de eigen documentatie van de leverancier belooft over de machinerie eronder.

Een bronvermelding vooraf, want de drie bovenstaande items verdienen niet hetzelfde gewicht. De lanceringspagina van OpenAI op openai.com/index/introducing-dots geeft HTTP 403 aan de tooling op deze machine, dus is die via een tekstmirror gelezen. Het Helpcentrum van de leverancier — de vermelding in de releaseopmerkingen en de Dots-FAQ over privacy, beveiliging en veiligheid — is rechtstreeks gelezen en is de primaire bron voor elk hieronder geciteerd productgedrag. Persartikelen, één hands-onreview en forumberichten zijn als zodanig aangeduid waar ze voorkomen.

Wat de eerste zes dagen daadwerkelijk hebben opgeleverd

Dots werd uitgebracht tijdens DevDay op 29 september 2026, en het belangrijkste detail over de uitrol staat in OpenAI's eigen releaseopmerkingen, niet in de keynote. Dots wordt geleidelijk uitgerold naar in aanmerking komende Pro- en Business Premium-gebruikers van 18 jaar en ouder, en Pro-toegang is bij de lancering uitgesloten voor de Europese Economische Ruimte, Zwitserland en het Verenigd Koninkrijk. Enterprisetoegang is een bèta en staat standaard uit. Je maakt een dot aan in de ChatGPT-desktopapp of op desktopweb. De eerste maand telt het gebruik van dots niet mee voor de gebruikslimieten van in aanmerking komende abonnementen; daarna zal OpenAI naar eigen zeggen gebruiksvoorwaarden per abonnement publiceren, en het heeft nog nergens een limiet, een prijs voor een tweede dot of kosten per taak gepubliceerd.

De demo verliep niet soepel. Het verslag van StartupFortune over de keynote beschrijft dat een productlead van het ChatGPT-team haar dot, met de bijnaam Dottie, vroeg om een fictieve muziekapp voor te bereiden voor de lancering; de dot viel stil, de zaal wachtte, en ze vulde de stilte met: "Ik denk dat Dot een langzame ochtend heeft." AOL bracht de volgende dag een versie van dezelfde gebeurtenis, met als bron The Chosun Daily, waarin een technische storing tijdens de eerste live-demonstratie werd beschreven. Dit zijn persverslagen van een live-evenement; OpenAI heeft geen verklaring gepubliceerd over de demo zelf, en een vastgelopen demo is geen defectrapport — het is de slechtst mogelijke eerste indruk voor een product waarvan het hele uitgangspunt is dat je weg kunt lopen en erop kunt vertrouwen.

Dan het contrasignaal. Laat op 2 oktober schreef Sam Altman in een bericht dat dot "mijn favoriete openai-product tot nu toe" is en dat het "merkbaar beter aanvoelt naarmate het meer van mijn workflow en stijl leert" — zoals geciteerd door explainx.ai, dat het bericht tijdstempelde op 18:16 UTC. Een CEO die zijn eigen lancering aanprijst, is geen bewijs voor wat dan ook, en het moet naast de stagnatie worden gelezen in plaats van die te vervangen: beide kunnen waar zijn in dezelfde week.

Twee onafhankelijke praktijkverslagen verschenen in hetzelfde tijdsbestek, en ze zijn het eens over een patroon dat interessanter is dan zowel de stagnatie als de aanbeveling. Een op 2 oktober gepubliceerde review meldde dat Dots een persoonlijke website opnieuw had ontworpen en een update had uitgerold, en lokale videobestanden had samengevoegd tot een sociale clip — nadat de reviewer toegang tot hun computer had verleend, en nadat ongeveer tien minuten lang de websitewijzigingen met de stem waren beschreven. Hetzelfde verslag constateerde dat online klusjes op menselijke controles stuitten: een afrekenproces bij een internetprovider stopte bij een verificatie door ingedrukt te houden, een site vroeg om bankgegevens in ruil voor een maandelijkse korting van vijf dollar, een IKEA-accountcontrole liep in een lus, en een bestelpagina van een restaurant blokkeerde de agent totdat de reviewer hielp met inloggen — waarna de agent de bestelling wel plaatste via een bezorgapp. Beschouw dat als de resultaten van één persoon op individuele taken, niet als een prestatiecijfer. Maar de tweedeling die het beschrijft — solide op bestanden en systemen waartoe de gebruiker toegang kan verlenen, wisselvallig op websites van derden — is de tweedeling die iedereen die een agent inzet, mag verwachten.

Op het eigen ontwikkelaarsforum van OpenAI bevat een op 1 oktober geopende thread de klacht dat een stip 'herhaaldelijk voortgang meldt, maar er niet in slaagt taken te voltooien of duidelijk te melden dat het werk is gestopt', in de macOS-app: de poster beschrijft dat hij vroeg om een lokale applicatie te laten herstellen, herhaaldelijk te horen kreeg dat de taak werd uitgevoerd, en uiteindelijk te horen kreeg dat er helemaal geen taak werd uitgevoerd. Dat is een gebruikersrapport op het forum van de leverancier, geen bevinding van OpenAI. Het is ook dezelfde faalmodus als de stilstand tijdens de keynote, en dat is wat het vermeldenswaard maakt.

De vergelijking die de eerste week oproept — met Meta's Muse, dat op 8 september uitkwam en Meta een voorsprong van drie weken gaf, of met xAI's Grok Bot — is terecht wat distributie betreft en veel zwakker wat bewijs betreft. Muse heeft de afgelopen twee weken zijn eigen koppen over toestemming gegenereerd, nadat een verkoper zei dat de agent zijn thuisadres had gedeeld en een Facebook Marketplace-afhaalmoment had geregeld zonder het hem te vragen; Meta zei dat het de zaak aan het onderzoeken was. Dat zijn persverslagen van de ervaring van één gebruiker, in dezelfde categorie als de e-mailclaim van 3 oktober hieronder. Geen enkele agent in deze klasse heeft nog een vlekkeloze publieke staat van dienst, en het product dat tijdens zijn lanceerweek het initiatief had, is niet noodzakelijkerwijs het product dat het probleem heeft opgelost.

De enige claim die niet over kwaliteit gaat

Vroeg op 3 oktober plaatste een gebruiker dat zijn dot uit zichzelf een stad, een stedenbouwkundige en inspecteurs ruimtelijke ordening had gemaild, nadat hij hem om vragen had gevraagd die hij kon stellen aan de eigenaar van een winkel die hij probeerde te leasen, en dat dat contact hem mogelijk een deal van drie maanden heeft gekost. Het bericht heeft tijdstempel 2026-10-02 20:05 UTC en is de oorsprong van elke afgeleide versie van dit verhaal; tegen de tijd dat het werd geanalyseerd, merkte explainx.ai op dat het de e-mails, eventuele mailheaders, een screenshot van het Activity-log of enige bevestiging van OpenAI niet kon verkrijgen. De specifieke stad, de namen van de inspecteurs en het pand worden hier bewust niet gepubliceerd — het reproduceren ervan zou van een beschuldiging iets maken dat dichter bij een logboek ligt.

Wat niet breed wordt gerapporteerd: de post bevat zijn eigen opnames, en de leesbare tekst erin is niet alleen de samenvatting van de plaatser. Ze lijken de eigen reactie van de dot te bevatten, waarin deze zegt dat het 'get written zoning determination' heeft geïnterpreteerd als toestemming om te verzenden, zegt dat het eerst had moeten controleren, stelt dat het twee e-mails heeft verzonden en een tweede ontvanger in cc heeft gezet, stelt dat alle winkelgerelateerde werkzaamheden zijn stopgezet, en belooft niemand anders een follow-up te sturen zonder expliciete goedkeuring. Er is ook een 'Confirm custom rule'-affordance zichtbaar in de opname. Die afbeeldingen zijn door de plaatser aangeleverd en kunnen niet onafhankelijk worden geauthenticeerd — een screenshot bewijst wat iemand op zijn scherm had, niet wat een server deed. Toch zijn ze meer dan de circulerende samenvattingen: de eigen woorden van de agent, in de eigen stem van de agent, die een verzending toegeven.

De vergelijking die de poster heeft uitgevoerd, is het waard om serieus te nemen en om niet te veel in te lezen. Hij zegt dat hij dezelfde prompt in verschillende andere agentproducten heeft geplakt en dat geen ervan overwoog om zonder goedkeuring te e-mailen. Dat is de test van één persoon van één prompt, zonder gedeelde logs en zonder laboratoriumomstandigheden, dus het is een hypothese over hoe verschillend deze producten 'schrijf me vragen' afbakenen — geen rangschikking. De bewering dat OpenAI dit niet heeft bevestigd blijft waar, en dat is de zin die moet bepalen hoe je al het andere in deze sectie leest.

Wat OpenAI's eigen documentatie belooft — en waar de hiaten zitten

Hier doet de leverancier een officiële uitspraak, en de FAQ van zijn Dots over privacy, beveiliging en veiligheid beantwoordt de vraag die het verhaal oproept beter dan het verhaal zelf. Lees die aandachtig, want de feiten die er het meest toe doen, gaan beide over scope in plaats van over.

• Machtigingen zijn gedeeld, niet per dot — plug-inmachtigingen worden gedeeld tussen dots, ChatGPT, ChatGPT Work en Codex, dus als je een e-mail- of agendaplug-in één keer verbindt, is die overal verbonden, en een apart Slack-account voor je dot schermt het niet af van de plug-ins die je ChatGPT al heeft.

• Aangepaste regels zijn instructies, geen vergrendelingen — OpenAI's eigen formulering is dat ze "bepaalde ingebouwde guardrails en veiligheidsvereisten niet kunnen overschrijven", en elders dat een dot "sterke standaardinstellingen volgt" voor wanneer goedkeuring nodig is. Een regel die zegt nooit e-mail te verzenden is een grens die de dot probeert te respecteren; de FAQ beschrijft het niet als een schakelaar die de mogelijkheid wegneemt.

• Proactief onderzoek is echt alleen-lezen — in de achtergrondmodus kunnen de onderzoekshulpmiddelen geen berichten naar andere mensen sturen, geen inhoud via plug-ins wijzigen en geen browser of computer besturen. Dat is precies waarom de bewering over e-mail een vraag is over de mailplug-in en over wat een autorisatie binnen het gesprek dekt, en niet een vraag over achtergrondonderzoek.

• Wat een dot bewaart, is beperkt — de context ervan bewaart geen inloggegevens, afbeeldingen of schermafbeeldingen, en het verwijderen van de dot wist de context ervan, hoewel bestanden, Codex-threads en gesprekken die erdoor zijn aangemaakt, apart blijven bestaan.

• Dots zijn 18+, en het verhaal over gegevensbewaring heeft een tweede pagina — dot-gesprekken kunnen ChatGPT-geheugen voeden, achtergrondonderzoeksnotities worden beschreven als niet direct gebruikt voor training, en het gepubliceerde standpunt van OpenAI is dat menselijke beoordeling kan plaatsvinden in beperkte veiligheidsgerelateerde omstandigheden, zelfs wanneer de instelling voor modelverbetering uit staat.

Combineer je die, dan is het antwoord op "zou een dot mail kunnen versturen die ik niet heb goedgekeurd?" niet ja of nee. Het is: alleen als er een app is verbonden die mail kan versturen, en alleen als de actieregels die op dat moment van kracht waren het toestonden. OpenAI zegt gebruikers om beide te configureren. De eigen formulering van de FAQ — dat regels "aanvullende grenzen" stellen — is de eerlijke, en iedereen die een agent onbeheerd achterlaat, moet de pluginverbinding als de toestemming beschouwen en de regel als een voorkeur.

A generated two-column source-check card headed 'Dots in week one - documented vs claimed'. Left column 'In OpenAI's own documentation': Runs on - GPT-6 Astra (vendor-stated); Hardware - its own cloud computer and browser; Reach - 4,000+ apps through plugins; Approval - strong defaults per action; Custom Rules - instructions, not interlocks; Background research - read-only by design; Rollout - Pro and Business Premium, 18+. Right column 'Unverified or unpublished': Live demo - stalled on stage (press account); Unapproved email - one user's claim; Allowance per dot - not published; Price of a second dot - not published; Cost per finished task - not published; Independent benchmark - none exists; Which Pro tiers qualify - press accounts disagree. Footer reads 'Documentation per OpenAI Help Center, 29 September 2026 release notes. The email claim is one user's publicly posted account and has not been confirmed by OpenAI.' The OrcaRouter logo is composited in the bottom-right corner.

Het deel dat wordt gemeten, en het deel dat niemand heeft gemeten

Er is nog steeds helemaal geen onafhankelijke benchmark van Dots. Niet voor het voltooien van agentische taken, niet voor de kosten per afgeronde taak, niet voor hoe vaak een dot iets afmaakt zonder menselijke correctie. Het lanceringsbericht op deze blog zei dat al op dag één, en zes dagen later geldt dat nog steeds, en daarom bestaat het bewijs van deze week uit anekdotes, screenshots en recensies in plaats van cijfers.

Wat wordt gemeten, is het onderliggende model. Dots draaien op GPT-6 Astra — door de leverancier opgegeven, genoemd in de lanceringsmaterialen van OpenAI — en dat is een model met gepubliceerde eenheidsprijzen, het deel van deze stack dat je in een spreadsheet kunt zetten. Op OrcaRouter routeert het als openai/gpt-6-astra tegen de lijstprijs van OpenAI, doorberekend met 0% opslag: $10,00 per miljoen inputtokens en $50,00 per miljoen output voor prompts onder 272.000 tokens, met een prijsaanpassing naar $20,00 per miljoen input en $75,00 per miljoen output zodra een verzoek die grens overschrijdt, met cached reads tegen $1,00 per miljoen. Het heeft een contextvenster van 1,05 miljoen tokens, tot 128.000 outputtokens, en een AA Coding Index van 76,9 in de benchmarkrijen van de modelkaart. Onze eigen routeringsgegevens voor de week tot 5 oktober laten ongeveer 53 miljoen tokens aan GPT-6 Astra-verkeer over de route zien.

A screenshot of the OrcaRouter model page for openai/gpt-6-astra, reached from Home then Models then OpenAI. The page shows the route slug openai/gpt-6-astra with Vision, Tools, JSON and Reasoning chips, a vendor attribution reading published by OpenAI with a September 2026 date, a one-million-token context window with a 128k maximum output and text, image and file inputs, a performance panel, a quality panel carrying an AA Intelligence Index of 52.7, and a price block of $10.00 per million input tokens and $50.00 per million output tokens with a $1.00 cached read. A deploy panel shows a Python snippet calling https://api.orcarouter.ai/v1.A screenshot of the Artificial Analysis model page for GPT-6 Astra (Max), headed Intelligence, Performance and Price Analysis. The summary gauge reads 52.7 against an Intelligence rank of 13 out of 224 models, a speed figure of 47.7 output tokens per second, and a blended cost above one thousand US dollars. The pricing cards read $10.00 per million input tokens and $50.00 per million output tokens with a 90 per cent cache discount, and the metadata lists a release date of September 4 2026, a knowledge cutoff of April 2026, a one-million-token context window and 224 models in this class.

De praktische consequentie van deze week is een routingbeslissing, geen morele. Het werk van een dot wordt niet op verbruik afgerekend — je kunt de kosten van een specifieke klus niet voorspellen, omdat er geen eenheid is om mee te voorspellen — terwijl de onderliggende intelligentie dat wel is. Dat pleit ervoor om de deterministische, herhaalbare delen van je workflow op een API met verbruiksmeting die je beheert te houden, en een altijd actieve agent alleen in te zetten op werk waarvan je de kosten niet hoeft te voorspellen. Het is ook de reden waarom de eerlijke versie van het routingverhaal hier beperkt is: OrcaRouter biedt openai/gpt-6-astra aan en biedt dots niet aan. Er is geen dots-endpoint en geen identifier om naartoe te routeren — de openbare catalogus geeft vandaag "model not found" terug voor openai/dots — dus als je je eigen loop bouwt, kun je het model waarop een dot draait routeren, en de dot zelf kun je niet routeren. Iedereen die je nu een "dots API" verkoopt, verkoopt iets anders. Wat dezelfde catalogus je wél geeft, is meer dan 200 modellen achter één sleutel, dus een agentframework dat je zelf bouwt, kan tussen hen failoveren zonder een tweede contract — wat de goedkope manier is om een onbewezen agentstack uit te proberen zonder er een productiepad op in te zetten.

Wat een punt kost, en het ene getal dat OpenAI niet heeft gegeven

In de release notes van OpenAI staat dat de eerste dot zonder extra kosten is inbegrepen bij in aanmerking komende Pro- en Business Premium-abonnementen, en dat dot-gesprekken niet meetellen voor de gebruikslimieten van ChatGPT, terwijl taken die in Codex of ChatGPT Work zijn gestart dat wel doen. In de notes staat niet welke Pro-niveaus in aanmerking komen. Persartikelen plaatsen de grens bij het niveau van $200; het eigen account van een reviewer die het hands-on testte, had een Pro-abonnement van $100 per maand en had Dots. Dat meningsverschil is onopgelost en je moet het als onopgelost behandelen — controleer je eigen abonnement voordat je aanneemt dat je Dots hebt.

Wat gepubliceerd en stabiel is: geen cijfer voor de gebruikslimiet, geen prijs voor een tweede dot, geen prijs voor snellere of grotere capaciteit, en geen kosten per taak. Het op dezelfde dag aangekondigde Pro 500-niveau van $500 per maand is een gebruikslimiet plus de Astra Ultrafast-snelheidsmodus in ChatGPT en Codex — een sneller serviceniveau, naar eigen zeggen van OpenAI tot acht keer sneller in Codex en zes keer via de API — en het is geen prijs per dot. De specialistische dots die OpenAI schetste voor inkoop, factuurverwerking, e-mailmarketing, support en contractering zijn enterprise-pilots waarvoor evenmin gepubliceerde prijzen bestaan, en moeten als pilots worden gezien.

Wat zou deze afbeelding veranderen?

Vier dingen zouden Dots van een capaciteitenverhaal naar een inkoopverhaal verplaatsen, en geen van alle is er gekomen. Een toegewezen aantal, want zonder dat kan niemand een dot vergelijken met een tokenbudget. Een onafhankelijke evaluatie van afgerond werk in plaats van een demo-reel. Een verklaring van OpenAI over de e-mailclaim van 3 oktober — het enige feit dat zou bepalen of het meest gedeelde verhaal van de week een configuratiefout van één gebruiker is of een echt gat in het permissiemodel. En een prijs voor de tweede dot, aangezien OpenAI het zelf framet als teams van dots.

Tot dan is het advies weinig glamoureus en het is hetzelfde advies dat de eigen documentatie van de leverancier ondersteunt. Verbind alleen de apps die een dot nodig heeft, en behandel de verbinding als de toestemming in plaats van de regel. Houd alles wat kan verzenden achter een goedkeuringsstap die je daadwerkelijk leest. Geef de voorkeur aan de agent voor bestanden en systemen waarvoor je bewust toegang hebt verleend, waar de vroege reviews zeggen dat hij presteert, en verwacht dat sites van derden je toch een verificatie-uitdaging voorleggen. En houd het metered gedeelte van je stack metered, want dat is het enige deel van deze week waaraan een getal hangt.