
GPT-6.5 "Doug"-lek, gecorrigeerd: Doug is het basismodel van GPT-6 Astra
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleNIEUWGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenNIEUWQwen: Qwen3.8 Max (0902)2026-09-0240Intelligentie72Coderen
- anthropicNIEUWAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligentie69Coderen
De kortste lekcyclus die deze blog heeft bijgehouden duurde ongeveer twaalf uur. Op 7 september voorspelde de onafhankelijke modelanalist teortaxesTex dat het volgende vlaggenschip van OpenAI de naam GPT-6.5 zou krijgen, dat de interne codenaam de gerapporteerde pre-trainingrun "Doug" was, en dat het "iets anders zou zijn… niet alleen groter" — een verandering van aard, geen opschaling. Binnen ongeveer twaalf uur had hij het teruggenomen. Na onderzoek zegt teortaxesTex dat hij het verkeerde model aan de verkeerde naam had gekoppeld: "Doug" is geen toekomstige GPT-6.5. In zijn gecorrigeerde lezing is dat het basismodel van GPT-6 Astra — het vlaggenschip dat OpenAI op 3 september uitbracht voor $10 / $50 per miljoen tokens met een context van ongeveer 1,05 miljoen tokens, waarvan het standaardniveau op 5 september algemeen beschikbaar werd. De gigantische pre-trainingrun waar de geruchtenmolen in augustus achteraan joeg, was volgens deze lezing het fundament onder datgene wat al in productie is.
Deze pagina is een "wat we weten"-tracker, dus de labels moeten meebewegen met de correctie. GPT-6 Astra is echt, onafhankelijk gemeten en aanroepbaar; het codenaamverhaal eromheen niet. teortaxesTex' vervolg is zijn eigen verslag van wat hij heeft geleerd, geen verklaring van OpenAI, en er is geen artefact voor "Doug" verschenen — geen identificatie, geen vermelding in de modelkiezer, geen vermelding in de cloudcatalogus — onder welke interpretatie dan ook. Wat de correctie oplost, is een verkeerde lezing die de eerdere versie van dit bericht herhaalde. Lees wat volgt als een geruchtenspoor dat zichzelf corrigeert, waarbij elke bewering nog steeds herleidbaar is tot genoemde of anonieme accounts en niet tot OpenAI.
De bewering en de correctie
Strikt genomen had de originele post van teortaxesTex drie onderdelen: het volgende OpenAI-model zal het nummer GPT-6.5 dragen; de codenaam is Doug; en het vertegenwoordigt een verandering in aard in plaats van een schaalvergroting. De eerste twee onderdelen waren naamgevingshypothesen die aansloten bij de bestaande berichtgeving over codenamen. Het derde is het onderdeel dat de post deed rondgaan, omdat het verder reikte dan 'wanneer' — de vraag waar de rest van de geruchtenmolen over twistte — en een uitspraak deed over 'wat'. Een opvolger die anders is in plaats van groter, zou niet alleen OpenAI's positie op de onafhankelijke ranglijsten resetten; het zou veranderen wat de volgende generatie van de grens is.
Zijn vervolgbericht trekt het grootste deel daarvan in, en de correctie heeft zelf drie onderdelen. Ten eerste is "Doug" het basismodel van GPT-6/Astra — geen apart, groter model dat in de coulissen wacht, maar de pre-training run waarop het al uitgebrachte Astra is gebouwd. Ten tweede is "Bel", de vermeende opvolger met 10 biljoen parameters — in zijn woorden — "insider-bro-onzin". Ten derde is de pre-training run die werkelijk wijst naar wat na Astra komt, naar zijn zeggen "misschien minder dan twee maanden geleden" gestart, onder een andere codenaam die niemand heeft gemeld. Alledrie zijn uitspraken van teortaxesTex over wat hij vond, in dezelfde trant als het oorspronkelijke lek: nuttig als signaal over waar de geruchtenlijn staat, waardeloos als document. Niets daarvan is een bevestiging van OpenAI, en hij voegt eraan toe dat dit in zijn ogen niet veel verandert — het strategische punt van het oorspronkelijke bericht, zo zegt hij, overleeft de naamsverandering. Dat is het deel dat hieronder het testen waard is.
Waar de "Doug"-lezing vandaan kwam — en hoe deze werd gecorrigeerd
De lezing over het toekomstige model begon niet met teortaxesTex, en het is de moeite waard om precies te zijn over de oorsprong ervan, omdat de eerdere versie van dit bericht erop leunde. Op 7 augustus publiceerde onderzoeksbureau SemiAnalysis een memo — gedateerd 9 juli — waarin institutionele klanten werd verteld dat OpenAI "hun pre-trainingproblemen had overwonnen" en dat "een veel groter model met de codenaam 'Doug' actief in de maak is." Twee dagen later vulde het X-account ChrisGPT de details in: Doug was niet hetzelfde model als GPT-6 (waarvan de meeste accounts aannamen dat het Astra was), het was OpenAI's grootste pre-trainingproject tot nu toe, en het zou al in november kunnen verschijnen. Op basis van die twee rapporten werd "Doug" de naam voor een grote, afzonderlijke lancering aan het einde van het jaar.
De lezing dat Doug in plaats daarvan de basis onder Astra is, is ook niet nieuw — en dat is de sterkste reden om de correctie van teortaxesTex als meer dan een bevlieging te beschouwen. Een marktnotitie van Samsung Securities van 10 augustus, een maand voor zijn vervolgpost, vermeldde al de correctie die in de gemeenschap circuleerde: sommige accounts lazen Doug als een apart model dat na Astra zou verschijnen, aldus de notitie, maar er werd "ook gecorrigeerd dat Doug het pre-trainingsmodel is dat als basis van Astra dient", met de kanttekening dat de exacte relatie onbevestigd bleef. De berichtgeving uit het Bel-tijdperk was op hetzelfde punt verdeeld: het anonieme account @synthwavedd beschreef in zijn bericht van 25 augustus een voltooide run genaamd "Bel", die volgens sommige navertellingen de opvolger van Doug was en volgens andere "waarschijnlijk de basis voor GPT-6". De stamboom was nooit consistent tussen de accounts. De vervolgpost van teortaxesTex kiest simpelweg de kant die de Samsung Securities-notitie al had genoteerd en laat de Bel-laag volledig weg.

Lees de correctie door: de SemiAnalysis- en ChrisGPT-rapporten volgden een run in de eindfase, niet een toekomstig project. Een basismodel dat begin juli 'actief in ontwikkeling' is, dat een veiligheidsbeoordeling in augustus doorstaat en dat op 3 september als product wordt uitgebracht, is een basismodel waarvan de pre-training maanden eerder was afgerond — met de zomer besteed aan reinforcement learning, alignment en de uitrolpauze die volgde op Astra's 'Critical'-classificatie voor cyberbeveiliging onder OpenAI's eigen Preparedness Framework. Die tijdlijn past bij Doug-als-Astra's-basis. Hij past niet bij Doug-als-novemberlancering. Als teortaxesTex gelijk heeft, behoorde het novembervenster toe aan een verkeerd gelezen run, en had de berichtgeving die een aparte, grotere Doug beloofde simpelweg het verkeerde object op het oog.
Wat overleeft de correctie
De strategische these overleeft in een geherformuleerde vorm. Het onderliggende argument van SemiAnalysis — dat de verbeteringen van OpenAI sinds GPT-4o grotendeels voortkomen uit post-training, reinforcement learning en inference-time rekenkracht op een oudere basis, en dat die opbrengsten afnemen zonder een beter fundament — is onafhankelijk van welke codenaam dat fundament droeg. Als Doug de basis van Astra is, dan is de door de memo voorspelde reset van het basismodel al gebeurd en al uitgerold: GPT-6 Astra is het eerste product van herstarte en gecorrigeerde pre-training, niet nog een polijstbeurt van het brein uit het GPT-4o-tijdperk.
Dat maakt het gemeten resultaat interessanter, niet minder. Het eerste product van de reset is niet de wereldtopper die de berichtgeving over de "grootste aardappel" beloofde. Op de Intelligence Index van Artificial Analysis scoort GPT-6 Astra (max) 61 — ongeveer achtste van meer dan 200 modellen — terwijl Claude Fable 5.1 de ranglijst aanvoert met 66. Als dat is wat een herstarte basis vandaag oplevert, dan was "anders, niet alleen groter" nooit een beschrijving van wat Astra al is; het was een hoop over wat de volgende basis — de run die minder dan twee maanden geleden begon onder een niet-bekendgemaakte codenaam — uiteindelijk zal voortbrengen. De energie van de oorspronkelijke lek hoort bij die toekomstige run, niet bij de codenaam waar iedereen over discussieerde.

Als de correctie standhoudt, volgen er nog twee implicaties, en beide verdienen het om als gevolgtrekking te worden geformuleerd, niet als feit. Ten eerste: de draad van “de opvolger komt zeer binnenkort” — Sam Altmans Axios-opmerking dat “er zeer, zeer, zeer binnenkort veel capabelere modellen komen,” en het rondgaande fragment waarin hij zei dat het model dat OpenAI “onlangs zei te pauzeren” “een toekomstig model” was — kan niet over de nieuwe pre-trainingrun gaan; een run die half juli is begonnen, is in september geen product. Als er inderdaad binnenkort een opvolger uitkomt, zal dat een post-getraind product van de Doug/Astra-basis zijn, niet de nieuwe basis zelf. Ten tweede: “Bel” was altijd het deel van het verhaal dat het meest blootstond aan precies dit soort wegwuiven, en dat is het onderwerp van de volgende sectie.
Waarom "Bel" de zwakste schakel was
Het Bel-rapport van het anonieme account @synthwavedd van 25 augustus had de schijn van een groot lek: OpenAI zou een enorme pre-training run van meer dan 10 biljoen totale parameters hebben 'afgerond', die werd omschreven als de opvolger van Doug en, volgens sommige lezingen, als de basis voor de GPT-6-generatie. Maar de inhoudelijke basis ontbrak. Het was terug te voeren op één enkele anonieme post; er verscheen nooit een tweede bron, geen identificatie, geen picker-entry en geen cloud-listing; en de navertellingen spraken elkaar tegen over de meest basale vraag of Bel vóór of na Doug kwam — een teken dat het account geen vast referentiepunt had. De tijdlijn was bovendien op het eerste gezicht al incoherent: een basismodel kan niet eind augustus de pre-training 'afronden' en tegelijk de basis vormen van een model dat al was gebouwd, aan een veiligheidsreview onderworpen en klaargemaakt voor de lancering op 3 september.
De afwijzing van teortaxesTex — "insider-bro-onzin" — is directer dan de berichtgeving ooit was, maar wijst op hetzelfde bewijs. De eerdere explainer van de blog over de opvolger wees in de week dat het rapport uitkwam al op de inconsistentie tussen Bel en Doug, en de explainer over de lancering van Astra bevatte dezelfde waarschuwing. Wat de correctie toevoegt, is een reden om geen voorbehoud meer te maken: als de echte pre-training van de opvolger minder dan twee maanden geleden begon onder een codenaam waarover niemand heeft bericht, dan was het verhaal over de "voltooide Bel van 10 biljoen parameters" niet alleen onbevestigd — het beschreef iets dat, op de gecorrigeerde tijdlijn, niet had kunnen bestaan.
Wat zou het beslechten?
De checklist is ongewijzigd, en de correctie verhoogt de lat in plaats van die te verlagen. Elke OpenAI-leakcyclus die deze blog heeft gevolgd, liet vóór de aankondiging een verifieerbaar object achter — de gpt-6-astra-identifier in de clientcode van Codex, de Sol/Terra/Luna-namen in de modelkiezer van GPT-5.6, de Azure- en Bedrock-catalogusvermeldingen vóór Astra. Niets in het Doug-verhaal heeft ook maar iets van dat alles opgeleverd, en de correctie verandert daar niets aan: zelfs als Doug het basismodel van Astra is, blijft de naam een interne aanduiding die nog nooit door enig artefact is bevestigd. Wat de gecorrigeerde lezing zou bevestigen, is een verklaring van OpenAI, een systeemkaart die het basismodel noemt, of een insidersverslag met een document — geen van die drie bestaat. Totdat een van deze drie er is, is het juiste label voor “Doug is het basismodel van GPT-6 Astra”: de analist die Doug aanvankelijk GPT-6.5 noemde, zegt dat nu; een maand oude onderzoeksnotitie legde dezelfde correctie vast binnen de community; en OpenAI heeft niets gezegd.
De planningsvraag is waar de correctie het hardst aankomt. Als de werkelijk volgende pre-training run pas twee maanden oud is en naamloos, dan was elke datum die in de berichtgeving aan 'Doug' werd gekoppeld — het novembervenster van ChrisGPT, de 'zeer binnenkort'-verwachtingen rond een opvolger — gekoppeld aan de verkeerde run. Wat een lezer echt kan vertrouwen is beperkter: OpenAI heeft Astra uitgebracht, directieleden hebben gezegd dat er capabelere modellen komen, en de volgende reset van het basismodel staat kennelijk voor de deur. Niets daarvan is een releasedatum, en het eerlijke standpunt is dat de klok van de opvolger begint te lopen zodra een identificatie of een aankondiging verschijnt — niet wanneer een leaker een codenaam noemt.
Wat te doen terwijl het verhaal tot een ontknoping komt
Geen van de beslissingsrelevante feiten verandert bij een correctie, want de modellen die er zijn, zijn de modellen die je kunt aanroepen. GPT-6 Astra is live, gebenchmarkt en beschikbaar via de eigen API van OpenAI en ChatGPT-abonnementen — en op OrcaRouter tegen de lijstprijs van OpenAI, $10 / $50, met de context van ~1,05M tokens die tegen providerprijzen en zonder opslag wordt doorgegeven. Als je nu een second opinion over de frontier wilt, voert Claude Fable 5.1 de onafhankelijke index aan, en GPT-5.6 Sol blijft voor werk met lange contexten de bewezen goedkopere OpenAI-route.

De nuttige voorbereiding is dezelfde als die vóór de correctie was, want de onzekerheid is niet kleiner geworden — die is alleen verplaatst. Een pass-through-router maakt dat welke opvolger er ook daadwerkelijk verschijnt, aanroepbaar is via de sleutel die je al gebruikt, tegen de eigen catalogusprijs van de leverancier, op dezelfde dag dat hij in een providercatalogus verschijnt: geen tweede contract, geen herschrijving, en de prijswijziging is live zodra de leverancier hem plaatst. En omdat een gloednieuw basismodel precies het soort onbewezen ding is waar je een productiepad niet op wilt vastpinnen voordat het een belastingstest heeft doorstaan, is automatische failover de eerlijke manier om het uit te proberen: zet de productie vast op het model dat je hebt gevalideerd, stuur een schaduwdeel van het verkeer naar de nieuwkomer en laat echte verzoeken beslissen. Als de gecorrigeerde lezing klopt en 'Doug' slechts het basismodel was onder een model dat je al kunt aanroepen, is er niets aan die opzet verspild; als de naamloze opvolger verschijnt, kost het volgen van de geruchtenmolen niets.
De eerlijke samenvatting van de correctie is een strakkere versie van de oorspronkelijke onzekerheid. teortaxesTex, de analist die Doug het label “GPT-6.5” had opgeplakt, zegt nu dat hij het mis had: Doug is het basismodel van de al uitgebrachte GPT-6 Astra; “Bel” was ruis; en de pre-trainingrun die ertoe doet is minder dan twee maanden oud en heeft geen naam — een interpretatie die een notitie van Samsung Securities een maand eerder al had opgetekend en die nog door geen enkel artefact of OpenAI-verklaring is bevestigd. Wat overeind blijft is het strategische punt, nu op het juiste doelwit gericht: OpenAI heeft de pre-training van het basismodel hervat, het eerste product staat achtste op de onafhankelijke index, en de run die bepaalt wat hierna komt, is nog maar net begonnen. De verdedigbare opstelling is ongewijzigd — blijf het gevalideerde model aanroepen, houd de optie open om de volgende release te omzeilen, en behandel een aankondiging, niet een codenaam en niet een correctie, als de enige planning die telt.
Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
