GPT-6.5 Doug 文章的英雄标题卡片——「泄密观察」,带有「未经核实 · 尚未公布」徽章,眉题「目前已知信息」,主标题「GPT-6.5 Doug:不只是更大的模型」,副标题「一位独立分析师表示,OpenAI 的下一代旗舰产品将是一种全然不同的东西——不是 GPT-6 Astra 的简单放大版」,标签为「来源:X/@teortaxesTex」、「2026年9月7日」和「GPT-6 Astra 于9月3日发布」,卡片行展示「GPT-6 Astra — 已于9月3日发布」,旁边是虚线框的「Doug — 有报道 · 尚未公布」。OrcaRouter 标志合成在右下角。
Guides & Insights

GPT-6.5 "Doug" 泄露,更正:Doug 是 GPT-6 Astra 的基础模型

作者

Elias Hawthorne

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

本博客追踪到的最短泄露周期约为十二小时。9月7日,独立模型分析师teortaxesTex预测,OpenAI的下一款旗舰产品将被命名为GPT-6.5,其内部代号是此前报道的预训练运行“Doug”,并且它将“有所不同……不只是更大”——是种类上的变化,而非规模上的提升。大约十二小时内,他就收回了这一说法。经过调查,teortaxesTex表示他把错误的模型对应到了错误的名字上:“Doug”不是未来的GPT-6.5。在他修正后的解读中,它是GPT-6 Astra的基础模型——即OpenAI于9月3日发布的旗舰产品,定价为每百万token 10美元/50美元,上下文约105万token,其标准版于9月5日正式全面可用。按照这种说法,谣言工厂整个八月追逐的那个庞大预训练运行,正是已经投产之物的基础。

本页是一个“已知信息”追踪页面,因此标签必须随更正而调整。GPT-6 Astra 是真实存在的,经过独立测量且可调用;围绕它的代号说法则并非事实。teortaxesTex 的后续文章是他对自己所了解到的情况的个人叙述,并非 OpenAI 的声明,而且任何解读下都未出现“Doug”的相关工件——没有标识符,没有模型选择器条目,也没有云目录列表。此次更正解决的是本文早期版本重复过的一个误读。请将下文视为一条自我修正的传闻线索,其中每一项说法仍可追溯到具名或匿名账号,而非 OpenAI。

主张与更正

teortaxesTex最初的帖子,严格来看,包含三个部分:下一代OpenAI模型将编号为GPT-6.5;其代号是Doug;它代表的是一种性质上的改变,而非规模的提升。前两部分是与既有代号报道相吻合的命名假设。第三部分才是让这篇帖子不胫而走的原因——因为它越过了“何时”这一其他传闻圈子争论不休的问题,就“是什么”提出了论断。一个不同而非更大的继任者,不仅会重置OpenAI在独立排行榜上的位置,更将改变下一代前沿的本质。

他的后续帖子收回了之前的大部分说法,而这则更正本身也包含三个部分。第一,“Doug”是GPT-6/Astra的基础模型——不是蓄势待发的另一个更大独立模型,而是已发布Astra所由构建的那一轮预训练。第二,据传为10万亿参数继任者的“Bel”,用他的话来说,是“内部哥们的鬼话”。第三,真正指向Astra之后产品的那次预训练,是在“可能不到两个月前”开始的,使用的是此前无人报道的另一个代号。这三点都是teortaxesTex关于自己发现的陈述,与最初爆料属于同一层面:作为判断传言走向的信号颇为有用,作为文档则毫无价值。其中没有任何一条是OpenAI的证实,他还补充说,在他看来这些并不会改变太多——他是在说,原帖的战略要点不会因改名而失效。这正是下一部分值得检验的地方。

“Doug”读数从何而来——以及它是如何被纠正的

关于未来模型的解读并非始于teortaxesTex,而且有必要准确梳理其来源,因为本文的早期版本曾以此为依据。8月7日,研究公司SemiAnalysis发布了一份日期为7月9日的备忘录,告知机构客户:OpenAI已经“克服了预训练问题”,并且“一个代号为‘Doug’的更大规模模型正在积极开发中”。两天后,X平台账号ChrisGPT补充了更多细节:Doug与GPT-6(多数账号认为GPT-6就是Astra)并非同一个模型,它是OpenAI迄今为止规模最大的预训练项目,最早可能在11月问世。凭借这两份报道,“Doug”成了那个规模庞大、独立推进、定于年底问世的项目的代称。

将 Doug 解读为 Astra 的底层基础也并非新观点——这正是将 teortaxesTex 的更正视为非一时兴起的最有力理由。三星证券(Samsung Securities)8月10日的一份市场简报,就在其跟进帖发布前一个月,已经记录了社区中流传的这一更正:该简报称,一些账号将 Doug 解读为继 Astra 之后推出的独立模型,但“同样被更正为 Doug 是作为 Astra 基础的预训练模型”,同时指出两者之间的确切关系仍未得到证实。关于 Bel 时代的报道在同一问题上也存在分歧:匿名账号 @synthwavedd 8月25日的帖子描述了一次名为“Bel”的已完成训练,一些转述将其说成 Doug 的继任者,另一些则称其“可能是 GPT-6 的基础”。各账号对模型谱系的说法从未一致。teortaxesTex 的跟进帖只是站在了三星简报已经记录的立场上,并将 Bel 这一层完全剔除。

A generated infographic titled 'The Doug paper trail' showing five signal entries as stacked cards: 'Jul 9, 2026 — SemiAnalysis memo: OpenAI has overcome pre-training issues; a much larger model codenamed Doug actively in the works'; 'Dec 2025 — The Information: pre-training fixes validated in a model codenamed Garlic'; 'Aug 9, 2026 — X/@ChrisGPT: Doug is OpenAI's largest pre-training project yet, not the same as GPT-6, possible launch by November'; 'Aug 25, 2026 — X/@synthwavedd: finished pre-training run codenamed Bel, over 10T total parameters, described as Doug's successor'; and 'Sep 7, 2026 — X/@teortaxesTex: GPT-6.5 Doug will be something different, not just bigger'. Footer: 'All of the above is reported and unconfirmed — OpenAI has announced nothing.' The OrcaRouter logo is composited in the bottom-right corner.

阅读更正后,SemiAnalysis和ChrisGPT的报告追踪的是一个处于最后阶段的运行,而非一个未来项目。一个在七月初“积极推进中”的基座模型,通过了八月的安全审查,并于9月3日作为产品发布——这样的基座模型,其预训练早在数月前就已结束——夏天的时间则花在了强化学习、对齐,以及紧随Astra在OpenAI自家《准备框架》下获得“严重”网络安全评级之后而来的发布暂停上。这条时间线与Doug作为Astra的基座相符,却不符合作Doug作为十一月发布版本的说法。如果teortaxesTex是对的,那么十一月的时间窗口属于一次被误读的运行,而那些承诺会出现一个独立且更大的Doug的报道,只是看错了对象。

什么能在修正中幸存下来

这一战略论点在重构之后依然成立。SemiAnalysis 的根本论点——即 OpenAI 自 GPT-4o 以来的进展大多来自基于旧基座的后训练、强化学习与推理时计算,而若没有更好的基座,这些回报便会递减——与这一基座顶着哪个代号无关。如果 Doug 是 Astra 的基座,那么该备忘录所预言的基础模型重置已经发生,并且已经上线:GPT-6 Astra 是重新启动并修正后的预训练的第一个产物,而不是对 GPT-4o 时代大脑的又一次打磨。

这让实测纪录更有意思,而不是更没意思。重启后的首款产品,并非“最大的土豆”式报道所承诺的那种称霸全球之作。在 Artificial Analysis 的 Intelligence Index 上,GPT-6 Astra (max) 得分为61——在200多个模型中大约排名第八——而 Claude Fable 5.1 以66分位居榜首。如果这就是一个重启后的基座如今所能带来的成果,那么“不同,而不只是更大”从来就不是对 Astra 现状的描述;它是对下一个基座的期望——就是不到两个月前以某个尚未公开的代号启动的那一轮训练终将孕育出的东西。最初那场泄密的能量属于未来那一轮,而不属于每个人都在争论的那个代号。

A screenshot of the Artificial Analysis model page for GPT-6 Astra at maximum reasoning, showing the header 'GPT-6 Astra (max) — Intelligence, Performance & Price Analysis', an Intelligence ranking of #8 out of 202 models with a score of 61, input price $10.00 and output price $50.00 per 1M tokens, a cost-per-intelligence assessment calling it expensive relative to models of similar price, and a 1M-token context with an April 30, 2026 knowledge cutoff.

如果这一修正成立,还会产生两个进一步的影响,而这两点都值得作为推断而非事实来陈述。首先,“继任者很快到来”这条线索——萨姆·奥尔特曼在接受Axios采访时表示“能力更强、更强、强得多的模型即将到来”,以及流传的片段中他说OpenAI“最近讨论过暂停”的模型是“一个未来模型”——不可能指向刚刚开始的预训练运行;七月中旬才启动的训练不可能在九月份就变成产品。如果继任者真的很快落地,那它将是基于Doug/Astra基座的后训练产品,而非新基座本身。其次,“Bel”一直是整个叙事中最容易遭受此类否定的一部分,而这正是下一节的主题。

8月25日,匿名账户@synthwavedd发布的Bel报告,表面上像是一次重大泄露:OpenAI“完成”了一次巨大的预训练,总参数超过10万亿,据说这是Doug的继任者,并且在某些解读中,是GPT-6一代的基础。但它从未具备实锤。它源于一条匿名的帖子;从未出现过第二个信源、身份标识、picker条目或云列表;而且在Bel是出现在Doug之前还是之后这一最基本的问题上,各转述版本相互矛盾——这表明该账户没有一个固定的指涉对象。时间线表面上看也说不通:一个基础模型不可能在8月底“完成”预训练,同时又是一款已经构建完成、通过安全审查并准备在9月3日发布的模型的基础。

teortaxesTex的驳斥——“内部老兄的鬼话”——比任何报道都更为直白,但它指向的是同样的证据。该博客早先的继任者解读文章,在报告发布当周就指出了Bel/Doug之间的不一致,Astra发布解读也带出了同样的告诫。这次更正新增的是一个停止含糊其辞的理由:如果真正的继任模型预训练是在不到两个月前才开始,且使用了一个无人报道过的代号,那么“已完成10万亿参数的Bel”这一说法就不仅仅是未经证实——它所描述的东西,在修正后的时间线上,根本不可能存在。

什么能解决这个问题

核对清单没有变化,而更正实际上是提高了标准,而不是降低了标准。本博客跟踪过的每一轮 OpenAI 泄露周期,都在官方公告之前留下了一个可验证的实物——Codex 客户端代码中的 gpt-6-astra 标识符、GPT-5.6 模型选择器中的 Sol/Terra/Luna 名称、Astra 之前的 Azure 与 Bedrock 目录列表。Doug 的故事没有产生任何类似的东西,而本次更正也并未改变这一点:即使 Doug 是 Astra 的基础模型,这个名称仍然是一个没有任何实物证据证实过的内部代号。能够为更正后的解读定论的,是 OpenAI 的一份声明、一张点名基础模型的系统卡,或者一位内部人士连同文件做出的陈述——但这些目前都不存在。在出现其中之一之前,对“Doug 是 GPT-6 Astra 的基础模型”这一说法的准确描述是:最初称其为 GPT-6.5 的那位分析师现在表示如此,一份一个月前的研究备忘在社区中记录了同样的更正,而 OpenAI 始终未发一言。

时间表问题恰恰是这次更正冲击最大的地方。如果真正意义上的下一轮预训练才运行了两个月,而且还没有命名,那么此前报道中所有与“Doug”绑定的日期——ChrisGPT的11月窗口、“继任者很快就来”的预期——全都系在了错误的训练项目上。读者真正可以依赖的信息其实更窄:OpenAI已经推出了Astra,高管们表示会有能力更强的新模型,而下一轮基础模型重训显然还处于早期阶段。但这些都不是发布日期。诚实的说法是:继任者的时钟,要从某个正式标识或公告出现的那一刻才开始计时——而不是泄密者叫出一个代号的时候。

在故事揭晓期间该做什么

没有任何影响决策的事实会因更正而改变,因为现有的模型就是你可以调用的模型。GPT-6 Astra 已上线、已跑过基准测试,并可通过 OpenAI 自己的 API 和 ChatGPT 套餐使用——也可以在 OrcaRouter 上以 OpenAI 的标价 $10 / $50 使用,约 1.05M token 的上下文按提供商价格传递,零加价。如果你现在想对前沿模型寻求另一种意见,Claude Fable 5.1 在独立指数中位居榜首,而GPT-5.6 Sol 仍是经过验证的、更经济的 OpenAI 长上下文选择

A screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the breadcrumb 'Home » Models » OpenAI', the model title 'GPT-6 Astra', capability chips for Vision, Tools, JSON and Reasoning, 'by OpenAI · 2026-09-04', input pricing of $10.00 per 1M tokens and output pricing of $50.00 per 1M tokens, and a description of GPT-6 Astra as OpenAI's flagship model for long-horizon reasoning and agentic workflows.

有用的准备工作与修正前并无二致,因为不确定性并未缩小——它只是转移了。透传路由器会让你已经在用的那个密钥,恰好能调用最终出现的那个后继型号,按厂商自定列表价,在它出现在供应商目录的当天即可生效:无需第二份合同,无需重写,价格变动的瞬间即与厂商发布同步。而正因一个全新基础型号恰恰是那种未经考验的东西——在它通过负载测试之前,你绝不想把生产路径押在它身上——自动故障转移才是诚实的试法:把生产流量钉在你已验证的模型上,把一小部分影子流量指向新来者,让真实请求来作决定。如果修正后的解读是对的,而“Doug”不过是你已经能调用的某个模型之下的基础版本,那么这套配置没有任何浪费;如果那个未命名的后继型号真的发布,跟随小道消息的成本也是零。

对这次更正的公允概括,是原有不确定性被收得更紧的一个版本。曾把“GPT-6.5”标签贴在 Doug 身上的分析师 teortaxesTex 现在承认他搞错了:Doug 是已经交付的 GPT-6 Astra 的基础模型,“Bel”纯属噪音;而真正关键的那次预训练启动还不到两个月、至今尚未命名——一个月前 Samsung Securities 的一份研报就已记录了这一解读,但迄今没有任何模型产物或 OpenAI 声明加以证实。真正留存下来的是那个战略要点,如今对准了正确的目标:OpenAI 已重启基础模型预训练,其首款产品在独立指数上位居第八,而决定后续走向的那一轮训练才刚刚开始。站得住的姿态没有变——继续调用你已经验证过的模型,保留绕开下一次发布的选项,并把官方公告当作唯一重要的日程:不是代号,也不是更正。

本文中的对比2

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新