
GPT-6 Astra的继任者:OpenAI的下一代旗舰据称'很快'发布
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77代码
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0345智能76代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78代码
GPT-6 Astra,OpenAI的新旗舰模型,于9月5日星期五正式全面上线。到了接下来的周二,关于其继任者的消息已不再是传闻,而成为了一场公开演示:9月8日,OpenAI表示,一个未发布、未命名的下一代模型——该公司称其“能力显著超越GPT-6 Astra”——在88小时的运行中驱动了约10,000个并行智能体,产出了对三维纳维-斯托克斯方程有限时间爆破的证明声明,该方程正是数学领域七个克莱千禧年奖问题之一。这是OpenAI首次将“很快问世”传闻背后的模型公开描述为一个可运行的系统,而非一个技术方向。这并非一次正式发布:没有模型名称、没有发布日期、没有API标识符,而且该证明本身尚未经过独立验证。这是一篇“迄今已知信息”的报道,探讨本周最重大的AI宣称究竟能告诉我们什么,又不能告诉我们什么——关于下一代旗舰模型。
这项声明发布的那一周,已经是全年最拥挤的一周。Anthropic 于9月1日发布了 Claude Fable 5.1——以及其受控的网络安全与生物学姊妹模型 Claude Mythos 5.1。OpenAI 于9月3日推出 GPT-6 Astra,价格为每百万 token 输入10美元、输出50美元,上下文约105万 token,输出上限128K,并获得了首个“Critical”网络安全评级——这是 OpenAI 模型在其自身《预备框架》下获得的最高评级。到9月5日,标准模型已面向付费 ChatGPT 各层级及 API 全面开放。独立评测榜单并不像发布材料那样光鲜:Claude Fable 5.1 在 Artificial Analysis 智能指数中位列第一,得分66;而 GPT-6 Astra 得分为61——在该追踪平台上大约排第八,与其前代 GPT-5.6 Sol 持平,落后于 Meta 的 Muse Spark 1.3(62分)。
这一差距正是“已经过时”论调的背景,它让真正的问题不在于OpenAI是否拥有更强大的产品——其内部人员一直这么说——而在于它有多接近,以及一次临近的旗舰换代可能会对你刚刚做出的决定产生何种影响。
萨姆实际上说了什么
从原始来源入手,因为转述已经偏离了它。在查珀尔希尔举行的G20创新峰会上接受Axios采访时(9月3日报道),奥特曼表示OpenAI“很快将推出能力强大得多得多得多的模型”,并警告称“下一代模型将让所有人都清醒过来”,还将未来的发布节奏描述为“取决于我们在对齐和安全方面能多快取得进展”。这就是“很快”背后的那句话。这是来自首席执行官的真实、公开的信号——但请准确理解:奥特曼没有说GPT-6 Astra的继任者几天内就会问世,没有点名任何模型,也没有给出日期。他说能力更强的模型即将到来,但按安全时钟来走。OpenAI观察者@kimmonismus表示,他随后已确认了这一所指:9月5日,他表示自己收到了官方确认,采访的完整记录表明,“能力强大得多的模型”的言论指的是GPT-6 Astra之外的模型,而非Astra本身,而且OpenAI“已经准备好了更多能力更强的模型,即将发布”。应将此视为消息来源对私下确认的转述,而非OpenAI的公开声明——但它与下方视频片段以及该实验室自家研究人员的说法方向一致。这些是不同的说法,有着不同的规划含义,把它们混为一谈,正是泄密变成虚假警报的原因。
那条不太受人注意的证据反而更有力,因为那是奥特曼本人亲自在Astra与它之后的型号之间划清界限。9月5日流传的一段视频片段——由账号@cgtwts发布、被@kimmonismus嵌入到上文那条推文中——显示奥特曼说:“GPT-6 Astra的训练完成已经有一阵子了。我们最近谈到要暂停的那个模型,呃,是个未来型号。但Astra确实达到了网络关键级(cyber-critical)。”先别管这段片段究竟出自哪场访谈,内容才是关键。在镜头前,OpenAI的CEO说了三件要紧的事:Astra在“一阵子前”就已完成训练,所以它不是一款还在摸索、尚未站稳的模型;OpenAI“最近谈到要暂停”的不是Astra,而是“一款未来型号”;而达到网络关键级(cyber-critical)的正是Astra,可它最终还是照常发布了。这重新定义了八月那次推迟Astra发布的安全暂停——按照CEO自己的说法,OpenAI在八月中旬叫停的,不只是大家都在紧盯的那款旗舰型号,还包括后续型号的工作。
研究人员把那些不言而喻的话明说出来了。
这一时间线的说法并非仅基于Altman一人。OpenAI相关的研究人员在发布周期间公开向业界表示,Astra是一个过渡节点,而非终点。研究员roon写道,他“甚至尚未触及Astra所能做到的事情的表面”,接着补充道:“我想它在某种程度上几周内就会过时。”另一位研究员Zuxin Liu描述自己感受到了“RSI的强大势头”——即递归自我改进,也就是OpenAI用当前模型构建下一代模型的循环。这些是实验室内人员的公开发帖,并非官方公告,因此应被视作内部信号而非事实。但若与Altman关于“未来模型”的评论放在一起看,它们所描绘的是一家不等待自然节奏的实验室:如果Astra正被用来训练其继任者,那么继任者到来的速度可能远远快于GPT-5.6 Sol(7月9日)与GPT-6 Astra(9月3日)之间八周间隔所暗示的速度。
同一周,公司的官方口径又向前推进了一步。Greg Brockman在发布时提出的“欢迎进入AGI时代”的框架、Altman在8月底向《时代》杂志发表的声明——称OpenAI可能在2026年底前拥有他会称之为AGI的系统——以及首席研究官Mark Chen给出的“已完成80%”的数字,都描绘了一家将Astra定位为更快速序列中一步的组织。这些都不是发布日期,但全都指向与“即将到来”解读一致的方向。
9月8日的证明声明
9月8日,这个故事有了一件实打实的东西——而且不是泄密。OpenAI表示,一个内部未发布的下一代模型——同样未命名,同样未注明日期——在一次自主运行88小时、最多10,000个智能体并行运算的过程中,产生了一个所声称的证明:三维Navier-Stokes方程可能发展出有限时间奇点。也就是说,一种光滑流体在演化中,涡旋不断收紧并加速旋转,直到速度变得无界,而总能量始终有限。这个问题是七大100万美元“千禧年大奖难题”之一,而七个问题中仅有一个——庞加莱猜想——曾被解决。OpenAI称,这项努力始于9月1日,花费了数百万美元的计算资源,并被视为能力展示,而非志在夺奖:公司表示不会领取这100万美元。该段中的每一项内容均为OpenAI所述;其中没有任何一项经过独立复现,也没有任何一项提及模型名称或发布日期。
验证差距正是这个声明在你认知中应被放置的位置。公告发布时,数学界尚未对该证明进行审查,而媒体对OpenAI是否发布了完整书面报告说法不一。克莱数学研究所所长马丁·布里德森指出,在该领域看来,这一悬赏问题仍然悬而未决——因为其经典表述针对的是无外力方程,而OpenAI所报道的结果涉及的是带外力变体——包括菲尔兹奖得主蒂莫西·高尔斯在内的数学家也表示,该声明需要数学界的审查。这与可验证数学应有的运作方式形成了鲜明对比:纽约大学数学家特里斯坦·巴克马斯特和Anthropic数学家莱文特·阿尔珀格在前一天(9月7日)发布了他们自己的相关结果,并附带了机器可检查的Lean形式化证明;而OpenAI的声明则是在一次新闻电话会议上发布的。
9月8日还开启了一场关于出处归属的争议,而这会影响你如何权衡这一说法。巴克马斯特和阿尔珀格在大约一年时间里,一直在研究密切相关的有限时间爆破问题,混合使用了Anthropic的Claude以及OpenAI的Codex和GPT-6 Astra模型。巴克马斯特表示,OpenAI于9月6日联系他,称其模型产生了一条与他们的路径惊人相似的证明,并声称OpenAI的塞巴斯蒂安·布贝克迫使他将阿尔珀格从联合公告中除名,原因是阿尔珀格受雇于Anthropic,还发表了一些被巴克马斯特解读为职业威胁的言论。OpenAI否认这一说法——布贝克称其“虚假且具有煽动性”——并表示,其研究人员及其代理人在两人的工作公开之前都未曾见过这些内容,而且仅承认无法排除来自自家产品的去标识化数据塑造了其模型的可能性。这些是对私人谈话存在争议的说法;中立的概括是,两个团队在数天内各自得出了相关结果,而这场争执如今已成为围绕OpenAI所保留内容周围氛围的一部分。
谣言工厂对它的称呼
名字是这则故事容易变得难以捉摸的地方,有必要明确说明目前的局面。本博客的 Astra 发布说明已经梳理了围绕“接下来会推出什么”而流传的两个代号:“Doug”——SemiAnalysis 于 8 月 7 日告知机构客户,这是 OpenAI“正在积极推进”的一个“规模大得多”的模型;匿名 X 账号 Chris GPT 则声称这将是 OpenAI 迄今为止最大的一次预训练,会让 Claude Fable 5 看起来“原始”。另一个代号是“Bel”——匿名 X 账号 @synthwavedd 于 8 月 25 日报道称,这是已完成预训练、总参数超过 10 万亿的模型,并被描述为 Doug 的继任者。围绕这两个代号的报道并不一致——有些说法将 Bel 视为刚刚以 GPT-6 Astra 这一形态发布的 GPT-6 世代的基础模型,另一些则认为它是那之后的模型——而且所有这些消息都追溯到匿名账号,OpenAI 内部没有任何具名的信源。
本周发生的变化是,Altman自己的话如今指向了与“Bel作为继任者”这一解读相同的方向。如果按照CEO的说法,OpenAI确实已经出于安全审查而暂停了一个“未来模型”,那么“一个已完成的预训练成果正躺在流程中等待对齐工作”这一想法就再也不只是一篇匿名帖——它与OpenAI自己的表态是一致的。将这些代号视为句柄,而非产品名称。OpenAI的命名此前就已经跑在了传言前面:本博客整个夏天以GPT-6.7为工作名追踪的那个模型,最终以GPT-6 Astra的名称发布。对于Doug和Bel,我们应当给予同样的怀疑和同样的耐心。重要的不是哪个代号能留下来,而是至今还没有出现任何真实的标识符——这正是需要特别关注的一点。
支持怀疑主义的理由
支持仓促行事的论点,从上面的引述中便不言自明。反对仓促行事的论点同样值得重视,因为它植根于OpenAI实际做了什么,而非其人员说了什么。
首先,这次发布尚未尘埃落定。GPT-6 Astra 的标准模型直到9月5日才全面可用;其更高等级版本 GPT-6-Astra-Pro 同周才登陆 Pro、Business 和 Enterprise 套餐,而 OpenAI 那周都在应付被媒体报道为混乱的发布过程,包括 Altman 在第二天承认发布并不如预期顺利。在这样的节骨眼上推出继任者,即便以 OpenAI 的标准来看也很奇怪。
其次,节奏数据本身就不支持“数天”的说法。OpenAI 在 2026 年展现出的旗舰发布节奏大约是两个月一个周期——7 月 9 日是 GPT-5.6 Sol,9 月 3 日是 GPT-6 Astra。在 Astra 之后仅一周就推出继任者,速度快了一个数量级,而且这与 OpenAI 过去一个月一直在传达的安全节奏信息相冲突:Astra 从 8 月推迟发布的全部原因就是那个“Critical”发现,Altman 也已表示,发布现在取决于对齐与安全进展。一个实验室若在 8 月中旬出于安全原因暂停其最大的前沿模型运行,又在 9 月中旬推出继任者,那它要么是极快地解决了那个发现,要么就从未真正暂停过真正要紧的东西。
第三点,也是最具体的:本周的产物是一个声明,而非产品。本博客追踪过的每一轮泄露周期都在身后留下了一个可验证的对象——gpt-6-astra 这个标识符在发布前出现在 Codex 客户端代码中,一个被清理过的 'gpt-nathree' PR 签名从 OpenAI 自有仓库中泄露。9月8日关于纳维-斯托克斯的公告则是另一种对象:OpenAI 表示,其尚未发布的下一代模型运行了大约 10,000 个智能体、历时 88 小时,产出了一种证明;但该证明在发布形态下无法审计,各方报道对完整论文是否公开说法不一,而 OpenAI 将整个实验框定为能力展示,而非向发布日期的推进。一个你无法核实的声明,与其说接近一个标识符,不如说更接近 CEO 的一句话——它告诉你继任者已经存在并已在运行,却几乎不告诉你何时能调用它。
以下是让三点同时成立的解释:Astra在“一段时间”前已完成,并一直在接受安全审查;实际在8月暂停的是后继模型;而暂停关乎的是管控,而非能力。如果这才是真实顺序,那么后继模型并非“现在正在构建”——它早已构建完成,变量只是OpenAI多快能完成安全审查工作。9月8日的披露符合这种解读:OpenAI称其下一代模型于9月1日开始了纳维-斯托克斯方面的工作,这不是一个仍在组装模型的实验室会有的行为,而是一个已经在用它能找到的最难问题来测试该模型的实验室的行为。正是在这种情况下,“很快”才显得合理,而“几周而非几个月”才是正确的理解。但同样在这种局面下,什么都不确定——曾推迟过Astra一次的安全门槛,也可能再次推迟下一代模型,而能力演示并不等于产品决策。

继任者必须做出哪些改变
由于对模型本身一无所知,要推断它的用途,唯一诚实的做法是阅读刚发布内容中的缺口。这些是需要留意的假设,而非可围绕其规划的事实。
• 独立指数上的差距。GPT-6 Astra 的发布材料标榜了那些头条数字,但在 Artificial Analysis 的 Intelligence Index 上,其得分仅为 61,而 Claude Fable 5.1 为 66。一个能消弭这一差距的继任者——而不是仅仅在厂商基准测试中再度确认这一差距——才是“例行更新”与“真正跨越”之间的分水岭。
• 价格和上下文这条线。GPT-6 Astra 发布时定价为 10 美元 / 50 美元,上下文约 105 万。OpenAI 今年已经下调过一次 GPT-5.6 系列的价格,而如果继任者以更低的标价、更大的上下文或更便宜的持续推理成本推出,其对采用率的影响将超过任何基准测试的差异。要像关注模型卡一样关注价格表。
• 计算机使用能力的天花板。GPT-6 Astra 的发布卖点是长时程自主能力——“你在电脑上能做的任何事”——而其厂商报告的 OSWorld 2.0 成绩(72.6% 部分得分)正是竞争对手已在攻击的数字。若其继任者能让自主能力的宣称在独立测试中站得住脚,那将远比榜单分数的提升更有意义。
• 安全门。这是最具OpenAI特异性的变量。Astra发布时,其最先进的网络安全能力被限制在可信访问计划中,而Altman现在已在视频中表示,被暂停的“未来模型”是真实存在的。观察其继任者是否会以同样的方式通过Critical阈值、以受限方式发布,还是会触发更长时间的审查——每种结果都说明了它距离目标有多近。
• 名称。它会留在 Astra 系列中,跃升为 GPT-7,还是以全新系列名称问世?OpenAI 直到发布前几天仍在纠结 Astra 本身是否会以 "GPT-6" 的名字发布。最终发布的名称,而非传闻,才是战略意图的真正体现。
等待时可以做什么
从今天可用的东西开始,因为这一切都不会因一句宣称或一则传闻而改变。GPT-6 Astra 是真实的、经过基准测试的,并且可通过 OpenAI 自己的 API 和 ChatGPT 套餐使用;Claude Fable 5.1 是真实的、经过基准测试的,目前在独立指数中位居榜首;GPT-5.6 Sol 仍是 OpenAI 在长上下文工作中兼具性价比的选择。直到本周,每一个附在继任型号上的数字,要么是 CEO 的含糊其辞,要么是匿名帖子;现在,其中一个数字是 OpenAI 自己的能力宣称,在媒体电话会上作出,实验室之外无人核实。宣称和传闻都不是规格说明书。围绕一个尚未命名、而且其最公开的成就也无法核实的模型来重新架构生产路径,那不过是披着工程外衣的猜测。
真正有用的工作,是让下一代版本在真的落地时能够被低成本地采用——这正是路由层证明自身价值、而非仅仅收取费用的地方。GPT-5.6 Sol 今天已在 OrcaRouter 上线,按 OpenAI 自己的价格,每百万 token 4 美元 / 20 美元,其 1.05M token 的上下文窗口按服务商目录价透传,零加价、无需重新谈判。如果继任者真的出现在服务商目录中,同样的规则也适用:它可以通过你已经在用的密钥和你已经在调的端点来调用,按厂商自己的价格,当天即生效。这也是故障转移模式大显身手的时刻。一款服务行为尚未得到验证的全新旗舰模型,正是路由规则的教科书式场景:把生产流量固定在你已经验证过的模型上,把一小部分影子流量指向新模型,让真实请求——而不是发布博客——来决定它能否占据主用位置。在 OrcaRouter 上,这只是编辑一次路由字符串,而非一次迁移。对“很快”判断失误的代价,恰恰就是路由层存在的意义——它正是为吸收这种代价而生。

看什么
• 一个标识符。规律是一致的:在 OpenAI 宣布发布之前,gpt-6-astra 的标识符就泄露在 Codex 客户端代码中,而 OpenAI 的仓库中还泄露过一条经清理的“gpt-nathree”提交签名。当真正的继任者临近时,预期在官方公告之前,会有一个字符串出现在第三方客户端、云端模型列表或 OpenAI 自己的 API 更新日志中。这就是真实信号与 CEO 时间表之间的区别。
• 命名方式。Astra 系列、GPT-7,还是新的系列名称——先出现哪一个,就能判断 OpenAI 是将此视为对刚推出的旗舰产品的更新,还是对整个世代的重新定义。
• 安全门。被暂停的“未来模型”是唯一最具信息量的变量。如果它迅速通过关键阈值并门控发布,那么“很快”的解读就是正确的。如果它触发更长时间的审查,那么八月的暂停就不仅仅是管控措施——进度安排也会随之延后。
• 独立数据。当继任者真正发布时,首批Artificial Analysis和LMArena评测将比任何发布时的榜单更重要,并且每个厂商的数据都应标注为厂商自报,直到独立方复现该结果。GPT-6 Astra自身的发布就是一个警示:营销说辞是一套,指数结果又是另一套。
• 价格表。OpenAI 今年已经下调过一次 GPT-5.6 的定价。如果后继型号以更低的标价推出,将重塑整个前沿经济格局——而在直通式路由器上,这一变化会在厂商发布的当天生效。
• 关键在于,证明是否会变得可核查。OpenAI 将其 Navier-Stokes 运行定位为一次能力展示,而既然是展示,它便没有义务公开证明。如果报告及任何形式化内容最终出现,供社区审查,那是一个信号,说明 OpenAI 打算如何使用下一代模型;如果这一说法仍只停留在媒体电话会上,那又是另一个信号。二者都不会让发布日期提前,但这一区别如今是判断继任模型真正用途的最清晰依据。

常见问题
OpenAI是否已确认GPT-6 Astra的继任者?
并非作为产品。萨姆·奥尔特曼告诉Axios,OpenAI“即将推出能力要强大得多得多得多的模型”。9月8日,OpenAI公开描述了一款尚未发布、尚未命名的下一代模型——“能力远超GPT-6 Astra”——称该模型产出了其所声称的纳维-斯托克斯方程证明。OpenAI尚未做的,是为该模型命名、定价、确定发布日期,或在其任何API中显示标识符。这款后继模型的存在现已由OpenAI官方证实;但它的可用性则尚未确定。
继任者会叫什么名字——GPT-6.7、Doug还是Bel?
这些都不是产品名称。GPT-6.7 是本博客整个夏天持续追踪的工作名称,所指的正是最终以 GPT-6 Astra 名义发布的那一代模型。Doug 和 Bel 是分别被报道过的预训练运行,不同说法中的谱系并不一致——有人认为 Bel 是 GPT-6 这一代的基础模型,也有人认为它是之后的模型。只有当标识符或官方公告出现时,真正的名称才会揭晓。
纳维-斯托克斯方程的证明是经过验证的结果吗?
不。这是OpenAI在9月8日的一次新闻发布会上宣布的主张,实验室之外没有人核实过。数学界尚未对任何书面报告进行过审查,媒体对于是否已发布报告也说法不一。克莱研究所所长马丁·布里德森指出,该千禧年问题仍未解决——其经典表述针对的是无外力方程,而OpenAI所报道的结果涉及的是受迫变体;OpenAI表示无论如何都不会申领这100万美元。与之对比,特里斯坦·巴克马斯特和莱文特·阿尔波格于9月7日发布的相关结果附带了机器可检查的Lean形式化验证。一个数学主张在有人能够检验之前,不能算是数学结果。
我是否应该暂缓基于 GPT-6 Astra 进行开发?
没有一个标准答案,因为现有模型都经过基准测试,而继任者尚未问世。如果一个长期智能体项目依赖的旗舰模型可能在数周内被重置,稳妥的做法是继续调用你已经验证过的模型,并保持无需重写即可切换的能力——这正是带故障转移的路由层的用途。让官方公告,而不是泄露消息,来引导你的流量。
诚实的总结是一个带着时钟的主张。一位广受关注的 OpenAI 观察者称,GPT-6 Astra 的继任者“很快”就会到来;Sam Altman 告诉 Axios,更强大的模型正在按照安全节奏的时钟到来——OpenAI 观察者 @kimmonismus 表示,他从完整记录中确认了这一解读,指向的是超越 GPT-6 Astra 的模型,而非 Astra 本身——而且 Altman 在视频中表示,OpenAI 暂停的是未来的模型;OpenAI 自己的研究人员公开称 GPT-6 Astra 将在数周内过时;9 月 8 日,该公司自己表示,一个未发布的下一代模型“能力显著超越 GPT-6 Astra”,产出了其对纳维-斯托克斯方程的证明主张。以上没有一项是公告,没有一项点名某个模型或设定日期,而且该证明还不是经过验证的结果——本文中每一项具体的预期,在下周此时都可能被证实有误。无可争议的是,GPT-6 Astra 存在且可用,Claude Fable 5.1 在独立指数上位居其上,而且一条更便宜的 OpenAI 路径——通过 OrcaRouter 以 4 美元/20 美元提供的 GPT-5.6 Sol——对于不需要全新旗舰模型的工作仍然可用。这类主张唯一能证明合理的姿态,是一种无需任何代价的姿态:继续你一直在做的判断,保留绕开下一次发布的选择,并把公告——以及审计——视为唯一重要的日程。
本文中的对比3
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
