GPT-6.7 的主视觉标题卡:OpenAI 尚未发布的下一代旗舰模型,标题为“GPT-6.7:核心问题”。画面包含一个扁平 GPU 芯片图标,上方带有粗体问号;一个仪表盘,红色指针指向“2x”刻度;以及速度表、钥匙、泄露文档等小型线性图标;底部条幅写有“GPT-6.7 · 未发布 · 目前已知信息”;右下角为 OrcaRouter 徽标。
Guides & Insights

GPT-6.7与"Bob"问题:OpenAI未发布的旗舰真的会慢2倍吗?

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

8月15日,来自@Yuchenj_UW账户的一条X帖子将一则传闻压缩成一句话:“GPU内核之王Bob离职了?GPT-6.7运行速度将慢一倍……。”这个问号承载着两个说法——该公司最神秘的工程师已经离开,以及他的离职将使该公司未发布的旗舰模型GPT-6.7(去年10月更名为GPT-6-7)的服务速度减半。这两个说法均未得到证实。但这条帖子发布之时,该公司的下一代模型已经是一个“何时”,而非“是否”的问题:Astra系列名称于8月1日亮相,8月7日安全审查暂停了它,而当前旗舰GPT-5.6 Sol——运行在OrcaRouter上——是下一代必须超越的唯一具体参照点。以下是截至今日实际可知的情况。

首先说明一点:OpenAI 之外没有人运行过 GPT-6.7。任何关于它输出 token 速度的说法都只是推测——包括“慢 2 倍”这个数字。下文将已核实的事实(更名、发布时间线、有正式记录的离职事件)与传闻(Bob、内核和那个数字)区分开来。所有传闻材料都会明确标注。

“Bob”是谁,以及为什么一位普通工程师成为了传奇。

“Bob”是OpenAI员工对一位公司从未公开确认其姓名的工程师的昵称。2025年9月的媒体报道——包括量子位(QbitAI)、澎湃新闻(The Paper)和ITBear(itbear),均援引OpenAI前员工及现员工的说法——描述了一位神秘的研究人员,他独自编写推理所用的CUDA内核,即把Transformer数学运算转化为token的低层GPU代码。据报道,他在OpenAI内部被称为“Bob内核”的注意力内核,每天在数十万块GPU上执行数万亿次,其精度要求也与之匹配:任何一个bug都将迫使检查点回滚并重新训练。

这个传说在各种叙述中都是一致的。前员工称,鲍勃用几分钟就解决了同事们苦战了一周的性能问题。OpenAI 的内部 Slack 上有一个“鲍勃魔法”表情符号。同一篇报道引用的行业估算显示,当今能编写高性能训练 CUDA 内核的人不足一百——正因如此,这类对单一人员的依赖才被视为真正的风险,而不是可有可无的锦上添花。

关于身份问题,OpenAI 从未说过 Bob 是谁。在同样的新闻报道中反复出现的主要假设是 Scott Gray——他是一位物理学与计算机科学毕业生,2016 年加入 OpenAI,是 OpenAI 2017 年博客文章《Block-sparse GPU kernels》的第一作者,后来还共同撰写了 GPT-4 技术报告和缩放定律论文,其参考文献列表包含 51 篇论文,被引用超过 80,000 次。这种匹配是间接的,但被广泛重复;这是一个推断,而非确认。

鲍勃真的离开了吗?

这条推文是一个问题,而非一个论断。但它所指的离职事件有据可查。2026年8月15日发布的一份领导层变动综述显示,斯科特·格雷(Scott Gray)——被描述为一位“资深GPU系统工程师”,于2016年加入,并参与构建了稀疏Transformer、缩放定律和GPT-3背后的基础设施——位列至少十二位在2026年离开OpenAI的高管之中。同一份名单还提到了首席营收官丹尼斯·德雷瑟(Denise Dresser)、前首席运营官布拉德·莱特卡普(Brad Lightcap)、应用业务CEO菲吉·西莫(Fidji Simo)、Sora负责人比尔·皮布尔斯(Bill Peebles),以及安全、伦理、营销和硬件部门的负责人。这是一份二手报道,并非官方确认,且未提供格雷的离职日期。

更广泛的背景使得这一传闻不那么令人意外。同一周前后的报道将这次人事变动定性为IPO前的洗牌:联合创始人Greg Brockman正计划在上市前将运营权收归自身,而CNBC于8月13日报道了首席营收官(CRO)的离职。此外,“Bob”作为招聘目标已被盯上一年之久——2025年9月的报道称,Meta的马克·扎克伯格已将“谁是Bob?”列为招聘会议上的常设议题。围绕这一特定技能的人才争夺战确实存在,这也是该消息泄露后读起来颇具可信度的部分原因。

然而,这条说法链有两个未经证实的环节:{{1}}Scott Gray{{/1}}就是{{2}}Bob{{/2}},以及那份汇总名单中的条目与推文所指的离职是同一件事。推文完全可能是在重复一条早于任何实际离职的传闻。本节是诚实的总结:在公开记录中,一位名叫{{3}}Scott Gray{{/3}}的高级GPU工程师出现在2026年离职名单上;在非公开层面,这个人可能是也可能不是推文所指的{{4}}Bob{{/4}}。

为什么“慢 2 倍”很重要——以及为什么事情可能没那么简单

内核决定了两个决定模型经济性的数字:每秒令牌数和每个令牌的成本。如果GPT-6.7发布时所搭载的服务内核,其效率仅为假设中“Bob优化”版本的一半,那么同样的硬件只能服务一半的令牌数,同一个请求的处理时间将翻倍——边际成本也大约翻倍。对于将生产流量路由到该模型的开发者而言,这意味着旗舰模型的延迟和成本都翻倍,而这恰恰是那种足以改变模型选型的数字。这就是为什么这个传闻并非空穴来风。

现在,怀疑它的理由:

• “2x”没有明确的依据。它只是帖子中的一个数字——一种思想实验,而非实际测量,所附图片也没有提供任何依据。

• 内核是代码,而代码的生命力比作者更长久。Bob(或任何人)为早期模型编写的服务栈不会因为某个人的离开而消失;下一个模型会继承其中的大部分。

• OpenAI 的基础设施组织规模庞大,"一人包办所有"的传说几乎可以肯定是一种简化。关键人员风险确实存在,但很少是非黑即白的。

• 即使效率确实有所下降,也不会改变能力。它改变的是成本和延迟——这固然令人头疼,但供应商可以部分吸收成本或围绕定价做文章,而且OpenAI已经推出了一项速度功能(Ultrafast,在当前旗舰机型上最高可提速14倍),正是针对这类服务成本压力。

该主张最有力的版本是“不足百人”的统计数据。如果编写旗舰产品服务内核的人不在了,接替者并非简单补一个编制名额——而是需要多年的逐步培养。这对OpenAI的服务经济性而言确实是一个切实的风险。但这是关于团队的风险,而非对一款尚未发布模型的实测事实。

我们实际上对GPT-6.7了解些什么

谣言所涉及的模型,其公开记录比推文所暗示的要长,而且其中大部分是近期的:

• 2025年10月31日——Sam Altman在X上宣布“GPT-6”将更名为“GPT-6-7”,外界普遍解读为是对Gen-Alpha俚语“6-7”的致意。“GPT-6.7”与“GPT-6-7”是否严格等同尚未得到官方确认;该推文将两者视为可互换,多数报道也是如此处理。

• 2026年4月 — 有报道称GPT-6的预训练已完成,传闻将于4月14日左右发布。但该日期已过,并未发布。

• 2026年8月 — 有泄露消息称发布提前至8月初,OpenAI将跳过GPT-5.7至GPT-5.9。未经证实。

2026年8月1日 — OpenAI 通过一份研究报告宣布其下一代模型系列命名为“Astra”,该报告声称解决了十个开放数学问题。Astra 是否会以 GPT-6 的名称发布尚未确认。

• 2026年8月7日 — OpenAI在内部安全审查标记出"严重"网络安全风险后,暂停了Astra的开发并推迟发布——这是首款触发该等级的模型。奥尔特曼表示,全面发布"还需要一点时间。"

• 预测市场——截至8月中旬,交易者认为GPT-6在9月30日前发布的可能性约为62%,在12月31日前发布的可能性约为90%。

• 传闻中的规格——约200万token的上下文,性能比当前一代提升约40%,个性化记忆,以及代号为"Symphony"的原生多模态架构。均未经证实。

所以,“2x slower”背后的模型尚未发布,没有确定的发布日期,目前正在接受安全审查。与之相关的服务速度数字具有双重推测性——一重在于日期,一重在于速度。

A timeline infographic titled 'GPT-6.7 — the trail so far' with five milestone cards: Oct 31 2025 (renamed GPT-6-7 by Altman), Apr 2026 (pre-training reported done), Aug 1 2026 (Astra family name announced), Aug 7 2026 (safety pause: critical cyber risk), Aug 15 2026 (Bob departure rumor circulates); footer reads 'Timeline per OpenAI announcements and press reports; model unreleased as of Aug 15 2026.' OrcaRouter logo in the bottom-right corner.

今天唯一诚实的计分板

由于GPT-6.7尚不存在,记分板只能将传闻与实际运行中的内容进行对比:

• GPT-6.7(未发布)— 状态:未出货;发布:传闻2026年秋季;上下文:约200万token(传闻);速度:“慢2倍?”未证实;价格:无;可路由:尚无。

• GPT-5.6 Sol(实时)— 状态:已发布;上下文:1.05M tokens,最大输出 128K;速度:根据 OrcaRouter 的 7 天统计,约为 290 tok/s;价格:标准输入层级下,每百万 tokens 输入 $5.00 / 输出 $30.00;可路由:是,按提供商列表价格。

有趣的差距在于价格列。OpenAI 目前的旗舰模型通过 OrcaRouter 收费为每百万 token 5美元/30美元,而且透传费率就是供应商自己的标价,零加价——因此无论 OpenAI 为 GPT-6.7 定价多少,我们这边的数字都会在它发布的同一天变动,无需重新谈判。对于任何围绕下一代模型做规划的人来说,这就是记分牌上有用的部分。

A two-column scoreboard titled 'GPT-6.7 vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6.7 (unreleased): Status not shipped, Release rumored autumn 2026, Context ~2M (rumored), Speed 2x slower? (unverified), Price n/a, On OrcaRouter not yet. Right column GPT-5.6 Sol (live): Status shipping, Release live now, Context 1.05M tokens, Speed ~290 tok/s, Price $5.00/$30.00 per M, On OrcaRouter yes at list price. Footer: 'GPT-6.7 figures rumored/unaudited; GPT-5.6 Sol per OrcaRouter model page.' OrcaRouter logo in the bottom-right corner.

如何处理这样的泄漏

这个模式很常见:一款未发布的型号、一个惊人的数字、一个有名有姓的人。每个部分都看似合理,但都未经证实。正确的回应既不是无视谣言,也不是押注谣言——而是构建决策,让你不必二选一。

这就是路由的应用场景。当GPT-6.7发布时,要评估一个「慢2倍」的说法而不把生产路径押在上面,方法是把它放在你已经在用的同一个端点后面:一个API密钥,一旦新模型表现不佳就自动故障转移到GPT-5.6 Sol,由真实流量来判断传言是否属实。这样,这个说法就变成了一个测量结果,而不是一条推文。如果OpenAI的价格表随新版本发布而变化,转嫁费率会在同一天更新——OrcaRouter以零加价转嫁提供商的标价,因此供应商降价(或涨价)会立即在此生效,无需重新谈判。

与此同时,当前的旗舰模型才是实实在在的。GPT-5.6 Sol 今日已在 OrcaRouter 上线,每百万 token 定价 5/30 美元,支持 105 万 token 的上下文窗口,排行榜显示其速度约为 290 token/秒。8 月 13 日发布的 Ultrafast 模式——速度最高提升 14 倍,在 Cerebras 基础设施上约为每秒 750 token——适用于该模型,而非 GPT-6.7。这提醒我们,OpenAI 既能通过内核,也能通过基础设施来降低服务成本。

Screen capture of the OrcaRouter model page for GPT-5.6 Sol, showing the OpenAI flagship's pricing ($5.00 in / $30.00 out per million tokens), a 1.05M-token context window, 128K max output, Vision/Tools/JSON/Reasoning capability tags, and a p50 time-to-first-token of 1.87 seconds.

我们现在正在看的

• 鲍勃的离职是否得到确认。OpenAI 并未评论鲍勃是谁;最接近的公开记录事件是斯科特·格雷(Scott Gray)的名字出现在2026年离职名单上。如果 OpenAI 或格雷确认此事,链条的第一环将成为事实。

• “2x slower”这个数字是否会有所依据。如果GPT-6.7发布,并且出现了独立的测速数据,这个数字就不再是传闻——要么被证实,要么被废弃。在那之前,它只是帖子里的一个数字。

• Astra的安全暂停是否会推迟发布日期。预测市场已把GPT-6移出八月;OpenAI所称的“关键”认定以及它希望进行的政府测试,都是进一步延迟的自然来源。

• 内核基准测试是否会重新排序。如果 OpenAI 的服务团队承担了损失——或者说该传闻夸大了某个人的份额——那么整个谣言就无关紧要了,第一个迹象将是下一代模型相对前代的 serving 性能。

诚实的解读是:“慢 2 倍”是一个很有吸引力的说法,但到目前为止,也仅此而已。内核奇才的离职是一个真实的数据点,有白纸黑字的记录佐证;而速度数字只是推特上的一个数字。在 GPT-6.7 发布之前,站得住脚的立场是为两种结果都做好计划——假设传闻可能部分属实,并构建路由,让测试一个比预期更慢的旗舰模型毫无成本。这正是对一个你尚未谋面的模型进行路由的全部意义。

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

providers@orcarouter.ai

加入我们的社区

Discordsupport@orcarouter.aiXGitHubYouTube