
GPT-6.7 與「Bob」之問:OpenAI 未發布的旗艦模型真的會慢 2 倍嗎?
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百萬 tokens
- z-ai新Z.ai: GLM 5.32026-08-1860智能75程式
- obsidian新Qwen3.8 27B2026-08-1552智能68程式
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69程式
- grok新SpaceXAI: Grok 4.62026-08-1261智能77程式
- metaMeta: Muse Spark 1.22026-08-0557智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
8 月 15 日,帳號 @Yuchenj_UW 在 X 上的貼文將一則謠言壓縮成一句話:「GPU kernel 之王 Bob 離開公司了?GPT-6.7 的運行速度將慢上一倍……。」這個問號承載著兩項宣稱——該公司最神祕的工程師已經離職,以及他的離去使該公司尚未發布的旗艦模型 GPT-6.7(去年 10 月更名為 GPT-6-7)的伺服速度減半。兩項宣稱皆未獲證實。但這則貼文發布之際,關於該公司下一代模型,問題已經是「何時」,而非「是否」:Astra 系列名稱於 8 月 1 日出現,8 月 7 日安全審查使其暫緩,而運行於 OrcaRouter 上的現任旗艦 GPT-5.6 Sol,是下一代必須超越的唯一具體參考點。以下是截至今日實際可知的資訊。
先說一件事:OpenAI 以外沒有人實際執行過 GPT-6.7。任何關於它提供 token 速度的說法都只是推測——包括「慢 2 倍」這個數字。以下內容將已證實的事實(更名、發布時程、有紀錄可查的離職事件)與傳說(Bob、核心,以及那個數字)區分開來。所有謠言性質的內容都會明確標示。
「Bob」是誰,以及為何一位工程師成為了傳奇
「Bob」是 OpenAI 員工用來稱呼一位公司從未證實其真實姓名的工程師的暱稱。2025 年 9 月的媒體報導——包括量子位(QbitAI)、澎湃新聞(The Paper)與 IT之家(itbear)——均引述 OpenAI 現任及前任員工的說法,描述了一位神祕的研究人員,他獨自撰寫用於推論(inference)的 CUDA kernel,也就是將 transformer 的數學運算轉換為 token 的低階 GPU 程式碼。據報導,他在 OpenAI 內部被稱為「Bob kernel」的注意力核心,每天在數十萬顆 GPU 上被執行數兆次,其精確度要求也與之相當:一旦出現錯誤,就必須回滾 checkpoint(檢查點)並重新訓練。
這個傳奇在不同說法中始終一致。前員工表示,Bob 只需幾分鐘就能解決同事們苦戰一週的效能問題。OpenAI 的內部 Slack 有一個「Bob magic」表情符號。同一篇報導引用的業界估計表明,目前能撰寫高效能訓練 CUDA kernel 的人數不到一百人——這就是為什麼這種單人依賴被視為真正的風險,而非錦上添花的額外優勢。
關於身分,OpenAI 從未說明 Bob 是誰。主流假設——在同樣的新聞報導中不斷重複——是 Scott Gray:他擁有物理與電腦科學學位,2016 年加入 OpenAI,是第一作者撰寫 OpenAI 2017 年部落格文章〈Block-sparse GPU kernels〉,後來也共同撰寫了 GPT-4 技術報告和 scaling-laws 論文,其著作目錄包含 51 篇論文、超過 80,000 次引用。這個推測屬於間接證據,但廣為流傳;它是推論,而非證實。
鮑勃真的離開了嗎?
這則推文是提問,不是主張。但它所指涉的離職事件有跡可循。2026年8月15日發布的一份領導層人事動盪綜述,將 Scott Gray——被描述為「資深 GPU 系統工程師」,於2016年加入,並協助建構稀疏 Transformer、規模定律(scaling laws)與 GPT-3 背後的基礎設施——列為2026年至少十二位離開 OpenAI 的高階主管之一。同一份名單還點名了營收長 Denise Dresser、前營運長 Brad Lightcap、應用程式執行長 Fidji Simo、Sora 負責人 Bill Peebles,以及安全、倫理、行銷與硬體部門的主管。那是一份二手報導,並非官方確認,且未提供 Gray 的離職日期。
更廣泛的背景使得這個傳聞不那麼令人意外。同一週前後的報導將這波人事流動描述為IPO前的重整:聯合創辦人Greg Brockman在計劃中的公開上市之前,將營運權力攬向自己,而CNBC在8月13日報導了CRO的離職。而「Bob」一年來一直是眾所皆知的招募目標——2025年9月的報導指出,Meta的Mark Zuckerberg已將「誰是Bob?」列為招聘會議的固定議題。圍繞這項特定技能的搶人大戰是真實存在的,這正是這則外流消息之所以看來可信的部分原因。
不過,這條指控鏈有兩個未經證實的環節:Scott Gray 就是 Bob,以及該彙整清單所列的離職,與推文所指的離職是同一起事件。推文很可能只是在重複某個早在實際離職之前就已存在的傳聞。本節是如實的總結:在公開記錄中,一位名叫 Scott Gray 的資深 GPU 工程師出現在 2026 年的離職名單上;而在非公開資訊方面,這個人可能是也可能不是推文所指的 Bob。
為什麼「慢 2 倍」會很重要——以及為何事情可能沒那麼簡單
核心(kernel)決定了兩個決定模型經濟效益的數字:每秒 token 數,以及每個 token 的成本。如果 GPT-6.7 出貨時搭載的服務核心效率只有假想中「Bob 最佳化」版本的一半,那麼同樣的硬體只能服務一半的 token,同一個請求則需耗時兩倍——邊際成本大約也是兩倍。對於將正式環境流量導向該模型的開發者而言,這代表旗艦模型要承受 2 倍延遲與 2 倍成本的打擊,正是那種足以讓人改變模型選擇的數字。這就是為什麼這則傳聞如此有份量。
現在不信任它的理由:
• 「2x」並無陳述依據。它只是貼文中的一個數字——是思想實驗,而非測量結果,而且所附的圖片同樣沒有提供依據。
• 內核是程式碼,而程式碼比作者更長壽。Bob(或任何人)為早期模型編寫的服務堆疊不會因人員離職而消失;下一個模型會繼承其中大部分內容。
OpenAI 的基礎設施組織規模龐大,「一人包辦所有程式碼」的傳說幾乎可以肯定是簡化說法。關鍵人物風險確實存在,但很少是零或一的問題。
• 即使真正影響效率,也不會改變能力本身。改變的是成本與延遲——雖然令人頭痛,但廠商可以部分吸收或透過定價策略來因應,而 OpenAI 已經推出了針對此類伺服成本壓力的速度功能(Ultrafast,在目前旗艦機型上最快可達 14 倍)。
「該主張最強烈的版本是「不到一百人」的統計數據。如果撰寫旗艦產品伺服內核的人離職了,替代者並非單純補足人數——而是需要多年的培養期。這對 OpenAI 的伺服經濟確實是一項合理的風險。但這是關於團隊的風險,而非關於尚未發佈之模型的實測事實。」
我們實際上對 GPT-6.7 的了解
謠言所指的那個模型,其公開蹤跡比那則推文所暗示的還要長,而且其中大部分都是近期的:
• 2025年10月31日 — Sam Altman 在 X 上宣布「GPT-6」將更名為「GPT-6-7」,普遍被解讀為對 Gen-Alpha 俚語「6-7」的致意。「GPT-6.7」與「GPT-6-7」是否嚴格來說是同一回事並未官方證實;該推文將兩者視為可互換,大多數報導也是如此。
• 2026年4月 — 有報導稱GPT-6的預訓練已完成,傳聞將於4月14日左右發布。但該日期已過,並未發布。
• 2026年8月 — 爆料稱發布時間提前至8月初,OpenAI將跳過GPT-5.7至GPT-5.9。未經證實。
• 2026年8月1日 — OpenAI 宣布其下一代模型系列名稱為「Astra」,並透過一份研究報告宣稱已解決十道開放數學問題。Astra 是否會以 GPT-6 之名推出尚未證實。
• 2026年8月7日 — OpenAI 在內部安全審查標記出「嚴重」網路安全風險後,暫停了 Astra 的開發並延後發布——這是首個觸發該等級的模型。Altman 表示,全面發布「還需要再等一段時間。」
• 預測市場 — 截至8月中旬,交易者認為GPT-6在9月30日前發布的機率約為62%,在12月31日前則約為90%。
• 傳聞中的規格 — 約2M token的上下文,比當前世代性能提升約40%,個人化記憶,以及代號為「Symphony」的原生多模態架構。全部未經證實。
因此,號稱「2x slower」的模型尚未出貨,沒有確認的發布日期,而且正在接受主動安全審查。其服務速度數字具有雙重不確定性——日期不確定,速度也不確定。

今天唯一誠實的記分板
因為 GPT-6.7 還不存在,排行榜只能將謠言與實際已上線的內容進行對比:
• GPT-6.7(未發布)— 狀態:尚未出貨;發布時間:據傳 2026 年秋季;上下文長度:約 2M tokens(傳聞);速度:「慢 2 倍?」未經驗證;價格:不適用;可路由:尚未。
• GPT-5.6 Sol(已上線)— 狀態:已推出;上下文:105 萬 tokens,最大輸出 128K;速度:OrcaRouter 7 天統計中觀察到約 290 tok/s;價格:標準輸入層級每百萬 tokens 輸入 $5.00 / 輸出 $30.00;可路由:是,按供應商列表價格。
有趣的差距在於價格欄。OpenAI 目前的旗艦模型透過 OrcaRouter 的費用是每百萬個 token 5/30 美元,而轉傳費率就是供應商自己的牌價、零加價——所以無論 OpenAI 將 GPT-6.7 定價多少,我們這邊的數字都會在它上市當天同步變動,無需重新議價。對於任何圍繞下一個模型做規劃的人來說,這就是記分板上最有用的部分。

如何處理這樣的洩漏
這個模式很熟悉:一個未發布的型號、一個驚人的數字、一個指名道姓的人。每個部分都貌似合理,卻無一經過證實。正確的回應既不是忽視謠言,也不是押注其上——而是調整決策的結構,讓自己不必做出選擇。
這就是路由(routing)的價值所在。當 GPT-6.7 上市時,要評估「慢 2 倍」這種說法,又不想因此賭上正式生產路徑,最合理的做法是把它放在你原本就在用的同一個 endpoint 後面:同一組 API key,一旦新模型表現不佳就自動故障轉移至 GPT-5.6 Sol,由真實流量來判斷這個傳聞是否屬實。於是,這個說法就成為一個量測結果,而不是一則推文。如果 OpenAI 的價格表隨新版本而變動,轉嫁費率也會在同一天更新——OrcaRouter 以零加價方式傳遞供應商的列表價格,因此供應商降價(或漲價)在這裡會立即生效,無需重新協商。
{{1}}與此同時,目前的旗艦產品才是實際的重點。{{/1}}{{2}}GPT-5.6 Sol 今日已在 OrcaRouter 上線,每百萬 tokens 收費 5/30 美元;記分板顯示其具備 1.05M token 的上下文長度與約 290 tok/s 的速度。{{/2}}{{3}}8 月 13 日公布的 Ultrafast 模式——速度最高提升 14 倍,在 Cerebras 基礎設施上每秒約可處理 750 個 tokens——適用於該模型,而非 GPT-6.7。這也提醒我們,OpenAI 既能靠核心(kernels),也能靠基礎設施來降低服務成本。{{/3}}

我們現在正在觀看的內容
• Bob 的離職是否得到確認。OpenAI 不評論 Bob 的身份;最接近的公開記錄是 Scott Gray 出現在 2026 年離職名單上。如果 OpenAI 或 Gray 確認此事,連鎖反應的第一環便成為事實。
• 「慢 2 倍」這個數字究竟會不會有依據。如果 GPT-6.7 正式發布,且出現獨立的測速數據,這個數字就不再是傳聞——要麼被證實,要麼被淘汰。在那之前,它只是貼文中的一個數字。
• Astra 的安全暫停是否會讓日期延後。預測市場已將 GPT-6 移出八月;「重大」指定以及 OpenAI 表示希望進行的政府測試,都是進一步延遲的自然來源。
• 內核基準測試是否會重新排序。如果 OpenAI 的服務團隊吸收了損失——或者傳言誇大了某個人的份額——整個謠言就無關緊要了,第一個跡象將是下一個模型相較於其前代的服務效能。
誠實的解讀:「慢兩倍」是個引人入勝的故事,但到目前為止,僅此而已。核心高手離職是確有其事的數據點,而且留下了完整的書面紀錄;速度數據只是推特上的一個數字。在 GPT-6.7 正式發布之前,站得住腳的立場是為兩種結果做好準備——假設這項傳聞可能部分屬實,並建立路由機制,讓測試一個比預期更慢的旗艦模型不花你任何成本。這正是為一個你尚未見過的模型做路由的全部意義。
