〈GPT-6.5 Doug — 洩漏觀察〉一文的主視覺標題卡,帶有「未經驗證 · 尚未發布」徽章;眉題為「我們目前所知」,主標題是「GPT-6.5 Doug:不只是更大的模型」,副標題是「一位獨立分析師表示,OpenAI 的下一個旗艦模型是另一種不同的東西——不是 GPT-6 Astra 的放大版」。標籤顯示「來源:X/@teortaxesTex」、「2026 年 9 月 7 日」及「GPT-6 Astra 已於 9 月 3 日發布」。卡片列中,「GPT-6 Astra — 9 月 3 日已出貨」旁邊是虛線的「Doug — 據報 · 尚未發布」。OrcaRouter 標誌合成於右下角。
Guides & Insights

GPT-6.5「Doug」洩漏事件更正:Doug 是 GPT-6 Astra 的基礎模型

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

這個部落格追蹤過最短的洩漏週期大約只維持了十二小時。9月7日,獨立模型分析師teortaxesTex預測OpenAI的下一款旗艦將命名為GPT-6.5,內部代號是先前報導的預訓練任務「Doug」,而且它會是「某種不同的東西……不只是更大」——本質上的改變,而非規模升級。大約十二小時內他就收回了說法。經過調查,teortaxesTex表示他把錯誤的模型對應到了錯誤的名稱上:「Doug」不是未來的GPT-6.5。在他修正後的解讀中,它是GPT-6 Astra的基礎模型——OpenAI在9月3日以每百萬個token $10 / $50的價格推出的旗艦,上下文長度約105萬個token,其標準版於9月5日正式全面開放。依照這種說法,謠言圈整個8月追著跑的巨型預訓練任務,其實是已經上線量產之物的地基。

此頁面是一個「已知資訊追蹤頁」,因此標籤必須隨著修正而調整。GPT-6 Astra 是真的、可獨立測量、也可呼叫;圍繞它的代號故事則不是真的。teortaxesTex 的後續文章是他自己對所學到內容的陳述,並非 OpenAI 的官方聲明;而且「Doug」沒有任何工件——沒有識別碼、沒有模型選單條目、沒有雲端目錄列表——在任何詮釋下出現過。這次修正所要解決的,是這篇文章較早版本重複出現的誤讀。請將以下內容視為一條自我修正的傳聞脈絡;每一項宣稱仍可追溯至具名或匿名消息來源,而非 OpenAI。

該主張,以及該更正

嚴格解讀 teortaxesTex 的原始貼文,可以分成三部分:下一個 OpenAI 模型將採用 GPT-6.5 這個編號;它的代號是 Doug;以及它所代表的是一種本質上的改變,而非規模上的擴大。前兩部分是命名假設,與既有的代號報導一致。第三部分才是讓這篇貼文廣為流傳的原因,因為它超越了「何時」——也就是其他傳聞圈爭論不休的問題——並對「是什麼」提出主張。一個與眾不同而非更大的後繼者,不僅會重設 OpenAI 在獨立排行榜上的位置;還會改變下一波前沿的定義。

他的後續貼文大多收回了原先說法,而這則更正本身有三個部分。第一,「Doug」是 GPT-6/Astra 的基礎模型——不是蓄勢待發、另立的更大模型,而是已經出貨的 Astra 所由建構出的預訓練執行。第二,據報為 10 兆參數後繼者的「Bel」,用他的話來說,是「圈內兄弟的屁話」。第三,真正指向 Astra 之後會是什麼的預訓練執行,是在「大概不到兩個月前」開始的,用的代號還沒有人報導過。這三點都是 teortaxesTex 對他發現之事的陳述,語氣與原始外洩一致:作為關於傳言走向的訊號是有用的,作為文件則一文不值。其中沒有任何一點是 OpenAI 的確認,他也說,在他看來這些都不會改變太多——他是在說,原始貼文的戰略重點在改名之後依然成立。以下就值得針對這部分來測試。

「Doug」這個讀音從何而來——以及它如何被修正

未來模型的解讀並非始於 teortaxesTex。由於本文較早版本曾以此為依據,因此有必要精確追溯其源頭。8 月 7 日,研究公司 SemiAnalysis 發布了一份標註日期為 7 月 9 日的備忘錄,告知機構客戶:OpenAI 已「克服其預訓練問題」,且「一個代號為『Doug』的更大規模模型正在積極研發中。」兩天後,X 帳號 ChrisGPT 補齊了細節:Doug 與 GPT-6(多數帳號認為 GPT-6 即 Astra)並非同一個模型,它是 OpenAI 迄今規模最大的預訓練項目,最快可能在 11 月問世。憑藉這兩份報告,「Doug」就此成為一個年底登場、規模龐大且獨立項目的代稱。

Doug 反而是 Astra 底層基礎的解讀並非新鮮事——而這正是最強的理由,讓我們認為 teortaxesTex 的修正並非一時興起。三星證券(Samsung Securities)在 8 月 10 日發布的市場報告(即 teortaxesTex 後續發文的一個月前)已經記錄了社群中流傳的這項修正:該報告指出,有些帳號將 Doug 解讀為會在 Astra 之後推出的獨立模型,但「也有人修正指出,Doug 是作為 Astra 基礎的預訓練模型」,不過報告也註明,兩者的確切關係仍未獲得證實。涉及 Bel 時期的報導在同一點上出現分歧:匿名帳號 @synthwavedd 在 8 月 25 日的發文描述了一個名為「Bel」的已完成訓練,部分轉述稱其為 Doug 的後繼者,另一些則稱它「可能是 GPT-6 的基礎」。各帳號對這張模型譜系的描述始終不一致。teortaxesTex 的後續發文不過是選擇了三星報告早已記錄的那一方,並完全刪去了 Bel 這一層。

A generated infographic titled 'The Doug paper trail' showing five signal entries as stacked cards: 'Jul 9, 2026 — SemiAnalysis memo: OpenAI has overcome pre-training issues; a much larger model codenamed Doug actively in the works'; 'Dec 2025 — The Information: pre-training fixes validated in a model codenamed Garlic'; 'Aug 9, 2026 — X/@ChrisGPT: Doug is OpenAI's largest pre-training project yet, not the same as GPT-6, possible launch by November'; 'Aug 25, 2026 — X/@synthwavedd: finished pre-training run codenamed Bel, over 10T total parameters, described as Doug's successor'; and 'Sep 7, 2026 — X/@teortaxesTex: GPT-6.5 Doug will be something different, not just bigger'. Footer: 'All of the above is reported and unconfirmed — OpenAI has announced nothing.' The OrcaRouter logo is composited in the bottom-right corner.

把修正讀完之後,SemiAnalysis 和 ChrisGPT 的報導所追蹤的,其實是一場已進入最後階段的訓練,而非一個未來專案。一個在 7 月初「積極開發中」的基礎模型,能通過 8 月的安全審查,並在 9 月 3 日以產品形式推出——這代表該基礎模型的預訓練早在數月前就已結束;整個夏天則投入於強化學習、對齊,以及在 Astra 於 OpenAI 自家 Preparedness Framework 下被評為「Critical(嚴重)」網路安全等級之後的暫緩上線。這條時間線符合「Doug 是 Astra 的基礎模型」的說法,卻不符合「Doug 是 11 月才推出」的說法。如果 teortaxesTex 是對的,那麼 11 月的那個窗口屬於一場被誤讀的訓練,而報導中所承諾的另一個更大的 Doug,從一開始就看錯了對象。

什麼能從修正中倖存下來?

這套策略論述以重新構框的形式存續。SemiAnalysis 的核心論點——OpenAI 自 GPT-4o 以來的進展大多來自後訓練、強化學習,以及在較舊基礎上的推論期運算,而若缺乏更好的基礎,這些收益就會遞減——與該基礎所承載的代號無關。如果 Doug 是 Astra 的基礎模型,那麼備忘錄所預測的基礎模型重置已經發生,也已經交付:GPT-6 Astra 是重啟並修正後的預訓練的第一個產物,而非對 GPT-4o 時代大腦的再度打磨。

這讓測量到的紀錄更有意思,而不是更無趣。重啟後的首個產品,並非那些「最大的馬鈴薯」報導所宣稱的稱霸世界之作。在 Artificial Analysis 的智慧指數上,GPT-6 Astra (max) 拿到 61 分——在超過 200 個模型中約排名第八——而 Claude Fable 5.1 則以 66 分高居榜首。如果這就是重啟後的基底目前能換來的成果,那麼「不同,而不只是更大」從來就不是對 Astra 現況的描述;而是對下一個基底——不到兩個月前以未公開代號展開的那一輪訓練——最終能產出什麼的期望。原始外流的能量屬於未來那一輪,而不是大家爭論不休的那個代號。

A screenshot of the Artificial Analysis model page for GPT-6 Astra at maximum reasoning, showing the header 'GPT-6 Astra (max) — Intelligence, Performance & Price Analysis', an Intelligence ranking of #8 out of 202 models with a score of 61, input price $10.00 and output price $50.00 per 1M tokens, a cost-per-intelligence assessment calling it expensive relative to models of similar price, and a 1M-token context with an April 30, 2026 knowledge cutoff.

若這項修正成立,還會產生兩點進一步的意涵,而兩者都值得以推論、而非事實的形式陳述。首先,「後繼者很快就會到來」這條脈絡——山姆·奧特曼對 Axios 所說「能力強大得多、得多、多得多的模型即將問世」,以及那段流傳的影片片段,他在其中表示 OpenAI「最近談到要暫緩」的模型是「未來的模型」——不可能是指剛展開的預訓練任務;七月中旬才開始的任務,不可能在九月就變成產品。如果後繼者真的很快就會推出,那也會是 Doug/Astra 基礎模型經後續訓練的產物,而非新的基礎模型本身。其次,「Bel」一直是整個故事中最容易遭到這類駁斥的部分,而這正是下一節的主題。

來自匿名帳號 @synthwavedd 於8月25日發布的 Bel 報告,表面上看起來像是一起重大洩漏:OpenAI「完成」了一次超過1萬億總參數的巨型預訓練,被描述為 Doug 的後繼者,且在某些解讀中,是 GPT-6 世代的基礎。但這從未有實質內容。它追溯至單一匿名貼文;從未出現第二來源、無識別碼、無揀選器條目、無雲端列表;且轉述之間在最基本的問題上相互矛盾——Bel 究竟是在 Doug 之前還是之後——這顯示該帳號並無固定指涉對象。時間線本身也明顯不一致:一個基礎模型不可能在8月底「完成」預訓練,同時又是一個已經建置、完成安全審查、並準備在9月3日發佈之模型的基礎。

teortaxesTex 的駁斥——「內部人小圈子的鬼話」——比此前的任何報導都更直言不諱,但它指向同樣的證據。該部落格較早發布的後繼者解說文,在報告出爐當週就指出了 Bel/Doug 的不一致,而 Astra 發布解說文也帶有同樣的告誡。這項修正新增的是一個停止含糊其辭的理由:如果真正的後繼者預訓練是在不到兩個月前、以一個無人報導過的代號開始的,那麼「完成 10 兆參數的 Bel」這個故事就不只是未經證實——它所描述的,在修正後的時間線上,根本不可能存在。

什麼能解決這件事?

檢查清單沒有改變,而這項修正反而是提高了標準,而非降低標準。這個部落格追蹤的每一次 OpenAI 洩漏週期,都在官方公告前留下了一個可驗證的具體物件——Codex 用戶端程式碼中的 gpt-6-astra 識別碼、GPT-5.6 模型選擇器中的 Sol/Terra/Luna 名稱、Astra 之前出現在 Azure 與 Bedrock 的目錄清單。在 Doug 的報導中,沒有任何內容產生過這類證據,而這項修正也沒有改變這一點:即使 Doug 確實是 Astra 的基礎模型,這個名稱仍然只是一個內部代號,沒有任何工件曾加以證實。能夠為修正後的解讀定案的,會是一份 OpenAI 聲明、一張指明基礎模型的系統卡,或是一位知情人士帶著文件現身——而這些目前都不存在。在這些證據出現之前,「Doug 是 GPT-6 Astra 的基礎模型」這個說法的準確標籤是:最初稱其為 GPT-6.5 的分析師現在這麼說、一份一個月前的研究筆記記錄了社群中同樣的修正,而 OpenAI 至今未置一詞。

排程問題才是最讓修正資訊難以落地的部分。如果真正「下一次」的預訓練執行才開始兩個月且尚未命名,那麼報導中所有掛在「Doug」身上的日期——ChrisGPT 的十一月窗口、「很快就會推出」後續模型的預期——全都是掛錯了執行。讀者真正能依賴的資訊其實更有限:OpenAI 已推出 Astra,高層表示更強大的模型即將問世,而下一次基礎模型重置顯然很快就會到來。這些都不是發布日期,誠實的說法是:後續模型的時鐘是從某個標識符或公告出現時才開始計算——而不是從某個洩密者喊出一個代號開始。

故事落幕前該做些什麼

在更正時,任何與決策相關的事實都不會改變;因為現有的模型就是你能呼叫的模型。GPT-6 Astra 已上線並有基準測試結果,可透過 OpenAI 自己的 API 與 ChatGPT 方案使用——也可以在 OrcaRouter 以 OpenAI 官方定價 $10 / $50 取得,且其約 1.05M token 的上下文會按供應商定價原樣傳遞、不加價。如果你現在想對前沿模型取得第二意見,Claude Fable 5.1 在獨立指數中居冠,而GPT-5.6 Sol 仍是經實證更便宜、適合長上下文工作的 OpenAI 路線

A screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the breadcrumb 'Home » Models » OpenAI', the model title 'GPT-6 Astra', capability chips for Vision, Tools, JSON and Reasoning, 'by OpenAI · 2026-09-04', input pricing of $10.00 per 1M tokens and output pricing of $50.00 per 1M tokens, and a description of GPT-6 Astra as OpenAI's flagship model for long-horizon reasoning and agentic workflows.

有用的準備工作和修正之前並無不同,因為不確定性並沒有縮小——它只是轉移了位置。直通路由器能讓實際出現的任一後繼型號,透過你原本就在使用的金鑰即可呼叫,且按廠商公布的牌價計費,並在它出現在供應商目錄的同一天生效:無需第二份合約、無需改寫任何設定,價格變動也會在廠商發布的那一刻即時反映。此外,由於全新基礎模型正是那種未經實證、在完成壓力測試之前你不會想讓生產路徑押注其上的東西,因此自動故障轉移才是測試它的誠實做法:將正式環境釘在你已驗證的模型上,把一小部分影子流量導向新進者,讓真實請求來做決定。如果修正後的解讀是對的,而「Doug」其實只是某個你已可呼叫之模型下的基礎版本,那麼這一切設置便毫無浪費;就算那個未具名的後繼型號真的推出了,追隨小道消息所付出的代價也是零。

{{1}}此項修正的公正總結,是原始不確定性的一個更精煉版本。將「GPT-6.5」標在 Doug 身上的分析師 teortaxesTex,如今表示他先前搞錯了:Doug 其實是已出貨的 GPT-6 Astra 的基礎模型,「Bel」只是雜訊,而真正關鍵的預訓練執行,時長不到兩個月且尚未命名——這一看法,三星證券的一份研究報告早在一個月前就已記載,且至今沒有任何工件或 OpenAI 聲明予以證實。{{2}}真正留存下來的,是那個策略性觀點,如今已瞄準正確目標:OpenAI 已重啟基礎模型的預訓練,其首款產品在獨立指數上排名第八,而決定下一步走向的執行才剛剛開始。{{3}}可防禦的立場並未改變——持續稱呼你已驗證的模型,保留繞過下一個版本的選項,並將官方公告——而非代號或修正——視為唯一重要的時程表。

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新