
GPT-6 Astra 的後繼者:據報導 OpenAI 的下一代旗艦「很快」推出
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0345智能76程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
GPT-6 Astra,OpenAI 的新一代旗艦模型,已於 9 月 5 日星期五正式全面上市。到了隔週星期二,關於其後繼者的消息已不再只是傳聞,而是成為了一項白紙黑字的公開展示:9 月 8 日,OpenAI 表示,一個未發布、未命名的下一代模型——該公司形容其「能力顯著超越 GPT-6 Astra」——在 88 小時的執行中驅動了約 10,000 個平行代理,產出一份聲稱證明了三維 Navier-Stokes 方程式有限時間爆破解的成果,而該方程式正是數學領域七大 Clay 千禧年獎問題之一。這是 OpenAI 首度公開將「很快就會推出」的傳聞背後那個模型,描述為一個實際運作的系統,而非只是一個研究方向。這並不是一次正式的發布:沒有模型名稱、沒有發布日期、沒有 API 識別碼,而該證明本身也尚未經過獨立驗證。這是一篇「目前已知資訊」的整理報導,探討本週最重大的 AI 宣稱,對下一代旗艦模型而言,究竟透露了什麼、又沒有透露什麼。
該宣稱發布所在的那一週,原本就已是今年最繁忙的一週。Anthropic 於 9 月 1 日推出 Claude Fable 5.1,以及其設有存取門檻的網路安全與生物學姊妹模型 Claude Mythos 5.1。OpenAI 則於 9 月 3 日發布 GPT-6 Astra,定價為每百萬個 token 輸入 10 美元、輸出 50 美元,具備約 105 萬個 token 的上下文長度、128K 的輸出上限,並在其自家的 Preparedness Framework 之下,成為第一款獲得「Critical」網路安全評級的 OpenAI 模型。到了 9 月 5 日,標準版模型已普遍開放於付費 ChatGPT 各層級方案及 API。獨立評測榜單的成績不如發布素材那般亮眼:Claude Fable 5.1 以 66 分高居 Artificial Analysis Intelligence Index 榜首,而 GPT-6 Astra 以 61 分位居約第八名——依該追蹤機構的數據,這與其前代 GPT-5.6 Sol 持平,並落後於拿下 62 分的 Meta Muse Spark 1.3。
That gap is the backdrop for the "already obsolete" chatter, and it makes the real question not whether OpenAI has something bigger — its own people keep saying so — but how close it is, and what a near-term flagship swap would do to a decision you may have just made.
Sam實際上說的話
先從原始來源看起,因為二手轉述已偏離了它。Altman 在教堂山舉行的 G20 創新高峰會上接受 Axios 採訪(9 月 3 日報導)時表示,OpenAI「很快就會有能力強上很多、很多、很多的模型推出」;他警告「下一代模型會讓所有人清醒過來」;並形容未來發布節奏「以我們在對齊與安全方面能多快取得進展為準」。這就是「很快」背後的那句話。這是執行長真實、可公開引用的訊號——但請精確解讀:Altman 並未表示 GPT-6 Astra 的後繼模型幾天內就會問世,沒有點名任何模型,也沒有給出日期。他只說,更強大的模型即將到來,且時程繫於安全進展。而長期觀察 OpenAI 的 @kimmonismus 表示,他事後已確認這番話的所指:9 月 5 日,他表示自己收到官方確認——訪談完整逐字稿清楚顯示,「更強大的模型」這番話指的是 GPT-6 Astra 之後的模型,而非 Astra 本身;OpenAI「已經有更強大的模型排隊等著發布」。這應視為消息來源對私下確認的陳述,而非 OpenAI 可公開引用的聲明——但它與下方影片片段的方向一致,也與 OpenAI 自家研究人員的說法一致。兩者主張不同,對規劃的意涵也不同;混為一談,正是讓一則外洩消息變成假警報的原因。
較不受注意的那項證據反而更有力,因為那是 Altman 親自為 Astra 與其後的模型劃清界線。一段在9月5日流傳的影片——由帳號 @cgtwts 發布,並由 @kimmonismus 嵌入在上方那則貼文中——顯示 Altman 說:「GPT-6 Astra 完成訓練已經有一段時間了。我們最近談到要暫停的那個模型,呃,是未來的模型。但就 Astra 而言,我們的確達到了 cyber-critical。」先別管這段影片究竟出自哪場訪談;重點在於內容本身。在鏡頭前,OpenAI 的執行長說了三件重要的事:Astra 早在「一段時間」前就已結束訓練,所以它不是一個仍在摸索站穩腳步的模型;OpenAI「最近談到要暫停」的模型不是 Astra,而是「未來的模型」;而那項達到 cyber-critical 的判定正是落在 Astra 身上,但 Astra 還是照常推出。這就重新詮釋了8月那次延後 Astra 上市的安全暫停——依照執行長自己的說法,OpenAI 在8月中暫停的不只是大家矚目的旗艦模型,還包括後繼模型的工作。
研究人員正把那些平時不會明說的部分大聲講出來。
時間聲稱並非僅依賴 Altman 一人。OpenAI 相關研究人員在發布週期間公開向業界表示,Astra 是一個過渡點,而非終點。研究員 roon 寫道,他「甚至還沒觸及 Astra 能力的皮毛」,並補充:「我想它大概會在幾週內以某種方式過時。」另一位研究員 Zuxin Liu 描述感受到「RSI 的強勁動能」——即遞歸式自我改良,也就是 OpenAI 利用當前模型來建構下一個模型的循環。這些是實驗室內部人員的公開發文,而非正式公告,應將其視為內部訊號而非事實。但若與 Altman 的「未來模型」說法一同解讀,它們描繪的是一個不願等待自然節奏的實驗室:如果 Astra 被用來訓練自己的後繼者,那麼後繼者的問世速度可能遠比 GPT-5.6 Sol(7 月 9 日)與 GPT-6 Astra(9 月 3 日)之間八週的間隔所暗示的還要快得多。
同一週,公司的敘事又往前推進了一步。Greg Brockman 在發表會上以「歡迎來到 AGI 時代」作為論述框架,Altman 在 8 月底對《時代》雜誌表示 OpenAI 可能在 2026 年底前擁有一個他會稱為 AGI 的系統,而首席研究官 Mark Chen 提出「已走了 80%」的數字——這些都顯示,該組織正將 Astra 呈現為一條更快速序列中的一步。這些都不是發布日期,但全部與「很快就會到來」的解讀方向一致。
9月8日的證明主張
9月8日,這個故事有了一項具體的產物,而它並非洩漏。OpenAI表示,一個內部未發布的下一代模型——同樣未命名、同樣未註明日期——在一次自主運行的88小時中,有多達10,000個代理並行工作,產出了一份聲稱的證明,證明三維納維-斯托克斯方程式可能發展出有限時間奇異性:即光滑流體演化至渦旋收緊並加速旋轉,速度最終變得無界,而總能量保持有限。這個問題是七個一百萬美元千禧年大獎難題之一,而七個之中只有一個——龐加萊猜想——曾被解決。OpenAI表示,這項努力於9月1日開始,耗費了數百萬美元的計算資源,並被定位為能力展示,而非爭取獎金:該公司表示不會領取這一百萬美元。該段落的每一項陳述都是OpenAI單方面所稱;其中沒有任何內容被獨立重現,也沒有任何內容點明具體的模型或發布日期。
在你心中,這項宣稱的定位就應該是「存在驗證缺口」。截至宣布之時,數學界尚未審核該證明,而媒體對OpenAI究竟是否發布了完整論文也說法不一。克雷數學研究所所長馬丁·布里德森(Martin Bridson)指出,在數學界眼中,該千禧年大獎難題仍懸而未決——該問題的經典表述是針對無外力方程式,而OpenAI所稱的結果涉及的則是有外力變體——包括菲爾茲獎得主蒂莫西·高爾斯(Timothy Gowers)在內的數學家也表示,這項宣稱需要數學界的審查。這與可驗證數學應有的運作方式形成了鮮明對比:紐約大學數學家特里斯坦·巴克馬斯特(Tristan Buckmaster)和Anthropic數學家萊文特·阿爾珀格(Levent Alpöge)在前一天(9月7日)發布了他們自己的相關成果,並附帶了可用機器檢查的Lean形式化驗證,而OpenAI的宣布則是在一場媒體電話會議上作出的。
9月8日也開啟了一場關於成果來源的爭論,而這會影響你如何看待這項宣稱。巴克馬斯特(Buckmaster)和阿爾珀格(Alpöge)花了約一年時間研究密切相關的有限時間爆破解問題,期間混合使用了Anthropic的Claude以及OpenAI的Codex和GPT-6 Astra模型。巴克馬斯特表示,OpenAI在9月6日聯繫了他,稱其模型已沿著與他們極為相似的路徑產出了一份證明;他並指控OpenAI的塞巴斯蒂安·布貝克(Sébastien Bubeck)施壓要他將阿爾珀格從聯合公告中除名,理由是阿爾珀格任職於Anthropic,且布貝克還說了讓巴克馬斯特解讀為職涯威脅的話。OpenAI否認此說法——布貝克稱其「虛假且具煽動性」——並表示其研究人員或代理人皆未在兩人成果公開前看過他們的工作;OpenAI僅承認無法排除自家產品的去識別化資料對其模型產生了影響。這些是關於私人對話的爭議性說法;中立的總結是:兩個團隊在數日內先後得出了相關結果,而這起爭端如今已成為圍繞OpenAI所隱瞞內容的氛圍的一部分。
謠言工廠對它的稱呼
故事之所以變得難以捉摸,正是從這些名字開始的,因此有必要明確說明目前的局勢。本站的Astra發佈說明文章已經介紹了圍繞下一代產品流傳的兩個代號:「Doug」——SemiAnalysis於8月7日向機構客戶表示,這是一個「規模大得多」的OpenAI模型,且「正在積極開發中」;匿名X帳號Chris GPT則聲稱,這將是OpenAI迄今規模最大的預訓練任務,並會讓Claude Fable 5看起來「原始」;以及「Bel」——匿名X帳號@synthwavedd於8月25日報導稱,這是一個已完成的預訓練任務,總參數量超過10萬億,被描述為Doug的繼任者。關於這兩個代號的報導並不一致——有些說法認為Bel是剛以GPT-6 Astra名義推出的GPT-6世代的基礎,有些則認為它是其後的下一代模型——而且所有資訊都追溯到匿名帳號,OpenAI內部並無具名消息來源。
本週的變化在於,奧特曼自己的說法如今也指向與「Bel 為繼任者」相同的解讀方向。若依執行長所言,OpenAI 已為了安全審查而暫停某個「未來模型」,那麼「一個已完成預訓練的模型正擱在流程中、等待對齊工作完成」這個想法,就不再只是匿名貼文——它與 OpenAI 自己的公開說法是一致的。請把這些代號視為暫用標記,而非產品名稱。OpenAI 的命名過往就曾領先於各路臆測:本部落格整個夏天以暫定名稱 GPT-6.7 追蹤的那個模型,最終是以 GPT-6 Astra 之名推出。Doug 與 Bel 也理應獲得同樣的懷疑與同樣的耐心。重點不在於哪個代號最後留下,而在於目前仍未出現任何真正的正式識別名稱——而那正是接下來該密切觀察的具體訊號。
懷疑論的論據
支持從速行事的論點,從上述引文中不言自明。反對的論點也同樣值得重視,因為它立足於OpenAI實際做了什麼,而非其人員說了什麼。
首先,這次推出仍在逐步穩定中。GPT-6 Astra 的標準模型直到 9 月 5 日才全面開放使用;其更高階版本 GPT-6-Astra-Pro 則在同一週才陸續登陸 Pro、Business 和 Enterprise 方案。而 OpenAI 在那一週都在處理媒體所描述的混亂推出過程,包括 Altman 在第二天承認這次發布並未如預期順利。即使在 OpenAI 的標準下,在這種情況下推出後續版本也會顯得很奇怪。
其次,節奏數據駁斥了「數天」的說法。OpenAI 在 2026 年展現的旗艦產品節奏大約是兩個月——7 月 9 日推出 GPT-5.6 Sol,9 月 3 日推出 GPT-6 Astra。在 Astra 之後一週就推出後繼產品,速度快了一個數量級,而且這與 OpenAI 花了一個月對外傳達的安全節奏訊息相衝突:Astra 上市之所以從 8 月延期,完全是因為那項「嚴重」發現,而 Altman 也表示發布現在取決於對齊與安全進展。一個在 8 月中旬出於安全考量暫停其最大前沿專案、卻在 9 月中旬推出後繼產品的實驗室,要不是極快地解決了那項發現,就是從未真正暫停過真正重要的部分。
第三點,也是最具體的一點:本週的產物是一項宣稱,而非產品。這個部落格追蹤的每一次先前洩漏週期,都在背後留下了可驗證的物件——gpt-6-astra 識別碼在發布前就出現在 Codex 用戶端程式碼中,而一個被抹除的「gpt-nathree」PR 簽名也從 OpenAI 自家的儲存庫中流出。9 月 8 日的 Navier-Stokes 公告則屬另一種物件:OpenAI 表示其尚未發布的次世代模型運行了約 10,000 個代理、共 88 小時,並產出一份證明;但該證明發布後無法被稽核,媒體對完整論文是否甚至已公開也看法不一,而 OpenAI 將整件事定位為能力展示,而非朝發布日期推進的進展。一個你無法查證的宣稱,更接近執行長的一句話,而非一個識別碼——它告訴你後繼者存在且已在運行,卻幾乎沒有告訴你何時能用到它。
以下這個解釋能讓這三點同時成立:Astra 在「一段時間」前就已完成,並一直處於安全審查之中;後繼模型才是 8 月真正被暫停的那一個;而暫停是出於安全管控,而非能力問題。如果實際順序是這樣,後繼模型就不是「正在打造中」——它早已打造完成,變數只在於 OpenAI 多快能清完安全相關作業。9月8日的披露也符合這種解讀:OpenAI 表示,其下一代模型已於 9月1日展開 Navier-Stokes 相關工作;這不像是一個仍在組裝模型的實驗室會有的行為,反而像是一個已拿自己所能找到的最困難問題來操練該模型的實驗室。正是在這種情況下,「很快」才顯得合理,而「數週而非數月」才是正確的解讀。但這種情況也同樣意味著,沒有什麼是確定的——曾讓 Astra 延後一次的安全關卡,可能再次讓下一個模型延後;況且,能力展示並不就是產品決策。

繼任者必須改變什麼
由於對模型本身一無所知,要推測它的用途,唯一誠實的做法是從剛發布的內容中讀出那些缺口。這些是值得留意的假設,而非可據以規劃的事實。
• 獨立指數的差距。GPT-6 Astra 的發表資料宣稱了那些頭條數字,但在 Artificial Analysis 的 Intelligence Index 上,它落在 61 分,而 Claude Fable 5.1 是 66 分。能扭轉這項差距的後繼產品——而非只是在廠商基準測試中再次宣示優勢——才是「更新」與「真正躍進」之間的差別。
• 價格與上下文這條線。GPT-6 Astra 以 $10 / $50 的價格推出,並提供約 1.05M 的上下文。OpenAI 今年已經調降過一次 GPT-5.6 系列的定價,而若後繼者以更低的建議售價、更大的上下文,或更便宜的持續推理成本登場,其改變採用決策算式的能力將超過任何基準測試的差異。要像關注模型卡一樣關注價格表。
• 電腦使用的天花板。GPT-6 Astra 的發布主打是長期自主性——「你在電腦上能做的任何事」——而廠商回報的 OSWorld 2.0 分數(72.6% 部分得分)正是競爭對手已在攻擊的數字。能讓這些自主性宣稱在獨立測試下站得住腳的繼任產品,其意義遠大於一次指標提升。
安全門。這是最具OpenAI特殊性的變數。Astra出貨時,其最先進的網路安全能力被限制在信任存取計畫內,而Altman如今已在影片中表示,遭暫停的「未來模型」是真實存在的。觀察後繼者是否會以同樣方式通過Critical門檻、以受限形式出貨,還是觸發更長時間的審查——每一種結果都說明了它距離實現有多近。
名稱。它是留在Astra系列,跳到GPT-7,還是以全新系列名稱登場?OpenAI直到發布前數天仍在決定Astra本身是否會以「GPT-6」名義出貨。出貨名稱——而非傳聞——才是策略意圖的關鍵。
等待時可以做什麼
從今日即可使用的產品出發,因為它們不會因一則聲明或謠言而改變。GPT-6 Astra是真實存在的、有基準測試數據、並可透過OpenAI自家API及ChatGPT方案取得;Claude Fable 5.1真實存在、有基準測試數據、且目前位居獨立指數之首;GPT-5.6 Sol仍是OpenAI在長上下文工作上兼具價格與效能的首選。直到本週之前,所有關於後繼模型的數字,都只是執行長的含糊說詞或匿名貼文;如今其中一項已成為OpenAI自家的能力聲明,是在記者會上提出、且未經實驗室外任何人士驗證的。兩者都不是規格表。為了某個尚未命名——且其最廣為人知的成就根本無法查證——的模型,重新建構一條生產路徑,那只不過是偽裝成工程學的臆測。
真正有用的工作,是讓下一個版本若真的上線時能被低成本採用——而這正是路由層證明其存在價值(而不只是賺取費用)的所在。GPT-5.6 Sol 已於今日在 OrcaRouter 上線,採用 OpenAI 自家的每百萬 token 4 美元/20 美元定價,其中 105 萬 token 的上下文按供應商目錄價格原價傳遞,零加成、無需重新議價。若後繼版本真的出現在供應商目錄中,同一規則照樣適用:它可透過你原本就在使用的金鑰、以及你原本就在呼叫的端點來呼叫,以廠商自家價格,當天即刻上線。那一刻也正是故障轉移模式證明自身價值的時刻。一個服務行為尚未驗證過的全新旗艦模型,正是路由規則的教科書級案例:把正式環境鎖定在你已驗證的模型上,將一部分影子流量指向新來者,讓真實請求——而不是一篇上線公告——來決定它是否該坐上主力位置。在 OrcaRouter 上,這只是修改一段路由字串,而非一次遷移。至於對「很快」判斷錯誤所要付出的代價,正是路由機制存在所要吸收的東西。

看什麼
• 一個識別碼。模式是一致的:gpt-6-astra 的識別碼在 OpenAI 宣布推出之前就從 Codex 用戶端程式碼中洩漏,而一個經清理的「gpt-nathree」提交簽名也從 OpenAI 的儲存庫中流出。當後繼者真正接近時,預期在第三方用戶端、雲端模型清單或 OpenAI 自己的 API 變更日誌中看到字串,而非任何公告。這就是真實訊號與執行長時間表之間的差異。
• 命名方式。Astra 系列、GPT-7,或是全新的系列名稱——無論哪一個先出現,都能讓你看穿 OpenAI 究竟是把這視為剛推出旗艦機種的升級版,還是整個世代的重置。
• 安全門。被暫停的「未來模型」是最具資訊量的單一變數。如果它能快速通過關鍵門檻並以受控方式推出,那麼「很快」的解讀就是正確的。如果它觸發更長時間的審查,那麼八月的暫停就不僅僅是控制措施——時程表也會隨之延後。
• 獨立數字。當繼任者真正出貨時,第一批 Artificial Analysis 和 LMArena 評測結果會比任何發布記分板都重要;每個廠商的數據都應註明為廠商數據,直到獨立方加以複現。GPT-6 Astra 自身的發布就是前車之鑑:行銷說一套,指數說另一套。
• 價格表。OpenAI 今年已調降過一次 GPT-5.6 的定價。若後續機型以更低的建議售價登場,將重置整個前沿經濟——而在直通路由器上,這項變更會在供應商發布當天即時生效。
• 證明是否變得可核查。OpenAI 將其 Navier-Stokes 運算視為能力的展示,而展示並不要求它公開證明。如果最終有書面報告及任何形式化內容供社群審查,那是關於 OpenAI 打算如何使用其下一代模型的一種訊號;如果這項說法只停留在媒體發布層面,那就是另一種訊號。兩者都不會改變發布日期,但這項區別如今是判斷後繼模型實際用途的最清晰依據。

常見問題
OpenAI 是否已確認 GPT-6 Astra 的後繼產品?
這不是作為產品推出的消息。山姆·奧特曼向Axios表示,OpenAI「很快將推出能力強大得多、多得多、多得多的模型」,而在9月8日,OpenAI公開描述一款尚未發布、尚未命名的下一代模型——「能力遠超GPT-6 Astra」——稱其產出了所宣稱的Navier-Stokes證明。OpenAI尚未做到的是:為該模型命名、定價、設定發布日期,或在任何API中顯示其識別碼。這款後繼模型的存在性已由OpenAI官方證實;但其可用性則尚未確定。
後繼者會被稱為什麼——GPT-6.7、Doug,還是Bel?
這些都不是產品名稱。GPT-6.7 是這個部落格整個夏天追蹤的工作名稱,指的是後來以 GPT-6 Astra 之名推出的世代。Doug 和 Bel 是分別被報導的預訓練運行,不同帳號之間的系譜說法並不一致——有些人認為 Bel 是 GPT-6 世代的基礎,有些人則認為它是後續的模型。只有在出現識別符號或官方公告時,才會知道真正的名稱。
Navier-Stokes 證明是已驗證的結果嗎?
不。這是OpenAI在9月8日的一場電話記者會上所宣稱的內容,實驗室以外沒有任何人事先查證過。數學界尚未審查任何書面報告,各家媒體對是否已發布報告說法不一;克萊數學研究所所長馬丁·布里德森指出,該獎項問題仍未解——其經典表述是針對無外力方程式,而OpenAI所報導的結果涉及的是受迫變體;OpenAI也表示無論如何不會領取這100萬美元。將此與特里斯坦·巴克馬斯特和萊文特·阿爾珀格在9月7日發布的相關結果相比,後者附帶了可用機器檢查的Lean形式化驗證。一個數學宣稱在有人能檢查之前,還不算數學成果。
我是否應該暫緩在 GPT-6 Astra 上進行開發?
沒有單一答案,因為目前現存的模型都已通過基準測試,而後繼模型尚不存在。如果一個長時程代理(agent)的建置依賴於可能在數週內就被重置的旗艦模型,防禦性的做法就是持續呼叫你已驗證的模型,並保有無須改寫即可切換的能力——這正是具備容錯移轉的路由層的用途。讓官方公告,而非洩漏消息,來帶動你的流量。
誠實的總結,是一項裝了時鐘的主張。一位廣受關注的 OpenAI 觀察者表示,GPT-6 Astra 的後繼者「很快就會到來」;Sam Altman 告訴 Axios,能力遠更強的模型正按照以安全為步調的時程推出——對此,OpenAI 觀察者 @kimmonismus 表示,他已經從完整逐字稿證實這項解讀,所指涉的是超越 GPT-6 Astra 的模型,而非 Astra 本身——Altman 也在影片中表示,OpenAI 暫緩推出的是一款未來的模型;OpenAI 自家的研究人員正公開表示,GPT-6 Astra 在幾週內就會過時;9月8日,OpenAI 自己更表示,一款尚未發布的次世代模型「能力顯著超越 GPT-6 Astra」,產生了其 Navier-Stokes 證明的宣稱。上述沒有一項是正式發布,沒有指名任何型號,也沒有設定日期,而那項證明也還不是經過驗證的結果——本文中每一項具體期待,到下週此時都可能被證明是錯的。沒有爭議的是:GPT-6 Astra 確實存在且能運作,Claude Fable 5.1 在獨立指數上高居其上,而且 OpenAI 還有一條更便宜的路徑——透過 OrcaRouter 以 $4 / $20 提供的 GPT-5.6 Sol——依然有效,足以應付不需要全新旗艦模型的工作。面對這類主張,唯一站得住腳的姿態,是零成本的那種:繼續作你一直在作的判斷,保留繞過下一次發布的選項,並把正式發布——以及稽核——當作唯一要緊的時程。
本文中的比較3
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
