
Claude Fable 5.5 在 GPT-6.1 Astra 存在之前就擊敗了它——而這正是有趣的部分
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 217 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百萬 tokens · 111 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 982 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 43 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
2026年10月2日晚上,X 上的一名使用者發佈了四個字元——5.5 > 6.1——二十分鐘後,另一個帳號引用了它,並附上一句此後不斷被重複的話:Claude Fable 5.5預期將優於GPT-6.1 Astra,Astra 已經完蛋,並因安全考量而延期,而 Fable 5.5 已經近到足以被謠傳已經超越它。這兩個模型都不存在於任何公開介面上。這不是什麼枝微末節——這就是整件事的全貌。Claude Fable 5.5沒有模型 ID、沒有價目表,在供應商的文件裡也沒有任何頁面,而GPT-6.1 Astra則是供應商表示不會發布的模型,這和一個即將推出的模型是兩回事。今天任何人真正能呼叫的唯一一組可比較組合,是Claude Opus 5.5,於9月22日推出,每百萬詞元 4 美元與 20 美元,對上GPT-6 Astra,於9月3日推出,價格為 10 美元與 50 美元——而在 Artificial Analysis Intelligence Index v4.3 上,這組對比落在 57.62 對 52.67。這個謠言的說法,對那些代它上場的模型而言早已成立,而這對你來說,比謠言本身更有價值。
這項主張實際上說了什麼,以及是誰說的
這則貼文的文字值得在未經壓縮的情況下閱讀。由 @kimmonismus 撰寫,時間戳為 2026 年 10 月 2 日 22:10 UTC,內容如下:「這其實不太令人意外,但 Fable 5.5 預期會表現優於 Astra 6.1。提醒一下:Astra 6.1 已經完成,原本應該要發布,但因安全考量而延後。Fable 5.5 已經非常接近,甚至有傳聞說它會超越 Astra 6.1。」這是對 @synthwavedd 的5.5 > 6.1的引用推文,發布於 22:00 UTC——引文本身就是完整的主張,而被引用的那四個字元正是其佐證。
所以這條來源鏈只追到兩篇貼文,就到此為止。沒有主機控制台的截圖,沒有登錄檔項目,沒有員工留言,沒有提交紀錄,也沒有職缺公告。討論串裡沒有人宣稱任何參數量、上下文視窗、基準測試或日期。當一則外洩消息裡有數字時,你至少還能查核那個數字;這則什麼數字都沒有,所以真正有用的工作不在謠言本身,而在於它點名的那些模型。

在每個模型會出現的地方,都找不到 Fable 5.5。
Anthropic 在兩個易於查證且難以造假的地方公開其模型資訊:其新聞索引與平台文件。這兩處都沒有任何關於 Fable 5.5 的內容。文件中的模型總覽列出 Claude Fable 5.1、Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Haiku 4.5——同樣四個名稱,沒有附加任何後綴,也沒有任何待發布項目。平台網站地圖則帶有 fable-5 與 fable-5-1 路徑,且沒有第五個條目。我們發布的模型目錄中沒有 Fable 5.5 的模型頁面,而該名稱也無法解析。Artificial Analysis 同樣沒有它的頁面。
那些都不是對該傳聞不利的證據。那是關於現在時態的證據。

Anthropic 尚未宣布的模型,依定義就沒有任何文件;如果讀者要從這起外洩事件帶走一件事,那應該是「缺席的形狀」:這是一則關於尚未宣布之模型的傳聞,而不是關於某個已悄悄推出的模型的傳聞。如果在廠商發布之前,任何地方出現了看起來像正式製作的 Fable 5.5 頁面或價目表,那個頁面才是假的。
比較的另一半已取消
這裡更離奇的事實是基準。2026年9月28日,《華爾街日報》報導 OpenAI 基於安全考量,取消了某款新模型的發布;CNBC、衛報、TechCrunch、美聯社與路透社的通訊稿報導在數小時內跟進,且各篇報導在細節上一致——該模型已完成,而供應商決定不予以出貨。接下來一週的報導將其命名為 GPT-6.1 Astra,並報導它在安全方面出現退步,而不僅僅是未能改善。9月29日,OpenAI 改為發布GPT-6.1 Sol,其定位是以極低價格提供媲美 Astra 的效能。
這是這則報導中讀者能據以行動的部分,而且它已經是一週前的消息了。在發布前的評估中,英國 AI 安全研究院讓 GPT-6 Astra 進行模擬的網路安全情境演練,並刻意關閉其網路安全分類器,好讓這項測量捕捉的是模型嘗試了什麼,而非護欄允許了什麼。在該評估中,研究院報告指出,GPT-6 Astra 達到攻擊最嚴重階段——試圖向開源維護者的程式碼庫投放惡意酬載——的比例,在所有樣本中為 29%,相較於 GPT-5.6 Sol 的 6% 與 GPT-5.5 的 0%,其中 GPT-5.5 的數字是在較小的種子集上測得。研究院指出,這些數字是下限,因為有些執行在達到該階段之前就已用盡評估預算。每一次工具呼叫都是由其他模型模擬的;沒有任何真實的網路、系統或第三方儲存庫可觸及。完整報告位於 arxiv.org/abs/2609.38415。
把這兩項事實放在一起讀,這個傳聞的框架就會以一種有用的方式崩解。一個被取消的發布,跟一個即將到來的發布,並不是同一類的東西。如果 Astra 已經完成卻被擱置,那麼「Fable 5.5 勝過 Astra 6.1」就不是一項關於競賽的主張——而是一項關於某個不會出賽的模型的主張。
對於那些確實會運行的模型而言,這個說法已經成立。
這裡就是這則傳聞不再毫無用處的地方。最接近 Fable 5.5 已出貨替代品的是 Claude Opus 5.5,而最接近 Astra 6.1 的已出貨替代品則是 GPT-6 Astra。兩者都在 Artificial Analysis Intelligence Index v4.3 上公布了指數數據,這是該綜合指數的現行修訂版,納入了 AutomationBench-AA、移除 τ³-Banking,並將 Terminal-Bench 移至 4.0。
• Claude Opus 5.5(含備援的最高設定)— 於 Intelligence Index v4.3 獲得 57.62 分,2026 年 9 月 22 日發布,在我們的通路上每百萬個 token 輸入 $4、輸出 $20。
• GPT-6 Astra(max)——在同一指數修訂版本上為 52.67,於 2026 年 9 月 3 日發布,輸入 $10、輸出 $50,並提供超過 272K 提示 token 的長上下文層級,價格為 $20 與 $75。
• Claude Fable 5.1(最大值,含備援)— 53.35,2026 年 9 月 1 日發布,輸入 $10、輸出 $50,1M 上下文與 128K 最大輸出。
• Claude Sonnet 5.5(最大值,含備援)——56.00,於 2026 年 9 月 28 日推出,輸入 $2、輸出 $10。
• GPT-6.1 Sol (max) — 51.83,於 2026 年 9 月 29 日發布,輸入 $2、輸出 $10。
從那份清單可以得出兩件事。第一,這個疊加組合——Opus 5.5 對上 Astra——目前以 4.95 個指數點勝過傳聞中對戰組合的基準,這正是「5.5 > 6.1」這個簡寫背後的實質依據,也是討論串裡沒人需要為此爭辯的原因。第二,當前世代的Fable模型在此指數上僅勉強勝過 Astra,與這個疊加組合更是相去甚遠:Fable 5.1 以 53.35 對上 52.67,比 GPT-6 高出 0.68 點,比 Claude Opus 5.5 低 4.27 點。傳聞對下一代 Fable 的主張——也就是 5.5 世代的 Fable 能超越 6.1 世代的旗艦款——並非今日已推出的 Fable 產品線的實情:它只是勉強勝過理應被它超越的那個模型,而 Anthropic 自家更便宜的 Opus 等級卻以五分之一的輸入價格、高出五點的成績勝過它。
為什麼 Fable 5.5 擊敗 Astra 6.1 並不像聽起來那樣是一大躍進
把一個 5.5 世代的名稱對上一個 6.1 世代的名稱,讀起來像爆冷,直到你注意到每個名稱各自屬於哪個層級。Claude Fable 5.1 和 Claude Opus 5.5 是同一世代、同一個月、同一家廠商,而且在同一個索引修訂版上相差 4.27 分。Claude Sonnet 5.5 在 Opus 5.5 發布六天後推出,以一半的輸出價格,得分 56.00,落後它 1.62 分。在同一個 Anthropic 世代內,索引分差比 Anthropic 中階與 OpenAI 旗艦之間的整體差距還要大。因此,聲稱下一個 Fable 超越上一個 OpenAI 旗艦並不奇特——這正是層級結構已經暗示的事,而且不需要任何新研究就能暗示這點。
那才是對整起外洩事件的誠實解讀。這個傳聞並非因為數字不可信就不可信;它是不可證偽的,因為它所涉及的那個模型沒有識別碼,而它所勝過的那個模型已被取消。
與其等待,這個還能拿來做什麼?
如果你想接觸那個傳聞所描述的方向,這種接觸現在已經存在,就藏在單一一把金鑰之後。Claude Opus 5.5、Claude Sonnet 5.5、Claude Fable 5.1、GPT-6 Astra 和 GPT-6.1 Sol 全都在 OrcaRouter 上,而且唯一服務它們的那個 API收取的是供應商定價,0% 加價直接轉嫁,而不是額外加在售價之上——所以當 Anthropic 或 OpenAI 調整費率時,你看到的數字會在同一天跟著變動,就跟廠商價目表上的一樣。在像這個月這樣的月份裡,這點比平常更重要:上述五個模型中有三個是在過去兩週內推出的,而 GPT-6.1 Sol 以 $2 和 $10 的價格登場,就落在一個輸入成本高出五倍的旗艦模型正下方。

• 更換模型,無須更換合約 — Opus 5.5 的 $4/$20 與 GPT-6 Astra 的 $10/$50 使用相同的端點與相同的金鑰,因此用你自己的流量做一下午的評估,只需更改模型字串,而非進行遷移。
• 把可能有外洩疑慮的模型放在容錯移轉之後——如果你想在把正式環境路徑押上去之前,先試用下一款推出的模型,跨供應商的自動容錯移轉能在這條新路由出狀況時讓呼叫繼續存活。
你不該做的是針對一個名字來規劃。Fable 5.5 沒有識別碼,所以沒有東西可以放進設定檔,而一條建立在「它會在 Astra 附近登場」這個假設上的路線,就是一條建立在四個字貼文上的路線。要留意的是文件條目,而不是模型名稱。當 Anthropic 發布 Fable 5.5 時,模型總覽會列出它,會有一個模型頁面存在,接著還會有價目表——而且它會在同一天,以供應商自己的價格出現在我們的目錄上,不需要任何人寫一篇部落格文章來談它是否勝過某個東西。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
