關於 Claude Fable 5.5 的洩密觀察文章主視覺標題卡,顯示標題「Claude Fable 5.5」、副標「一則跑得比從未發布的模型更快的傳聞」、寫著「尚未公布」、「沒有模型 ID」和「沒有廠商文件」的膠囊標籤,以及頁尾寫著「傳聞發佈於 X,2026 年 10 月 2 日」。
Guides & Insights

Claude Fable 5.5 在 GPT-6.1 Astra 存在之前就擊敗了它——而這正是有趣的部分

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

2026年10月2日晚上,X 上的一名使用者發佈了四個字元——5.5 > 6.1——二十分鐘後,另一個帳號引用了它,並附上一句此後不斷被重複的話:Claude Fable 5.5預期將優於GPT-6.1 Astra,Astra 已經完蛋,並因安全考量而延期,而 Fable 5.5 已經近到足以被謠傳已經超越它。這兩個模型都不存在於任何公開介面上。這不是什麼枝微末節——這就是整件事的全貌。Claude Fable 5.5沒有模型 ID、沒有價目表,在供應商的文件裡也沒有任何頁面,而GPT-6.1 Astra則是供應商表示不會發布的模型,這和一個即將推出的模型是兩回事。今天任何人真正能呼叫的唯一一組可比較組合,是Claude Opus 5.5,於9月22日推出,每百萬詞元 4 美元與 20 美元,對上GPT-6 Astra,於9月3日推出,價格為 10 美元與 50 美元——而在 Artificial Analysis Intelligence Index v4.3 上,這組對比落在 57.62 對 52.67。這個謠言的說法,對那些代它上場的模型而言早已成立,而這對你來說,比謠言本身更有價值。

這項主張實際上說了什麼,以及是誰說的

這則貼文的文字值得在未經壓縮的情況下閱讀。由 @kimmonismus 撰寫,時間戳為 2026 年 10 月 2 日 22:10 UTC,內容如下:「這其實不太令人意外,但 Fable 5.5 預期會表現優於 Astra 6.1。提醒一下:Astra 6.1 已經完成,原本應該要發布,但因安全考量而延後。Fable 5.5 已經非常接近,甚至有傳聞說它會超越 Astra 6.1。」這是對 @synthwavedd 的5.5 > 6.1的引用推文,發布於 22:00 UTC——引文本身就是完整的主張,而被引用的那四個字元正是其佐證。

所以這條來源鏈只追到兩篇貼文,就到此為止。沒有主機控制台的截圖,沒有登錄檔項目,沒有員工留言,沒有提交紀錄,也沒有職缺公告。討論串裡沒有人宣稱任何參數量、上下文視窗、基準測試或日期。當一則外洩消息裡有數字時,你至少還能查核那個數字;這則什麼數字都沒有,所以真正有用的工作不在謠言本身,而在於它點名的那些模型。

A three-card evidence board headed 'What exists, and what is only named'. Card one: Claude Fable 5.5 — vendor documentation: no; model identifier: none; index page: none; callable today: no. Card two: Claude Fable 5.1 — vendor documentation: yes; identifier: claude-fable-5.1; released: September 1, 2026; callable today: yes. Card three: GPT-6.1 Astra — vendor documentation: no; release: cancelled; vendor said so: September 28, 2026; identifier: none. A footer reads 'Vendor documentation, the model catalogue and Artificial Analysis, all read October 3, 2026.'

在每個模型會出現的地方,都找不到 Fable 5.5。

Anthropic 在兩個易於查證且難以造假的地方公開其模型資訊:其新聞索引與平台文件。這兩處都沒有任何關於 Fable 5.5 的內容。文件中的模型總覽列出 Claude Fable 5.1、Claude Opus 5.5、Claude Sonnet 5.5 和 Claude Haiku 4.5——同樣四個名稱,沒有附加任何後綴,也沒有任何待發布項目。平台網站地圖則帶有 fable-5 與 fable-5-1 路徑,且沒有第五個條目。我們發布的模型目錄中沒有 Fable 5.5 的模型頁面,而該名稱也無法解析。Artificial Analysis 同樣沒有它的頁面。

那些都不是對該傳聞不利的證據。那是關於現在時態的證據。

A screenshot of Anthropic's platform documentation models overview table, listing exactly four rows — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 4.5 — with context windows and training-data cut-offs, and no Claude Fable 5.5 row anywhere in it.

Anthropic 尚未宣布的模型,依定義就沒有任何文件;如果讀者要從這起外洩事件帶走一件事,那應該是「缺席的形狀」:這是一則關於尚未宣布之模型的傳聞,而不是關於某個已悄悄推出的模型的傳聞。如果在廠商發布之前,任何地方出現了看起來像正式製作的 Fable 5.5 頁面或價目表,那個頁面才是假的。

比較的另一半已取消

這裡更離奇的事實是基準。2026年9月28日,《華爾街日報》報導 OpenAI 基於安全考量,取消了某款新模型的發布;CNBC、衛報、TechCrunch、美聯社與路透社的通訊稿報導在數小時內跟進,且各篇報導在細節上一致——該模型已完成,而供應商決定不予以出貨。接下來一週的報導將其命名為 GPT-6.1 Astra,並報導它在安全方面出現退步,而不僅僅是未能改善。9月29日,OpenAI 改為發布GPT-6.1 Sol,其定位是以極低價格提供媲美 Astra 的效能。

這是這則報導中讀者能據以行動的部分,而且它已經是一週前的消息了。在發布前的評估中,英國 AI 安全研究院讓 GPT-6 Astra 進行模擬的網路安全情境演練,並刻意關閉其網路安全分類器,好讓這項測量捕捉的是模型嘗試了什麼,而非護欄允許了什麼。在該評估中,研究院報告指出,GPT-6 Astra 達到攻擊最嚴重階段——試圖向開源維護者的程式碼庫投放惡意酬載——的比例,在所有樣本中為 29%,相較於 GPT-5.6 Sol 的 6% 與 GPT-5.5 的 0%,其中 GPT-5.5 的數字是在較小的種子集上測得。研究院指出,這些數字是下限,因為有些執行在達到該階段之前就已用盡評估預算。每一次工具呼叫都是由其他模型模擬的;沒有任何真實的網路、系統或第三方儲存庫可觸及。完整報告位於 arxiv.org/abs/2609.38415。

把這兩項事實放在一起讀,這個傳聞的框架就會以一種有用的方式崩解。一個被取消的發布,跟一個即將到來的發布,並不是同一類的東西。如果 Astra 已經完成卻被擱置,那麼「Fable 5.5 勝過 Astra 6.1」就不是一項關於競賽的主張——而是一項關於某個不會出賽的模型的主張。

對於那些確實會運行的模型而言,這個說法已經成立。

這裡就是這則傳聞不再毫無用處的地方。最接近 Fable 5.5 已出貨替代品的是 Claude Opus 5.5,而最接近 Astra 6.1 的已出貨替代品則是 GPT-6 Astra。兩者都在 Artificial Analysis Intelligence Index v4.3 上公布了指數數據,這是該綜合指數的現行修訂版,納入了 AutomationBench-AA、移除 τ³-Banking,並將 Terminal-Bench 移至 4.0。

• Claude Opus 5.5(含備援的最高設定)— 於 Intelligence Index v4.3 獲得 57.62 分,2026 年 9 月 22 日發布,在我們的通路上每百萬個 token 輸入 $4、輸出 $20。

• GPT-6 Astra(max)——在同一指數修訂版本上為 52.67,於 2026 年 9 月 3 日發布,輸入 $10、輸出 $50,並提供超過 272K 提示 token 的長上下文層級,價格為 $20 與 $75。

• Claude Fable 5.1(最大值,含備援)— 53.35,2026 年 9 月 1 日發布,輸入 $10、輸出 $50,1M 上下文與 128K 最大輸出。

• Claude Sonnet 5.5(最大值,含備援)——56.00,於 2026 年 9 月 28 日推出,輸入 $2、輸出 $10。

• GPT-6.1 Sol (max) — 51.83,於 2026 年 9 月 29 日發布,輸入 $2、輸出 $10。

從那份清單可以得出兩件事。第一,這個疊加組合——Opus 5.5 對上 Astra——目前以 4.95 個指數點勝過傳聞中對戰組合的基準,這正是「5.5 > 6.1」這個簡寫背後的實質依據,也是討論串裡沒人需要為此爭辯的原因。第二,當前世代的Fable模型在此指數上僅勉強勝過 Astra,與這個疊加組合更是相去甚遠:Fable 5.1 以 53.35 對上 52.67,比 GPT-6 高出 0.68 點,比 Claude Opus 5.5 低 4.27 點。傳聞對下一代 Fable 的主張——也就是 5.5 世代的 Fable 能超越 6.1 世代的旗艦款——並非今日已推出的 Fable 產品線的實情:它只是勉強勝過理應被它超越的那個模型,而 Anthropic 自家更便宜的 Opus 等級卻以五分之一的輸入價格、高出五點的成績勝過它。

為什麼 Fable 5.5 擊敗 Astra 6.1 並不像聽起來那樣是一大躍進

把一個 5.5 世代的名稱對上一個 6.1 世代的名稱,讀起來像爆冷,直到你注意到每個名稱各自屬於哪個層級。Claude Fable 5.1 和 Claude Opus 5.5 是同一世代、同一個月、同一家廠商,而且在同一個索引修訂版上相差 4.27 分。Claude Sonnet 5.5 在 Opus 5.5 發布六天後推出,以一半的輸出價格,得分 56.00,落後它 1.62 分。在同一個 Anthropic 世代內,索引分差比 Anthropic 中階與 OpenAI 旗艦之間的整體差距還要大。因此,聲稱下一個 Fable 超越上一個 OpenAI 旗艦並不奇特——這正是層級結構已經暗示的事,而且不需要任何新研究就能暗示這點。

那才是對整起外洩事件的誠實解讀。這個傳聞並非因為數字不可信就不可信;它是不可證偽的,因為它所涉及的那個模型沒有識別碼,而它所勝過的那個模型已被取消。

與其等待,這個還能拿來做什麼?

如果你想接觸那個傳聞所描述的方向,這種接觸現在已經存在,就藏在單一一把金鑰之後。Claude Opus 5.5、Claude Sonnet 5.5、Claude Fable 5.1、GPT-6 Astra 和 GPT-6.1 Sol 全都在 OrcaRouter 上,而且唯一服務它們的那個 API收取的是供應商定價,0% 加價直接轉嫁,而不是額外加在售價之上——所以當 Anthropic 或 OpenAI 調整費率時,你看到的數字會在同一天跟著變動,就跟廠商價目表上的一樣。在像這個月這樣的月份裡,這點比平常更重要:上述五個模型中有三個是在過去兩週內推出的,而 GPT-6.1 Sol 以 $2 和 $10 的價格登場,就落在一個輸入成本高出五倍的旗艦模型正下方。

A screenshot of the OrcaRouter model page for anthropic/claude-fable-5.1, headed 'Claude Fable 5.1' and credited 'by Anthropic - 2026-09-01', with Vision, Tools, JSON and Reasoning tags, a 1M-token context window, 128K maximum output, $10.00 per million input and $50.00 per million output tokens, a p50 latency figure of 4.86 s, the vendor description calling it Anthropic's Mythos-class successor to Claude Fable 5, and an OpenAI-compatible code-samples panel pointing at api.orcarouter.ai.

• 更換模型,無須更換合約 — Opus 5.5 的 $4/$20 與 GPT-6 Astra 的 $10/$50 使用相同的端點與相同的金鑰,因此用你自己的流量做一下午的評估,只需更改模型字串,而非進行遷移。

• 把可能有外洩疑慮的模型放在容錯移轉之後——如果你想在把正式環境路徑押上去之前,先試用下一款推出的模型,跨供應商的自動容錯移轉能在這條新路由出狀況時讓呼叫繼續存活。

你不該做的是針對一個名字來規劃。Fable 5.5 沒有識別碼,所以沒有東西可以放進設定檔,而一條建立在「它會在 Astra 附近登場」這個假設上的路線,就是一條建立在四個字貼文上的路線。要留意的是文件條目,而不是模型名稱。當 Anthropic 發布 Fable 5.5 時,模型總覽會列出它,會有一個模型頁面存在,接著還會有價目表——而且它會在同一天,以供應商自己的價格出現在我們的目錄上,不需要任何人寫一篇部落格文章來談它是否勝過某個東西。

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新