
Claude Fable 5.1 對比 Claude Fable 5:Anthropic 自家旗艦更新究竟帶來什麼
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0241智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0240智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0340智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2134智能69程式
Claude Fable 5.1 是 Anthropic 目前的旗艦模型,於 2026 年 9 月 1 日推出,而對大多數團隊來說,最重要的對決正是 Anthropic 自己安排的:Claude Fable 5.1 對上它在 6 月 9 日推出、如今被取代的旗艦 Claude Fable 5。兩者價格完全相同——每百萬輸入 token 10.00 美元、每百萬輸出 token 50.00 美元——100 萬 token 的上下文視窗也一樣。真正改變的是長時間代理式工作的特性:Anthropic 自家數據顯示,Fable 5.1 在其最難的科學代理基準上,表現是 Fable 5 的兩倍以上;而本週關於企業在資料保留方面如何對待 Fable 系列的報導,讓這次改版有了第二項更銳利的優勢,對任何今天要在兩者之間做選擇的人來說都是如此。
先說明日期與消息來源:Claude Fable 5.1 於 9 月 1 日推出,因此這個模型本身已有兩週歷史,並非突發新聞。目前最新的是 2026 年 9 月 14 日一則歸屬於 The Information 的報導,指出 Nvidia、Palantir 與 Booz Allen 因擔心敏感企業資料留存問題,正限制使用 Anthropic 的 Fable 系列;並指出 Anthropic 在 6 月為安全監控推出了滾動式 30 天使用紀錄,客戶可選擇自行儲存這些紀錄,「仍可撤銷」。該報導有具名消息來源,但尚未經獨立證實。下文所有標示為廠商提供的內容,均為 Anthropic 自家的基準測試表,尚未由中立第三方重現。
規格表,逐項檢視
• 價格 — Claude Fable 5.1 每 100 萬個 token 輸入 $10.00/輸出 $50.00,與 Claude Fable 5 相同。兩者的價格在本次刷新時均未變動。
• 快取輸入 — Claude Fable 5.1 每 100 萬個 token 為 $0.25,較 Claude Fable 5 的 $1.00 下降 75%。快取寫入 $12.50(5 分鐘)/ $20(1 小時);批次模式 $5 / $25。
• 上下文與輸出 — 兩者都具備 1M token 的輸入視窗,以及最多 128K 的輸出 token;兩者都接受文字與圖片輸入;兩者都位於相同的自適應推理介面之後,並具備一個可從低到最高調整的努力程度旋鈕。
• 獨立分數——在 Artificial Analysis 的 Intelligence Index 當前版本上,Claude Fable 5.1 得分為 53,在追蹤的 201 個模型中排名第一,輸出速度為每秒 67.2 個輸出 token,每項 index 任務成本為 $7.63。Claude Fable 5 的發布規模 index 數值(62)早於九月重述,無法相比,因此我們不引用其當前規模的數字。
• 廠商基準測試 — Anthropic 報告指出,Claude Fable 5.1 在 Terminal-Bench-Science 0.1 上達到 52.6%,相較於 Claude Fable 5 的 24.7%;在 Terminal-Bench 4.0 上為 55.8%,相較於 42.0%;在 AutomationBench 上為 31.4%,相較於 17.1%;而在 CursorBench 3.2.0 上則為 73.4%,相較於 70.5%。
• 發佈 — Claude Fable 5.1 於 2026 年 9 月 1 日;Claude Fable 5 於 2026 年 6 月 9 日。
在這裡,重新整理才真的是重新整理
Fable 5.1 發布最引人注目的手法是:價目表上沒有任何東西變動,而基準測試表上幾乎所有項目都變了。這些提升集中在長時程、使用工具、代理式的工作上——Terminal-Bench-Science 0.1 從 24.7% 增加到 52.6%,成長超過一倍;Terminal-Bench 4.0 從 42.0% 攀升至 55.8%;AutomationBench 從 17.1% 幾近翻倍至 31.4%。在 Humanity's Last Exam 上,Anthropic 回報的成績是無工具 60.9%、有工具 65.0%,而 Claude Fable 5 則分別為 57.8% 與 63.8%。這些數字應理解為發展方向:它們是供應商自家的表格,而最誇張的單一數字說法描述的是受閘控的同系列模型 Claude Mythos 5.1,它在更嚴格的護欄背後共用相同權重。

第二個槓桿是成本,而它的重要性勝過任何單一基準測試。快取輸入的價格從每百萬詞元 $1.00 降到 $0.25,而在長時間的代理式執行中,重複讀取才是主導因素:工具輸出、檔案內容與先前的對話輪次會被一遍又一遍地重新送出。Anthropic 估計,在典型的按詞元計費工作負載上,有效成本約可降低 25%,在高度代理式的工作負載上更可降低多達 45%——這是廠商自行提出的估計,但底層的價格變動可在價目表上獲得驗證。一個長時程代理若在一項任務中重複讀取 100K 詞元的脈絡五十次,按 Claude Fable 5 的定價,需支付 $5.00 的快取讀取費用,而按 Claude Fable 5.1 的定價則為 $1.25。當規模擴及一整群代理時,這筆費用就不再只是誤差尾數了。
第三項變革是前一代使用者最先感受到的:安全分類器。開發者替舊行為取了個綽號叫「Fable 的憂鬱」——付了旗艦級的錢,換來的卻是當分類器把無害請求標記為有問題時,默默被改派給較弱模型所產生的輸出。Anthropic 表示,Fable 5.1 的網路安全防護機制現在在每個 Claude Code 工作階段中造成的介入次數大約少了 60%,而且生物安全防護機制在無害請求上的觸發頻率,比起 Fable 5 剛推出時少了 85%。如果你對六月版模型的抱怨是關於任務進行到一半被交接給其他模型,這次升級正是直接針對這點而來。
本週的留存故事,以及它對決策的影響
9月14日的報導,是改變企業盤算的那一部分,因為 Fable 系列正是 Anthropic 最強大模型所屬之處,也因為資料保留立場正是受監管買家無法含糊帶過的那種事。據報導,Anthropic 在6月推出了用於安全監控的滾動式30天使用日誌;客戶被告知可以改為自行儲存這些日誌;而報導稱該選項「仍可被撤銷」。Palantir 被描述為在取得不可撤銷的零資料保留保證之前,會暫不採用 Fable;Nvidia 被描述為將 Fable 限制在較不敏感的工作;Booz Allen 則被描述為將其排除在專有資安工作之外。這一切都是有消息來源的報導,點名的公司均未確認,而其實際影響並不一致:有些客戶會非常在意,有些則完全不在意。
它對「5.1 還是 5」這項決策的影響,值得精確說明。資料保留的狀況適用於整個 Fable 系列——這不是兩個模型之間的新差異,因為 Fable 5 與 Fable 5.1 採相同的資料保留立場。它真正改變的是風險加權後的計算:如果你的工作負載敏感到連可撤銷的自我儲存選項都構成不合格條件,那麼今天這兩個模型都過不了門檻,而這個話題應歸入 Anthropic 的 Enterprise Frontier Safeguards (EFS) 路線圖;該路線圖據稱會從 2026 年秋季起,為符合資格的客戶分階段導入零資料保留。如果你的工作負載沒有那麼敏感,資料保留報告不應勸你放棄真正的效能升級——但它應該被載明於決策紀錄中,而不是事後才被發現。

該由誰來選擇哪一個
當錯誤或遭捨棄答案的成本壓過 token 成本時,就選 Claude Fable 5.1:長時程代理式研究、大量工具使用、任何活在 Claude Code 裡的東西,以及那些 75% 更便宜的快取讀取會改變你單位經濟的工作負載。當你的流量短、單次且能容忍吞吐量時,就繼續用 Claude Fable 5——價格完全相同,而舊模型的評分仍屬前沿水準——或者當你正處於合約期中,且遷移負擔確實存在時。誠實的中間路線是根本不要選:兩個模型都位於同一個 Anthropic API 介面之後,而如果你透過單一端點呼叫它們,就可以在任務需要推理上限時升級到 Claude Fable 5.1,並讓這對定價相同、成本更低的組合共享容錯移轉,而無需第二份合約。
在 OrcaRouter 上,Claude Fable 5 與 Claude Fable 5.1 皆以其供應商的定價提供,零加成,因此上述的 $10 / $50 就是帳單上的數字,而 Anthropic 自家的價格變動會在同日直接反映,而非被吸收進轉售商的利潤之中。用你自己的流量來測試這次更新,不過是編輯一條路由規則,並具備自動容錯移轉——這兩個模型共用同一把金鑰,因此切換成本幾乎為零,而模型融合能在任務重要到值得聽取不只一種意見時,讓一組模型共同作答。

簡短版:Claude Fable 5.1 的價格與 Claude Fable 5 相同,在 Anthropic 所強調的代理式科學基準測試上大約強上一倍,在長時間工作階段中佔主導地位的快取讀取成本便宜 75%,而且在任務進行到一半時把您的請求轉交給較弱模型的機率明顯更低。9 月 14 日的留存資料報告確有其事,如果您是資料要求嚴格的企業,值得納入考量——但它適用於整個系列,而非這次的特定升級,而且在一個早已由基準測試與快取成本計算定案的決策裡,它應該只佔一行。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
