Claude Fable 5 是 Anthropic 的 Mythos-class 模型——能力層級高於 Opus class——並經過安全調校以適用於一般用途。其能力超越 Anthropic 先前廣泛發佈的任何模型,在軟體工程、知識工作、視覺與科學研究領域均達到最先進成果;任務越長越複雜,其領先幅度就越大。它接受文字、圖像與檔案輸入並輸出文字,支援 100 萬 token 的上下文視窗,最多可輸出 12.8 萬 token,並具備自適應推理與結構化輸出能力。 Fable 5 專為自主、長週期工作而建:它在數百萬 token 範圍內保持連貫性,利用檔案式記憶改善自身輸出,且相較於先前模型,完成複雜多步驟任務所需的 Scaffolding 大幅減少。對於視覺密集型任務——從科學圖表中精確提取數值、僅憑螢幕截圖重建應用程式——它代表嶄新的技術巔峰,也是自主編碼與原型開發的階梯式躍進:能以更少、更節省 token 的回合處理程式碼庫遷移與前沿工程任務。這使其成為 AI 編碼助手、深度研究與分析管線,以及最注重持續連貫性與判斷力的長期自主代理的強大預設選擇。
Claude Fable 5 是 Anthropic 推出的大型語言模型,強調延長上下文與多模態輸入。其 1,000,000 個 token 的上下文視窗可讓單次請求包含整本書籍、大型程式碼庫或長篇對話記錄。此模型接受文字、圖片與檔案上傳,每次回應最多可產生 128,000 個 token。定價透明:每百萬個輸入 token 為 $10.00 美元,每百萬個輸出 token 為 $50.00…
Claude Fable 5 擅長需要跨長文本或多模態輸入進行深度語境理解的任務。例如,總結多卷法律文件、對大型程式碼庫進行程式碼審查、整合多張圖片和文字中的資訊,以及規劃早期步驟影響後續步驟的複雜多步流程。該模型在 OSWorld-Verified 上的 85.0 分數表明,它能夠成功完成涉及瀏覽、檔案操作和軟體互動的多步驟現實電腦任務。它在標準語言理解和生成基準測試上也表現良好,但除 OSWorld 之外的具體分數並未公開詳細說明。對於不需要大規模上下文或多模態輸入的任務,較小的模型如 Claude 3 Haiku 或 GPT-4o mini 會更具成本效益。
考量到每百萬個token需支付$10/$50的高昂定價,Claude Fable 5並不適合用於大量短提示的場景,例如簡單分類、單句翻譯或例行客服支援。若您的任務落在8K-32K的上下文視窗範圍內,且無需影像理解能力,那麼較小的模型如Claude 3 Sonnet、GPT-4o或最新的輕量級變體,將能以更低的成本提供更快的回應速度。此外,若您正在進行微調或需要處理大量並行請求的高吞吐量,Claude 5的成本與延遲可能不切實際。請將此模型保留給那些極端上下文、多模態推理或頂級代理效能能明確證明其價值的任務。OrcaRouter的API可讓您根據每次請求動態切換模型,因此您可僅針對複雜任務使用Fable 5,並將較簡單的任務導向其他模型。
是的,此模型非常適合需要跨多個步驟維持狀態的代理工作流程。其上下文窗口可容納完整的代理日誌、工具呼叫歷史以及環境觀察,從而在長時間互動中實現連貫的決策。在 OSWorld-Verified 上獲得的 85.0 分數直接衡量了在真實多步驟電腦任務(例如撰寫電子郵件、編輯試算表或操作網頁介面)上的表現,這些正是代理系統的核心功能。128K 的最大輸出量允許模型生成長序列操作或詳細報告。然而,開發者應考慮到每次互動增加的延遲與成本。對於上下文較短的簡單代理循環,較小的模型便足以勝任。OrcaRouter 的 API 支援串流傳輸與自訂參數(例如 temperature、max_tokens),以便微調行為。
優勢包括目前業界最大的商用上下文視窗(1M tokens)、強大的多模態理解能力(文字、圖像、文件),以及在 OSWorld-Verified 上獲得 85.0 的高分,反映其紮實的真實世界任務表現。該模型還提供慷慨的 128K 輸出限制,支援生成較長內容。限制方面則包括成本高昂:每百萬 tokens 收費 $10/$50,是中等階層模型的數倍。此外,延遲會隨上下文長度增加;處理將近 1M tokens 可能需要數十秒或更久。模型缺乏音訊或視訊等模態,僅接受文字和圖像。也不支援微調或自訂訓練——這是一個固定的、僅限 API 的模型。對於那些無法充分利用其獨特能力的任務,成本可能超過效益。
OSWorld-Verified 是一個基準測試,用於評估 AI 代理在跨作業系統的真實多步驟電腦任務上的表現。85.0 分數表示 Claude Fable 5 在無需人類介入的情況下成功完成 85% 的評估任務。這是一個高分,顯示該模型能夠有效使用工具、瀏覽檔案、操作 UI 元素,並在長序列中進行推理。對比之下,許多其他模型在類似基準測試中得分低於 50。該分數反映了模型的大上下文(使其能記住先前步驟)及其推理能力。然而,OSWorld-Verified 僅為單一指標,並不衡量事實性、安全性或領域特定知識。使用者應根據自身任務評估效能。該基準測試由 Anthropic 使用獨立評估框架執行。
Anthropic 並未公開披露 Claude Fable 5 的準確延遲數據,但可推測一般情況。對於典型的短提示(例如幾百個 token),模型可能在數秒內回應。當上下文長度接近 100 萬 token 限制時,延遲會顯著增加——處理和生成時間可能超過一分鐘。輸出長度也會影響速度;生成 128K token 可能需要相當長的時間。OrcaRouter 的 API 支援串流回應,因此使用者可以在結果到達時處理部分內容。對於即時應用,建議使用較小型的模型。高成本(50 美元/輸出 MTok)進一步鼓勵優化提示長度。快取並非原生提供,但 OrcaRouter 可能為重複請求提供選用快取功能——請查閱最新文件。
儘管Claude Fable 5有其優勢,但仍存在局限性。首先,它並非全能的多任務模型;它擅長長上下文與多模態推理,但在數學(如GPT-4o)或程式碼生成(如Code Llama)等任務上,若這些模型經過微調,Claude Fable 5可能表現不如它們。其次,模型的知識截止日期未明確說明;假設其可能無法掌握最新的時事資訊。第三,與所有大型語言模型一樣,它可能產生幻覺或輸出不準確的資訊,尤其是在超出訓練資料分佈時。第四,影像理解能力雖強但不完美——低解析度影像中的細微細節可能被遺漏。最後,其成本與延遲使其不適用於高吞吐量的生產系統。請務必對輸出進行批判性驗證。OrcaRouter的平台可讓您根據需要切換至其他替代模型。
OSWorld-Verified 基準測試相對較新,因此與許多模型的直接比較結果有限。然而,公開排行榜的已知結果顯示,得分超過 70 分被視為非常強勁。舉例來說,較早期的模型如 GPT-4V 與 Claude 3 Opus 在類似的代理型基準測試(例如 OSWorld)中報告得分低於 60 分。Claude Fable 5 的 85.0 分表明它是在代理型任務中表現最優的模型之一。儘管如此,基準測試分數並不能保證在每種場景下的表現;現實世界的任務在複雜度和領域上各有不同。該模型在一般語言理解基準測試(例如 MMLU、HellaSwag)中也很可能得到高分,但目前未提供具體數值。使用者應使用具代表性的樣本自行評估。OrcaRouter 的 API 讓您能以相同的提示詞並排測試模型。
定價簡單明瞭:每100萬個輸入token收費$10.00,每100萬個輸出token收費$50.00。這些是Anthropic提供的確切費率;OrcaRouter不加價。輸入token包含模型處理的所有文字、圖片及檔案內容。輸出token則計算每個生成的token。例如,一個包含10,000個輸入token和2,000個輸出token的請求,費用為$0.10 + $0.10 = $0.20。無隱藏費用或最低用量限制。費用將透過您的OrcaRouter帳戶計費。如果您是高用量用戶,OrcaRouter可能提供折扣方案——請聯絡支援團隊了解詳情。請注意,由於模型成本較高,監控token用量非常重要。OrcaRouter在儀表板中提供用量記錄與成本明細。
主要的取捨在於能力與成本之間。Claude Fable 5 因其大上下文和高每 token 價格,是市面上最昂貴的模型之一。對於使用少於 32K token 的任務,你將支付溢價卻無法充分利用該模型的關鍵優勢。建議在這類情況下考慮更便宜的模型(例如 Claude 3 Haiku,每 MTok 價格為 $0.25/$1.25)。此外,輸出 token 的價格是輸入 token 的五倍,因此透過使用結構化提示或降低 max_tokens 設定來最佳化生成長度,可以降低成本。另外,避免包含不必要的上下文;每張圖片會消耗大量 token(通常是數千個)。OrcaRouter 的 API 支援 `max_tokens` 參數以限制輸出。對於頻繁重複提示的工作負載,請考慮快取或對較小模型進行自訂微調是否更具成本效益。
截至目前,Anthropic 並未為 Claude Fable 5 提供原生的提示快取功能,且 OrcaRouter 不會自動快取提示。然而,OrcaRouter 的 API 可能在基礎設施層級針對相同請求支援可選的請求快取——請查閱 OrcaRouter 的文件或聯絡支援以了解目前的快取選項。若無快取,每個請求都會按每個權杖完整計費。如果您的使用案例涉及許多相同的前綴(例如,多條使用者訊息共享的系統提示),您可以重新組織呼叫以減少重複的權杖成本,但模型每次仍會處理完整的輸入。對於高流量的應用,請考慮微調較小的模型或使用具有較短上下文的較便宜模型。OrcaRouter 允許您以程式化方式切換模型以最佳化成本。
不,OrcaRouter 不會在供應商費率之上收取任何額外費用。您支付的價格為每 100 萬輸入代幣 $10.00 美元,每 100 萬輸出代幣 $50.00 美元。沒有按請求收費、沒有最低訂閱量、也沒有隱藏成本。標準的 OrcaRouter 帳戶費用(如果有的話)適用於所有 API 使用量,但與模型特定定價分開計算。如果您使用自訂模型路由、串流或多輪對話等功能,這些都包含在代幣定價中。請務必查看 OrcaRouter 定價頁面以獲取最新資訊。對於企業客戶,OrcaRouter 可能提供批量折扣或專屬定價——請聯絡銷售人員取得報價。總結來說,成本透明且可根據代幣使用量預測。
您通過 OrcaRouter 的 OpenAI 相容 API 存取 Claude Fable 5。基礎 URL 為 https://api.orcarouter.ai/v1。在請求中使用模型 ID "anthropic/claude-fable-5"。該 API 接受標準的 OpenAI 聊天完成參數:`messages`、`max_tokens`、`temperature`、`top_p`、`stop` 等。對於多模態輸入,請包含 `content` 陣列,其中包含類型為 "text"、"image_url" 或 "file_url" 的條目(根據您的 SDK 版本)。身份驗證需要來自 OrcaRouter 的 API 金鑰,並在 Authorization 標頭中以 "Bearer YOUR_API_KEY" 的形式傳遞。範例 curl 命令:curl https://api.orcarouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $ORCAROUTER_API_KEY" -d '{"model":"anthropic/claude-fable-5","messages":[{"role":"user","content":"Hello"}],"max_tokens":100}'。透過設定 `stream: true` 可支援串流。
Claude Fable 5 支援 OpenAI chat completions API 的標準參數。最相關的參數包括:`max_tokens`(預設最大 128K)、`temperature`(範圍 0-2,建議 0-1)、`top_p`(temperature 的替代選項)、`stop` 序列、`presence_penalty` 和 `frequency_penalty`。對於多模態請求,`content` 欄位可以包含帶有 `type` 和相應資料的物件陣列(例如 `{"type":"text","text":"Describe this chart"}` 和 `{"type":"image_url","image_url":{"url":"data:image/jpeg;base64,..."}}`)。檔案上傳可透過 URL 或 base64 編碼資料進行。還有一個用於接收部分回應的 `stream` 參數。並非所有參數都受支援;例如,functions/tools 目前無法用於此模型——請查閱 OrcaRouter 文件以獲取更新。所有參數都在請求主體中傳遞。
遷移過程非常簡單,因為 OrcaRouter 的 API 與 OpenAI 相容。首先,從您的帳戶儀表板取得 OrcaRouter API 金鑰。將現有的基礎 URL 取代為 https://api.orcarouter.ai/v1,並將模型識別碼變更為「anthropic/claude-fable-5」。如果您之前使用的是 Anthropic 的原生 API,請注意 OrcaRouter 使用的是 OpenAI 的訊息格式,而非 Anthropic 的格式。您需要調整任何用來建構訊息的程式碼。對於圖片輸入,請將其轉換為 OpenAI 格式(例如 base64 或 URL)。OrcaRouter 會處理底層的轉換以對應 Anthropic 的 API。在遷移正式環境工作負載之前,請先以單一請求進行測試。OrcaRouter 還可能提供其他功能,例如速率限制、使用量分析和模型備援。請參閱 OrcaRouter 的文件以了解訊息格式化和驗證的詳細資訊。
Claude Fable 5 提供更大的上下文視窗(1M vs Opus 的 200K)以及在 OSWorld-Verified 上更高的分數(85.0 vs Opus 估計約 55-60)。它也像 Opus 一樣支援圖片和檔案輸入。輸出 token 限制更高(128K vs Opus 的 4,096)。然而,Claude 3 Opus 顯著更便宜:Opus 之前是 $15/$75 每 MTok,降價後是 $8/$24?Opus 目前的實際定價是 $15/$75 每 MTok 對比 Fable 5 的 $10/$50——等等,Opus 實際上是 $15/$75 輸入/輸出?(標準費率:Claude 3 Opus $15/$75 每 MTok)。所以 Fable 5 實際上每 token 比 Opus 便宜?實際上是 $10/$50 對比 $15/$75,因此 Fable 5 便宜了 33%。這是個有趣的點。但 Opus 對於較短的任務仍然足夠勝任。Fable 5 的主要優勢是上下文長度和代理效能。對於 200K token 以內的任務,Opus 可能以較低成本滿足需求。如果你需要極端的上下文或頂尖的代理分數,Fable 5 更好。
GPT-4o(來自 OpenAI)擁有 128K 的上下文視窗,而 Fable 5 則為 1M。GPT-4o 也支援文字、圖片和音訊輸入(Fable 5 僅支援文字和圖片)。GPT-4o 的輸出限制為 4,096 個 token,遠小於 Fable 5 的 128K。在基準測試方面,GPT-4o 在 MMLU 上的得分約為 87.1,但未公佈 OSWorld-Verified 的分數。在定價方面,GPT-4o 每百萬 token(輸入/輸出)的費用為 $5/$15,比 Fable 5 的 $10/$50 更便宜。因此,對於較短的任務,GPT-4o 更快且更便宜,而 Fable 5 在長上下文和自主代理場景中表現出色。對於包含音訊的多模態需求,GPT-4o 是更好的選擇。兩者均可透過 OrcaRouter 存取,讓您可以針對每次請求進行選擇。
在OrcaRouter中,您可以選擇多種Anthropic模型(Claude 3.5 Sonnet、Claude 3 Haiku)和OpenAI模型(GPT-4o、GPT-4o mini、GPT-4 Turbo),以及開源模型。對於大多數任務,Claude 3.5 Sonnet在能力與成本之間提供了良好的平衡(每百萬Token $3/$15),並具備200K上下文。對於極長上下文,Fable 5無可匹敵。對於高吞吐量的分類或提取任務,Claude 3 Haiku(每百萬Token $0.25/$1.25)既便宜又快速。對於程式碼生成,GPT-4o或Code Llama可能更具專長。OrcaRouter允許您設定備援模型:如果Fable 5失敗或超時,您可以路由到更便宜的模型。請根據您的具體需求評估上下文長度、輸入模態和基準測試表現。最佳模型取決於您的使用案例,而不僅僅是最高的基準分數。
相容 OpenAI——沿用你現有的 SDK
https://api.orcarouter.ai/v1https://api.orcarouter.aifrom openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="anthropic/claude-fable-5",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_tokensreasoningresponse_formatstopstructured_outputstool_choicetoolsverbosity| 輸入 / 1M tokens | $10.00 |
| 輸出 / 1M tokens | $50.00 |
| 快取讀取 / 1M | $1.00 |
| 快取寫入 / 1M | $12.50 |
| 貨幣 | USD |
基於標價的估算
僅為估算——實際 Token 數取決於供應商的分詞器。
@misc{orcarouter_claude_fable_5,
title = {Claude Fable 5 API},
author = {Anthropic},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/anthropic/claude-fable-5}
}Anthropic. (2026). Claude Fable 5 API. OrcaRouter. https://www.orcarouter.ai/models/anthropic/claude-fable-5