文章《Claude Fable 5.1》的头图标题卡,副标题为“Anthropic Fable 级旗舰模型的权威参考页面”,标签分别为“2026 年 9 月 1 日发布”“100 万上下文 / 128K 最大输出”以及“每 100 万 token 输入 $10 / 输出 $50——缓存读取 $0.25”,页脚一行文字为“上下文窗口、费率卡、effort 设置、基准测试与可用性——已于 2026-09-28 核实”。OrcaRouter 徽标合成在右下角。
Guides & Insights

Claude Fable 5.1:Anthropic 的 Fable 旗舰,完整规格详解

作者

Gideon Frost

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

Claude Fable 5.1 是正式发布的 Fable 级旗舰模型,自 2026 年 9 月 1 日起上线,它位于读者经常混淆的三个名称中间。不带后缀的 Claude Fable 5 是 2026 年 6 月发布的原版,Fable 5.1 以相同的每 token 价格取代了它。Claude Fable 5.2 是第三个名称,从未发布,任何地方都没有厂商页面——包括厂商自己的文档、价格表和新闻编辑室,均未提及它。而 Claude Mythos 5.1 也不是一个独立模型:它与 Claude Fable 5.1 是相同的权重,通过受限访问计划出售。本页面介绍的是读者今天真正可以调用的那一个模型:它的规格范围、完整费率表、厂商关于 effort 和 thinking 的文档说明、每一项已公布的基准测试数据及其运行设置、独立解读,以及在 OrcaRouter 上的费用。

Fable 家族:三个名称,两个型号,一个后缀陷阱

后缀混淆并非表面问题——这三个字符串仅相差一位数字,却会导向不同的信封、不同的价格,而且在其中一种情况下,什么也得不到。先把它们分辨清楚,本页其余内容才读得下去。

• Claude Fable 5 —— 于 2026 年 6 月 9 日发布,是 Anthropic 的首个 Fable 级模型。它仍在提供服务,且定价仍与其继任者完全相同:每百万输入 token 10 美元,每百万输出 50 美元,缓存读取为每百万 1.00 美元。它是 .1 版本所取代的模型,而不是本页面所介绍的模型。

• Claude Fable 5.1 — 本模型。发布于 2026 年 9 月 1 日,沿用与 Claude Fable 5 相同的 10 美元 / 50 美元标价,但缓存读取费用降至 0.25 美元,且行为变更清单比版本号提升所暗示的更短。Anthropic 自己的文档将其描述为适合“高要求推理和长周期智能体工作”的版本。

• Claude Fable 5.2 —— 它并不存在,既无法购买,也没有任何官方文档记录。Anthropic 的新闻编辑室并未发布此类公告;其模型总览、定价页面以及 Fable 5.1 模型页面均未出现该名称;Artificial Analysis 中查无此项;OrcaRouter 的目录则返回“未找到该模型”。你可能看过的相关报道属于发布前报道,那是与本篇不同的另一篇文章,已在下方给出链接,此处不再重新讨论。

• Claude Mythos 5.1 —— 与 Claude Fable 5.1 是同一底层模型,只是其防护机制针对网络安全与生命科学工作进行了调校,而非面向通用发布。它仅通过 Anthropic 的可信访问计划(Project Glasswing 与 Cyber Verification Program)提供,目前仅面向一部分美国机构,且定价与 Claude Fable 5.1 完全相同。它不在 OrcaRouter 的产品目录中,本页也并非介绍它。

2026年9月1日发布了什么,以及这个模型究竟是什么

Anthropic 于 2026 年 9 月 1 日在一份公告中同时发布了 Claude Fable 5.1 和 Claude Mythos 5.1,并将它们描述为“全球最先进的编码与知识工作模型”。这是厂商的说法,此处按原话引用。此次发布中可验证的部分更有限,也更有用:一个模型、两种防护配置,以及一项完全集中在缓存输入上的价格变动。

这份规格,依据 Anthropic 自己的模型页面和 API 文档:标准按 token 定价下提供 1,000,000 token 的上下文窗口——没有长上下文溢价,因此 900,000 token 的请求与 9,000 token 的请求按相同费率计费——以及最多 128,000 个输出 token。输入为文本和图像;输出为文本。工具使用、视觉、结构化输出和多语言任务均受支持。可靠知识和训练数据截止时间均为 2026 年 6 月。

API 接口范围:claude-fable-5-1(用于第一方 Claude API,以及 AWS、Google Cloud 和 Microsoft Foundry 上的 Claude Platform);anthropic.claude-fable-5-1(用于 Amazon Bedrock)。Anthropic 承诺对它的支持"不早于 2027 年 9 月 1 日",这是规划迁移时应参照的时间界限,而非弃用日期。

在确定统一采用它之前,有一个部署限制值得了解:Claude Fable 5.1 在生产环境中运行时带有防护机制,可能会直接拒绝请求,而 Anthropic 关于降级处理的指引在实践中很重要——请求被拒绝时会返回正常的 HTTP 200,其停止原因是 refusal,而不是错误。公告还给出了数据保留方面的方案:Anthropic 表示,其新的 Enterprise Frontier Safeguards 系统会将数据保留在客户掌控的云基础设施中,该系统将从今年秋季晚些时候起面向企业客户分阶段启用;在此之前,符合条件的客户可以在零数据保留的情况下运行 Fable 5.1。

A screenshot of Anthropic's Claude Platform documentation page 'Models overview', showing the four-model comparison across Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 and Claude Haiku 4.5. The Claude Fable 5.1 column reads: Claude API ID claude-fable-5-1, thinking listed as adaptive and always on, default effort high, a 1M-token context window, 128K maximum output, a reliable knowledge cutoff of June 2026, and pricing of $10 per million input tokens and $50 per million output tokens. Above the table the page's own guidance reads: if you're unsure which model to use, start with Claude Opus 5.5 for most workloads and use Claude Fable 5.1 for demanding reasoning and long-horizon agentic work, or when your evals on Claude Opus 5.5 at higher effort still fall short.

完整费率卡,以及资金实际流向何处

本节中的每一个数字都来自 Anthropic 自己的定价文档,查阅日期为 2026 年 9 月 28 日。基础 token 定价与 Claude Fable 5 相比保持不变:每百万输入 token 10.00 美元,每百万输出 token 50.00 美元。变化在于缓存。

• 输入 — 每百万 token 10.00 美元,与 Claude Fable 5 完全相同。

• 输出 — 每百万 token 50.00 美元,与 Claude Fable 5 完全相同。

• 缓存读取(命中)——每百万 token $0.25,较 Claude Fable 5 的 $1.00 有所下降。Anthropic 表示这相当于降低 75%,而这正是该版本成本叙事背后的全部机制:如今一次缓存命中的费用为标准输入价格的 2.5%,而非 10%。

• 缓存写入——五分钟窗口每百万 token 12.50 美元,一小时窗口每百万 20.00 美元。这些与 Claude Fable 5 保持不变,因此这笔交易的写入部分不包含在折扣中。

• 批处理 API — 双向均享 50% 折扣,因此异步工作每百万输入 5.00 美元,每百万输出 25.00 美元。

• 数据驻留——请求仅限美国境内的推理时,每个 token 类别均适用 Anthropic 标准的 1.1 倍乘数。

Anthropic 在其公告中将这一结果推算为:典型工作负载的成本约降低 25%,高度智能体化工作负载的成本最高约降低 45%;该结果是在 2026 年 8 月四周的使用期内按默认 effort 测得的。这两个百分比是 Anthropic 根据其自身使用数据给出的厂商估算,并非经过独立审计的数字,并且仅适用于会重新读取上下文的工作负载。不使用缓存复用的单轮请求,其成本与在 Claude Fable 5 上完全一致。

A single-column reference scoreboard titled 'Claude Fable 5.1 at every effort level'. Six rows reading 'Low: Index 47, $2.37 per task', 'Medium: Index 49, $2.98 per task', 'High: Index 51, $3.91 per task', 'Xhigh: Index 53, $5.98 per task', 'Max: Index 53, $7.63 per task', 'Default effort: high'. A footer line reads 'Artificial Analysis Intelligence Index v4.3.2, read 2026-09-28. Anthropic's own benchmarks are published as curves, not pinned to one effort.' The OrcaRouter logo is composited in the bottom-right corner.

努力程度、思考,以及每个基准测试运行时所采用的设置

这是规格表中最常被报道忽略的部分,也正是决定两份已发布的分数究竟是否具有可比性的部分。

Claude Fable 5.1 采用自适应思考,且思考始终开启——Anthropic 的模型页面将其列为“自适应(始终开启)”,并且没有任何模式可以将其关闭。在这里,旧式固定预算的扩展思考不只是不被推荐:该参数会被直接拒绝。在 Claude 4.7 及更高版本的模型上,请求若设置thinking: {type: "enabled", budget_tokens: N}就会返回 400 错误,而 Anthropic 的文档将 Claude Fable 5.1 列为受影响的模型之一。它的替代方案是一个深度调节旋钮,而不是令牌预算。

那个调节旋钮就是output_config.effort,而 Claude Fable 5.1 支持全部五个级别:low、medium、high、xhigh 以及 max。默认值是 high,完全省略该参数时得到的也是这个值。Anthropic 自己的建议是:从 high 起步;对于对能力最敏感的智能体与编码类工作,上调至 xhigh 或 max;而对于常规或对延迟敏感的工作,一旦你的评测表明质量能够保持,就下调至 medium 或 low。Anthropic 还指出,在 Low 或 Medium 努力级别下,Fable 5.1 能以低得多的成本取得与 Claude Fable 5 相当甚至更好的结果;并且该模型在 Claude Code 中默认使用 High 努力级别,在 Claude Cowork 和 Claude.ai 上默认使用 Medium,因此同一个模型名称在不同入口调用时可能表现出不同的行为。

现在,来精确回答这个设定基准的问题。Anthropic 将上述每个基准都以准确率-成本曲线的形式发布,曲线覆盖全部五个投入等级,而其主对比表并没有把任何单一投入等级与任何单一数字对应起来。Anthropic 材料中唯一与某个投入等级明确绑定的数字来自 CursorBench 3.2.0:同一公告中的合作伙伴引述称,其在“最高投入”下达到 73.4%,这与表中的 73.4% 相符。其他一切内容都应被解读为曲线,而不是单个点——这也正是为什么,拿一个孤立的分数去和另一家实验室的模型比较——该模型是在不同的投入等级和不同的测试框架下评测的——几乎说明不了什么。

基准测试表,以及运行它的人

本节中的每一个数字均由 Anthropic 报告,未经独立复现。Anthropic 自己的脚注中有两点说明需要一并附上:Terminal-Bench-Science 0.1 的标准误差为每个模型 ±3.5–4.5 个百分点,而 OSWorld 2.0 的分数基于基准作者 2026 年 8 月发布的任务集,因此与先前发布的 OSWorld 2.0 结果不可比。

• Terminal-Bench-Science 0.1 — Claude Fable 5.1:52.6% 对 Claude Fable 5:24.7%、Claude Opus 5:29.0%、GPT-5.6 Sol:22.4%。“两倍多”的说法成立,且 Anthropic 指出其测试框架复现出的公开排行榜成绩——Opus 5 为 30.0%、Claude Fable 5 为 21.4%——均在噪声范围内。

• Terminal-Bench 4.0 — Claude Fable 5.1:55.8%,对比 Claude Fable 5:42.0%、Claude Opus 5:52.3%、GPT-5.6 Sol:37.3%。Claude Mythos 5.1 达到 60.9%,Anthropic 将这一差距归因于受限模型上不够精确的网络防护措施介入的那些任务。

• 人类最后的考试——Claude Fable 5.1:无工具时 60.9%,使用工具时 65.0%,而 Claude Fable 5 为 57.8% / 63.8%,Claude Opus 5 为 56.6% / 63.6%。

• GDPval-AA v2 — Claude Fable 5.1:1,853,对比 Claude Fable 5:1,723、Claude Opus 5:1,824、GPT-5.6 Sol:1,711。

• AutomationBench — Claude Fable 5.1:31.4%,而 Claude Fable 5 为 17.1%、Claude Opus 5 为 26.9%、GPT-5.6 Sol 为 19.6%。

• CursorBench 3.2.0 — Claude Fable 5.1:在最高努力程度下达到 73.4%,相比之下,Claude Fable 5 为 70.5%,Claude Opus 5 为 70.0%,GPT-5.6 Sol 为 67.2%。

• OSWorld 2.0 — Claude Fable 5.1:部分成功率 77.9%,严格成功率 41.7%;相比之下,Claude Fable 5 为 72.9%/36.1%,Claude Fable 5 为 75.0%/39.6%。

• 由合作伙伴运行、由第一方报告——Browserbase 测得,其最难的浏览器智能体任务中有 82% 在约十分钟内完成,而 Claude Opus 5 为 74%,Claude Fable 5 为 57%;Crosby 的 RedlineBench 合同红线标注得分在 Fable 5 的基础上从 47.9 提升至 57.0;Samaya 的 FrontierFinance 评分标准从 49.2% 提升至 55.9%。

阅读这份表格时,请记住一个结构性事实,因为Anthropic明确指出了这一点:Claude Fable 5.1和Claude Fable 5都是在启用生产环境防护机制的情况下接受评估的,而在那些防护机制介入的任务上,两个模型都得了零分——在各自的OSWorld 2.0上如此,Claude Fable 5在AutomationBench上也是如此。Anthropic表示,触发干预的网络任务是由Claude Opus 4.8完成的,生物学任务则由Claude Opus 5完成,而这"很可能降低"了Fable系列模型在这些基准测试上的表现。换句话说,一次拒绝被计为一次失败——对于停止运行的智能体而言,这是一种合理的解读,同时也是防护机制一变、数字就随之变动的原因之一。

独立解读:第三方测量了什么,以及为此付出了多少努力

这里的独立分析数据来自 Artificial Analysis,其智能指数是被引用最广泛的第三方综合指标,而且该机构会公布每项结果生成时所依据的确切配置。截至 2026 年 9 月 28 日,其 Claude Fable 5.1 页面显示,Artificial Analysis 智能指数 v4.3.2 为 53,在“Adaptive Reasoning, Max Effort, Default Fallback”配置下,每个智能指数任务的加权成本为 $7.63,每秒输出 69.7 个 token。

努力阶梯才是有意思的部分,而它也恰恰是单个头条数字所掩盖的东西。Artificial Analysis 为每个努力档位都单独发布了一个页面:低档位下 47(每任务 2.37 美元),中档位下 49(2.98 美元),高档位下 51(3.91 美元),xhigh 下 53(5.98 美元),max 下 53(7.63 美元)。由此可得出两点。第一,努力旋钮是真实存在的,而且是有定价的:从 max 降到 high 会放弃两个指数点,每任务成本降低 49%;降到 low 则会放弃六个点,成本降低 69%。第二,xhigh 和 max 以不同的成本落在同一个头条分数上,这正是这类曲线的常见形态,也是应衡量自身工作负载、而不是默认购买最高档位的理由。在同一次指数修订中,Claude Fable 5 为 50(每任务 8.75 美元),Claude Opus 5 为 51(5.86 美元),Claude Opus 5.5 为 58(5.98 美元)。

关于这些对比,有两点需要坦诚说明。它们全都出自同一家供应商的测试框架、基于同一版索引,因此彼此之间可以比较,与其他任何东西都无从比较。而且它们并不能复现 Anthropic 的排序:在 Anthropic 自行报告的榜单上,Claude Fable 5.1 横扫其全部对比对象,而在 Artificial Analysis 的索引中,三周后发布的一款更便宜的 Anthropic 模型得分反而高出五分。两者都可能成立,因为该索引与厂商榜单对不同工作的权重不同——也因为一个头条指数只是十项评估的汇总,而不是对你具体任务的裁决。

就这么定了:一键解决版本问题

这个页面存在的实际原因是,“claude fable 5.1”是用户会单独输入的一个查询,通常是为了解答三个问题之一:Fable 的各个名称中哪个才是现行的、它的费用是多少,以及如何在不另立第二份供应商合同的情况下试用它。前两个问题已在上文依据 Anthropic 自己的页面给出解答。第三个,则正是路由服务发挥价值的地方。

A screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model id, a 1M-token context window with 128K maximum output, text, image and file input and text output, a stat strip reading $10.00 input and $50.00 output per million tokens with a p50 time-to-first-token of 7.05 seconds, a release date of 2026-09-01, the capability chips Vision, Tools, JSON and Reasoning, and a code sample against the OpenAI-compatible base URL https://api.orcarouter.ai/v1.

Claude Fable 5.1 已在 OrcaRouter 上线,形式为 anthropic/claude-fable-5.1,按 Anthropic 的标价提供,加价为 0%——每百万输入 token 10.00 美元,每百万输出 50.00 美元,缓存读取 0.25 美元,缓存写入 12.50 美元——并与 Claude Fable 5 位于同一目录中。两者都可以通过 一个密钥、一个基础 URL 和一条计费项访问,无论是经由 OpenAI 兼容的 /v1/chat/completions 端点,还是 Anthropic 自己的 /v1/messages 格式,因此现有的 Claude SDK 客户端只需更改两个值,就能指向新模型。这是成本最低的版本测试:用相同的提示词,在 high 和 xhigh effort 下分别对 Claude Fable 5 和 Claude Fable 5.1 运行,比较每完成一个任务的成本而非每次请求的成本,并让你自己的评估决定这 .1 是否值得迁移。由于加价为零,供应商的价格变更——就像 9 月 1 日的缓存读取降价那样——当天就会在我们这边生效,而不必等待重新定价。

如果你正在 Fable 系列和更便宜的选项之间做选择,请注意,Anthropic 自己在文档中就把大多数工作负载指向了 Claude Opus 5,仅将 Fable 5.1 保留给要求苛刻的推理和长周期智能体任务。而如果你真正需要的是受管控的生物学或网络能力,那属于通过 Anthropic 各项访问计划提供的 Claude Mythos 5.1——这不是本页面、也不是我们的产品目录能为你指路的。

为什么这是参考页面而不是发布报道

Claude Fable 5.1 于 2026 年 9 月 1 日发布——比本页撰写时间早四周——因此,发布本身并非新闻,本文也刻意不作为第二篇发布公告。本页的立论有所不同,而且我们认为,它更具持久价值:它是一个如今已上线于我们目录中的模型的权威参考页,是读者搜索该模型名称后抵达的页面,其依据是我们能够亲眼观察到的持续性搜索需求,而非发布的新鲜度。此处提到 9 月 1 日的发布日期,是为了标注该模型的时间,而不是作为事件来报道。我们的发布日专题报道与发布前的泄露报道仍为各自独立的文章,本页链接到它们,而非重述其中任何一篇。

本文中的对比3

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新