
Claude Sonnet 5.5 的两周使用折扣:50% 究竟涵盖什么
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 223 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 125 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 212 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
厂商于2026年10月1日公布的这项折扣,不会出现在任何一张发票上。它既不是降价,也不是token的促销费率,更不是你主动选择加入的某种东西。从10月1日太平洋时间上午11:00到10月15日太平洋时间晚上11:59,在Claude或云端的Claude Cowork中创建或编辑Artifact,都会让随后的一部分工作按半价计入你的五小时会话额度——而厂商在此过程中所指的模型是Claude Sonnet 5.5。这项优惠有文档记录、有明确日期,而且是自动生效的。它不做什么,几乎和它做什么一样具体,而这两者之间的差距,正是大部分实际价值所在。
厂商自己对这个机制的表述只有一句话:限时活动期间,当你在 Claude 或 Claude Cowork 中创建或编辑制品时,后续工作的一部分会少占用你五小时会话限额的 50%。“一部分”这个词在这里承担了很重的分量。以下条款是厂商的,摘自该促销活动自己的帮助中心页面,尚未被 Anthropic 之外的任何人独立测量——这一点值得直说,因为用量折扣从外部极难核实。你无法从账单上审计它。你只能盯着自己的会话计量表。
真正具有约束力的两个时钟
该折扣在聊天中体现为消息条数,在 Cowork 中体现为步骤数,而两者都比“后续工作”这一说法所暗示的范围更窄。
• 在聊天中——在 Claude 于该聊天中创建或编辑 artifact 之后的接下来 10 条消息可享受折扣。第 11 条消息不享受折扣,且除再次创建或编辑 artifact 外,没有任何操作会重置计数。
• 在单条回复内——最多前 15 个步骤可享受折扣。一个步骤是一次搜索、一次工具调用或一次工件更新。如果一条智能体回复运行超过 15 个步骤,即使它仍处于 10 条消息窗口内,其剩余部分也会按标准费率计费。
• 在云端 Cowork 任务中——如果你通过从“输出”菜单中选择“文档”、“演示文稿”或“设计”来启动任务,则大约前 45 分钟可享受折扣;否则,可享受折扣的是创建或编辑工件后的接下来最多 80 步。
前两行之间的交互才是让人意外的地方。十条消息听起来很宽裕,直到你发现单条消息就能耗尽整个步骤预算:要求一次大幅修改,回复从第十六步起就按全价计费——而且是在一个你本来合理地以为有折扣的窗口内。
你如何打开聊天,决定了你的第一条消息是否享受折扣。通过从“输出”菜单中选择“文档”、“演示文稿”或“设计”来开始新聊天,会从第一条消息起就启用折扣。在对话中途提出则不会——首次创建该成果物的那条消息按标准费率计费,折扣从下一条消息开始。如果你知道自己即将反复迭代一份演示文稿,那么这两条路径之间的差别就是一条消息,而且实际上,这正是这样安排的全部意义所在。
谁进,谁出,以及那条会让人中招的界线
该优惠对 Pro、Max 和 Team 套餐自动生效。无需输入任何优惠码,也无需改动任何设置。Free 套餐不适用,两种类型的 Enterprise 套餐也都不适用——Anthropic 明确点名了基于席位的 Enterprise 和基于用量的 Enterprise,从而堵住了那个显而易见的漏洞,即想当然地认为按用量计费的席位会像 Team 席位一样运作。

排除清单比资格清单更长,而且其中少数条目比其他条目更重要:
• Claude Code 不在此列。一位使用 Max 套餐、常驻 Claude Code 的开发者从中一无所获。
• Claude API 不在此优惠范围内。这是订阅侧的促销活动,而非模型价格促销。
• Slack 中的 Claude 除外,定时任务和无人值守任务也同样除外,以及在 Claude Desktop 中本地而非云端运行的 Cowork 任务。
• 用量额度不包含在内。如果你已启用额度,且某条消息动用了这些额度,那么无论该消息位于窗口中的哪个位置,都会按标准费率计费。
• 使用早期版本 artifacts 创建的 Artifacts 会被排除,通过 Drive 连接器创建的 Docs、Sheets 和 Slides 文件也会被排除。
• 独立的 Claude Design 应用不包括在内——包括你从该应用以 artifacts 形式发布的项目。在 Claude 内制作的设计则包括在内,只要你在聊天或 Cowork 任务中从“输出”菜单中选择“设计”。两种看起来都像“Claude Design”的东西,却分处这条线的两侧。
有一项结构性限制凌驾于这一切之上:折扣只会减少计入五小时会话限额的用量,而周限额不受影响。高用量的一周不会因 artifact 工作而得到纾解。而且该优惠本身也带有厂商惯用的免责条款——无现金价值、不可转让,且 Anthropic 保留更改或提前终止的权利,这正是应把 10 月 15 日视为上限而非承诺的原因。
为什么这是关于 Sonnet 5.5 的故事,而不只是关于计费的故事
Anthropic 在发布公告时还附上了一条模型推荐:不妨试试 Claude Sonnet 5.5,厂商称它对设计有很强的眼光,能制作出几乎无需编辑的幻灯片。这句话来自同时销售该模型和订阅服务的公司,属于营销文案,而且我们找不到可引用的、已发布的针对 Claude Sonnet 5.5 在幻灯片生成或视觉设计质量方面的独立评估。请把这一设计说法视为厂商立场。

该模型的其他数字是具体的。Claude Sonnet 5.5 于 2026 年 9 月 28 日发布,比这项促销活动开始早三天,定价为每百万输入 token 2 美元、每百万输出 token 10 美元,缓存读取为每百万 0.20 美元,上下文窗口为 1,000,000 token,输出上限为 128,000 token。它是 Anthropic 当前 Sonnet 与 Opus 搭配中较便宜的那一半,而这种安排并非偶然:促销活动要你把折扣消息用在家族中每 token 成本最低的模型上,因此折扣会与你本来就会选择的费率叠加。它劝你离开的那组搭配同样如此——Claude Opus 5.5 和 Claude Fable 5.1 都处在显著更高的价目档位上,而促销活动丝毫不会改变这笔账。
诚实地将这两个事实放在一起的方式,就是将二者分开。该促销是一项有记录、有日期、自动的变更,关乎 Claude 订阅如何计量使用量。而设计能力则是一种声称。前者是这项促销本周为何值得一读的原因;后者是 Anthropic 为何希望你将折扣窗口期花在这个特定模型上,而不是更贵的模型上。
这个折扣实际上大概值多少
一次 Artifact 编辑后十条消息的用量减半,并不等于你当天用量减半;这笔算术感受起来比说出来更容易。十条享折扣的消息等于五条标准消息。这就是每次 Artifact 事件的全部节省,在 15 步上限开始进一步削减之前。一位以每轮二十条消息迭代演示文稿的设计师,每轮前十条能享受折扣,其余则没有。
该机制见效的地方,在于供应商为其构建的工作形态:短小的、以交付物为锚点的循环。起草一份单页文档,将其转化为演示文稿,制作匹配的视觉稿,然后修订。每次创建或编辑都会重新开始计数,因此由重复的交付物修订构成的会话会不断落在窗口内,而由长时间开放式分析构成的会话——没有交付物,没有重新开始——则完全不会触及它。
这也是这项促销与大多数团队实际购买推理的方式之间的分界线。如果工作是通过 Claude API 而不是 Claude 应用进行的,那么上述内容都不适用。API 使用按 token 计费,而按 token 计费并没有可打折的五小时会话限制。一个已将文档和演示文稿生成迁移到 API 流水线的团队,完全无法从这项优惠中获益——不是因为它因技术细节被排除在外,而是因为被打折的东西是订阅计量表,而不是价格。
如果你是在构建而不是在点击

就 API 而言,这次促销算不上什么大事,真正值得关注的数字是原本就已经在那里的那个。anthropic/claude-sonnet-5.5收录在我们自己的目录中,价格为每百万输入 token 2.00 美元、每百万输出 token 10.00 美元,缓存读取为 0.20 美元、缓存写入为 2.50 美元——这就是提供商自己的标价,原样透传、未加任何加价,也正因如此,供应商的费率变动在其生效的同一天就会落到我们这边。目录中标明其上下文窗口为 1,000,000 token、输出上限为 128,000 token,并同时通过 /v1/chat/completions 的 chat-completions 端点和 /v1/messages 的 Anthropic 兼容 messages 端点提供服务,因此已经按 Anthropic SDK 形态编写的代码库无需重写即可经由我们路由。
在把生产环境指向这条路由之前,有两点值得了解。第一点是,anthropic/claude-sonnet-5.5在目录中属于新增条目——发布于 2026 年 9 月 28 日,且被标记为新增,而非成熟路由——而这正是自动故障转移存在的意义:这样某个提供商状态糟糕的一天就不会变成一次糟糕的部署。第二点则是这整场促销所引出的比较。订阅折扣与按 token 计费率是两本不同的账:应用的五小时会话限额可能连续两周减半,而 API 价格却一分未动;一个已经超出应用承载能力的团队,应该把直通费率与席位成本相比较,而不是与促销价相比较。对于产出物本身就是交付成果、且有人在环中的工作负载,订阅折扣在未来两周是更划算的选择。而对于任何无人值守运行的东西,它从设计上就无关紧要。
这两周真正值得做的一件事成本很低:如果你使用的是 Pro、Max 或 Team,并且一直在普通聊天里起草文档或演示文稿,那么下一次就从 Output 菜单开始。仅仅这一个选择,就能让你的第一条消息进入折扣范围,而你要付出的不过是点一下而已。
目录中列出了 1,000,000 token 的上下文窗口,最多可输出 128,000 个 token,并同时在 位于 /v1/chat/completions 的 chat-completions 端点以及位于 /v1/messages 的兼容 Anthropic 的 messages 端点上提供服务,因此已经按照 Anthropic SDK 形态编写的代码库无需重写就能通过我们来路由。
