
GPT-5.6 Sol API 定价:降价后每 1M Tokens $4 / $20
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 150 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2238智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 127 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 202 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 228 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
GPT-5.6 Sol 的价格为每百万输入 token 4.00 美元、每百万输出 token 20.00 美元,截至今天,在 GPT-5.6 Sol API 上,这与旗舰层级在 OrcaRouter 目录中承载的直通费率相同,经 2026-08-25 核实为零加价。2026 年 8 月 24 日,OpenAI 将 Sol 的 API 价格下调:输入降 20%,输出降约 33%,这是一项至少持续到 2026 年 11 月 21 日的临时促销。它仍是 GPT-5.6 系列中最昂贵的层级,也是自 7 月 30 日降价(未涉及旗舰层级)以来,首个调整标价的层级。定价杠杆比表面价格更重要:通过提示缓存,重复使用的输入按每百万 0.40 美元计费;批处理 API 降至每百万 2.00 / 10.00 美元;快速模式以 2 倍溢价换取最高 2.5 倍的速度。本页是 Sol 专属的定价参考——确切的费率表、一次请求的实际成本、旗舰层级与其他层级的对比、何时不应购买,以及如何通过一个兼容 OpenAI 的端点使用你自己的密钥调用它。
{{1}}价格按每百万个令牌(输入/输出)计,截至2026-08-25。{{/1}}{{2}}此次降价——输入降20%,输出降约33%,至少持续至2026年11月21日——系OpenAI官方公告,我们按原样报道;美元数字取自OpenAI公布的API费率,并与OrcaRouter上GPT-5.6 Sol的模型页面交叉核对。{{/2}}{{3}}缓存、批量、快速模式及长上下文的费率均由OpenAI公布。{{/3}}这些是促销费率,而非永久性价格调整——价格会变动,也可能反弹;构建前请核实。
今天已核实的确切价格
以下是 GPT-5.6 Sol 的完整费率卡,已于 2026-08-25 按促销费率验证。使用 gpt-5.6 别名的请求适用相同费率,降价正在向符合条件的 ChatGPT Work 和 Codex 积分计划逐步推出;ChatGPT Pro、Plus 和 Business 订阅保持不变。

• 输入 — 缓存未命中时每1M tokens $4.00(原价$5.00,11月21日前享20%折扣)。
• 输出 — 每100万tokens $20.00(原价$30.00,截至11月21日享约33%折扣)。
• 提示词缓存读取 — 每1M tokens $0.40(原价$0.50),您重新发送的任何输入可享90%折扣。
• 提示词缓存写入 — 每1M tokens $5.00(原为$6.25)
• 长上下文层级 — 超过约272K tokens的输入部分按 $8.00 输入 / $30.00 输出计费(原为 $10.00 / $45.00;相同的2倍输入、1.5倍输出倍数现在基于较低的基准价计算)。
• Batch API — 输入 $2.00 / 输出 $10.00,统一五折优惠(原价 $2.50 / $15.00),异步处理,通常约 24 小时内完成。
• 快速模式 — 输入$8.00 / 输出$40.00(原为$10.00 / $60.00),溢价2倍,输出速度最高提升约2.5倍,智能水平不变。
• 上下文窗口 — 约1.05M tokens,输出上限128K。
OrcaRouter 以无加价的方式传递提供商费率,因此目录上的数字就是您支付的数字——而且供应商降价会在生效当日就反映在列表上。在实时模型页面上,卡片显示每 1M 4.00 美元 / 20.00 美元,缓存读取 0.400 美元,并带有 Vision、Tools、JSON 和 Reasoning 徽章。这是 Sol 的标价自 7 月 30 日降价以来的首次变动,那次降价将 GPT-5.6 Luna 降至 0.20 美元 / 1.20 美元,GPT-5.6 Terra 降至 2 美元 / 12 美元,而旗舰版保持不变;8 月 24 日的降价则轮到了旗舰版。
改变有效价格的杠杆
基础费率只是起点。四个修正因素会改变Sol的实际成本:
• 提示缓存——重复使用的上下文按每百万$0.40计费,而非全新内容的$4.00;缓存写入费用为每百万$5.00。对于任何每轮都会重新发送大量前缀的代理或聊天应用来说,缓存是账单上最大的单一杠杆。OpenAI 以项目和 API 密钥作为缓存的键,因此坚持使用同一个密钥(同一个渠道)是让缓存持续命中的关键。
• 长上下文档位 — 输入超过约 272K token 的请求将从基础费率变为 $8 / $30。少数几个超大提示词可能悄悄拉高你的平均价格,因此在并非真正需要深度上下文时,请进行批处理或截断。
• 批处理 — OpenAI的批处理API以异步方式运行作业,周转时间约为24小时,而价格正好减半:$2.00 / $10.00,其中缓存输入为$0.20,缓存写入为$2.50。它与提示缓存叠加,适用于评估、批量分类和离线生成等对延迟不敏感的场景。
• 快速模式——$8 / $40,输出吞吐量最高提升约2.5倍,适用于延迟敏感、用户等待中的工作,如实时编码辅助。按token计费,为标准费率的2倍,不计入已购买的Scale Tier TPM套餐,若超出共享速率限制,可回退至标准处理。
一次请求的实际成本
按token计费的价格比较抽象,因此这里以今日费率给出计算示例:
• 单次聊天调用,50K输入 + 20K输出 — $0.20 + $0.40 = $0.60(原价$0.85)。
• 1M 输入 + 1M 输出 — $4 + $20 = $24(原价 $35)。
• 智能体调用,200K 缓存上下文 + 20K 新输入 + 30K 输出 — $0.08 + $0.08 + $0.60 = $0.76。同样的调用在冷缓存情况下 — 220K 新输入需 $0.88,加上 $0.60 输出 — 总计 $1.48。缓存大约可使其成本减半。
• 一个月1000万token,按70%输入/30%输出拆分,其中80%的输入由缓存提供:140万未缓存输入($5.60)+ 560万缓存输入($2.24)+ 300万输出($60)≈ $68。不缓存时,同样的一个月费用为$88——而在GPT-5.6 Terra上,同样的一个月约为$50,在GPT-5.6 Luna上约为$5。Sol和Luna之间约14倍的价差,正是层级匹配比任何单一费率都更重要的原因。
有两个注意事项会提高实际费率。Sol 是一个推理模型——内部推理 token 按输出计费,每百万个 20 美元。在较高的推理努力设置下,一个困难提示词可能会将大部分输出预算花在思考上,因此在困难任务上的实际输出成本远高于粗略估算。此外,OpenAI 的分词器在某些输入上比上一代更冗长,因此相同文本的 token 消耗可能比在 GPT-5.5 上更多。请根据任务调整推理努力,尽可能限制输出,并在预估账单前测量实际用量。
Sol 的定价与同类产品相比如何

对照2026-08-25公布的价格(Sol按促销价计算)。媒体报道将此次降价解读为对Anthropic及中国实验室定价压力的回应——这是第三方解读,并非OpenAI的声明。
• GPT-5.6 Terra — $2 / $12,调价后的中档层级。Sol 现在的输入价格高出 2 倍,输出价格高出约 1.7 倍;当你不需要旗舰级推理时,Terra 是默认选择。
• GPT-5.6 Luna — 0.20美元/1.20美元,降价后的用量档位。与Sol相比有20倍的输入差距;Luna的定价面向大部分简单流量。
• Claude Opus 5 — $5 / $25。Sol 现在的输入和输出标价都便宜了 20%,而旧费率下 Sol 在输入上只是与 Opus 5 持平。降价之前,对比就已经有利于 Sol:本博客此前在相同的英文/混合样本上测得,Sol 生成的 token 数比 Anthropic 模型少约 34.5%;而一篇已发表的 token 经济学分析(TheBlockBeats)估计,即使 Sol 的输出费率更高,完成同等工作量时 Sol 的总账单仍可比 Claude Opus 5 低约 21%。请以你自己的 tokenizer 实测为准,而不是只看标价。
• Claude Fable 5 — $10 / $50。Sol 现在的输入和输出价格均比 Anthropic 最高档便宜 60%(旧费率下分别为 50% / 40%)。
• Claude Opus 4.8 — $5 / $25。Sol 现在的输入成本降低了 20%,输出成本也降低了 20%——与上一代 Anthropic 旗舰产品相比,标价优势已经完全逆转。
• Grok 4.6 — $2 / $6。这是榜单上最亮眼的数字:它在Artificial Analysis指数上追平了GPT-5.6 Sol(两者均为61),输入价格仅为后者的一半,输出价格约为后者的1/3.3,相比旧费率下2.5倍/5倍的差距已大幅缩小。
• DeepSeek V4 Pro——非高峰时段 $0.44 / $0.88(高峰时段价格翻倍)。对于廉价开源权重路线而言,这完全是另一个价格体系。
坦诚地讲:Sol 仍然是一款高端旗舰,但这次降价使它脱离了顶级价格档位——20 美元的输出定价现在低于 Claude Opus 5 的 25 美元和 Claude Opus 4.8 的 25 美元,使得 Claude Fable 5 的 50 美元成为唯一仍高于它的闭源旗舰输出价格。它的优势在于完成繁重工作的有效单位成本(它的分词器、它的推理能力、它的长上下文),而非绝对价格;8 月 24 日的降价让这一论点更具说服力。如果你的流量是简短提示和简单任务,2 美元的 Terra、0.20 美元的 Luna 或 2 美元/6 美元的 Grok 4.6 仍然是更便宜的选择——而且在指数上,Grok 4.6 在纸面上毫不逊色。
当Sol是错误的选择时
四种情况下,这个价格不是你想要的:
简短、简单的提示。对于约20K token以下且无需深度推理的场景,旗舰高级版纯属浪费。GPT-5.6 Terra 按 $2 / $12 或 GPT-5.6 Luna 按 $0.20 / $1.20 即可用一小部分成本处理批量需求,而 Grok 4.6 或 DeepSeek 级别的模型费用更低。
推理密集型负载。因为推理按输出计费,在高推理强度下,高难度提示词的费用可能远超标称的输出价格。如果你的工作负载包含大量困难调用,请在正式投入前先测量实际输出的 token 数量——实际费率可能会让你意外。
以每 token 价格作为唯一目标。Grok 4.6 在指数上与 Sol 并列,价格为 $2 / $6,而 DeepSeek V4 Pro 的错峰价格为 $0.44 / $0.88。如果前沿基准测试分数不是硬性要求,那么对于同类工作,这些模型的每 token 价格要低得多。
严格的延迟预算。Sol 是大型推理模型,因此其首令牌时间远高于 Flash 级模型。对于亚秒级 TTFT 至关重要的实时聊天场景,$8/$40 的快速模式提升的是吞吐量,而非降低首令牌延迟——而更小的模型仍然是更经济的解决方案。
如何在 OrcaRouter 上调用它?

GPT-5.6 Sol 托管在 OrcaRouter 上,模型 ID 为 openai/gpt-5.6-sol,通过 OpenAI 兼容端点 api.orcarouter.ai/v1 按提供商费率提供服务,零加价。如果你已经有 OpenAI 客户端,迁移只需要修改基础 URL 和模型 ID——仅此而已。同一个密钥和端点支持 200 多个模型,因此 Sol 与 GPT-5.6 Terra、GPT-5.6 Luna、Claude Opus 5、Claude Fable 5、Grok 4.6 以及你想拿来与之对比的开放权重模型并列,你可以按难度路由,而无需逐一重新集成。
OrcaRouter 有两个在定价页面上值得提及的特性。BYOK:自带 OpenAI API 密钥,OpenAI 按自身费率直接向你收费——OrcaRouter 每个 token 加价 $0,并让你原有的提供商速率限制和额度保持不变。护栏:PII 防护盾和内容策略在计费之前运行,因此被拦截的请求会返回干净的 400 状态码,且永远不会被计费;Agent 防火墙会在工具和 MCP 调用执行之前对其进行评估。
定价页面最重要的诚实说明:我们负责路由模型,但价格不由我们设定。 $4 / $20 这一数字是 OpenAI 促销价的直接转传——当 OpenAI 于 8 月 24 日调整价格时,本页面列表当天即同步更新,这正是本页面带有日期戳的原因。如果你直接调用 OpenAI,得到的是同样的价格;如果你想要一个覆盖整个模型系列的端点,OrcaRouter 就是那个单密钥、零加价的通道。
来源和日期
以上所有价格已于2026-08-25核实。GPT-5.6 Sol的数据来自OpenAI公布的API定价,并与OrcaRouter上GPT-5.6 Sol的模型页面(当日核对)以及8月24日降价的媒体报道(Indian Express、Economic Times、The Star)进行了交叉核对;批量、快速模式、缓存写入和长上下文费率均为OpenAI官方公布。Claude、Grok和DeepSeek的数据为OrcaRouter目录中的当前列表,其中DeepSeek V4 Pro显示的是非高峰费率。Sol的标价自7月9日发布至7月30日降价期间均未变动,直到8月24日才随着本次促销首次调整——这正是日期在此重要的原因:4美元/20美元的费率是临时的,而价格会变动;你找到的任何更早或更晚的“GPT-5.6 Sol定价”页面,请以核对的日期为准。此处的数字为截至今日的最新数据。
以上每个价格均为GPT-5.6 Sol on OrcaRouter上的实时汇率——于 2026-08-25 核对,零加价,可供您自己的密钥直接使用。
本文中的对比2
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
