针对旗舰机型定价的科技博客主视觉编辑式扁平矢量插画:浅色背景上一枚深蓝色大圆角模型芯片,带有柔和的青色辉光;芯片一角夹着一张纸质价格标签;三条代币流从芯片流出,汇入带有抽象小刻度的圆形价格仪表;仪表旁有一小叠缓存块;一张细长日历页从左侧滑入。白色背景点缀柔和的蓝青渐变,并有一处微妙的暖色高光;极简扁平线框图标;简洁现代的无衬线几何字体排版;无可读文字。
Guides & Insights

GPT-5.6 Sol API 定价:每 100 万 Tokens 收费 $5 / $30,缓存 $0.50,以及真实成本是多少

作者

Gideon Frost

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

GPT-5.6 Sol 的价格为每百万输入 token 5.00 美元、每百万输出 token 30.00 美元,这是 GPT-5.6 Sol API 上的价格——与 OrcaRouter 目录中旗舰层级的费率相同,检查于 2026-08-18,零加价。它是 GPT-5.6 系列中最贵的层级,也是唯一一个在 7 月 30 日降价中未调整标价的层级,因此在 GPT-5.6 Sol 实时模型页面上显示的费率卡才是预算时应参考的。关键杠杆比标题数字更重要:通过提示缓存,复用输入按每百万 0.50 美元计费;批量 API 降至 2.50 / 15.00 美元;快速模式则以 2 倍溢价换取最高 2.5 倍速度。本页面是 Sol 专属的定价参考——包括确切的费率卡、一次请求的实际成本、旗舰层级与同类产品的对比、何时不应购买它,以及如何通过一个兼容 OpenAI 的端点使用您自己的密钥来调用它。

价格按每百万 Token(输入/输出)计算,截至 2026-08-18。美元金额取自 OpenAI 公布的 API 费率,并与 OrcaRouter 上 GPT-5.6 Sol 的模型页面交叉核对;缓存、批量、快速模式和长上下文费率均为 OpenAI 官方公布。价格会变动——构建前请核实。

今天已核实的确切价格

以下是 GPT-5.6 Sol 的完整费率卡,核实于 2026-08-18:

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

输入 — 缓存未命中时,每 1M tokens 收费 $5.00。

输出 — 每100万token 30.00美元。

提示缓存读取 — 每 1M tokens 仅需 $0.50,对您重新发送的任何输入提供 90% 折扣。

提示词缓存写入 — 每1M tokens $6.25。

长上下文层级——超过约272K个token的输入按$10.00输入/$45.00输出计费(输入2倍,输出1.5倍)。

Batch API — $2.50 输入 / $15.00 输出,统一五折,异步处理,通常约24小时内完成。

快速模式 — $10.00 输入 / $60.00 输出,支付 2 倍价格可获得最高约 2.5 倍的输出速度,且智能水平不变。

上下文窗口 — 约1.05M tokens,输出上限128K。

OrcaRouter 直接传递提供商费率,不加任何加价,因此目录上显示的数字就是您实际支付的数字。在实时模型页面上,卡片显示每 1M 次读取 $5.00 / $30.00,缓存读取 $0.500,并带有 Vision、Tools、JSON 和 Reasoning 徽章。Sol 的 $5 / $30 也是降价前的价格:OpenAI 7 月 30 日的降价适用于 GPT-5.6 Luna(现为 $0.20 / $1.20)和 GPT-5.6 Terra(现为 $2 / $12),而旗舰版价格保持不变。

改变有效价格的杠杆

基础费率只是起点。四个修正因素会改变Sol的实际成本:

提示缓存——重复使用的上下文按每百万 0.50 美元计费,而不是全新的 5 美元;缓存写入成本为每百万 6.25 美元。对于任何在每轮都会重新发送大型前缀的智能体或聊天应用来说,缓存是账单上最大的杠杆。OpenAI 按项目和 API 密钥对缓存进行键控,因此固定使用同一个密钥(同一个通道)才能确保持续命中。

长上下文层级 — 输入超过约 272K token 的请求将从基础费率切换至 $10 / $45。少数超大提示词可能会悄悄抬高你的平均价格,因此,当你并非真正需要深度上下文时,请进行批量处理或截断。

Batch——OpenAI 的批处理 API 会异步运行作业,周转时间约为 24 小时,价格恰好减半:$2.50 / $15.00,其中缓存输入为 $0.25,缓存写入为 $3.13。它可以与提示缓存叠加使用,适用于评估、批量分类和离线生成等对延迟不敏感的场景。

快速模式 — $10 / $60,最高可提供约2.5倍的输出吞吐量,适用于对延迟敏感、用户等待中的任务,如实时编码辅助。按token计费,费率为标准费率的2倍,不计入已购买的Scale Tier TPM套餐额度;如果超出共享速率限制,则可回退到标准处理。

一次请求的实际成本

按token计费的价格比较抽象,因此这里以今日费率给出计算示例:

单次聊天调用,50K 输入 + 20K 输出 — $0.25 + $0.60 = $0.85

1M 输入 + 1M 输出 — $5 + $30 = $35

智能体回合,200K 缓存上下文 + 20K 新输入 + 30K 输出 — $0.10 + $0.10 + $0.90 = $1.10。冷缓存下的同一回合——220K 新输入,价格为 $1.10——总计 $2.00。缓存几乎可以使其减半。

按70%输入/30%输出拆分的一个月1000万token用量,其中80%的输入由缓存提供:140万新输入(7.00美元)+ 560万缓存(2.80美元)+ 300万输出(90美元)≈ 100美元。无缓存时,同样一个月为125美元——而在GPT-5.6 Terra上,同样一个月约50美元,或在GPT-5.6 Luna上约5美元。Sol和Luna之间20倍的差距,正是层级匹配比任何单一费率都更重要的原因。

有两个注意事项会提高实际费率。{{1}}Sol 是一个推理模型——内部推理 token 按输出计费,每百万个 30 美元。在高推理强度设置下,一个高难度提示可能会将其输出预算的很大一部分用于思考,因此在困难任务上的实际输出成本会远高于简单估算。{{/1}}此外,{{2}}OpenAI 的分词器在某些输入上比上一代更冗长,因此相同文本可能比在 GPT-5.5 上消耗更多 token。{{/2}}根据任务调整推理强度,尽可能限制输出,并在预估账单前测量实际用量。

Sol 的定价与同类产品相比如何

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

根据2026-08-18公布的建议零售价:

GPT-5.6 Terra — $2 / $12,降价后的中档层级。Sol 的输入和输出费用高出 2.5 倍;当你不需要旗舰级推理时,Terra 是默认选择。

GPT-5.6 Luna — $0.20 / $1.20,降价后的量档。与Sol相比有25倍的输入差距;Luna的定价面向大多数常规流量。

Claude Opus 5——$5 / $25。同样的输入,输出按标价便宜 20%。但在实践中,对某些工作负载来说,对比结果会发生反转:本博客此前在相同的英文/混合样本上测得,Sol 消耗的 token 数比 Anthropic 模型少约 34.5%;而 TheBlockBeats 发表的一篇 token 经济学分析估计,尽管输出费率更高,Sol 完成同等任务的总费用仍可比 Claude Opus 5 低约 21%。度量你自己的 tokenizer,而不是看标价。

Claude Fable 5——$10 / $50。与 Anthropic 顶级型号相比,Sol 的输入价格为其一半,输出价格则便宜 40%。

Claude Opus 4.8 — $5 / $25。输入与 Sol 相同,输出更便宜——Anthropic 上一代旗舰模型。

Grok 4.6——$2 / $6。这是榜单上最亮眼的数字:它在 Artificial Analysis 指数上追平了 GPT-5.6 Sol(两者均为 61),输入价格便宜 2.5 倍,输出价格便宜 5 倍。

DeepSeek V4 Pro——非高峰时段 $0.44 / $0.88(高峰时段价格翻倍)。对于廉价开源权重路线而言,这完全是另一个价格体系。

坦诚地讲:Sol 是一款高端旗舰,输出速率也属高端——是 Claude Fable 5 以下封闭旗舰中输出速率最高的。它的赢面在于单位繁重工作的有效成本(其分词器、推理能力和长上下文),而非绝对速率。如果你的流量是短提示和简单任务,$2 的 Terra、$0.20 的 Luna 或 $2/$6 的 Grok 4.6 才是更便宜的选择——而且在指数上,Grok 4.6 纸面上毫不逊色。

当Sol是错误的选择时

四种情况下,这个价格不是你想要的:

简短、简单的提示。对于约20K token以下且无需深度推理的场景,旗舰高级版纯属浪费。GPT-5.6 Terra 按 $2 / $12 或 GPT-5.6 Luna 按 $0.20 / $1.20 即可用一小部分成本处理批量需求,而 Grok 4.6 或 DeepSeek 级别的模型费用更低。

推理密集型负载。因为推理按输出计费,在高推理强度下,高难度提示词的费用可能远超标称的输出价格。如果你的工作负载包含大量困难调用,请在正式投入前先测量实际输出的 token 数量——实际费率可能会让你意外。

以每 token 价格作为唯一目标。Grok 4.6 在指数上与 Sol 并列,价格为 $2 / $6,而 DeepSeek V4 Pro 的错峰价格为 $0.44 / $0.88。如果前沿基准测试分数不是硬性要求,那么对于同类工作,这些模型的每 token 价格要低得多。

严格的延迟预算。Sol 是一个大型推理模型,因此首次令牌时间(TTFT)远高于 Flash 级别模型。在需要亚秒级 TTFT 的实时聊天场景中,$10 / $60 的快速模式提升的是吞吐量,而非降低首个令牌的延迟——更小的模型仍然是更便宜的解决方案。

如何在 OrcaRouter 上调用它?

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol 托管在 OrcaRouter 上,模型 ID 为 openai/gpt-5.6-sol,通过 OpenAI 兼容端点 api.orcarouter.ai/v1 按提供商费率提供服务,零加价。如果你已经有 OpenAI 客户端,迁移只需要修改基础 URL 和模型 ID——仅此而已。同一个密钥和端点支持 200 多个模型,因此 Sol 与 GPT-5.6 Terra、GPT-5.6 Luna、Claude Opus 5、Claude Fable 5、Grok 4.6 以及你想拿来与之对比的开放权重模型并列,你可以按难度路由,而无需逐一重新集成。

OrcaRouter 有两个在定价页面上值得提及的特性。BYOK:自带 OpenAI API 密钥,OpenAI 按自身费率直接向你收费——OrcaRouter 每个 token 加价 $0,并让你原有的提供商速率限制和额度保持不变。护栏:PII 防护盾和内容策略在计费之前运行,因此被拦截的请求会返回干净的 400 状态码,且永远不会被计费;Agent 防火墙会在工具和 MCP 调用执行之前对其进行评估。

定价页面上一句重要的实话:我们负责路由模型,而不是设定其价格。$5/$30 的数字是 OpenAI 的费率原样转传,OpenAI 调整时列表会随之更新——这正是本页带有日期戳的原因。如果你直接调用 OpenAI,得到的费率完全相同;OrcaRouter 提供单密钥、零加价的路径,让你用一个端点覆盖整个模型系列。

来源和日期

以上所有价格已于2026-08-18核实。GPT-5.6 Sol 的数据取自 OpenAI 公布的 API 定价,并与 OrcaRouter 上 GPT-5.6 Sol 的模型页面(同日核实)及我们自行发布的 GPT-5.6 定价页面进行了交叉核对。批量、快速模式、缓存写入和长上下文费率均为 OpenAI 官方公布。Claude、Grok 和 DeepSeek 的数据为 OrcaRouter 目录中的当前列表,其中 DeepSeek V4 Pro 显示的是其非高峰费率。自2026年7月9日发布以来,OpenAI 未调整过 Sol 的标价——7月30日的降价未波及这款旗舰产品——但价格会变动;你找到的任何更早的"GPT-5.6 Sol 定价"页面,都请以核实日期为准。此处数字均为截至今天的最新数据。

以上每个价格均为OrcaRouter 上 GPT-5.6 Sol的实时价格——于 2026-08-18 核验,零加价,可直接用于您自己的密钥。

本文中的对比3

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

providers@orcarouter.ai

加入我们的社区

Discordsupport@orcarouter.aiXGitHubYouTube