一份 GPT-5.6 Sol API 指南的标题卡片,展示了一张圆角网关卡片:一个代码标签显示 model: gpt-5.6-sol;一个价格标签显示每 1M tokens 收费 $5 / $30;一个标有「推理强度」的刻度盘,带六个档位;还有四个模型标签——GPT、Claude、Gemini 和 Qwen——通过细线连接到同一个网关。
Guides & Insights

GPT-5.6 Sol API:如何调用它、它花费多少、以及何时降级

作者

Alistair Wren

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.

两种方言与同一个模型ID

大多数 GPT-5.6 Sol 教程只展示一种方言,便就此止步。实际上有两种,且两者都能达到相同的权重。

• Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.

• Responses API — client.responses.create.相同的模型 ID,但请求结构更新:单个 input 字段和一个 reasoning 块({"effort": "high"})而不是 messages 数组。OpenAI 建议在新构建中使用它,因为它能直接接收推理参数,并将推理令牌作为一等输出返回——而且最高的 effort 级别仅在此处可用。

• 锁定层级。 裸别名 gpt-5.6 目前路由到 Sol,但别名恰恰是供应商在新旗舰发布时会更改的东西。显式传入 gpt-5.6-sol 意味着每次调用都标明其成本,这也是每个网关所期望的 ID。

你得到什么——以及决定你账单的那个表盘

GPT-5.6 Sol是OpenAI的重推理旗舰模型:约1.05M token的上下文窗口、128K最大输出、2026年2月16日的知识截止日期,以及文本、图像和文件输入与文本输出。在独立的Artificial Analysis排行榜上,它的AA智能指数为61、AA编码得分为77,以及SWE-bench Pro得分为64.6%(由llm-stats独立测量)——其中编码数字才是智能体圈子里实际引用的那个。

A spec and benchmark scoreboard for GPT-5.6 Sol: model id gpt-5.6-sol, ~1.05M token context window, 128K max output, released July 9 2026, AA Intelligence Index 61 and AA Coding 77 per Artificial Analysis, SWE-bench Pro 64.6% independently measured by llm-stats, and six reasoning-effort levels from none to max.

思考是默认开启的,而推理努力参数是影响延迟和成本的最大杠杆:

• 六个级别 — 无、低、中、高、极高、最大。无用于机械性任务时会关闭推理;最大适用于错误代价较高的问题,并且只能通过 Responses API 使用。

• 从中等水平开始,一次调整一个级别。 apidog GPT-5.6 教程指出,许多 GPT-5.5 工作负载在 5.6 系列上低一个级别就能保持原有质量——在为更多思考付费之前,先衡量质量。

• Pro 模式是一种设置,而不是一个模型。设置 reasoning.mode: "pro"后,模型会优先考虑答案质量而非速度。价格和模型 ID 不变。

• 详细程度—低、中(默认)、高— 独立于推理控制输出长度。

• 推理 token 按输出计费,每百万个 30 美元。在 xhigh 或 max 的高难度提示下,内部推理可能会占据账单的主要部分——这是推理模型定价中隐藏的部分,标价上从来不会显示。

Sol 的实际成本

Sol 的基础价格在 OpenAI 2026年7月30日的降价中保持不变:每百万输入 $5,每百万输出 $30。此次降价落在两个更便宜的层级上——GPT-5.6 Terra降至$2 / $12,而GPT-5.6 Luna降至$0.20 / $1.20——这一点很重要,因为正是这一对比能告诉你 Sol 何时属于大材小用。

A price card for the GPT-5.6 Sol API: Sol at $5 input / $30 output per 1M with a $0.50 cache read and a $6.25 cache write, a long-context tier at $10 / $45, GPT-5.6 Terra at $2 / $12 and GPT-5.6 Luna at $0.20 / $1.20, and a worked example of 100K tokens in plus 20K out billing $1.10 uncached or about $0.65 with a cached input leg.

三个修饰符会改变有效速率:

• 提示缓存。重复使用的输入按大约 $0.50 每百万在缓存读取时计费——较新输入便宜 90%——而缓存写入按 $6.25 每百万计费(未缓存输入价格的 1.25 倍)。默认情况下缓存是隐式的,可通过以下方式显式启用:prompt_cache_options 并指定 ttl;缓存前缀至少需要 1,024 个 token,并且至少保持有效 30 分钟。

• 长上下文层级。当输入规模超过阈值时,Sol 会升级到$10 / $45 每百万。少数超长提示会悄然改变你的平均价格。

• 模型发出的所有内容都是输出。这包括内部推理令牌,因此在推理密集型调用中,输出端是费用集中的部分。

一个具体的账单:一个10万token的请求产生2万输出token,计费输入$0.50,输出$0.60——合计$1.10未缓存。如果下次请求时该10万token提示词命中缓存,输入费用降至约$0.05,往返总费用接近$0.65。在长时间运行的agent循环中,如果整天复用相同的系统提示词,缓存就是Sol是否可负担的分水岭。

Sol 运行量子计算实验:OpenAI 的报道

关于这个$5 / $30费率能买到什么,目前最有力的答案是OpenAI自己在2026年9月8日发布的一个用例——一篇官方帖子,“GPT-5.6 Sol如何帮助运行量子计算实验”,该用例是将模型指向真实的实验室硬件,而不是另一个编码基准。在其中,OpenAI描述了MIT工程量子系统组(EQuS)的研究生Beatriz Yankelevich——该实验室研究冷却到接近绝对零度的超导量子比特——将GPT-5.6 Sol(通过Codex运行)连接到协调其芯片测量的软件。考虑到特定于测量的技能和芯片的设计目标,GPT-5.6 Sol选择了测量参数、驱动硬件、分析返回的数据,并决定要改进或保存什么。在一块未校准的六量子比特芯片上,它在研究人员几乎不干预的情况下完成了标准校准序列:它找到了每个量子比特的跃迁频率,校准了控制和读出量子比特的脉冲,并测量了量子比特保留量子信息的时间。

OpenAI 对能力边界直言不讳,而且告诫总是与论断相伴出现:当实验信号微弱或充满噪声时,Sol 需要更长时间才能找到可行参数,有时甚至需要经验丰富的研究人员从旁引导。因此,应把这篇帖子当作OpenAI 的自述——一份厂商案例研究,而非独立的基准测试——并提取其中真正的信号:工作负载特征。EQuS 现在可以让智能体在夜间自动完成常规芯片表征,而此前这项工作每颗芯片都要耗费研究人员数天时间。这正是推理旋钮存在的意义所在:周期长、步骤多、需要反复调用工具的循环,由模型自行决定下一步行动,走错一步代价高昂。同样,这里使用的也正是同一批gpt-5.6-sol权重——通过 API 即可获取——Codex 只是执行框架,并非另一个模型。

一个端点,200+ 模型

If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the 1.05M-token context window, 128K max output, the p50 TTFT of 4.59s, and the /v1/chat/completions and /v1/responses endpoints.

价格方面是实打实的。OrcaRouter 加收每 token $0——模型页面上的 $5/$30 是 OpenAI 费率的原样传递,供应商价格变动在公布当天就会在我们这边生效。自带密钥是一项一流的选项:提供你现有的 OpenAI 密钥,保留你自己的速率限制和额度,OpenAI 直接向你计费。护栏——PII 防护盾和内容策略——在请求计费之前强制执行,而不是之后。路由 DSL 组合出故障转移逻辑,当 Sol 报错或你的流量形态允许时,更便宜的模型就会应答。

当Sol处于错误的等级时

作为旗舰产品并不等同于适合每一次调用,而且5美元/30美元的费率在三个方面存在劣势。

• 大量、低风险调用。每月处理1000万输入token的分类或提取流水线的成本在Sol上为$50,而在GPT-5.6 Luna上为$2——同样的端点、同样的密钥,只需更改一个id。Luna按$0.20 / $1.20定价,正是为此类工作而生。

• 不需要前沿深度的中端推理。 GPT-5.6 Terra以 $2 / $12 的价格介于走量级与旗舰级之间。apidog 教程的建议是明智的默认选择:在 Terra 上搭建原型,仅在 Terra 经实测确实无法胜任时才升级到 Sol,并将稳定的高容量路径下推到 Luna。

• 我们能承诺的边界。OrcaRouter负责路由和计费;OpenAI运行模型权重。端点、零加价、故障转移和安全护栏是我们的,但推理质量和安全行为是OpenAI的,而使用BYOK时,费用直接支付给他们。这就是协议所明确说明的:无论哪种方式,你都按提供商费率付费,问题在于一个端点支持200多个模型是否值得。

最重要的一点

如果你已有 OpenAI 客户端,请通过 Chat Completions 调用 GPT-5.6 Sol API;如果你是从零开始构建,则使用 Responses API——模型 ID 为 gpt-5.6-sol,费率为 $5/$30,且无论哪种方式,推理档位都相同。当任务困难、上下文很长、且输出每百万 token 价值 $30 时,它是合适的模型;而当任务属于常规场景时,它就不合适了——Terra 和 Luna 的价格只是它的一小部分。最简洁的方案是那种能让你随时改变主意的配置:一个端点、你自己的密钥、$0 加价,以及一个可以在工作负载变化时随时更换的模型 ID。

GPT-5.6 Sol 已在 OrcaRouter 上线,按 OpenAI 的 $5 / $30 标价、每 token 零加价——使用你现有的 OpenAI 密钥,服务商将直接向你计费。从OrcaRouter 上的 GPT-5.6 Sol开始——一个端点,无需二次集成。