OpenAI 下调 GPT-5.6 API 价格:有何变化、为何调整、如何获取
Guides & Insights

OpenAI 下调 GPT-5.6 API 价格:有何变化、为何调整、如何获取

作者

jinhao song

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

2026年7月30日,OpenAI下调了其两款低成本GPT-5.6模型的API价格——大幅削减了最便宜的档位,并小幅下调了中档价格,旗舰模型则保持不变。在日益激烈的价格战中,此举引人注目,且新价格已立即生效于公布的价目表。本文将准确说明具体变化、背后的工程原理、新价格与竞争对手的对比、需要留意的隐性成本、如何进一步削减账单——以及这些更低价格如何已在OrcaRouter上以0%加价上线。

下文中的每个数字均标明来源。定价按每百万个令牌(输入/输出)计算,反映OpenAI 2026年7月30日的价目表(据Unite.AI等媒体报道),外加OrcaRouter的直通模型页面;竞争对手的数据均注明出处。价格时有变动——构建前请核实。

TL;DR. OpenAI 将 GPT-5.6 Luna 的价格降至 $0.20 / $1.20(原价 $1 / $6,降幅约 80%),并将 GPT-5.6 Terra 降至 $2 / $12(原价 $2.50 / $15,降幅约 20%),而 GPT-5.6 Sol 维持 $5 / $30 不变。这得益于两项效率优化:重写的 GPU 内核(服务成本降低约 20%)和重新设计的推测解码草稿模型(token 生成速度提升 15% 以上)。此次降价使 Luna 低于 Anthropic 的 Haiku 4.5,并接近 DeepSeek 和 GLM 设定的开源模型低价底线。如果你通过像 OrcaRouter 这样供应商中立、0% 加价的端点进行路由,新价格已经生效——价格相同,一个兼容 OpenAI 的 API,旁边还有所有竞品模型可供比较和路由选择。

关键要点

• GPT-5.6 Luna:现在每1M tokens收费$0.20 / $1.20,原价为$1 / $6——大约降价80%。

• GPT-5.6 Terra:现价 $2 / $12,原价 $2.50 / $15 — 降幅约 20%。

• GPT-5.6 Sol(旗舰版):价格不变,$5 / $30。

• 原因:重写了生产级GPU内核(服务成本降低约20%),并重新设计了推测解码的草稿模型(token生成效率提升15%以上)——据OpenAI 7月29日的工程博文。

• 如何获取:该折扣已反映在 OrcaRouter 上(0% 加价)— Luna 定价为 $0.20 / $1.20 — 通过一个兼容 OpenAI 的端点。

到底发生了什么变化

OpenAI 的 GPT-5.6 系列采用分层阶梯结构:Luna(快速、最便宜)、Terra(中等)和 Sol(旗舰)。7月30日的降价影响了两个较便宜的层级。根据公布的费率表,GPT-5.6 Luna 从每百万输入/输出 tokens 的 $1 / $6 降至 $0.20 / $1.20——输入和输出均降低约80%——而 GPT-5.6 Terra 从 $2.50 / $15 降至 $2 / $12,降幅约20%。GPT-5.6 Sol 是为最困难的推理和智能体编程而打造的旗舰型号,价格保持在 $5 / $30。低价层级大幅降价;顶级层级则没有变动。

每 token 的基础费率并非全貌。GPT-5.6 的定价还包含输入长度档位(超长上下文会进入更高费率)、提示缓存折扣(缓存输入远比全新输入便宜),以及批处理选项(异步任务享受折扣)。这三者在降价后仍然适用,因此对于缓存或批处理密集型工作负载,有效价格甚至还能更低。但要注意长上下文档位是反方向的风险:喂入超大提示词可能会让你跳到更高档位。

削减背后的两项优化

这不是亏本引流的手段——OpenAI将其定性为一次效率红利。在2026年7月29日的一篇工程博文中,OpenAI技术团队成员描述了Codex和ChatGPT Work背后推理及智能体框架的多项优化。其中两项尤为突出。其一,跨生产基础设施的GPU内核重写——借助Codex内部运行的Sol来重写公司自身的内核——OpenAI称此举将端到端服务成本削减了约20%。其二,一个重新设计的推测解码草稿模型,据称将令牌生成效率提升了超过15%。服务成本降低,并以高用量套餐降价的形式传导给客户,这就是故事的表面——而这背后,是整个行业都在追逐的一个反馈回路的缩影:用前沿模型来优化服务于这些模型自身的基础设施。

新价格对比

这次降价直指竞争对手。据Unite.AI报道,Luna的新定价$0.20/$1.20在输入方面约为Anthropic Haiku 4.5的1/5,输出方面约为其1/4;Terra的新定价$2/$12也低于Claude Sonnet 5的标准定价(据报道为$3/$15,自2026年8月31日后生效)。在开放权重模型领域,Luna目前接近DeepSeek V4系列和智谱GLM-5.2所确立的廉价推理下限(约$1.20/$4.10),阿里巴巴的Qwen和谷歌的Gemini Flash系列也处于相近水平。换言之,OpenAI将其批量定价档位下调到了最便宜的有能力模型所在的区间——缩小了选择专有模型而非开放模型所需付出的价格代价。

推理越来越便宜

退一步看,这次降价符合一项持续多年的趋势:随着实验室从相同硬件中榨取更多吞吐量,每一代模型在给定能力水平上的成本都急剧下降。OpenAI 自家较旧的定价档位就体现了这种随时间的下行趋势;每一项效率突破——更好的内核、推测解码、更廉价的注意力机制——往往在数月内就会表现为降价。对买家来说,实际的启示是要为一个推理成本按节奏下降的世界设计架构:不要过度绑定单一模型的定价,并保持切换成本低廉。

需要留意的隐藏成本:推理令牌

GPT-5.6 模型是推理模型,这会影响实际支出。启用推理时,模型会生成内部推理 token,并按输出计费——因此你的实际输出成本可能高于按“答案中的字数”直接估算的结果,尤其是在推理强度较高的困难提示词上。解决办法是根据任务调整推理强度(简单调用使用低或关闭),尽可能限制输出,并测量实际 token 用量,而不是想当然。更低的每 token 价格有帮助,但控制生成的 token 数量更有帮助。

这对开发者意味着什么

如果你使用 GPT-5.6 Luna 或 Terra 处理高吞吐量工作——分类、提取、路由、轻量级 Agent、聊天——你的账单刚刚下降了,某些情况下降幅甚至达到原费用的大部分,且无需修改任何代码。这使得按量付费层级对成本敏感的工作负载更具吸引力,并缩小了与廉价开源模型之间的价格差距。旗舰模型的算账逻辑不变:Sol 定价 $5 / $30,依然是处理最棘手任务的高端选择。最佳实践是按难度进行路由——简单的 80% 用廉价层级(或廉价开源模型),旗舰模型只在物有所值的地方使用。

如何进一步削减您的账单

此次降价是打基础的地板,而非终点线。最大的额外杠杆有:提示词缓存(复用稳定的系统提示词或长上下文,支付低得多的缓存输入费率);批量选项(以折扣价异步运行非紧急任务);分层与模型路由(将每个请求发送到能处理它的最便宜模型,包括开放模型);以及推理控制(不要为琐碎调用支付深度推理费用)。叠加起来,这些方式削减实际账单的幅度通常远超任何单一费率变化。举个具体参照:按每月1000万token、输入占比70%计算,Luna的新费率大约为每月5美元(使用缓存则约4.37美元);同样的用量在Sol上约为每月125美元——这就是按难度路由最有力的论据。

如何立即捕捉更低的价格

这是将一切串联起来的关键部分。a href="https://www.orcarouter.ai/">OrcaRouter/a> 收取 0% 加价,并将提供商的定价原样传递,因此 OpenAI 的报价已经实时上线 OrcaRouter:GPT-5.6 Luna 目前在模型页面上显示 $0.20 / $1.20,Terra 显示 $2 / $12——与 OpenAI 官方价格卡一致,只需通过一个 OpenAI 兼容端点即可访问,同时支持 185+ 个其他模型。无需迁移,你就能享受这一价格;你还可以在一处将 Luna 和 Terra 与 DeepSeek、GLM、Qwen、Gemini、Claude 进行比价,然后根据具体任务,将每个请求路由到最便宜的选项。此外还有免费套餐和 Offers 页面,可进一步节省费用。

该降价已在 OrcaRouter 上线:GPT-5.6 Luna 每 100 万 tokens 定价为 $0.20 / $1.20,以 0% 加价直通。

按难度规划路线,节省更多

最便宜的账单不是单一模型——而是针对每个请求选择合适的模型。由于OrcaRouter通过一个端点即可覆盖整个模型池,你可以将简单、高并发的调用发送给Luna或某个廉价的开源模型,而将Sol或其他旗舰模型保留给困难任务,切换时只需更改配置,而无需重新集成。Luna降价让这种按难度路由的策略更加划算,且你无需重新改造任何环节。

常见问题

OpenAI 将 GPT-5.6 的价格下调了多少?

GPT-5.6 Luna 的价格从每百万 token $1 / $6 降至 $0.20 / $1.20(约下降 80%),GPT-5.6 Terra 从每百万 token $2.50 / $15 降至 $2 / $12(约下降 20%)。GPT-5.6 Sol 保持在每百万 token $5 / $30。

价格削减是什么时候生效的?

2026年7月30日,记录在OpenAI的API更新日志中,并在已发布的费率卡上生效。

为什么OpenAI降低了价格?

OpenAI将其归因于推理优化——重写的生产级GPU内核(服务成本降低约20%)以及重新设计的投机解码草稿模型(token生成效率提升15%以上)——据2026年7月29日的一篇工程博文。

旗舰款(Sol)降价了吗?

不。GPT-5.6 Sol 仍然是每百万个代币 $5 / $30。只有价格更便宜的两个档位 Luna 和 Terra 被下调了。

新价格与Anthropic和开源模型相比如何?

据报道,Luna 现在的输入/输出价格分别约为 Anthropic Haiku 4.5 的 1/5 和 1/4,而 Terra 则低于 Claude Sonnet 5 的标准定价($3 / $15)。Luna 也接近 DeepSeek 和 GLM-5.2 设定的廉价开源模型价格底线。

推理代币有什么猫腻?

GPT-5.6 是推理模型;内部推理令牌按输出计费,因此有效输出成本可能超出简单估算。可通过调整推理力度并设置输出上限来控制成本。

如何获得新的更低价格?

它们已在 OpenAI 的 API 上上线,并且以 0% 加价在 OrcaRouter 上提供——其中 GPT-5.6 Luna 显示为 $0.20 / $1.20——通过一个兼容 OpenAI 的端点即可访问,无需更改任何代码。

底线

OpenAI 7月30日的降价使GPT-5.6 Luna和Terra在大批量任务中大幅降价——这是内核重写和推测解码改进带来的效率红利,也是对真实价格战的明确回应。此次降价现已低于Anthropic的廉价层级,并接近开放模型的底价。旗舰模型Sol保持不变,因此可按难度分流任务,善用缓存和批处理,并控制推理token数量以节省最多成本。由于OrcaRouter以0%加价传递提供商定价,更低费率已在该平台生效——价格不变、一个兼容OpenAI的端点、整个模型领域汇聚一处。无需改动一行代码即可享受降价,让每个请求自动选择能胜任任务的最便宜模型。

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube