GPT-5.6 降价后的定价:Luna vs Terra vs Sol,以及该使用哪个层级
Guides & Insights

GPT-5.6 降价后的定价:Luna vs Terra vs Sol,以及该使用哪个层级

作者

Jim Song

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

在O​penAI于2026年7月30日降价之后,GPT-5.​6系列——GPT-5.6 Luna、GPT-5.6 Terra和GPT-5.6 Sol——从未以如此低的成本进行大规模运行。一周后,也就是8月6日,O​penAI将同样的层级推入ChatGPT本身:GPT-5.6 Luna正在成为免费账户和Go账户的默认模型,提供无限文本聊天,而GPT-5.6 Sol则针对Plus和Pro进行了更新。但这三个层级的定价差异很大,选择正确的层级(加上善用缓存、批处理和路由)是影响API账单的最大单一因素。本指南列出了降价后的完整定价、实际成本示例、每个层级与竞争对手的对比,以及如何通过一个端点在这些层级之间进行路由。

价格按每百万token(输入/输出)计费,反映降价后的费率表(据公开报道)及OrcaRouter的直通模式页面;分层费率和缓存费率来自OrcaRouter的模型页面,竞争对手数据均已注明出处。本文中ChatGPT的推出细节来自OpenAI于2026年8月6日的官方表述——为厂商自报数据,未经独立测量。价格会变化——构建前请核实。

太长不看

GPT-5.6 Luna($0.20 / $1.20)是高吞吐量的主力;Terra($2 / $12)是均衡的中端;Sol($5 / $30)是用于最困难推理和智能体编码的旗舰。三者共享约 1.05M token 的上下文窗口和 128K 的最大输出。提示词缓存和批处理选项进一步降低成本,而超长输入会将你移至更高层级。在消费端,O​penAI 于 8 月 6 日宣布,GPT-5.6 Luna 将成为 Free 和 Go 版 ChatGPT 账户的默认模型,提供无限纯文本聊天,同时更新后的 GPT-5.6 Sol 正面向 Plus 和 Pro 用户推出。对于简单的大多数任务,使用 Luna;需要更多时使用 Terra;仅在 Sol 物有所值时使用它——并通过一个 O​penAI 兼容端点按难度路由,以最小化支出。

关键要点

• Luna:每100万token $0.20 / $1.20 — 速度快、价格低,适合高吞吐量、对延迟敏感的工作。

• Terra:$2 / $12 — 均衡的中端选择,适合不需要旗舰机的更艰巨任务。

• Sol:$5 / $30 —— 深度推理、大规模编码、长周期智能体的旗舰产品。

• 缓存和批处理进一步降低成本;长输入会将你推向更昂贵的长上下文层级。

• ChatGPT(OpenAI 声明,8月6日):Luna 成为免费/Go 的默认选项,提供无限文本聊天;Sol 获得针对 Plus/Pro 的可靠性更新。

• 最大的节省杠杆:按难度路由——不要为Luna能完成的工作支付Sol级别的费率。

新的GPT-5.​6基础定价

以下是降价后每百万输入/输出 tokens 的基础定价:Luna $0.20 / $1.20(从 $1 / $6 下调),Terra $2 / $12(从 $2.50 / $15 下调),以及 Sol $5 / $30(不变)。两个较便宜的层级已于 2026 年 7 月 30 日降价;旗舰层级维持原价。简而言之,低层级现在的定价面向规模化,而旗舰层级保持高端定位。

分层、缓存和批量定价

基础费率仅仅是起点。GPT-5.6 的定价包含三个会实质性改变你实际成本的调节因素:

• 长上下文层级。超长输入的价格会逐级上调。在 OrcaRouter 的直通页面上,Luna 在达到大型上下文层级之前为 $0.20 / $1.20,超出后为 $0.40 / $1.80;Sol 在基础层级为 $5 / $30,在最大层级为 $10 / $45。层级由每个请求的输入 token 数量决定,因此少量超长提示词就会悄然拉高你的平均价格。

• 提示缓存。重用的上下文按大幅折扣计费——Luna 的缓存读取约为每百万 tokens $0.02(而全新读取为 $0.20),缓存写入约为 $0.25;Sol 的缓存读取约为 $0.50(而全新读取为 $5)。对于具有稳定系统提示的智能体和聊天应用,缓存往往是最主要的节省来源。

• 批量。非紧急任务以折扣价异步运行——非常适合批量分类、评估和离线生成等对延迟不敏感的场景。

示例:实际成本是多少

具体数字让层级变得真实。以每月1000万个token为例,输入/输出比例为70% / 30%(典型的聊天/智能体混合):

• Luna:每月约5美元(启用提示缓存后约为4.37美元)。

• Terra:每月大约50美元。

• Sol:每月约125美元(使用缓存后约为109美元)。

同样的体积,Luna 和 Sol 之间相差 25 倍——这正是为什么将每个请求匹配到能满足要求的最便宜层级,比任何单一费率都重要。(这些数字与 OrcaRouter 页面上的成本计算器一致,该计算器基于标价估算;你的实际数字取决于缓存以及你的输入/输出组合。)

每个层级实际上是用做什么的

GPT-5.6 Luna — 处理大规模任务的得力干将

Luna 是快速、高性价比的层级,专为高吞吐量、对延迟敏感的工作负载而调优:聊天、分类、提取、路由和轻量级智能体任务,p50 首令牌时间约为 1.65 秒。降价后,$0.20 / $1.20 的定价直接对标廉价开放模型——是绝大多数简单调用的默认选择。它也是 OpenAI 正在引导消费者版 ChatGPT 采用的层级:根据其 8 月 6 日的公告,GPT-5.6 Luna 将成为 Free 和 Go 账户的默认模型,纯文本聊天将不限量,新的 Think 按钮将于下周推出,用于在更难的问题上进行更深层的推理(文件、图片和语音限制保持不变)。OpenAI 表示,与它所取代的 GPT-5.5 Instant 相比,Luna 的事实性错误减少了 62%——这是供应商报告的数据,但明确表明该公司正将大部分流量引向这个高容量层级。

GPT-5.6 Terra — 均衡中庸

Terra 介于经济型与旗舰型之间:在更复杂的推理和编码任务上比 Luna 更强,但价格远低于 Sol。$2 / $12 的定价使其成为一个明智的默认选择——当 Luna 不够用、但又不需要旗舰版时,适合中等复杂度的信息提取、草拟和多步骤任务,且仍能大规模运行。

GPT-5.6 Sol — 旗舰

Sol 专为最艰巨的任务而生:{{1}}深度多步推理、大规模软件工程和长周期智能体工作流{{/1}},在{{2}}约 1.05M token 的上下文和高达 128K 的输出{{/2}}中保持连贯。以{{3}}$5 / $30(基础价){{/3}}的价格,它是一个高端选择——{{4}}请将其保留给真正需要的任务,如复杂的多文件编码或长时间的智能体运行{{/4}}。{{5}}8 月 6 日{{/5}},O​penAI 还为{{7}}Plus 和 Pro 用户{{/7}}更新了{{6}}ChatGPT 中的 GPT-5.6 Sol{{/6}}:{{8}}该公司表示{{/8}},{{9}}聊天版本在事实方面更加可靠{{/9}}——{{10}}据 O​penAI 称,事实性错误减少了 68%{{/10}}——并且{{11}}回答更加聚焦{{/11}},新增了{{12}}一个滑块{{/12}}来控制{{13}}其应用的推理力度{{/13}}。此次更新{{14}}仅限聊天端{{/14}}({{15}}Work 和 Codex 背后的 Sol 未变{{/15}}),{{16}}API 层级价格仍为 $5 / $30{{/16}}。

推理令牌的注意事项

GPT-5.​6 是推理模型,因此有效输出成本可能超过简单估算:开启推理时,内部推理 token 会按输出计费。在困难提示且推理强度较高的情况下,这部分可能占据账单的主要份额。要根据任务调整推理强度(简单调用设为低或关闭),在可行之处限制输出 token 数量,并测量实际使用量。更低的每 token 单价有帮助,但生成更少的 token 效果更大。

各层级与竞品的对比

这次降价使GPT-5.6在市场竞争中重新定位。据报道,Luna的$0.20 / $1.20现在在输入上约比Claude Haiku 4.5便宜5倍,输出上约4倍;Terra的$2 / $12也低于Claude Sonnet 5的标准定价(据报道为$3 / $15)。与开源模型相比,Luna接近DeepSeek V4系列和智谱GLM-5.2(约$1.20 / $4.10)所设定的价格底线,Qwen和Gemini Flash系列也在附近。结果是:对于成本敏感的工作,Luna现在与最便宜的有能力模型不相上下,而非它们的高端替代品——而Sol仍然是真正的高端层级,提供无法廉价获得的能力。

真正的省钱杠杆:按难度路由

最便宜的账单不是单一层级——而是将每个请求匹配到能够完成它的最便宜模型。在实践中:将简单、大量的调用发送给 Luna(或一个便宜的开源模型),对更困难的任务升级到 Terra,并且只将 Sol 用于真正困难的少数情况。结合缓存和批处理,这通常能比任何单一价格调整更大程度地降低成本。难点在于运营层面:你不想分别重新集成三个 OpenAI 层级以及开源模型替代方案。

通过一个端点即可访问全部三款(以及更便宜的竞品)

这就是供应商中立路由器的作用所在。OrcaRouter 通过一个兼容 O​penAI 的端点,以相同的降价后价格(0% 加价)提供 GPT-5.6 Luna、Terra 和 Sol,同时还提供更便宜的开源模型,如 DeepSeek V4 Pro、GLM-5.2 和 Qw​en。切换层级(或对 Luna 与开源模型进行 A/B 测试)只需更改配置,无需重新集成,而且你可以将每个请求路由到最便宜的模型。

降费后的 Luna 价格卡以标价显示在 OrcaRouter 自己的模型页面上——每百万 token 0.20 美元 / 1.20 美元——因为路由器以 0% 加价直接传递提供商价格,并附带典型月度账单的成本计算器。此外还有免费套餐和 Offers 页面,可享受更多优惠。

常见问题

GPT-5.6降价后的价格是多少?

Luna $0.20 / $1.20、Terra $2 / $12 和 Sol $5 / $30 每百万输入/输出令牌。Luna 和 Terra 的价格于 2026 年 7 月 30 日下调;Sol 保持不变。

我应该使用哪个 GPT-5.6 层级?

{{1}}Luna 适用于高吞吐量、延迟敏感型工作;{{/1}} {{2}}Terra 适用于不需要旗舰级的较难任务;{{/2}} {{3}}Sol 适用于最困难的推理和智能体编码。{{/3}} 按难度路由以最小化成本。

GPT-5.6 Luna 在 ChatGPT 中是免费的吗?

O​penAI于8月6日宣布,GPT-5.6 Luna将成为免费和Go ChatGPT账户的默认模型,提供不限次数的纯文本聊天;文件上传、图片和语音工具仍有限制,而用于更高推理的Think按钮将单独推出。这些是O​penAI公布的计划,并非独立核实的结果。

GPT-5.6 每月费用是多少?

在每月1000万token(70%输入)的情况下:Luna约5美元,Terra约50美元,Sol约125美元——在缓存之前,差距达25倍。您的实际成本取决于缓存以及您的输入/输出混合比例。

这三个层级都有相同的上下文窗口吗?

是的——大约支持105万token的上下文长度,最多可输出12.8万token,并支持视觉、工具、JSON和推理功能。

提示缓存如何影响成本?

缓存可大幅降低重复上下文的成本——Luna 的缓存读取约为每百万 token $0.02,而全新读取为 $0.20——因此应尽可能复用已缓存的提示词。反之,长输入可能会将你推入更昂贵的“长上下文”档位。

这些层级与Anthropic或开源模型相比如何?

根据报道,Luna 比 Claude Haiku 4.5 便宜(输入约 5 倍 / 输出约 4 倍),Terra 则低于 Claude Sonnet 5($3 / $15)。Luna 也接近低价开源模型的底线(Deep​Seek、GLM-5.2 约 $1.20/$4.10)。

我可以在哪里同时使用所有三个层级?

通过OrcaRouter的单一OpenAI兼容端点,零加成,同时提供更便宜的开源模型用于基于难度的路由。

底线

降价之后,GPT-5.6 Luna($0.20 / $1.20)和 Terra($2 / $12)对于高吞吐量和中端任务很有吸引力,而 Sol($5 / $30)仍然是高端旗舰——25倍的成本差距让智能路由更值得投入。面向消费者的发布强化了这一分化:O​penAI 将 Luna 设为免费默认选项,同时把 Sol 的可靠性更新保留给付费用户,这对 API 开发者来说,又多了一个把简单流量路由到 Luna 的理由。最大的节省来自按难度路由、充分利用缓存和批处理、控制推理 token,而不是默认使用某个单一层级。要做到这一点,最简单的方式是通过一个统一的 0% 加价端点,比如 OrcaRouter,在这里三个层级(按新价格)与你想要对比的更便宜的开源模型并列在一起。

本文中的对比2

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube