GPT-5.6 发布日期、功能、定价与访问指南
Guides & Insights

GPT-5.6 发布日期、功能、定价与访问指南

作者

Rowan Sterling

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

GPT-5.6 Sol 刚刚获得了一个 Ultrafast 速度档位——比标准处理快达 14 倍——本周已在 OpenAI API 上预览;而 GPT-5.6 TerraGPT-5.6 Luna 则继续将该系列推广到 ChatGPT。API 发布两个月后,GPT-5.6 系列既已广泛可用,仍在不断获得新能力:这款在推理上超越 GPT-5.5 的旗舰模型,现在可以以每秒高达 750 个输出 token 的速度进行预览。同一周,OpenAI 还将其 Daybreak 网络安全项目扩展为面向防御者的 Daybreak Blue 和面向攻击方的 Daybreak Red,并由一个基于 Sol 构建的新 GPT-5.6-Cyber 模型提供支持,用于授权漏洞研究。

OpenAI 于2026年7月9日发布了GPT-5.6模型系列,并于8月6日将旗舰模型推入ChatGPT,同时进行了以可靠性为重点的更新,并扩大了免费访问范围。这不仅仅是又一次单一模型的升级。它是一个分层系列,旨在为开发者在智能、速度和成本之间提供更清晰的选择——而且它现在也是免费ChatGPT用户的默认体验。

问题在于“GPT-5.6”在不同地方含义不同。

API自7月9日起上线,三个层级均采用公开定价。ChatGPT的推出是分阶段的:更新后的Sol于8月6日覆盖Plus和Pro用户,GPT-5.6 Luna本周成为Free和Go账户的默认版本,这些层级上的纯文本聊天将于8月10日那周起不限量。ChatGPT的Work和Codex界面背后的Sol未受此次更新影响。Ultrafast预览版再次独立:这是API中的新速度层级,于8月13日发布,最初仅限一小部分客户使用。

GPT-5.6 现已正式发布、正在交付并广泛可用——其旗舰版本在纸面上已成为最快的 frontier 模型。对开发者来说,有趣的部分仍然是路由决策:Sol 用于最困难的推理,Terra 用于均衡的生产工作,Luna 用于高容量场景——此外,当预览开放后,还会有一个 Ultrafast 层级,用于延迟敏感的 Sol 工作负载——而三个层级中有两个的价格在七月底发生了变化。

本指南讲解了什么是 GPT-5.6、官方已确认哪些信息、Sol、Terra 和 Luna 之间的区别、定价的运作方式、Ultrafast 预览版的意义,以及为什么 GPT-5.6 使模型路由变得更加重要。

快速回答

GPT-5.6 发布了吗? 是的。API 已于 2026 年 7 月 9 日推出,ChatGPT 访问正在逐步开放——自 8 月 6 日起为 Plus/Pro 更新了 Sol,本周 Luna 成为免费/Go 的默认版本。

我可以在 ChatGPT 中使用 GPT-5.6 吗? 可以。GPT-5.6 Sol 现已成为 Plus/Pro 聊天体验中的更新默认模型(带有新的思考滑块),而 GPT-5.6 Luna 将于本周成为 Free 和 Go 账户的默认模型。

我可以通过API使用GPT-5.6吗?可以。Sol、Terra和Luna都已上线公共API,并公布了定价;在OrcaRouter上零加价。

什么是 GPT-5.6 Sol Ultrafast 模式? 这是 API 上的一种预览速度层级,运行 GPT-5.6 Sol 的处理速度比标准处理快达 14 倍,每秒最多可输出 750 个 token。它最初仅限于一小部分客户,Open​AI 尚未公布其定价。

有等待名单吗?对于基础访问,没有——API 是公开的,ChatGPT 访问正在所有层级逐步推出,所以无需加入任何名单。超快模式则不同:它是一个有限预览,最初向一小部分客户开放,并提供注册,以便在容量扩大时收到通知。

GPT-5.6 何时正式全面可用?它已经分阶段推出了:API 于 2026 年 7 月 9 日上线,更新后的 Sol 于 8 月 6 日登陆 Plus/Pro ChatGPT,Luna 将于本周成为免费版/Go 的默认模型,无限量免费文本聊天将于 8 月 10 日当周上线。

你应该等待 GPT​-5.6 吗? 如果你要使用它,那就不需要等——它已经上线了。真正的问题在于:每个任务该路由到哪个层级,以及允许多少推理,因为现在这才是决定你单任务成本的因素。

GPT-5.6是什么?

GPT-5.6 是 OpenAI 最新的模型系列,也是 GPT-5.5 的继任代。

关键词是家庭。

Open​AI 不是为每个使用场景推出一个模型,而是引入三个层级:

- GPT-5.6 Sol是处理最艰巨任务的旗舰模型:深度推理、智能体编程、研究、专业知识工作以及复杂的工具密集型任务。

- GPT-5.6 Terra是面向日常工作的均衡模型。它旨在以更低的成本提供强大的能力,使其更适合无法将每个请求都发送给旗舰模型的生产应用。

- GPT-5.6 Luna 是最快且最具成本效益的层级。它专为大批量任务、轻量级自动化、摘要、分类、路由,以及其他速度和成本比最大推理深度更重要的负载而设计。

这改变了开发者需要问的主要问题。

问题不再是:我该不该用GPT-5.6?

更好的问题是:哪个 GPT-5.6 模型应该处理这项任务?

并非每个请求都需要Sol。有些任务需要最大的推理能力。有些需要更低的延迟。有些需要最便宜且可靠的模型。GPT​-5.6让这种权衡变得明确。

官方确认了什么?

GPT​-5.6 不应被视为传闻汇总。Open​AI 已正式确认模型系列和预览访问。

已确认的要点是:

- GPT-5.6 是一个包含 Sol、Terra 和 Luna 的模型系列。

它于2026年7月9日在API上发布,所有三个层级均公开定价。

- ChatGPT 访问正在逐步推出:为 Plus/Pro 更新了 Sol(8月6日),Luna 成为免费/Go 默认选项(本周),无限免费文本聊天(8月10日当周)。

OpenAI 报告称,更新后的 Sol 在内部金融/医疗/法律评估中产生的事实错误比 GPT-5.5 Instant 少约 68%(供应商报告;Luna 约为 62%)。

- Plus 和 Pro 用户将获得一个新的思考滑块,用于控制每次回复花费多少推理。

API定价是公开的——而Terra和Luna于2026年7月下旬被降价(Sol保持不变)。

GPT-5.6 引入了更可预测的提示缓存。

- GPT-5.6 Sol 包含一个新的最大推理努力。

- GPT-5.6 引入了一种使用子代理处理复杂工作的超强模式。

OpenAI 于 2026 年 8 月 13 日在 API 上预览了 GPT-5.6 Sol 的 Ultrafast 模式——处理速度比标准模式最高快 14 倍,每秒最多可输出 750 个 token,最初仅向一小部分客户开放。速度数据来自厂商声明,尚未经过独立验证。

OpenAI 于 2026 年 8 月 10 日将其经审核的网络安全计划 Daybreak 扩展为两个层级:Daybreak Blue(GPT-5.6 Sol,移除网络防护限制,用于防御性工作)和 Daybreak Red(GPT-5.6-Cyber,一种基于 Sol 的模型,经过专门训练用于授权漏洞研究)。访问权限仅限于经审核的客户和安全合作伙伴,不向公共 API 开放。

未解决的问题是不同的:

在实际任务中,经过 ChatGPT 调优的 Sol 与 API Sol 相比会如何?

在实际生产工作流中,它的速度会有多快?Ultrafast 预览版是第一个真实的数据点,而且目前仍仅限受邀用户使用。

- 安全措施会多久增加一次摩擦?

- 在实际任务中,Sol、Terra和Luna将如何比较?

多少推理才算足够,你又是如何调节新的思考滑块的?

- Ultrafast 层级将如何定价?Cerebras 的供应能多快跟上对其的需求?

这就是为什么正确的方法是准备,而不是盲目迁移。

GPT-5.6 发布日期与获取方式

最简单的答案:GPT​-5.6 于 2026 年 7 月 9 日在 API 上线,ChatGPT 访问权限将分阶段推出,直至8月底。

API 访问现已向任何开发者开放,并已公布定价。仍然不同的是表面:为 ChatGPT 的 Chat 体验调校的 Sol 与 API 模型并不相同——Open​AI 表示,驱动 Work 和 Codex 的版本保持不变——因此消费者应用与 API 之间的行为可能会有所差异。

{{1}}对于 ChatGPT 用户,六月的情况则相反。{{/1}} {{2}}Plus 和 Pro 用户将获得更新后的 Sol,在网页端、移动端和桌面端新增了思考滑块,可在回答深度与延迟之间进行权衡。{{/2}} {{3}}Free 和 Go 用户本周将默认使用 Luna,并新增一个用于回答更复杂问题的思考按钮;8 月 10 日那一周将推出无限量纯文本聊天功能。{{/3}}

访问故事中最新的一部分是Ultrafast预览。该预览于2026年8月13日发布,是GPT-5.6 Sol API中的一个新速度层级——比标准处理快达14倍(供应商声称)——并且它从小批客户开始使用,而非公开发布。OpenAI表示,它正在编码、商务、金融研究、客户支持和交互式应用等领域测试该层级,以便在扩大访问范围之前了解速度在哪些方面能创造真正的价值。其他客户可以注册,以便在容量增长时收到通知。

对开发者而言,现在稳妥的说法是:GPT-5.6 是一个已发布、已定价的 API 系列。剩下的不确定性在于行为层面——每个层级思考多少、回复有多冗长,以及每个已完成任务要花多少钱——而不是你能不能访问。Ultrafast 层级是唯一访问权限仍存疑的地方。

这一区别至关重要。不要围绕 GPT-5.6 的开放日期来规划发布;应围绕层级行为和单任务成本来规划。构建你的评估集,计量推理投入,并保留一条备用路径。

GPT-5.6 的 Sol、Terra 和 Luna 详解

GPT-5.6 Sol

当质量比成本更重要时,Sol是值得测试的模型。

用于:

复杂软件工程

- 智能体编码工作流

长时域工具使用

- 调试困难

- 研究分析

- 高利害企业推理

- 网络安全防御与漏洞研究

Sol 是旗舰级别,但这并不意味着它应该处理每一个请求。

2026年8月6日,OpenAI还重新调校了ChatGPT聊天体验中用于日常对话的Sol——在事实上更可靠,回答更直接,并在Instant和Thinking之间保持一致的语气。OpenAI的内部评估(而非独立实验室)显示,在金融、医疗和法律提示上,事实错误比GPT-5.5 Instant低约68%。ChatGPT的调校独立于API模型;Work和Codex背后的Sol保持不变。

Sol 也是获得 Ultrafast 预览的层级。2026 年 8 月 13 日,Open​AI 在 API 上为 Sol 预览了一种 Ultrafast 模式,该模式运行相同的模型,处理速度比 Standard 处理快达 14 倍(厂商声称),专为对延迟敏感的工作而设计。该功能尚未广泛开放——预览版首先向一小部分客户推出——但这是第一个迹象,表明 Sol 的质量不必以 Standard 级别的延迟为代价。

Sol 也是 Open​AI 的 Daybreak 计划背后的模型:Daybreak Blue 向经审核的防御者提供移除了网络护栏的 GPT-5.6 Sol,而 GPT​-5.6-Cyber 则是专门基于 Sol 训练,用于经授权的漏洞研究。这两个层级均属受限访问,且不在公共 API 之列。

GPT-5.6 Terra

Terra是平衡的选择。

用于:

- 日常AI助手

商务写作与分析

内部知识工具

客户支持工作流程

- 不需要最大推理的编程帮助

- 文档处理

- 中等复杂度自动化

Terra 可能会成为许多生产应用中最实用的 GPT-5.6 级别,因为它在性能和价格之间取得了平衡。

GPT-5.6 Luna

Luna是快速且价格实惠的层级。

用于:

大量请求

分类

- 路由

摘要

- 简单变换

- 轻量级的代理步骤

回退响应

草稿生成

当任务足够简单,以至于为Sol付费是浪费时,Luna就很有用。

Luna 现在也是消费者默认模型:在2026年8月3日那一周,Open​AI 将 GPT-5.6 Luna 设为 Free 和 Go ChatGPT 账户所使用的模型,以取代 GPT-5.5 Instant。新的 Think 按钮让这些用户可以要求更高的推理能力,纯文本聊天从8月10日那一周起变为无限。

GPT-5.6 定价与缓存

GPT-5.6 的定价已经公开。

GPT-5.6 Sol

每100万令牌5美元

输出:$30 每100万个token

- 最适合旗舰级推理、复杂编码和深度智能体工作

GPT-5.6 Terra

每100万token 2美元(从2026年7月底的2.50美元下调)

输出:$12 每 1M tokens(从 $15 下调)

- 最适合平衡的日常工作

GPT-5.6 Luna

$0.20 每百万 tokens(从 $1 下调)

- 输出:每百万tokens 1.20美元(原价6美元)

- 最适合快速、经济、高负载的工作

OpenAI于2026年7月下旬将Terra下调20%、Luna下调80%,理由是推理效率提升;Sol维持在$5/$30。由于OrcaRouter以0%加价原样传递供应商价格,这些降价会在上线的当天就出现在我们的模型页面上。

Ultrafast 预览版尚未公布价格。它仅面向一小部分客户提供限量预览,OpenAI 也尚未说明该层级的计费方式——因此不要假设 $5/$30 的 Sol 费率适用于该预览版。这一点值得与速度数据一同关注:如果高端速度层级以高价推出,那么对延迟敏感的工作负载而言,每 token 成本的计算方式将发生变化。

定价明确了一件事:GPT​-5.6 并非旨在作为适用于每项任务的默认模型。

一个合理的路由策略可能如下所示:

- 使用Luna处理简单、高容量的任务;

- 使用 Terra 进行日常推理和业务工作流;

- 使用 Sol 来完成最困难的编码、研究或代理任务;

- 积极地缓存重复的上下文;

- 默认情况下避免将所有请求发送给 Sol。

GPT-5.6 还引入了更可预测的提示缓存,包括显式缓存断点和最短 30 分钟的缓存生命周期。对于长时间运行的工作流、编码代理和企业级助手而言,这一点可能非常重要。

实用的要点:衡量每个完成任务的成本,而不仅仅是每个令牌的成本。

一个更贵的模型如果能用更少的尝试次数完成任务,可能反而更便宜。一个更便宜的模型在任务简单且量大时可能更合适。

GPT-5.6 有什么新功能?

GPT-5.6 不应主要通过传闻中的上下文窗口数字或泄露的内部日志来描述。

重要的变化是OpenAI已经确认的那些。

一个三层模型家族

Sol、Terra 和 Luna {{1}}让模型选择更加结构化{{/1}}。开发者可以 {{2}}根据难度、延迟和成本来路由任务{{/2}} 而不是 {{3}}将所有内容发送给一个旗舰模型{{/3}}。

更强的代理和编码工作流

GPT-5.6 Sol 定位围绕智能体编码、命令行工作流、规划、迭代和工具协调。

这一点之所以重要,是因为现代编码智能体所做的远不止编写代码片段。它们会检查仓库、运行命令、理解测试失败、补丁文件、验证更改,并重复这一过程直到任务完成。

新的最大推理努力

Sol 为更困难的任务引入了新的最大推理努力。

这不应到处使用。更高层次的推理会增加成本和延迟,因此应保留给值得进行更深入规划的工作:复杂调试、迁移、研究综合、安全审查或困难的数据分析。

Ultra模式与子代理

GPT-5.6 引入了一种超模式,使用子代理处理复杂工作。

这指向一个未来,模型不仅仅是回答提示,而是协调跨多个步骤或专门代理的工作。

极速模式:GPT-5.6 Sol,速度最高可达14倍

2026年8月13日,OpenAI在API中预览了Ultrafast,这是一个新的服务层级,运行GPT-5.6 Sol的速度比标准处理快14倍,每秒最多可生成750个输出token。OpenAI表示,该层级提供与GPT-5.6 Sol标准版相同的智能水平——速度提升关乎延迟,而非更小或更弱的模型。这些速度数据来自厂商声明:OpenAI与其推理合作伙伴Cerebras共同发布了这些数据,目前尚无独立实验室复现这些结果。

速度来自不同的推理栈,而非不同的模型。Ultrafast 运行在 Cerebras 的晶圆级引擎(Wafer-Scale Engine)架构上,该架构将模型权重保留在芯片上(每颗晶圆级芯片拥有 44 GB 的 SRAM),从而消除了限制基于 GPU 推理的内存带宽瓶颈。在这一层级,OpenAI 使用的是 Cerebras 的硬件,而非自己的硬件。

Ultrafast 最初是一个限量预览版。一小部分客户会率先获得访问权限,OpenAI 表示,它正在编码、商务、金融研究、客户支持和交互式应用中测试这一服务层级,以了解这种速度在哪些方面能创造价值。其他客户可以注册,以便在容量扩展时收到通知。目前尚未公布价格,也没有正式上市的日期。

OpenAI 和 Cerebras 也发布了对比数据,全部为厂商自行报告,基于 Artificial Analysis 的输出速度数据:Ultrafast 声称比 Fast 模式下的 Claude Opus 4.8 快 5 倍,比 Claude Fable 5 快 11 倍;在 Humanity's Last Exam 的 2,500 道题测试集中,据称只需 11 小时多一点即可完成,而 Claude Fable 5 需要三天以上,且准确率相当;在 GDP-Val(法律文书、财务模型、工程报告)上,它声称端到端速度提升 5.6 倍,且质量无损。在独立运行验证之前,请将这些视为 OpenAI 和 Cerebras 的说法。

这一层级还引发了两个悬而未决的问题。首先是产能:Cerebras的晶圆级供应是限制因素,预览版在2026年底之后是否仍保持仅限邀请状态,将表明硬件能否跟上需求。其次是定价结构:高级速度层级可能会对API定价进行细分,而这对于成本敏感型团队十分重要。

更强的保障措施

GPT-5.6 还配备了更强的安全防护措施,尤其是在网络安全和生物工作流程方面。在运行额外安全检查时,某些请求可能需要更长时间,或返回无内容。

对于合法的防御性或研究团队来说,这并不会使 GPT​-5.6 无法使用。但这确实意味着,在迁移到生产环境之前,应仔细测试涉及敏感领域的工作流。

Daybreak Blue and Red:GPT-5.6 为经审核的团队降低安全护栏

更强的防护措施的另一面是,Open​AI 现在也为同一系列提供减少护栏的访问权限。2026年8月10日,它将其经过审查的网络安全计划 Daybreak 扩展为两个层级。Daybreak Blue 为获批的防御者提供移除了系统级网络护栏的 GPT-5.6 Sol,用于漏洞发现、安全代码审查、恶意软件分析、检测工程、事件响应和补丁验证。Open​AI 将其描述为大多数防御者的推荐起点。

Daybreak Red 更进一步。它提供对 GPT-5.6-Cyber 的访问,这是一个基于 GPT-5.6 Sol 专门训练的模型,用于零日漏洞发现和漏洞利用链开发。访问受到严格限制和监控——身份验证、用途审批限制和法律合规声明——OpenAI 表示,从 2026 年 9 月 1 日起,个人 Daybreak 账户必须采用硬件安全密钥。

上述能力数据均由供应商报告。在{{1}}Open​AI{{/1}}的内部高级网络安全完成率测试中,{{2}}GPT​-5.6-Cyber{{/2}}在被要求执行的敏感任务中完成了95%,其前代产品{{3}}GPT​-5.5-Cyber{{/3}}则为57.3%——而{{4}}Sol through Daybreak Blue{{/4}}仅完成了2.0%(在标准防护措施下为1.5%)。{{5}}Open​AI{{/5}}将这一变化定性为拒答率的转变,而非智能水平的跃升:底层模型会作答而不再拒答。{{6}}Open​AI{{/6}}还表示,该模型帮助发现了{{7}}Chrome's V8 engine{{/7}}中的两个此前未知的漏洞,已披露给Google并以{{8}}CVE-2026-15903{{/8}}修复。

Daybreak 并非公开的 API 产品。访问需经 Open​AI 计划及安全供应商合作伙伴网络进行,因此大多数团队会间接接触到它——体现为更出色的防御工具,也体现为这样一个信号:Open​AI 现在推出了一款代表防御方对系统发起攻击的模型。

ChatGPT 中的 Sol:可靠性调校与思维滑块

2026年8月6日的公告关于消费者体验。Open​AI对ChatGPT的Chat体验中运行的Sol进行了调优,使其在事实(日期、数字、来源、规则和假设)方面更加可靠,在日常回复中更加直接,同时让Instant和Thinking体验更加接近。“更可靠”背后的数字是Open​AI自身的内部评估,而非独立实验室的结果:在金融、医疗和法律提示方面,与GPT-5.5 Instant相比,Sol出现事实性错误的回复减少了约68%,Luna减少了62%。

Plus 和 Pro 用户还将在网页、移动和桌面端获得一个新的思考滑块,用来选择每次回复花费多少推理——从解决日常问题的快速回答,到更深入的规划、研究、写作、编程或决策。OpenAI 表示,Work 和 Codex 背后的 Sol 版本未变;该调整适用于 Chat 体验。

Free and Go:默认 Luna,无限文本聊天

Open​AI 本周将 GPT-5.6 Luna 设为 Free 和 Go 版 ChatGPT 账户的默认模型,取代 GPT-5.5 Instant。从 8 月 10 日那一周开始,这些档位的纯文本聊天不再限量——没有速率限制,但有滥用防护——而文件上传、图片、图像生成和语音仍然受限。新增的 Think 按钮可让 Free 和 Go 用户要求 Luna 进行更深度的推理,纯文本聊天同样不受限制。Open​AI 还加强了对 18 岁以下用户的安全训练,包括针对浪漫角色扮演和年龄限制内容的边界。

GPT-5.6 对比 GPT-5.5

与GPT-5.5相比,GPT​-5.6在六个方面最为重要:

- 模型选择:GPT-5.6 引入了 Sol、Terra 和 Luna,而不是一个默认模型。

- 代理工作:Sol 在编码代理和工具密集型工作流方面定位更强。

- 推理控制:最大推理力度和极致模式为开发者针对困难任务提供了更多选择。

- 成本灵活性:Terra 和 Luna 使得更容易避免过度使用旗舰模型。

速度选项:GPT-5.6 Sol 预览版提供高达 14 倍标准速度的 Ultrafast 层级;GPT-5.5 仅提供一个速度等级。

- 发布策略:GPT-5.6 分阶段推出——先 API,后 ChatGPT——因此,随着行为和定价的变化,团队仍需要后备方案。

关键点很简单:GPT​-5.6 不仅仅是一个更好的模型。它是一个理由,让你停止将单一模型硬编码到你的应用中。

如何为 GPT-5.6 做准备

你可以利用已有的访问权限做准备:Luna 是免费的 ChatGPT 默认版本,Sol 包含在 Plus/Pro 体验中,API 也是公开的。准备工作关乎路由和计量,而非等待。

首先,构建一个真实的评估集。不要只用玩具提示来测试GPT​-5.6。要使用实际的代码库问题、支持工单、客户文档、研究任务和自动化失败案例。

其次,为模型路由进行设计。Luna 可以处理简单的摘要和分类任务。Terra 可以处理日常面向用户的工作流。Sol 应保留给高难度的推理、编码和研究工作。如果延迟是您路线图上的一项要求,请将 Ultrafast 预览版视为现在就设计一个感知速度的路由层的理由,而不是硬编码出某个层级——如今在延迟方面胜出的层级可能仍处于预览阶段,但它所隐含的路由决策已经清晰可见。

第三,追踪每个完成任务的成本。对于代理工作流,一个用户请求可能触发多次模型调用。最便宜的令牌价格并不总是最便宜的完成工作流。

第四,为缓存做准备。如果您的应用程序重复发送相同的仓库、策略文档或知识库,请构建提示以便稳定上下文可以被重用。

最后,保留一个后备方案。推理模型往往输出冗长,而且价格会变动——Terra 和 Luna 在 7 月下旬都有所下跌。当延迟、成本或行为发生变化时,生产系统应该能够回退到另一个 GPT-5.6 层级、GPT-5.5,或不同的提供商。

OrcaRouter 的适用场景

GPT-5.6 使模型路由变得更加重要。

OpenAI 不再将新一代作为单一模型发布。GPT-5.6 以系列形式推出:Sol 用于最复杂的推理和智能体工作,Terra 用于均衡的日常负载,Luna 用于快速、低成本的任务。

这就给开发者带来了一个实际问题:每个请求应由哪个模型来处理?

并非所有任务都需要Sol。简单的摘要可能更适合用Luna。普通的商业工作流可能适合Terra。而困难的编码代理任务可能才值得使用Sol。

即使访问通道已经开放,生产环境中的应用在延迟、速率限制或单任务成本发生变化时,仍然需要备用选项——7月底的降价提醒我们费率表是一个不断变化的目标,而Ultrafast预览版则提醒我们服务选项同样在变化中。

这就是 OrcaRouter 发挥作用的地方。

OrcaRouter 为开发者提供单一 Open​AI 兼容端点,用于跨多个模型进行路由,具备智能路由、自动故障转移、可观测性和零 token 加价。无需在每次新模型发布时重建集成,您可以保持一种 API 模式,并根据质量、成本、延迟和可用性来路由任务。

对于GPT-5.6,这意味着你现在就可以构建模型层,而不必等待访问权限稳定下来。

所有三个标准层级今天都已上线 OrcaRouter:GPT-5.6 Sol 定价为 $5/$30,GPT-5.6 Terra 定价为 $2/$12,GPT-5.6 Luna 定价为 $0.20/$1.20 — 均以 0% 加价直接透传,因此 7 月下旬的降价在正式发布当天就已在此生效。Ultrafast 层级尚未广泛开放,因此不在该列表之列 — 一旦开放,它就会成为可供路由的另一个服务层级,而同一个端点正是进行该选择的地方。Daybreak Blue 和 Red 是独立的限制访问计划,而非公共 API 层级,因此它们同样无法通过 OrcaRouter 进行路由 — 路由决策仍然落在标准层级上。

GPT-5.6 的接入情况仍在尘埃落定中,但你的路由策略不必等待。

通过 OrcaRouter 使用 GPT-5.6

GPT​-5.6 正是开发者想要路由的那种模型家族。

但这次推出引发了一个实际问题:访问权限分阶段扩大,7月底两个层级的价格发生了变化,ChatGPT的调优与API模型存在差异,现在又有一个速度层级处于预览阶段。团队需要一个能够吸收这些变化的层。

OrcaRouter 通过一个兼容 Open​AI 的端点提供全部三个 GPT​-5.6 层级,以及 200+ 其他模型——这样你就可以在一个地方测试 Sol、Terra 和 Luna 与 GPT-5.5、Claude、Gem​ini 等的对比,而无需重新集成。

这在以下情况下很有用:

将每个请求路由到能够处理它的最便宜层级;

- 将 Sol、Terra 和 Luna 与你当前的技术栈进行并行测试;

将简单任务路由到更便宜的模型;

- 将旗舰型号保留给更繁重的工作;

- 将 GPT-5.6 与您当前的生产技术栈进行比较;

当行为或定价发生变化时,保持备用模型随时可用。

GPT​-5.6 现已在 OrcaRouter 上线——Sol、Terra 和 Luna——0% 加价,并具备自动故障转移,确保新上线或重新定价的服务层级绝不会导致生产路径中断。

通过 OrcaRouter 上的一个 API 调用任何 GPT-5.6 层级,并使用同一密钥路由到目录中的其余部分。

最终裁决

GPT-5.6 是真实的、官方的,而且很重要。

但它已不再是你需要等待的预览:API 自 7 月 9 日起就已上线,ChatGPT 访问权限本月将陆续向所有层级开放。

最大的变化不仅仅是更好的智能。而是从单一默认模型转向路由模型家族:Sol、Terra 和 Luna。

对于开发者来说,机会不仅仅是升级到GPT-5.6。机会在于构建一个更智能的模型层:

- 用于快速且廉价任务的Luna;

- Terra 适用于平衡的生产工作负载;

- Sol 用于最难的推理和编码任务;

- 缓存重复上下文;

- 备用模型以提高可靠性。

如果你今天就要发布,无需再等待:Luna 是免费版 ChatGPT 的默认模型,Sol 已进入 Plus/Pro 体验,API 也已公开。

如果你正在构建编码代理、企业级 Copilot 或长期运行的 AI 工作流,那么现在做好准备意味着要关注路由、推理消耗计量和单任务成本——而不是访问权限。Ultrafast 预览版提醒我们,这个产品系列仍在不断演进:你今天进行基准测试的旗舰型号,到正式发布时可能已经有了更快的版本——或者,借助 Daybreak,一个针对特定目的训练的网络安全变体。

常见问题

GPT-5.6 发布了吗?

是的。API 于 2026 年 7 月 9 日推出,ChatGPT 访问权限正在逐步开放——自 8 月 6 日起为 Plus/Pro 更新了 Sol,本周 Luna 成为 Free/Go 的默认选择。

我可以在ChatGPT中使用GPT-5.6吗?

是的。GPT-5.6 Sol 现已上线 Plus/Pro Chat 体验,并新增了思维滑块;GPT-5.6 Luna 本周将成为 Free 和 Go 账户的默认版本,从 8 月 10 日那周起提供无限制的纯文本聊天。

我能通过API使用GPT-5.6吗?

是的。所有三个层级都在公共 API 上,并附有公开定价——Sol $5/$30、Terra $2/$12、Luna $0.20/$1.20——并且通过 OrcaRouter 以 0% 加价提供。

什么是GPT-5.6 Sol超快速模式?

这是Open​AI API中的一个预览版速度层级,运行GPT-5.6 Sol时,处理速度比标准模式快达14倍,每秒输出token数最高可达750个,智能水平与标准模型一致(厂商声明)。该层级最初仅限一小部分客户使用,Open​AI尚未公布其定价。

GPT-5.6有公开的等候名单吗?

对于基础层级,不需要——API 是公开的,ChatGPT 访问权限正在所有层级逐步推出,因此无需加入。Ultrafast 预览版是例外:它最初仅限一小部分客户使用,并提供注册通知,以便在容量扩展时收到提醒。

GPT-5.6 何时全面可用?

已经在分阶段进行。API 于 2026 年 7 月 9 日上线;更新后的 Sol 于 8 月 6 日登陆 Plus/Pro ChatGPT;Luna 本周成为 Free/Go 的默认选项;无限免费文本聊天将于 8 月 10 日那一周推出。

GPT-5.6 Sol、Terra和Luna是什么?

Sol是旗舰型号,Terra是适合日常工作的均衡型号,而Luna则是快速且经济实惠的型号。

GPT-5.6 的价格是多少?

GPT-5.6 Sol 的定价为每 100 万输入 token 5 美元、每 100 万输出 token 30 美元。GPT-5.6 Terra 的定价为每 100 万输入 token 2 美元、每 100 万输出 token 12 美元。GPT-5.6 Luna 的定价为每 100 万输入 token 0.20 美元、每 100 万输出 token 1.20 美元。Terra 和 Luna 已于 2026 年 7 月下旬降价;Sol 保持不变。在 OrcaRouter 上,这些价格以 0% 加价直通。Ultrafast preview 尚未公布定价。

我应该从 GPT-5.5 切换到 GPT-5.6 吗?

不要盲目。保留稳定的后备方案,但权衡已经改变:Luna 的价格使其成为大批量文本工作的默认选择,而 ChatGPT 的调校值得在日常助手中测试。在您自己的任务上进行基准测试,并按层级路由。

我能通过OrcaRouter访问GPT-5.6吗?

是的。GPT-5.6 Sol、Terra 和 Luna 全部通过 OrcaRouter 上的一个 Open​AI 兼容端点提供,零加价,并具备自动故障转移。你可以直接与 GPT-5.5、Claude、Gem​ini 及其他模型进行对比测试,无需更改集成配置。

什么是 Daybreak Blue 和 Daybreak Red?

它们是Open​AI经审核的网络安全计划的两个层级,该计划于2026年8月10日扩大。Daybreak Blue向经批准的防御者提供移除了网络护栏的GPT-5.6 Sol,用于事件响应、恶意软件分析和安全代码审查等防御工作。Daybreak Red向经过单独审核的团队提供GPT​-5.6-Cyber,这是一种基于Sol的模型,经过专门训练,用于授权的漏洞研究和利用开发工作。两者都不是公开API产品。

本文中的对比4

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新