GPT-5.6 Luna

openai/gpt-5.6-luna
精选
视觉工具JSON推理
来自 OpenAI · 2026-07-09

GPT-5.6 Luna 是 OpenAI GPT-5.6 系列中快速且经济高效的模型——针对高吞吐量、延迟敏感的工作负载进行了优化,同时保留了真正有能力的推理能力。它非常适合聊天、分类、提取、路由和轻量级智能体工作流,在这些场景中响应速度和每次调用的价格占据主导地位,并且仍然支持完整的 1.05M token 上下文窗口,最多可输出 128K token。 它接受文本、图像和文件输入,输出文本;支持可配置的推理深度,以便在偶尔的困难请求上增加深度;并且是一流的 OpenAI Responses 模型,具有原生工具调用和结构化输出。在扇出架构的顶层、作为廉价的初稿模型,或任何你运行数百万次调用且每一分钱和每一毫秒都至关重要的场景中,请使用 Luna。

上下文1M tokens
最大输出128K
输入模态text + image + file
输出模态text
p50 首字节1.27 s
输入$0.20/ 百万 tokens
输出$1.20/ 百万 tokens
p50 首字节1.27 s7 天
p95 首字节7.48 s7 天
流量16607.1Mtokens / 7 天

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="openai/gpt-5.6-luna",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • include_reasoning
  • max_completion_tokens
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • structured_outputs
  • tool_choice
  • tools

价格

阶梯输入 / 1M tokens输出 / 1M tokens缓存读取 / 1M缓存写入 / 1M
272K$0.200$1.20$0.020$0.250
$0.400$1.80$0.040$0.500
阶梯按每次请求的输入 token 数确定

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $5.00 · 启用提示缓存后 $4.37

基于标价的估算

阶梯定价——此估算使用基础档位费率。

Token 与费用估算器

输入 Token: 6每次请求费用: $0.000601

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
1.27 s
输出速度
104 tok/s
p95 首字节
7.48 s
错误率
0.05%

公共基准测试

71.4
AA Coding
优于所参与对比模型中的 87%
第 16 / 共 133
52.3
AA Intelligence
优于所参与对比模型中的 79%
第 27 / 共 135
GPQA Diamond
91.1
Humanity's Last Exam
39.5
Long-Context Recall
78.3
SciCode
52.5
tau_banking
31.1
terminalbench_v2_1
80.9
来源: artificialanalysis.ai

社区热度

本周开发者的讨论

Hacker News0 次提及 · 近 7 天较上周减少 4

对比一览

GPT-5.6 LunaGPT-5.2 ProGPT-5.4 ProGPT-5.5
输入 $/百万$0.20$21.00$60.00$5.00
输出 $/百万$1.20$168.00$270.00$30.00
上下文1.1M400K1.1M
质量7/1010/1010/1010/10
并排对比并排对比并排对比并排对比

更多 OpenAI 模型

常见问题

在 OrcaRouter 上,OpenAI: GPT-5.6 Luna 的价格是多少?
OpenAI: GPT-5.6 Luna 通过 OrcaRouter 的定价为每百万输入 token $0.20,每百万输出 token $1.20。定价从路由层实时获取。
OpenAI: GPT-5.6 Luna的上下文窗口是多少?
OpenAI: GPT-5.6 Luna 支持 1M 个 token 的上下文窗口。可使用长上下文功能(RAG、摘要)直至该限制。
如何通过 OpenAI SDK 调用 OpenAI: GPT-5.6 Luna?
将 OpenAI base_url 设置为 https://api.orcarouter.ai/v1,提供您的 OrcaRouter API 密钥,并在 chat.completions.create 调用中传递 model="openai/gpt-5.6-luna"。
OrcaRouter 是否对 OpenAI: GPT-5.6 Luna 进行速率限制?
每个模型的速率限制遵循您的 OrcaRouter 计划。免费套餐设有保守的上限;付费套餐则会提升这些上限。请查看 /pricing 了解当前配额。

嵌入此徽章

OpenAI: GPT-5.6 Luna$0.20/M in1272ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-5.6-luna" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-5.6-luna.svg" alt="OpenAI: GPT-5.6 Luna 在 OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-5.6 Luna](https://www.orcarouter.ai/embed/openai/gpt-5.6-luna.svg)](https://www.orcarouter.ai/models/openai/gpt-5.6-luna)

以数据形式获取模型卡

GET /api/public/models/openai/gpt-5.6-luna打开