GPT-6 Luna 是 OpenAI GPT-6 系列中快速、经济高效的模型,定位低于 GPT-6 Sol。它适用于高吞吐量和延迟敏感型工作负载,例如聊天、分类和轻量级智能体任务。多模态输入(文本、图像、文件),1.05M token 上下文,可配置推理强度,工具和结构化输出。
GPT-6 Luna 是 OpenAI GPT-6 系列中快速、高性价比的模型,定位低于 GPT-6 Sol 和旗舰级 GPT-6 Astra。它面向高并发和延迟敏感型工作负载——聊天、分类、提取以及轻量级智能体任务。
多模态输入(文本、图像和文件),文本输出,约105万token的上下文窗口,以及最多128K输出token。支持可配置的推理强度、函数调用/工具、结构化(JSON)输出和带种子的采样。该模型由提供商进行审核。
定价按提示词大小分级:标准费率适用于最多 272K 输入 token,超出后阶梯上调。缓存输入读取按折扣费率计费。当前价格请参见本页面的定价。
POST /v1/chat/completions,使用模型 openai/gpt-6-luna,通过你的 OrcaRouter API 密钥进行调用——任何 OpenAI SDK 都可以使用,只需将 base URL 设置为 OrcaRouter。支持 tools / function calling、用于结构化输出的 response_format,以及用于调整思考深度的 reasoning_effort。错误使用 OpenAI 错误信封格式。
兼容 OpenAI——沿用你现有的 SDK
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-6-luna",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools| 阶梯 | 输入 / 1M tokens | 输出 / 1M tokens | 缓存读取 / 1M | 缓存写入 / 1M |
|---|---|---|---|---|
| ≤ 272K | $0.100 | $0.500 | $0.010 | $0.125 |
| ≤ ∞ | $0.200 | $0.750 | $0.020 | $0.250 |
| 阶梯按每次请求的输入 token 数确定 | ||||
基于标价的估算
阶梯定价——此估算使用基础档位费率。
仅为估算——实际 Token 数取决于提供商的分词器。
本周开发者的讨论
@misc{orcarouter_gpt_6_luna,
title = {GPT-6 Luna API},
author = {OpenAI},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-6-luna}
}OpenAI. (2026). GPT-6 Luna API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-6-luna