GPT-6 Luna è il modello veloce ed efficiente in termini di costi della serie GPT-6 di OpenAI, posizionato al di sotto di GPT-6 Sol. È adatto a carichi di lavoro ad alto volume e sensibili alla latenza come chat, classificazione e attività agentiche leggere. Input multimodale (testo, immagine, file), contesto da 1,05M token, sforzo di ragionamento configurabile, strumenti e output strutturati.
GPT-6 Luna è il modello veloce ed economico della serie GPT-6 di OpenAI, sotto GPT-6 Sol e il flagship GPT-6 Astra. È pensato per carichi di lavoro ad alto volume e sensibili alla latenza — chat,…
Input multimodale (testo, immagini e file) con output testuale, una finestra di contesto di ~1,05M token e fino a 128K token di output. Supporta sforzo di ragionamento configurabile, chiamata di funzioni / strumenti, output strutturati (JSON) e campionamento con seed. Il modello è moderato dal provider.
La tariffazione è a livelli in base alla dimensione del prompt: la tariffa standard si applica fino a 272K token di input e aumenta oltre tale soglia. Le letture di input in cache sono fatturate a una tariffa ridotta. Consulta i prezzi su questa pagina per i valori attuali.
POST /v1/chat/completions con il modello openai/gpt-6-luna tramite la tua chiave API OrcaRouter — qualsiasi SDK OpenAI funziona impostando l'URL di base su OrcaRouter. Supporta tools / function calling, response_format per output strutturati e reasoning_effort per regolare la profondità. Gli errori usano l'envelope di errore di OpenAI.
Compatibile con OpenAI: mantieni il tuo SDK
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-6-luna",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools| Livello | Input / 1M token | Output / 1M token | Lettura cache / 1M | Scrittura cache / 1M |
|---|---|---|---|---|
| ≤ 272K | $0.100 | $0.500 | $0.010 | $0.125 |
| ≤ ∞ | $0.200 | $0.750 | $0.020 | $0.250 |
| Livello selezionato in base al numero di token di input di ogni richiesta | ||||
Stima basata sul prezzo di listino
Prezzi a livelli — questa stima usa le tariffe del livello base.
Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.
Di cosa parlano gli sviluppatori questa settimana
GET /api/public/models/openai/gpt-6-lunaApri @misc{orcarouter_gpt_6_luna,
title = {GPT-6 Luna API},
author = {OpenAI},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-6-luna}
}OpenAI. (2026). GPT-6 Luna API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-6-luna