GPT-6 Luna est le modèle rapide et économique de la série GPT-6 d’OpenAI, positionné en dessous de GPT-6 Sol. Il est adapté aux charges de travail à volume élevé et sensibles à la latence, telles que le chat, la classification et les tâches agentiques légères. Entrée multimodale (texte, image, fichier), contexte de 1,05 M de jetons, effort de raisonnement configurable, outils et sorties structurées.
GPT-6 Luna est le modèle rapide et économique de la série GPT-6 d'OpenAI, en dessous de GPT-6 Sol et du fleuron GPT-6 Astra. Il cible les charges de travail à fort volume et sensibles à la latence —…
Entrée multimodale (texte, images et fichiers) avec sortie texte, une fenêtre de contexte d’environ 1,05 M de tokens et jusqu’à 128 K de tokens en sortie. Prend en charge l’effort de raisonnement configurable, l’appel de fonctions / les outils, les sorties structurées (JSON) et l’échantillonnage avec graine. Le modèle est modéré par le fournisseur.
La tarification est échelonnée selon la taille du prompt : le tarif standard s'applique jusqu'à 272K jetons d'entrée et augmente au-delà. Les lectures d'entrée mises en cache sont facturées à un tarif réduit. Consultez la tarification sur cette page pour connaître les chiffres actuels.
POST /v1/chat/completions avec le modèle openai/gpt-6-luna via votre clé d'API OrcaRouter — n'importe quel SDK OpenAI fonctionne en définissant l'URL de base sur OrcaRouter. Prend en charge tools / function calling, response_format pour les sorties structurées, et reasoning_effort pour ajuster la profondeur. Les erreurs utilisent l'enveloppe d'erreur OpenAI.
Compatible OpenAI — gardez votre SDK actuel
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-6-luna",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools| Palier | Entrée / 1M tokens | Sortie / 1M tokens | Lecture cache / 1M | Écriture cache / 1M |
|---|---|---|---|---|
| ≤ 272K | $0.100 | $0.500 | $0.010 | $0.125 |
| ≤ ∞ | $0.200 | $0.750 | $0.020 | $0.250 |
| Palier sélectionné selon le nombre de tokens d'entrée de chaque requête | ||||
Estimation basée sur le tarif public
Tarification par paliers — cette estimation utilise les tarifs du palier de base.
Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.
Ce dont parlent les développeurs cette semaine
GET /api/public/models/openai/gpt-6-lunaOuvrir @misc{orcarouter_gpt_6_luna,
title = {GPT-6 Luna API},
author = {OpenAI},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-6-luna}
}OpenAI. (2026). GPT-6 Luna API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-6-luna