GPT-6 Luna ist das schnelle, kosteneffiziente Modell in der GPT-6-Serie von OpenAI, positioniert unter GPT-6 Sol. Es eignet sich für volumenstarke und latenzempfindliche Workloads wie Chat, Klassifizierung und leichte agentische Aufgaben. Multimodale Eingabe (Text, Bild, Datei), 1,05 Mio. Token Kontext, konfigurierbarer Reasoning-Aufwand, Tools und strukturierte Ausgaben.
GPT-6 Luna ist das schnelle, kosteneffiziente Modell in OpenAIs GPT-6-Serie, unterhalb von GPT-6 Sol und dem Flaggschiff GPT-6 Astra. Es richtet sich an Workloads mit hohem Volumen und niedriger…
Multimodale Eingabe (Text, Bilder und Dateien) mit Textausgabe, einem Kontextfenster von ~1,05 Mio. Tokens und bis zu 128K Ausgabe-Tokens. Unterstützt konfigurierbaren Reasoning-Aufwand, Funktionsaufrufe / Tools, strukturierte (JSON-)Ausgaben und Sampling mit festgelegtem Seed. Das Modell wird vom Anbieter moderiert.
Die Preisgestaltung ist nach der Prompt-Größe gestaffelt: Der Standardtarif gilt bis zu 272K Eingabe-Tokens und erhöht sich darüber hinaus. Gecachte Eingabelesevorgänge werden zu einem reduzierten Tarif abgerechnet. Die aktuellen Zahlen finden Sie in der Preisübersicht auf dieser Seite.
POST /v1/chat/completions mit dem Modell openai/gpt-6-luna über Ihren OrcaRouter-API-Schlüssel — jedes OpenAI-SDK funktioniert, indem Sie die Basis-URL auf OrcaRouter setzen. Unterstützt tools / Function Calling, response_format für strukturierte Ausgaben und reasoning_effort zur Feinabstimmung der Tiefe. Fehler verwenden den OpenAI-Fehler-Envelope.
OpenAI-kompatibel — behalte dein bisheriges SDK
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-6-luna",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_completion_tokensmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstool_choicetools| Stufe | Eingabe / 1M Tokens | Ausgabe / 1M Tokens | Cache-Lesen / 1M | Cache-Schreiben / 1M |
|---|---|---|---|---|
| ≤ 272K | $0.100 | $0.500 | $0.010 | $0.125 |
| ≤ ∞ | $0.200 | $0.750 | $0.020 | $0.250 |
| Stufe wird durch die Eingabe-Token-Anzahl jeder Anfrage bestimmt | ||||
Schätzung auf Basis des Listenpreises
Gestaffelte Preise — diese Schätzung verwendet die Basisstufe.
Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.
Worüber Entwickler diese Woche sprechen
GET /api/public/models/openai/gpt-6-lunaÖffnen @misc{orcarouter_gpt_6_luna,
title = {GPT-6 Luna API},
author = {OpenAI},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-6-luna}
}OpenAI. (2026). GPT-6 Luna API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-6-luna