
GPT-5.6 API-prissättning: Sol-, Terra- och Luna-nivåer, verklig kostnad och hur man anropar var och en
- qwenNYQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaNYOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicNYAnthropic: Claude Opus 52026-07-2461Intelligens78Kodning
- googleNYGoogle: Gemini 3.6 Flash2026-07-2150Intelligens69Kodning
- googleNYGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligens49Kodning
- metaNYMeta: Muse Spark 1.12026-07-1651Intelligens71Kodning
- kimiMoonshotAI: Kimi K32026-07-1557Intelligens76Kodning
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Intelligens71Kodning
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Intelligens77Kodning
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Intelligens77Kodning
- grokxAI: Grok 4.52026-07-0854Intelligens72Kodning
- tencentTencent: Hy32026-07-0641Intelligens59Kodning
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligens42Kodning
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligens39Kodning
- anthropicAnthropic: Claude Sonnet 52026-06-3053Intelligens72Kodning
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligens52Kodning57Matematik
- z-aiZ.ai: GLM 5.22026-06-1651Intelligens69Kodning60Matematik
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Intelligens61Kodning61Matematik
- anthropicAnthropic: Claude Fable 52026-06-0960Intelligens77Kodning
- qwenQwen: Qwen3.7 Plus2026-06-0139Intelligens56Kodning59Matematik
GPT-5.6 är OpenAI:s flaggskeppsfamilj från juli 2026, och det viktiga för utvecklare är att den inte har ett pris. Den levereras i tre nivåer—Sol, Terra och Luna. På OpenAI API kostar Sol $5 per miljon input-tokens och $30 per miljon output-tokens, Terra kostar $2,50 och $15, och Luna kostar $1 och $6. Varje nivå har en rabatt för cachad input, alla tre accepterar både bild- och textinput, och kontextfönstret är cirka 1,05 miljoner tokens med upp till 128K output.
Listpriset är bara början på den verkliga kostnaden. Vilken nivå du faktiskt behöver, hur mycket du cachar, hur mycket utdata modellen genererar, och ett par prissättningsregler som de flesta guider hoppar över—prompter över 272K tokens, dataresidenspåslag och servicenivåer—avgör fakturan långt mer än rubriksatsen. Den här guiden bryter ner varje nivås pris, vad den är till för, hur den poängsätts, hur man migrerar från GPT-5.5, hur man anropar den, och hur den jämförs med Claude, GLM, Gemini, DeepSeek och Grok.
Snabbt svar: GPT-5.6 prissättning i korthet
- Tre nivåer (per miljon tokens, input / output): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.
- Cachelagrad inmatning: $0,50 (Sol), $0,25 (Terra), $0,10 (Luna) per miljon tokens; cachens skrivkostnad är 1,25 gånger den icke-cachelagrade inmatningstakten.
- Positionering: Sol för det svåraste resonemangs- och agentarbetet, Terra som den balanserade standarden, Luna för högvolym-, kostnadskänsliga uppgifter.
- Modalitet: multimodal—GPT-5.6 accepterar bildinmatning tillsammans med text. Kontext ~1,05 miljoner tokens, maximal utdata 128K.
- Två prisregler att planera för: frågor över 272K indatatokens debiteras som 2x indata och 1,5x utdata för hela förfrågan, och dataresidensändpunkter lägger till en 10% höjning.
- Sätt att betala mindre: Batch är 50% rabatt på standard, cachning minskar upprepad inmatning till en tiondel, och routning av rutinarbete till en lägre nivå undviker Sols $30-utdata.
- Intelligens: Artificial Analysis placerar GPT-5.6 Sol nära toppen av sitt Intelligence Index (poäng 59).
GPT-5.6 API prissättning, nivå för nivå

OpenAI prissätter GPT-5.6 per miljon tokens, och utdata är mycket dyrare än indata på varje nivå. De aktuella publicerade priserna är:
- GPT-5.6 Sol: $5.00 inmatning, $0.50 cachad inmatning, $30.00 utmatning (cacheskrivningar $6.25).
- GPT-5.6 Terra: $2.50 indata, $0.25 cachad indata, $15.00 utdata.
- GPT-5.6 Luna: $1,00 inmatning, $0,10 cachad inmatning, $6,00 utmatning.
Två detaljer är viktiga innan du planerar en budget. För det första dominerar utdatatakten de flesta verkliga kostnader, särskilt för resonemang och agentarbete där modellen genererar långa spår, verktygsanrop och revisioner innan ett slutgiltigt svar. För det andra finns det ingen separat "Sol Ultra"-prisrad på prissidan; "Sol Ultra" är en högre resonemangskonfiguration av Sol (en multi-agent-uppsättning), inte en oberoende nivå – budgetera kring Sol, Terra och Luna.
Vad varje nivå egentligen är till för
Luna: högvolym och kostnadskänslig
Luna är den ekonomiska nivån till ett pris på $1 för inmatning och $6 för utmatning. Det är rätt standard för klassificering, extrahering, routing, sammanfattning, utkast och den stora volymen rutinarbete där en liten kvalitetsskillnad inte förändrar resultatet. Med sex dollar per miljon utmatningstokens är det tillräckligt billigt för att köras i stor skala och för att ta prover upprepade gånger.
Terra: den balanserade standarden
Terra ligger i mitten på $2.50 och $15. För de flesta applikations- och kodningsarbeten är det en vettig utgångspunkt: märkbart starkare än Luna på svårare uppgifter, men till halva utmatningspriset jämfört med Sol. Börja här, flytta sedan upp en uppgift till Sol först när Terra uppenbart misslyckas med den.
Sol: det svåraste resonemanget och agentiska arbetet
Sol är flaggskeppet för $5 och $30, och Artificial Analysis placerar det nära toppen av sin Intelligence Index. Reservera det för svår arkitektur, komplex felsökning, långsiktiga agenter och högriskanalyser där ett undviket misslyckande är värt premien. Att använda Sol för rutinarbete är det vanligaste sättet att spendera för mycket på GPT-5.6.
Kommer du från GPT-5.5? Vilken nivå sparar mest?
GPT-5.6 Sol är prissatt identiskt med GPT-5.5 till $5 för input och $30 för output, så att flytta en GPT-5.5-arbetsbelastning direkt till Sol förändrar lite på fakturan. Besparingen ligger i de två nya lägre nivåerna. Terra levererar ungefär GPT-5.5-klasskvalitet på de flesta uppgifter till halva priset, så den enklaste migreringen är att skicka befintlig GPT-5.5-trafik till Terra och bara lyfta upp de uppgifter som presterar sämre till Sol.
Den praktiska migrationsplanen består av tre steg: omdirigera GPT-5.5-anrop till Terra, kör din utvärderingsuppsättning och eskalera endast felen till Sol samtidigt som du för ner uppenbart rutinarbete till Luna. De flesta GPT-5.5-arbetsbelastningar blir billigare på detta sätt utan en mätbar kvalitetsförlust.
Hur nivåerna faktiskt poängsätter


Priset spelar bara roll i förhållande till kapaciteten. Enligt OpenAI:s egna siffror från Terminal-Bench 2.1 skiljer sig nivåerna ungefär som man kan förvänta sig: Sol 88,8 %, Sol Ultra 91,9 %, Terra 87,4 % och Luna 84,7 %. Som jämförelse i samma tabell får GPT-5.5 85,6 %, Claude Opus 4.8 får 78,9 %, Claude Fable 5 får 83,1 %, och Gemini 3.1 Pro (förhandsversion) får 70,7 %. Artificial Analysis ger separat Sol ett Intelligence Index på 59, nära toppen av sin ranking.
Läs dessa som leverantörsrapporterade och vägledande. OpenAI har publicerat en begränsad uppsättning utvärderingar för GPT-5.6 och vid skrivande stund inte traditionella kodnings- och resonemangsriktmärken som SWE-bench Verified eller GPQA, så använd dessa poäng för att avgöra vad du ska testa på din egen arbetsbelastning snarare än som en slutgiltig bedömning.

Varje nivås cachade inläsningshastighet är en tiondel av dess färska inläsningshastighet: $0,50 på Sol, $0,25 på Terra, $0,10 på Luna. Att skriva till cachen kostar däremot 1,25 gånger den icke-cachade inläsningshastigheten (cirka $6,25 per miljon på Sol), så cachning lönar sig bara när ett stabilt prefix återanvänds tillräckligt många gånger för att tjäna in skrivpremien – systeminstruktioner, ett stort dokument, arkivregler eller en produktaxiologi. Placera stabilt material i början av prompten och den föränderliga frågan i slutet, och undvik att infoga tidsstämplar eller slumpmässiga identifierare före återanvändbart sammanhang.
Caching minskar kostnaden för upprepad indata; den gör inget för utdata. Eftersom utdata är den dyra sidan på varje nivå, är de två spakar som påverkar en GPT-5.6-räkning mest att cacha ett stabilt prefix och att kontrollera hur mycket modellen skriver.
Vilken nivå bör du välja?

Välj inte en nivå baserat på rykte. Välj den baserat på test. Bygg en liten uppsättning representativa uppgifter med tydliga godkännandekriterier, kör dem på Luna först och befordra endast de uppgifter som misslyckas till Terra, sedan till Sol. Mät kostnad per godkänd uppgift, inte genomsnittligt tokenpris, eftersom en billigare nivå som kräver tre försök kan kosta mer än en starkare nivå som lyckas på en gång.
En operativ vana sparar riktiga pengar: ange exakt nivåmodell-ID i varje anrop istället för att förlita sig på ett bart alias, så att en rutinförfrågan aldrig tyst körs på den dyraste nivån. En blandad arbetsbelastning resulterar vanligtvis i Luna för rutinmässig transformering och utkast, Terra för vardaglig implementering och analys, och Sol reserverad för den svåra minoriteten – de flesta förfrågningar behöver aldrig flaggskeppet alls.
GPT-5.6 jämfört med konkurrenterna prismässigt
GPT-5.6 existerar inte i ett vakuum. Jämför med nuvarande priser (per miljon tokens, inmatning/utmatning, mitten av 2026): Claude Opus 4.8 kostar $5 / $25, Claude Fable 5—Anthropic’s starkaste publika modell—kostar $10 / $50, GLM 5.2kostar $1.40 / $4.40 på Z.AI (tredjepartshostar kan vara lägre), Grok 4.5kostar $2 / $6, Googles Gemini 3.5 Flashkostar ungefär $1.50 / $9, och DeepSeek V4-Pro kostar ungefär $0.44 / $0.87. Bekräfta varje pris på leverantörens egen sida, eftersom dessa förändras.
Slutsatserna är specifika. GPT-5.6 Sol matchar Opus 4.8 vad gäller inmatning men är dyrare på utdata ($30 mot $25), så för utdatatunga agentiska arbetsuppgifter är Opus något billigare per token medan Sol leder Intelligence Index. Terra understiger båda flaggskeppen och är värdevalet inom OpenAI-familjen. Luna konkurrerar prismässigt med billigare modeller, även om Grok 4.5, GLM 5.2 och särskilt DeepSeek ligger ännu lägre. Ingen enskild nivå eller leverantör vinner allt, vilket är precis varför routing efter svårighetsgrad är bättre än att binda sig till en.
En bearbetad månadsfaktura

Sätt siffror på det. För en medeltung månad med 50M inmatning och 10M utmatningstokens, vid listpris före cachelagring och verktygsanvändning, blir modellavgiften ungefär:
- GPT-5.6 Luna: cirka 110 dollar.
GPT-5.6 Terra: cirka 275 dollar.
GPT-5.6 Sol: ungefär $550.
- Som jämförelse: GLM 5.2 cirka $114, Grok 4.5 cirka $160, Claude Opus 4.8 cirka $500, Claude Fable 5 cirka $1,000.
Samma uppgifter dirigerade intelligent—Luna och Terra för det mesta, Sol för den svåra minoriteten—hamnar mycket närmare bandet $110–$275 än en platt $550 för Sol-till-allt. Den skillnaden, multiplicerad över ett år, är hela argumentet för nivåbaserad dirigering.
Dolda kostnader att planera för
Flera prissättningsregler syns inte i rubrikräntan och överraskar teamen senare:
- Långa uppmaningar: en begäran över 272K inmatningstoken debiteras med 2x inmatning och 1.5x utdata för hela begäran, så stora kontext- och stora RAG-anrop kan mer än fördubbla kostnaden.
- Utgångsvolym: utgången är upp till sex gånger ingångshastigheten, så obegränsad eller högslutledningsutgång är den största risken för överskridande.
- Tjänstenivå: Prioritetsbearbetning är ungefär dubbelt så hög som standardavgiften (cirka $10 inmatning / $60 utmatning på Sol); Flex och Batch är billigare. Välj nivån medvetet via inställningen service_tier.
- Dataresidens: regionala bearbetningsändpunkter lägger till en höjning på 10% för modeller som släppts den 5 mars 2026 eller senare, vilket inkluderar GPT-5.6.
- Agentloopar och återförsök: instruktioner, verktyg och historik skickas på nytt varje tur, och en misslyckad lång begäran slösar bort den indata du redan betalat för.
- Tier drift: att lämna allt på Sol "för att vara säker" är den enskilt dyraste vanan.
Sätt att betala mindre
Tre spakar minskar en GPT-5.6-räkning utan att ändra vad du bygger. Batch: asynkrona förfrågningar via Batch-nivån är 50 % billigare än standardpriset, idealiskt för högvolymarbete med Luna som inte är känsligt för svarstider. Caching: återanvänd en stabil prefix tillräckligt många gånger för att slå 1,25x skrivpremien och upprepat indata minskar till en tiondel. Routning: skicka rutinarbete till Luna eller Terra och eskalera endast den svåra minoriteten till Sol, och håll promptarna under 272K-tröskeln när du kan.
Hur man anropar GPT-5.6
GPT-5.6 finns tillgänglig via OpenAI API och via OpenAI-kompatibla gateways, så integrationen förblir stabil medan du ändrar modellen eller nivån bakom den. Följande är ett standardmönster som är kompatibelt med OpenAI; bekräfta det aktuella modell-ID:t före produktion och lås fast den exakta nivån istället för enbart ett alias.
from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "Omstrukturera denna modul och förklara riskerna."}],
)
print(response.choices[0].message.content)
Att byta nivå är en enradig ändring i modellfältet, vilket gör att svårighetsbaserad routing blir praktisk: skicka vanliga anrop till Luna eller Terra och eskalera endast de svåra till Sol.
Testar GPT-5.6 via OrcaRouter
En gateway gör GPT-5.6 enklare att använda av två anledningar. För det första kan samma OpenAI-kompatibla klient anropa alla tre nivåerna och jämförelsemodeller som Claude Opus 4.8, GLM 5.2 och Grok 4.5, så du kan köra en utvärderingsuppsättning över allt utan att skriva om integrationskoden och mäta den verkliga kostnaden per accepterad uppgift—inklusive verktygsavgifter, omförsök och 272K-tilläggsavgiften. För det andra kan en gateway växla över mellan leverantörer och upprätthålla en budgettak, så ett tillfälligt kapacitetsproblem eller ett felaktigt Sol-anrop spränger inte månaden. Bekräfta den aktiva GPT-5.6-routern och nuvarande nivå-ID:n innan du bygger en budget på dem.

Nästa steg: Registrera dig för OrcaRouter och kör din egen GPT-5.6-nivåjämförelse över en API-endpoint.
FAQ
Vad är skillnaden mellan GPT-5.6 Sol, Terra och Luna?
De är tre nivåer av samma familj till olika priser och förmågor. Sol är flaggskeppet för det tyngsta arbetet ($5/$30), Terra är den balanserade standarden ($2.50/$15), och Luna är ekonomiklassen för högvolymsuppgifter ($1/$6). Välj den lägsta som klarar dina tester.
Finns det en GPT-5.6 Sol Ultra prisnivå?
Nej. "Sol Ultra" är en högre resonerande multiagent-konfiguration av Sol, inte en separat rad på prissidan. Den använder fler tokens och kostar mer per uppgift, men du budgeterar det som Sol med högre ansträngning.
Varför översteg min GPT-5.6-räkning en enkel uppskattning?
Vanligtvis utdatatokens, tilläggsavgift för lång prompt på 272K (2x inmatning, 1,5x utdata), prioriterad servicenivå, datalokaliseringshöjning, eller återförsök. Logga hela begärandekedjan och mät kostnad per accepterad uppgift istället för per prompt.
Kan jag finjustera GPT-5.6, och finns det en gratisnivå?
Nej på båda. GPT-5.6 stöder inte finjustering, och API:et har ingen gratissnivå—debitering startar från första token. Gratis åtkomst finns endast inom vissa ChatGPT-planer, vilket är en separat produkt från API:et.
Vilken ChatGPT-plan kan använda vilken nivå?
Det varierar beroende på produkt. I ChatGPT Work och Codex kan Free och Go använda Terra medan Plus och högre kan välja mellan Sol, Terra och Luna; den högsta ultra-inställningen är begränsad till Pro och Enterprise. Behandla API- och ChatGPT-planerna som separata – en API-nyckel ärver inte en prenumerations åtkomst.
Slutsatsen
GPT-5.6:s prisberättelse är nivåindelningen. Sol för $5/$30 leder intelligensrankingen, Terra för $2.50/$15 är standardvärdet och det naturliga hemmet för tidigare GPT-5.5-trafik, och Luna för $1/$6 hanterar volym. Caching minskar upprepad indata till en tiondel (efter en 1.25x skrivpremie), Batch är halva priset, men utdata är den dyra sidan på varje nivå och långa prompts över 272K medför en tilläggsavgift.
Behandla de tre nivåerna som ett routingproblem, inte ett enskilt köp: standard låg, eskalera vid misslyckande, cachelagra stabil kontext, använd Batch där latens tillåter, och håll en jämförelsemodell tillgänglig via samma slutpunkt. Det ger en mycket lägre kostnad per accepterad uppgift än att betala flaggskeppspriser för rutinarbete.
