
GPT-5.6-prissättning efter prissänkningen: Luna vs Terra vs Sol, och vilken nivå du ska använda
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 546 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 182 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1312 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 114 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
Efter OpenAIs prissänkning den 30 juli 2026 har GPT-5.6-familjen – GPT-5.6 Luna, GPT-5.6 Terra och GPT-5.6 Sol – aldrig varit billigare att köra i stor skala. En vecka senare, den 6 augusti, lade OpenAI in samma nivåer i själva ChatGPT: GPT-5.6 Luna blir standardmodellen för gratiskonton och Go-konton med obegränsade textchattar, medan GPT-5.6 Sol uppdaterades för Plus och Pro. Den 19 augusti meddelade OpenAI och Replit att Replits nya Free Mode för Core- och Pro-prenumeranter körs på GPT-5.6 Luna – den hittills största tredjepartssatsningen på volymnivån. Och i slutet av augusti började OpenAI rulla ut en reservlösning för tunga konsumentanvändare: ett ”Luna Reserve”-utrymme som ger utvalda ChatGPT Plus- och Pro-konton begränsad användning av GPT-5.6 Luna i Codex och ChatGPT Work när deras vanliga användningsgränser är förbrukade. Men de tre nivåerna prissätts mycket olika, och att välja rätt (samt att använda cachning, batch och routing på rätt sätt) är den enskilt största hävstången på din API-faktura. Den här guiden beskriver hela prissättningen efter sänkningen, genomarbetade kostnadsexempel, hur varje nivå står sig mot konkurrenterna och hur du kan dirigera trafiken mellan dem via en enda endpoint.
Priser anges per miljon tokens (inmatning / utmatning) och återspeglar den sänkta prislistan enligt rapportering samt OrcaRouters vidarefaktureringsmodellsidor; nivå- och cachepriser kommer från OrcaRouters modellsidor, och konkurrenters siffror är tillskrivna. ChatGPT-utrullningsdetaljerna i denna artikel är som OpenAI angav dem den 6 augusti 2026, och detaljerna om Replit Free Mode är som OpenAI och Replit angav dem den 19 augusti 2026 – leverantörsrapporterade, inte oberoende uppmätta. Detaljerna om Luna Reserve är som OpenAI dokumenterar dem i sitt hjälpcenter och som OpenAI-anställda och tidiga användare rapporterade dem i slutet av augusti 2026 – leverantörs- och communitybaserade, inte oberoende verifierade. Priser ändras – verifiera innan du bygger.
Sammanfattning
GPT-5.6 Luna ($0.20 / $1.20) är den högvolymiga arbetshästen; Terra ($2 / $12) är det balanserade mittenalternativet; Sol ($5 / $30) är flaggskeppet för de svåraste resonemangen och agentisk kodning. Alla tre delar en kontext på ~1,05M tokens och 128K maxutdata. Promptcache och batchalternativet sänker kostnaderna ytterligare, medan mycket långa indata flyttar dig till en högre nivå. På konsumentsidan tillkännagav OpenAI den 6 augusti att GPT-5.6 Luna blir standard för gratis- och Go ChatGPT-konton med obegränsade textbaserade chattar, och att en uppdaterad GPT-5.6 Sol rullas ut till Plus och Pro. Den 19 augusti lanserade Replit Free Mode på GPT-5.6 Luna för Core- och Pro-prenumeranter, och dirigerar svårare uppgifter vidare till GPT-5.6 Sol vid behov. I slutet av augusti började OpenAI även rulla ut en “Luna Reserve”-reservlösning som ger utvalda ChatGPT Plus- och Pro-konton begränsad användning av GPT-5.6 Luna i Codex och ChatGPT Work efter att deras vanliga gränser har förbrukats — dokumenterad av OpenAI, med utrullningen till utvalda konton rapporterad av användare. Använd Luna för den enkla majoriteten, Terra när du behöver mer, och Sol bara där den motiverar sin kostnad — och dirigera efter svårighetsgrad genom en OpenAI-kompatibel slutpunkt för att minimera utgifterna.
Viktiga slutsatser
• Luna: $0,20 / $1,20 per 1M tokens — snabb, billig, för högvolymarbete som är latenskänsligt.
Terra: $2 / $12 — den balanserade mellanklassen för tuffare uppgifter som inte behöver flaggskeppet.
• Sol: $5 / $30 — flaggskeppet för djupgående resonemang, storskalig kodning och långsiktiga agenter.
• Cachning och batchbearbetning sänker kostnaderna ytterligare; långa indata leder dig till en dyrare långkontextnivå.
• ChatGPT (enligt OpenAI, 6 aug): Luna blir standard för gratis/Go med obegränsade textchattar; Sol får en tillförlitlighetsuppdatering för Plus/Pro.
• Replit (tillkännagav 19 aug): Free Mode för Core/Pro körs på GPT-5.6 Luna — upp till 30x mer användning per Replit, med svårare uppgifter som dirigeras upp till GPT-5.6 Sol. Enligt Replit, inte oberoende verifierat.
• Luna Reserve (slutet av aug, OpenAI-dokumenterad): en reservtilldelning med tak som låter utvalda ChatGPT Plus- och Pro-konton fortsätta använda GPT-5.6 Luna i Codex och ChatGPT Work efter att de vanliga gränserna är förbrukade — inte obegränsat, och inte tillgängligt i Business- eller Enterprise-arbetsytor.
Största besparingshävstången: dirigera efter svårighetsgrad — betala inte Sol-priser för arbete som Luna kan utföra.
Den nya grundprissättningen för GPT-5.6
Här är baspriserna efter sänkningen per miljon in-/utdata-token: Luna $0.20 / $1.20 (ned från $1 / $6), Terra $2 / $12 (ned från $2.50 / $15) och Sol $5 / $30 (oförändrat). De två billigare nivåerna sänktes den 30 juli 2026; flaggskeppet höll. Enkelt uttryckt är de låga nivåerna nu prissatta för skala, medan flaggskeppet förblir premium.

Nivåbaserad, cachad och batchprissättning
Grundpriset är bara utgångspunkten. GPT-5.6-prissättningen har tre modifierare som väsentligt ändrar din faktiska kostnad:
• Långa kontextnivåer. Priserna trappas upp för mycket långa indata. På OrcaRouters pass-through-sidor kostar Luna $0,20 / $1,20 upp till en stor kontextnivå och $0,40 / $1,80 därutöver; Sol kostar $5 / $30 på sin basnivå och $10 / $45 på den största. Nivån väljs utifrån varje begärans antal inmatningstoken, så några få enorma promptar kan tyst höja ditt genomsnittspris.
• Prompt caching. Återanvänt sammanhang faktureras till ett kraftigt rabatterat pris — Lunas cacheread är ungefär $0,02 per miljon tokens (jämfört med $0,20 för färskt), med cacheskrivningar runt $0,25; Sols cacheread är cirka $0,50 (jämfört med $5 för färskt). För agenter och chatt med en stabil systemprompt är cachning ofta den enskilt största besparingen.
• Batch. Icke-brådskande jobb körs asynkront till rabatterat pris — idealiskt för bulkklassificering, utvärderingar och offlinegenerering där latens inte spelar någon roll.
Genomarbetade exempel: vad det faktiskt kostar
Konkreta siffror gör nivåerna verkliga. Ta 10 miljoner tokens i månaden med en fördelning på 70% inmatning / 30% utmatning (en typisk chatt-/agentmix):
• Luna: cirka 5 USD per månad (ungefär 4,37 USD med prompt caching).
• Terra: ungefär 50 dollar i månaden.
• Sol: omkring 125 dollar i månaden (ungefär 109 dollar med cachning).
Det är en 25x skillnad mellan Luna och Sol för samma volym — vilket är precis varför det är viktigare att matcha varje förfrågan till den billigaste lämpliga nivån än någon enskild taxa. (Dessa matchar OrcaRouters kostnadskalkylator på sidan, som uppskattar utifrån listpris; dina faktiska siffror beror på cachning och din in-/utdatablandning.)
Vad varje nivå egentligen är till för
GPT-5.6 Luna — volymarbetshästen
Luna är den snabba, kostnadseffektiva nivån, optimerad för högvolyms-, {{1}}latenskänsliga arbetsbelastningar{{/1}}: {{2}}chat, klassificering, extraktion, routing och lätta agentiska uppgifter{{/2}}, {{3}}med en p50-tid till första token på cirka 1,65 sekunder{{/3}}. Efter prissänkningen, till {{4}}$0,20 / $1,20{{/4}}, är den prissatt för att konkurrera direkt med billiga öppna modeller – standardvalet för majoriteten av enkla anrop. Det är också den nivå som OpenAI styr konsument-ChatGPT mot: enligt tillkännagivandet den 6 augusti blir {{5}}GPT-5.6 Luna{{/5}} standardmodellen för Free- och Go-konton, med obegränsade textchattar och en ny Think-knapp för högre resonemang på svårare frågor som kommer följande vecka (gränserna för fil, bild och röst kvarstår). OpenAI säger att Luna gör {{6}}62 % färre faktiska fel{{/6}} än GPT-5.5 Instant som den ersätter – en leverantörsrapporterad siffra, men en tydlig signal om att volymnivån är dit företaget riktar större delen av sin trafik.
Den 19 augusti 2026 gjorde Replit GPT-5.6 Luna till motorn i sitt nya gratisläge – standardupplevelsen för Core- och Pro-prenumeranter. Vardaglig chatt, idéarbete och enkla koduppgifter körs på Luna utan att förbruka användarens betalda AI-kreditbudget; Replit säger att Core-användare nu kan skapa upp till 30 gånger mer per månad, inklusive upp till 30 timmars chatt. När en uppgift kräver mer resonemang dirigerar Replits Agent begäran till en större modell för den delen – dess Power/Max-lägen eller GPT-5.6 Sol – och återgår sedan till Luna. Dessa är uppgifter från Replit och OpenAI, inte oberoende verifierade – men riktningen stämmer med prissänkningen: en 80 % billigare Luna är det som gör en alltid påslagen, som standard inkluderad nivå livskraftig.
En annan konsumentrelaterad nyhet dök upp i slutet av augusti 2026: Luna Reserve. Som OpenAI dokumenterar i sitt hjälpcenter kan utvalda ChatGPT Plus- och Pro-konton få en begränsad pool av GPT-5.6 Luna-användning i Codex och ChatGPT Work som en reserv när deras vanliga användningskvot är förbrukad — ett meddelande eller en månindikator visas vid gränsen, och du kan fortsätta arbeta på Luna så länge reserven räcker. Det är inte en obegränsad förlängning: reserven är separat från den vanliga kvoten och har själv ett tak, den betjänar endast GPT-5.6 Luna (aldrig Terra eller Sol), den är inte tillgänglig i Business- eller Enterprise-arbetsytor, och att nå en vanlig gräns garanterar inte åtkomst. OpenAI:s personal bekräftade reservens existens den 27 augusti, och tidiga användarrapporter beskriver hur den rullas ut till utvalda konton — uppgifter från leverantör och community, inte oberoende verifierade. Vissa tidiga communityrapporter noterar också att reserven kör den webblättra sidan av GPT-5.6 Luna, så live-webbinspektioner kanske inte fungerar när du använder reserven.
GPT-5.6 Terra — den balanserade mitten
Terra ligger mellan volym och flaggskepp: mer kapabel än Luna för tuffare resonemang och kodning, men mycket billigare än Sol. Till $2 / $12 är det ett förnuftigt standardval när Luna inte riktigt räcker till men du inte behöver flaggskeppet — medelkomplex extraktion, utkast och flerstegsuppgifter som fortfarande körs i stor skala.
GPT-5.6 Sol — flaggskeppet
Sol är byggd för det svåraste arbetet: djup flerstegsresonemang, storskalig programvaruutveckling och långsiktiga agentiska arbetsflöden, och förblir koherent över en kontext på ~1,05M tokens och upp till 128K utdata. Till $5 / $30 (bas) är det ett premiumval — reservera det för uppgifter som verkligen behöver det, som komplex kodning över flera filer eller långa agentkörningar. Den 6 augusti uppdaterade OpenAI även GPT-5.6 Sol i ChatGPT för Plus- och Pro-användare: företaget säger att chattversionen är mer tillförlitlig när det gäller fakta — 68 % färre faktiska fel, enligt OpenAI — och ger mer fokuserade svar, med ett nytt skjutreglage för att styra hur mycket resonemangsansträngning den tillämpar. Uppdateringen gäller endast chatten (Sol bakom Work och Codex är oförändrad), och API-nivån ligger kvar på $5 / $30.
Förbehållet om resonemangstoken
GPT-5.6 är resonemangsmodeller, så den effektiva utdatakostnaden kan överstiga en naiv uppskattning: när resonemang är på, faktureras interna resonemangstokens som utdata. För svåra uppmaningar med hög resonemangsinsats kan det dominera din faktura. Ställ in resonemangsinsatsen efter uppgiften (låg eller av för enkla anrop), begränsa utdatatokens där du kan, och mät faktisk användning. Billigare priser per token hjälper; att generera färre tokens hjälper mer.
Hur varje nivå jämförs med konkurrenterna
Prissänkningen ompositionerade GPT-5.6 gentemot fältet. Enligt rapporter understiger Lunas $0,20 / $1,20 nu Claude Haiku 4.5 med ungefär 5 gånger för input och 4 gånger för output, och Terras $2 / $12 ligger under Claude Sonnet 5:s standardpris (rapporterat till $3 / $15). Jämfört med öppna vikter ligger Luna nära den bottennivå som sätts av DeepSeeks V4-serie och Zhipus GLM-5.2 (ungefär $1,20 / $4,10), med Qwen- och Gemini Flash-nivåer i närheten. Slutsatsen: för kostnadskänsligt arbete är Luna nu konkurrenskraftig med de billigaste kapabla modellerna snarare än ett premiumalternativ till dem — medan Sol förblir en genuin premiumnivå för kapacitet som du inte kan få billigt.
Den verkliga besparingshävstången: dirigera efter svårighet
Den billigaste fakturan är inte en enda nivå — det handlar om att matcha varje förfrågan till den billigaste modell som kan utföra den. I praktiken: skicka enkla, högfrekventa anrop till Luna (eller en billig öppen modell), växla upp till Terra för svårare uppgifter, och använd Sol endast för den genuint svåra minoriteten. I kombination med cachning och batchbearbetning sänker detta rutinmässigt kostnaderna långt mer än någon enskild prisändring. Haken är operativ: du vill inte integrera om tre OpenAI-nivåer plus öppna modellalternativ separat.
Få åtkomst till alla tre (och billigare konkurrenter) via en slutpunkt
Det är här som en leverantörsneutral router hjälper. OrcaRouter exponerar GPT-5.6 Luna, Terra och Sol — till samma priser efter sänkningen, 0% påslag — via en enda OpenAI-kompatibel endpoint, tillsammans med billigare öppna modeller som DeepSeek V4 Pro, GLM-5.2 och Qwen. Att byta nivå (eller A/B-testa Luna mot en öppen modell) är en konfigurationsändring, inte en ny integration, och du kan dirigera varje förfrågan till det som är billigast. Luna Reserve är konsumentsidan av samma idé — en inbyggd reservlösning som håller utvalda användare kvar på GPT-5.6 Luna efter att deras vanliga kvot är förbrukad — och API-motsvarigheten är automatisk failover, som OrcaRouter hanterar när en leverantör rate-begränsar eller returnerar ett fel på en begäran.

Den sänkta Luna-prislistan syns på OrcaRouters egen modellsida till listpris – $0,20 / $1,20 per miljon tokens – eftersom routern förmedlar leverantörspriserna utan påslag (0 %), med en kostnadskalkylator på sidan för en typisk månadsfaktura. Det finns också en gratisnivå och en Offers-sida för ytterligare besparingar.

Vanliga frågor
Vilka är GPT-5.6-priserna efter sänkningen?
Luna $0,20 / $1,20, Terra $2 / $12 och Sol $5 / $30 per miljon in- och utdatatoken. Luna och Terra sänktes den 30 juli 2026; Sol är oförändrad.
Vilken GPT-5.6-nivå ska jag använda?
Luna för högvolymsarbete med låg latens; Terra för tuffare uppgifter som inte kräver flaggskeppet; Sol för de svåraste resonemangen och agentisk kodning. Routa efter svårighetsgrad för att minimera kostnaden.
Är GPT-5.6 Luna gratis i ChatGPT?
OpenAI meddelade den 6 augusti att GPT-5.6 Luna blir standardmodellen för gratis- och Go ChatGPT-konton, med obegränsade textchattar; gränser kvarstår för filuppladdningar, bilder och röstverktyg, och en Think-knapp för högre resonemang rullas ut separat. Dessa är OpenAI:s egna planer, inte oberoende verifierade.
Varför använder Replit GPT-5.6 Luna för gratisläget?
Replits Free Mode, som tillkännagavs den 19 augusti 2026, kör vardagliga chattar, idégenerering och enkel kodning på GPT-5.6 Luna som standard för Core- och Pro-prenumeranter, och dirigerar svårare uppgifter vidare till en större modell – dess Power/Max-lägen eller GPT-5.6 Sol – efter behov. Replit tillskriver prissänkningen på Luna API den 30 juli, cirka 80 %, att ekonomin går ihop. Dessa är leverantörsangivna planer, inte oberoende verifierade.
Vad är Luna Reserve?
En fallback-tilldelning som OpenAI dokumenterar för Codex och ChatGPT Work: utvalda ChatGPT Plus- och Pro-konton får en begränsad pool av GPT-5.6 Luna-användning när deras ordinarie användningsgräns är förbrukad, så att de fortsätter fungera istället för att stängas av. Den serverar endast GPT-5.6 Luna — aldrig Terra eller Sol — har en egen gräns, är separat från ordinarie användning och är inte tillgänglig i Business- eller Enterprise-arbetsytor. Existensen är OpenAI-bekräftad (personal bekräftade det den 27 augusti); utrullningen till utvalda konton är community-rapporterad, inte oberoende verifierad.
Hur mycket kostar GPT-5.6 per månad?
Vid 10M tokens/månad (70% input): ungefär $5 på Luna, $50 på Terra och $125 på Sol — en 25x skillnad, före cachning. Din faktiska kostnad beror på cachning och din input/output-blandning.
Har alla tre nivåer samma kontextfönster?
Ja — ungefär en kontext på 1,05 miljoner tokens och upp till 128 000 utdatatokens, med stöd för vision, verktyg, JSON och resonemang.
Hur påverkar promptcachning kostnaden?
Cachning minskar kraftigt kostnaden för upprepat kontext — Lunas cacheread ligger på cirka 0,02 USD per miljon tokens jämfört med 0,20 USD för färsk — så återanvänd cachade prompter när det är möjligt. Långa indata kan å andra sidan flytta dig till en dyrare långkontextnivå.
Hur jämför sig nivåerna med Anthropic eller öppna modeller?
Enligt rapporter är Luna billigare än Claude Haiku 4.5 (~5x input / 4x output) och Terra ligger under Claude Sonnet 5 ($3 / $15). Luna ligger också nära det billiga golvet för öppna modeller (DeepSeek, GLM-5.2 ~$1.20/$4.10).
Var kan jag använda alla tre nivåerna tillsammans?
Genom OrcaRouters enda OpenAI-kompatibla slutpunkt med 0 % påslag, tillsammans med billigare öppna modeller för svårighetsbaserad routing.
Slutsats
Efter sänkningen är GPT-5.6 Luna ($0.20 / $1.20) och Terra ($2 / $12) lockande för högvolym- och mellannivåarbete, medan Sol ($5 / $30) förblir premiumflaggskeppet — en 25x kostnadsspridning som belönar smart routing. Konsumentutrullningen förstärker uppdelningen: OpenAI gör Luna till gratisstandard medan de reserverar Sol:s tillförlitlighetsuppdatering för betalda abonnemang, och Replits Free Mode den 19 augusti — byggd på GPT-5.6 Luna, med svårare uppgifter som dirigeras upp till GPT-5.6 Sol — visar att högtrafikprodukter hamnar på samma nivå, och Luna Reserve-fallbacken i slutet av augusti förlänger mönstret genom att hålla utvalda Plus- och Pro-användare kvar på GPT-5.6 Luna även efter att deras vanliga gränser har tagit slut. För API-utvecklare är det ytterligare en anledning att dirigera enkel trafik till Luna. De största besparingarna kommer från att dirigera efter svårighet, utnyttja cachning och batchning samt kontrollera resonemangstoken snarare än att som standard använda en enda nivå. Det är lättast att göra via en enda endpoint med 0 % pålägg, som OrcaRouter, där alla tre nivåerna (till de nya priserna) ligger sida vid sida med de billigare öppna modeller som du vill jämföra dem med.
