GPT-5.6-prissättning efter prissänkningen: Luna vs Terra vs Sol, och vilken nivå du ska använda
Guides & Insights

GPT-5.6-prissättning efter prissänkningen: Luna vs Terra vs Sol, och vilken nivå du ska använda

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Efter OpenAIs prissänkning den 30 juli 2026 har GPT-5.6-familjen – GPT-5.6 Luna, GPT-5.6 Terra och GPT-5.6 Sol – aldrig varit billigare att köra i stor skala. En vecka senare, den 6 augusti, lade OpenAI in samma nivåer i själva ChatGPT: GPT-5.6 Luna blir standardmodellen för gratiskonton och Go-konton med obegränsade textchattar, medan GPT-5.6 Sol uppdaterades för Plus och Pro. Den 19 augusti meddelade OpenAI och Replit att Replits nya Free Mode för Core- och Pro-prenumeranter körs på GPT-5.6 Luna – den hittills största tredjepartssatsningen på volymnivån. Och i slutet av augusti började OpenAI rulla ut en reservlösning för tunga konsumentanvändare: ett ”Luna Reserve”-utrymme som ger utvalda ChatGPT Plus- och Pro-konton begränsad användning av GPT-5.6 Luna i Codex och ChatGPT Work när deras vanliga användningsgränser är förbrukade. Men de tre nivåerna prissätts mycket olika, och att välja rätt (samt att använda cachning, batch och routing på rätt sätt) är den enskilt största hävstången på din API-faktura. Den här guiden beskriver hela prissättningen efter sänkningen, genomarbetade kostnadsexempel, hur varje nivå står sig mot konkurrenterna och hur du kan dirigera trafiken mellan dem via en enda endpoint.

Priser anges per miljon tokens (inmatning / utmatning) och återspeglar den sänkta prislistan enligt rapportering samt OrcaRouters vidarefaktureringsmodellsidor; nivå- och cachepriser kommer från OrcaRouters modellsidor, och konkurrenters siffror är tillskrivna. ChatGPT-utrullningsdetaljerna i denna artikel är som O​penAI angav dem den 6 augusti 2026, och detaljerna om Replit Free Mode är som O​penAI och Replit angav dem den 19 augusti 2026 – leverantörsrapporterade, inte oberoende uppmätta. Detaljerna om Luna Reserve är som O​penAI dokumenterar dem i sitt hjälpcenter och som O​penAI-anställda och tidiga användare rapporterade dem i slutet av augusti 2026 – leverantörs- och communitybaserade, inte oberoende verifierade. Priser ändras – verifiera innan du bygger.

Sammanfattning

GPT-5.6 Luna ($0.20 / $1.20) är den högvolymiga arbetshästen; Terra ($2 / $12) är det balanserade mittenalternativet; Sol ($5 / $30) är flaggskeppet för de svåraste resonemangen och agentisk kodning. Alla tre delar en kontext på ~1,05M tokens och 128K maxutdata. Promptcache och batchalternativet sänker kostnaderna ytterligare, medan mycket långa indata flyttar dig till en högre nivå. På konsumentsidan tillkännagav O​penAI den 6 augusti att GPT-5.6 Luna blir standard för gratis- och Go ChatGPT-konton med obegränsade textbaserade chattar, och att en uppdaterad GPT-5.6 Sol rullas ut till Plus och Pro. Den 19 augusti lanserade Replit Free Mode på GPT-5.6 Luna för Core- och Pro-prenumeranter, och dirigerar svårare uppgifter vidare till GPT-5.6 Sol vid behov. I slutet av augusti började O​penAI även rulla ut en “Luna Reserve”-reservlösning som ger utvalda ChatGPT Plus- och Pro-konton begränsad användning av GPT-5.6 Luna i Codex och ChatGPT Work efter att deras vanliga gränser har förbrukats — dokumenterad av O​penAI, med utrullningen till utvalda konton rapporterad av användare. Använd Luna för den enkla majoriteten, Terra när du behöver mer, och Sol bara där den motiverar sin kostnad — och dirigera efter svårighetsgrad genom en O​penAI-kompatibel slutpunkt för att minimera utgifterna.

Viktiga slutsatser

• Luna: $0,20 / $1,20 per 1M tokens — snabb, billig, för högvolymarbete som är latenskänsligt.

Terra: $2 / $12 — den balanserade mellanklassen för tuffare uppgifter som inte behöver flaggskeppet.

• Sol: $5 / $30 — flaggskeppet för djupgående resonemang, storskalig kodning och långsiktiga agenter.

• Cachning och batchbearbetning sänker kostnaderna ytterligare; långa indata leder dig till en dyrare långkontextnivå.

• ChatGPT (enligt OpenAI, 6 aug): Luna blir standard för gratis/Go med obegränsade textchattar; Sol får en tillförlitlighetsuppdatering för Plus/Pro.

• Replit (tillkännagav 19 aug): Free Mode för Core/Pro körs på GPT-5.6 Luna — upp till 30x mer användning per Replit, med svårare uppgifter som dirigeras upp till GPT-5.6 Sol. Enligt Replit, inte oberoende verifierat.

• Luna Reserve (slutet av aug, O​penAI-dokumenterad): en reservtilldelning med tak som låter utvalda ChatGPT Plus- och Pro-konton fortsätta använda GPT-5.6 Luna i Codex och ChatGPT Work efter att de vanliga gränserna är förbrukade — inte obegränsat, och inte tillgängligt i Business- eller Enterprise-arbetsytor.

Största besparingshävstången: dirigera efter svårighetsgrad — betala inte Sol-priser för arbete som Luna kan utföra.

Den nya grundprissättningen för GP​T-5.​6

Här är baspriserna efter sänkningen per miljon in-/utdata-token: Luna $0.20 / $1.20 (ned från $1 / $6), Terra $2 / $12 (ned från $2.50 / $15) och Sol $5 / $30 (oförändrat). De två billigare nivåerna sänktes den 30 juli 2026; flaggskeppet höll. Enkelt uttryckt är de låga nivåerna nu prissatta för skala, medan flaggskeppet förblir premium.

Nivåbaserad, cachad och batchprissättning

Grundpriset är bara utgångspunkten. GP​T-5.​6-prissättningen har tre modifierare som väsentligt ändrar din faktiska kostnad:

• Långa kontextnivåer. Priserna trappas upp för mycket långa indata. På OrcaRouters pass-through-sidor kostar Luna $0,20 / $1,20 upp till en stor kontextnivå och $0,40 / $1,80 därutöver; Sol kostar $5 / $30 på sin basnivå och $10 / $45 på den största. Nivån väljs utifrån varje begärans antal inmatningstoken, så några få enorma promptar kan tyst höja ditt genomsnittspris.

• Prompt caching. Återanvänt sammanhang faktureras till ett kraftigt rabatterat pris — Lunas cacheread är ungefär $0,02 per miljon tokens (jämfört med $0,20 för färskt), med cacheskrivningar runt $0,25; Sols cacheread är cirka $0,50 (jämfört med $5 för färskt). För agenter och chatt med en stabil systemprompt är cachning ofta den enskilt största besparingen.

• Batch. Icke-brådskande jobb körs asynkront till rabatterat pris — idealiskt för bulkklassificering, utvärderingar och offlinegenerering där latens inte spelar någon roll.

Genomarbetade exempel: vad det faktiskt kostar

Konkreta siffror gör nivåerna verkliga. Ta 10 miljoner tokens i månaden med en fördelning på 70% inmatning / 30% utmatning (en typisk chatt-/agentmix):

• Luna: cirka 5 USD per månad (ungefär 4,37 USD med prompt caching).

• Terra: ungefär 50 dollar i månaden.

• Sol: omkring 125 dollar i månaden (ungefär 109 dollar med cachning).

Det är en 25x skillnad mellan Luna och Sol för samma volym — vilket är precis varför det är viktigare att matcha varje förfrågan till den billigaste lämpliga nivån än någon enskild taxa. (Dessa matchar OrcaRouters kostnadskalkylator på sidan, som uppskattar utifrån listpris; dina faktiska siffror beror på cachning och din in-/utdatablandning.)

Vad varje nivå egentligen är till för

GPT-5.6 Luna — volymarbetshästen

Luna är den snabba, kostnadseffektiva nivån, optimerad för högvolyms-, {{1}}latenskänsliga arbetsbelastningar{{/1}}: {{2}}chat, klassificering, extraktion, routing och lätta agentiska uppgifter{{/2}}, {{3}}med en p50-tid till första token på cirka 1,65 sekunder{{/3}}. Efter prissänkningen, till {{4}}$0,20 / $1,20{{/4}}, är den prissatt för att konkurrera direkt med billiga öppna modeller – standardvalet för majoriteten av enkla anrop. Det är också den nivå som O​penAI styr konsument-ChatGPT mot: enligt tillkännagivandet den 6 augusti blir {{5}}GPT-5.6 Luna{{/5}} standardmodellen för Free- och Go-konton, med obegränsade textchattar och en ny Think-knapp för högre resonemang på svårare frågor som kommer följande vecka (gränserna för fil, bild och röst kvarstår). O​penAI säger att Luna gör {{6}}62 % färre faktiska fel{{/6}} än GPT-5.5 Instant som den ersätter – en leverantörsrapporterad siffra, men en tydlig signal om att volymnivån är dit företaget riktar större delen av sin trafik.

Den 19 augusti 2026 gjorde Replit GPT-5.6 Luna till motorn i sitt nya gratisläge – standardupplevelsen för Core- och Pro-prenumeranter. Vardaglig chatt, idéarbete och enkla koduppgifter körs på Luna utan att förbruka användarens betalda AI-kreditbudget; Replit säger att Core-användare nu kan skapa upp till 30 gånger mer per månad, inklusive upp till 30 timmars chatt. När en uppgift kräver mer resonemang dirigerar Replits Agent begäran till en större modell för den delen – dess Power/Max-lägen eller GPT-5.6 Sol – och återgår sedan till Luna. Dessa är uppgifter från Replit och O​penAI, inte oberoende verifierade – men riktningen stämmer med prissänkningen: en 80 % billigare Luna är det som gör en alltid påslagen, som standard inkluderad nivå livskraftig.

En annan konsumentrelaterad nyhet dök upp i slutet av augusti 2026: Luna Reserve. Som O​penAI dokumenterar i sitt hjälpcenter kan utvalda ChatGPT Plus- och Pro-konton få en begränsad pool av GPT-5.6 Luna-användning i Codex och ChatGPT Work som en reserv när deras vanliga användningskvot är förbrukad — ett meddelande eller en månindikator visas vid gränsen, och du kan fortsätta arbeta på Luna så länge reserven räcker. Det är inte en obegränsad förlängning: reserven är separat från den vanliga kvoten och har själv ett tak, den betjänar endast GPT-5.6 Luna (aldrig Terra eller Sol), den är inte tillgänglig i Business- eller Enterprise-arbetsytor, och att nå en vanlig gräns garanterar inte åtkomst. O​penAI:s personal bekräftade reservens existens den 27 augusti, och tidiga användarrapporter beskriver hur den rullas ut till utvalda konton — uppgifter från leverantör och community, inte oberoende verifierade. Vissa tidiga communityrapporter noterar också att reserven kör den webblättra sidan av GPT-5.6 Luna, så live-webbinspektioner kanske inte fungerar när du använder reserven.

GPT-5.6 Terra — den balanserade mitten

Terra ligger mellan volym och flaggskepp: mer kapabel än Luna för tuffare resonemang och kodning, men mycket billigare än Sol. Till $2 / $12 är det ett förnuftigt standardval när Luna inte riktigt räcker till men du inte behöver flaggskeppet — medelkomplex extraktion, utkast och flerstegsuppgifter som fortfarande körs i stor skala.

GPT-5.6 Sol — flaggskeppet

Sol är byggd för det svåraste arbetet: djup flerstegsresonemang, storskalig programvaruutveckling och långsiktiga agentiska arbetsflöden, och förblir koherent över en kontext på ~1,05M tokens och upp till 128K utdata. Till $5 / $30 (bas) är det ett premiumval — reservera det för uppgifter som verkligen behöver det, som komplex kodning över flera filer eller långa agentkörningar. Den 6 augusti uppdaterade O​penAI även GPT-5.6 Sol i ChatGPT för Plus- och Pro-användare: företaget säger att chattversionen är mer tillförlitlig när det gäller fakta — 68 % färre faktiska fel, enligt O​penAI — och ger mer fokuserade svar, med ett nytt skjutreglage för att styra hur mycket resonemangsansträngning den tillämpar. Uppdateringen gäller endast chatten (Sol bakom Work och Codex är oförändrad), och API-nivån ligger kvar på $5 / $30.

Förbehållet om resonemangstoken

GP​T-5.​6 är resonemangsmodeller, så den effektiva utdatakostnaden kan överstiga en naiv uppskattning: när resonemang är på, faktureras interna resonemangstokens som utdata. För svåra uppmaningar med hög resonemangsinsats kan det dominera din faktura. Ställ in resonemangsinsatsen efter uppgiften (låg eller av för enkla anrop), begränsa utdatatokens där du kan, och mät faktisk användning. Billigare priser per token hjälper; att generera färre tokens hjälper mer.

Hur varje nivå jämförs med konkurrenterna

Prissänkningen ompositionerade GP​T-5.​6 gentemot fältet. Enligt rapporter understiger Lunas $0,20 / $1,20 nu Claude Haiku 4.5 med ungefär 5 gånger för input och 4 gånger för output, och Terras $2 / $12 ligger under Claude Sonnet 5:s standardpris (rapporterat till $3 / $15). Jämfört med öppna vikter ligger Luna nära den bottennivå som sätts av Deep​Seeks V4-serie och Zhi​pus GLM-5.2 (ungefär $1,20 / $4,10), med Qw​en- och Gem​ini Flash-nivåer i närheten. Slutsatsen: för kostnadskänsligt arbete är Luna nu konkurrenskraftig med de billigaste kapabla modellerna snarare än ett premiumalternativ till dem — medan Sol förblir en genuin premiumnivå för kapacitet som du inte kan få billigt.

Den verkliga besparingshävstången: dirigera efter svårighet

Den billigaste fakturan är inte en enda nivå — det handlar om att matcha varje förfrågan till den billigaste modell som kan utföra den. I praktiken: skicka enkla, högfrekventa anrop till Luna (eller en billig öppen modell), växla upp till Terra för svårare uppgifter, och använd Sol endast för den genuint svåra minoriteten. I kombination med cachning och batchbearbetning sänker detta rutinmässigt kostnaderna långt mer än någon enskild prisändring. Haken är operativ: du vill inte integrera om tre O​penAI-nivåer plus öppna modellalternativ separat.

Få åtkomst till alla tre (och billigare konkurrenter) via en slutpunkt

Det är här som en leverantörsneutral router hjälper. OrcaRouter exponerar GPT-5.6 Luna, Terra och Sol — till samma priser efter sänkningen, 0% påslag — via en enda O​penAI-kompatibel endpoint, tillsammans med billigare öppna modeller som DeepSeek V4 Pro, GLM-5.2 och Qw​en. Att byta nivå (eller A/B-testa Luna mot en öppen modell) är en konfigurationsändring, inte en ny integration, och du kan dirigera varje förfrågan till det som är billigast. Luna Reserve är konsumentsidan av samma idé — en inbyggd reservlösning som håller utvalda användare kvar på GPT-5.6 Luna efter att deras vanliga kvot är förbrukad — och API-motsvarigheten är automatisk failover, som OrcaRouter hanterar när en leverantör rate-begränsar eller returnerar ett fel på en begäran.

Den sänkta Luna-prislistan syns på OrcaRouters egen modellsida till listpris – $0,20 / $1,20 per miljon tokens – eftersom routern förmedlar leverantörspriserna utan påslag (0 %), med en kostnadskalkylator på sidan för en typisk månadsfaktura. Det finns också en gratisnivå och en Offers-sida för ytterligare besparingar.

Vanliga frågor

Vilka är GP​T-5.​6-priserna efter sänkningen?

Luna $0,20 / $1,20, Terra $2 / $12 och Sol $5 / $30 per miljon in- och utdatatoken. Luna och Terra sänktes den 30 juli 2026; Sol är oförändrad.

Vilken GPT-5.6-nivå ska jag använda?

Luna för högvolymsarbete med låg latens; Terra för tuffare uppgifter som inte kräver flaggskeppet; Sol för de svåraste resonemangen och agentisk kodning. Routa efter svårighetsgrad för att minimera kostnaden.

Är GPT-5.6 Luna gratis i ChatGPT?

O​penAI meddelade den 6 augusti att GPT-5.6 Luna blir standardmodellen för gratis- och Go ChatGPT-konton, med obegränsade textchattar; gränser kvarstår för filuppladdningar, bilder och röstverktyg, och en Think-knapp för högre resonemang rullas ut separat. Dessa är O​penAI:s egna planer, inte oberoende verifierade.

Varför använder Replit GPT-5.6 Luna för gratisläget?

Replits Free Mode, som tillkännagavs den 19 augusti 2026, kör vardagliga chattar, idégenerering och enkel kodning på GPT-5.6 Luna som standard för Core- och Pro-prenumeranter, och dirigerar svårare uppgifter vidare till en större modell – dess Power/Max-lägen eller GPT-5.6 Sol – efter behov. Replit tillskriver prissänkningen på Luna API den 30 juli, cirka 80 %, att ekonomin går ihop. Dessa är leverantörsangivna planer, inte oberoende verifierade.

Vad är Luna Reserve?

En fallback-tilldelning som O​penAI dokumenterar för Codex och ChatGPT Work: utvalda ChatGPT Plus- och Pro-konton får en begränsad pool av GPT-5.6 Luna-användning när deras ordinarie användningsgräns är förbrukad, så att de fortsätter fungera istället för att stängas av. Den serverar endast GPT-5.6 Luna — aldrig Terra eller Sol — har en egen gräns, är separat från ordinarie användning och är inte tillgänglig i Business- eller Enterprise-arbetsytor. Existensen är O​penAI-bekräftad (personal bekräftade det den 27 augusti); utrullningen till utvalda konton är community-rapporterad, inte oberoende verifierad.

Hur mycket kostar GP​T-5.​6 per månad?

Vid 10M tokens/månad (70% input): ungefär $5 på Luna, $50 på Terra och $125 på Sol — en 25x skillnad, före cachning. Din faktiska kostnad beror på cachning och din input/output-blandning.

Har alla tre nivåer samma kontextfönster?

Ja — ungefär en kontext på 1,05 miljoner tokens och upp till 128 000 utdatatokens, med stöd för vision, verktyg, JSON och resonemang.

Hur påverkar promptcachning kostnaden?

Cachning minskar kraftigt kostnaden för upprepat kontext — Lunas cacheread ligger på cirka 0,02 USD per miljon tokens jämfört med 0,20 USD för färsk — så återanvänd cachade prompter när det är möjligt. Långa indata kan å andra sidan flytta dig till en dyrare långkontextnivå.

Hur jämför sig nivåerna med Anthropic eller öppna modeller?

Enligt rapporter är Luna billigare än Claude Haiku 4.5 (~5x input / 4x output) och Terra ligger under Claude Sonnet 5 ($3 / $15). Luna ligger också nära det billiga golvet för öppna modeller (Deep​Seek, GLM-5.2 ~$1.20/$4.10).

Var kan jag använda alla tre nivåerna tillsammans?

Genom OrcaRouters enda OpenAI-kompatibla slutpunkt med 0 % påslag, tillsammans med billigare öppna modeller för svårighetsbaserad routing.

Slutsats

Efter sänkningen är GPT-5.6 Luna ($0.20 / $1.20) och Terra ($2 / $12) lockande för högvolym- och mellannivåarbete, medan Sol ($5 / $30) förblir premiumflaggskeppet — en 25x kostnadsspridning som belönar smart routing. Konsumentutrullningen förstärker uppdelningen: O​penAI gör Luna till gratisstandard medan de reserverar Sol:s tillförlitlighetsuppdatering för betalda abonnemang, och Replits Free Mode den 19 augusti — byggd på GPT-5.6 Luna, med svårare uppgifter som dirigeras upp till GPT-5.6 Sol — visar att högtrafikprodukter hamnar på samma nivå, och Luna Reserve-fallbacken i slutet av augusti förlänger mönstret genom att hålla utvalda Plus- och Pro-användare kvar på GPT-5.6 Luna även efter att deras vanliga gränser har tagit slut. För API-utvecklare är det ytterligare en anledning att dirigera enkel trafik till Luna. De största besparingarna kommer från att dirigera efter svårighet, utnyttja cachning och batchning samt kontrollera resonemangstoken snarare än att som standard använda en enda nivå. Det är lättast att göra via en enda endpoint med 0 % pålägg, som OrcaRouter, där alla tre nivåerna (till de nya priserna) ligger sida vid sida med de billigare öppna modeller som du vill jämföra dem med.