
OpenAI sänkte GPT-5.6 API-priserna: Vad som ändrades, varför och hur du får det
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 984 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 195 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
Den 30 juli 2026 sänkte OpenAI API-priserna för sina två billigare GPT-5.6-modeller – en kraftig sänkning av den billigaste nivån och en viss minskning av mellannivån. Tre veckor senare var det dags för flaggskeppet: den 21 augusti 2026 meddelade OpenAI att API-priserna för GPT-5.6 Sol sjunker med mer än 20 % under de kommande tre månaderna medan företaget arbetar för att driva modellen mer effektivt. Den här artikeln förklarar exakt vad som förändrades i båda omgångarna, tekniken bakom dem, hur de nya priserna står sig mot konkurrenterna, de dolda kostnaderna att se upp för, hur du kan sänka din faktura ytterligare – och hur de lägre priserna redan är live på OrcaRouter med 0 % påslag.
Alla siffror nedan är märkta med källa. Priset anges per miljon tokens (input / output). Luna- och Terra-priserna återspeglar OpenAIs prislista från den 30 juli 2026, som rapporterats av bland annat Unite.AI; Sol-sänkningen återspeglar OpenAIs tillkännagivande från den 21 augusti 2026, med priser per token som rapporterats av bland annat Runtimewire och Reuters. OrcaRouters pass-through-modellsidor visar samma siffror; konkurrenters siffror anges med källa. Priserna förändras — verifiera innan du bygger.
TL;DR. OpenAI sänkte GPT-5.6 Luna till 0,20 $ / 1,20 $ (från 1 $ / 6 $, cirka 80 % rabatt) och GPT-5.6 Terra till 2 $ / 12 $ (från 2,50 $ / 15 $, cirka 20 % rabatt) den 30 juli. Den 21 augusti utökades rabatten till flaggskeppet: GPT-5.6 Sol:s API-priser sjunker med över 20 % under de kommande tre månaderna – till 4 $ / 20 $ per miljon tokens från 5 $ / 30 $, enligt OpenAI – medan tokenbaserade Codex- och ChatGPT Work-krediter räcker längre och abonnemangsanvändningen förblir oförändrad. Två effektivitetsvinster betalade för julirabatten: omskrivna GPU-kernlar (cirka 20 % lägre serveringskostnad) och en omdesignad utkastsmodell för spekulativ avkodning (15 %+ snabbare tokengenerering). Om du dirigerar trafik via en leverantörsoberoende slutpunkt med 0 % påslag, som OrcaRouter, är de nya priserna redan aktiva – samma pris, ett OpenAI-kompatibelt API, med alla konkurrerande modeller bredvid för att jämföra och dirigera mellan.
Viktiga slutsatser
• GPT-5.6 Luna: nu $0.20 / $1.20 per 1M tokens, ner från $1 / $6 — ungefär en sänkning på 80 %.
• GPT-5.6 Terra: nu $2 / $12, ned från $2.50 / $15 — en sänkning på cirka 20%.
• GPT-5.6 Sol (flaggskepp): nu $4 / $20 under de kommande tre månaderna, ned från $5 / $30 — en sänkning på över 20 % som tillkännagavs den 21 augusti 2026.
• Codex & ChatGPT Work token-baserade krediter ger mer: Sol input sjunker till 100 krediter och output till 500 krediter per 1M tokens (från 125 / 750).
• Prenumerationer oförändrade: inkluderad användning, veckogränser på fem timmar och äldre kreditpriser för Plus, Pro och Business påverkas inte.
• Varför: OpenAI beskrev båda omgångarna som effektivitetsvinster — omskrivna produktions-GPU-kärnor (~20 % lägre serveringskostnad) plus en omdesign av draftmodellen för spekulativ avkodning (15 %+ högre tokengenereringseffektivitet), enligt OpenAIs tekniska inlägg från den 29 juli.
• Så här får du det: prissänkningarna är redan återspeglade på OrcaRouter (0 % påslag) — Luna för $0,20 / $1,20, Sol för $4 / $20 — via en OpenAI-kompatibel slutpunkt.
Vad exakt ändrades?
OpenAI:s GPT-5.6-familj fungerar som en nivåstege: Luna (snabb, billigast), Terra (mellan), och Sol (flagskepp). Nedskärningen den 30 juli drabbade de två billigare nivåerna. Enligt den rapporterade prislistan sänktes GPT-5.6 Luna från $1 / $6 till $0,20 / $1,20 per miljon in-/utdatatokens — en minskning på cirka 80 % för både in- och utdata — och GPT-5.6 Terra sänktes från $2,50 / $15 till $2 / $12, ungefär 20 %. GPT-5.6 Sol, flagskeppet byggt för det svåraste resonerandet och agentisk kodning, lämnades orört den dagen — men den 21 augusti 2026 meddelade OpenAI en tillfällig sänkning även för den: API-priserna faller med mer än 20 % under de närmaste tre månaderna, till $4 per miljon inmatningstokens och $20 per miljon utdatatokens, med cachad inmatning sänkt från $0,50 till $0,40. I samma meddelande sades att de krediter du köper räcker längre i Codex på token-baserade abonnemang, och att användningen som ingår i din prenumeration förblir densamma.
Grundpriset per token är inte hela historien. GPT-5.6-prissättningen har också nivåer baserade på inmatningslängd (mycket långa sammanhang flyttas till en högre taxa), en rabatt för promptcache (cachad inmatning är mycket billigare än färsk inmatning) och ett batchalternativ (asynkrona jobb till rabatterat pris). Alla tre gäller även efter prissänkningen, så det effektiva priset för en arbetsbelastning som är tung på cache eller batch kan bli ännu lägre. Se upp med långkontext-nivån i andra riktningen: att mata in enorma prompter kan knuffa upp dig en nivå.

De två optimeringarna bakom klippet
Det här var ingen förlustledargest – OpenAI beskrev det som en effektivitetsutdelning. I ett tekniskt inlägg den 29 juli 2026 beskrev medlemmar av OpenAIs teknikpersonal optimeringar inom inferens och agentmiljön bakom Codex och ChatGPT Work. Två saker sticker ut. För det första omskrivningar av GPU-kernlar i produktionsinfrastrukturen – där Sol, som körs i Codex, användes för att skriva om företagets egna kernels – vilket OpenAI säger minskade de totala serveringskostnaderna med cirka 20 %. För det andra en omdesignad utkastmodell för spekulativ avkodning som enligt uppgift förbättrade effektiviteten i tokengenereringen med mer än 15 %. Lägre serveringskostnad, som förs vidare till kunderna som lägre priser i de volymstarka nivåerna, är berättelsen – och det är en glimt av en återkopplingsslinga som hela branschen jagar: att använda frontier-modeller för att optimera själva infrastrukturen som serverar dem.
Sol-sänkningen som tillkännagavs den 21 augusti har samma inramning. Enligt OpenAI beror sänkningen – mer än 20 % under de kommande tre månaderna – på att företaget gör modellen mer effektiv att köra, och den är uttryckligen tillfällig snarare än en permanent prissänkning.
Hur de nya priserna jämförs
Prissänkningen är riktad rakt mot konkurrensen. Enligt Unite.AI:s rapportering underbjuder Lunas nya $0,20 / $1,20 Anthropics Haiku 4.5 med ungefär 5x på input och cirka 4x på output, och Terras nya $2 / $12 hamnar under Claude Sonnet 5:s standardpris (rapporterat till $3 / $15 som träder i kraft efter 31 augusti 2026). När det gäller modeller med öppna vikter ligger Luna nu nära det billiga inferensgolvet som etablerats av DeepSeeks V4-serie och Zhipus GLM-5.2 (ungefär $1,20 / $4,10), med Alibabas Qwen och Googles Gemini Flash-nivåer i samma härad. Sols tillfälliga sänkning till $4 / $20 håller flaggskeppet väl ovanför sina egna volymnivåer men minskar premien – och minskningen med en tredjedel på output-tokens spelar störst roll för output-tunga agentarbetsbelastningar. Bevakningen av sänkningen noterar att den kommer när OpenAI möter växande konkurrens från Anthropic och kinesiska AI-modeller.
Inferens fortsätter att bli billigare.
Zoomar man ut passar den här prissänkningen in i en flerårig trend: kostnaden för en given kapacitetsnivå har fallit kraftigt, generation efter generation, när labben pressar ut mer genomströmning ur samma hårdvara. OpenAI:s egna äldre prisnivåer illustrerar nedgången över tid, och varje effektivitetsgenombrott — bättre kärnor, spekulativ avkodning, billigare attention — tenderar att visa sig som en prissänkning inom några månader. För köpare är den praktiska innebörden att arkitektera för en värld där inferens blir billigare enligt ett schema: bind dig inte för hårt till en enda modells prissättning, och håll byten billiga.
Den dolda kostnaden att se upp för: resonemangstokens
GPT-5.6-modeller är resonemangsmodeller, och det påverkar de faktiska kostnaderna. När resonemang är aktiverat genererar modellen interna resonemangstokens som debiteras som utdata – så din effektiva utdatakostnad kan bli högre än vad en naiv uppskattning av "ord i svaret" antyder, särskilt för svåra prompts med hög resonemangsansträngning. Lösningen är att anpassa resonemangsansträngningen till uppgiften (låg eller av för enkla anrop), sätta ett tak på utdata där det är möjligt och mäta faktisk tokenanvändning i stället för att anta. Ett lägre pris per token hjälper, men att kontrollera hur många tokens du genererar hjälper mer.
Vad det innebär för utvecklare
Om du använder GPT-5.6 Luna eller Terra för högvolymarbete – klassificering, extraktion, routing, lätta agenter, chatt – har din räkning just sjunkit, i vissa fall med större delen av dess värde, utan att någon kodändring krävs. Det gör volymnivåerna ännu mer attraktiva för kostnadskänsliga arbetsbelastningar och minskar prisskillnaden jämfört med billiga öppna modeller. Flaggskeppsmatematiken har också ändrats, åtminstone för nu: Sol till $4 / $20 under de kommande tre månaderna sänker kostnaden för resonemangstungt och agentbaserat arbete på toppnivån, och tokenbaserade Codex- och ChatGPT Work-krediter räcker längre. Det är fortfarande ett premiumval för de svåraste uppgifterna – bara ett billigare sådant än tidigare. Det vinnande mönstret är detsamma: dirigera efter svårighet – billiga nivåer (eller billiga öppna modeller) för de lätta 80 procenten, flaggskeppet bara där det motiverar sin kostnad.
Så här minskar du din räkning ytterligare
Prissänkningen är en grund att bygga på, inte mållinjen. De största ytterligare hävstängerna: cache av promptar (återanvänd en stabil systemprompt eller lång kontext och betala den mycket lägre avgiften för cachad inmatning); batchalternativet (kör icke-brådskande jobb asynkront till rabatterat pris); nivå- och modellroutning (skicka varje begäran till den billigaste modellen som kan hantera den, inklusive öppna modeller); och resonemangskontroll (betala inte för djupa resonemang på triviala anrop). Sammantagna minskar dessa rutinmässigt de faktiska räkningarna mycket mer än någon enskild prisförändring. Som en konkret referens: vid 10 miljoner tokens per månad med 70 % inmatningsandel, ger Luna's nya priser ungefär 5 dollar i månaden (cirka 4,37 dollar med cachning); samma volym på Sol är cirka 125 dollar i månaden — det tydligaste argumentet för routning efter svårighetsgrad.
Så här fångar du de lägre priserna direkt
Här är delen som knyter ihop allt. OrcaRouter tar 0 % påslag och släpper igenom leverantörspriserna direkt, så OpenAIs prissänkningar är redan aktiva på OrcaRouter: GPT-5.6 Luna visar $0.20 / $1.20, Terra $2 / $12 och GPT-5.6 Sol $4 / $20 på modellsidorna just nu — samma priser som på OpenAIs egen prislista, tillgänglig via en enda OpenAI-kompatibel slutpunkt tillsammans med 185+ andra modeller. Du får prissänkningarna utan migrering, och du kan jämföra priser för Sol, Luna och Terra mot DeepSeek, GLM, Qwen, Gemini och Claude på ett ställe, för att sedan dirigera varje förfrågan till det som är billigast för uppgiften. Det finns också en gratisnivå och en sida med erbjudanden för ytterligare besparingar.

Prissänkningarna är redan aktiva på OrcaRouter: GPT-5.6 Luna till $0.20 / $1.20 och GPT-5.6 Sol till $4 / $20 per 1M tokens, vidareförmedlade utan påslag (0% markup).
Välj rutt efter svårighetsgrad för att spara ännu mer.
Den billigaste fakturan är inte en enda modell — det är rätt modell per förfrågan. Eftersom OrcaRouter exponerar hela utbudet genom en enda slutpunkt kan du skicka enkla, högvolymiga anrop till Luna eller en billig öppen modell och reservera Sol eller en annan flaggskeppsmodell för de svåra, genom att växla med en konfigurationsändring snarare än en ny integration. En prissänkning på Luna gör den svårighetsbaserade routingstrategin ännu billigare, och den tillfälliga Sol-rabatten sänker kostnaden för de svåra anropen också — utan att du behöver koppla om något.

Vanliga frågor
Hur mycket sänkte OpenAI priserna på GPT-5.6?
GPT-5.6 Luna sjönk från $1 / $6 till $0.20 / $1.20 per miljon tokens (cirka 80 %), och GPT-5.6 Terra från $2.50 / $15 till $2 / $12 (cirka 20 %). Den 21 augusti 2026 sänkte OpenAI även GPT-5.6 Sol från $5 / $30 till $4 / $20 för de kommande tre månaderna.
När trädde prissänkningen i kraft?
Luna- och Terra-sänkningarna trädde i kraft den 30 juli 2026, live på den publicerade prislistan. OpenAI tillkännagav den tillfälliga Sol-sänkningen den 21 augusti 2026, för de kommande tre månaderna.
Varför sänkte OpenAI priserna?
OpenAI tillskriver juliprissänkningen inferensoptimeringar — omskrivna produktions-GPU-kärnor (cirka 20 % lägre serveringskostnad) och en omdesignad draftmodell för spekulativ avkodning (15 %+ effektivare tokengenerering) — enligt ett tekniskt inlägg från den 29 juli 2026. Man beskrev Sol-prissänkningen på samma sätt, som ett steg som tas medan modellen blir billigare att driva, på en marknad med växande konkurrens.
Har flaggskeppet (Sol) blivit billigare?
Ja — tillfälligt. Sänkningen den 30 juli lämnade GPT-5.6 Sol på $5 / $30, men den 21 augusti 2026 tillkännagav OpenAI en prissänkning på mer än 20 % för de kommande tre månaderna, till $4 / $20 per miljon tokens. Codex och ChatGPT Work:s tokenbaserade krediter köper också mer, medan abonnemangsanvändningen förblir oförändrad.
Hur jämför sig de nya priserna med Anthropic och öppna modeller?
Enligt rapporter underbjuder Luna nu Anthropics Haiku 4.5 med ungefär 5x input / 4x output, och Terra hamnar under Claude Sonnet 5:s standardpris ($3 / $15). Luna ligger också nära den billiga golvnivån för öppna modeller som satts av DeepSeek och GLM-5.2.
Vad är haken med resonemangstokens?
GPT-5.6 är resonemangsmodeller; interna resonemangstokens debiteras som utdata, så den faktiska utdatakostnaden kan överstiga en naiv uppskattning. Justera resonemangsinsatsen och begränsa utdata för att kontrollera den.
Hur får jag de nya lägre priserna?
De är redan live på OpenAI:s API och, med 0 % påslag, på OrcaRouter — där GPT-5.6 Luna visar $0,20 / $1,20 och GPT-5.6 Sol $4 / $20 — genom en OpenAI-kompatibel endpoint, utan kodändring.
Slutsats
OpenAIs sänkning den 30 juli gjorde GPT-5.6 Luna och Terra dramatiskt billigare för högvolymarbete, och tillkännagivandet den 21 augusti utökar historien till flaggskeppet: GPT-5.6 Sol sjunker till $4 / $20 under de kommande tre månaderna, medan Codex-tokenkrediter ger mer och abonnemangsanvändningen förblir oförändrad. Båda omgångarna är effektivitetsvinster – kärnomskrivningar och spekulativa avkodningsförbättringar å ena sidan, billigare serveringsdrift å den andra – och ett tydligt svar på ett verkligt priskrig. Routa efter svårighetsgrad, förlita dig på cachelagring och batchning, och kontrollera resonemangstoken för att spara mest. Och eftersom OrcaRouter förmedlar leverantörspriser med 0 % påslag, är de lägre priserna redan aktiva där – Luna för $0,20 / $1,20, Sol för $4 / $20 – samma pris, en OpenAI-kompatibel slutpunkt, hela modellfältet på ett ställe. Ta del av sänkningarna utan att ändra en enda rad kod, och låt varje förfrågan välja den billigaste modellen som klarar jobbet.
