Redaktionell flat-vector illustration för en teknikbloggs hjältebild om prissättning av flaggskeppsmodeller: ett stort runt modellchipp i djupblått med en mjuk cyan glöd på en ljus bakgrund, en pappersprislapp fastklämd i dess hörn, tre tokenströmmar som rinner ut ur chippet in i en cirkulär prismätare med små abstrakta markeringar, en liten stack av cachade block bredvid mätaren, och ett smalt kalenderblad som glider in från vänster. Vit bakgrund med mjuka blå- och cyangradientaccenter och en subtil varm högdager; minimala platta linjeikoner; ren modern geometrisk sans-serif-typografi; ingen läsbar text.
Guides & Insights

GPT-5.6 Sol API-priser: $5 / $30 per 1M tokens, cache till $0,50 – och vad det egentligen kostar

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

GPT-5.6 Sol kostar 5,00 USD per miljon inmatningstokens och 30,00 USD per miljon utmatningstokens på GPT-5.6 Sol API:et — samma pris som flaggskeppsnivån har i OrcaRouter-katalogen, kontrollerat 2026-08-18, utan påslag. Det är den dyraste nivån i GPT-5.6-familjen och den enda vars listpris inte ändrades i sänkningen den 30 juli, så prislistan på den live GPT-5.6 Sol-modellsidan är den man ska budgetera efter. Reglagen spelar större roll än rubriken: återanvänd inmatning faktureras till 0,50 USD per miljon via promptcache, batch-API:et sjunker till 2,50 / 15,00 USD, och snabbläget kostar en 2x-premie i utbyte mot upp till 2,5x hastighet. Den här sidan är prisreferensen specifikt för Sol — den exakta prislistan, vad en förfrågan faktiskt kostar, hur flaggskeppet står sig mot fältet, när det är fel köp och hur man anropar den via en OpenAI-kompatibel slutpunkt med sin egen nyckel.

Priserna gäller per miljon tokens (inmatning / utmatning), per den 2026-08-18. Dollarsiffrorna är hämtade från OpenAIs publicerade API-priser och korskontrollerade mot OrcaRouters modelsida för GPT-5.6 Sol; cache-, batch-, snabbläge- och långkontextpriser är tillkännagivna av OpenAI. Priserna ändras — verifiera innan du bygger.

Det exakta priset, verifierat idag

Här är den fullständiga prislistan för GPT-5.6 Sol, verifierad 2026-08-18:

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

Indata — $5.00 per 1M tokens vid en cache-miss.

Utdata — 30,00 USD per 1M tokens.

Läsning av promptcache — $0,50 per 1M tokens, 90 % rabatt på all indata du skickar om.

Prompt cache write — $6,25 per 1M tokens.

Long-context-nivå — indata över ungefär 272K tokens debiteras med $10.00 per input / $45.00 per output (2x input, 1.5x output).

Batch API — $2.50 input / $15.00 output, en fast rabatt på 50 %, asynkron, vanligtvis klar inom cirka 24 timmar.

Fast mode — $10.00 inmatning / $60.00 utmatning, en 2x premie för upp till cirka 2,5x utmatningshastighet med oförändrad intelligens.

Kontextfönster — ~1,05M token, upp till 128K utdata.

OrcaRouter skickar vidare leverantörens pris utan påslag, så siffran i katalogen är den siffra du betalar. På den live modellsidan visar kortet $5.00 / $30.00 per 1M, cacheläsning $0.500, med märkena Vision, Tools, JSON och Reasoning. Sols $5 / $30 är också priset före sänkningen: OpenAIs sänkning den 30 juli tillämpades på GPT-5.6 Luna (nu $0.20 / $1.20) och GPT-5.6 Terra (nu $2 / $12), medan flaggskeppet höll.

Spakarna som förändrar det effektiva priset.

Basräntan är bara utgångspunkten. Fyra modifierare ändrar vad Sol faktiskt kostar dig:

Promptcachning — återanvänd kontext kostar 0,50 USD per miljon istället för 5 USD för ny, och cache-skrivningar kostar 6,25 USD per miljon. För alla agenter eller chattar som skickar om ett stort prefix vid varje tur är cachning den enskilt största hävstången på fakturan. OpenAI baserar cachen på projekt och API-nyckel, så att hålla sig till en nyckel (en kanal) är det som gör att träffarna fortsätter komma.

Långkontextnivå — en begäran vars indata överstiger ungefär 272K tokens flyttas från baspriset till $10 / $45. Några få enorma prompts kan i tysthet höja ditt genomsnittspris, så batcha eller trunkera när du inte verkligen behöver den djupa kontexten.

Batch — OpenAI:s batch-API kör jobb asynkront med en ungefär 24 timmars handläggningstid till exakt halva priset: $2.50 / $15.00, med cachad inmatning för $0.25 och cache-skrivningar för $3.13. Det kombineras med prompt-cachning och passar utvärderingar, bulkklassificering och offlinegenerering där latens inte spelar någon roll.

Snabbläge — $10 / $60 för upp till cirka 2,5x högre utdatagenomströmning, användbart för latens-kritiskt arbete där användaren väntar, som livekodningsassistans. Det debiteras per token till 2x standardpriset, räknas inte mot köpta Scale Tier TPM-paket, och kan falla tillbaka till standardbearbetning om du överskrider den delade hastighetsgränsen.

Vad en förfrågan faktiskt kostar

Priser per token är abstrakta, så här är räkneexempel till dagens priser:

Enskilt chattanrop, 50K indata + 20K utdata — $0,25 + $0,60 = $0,85.

1M indata + 1M utdata — $5 + $30 = $35.

Agentisk tur, 200K cachad kontext + 20K ny indata + 30K utdata — $0.10 + $0.10 + $0.90 = $1.10. Samma tur med en kall cache — 220K ny indata till $1.10 — uppgår till $2.00. Cachning halverar nästan det.

En 10M-token-månad med en 70% input / 30% output-fördelning, med 80% av input från cache: 1.4M färsk input ($7.00) + 5.6M cachad ($2.80) + 3M output ($90) ≈ $100. Utan cache är samma månad $125 — och samma månad på GPT-5.6 Terra kostar cirka $50, eller cirka $5 på GPT-5.6 Luna. Den där 20x-skillnaden mellan Sol och Luna är anledningen till att nivåmatchning är viktigare än någon enskild taxa.

Två förbehåll höjer den effektiva kostnaden. Sol är en resonemangsmodell – interna resonemangstoken faktureras som utdata till 30 dollar per miljon. En svår prompt med hög resonemangsansträngning kan spendera en stor del av sin utdatabudget på tänkande, så den effektiva utdatakostnaden för svåra uppgifter ligger långt över en naiv uppskattning. Och OpenAIs tokeniserare är mer utförlig än förra generationens på vissa indata, så samma text kan kosta fler token än den skulle ha gjort på GPT-5.5. Anpassa resonemangsansträngningen till uppgiften, begränsa utdata där du kan, och mät faktisk användning innan du uppskattar en faktura.

Hur Sols prissättning står sig mot konkurrenterna.

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Avläst mot publicerade listpriser den 2026-08-18:

GPT-5.6 Terra — $2 / $12, mellannivån efter prissänkningen. Sol kostar 2,5 gånger mer på input och output; Terra är standardvalet när du inte behöver flaggskeppsresonemang.

GPT-5.6 Luna — $0.20 / $1.20, volymnivån efter sänkningen. Ett 25x ingångsgap till Sol; Luna är prissatt för merparten av trafiken.

Claude Opus 5 — $5 / $25. Samma indata, 20 % billigare utdata på pappret. I praktiken vänder jämförelsen för vissa arbetsbelastningar: den här bloggen mätte tidigare Sol till ungefär 34,5 % färre token än en Anthropic-modell på samma engelska/blandade urval, och en publicerad tokenekonomisk analys (TheBlockBeats) uppskattade att Sols totala faktura kan bli cirka 21 % lägre än Claude Opus 5 för motsvarande arbete trots den högre utdataavgiften. Mät din egen tokenizer, inte prisskylten.

Claude Fable 5 — $10 / $50. Sol kostar hälften av priset för inmatning och är 40 % billigare på utmatning än Anthropics toppnivå.

Claude Opus 4.8 — $5 / $25. Samma input som Sol, billigare output — Anthropic flaggskepp från föregående generation.

Grok 4.6 — $2 / $6. Den vassaste siffran på tavlan: den matchade GPT-5.6 Sol på Artificial Analysis-indexet (båda 61) med 2,5x billigare input och 5x billigare output.

DeepSeek V4 Pro — $0.44 / $0.88 utanför högtrafik (högtrafikfönster dubblar det). En helt annan prisvärld, för den billiga open-weights-banan.

Den ärliga beskrivningen: Sol är ett premiumflaggskepp med en premiumutmatningstakt — den högsta utmatningstakten bland de stängda flaggskeppsmodellerna under Claude Fable 5. Den vinner på effektiv kostnad per enhet av hårt arbete (dess tokenizer, dess resonemangsförmåga, dess långa kontext) snarare än på den absoluta takten. Om din trafik består av korta prompts och enkla uppgifter är en $2 Terra, en $0.20 Luna, eller en $2 / $6 Grok 4.6 det billigare valet — och på indexet är Grok 4.6 inte sämre på papperet.

När Sol är fel val

Fyra fall där detta pris inte är det du vill ha:

Korta, enkla prompter. Under ungefär 20K tokens utan djupare resonemang är flaggskeppspremien bortkastad. GPT-5.6 Terra för $2 / $12 eller GPT-5.6 Luna för $0,20 / $1,20 hanterar volymnivån för en bråkdel av kostnaden, och en Grok 4.6- eller DeepSeek-klassmodell kostar ännu mindre.

Resoneringsintensiv volym. Eftersom tänkande debiteras som utdata, kan en svår prompt med hög ansträngningsnivå kosta en bra bit över den nominella utdatanivån. Om din arbetsbelastning består av många svåra anrop, mät faktiska utdatatokens innan du förbinder dig — den effektiva taxan kan överraska dig.

Pris per token som enda mål. Grok 4.6 låg lika med Sol på indexet vid $2 / $6, och DeepSeek V4 Pro ligger på $0,44 / $0,88 utanför högtrafik. Om ett frontlinjebenchmarkresultat inte är det hårda kravet, levererar dessa modeller betydligt lägre priser per token för samma typ av arbete.

Strikta latensbudgetar. Sol är en stor resonemangsmodell, så tiden till första token ligger klart över den för en Flash-nivåmodell. För realtidschatt där subsekunds-TTFT är viktigt, ger snabbläget för $10 / $60 genomströmning, inte lägre första-token-latens — och en mindre modell är fortfarande den billigare lösningen.

Hur man anropar det på OrcaRouter

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol är hostad på OrcaRouter med modell-ID openai/gpt-5.6-sol, serveras via den OpenAI-kompatibla slutpunkten på api.orcarouter.ai/v1 till leverantörens pris utan påslag. Om du redan har en OpenAI-klient är migreringen bara en ändring av bas-URL och modell-ID — inget annat. Samma nyckel och slutpunkt ger tillgång till 200+ modeller, så Sol ligger bredvid GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 och de open-weight-modeller du vill jämföra den mot, och du kan dirigera efter svårighetsgrad istället för att återintegrera varje enskild modell.

Två OrcaRouter-detaljer värda att nämna på en prissida. BYOK: ta med din egen OpenAI-nyckel och OpenAI fakturerar dig direkt till sina egna priser — OrcaRouter lägger till $0 per token och behåller din leverantörs hastighetsbegränsningar och krediter intakta. Guardrails: PII Shield och innehållspolicyn körs före fakturering, så en blockerad begäran returnerar ett rent 400-svar och debiteras aldrig, och Agent Firewall bedömer verktygs- och MCP-anrop innan de exekveras.

Den ärlighetsnot som spelar roll för en prissida: vi dirigerar modellen, vi sätter inte dess pris. Siffran $5 / $30 är OpenAIs pris som förs vidare, och när OpenAI ändrar det följer listningen med — vilket är precis därför den här sidan är datumstämplad. Om du anropar OpenAI direkt får du samma pris; OrcaRouter finns för rutten med en enda nyckel och noll påslag om du vill ha en endpoint för hela modellinjen.

Källor och datum

Alla priser ovan verifierades 2026-08-18. Siffrorna för GPT-5.6 Sol är hämtade från OpenAIs publicerade API-priser och korskontrollerade mot OrcaRouters modellsida för GPT-5.6 Sol (kontrollerad samma dag) och våra egna publicerade GPT-5.6-prissidor. Priserna för batch, snabbläge, cache-skrivning och lång kontext är tillkännagivna av OpenAI. Siffrorna för Claude, Grok och DeepSeek är de aktuella OrcaRouter-kataloglistningarna, med DeepSeek V4 Pro visad till sitt lågtrafikpris. OpenAI har inte ändrat Sols listpris sedan lanseringen den 9 juli 2026 – sänkningen den 30 juli lämnade flaggskeppsmodellen orörd – men priserna rör sig; tänk på kontrolldatumet för eventuella tidigare "GPT-5.6 Sol pricing"-sidor du hittar. Siffrorna här är aktuella per idag.

Varje pris ovan är den aktuella kursen på GPT-5.6 Sol on OrcaRouter — kontrollerat 2026-08-18 utan påslag, redo för din egen nyckel.

Jämförda i den här artikeln3

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen

© 2026 OrcaRouter

För leverantörer

Driver du en inferensplattform? Få dina modeller på OrcaRouter.

providers@orcarouter.ai

Gå med i vår community

Discordsupport@orcarouter.aiXGitHubYouTube