
Cennik GPT-5.6 Sol API: 5 USD / 30 USD za 1 milion tokenów, cache za 0,50 USD i ile to naprawdę kosztuje
- DeepSeekNOWOŚĆDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 za 1 mln tokenów
- z-aiNOWOŚĆZ.ai: GLM 5.32026-08-1860Inteligencja75Kod
- obsidianNOWOŚĆQwen3.8 27B2026-08-1552Inteligencja68Kod
- qwenNOWOŚĆQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNOWOŚĆDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencja69Kod
- grokNOWOŚĆSpaceXAI: Grok 4.62026-08-1261Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0557Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencja69Kod
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencja49Kod
- metaMeta: Muse Spark 1.12026-07-1653Inteligencja71Kod
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencja76Kod
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencja71Kod
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencja77Kod
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencja77Kod
GPT-5.6 Sol kosztuje $5.00 za milion tokenów wejściowych i $30.00 za milion tokenów wyjściowych w API GPT-5.6 Sol — ta sama stawka, którą najwyższy poziom ma w katalogu OrcaRouter, sprawdzona 2026-08-18, bez żadnej marży. Jest to najdroższy poziom w rodzinie GPT-5.6 i jedyny, którego cena katalogowa nie zmieniła się w obniżce z 30 lipca, więc karta stawek na aktywnej stronie modelu GPT-5.6 Sol jest tą, na której należy opierać budżet. Dźwignie liczą się bardziej niż nagłówek: ponownie użyte tokeny wejściowe kosztują $0.50 za milion dzięki buforowaniu promptów, API wsadowe spada do $2.50 / $15.00, a tryb szybki oznacza 2-krotną dopłatę w zamian za nawet 2.5-krotną prędkość. Ta strona jest punktem odniesienia dla cen Sol — dokładna karta stawek, ile naprawdę kosztuje żądanie, jak flagowy model wypada na tle innych, kiedy jest złym wyborem i jak wywołać go przez jeden endpoint zgodny z OpenAI, używając własnego klucza.
Ceny są podawane za milion tokenów (wejście / wyjście), według stanu na 2026-08-18. Kwoty w dolarach pochodzą z opublikowanych stawek API OpenAI i zostały zweryfikowane na stronie modelu OrcaRouter dla GPT-5.6 Sol; stawki za pamięć podręczną, przetwarzanie wsadowe, tryb szybki i długi kontekst są ogłoszone przez OpenAI. Ceny się zmieniają — sprawdź przed zbudowaniem.
Dokładna cena, zweryfikowana dzisiaj
Oto pełna karta opłat dla GPT-5.6 Sol, zweryfikowana 2026-08-18:

• Wejście — 5,00 USD za 1 mln tokenów przy braku trafienia w pamięci podręcznej.
• Wyjście — 30,00 $ za 1M tokenów.
• Odczyt z pamięci podręcznej promptu — 0,50 USD za 1M tokenów, 90% zniżki na każde ponownie wysłane wejście.
• Zapis do pamięci podręcznej promptu — 6,25 USD za 1 mln tokenów.
• Poziom długiego kontekstu — wejścia przekraczające mniej więcej 272 tys. tokenów kosztują 10,00 USD za wejście / 45,00 USD za wyjście (2x wejście, 1,5x wyjście).
• Batch API — $2.50 za wejście / $15.00 za wyjście, stała 50% zniżka, asynchroniczny, zwykle gotowy w ciągu około 24 godzin.
• Tryb szybki — $10.00 na wejściu / $60.00 na wyjściu, 2x wyższa cena za prędkość wyjścia do około 2,5 razy większą, bez zmiany inteligencji.
• Okno kontekstu — ~1,05 mln tokenów, do 128 tys. na wyjściu.
OrcaRouter przekazuje stawkę dostawcy bez narzutów, więc kwota widniejąca w katalogu to kwota, którą płacisz. Na stronie modelu na żywo karta pokazuje 5,00 USD / 30,00 USD za 1M, odczyt z pamięci podręcznej 0,500 USD, z plakietkami Vision, Tools, JSON i Reasoning. Cena Sola 5 / 30 USD to również cena sprzed cięcia: obniżka OpenAI z 30 lipca dotyczy GPT-5.6 Luna (obecnie 0,20 USD / 1,20 USD) i GPT-5.6 Terra (obecnie 2 USD / 12 USD), podczas gdy flagowy model utrzymał cenę.
Dźwignie, które zmieniają efektywną cenę
Stawka bazowa to tylko punkt wyjścia. Cztery modyfikatory zmieniają to, ile faktycznie kosztuje Cię Sol:
• Prompt caching — ponowne użycie kontekstu kosztuje 0,50 USD za milion zamiast 5 USD za nowy, a zapisy do pamięci podręcznej kosztują 6,25 USD za milion. W przypadku każdego agenta lub czatu, który przy każdej turze wysyła ponownie duży prefiks, buforowanie jest największą pojedynczą dźwignią wpływającą na rachunek. OpenAI wiąże pamięć podręczną z projektem i kluczem API, więc pozostanie przy jednym kluczu (jednym kanale) to to, co sprawia, że trafienia się udają.
• Poziom długiego kontekstu — żądanie, którego wejście przekracza około 272K tokenów, przechodzi z podstawowej stawki na $10 / $45. Kilka ogromnych promptów może niepostrzeżenie podnieść średnią cenę, więc grupuj lub skracaj, gdy naprawdę nie potrzebujesz głębokiego kontekstu.
• Batch — API Batch firmy OpenAI uruchamia zadania asynchronicznie, z czasem realizacji około 24 godzin, przy dokładnie połowie ceny: $2.50 / $15.00, z wejściem z cache po $0.25 i zapisami do cache po $3.13. Można go łączyć z buforowaniem promptów i sprawdza się w ewaluacjach, klasyfikacji masowej i generowaniu offline, gdzie opóźnienie nie ma znaczenia.
• Tryb szybki — $10 / $60 za do ~2.5x przepustowości wyjściowej, przydatny w zadaniach krytycznych pod względem opóźnień, gdy użytkownik czeka, takich jak asysta przy kodowaniu na żywo. Rozliczany jest za token w cenie 2x standardowej stawki, nie wlicza się do zakupionych pakietów TPM w ramach Scale Tier i może wrócić do standardowego przetwarzania, jeśli przekroczysz współdzielony limit szybkości.
Ile właściwie kosztuje zapytanie
Ceny za token są abstrakcyjne, więc oto przykłady wyliczone według dzisiejszych stawek:
• Pojedyncza rozmowa czatu, 50K wejścia + 20K wyjścia — $0,25 + $0,60 = $0,85.
• 1M wejść + 1M wyjść — $5 + $30 = $35.
• Tura agentowa, 200K kontekstu z pamięci podręcznej + 20K nowych danych wejściowych + 30K danych wyjściowych — $0.10 + $0.10 + $0.90 = $1.10. Ta sama tura z zimną pamięcią podręczną — 220K nowych danych wejściowych za $1.10 — daje łącznie $2.00. Buforowanie zmniejsza to prawie o połowę.
• Miesiąc z 10M tokenów przy podziale 70% wejście / 30% wyjście, przy 80% wejścia z cache: 1.4M świeżych wejść ($7.00) + 5.6M z cache ($2.80) + 3M wyjść ($90) ≈ $100. Bez cache, ten sam miesiąc kosztuje $125 — a ten sam miesiąc na GPT-5.6 Terra to około $50, a na GPT-5.6 Luna około $5. Ta 20-krotna różnica między Sol i Luna sprawia, że dopasowanie poziomu jest ważniejsze niż jakakolwiek pojedyncza stawka.
Dwa zastrzeżenia podnoszą efektywną stawkę. Sol to model rozumujący — wewnętrzne tokeny rozumowania są rozliczane jako wyjście po 30 dolarów za milion. Trudny prompt przy wysokim ustawieniu wysiłku rozumowania może przeznaczyć dużą część budżetu wyjściowego na myślenie, więc efektywny koszt wyjściowy przy trudnych zadaniach jest znacznie wyższy niż naiwne szacunki. A tokenizator OpenAI jest bardziej rozwlekły niż w poprzedniej generacji w przypadku niektórych danych wejściowych, więc ten sam tekst może kosztować więcej tokenów niż kosztowałby w GPT-5.5. Dostosuj wysiłek rozumowania do zadania, ograniczaj wynik, gdzie się da, i mierz rzeczywiste zużycie, zanim oszacujesz rachunek.
Jak ceny Sol wypadają na tle konkurencji

Odczytane względem opublikowanych cen katalogowych na dzień 2026-08-18:
• GPT-5.6 Terra — $2 / $12, środkowy poziom po obniżce. Sol kosztuje 2,5x więcej na wejściu i wyjściu; Terra jest domyślna, gdy nie potrzebujesz flagowego rozumowania.
• GPT-5.6 Luna — $0.20 / $1.20, poziom wolumenu po obniżce. 25x luka w inputach do Sol; Luna jest wyceniona dla łatwej większości ruchu.
• Claude Opus 5 — 5 USD / 25 USD. To samo wejście, o 20% tańsze wyjście na papierze. W praktyce porównanie odwraca się dla niektórych obciążeń: na tym blogu zmierzono wcześniej, że Sol zużywa około 34,5% mniej tokenów niż model Anthropica na tej samej angielskiej/mieszanej próbce, a opublikowana analiza ekonomiki tokenów (TheBlockBeats) oszacowała, że całkowity rachunek za Sol może być o około 21% niższy niż za Claude Opus 5 przy równoważnej pracy, mimo wyższej stawki za wyjście. Zmierz swój własny tokenizer, a nie cenę z metki.
• Claude Fable 5 — $10 / $50. Sol jest o połowę tańszy na wejściu i o 40% tańszy na wyjściu niż najwyższa półka Anthropica.
• Claude Opus 4.8 — $5 / $25. Ten sam input co Sol, tańszy output — flagowy model poprzedniej generacji Anthropica.
• Grok 4.6 — $2 / $6. Najbardziej uderzająca liczba w zestawieniu: dorównał GPT-5.6 Sol w indeksie Artificial Analysis (oba po 61) przy 2,5x tańszym wejściu i 5x tańszym wyjściu.
• DeepSeek V4 Pro — $0.44 / $0.88 poza godzinami szczytu (okna szczytowe podwajają cenę). Zupełnie inny wszechświat cenowy, dla taniej ścieżki open-weights.
Uczciwe ujęcie: Sol to flagowy model premium o szybkości generowania premium — najwyższej szybkości generowania wśród zamkniętych flagowców poniżej Claude Fable 5. Wygrywa pod względem efektywnego kosztu na jednostkę ciężkiej pracy (jego tokenizator, rozumowanie, długi kontekst), a nie absolutnej szybkości. Jeśli twój ruch to krótkie prompty i proste zadania, tańszą opcją jest $2 Terra, $0.20 Luna lub $2 / $6 Grok 4.6 — a w indeksie Grok 4.6 nie ustępuje niczym na papierze.
Kiedy Sol jest złym wyborem
Cztery przypadki, w których ta cena to nie ta, której chcesz:
Krótkie, proste monity. Poniżej mniej więcej 20 tys. tokenów bez głębokiego rozumowania flagowy model premium to strata. GPT-5.6 Terra za $2 / $12 lub GPT-5.6 Luna za $0.20 / $1.20 obsługuje segment wolumenowy za ułamek kosztów, a model klasy Grok 4.6 lub DeepSeek kosztuje jeszcze mniej.
Duży wolumen wymagający intensywnego rozumowania. Ponieważ myślenie jest rozliczane jako dane wyjściowe, trudny prompt przy wysokim nakładzie pracy może kosztować znacznie więcej, niż wynikałoby z nominalnej liczby tokenów wyjściowych. Jeśli Twoje zadania to wiele trudnych wywołań, zmierz rzeczywistą liczbę tokenów wyjściowych przed podjęciem decyzji — efektywna stawka może Cię zaskoczyć.
Cena za token jako jedyny cel. Grok 4.6 zrównał się z Sol w indeksie przy $2 / $6, a DeepSeek V4 Pro kosztuje $0.44 / $0.88 poza szczytem. Jeśli wynik na benchmarku granicznym nie jest twardym wymaganiem, te modele oferują znacznie niższe stawki za token w tej samej klasie zadań.
Rygorystyczne limity opóźnień.Sol to duży model rozumujący, więc czas do pierwszego tokena jest znacznie dłuższy niż w modelu klasy Flash. W przypadku czatu w czasie rzeczywistym, gdzie liczy się TTFT poniżej sekundy, tryb szybki za 10 / 60 USD zapewnia większą przepustowość, a nie niższe opóźnienie pierwszego tokena — a mniejszy model nadal jest tańszym rozwiązaniem.
Jak to wywołać w OrcaRouter

GPT-5.6 Sol jest hostowany na OrcaRouter jako ID modelu openai/gpt-5.6-sol, udostępniany przez punkt końcowy zgodny z OpenAI pod adresem api.orcarouter.ai/v1 po cenie dostawcy z zerową marżą. Jeśli masz już klienta OpenAI, migracja to zmiana base-URL i ID modelu — nic więcej. Ten sam klucz i punkt końcowy obsługują 200+ modeli, więc Sol znajduje się obok GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 oraz modeli o otwartych wagach, z którymi możesz chcieć go porównać, i możesz kierować zapytania według trudności zamiast integrować każdy z osobna.
Dwie cechy OrcaRouter, które warto wymienić na stronie z cennikiem. BYOK: dostarczasz własny klucz OpenAI, a OpenAI rozlicza cię bezpośrednio według własnych stawek — OrcaRouter dodaje $0 za token i zachowuje limity szybkości oraz kredyty twojego dostawcy w nienaruszonym stanie. Guardrails: PII Shield i polityka treści uruchamiają się przed rozliczeniem, więc zablokowane żądanie zwraca czysty błąd 400 i nie jest obciążane, a Agent Firewall ocenia wywołania narzędzi i MCP przed ich wykonaniem.
Uczciwa uwaga, która ma znaczenie na stronie cenowej: kierujemy modelem, nie ustalamy jego ceny. Kwota 5 USD / 30 USD to stawka OpenAI przekazywana dalej, a gdy OpenAI ją zmienia, lista podąża za nią — właśnie dlatego ta strona jest opatrzona datą. Jeśli bezpośrednio wywołasz OpenAI, otrzymasz tę samą stawkę; OrcaRouter istnieje dla ścieżki z jednym kluczem i zerową marżą, jeśli chcesz mieć jeden punkt końcowy dla całej linii modeli.
Źródła i data
Wszystkie powyższe ceny zostały zweryfikowane w dniu 2026-08-18. Dane dla GPT-5.6 Sol pochodzą z opublikowanych cen API OpenAI i zostały skrzyżowane z modelem OrcaRouter dla GPT-5.6 Sol (sprawdzonym tego samego dnia) oraz z naszymi opublikowanymi stronami cenowymi GPT-5.6. Stawki za tryb batch, tryb szybki, zapis do pamięci podręcznej i długi kontekst zostały ogłoszone przez OpenAI. Wartości dla Claude, Grok i DeepSeek pochodzą z bieżących wpisów w katalogu OrcaRouter, przy czym DeepSeek V4 Pro jest pokazany w stawce pozaszczytowej. OpenAI nie zmieniło ceny katalogowej Sol od czasu premiery 9 lipca 2026 r. – cięcie z 30 lipca nie objęło flagowca – ale ceny się zmieniają; traktuj każdą znalezioną wcześniejszą stronę „GPT-5.6 Sol pricing” z uwzględnieniem daty jej sprawdzenia. Podane tutaj liczby są aktualne na dziś.
Każda cena powyżej to aktualny kurs na GPT-5.6 Sol on OrcaRouter — sprawdzony 2026-08-18 bez marży, gotowy na Twój własny klucz.
Porównane w tym artykule3
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
