
OpenAI obniża ceny API GPT-5.6: Co się zmieniło, dlaczego i jak to uzyskać
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 984 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 195 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
30 lipca 2026 r. OpenAI obniżyło ceny API swoich dwóch tańszych modeli GPT-5.6 — znacznie redukując najtańszy poziom i lekko obniżając średni. Trzy tygodnie później przyszła kolej na flagowy model: 21 sierpnia 2026 r. OpenAI ogłosiło, że ceny API modelu GPT-5.6 Sol spadną o ponad 20% na najbliższe trzy miesiące, w miarę jak firma pracuje nad zwiększeniem wydajności modelu. W tym artykule wyjaśniamy dokładnie, co zmieniło się w obu turach, jaka inżynieria za nimi stoi, jak nowe ceny wypadają w porównaniu z konkurencją, na jakie ukryte koszty trzeba uważać, jak jeszcze bardziej obniżyć rachunek — oraz jak niższe ceny są już dostępne na OrcaRouter z marżą 0%.
Każda liczba poniżej jest oznaczona źródłem. Ceny podawane są za milion tokenów (wejście / wyjście). Stawki Luna i Terra odzwierciedlają cennik OpenAI z 30 lipca 2026 r., o którym informowały m.in. Unite.AI; obniżka Sol odzwierciedla ogłoszenie OpenAI z 21 sierpnia 2026 r., z cenami za token podanymi przez takie serwisy jak Runtimewire i Reuters. Strony modeli pass-through OrcaRouter pokazują te same liczby; dane konkurencji są przypisane do źródeł. Ceny się zmieniają — zweryfikuj przed rozpoczęciem budowy.
TL;DR. OpenAI obniżyło ceny GPT-5.6 Luna do 0,20 USD / 1,20 USD (z 1 USD / 6 USD, czyli o ~80%) oraz GPT-5.6 Terra do 2 USD / 12 USD (z 2,50 USD / 15 USD, czyli o ~20%) 30 lipca. 21 sierpnia rozszerzyło zniżkę na flagowy model: ceny API GPT-5.6 Sol spadają o ponad 20% przez najbliższe trzy miesiące — do 4 USD / 20 USD za milion tokenów z 5 USD / 30 USD, według OpenAI — podczas gdy tokeny Codex i kredyty ChatGPT Work oparte na tokenach pozwalają kupić więcej, a wykorzystanie subskrypcji pozostaje bez zmian. Dwie poprawki wydajności sfinansowały lipcową obniżkę: przepisane jądra GPU (ok. 20% niższy koszt serwowania) oraz przeprojektowany model typu speculative decoding (ponad 15% szybsze generowanie tokenów). Jeśli korzystasz z neutralnego wobec dostawców punktu końcowego z zerową marżą, takiego jak OrcaRouter, nowe stawki są już aktywne — ta sama cena, jedno API zgodne z OpenAI, a obok niego każdy konkurencyjny model do porównania i przełączania się między nimi.
Najważniejsze wnioski
• GPT-5.6 Luna: teraz $0.20 / $1.20 za 1 mln tokenów, spadek z $1 / $6 — czyli około 80% obniżki.
• GPT-5.6 Terra: teraz $2 / $12 zamiast $2.50 / $15 — około 20% taniej.
• GPT-5.6 Sol (flagowy): teraz 4 $ / 20 $ przez następne trzy miesiące, zamiast 5 $ / 30 $ — obniżka o ponad 20% ogłoszona 21 sierpnia 2026.
• Codex i ChatGPT Work — kredyty oparte na tokenach dają więcej: cena wejścia Sol spada do 100 kredytów, a wyjścia do 500 kredytów za 1M tokenów (z 125 / 750).
Subskrypcje bez zmian: wykorzystanie wliczone w plany Plus, Pro i Business, limity pięciu godzin tygodniowo oraz dotychczasowe stawki kredytów pozostają bez zmian.
• Dlaczego: OpenAI przedstawiło obie rundy jako dywidendy wydajności — przepisane produkcyjne jądra GPU (~20% niższy koszt serwowania) plus przeprojektowanie modelu szkicowego z dekodowaniem spekulatywnym (15%+ wydajności generowania tokenów), zgodnie z wpisem technicznym OpenAI z 29 lipca.
• Jak to uzyskać: obniżki są już uwzględnione na OrcaRouter (0% marży) — Luna za $0.20 / $1.20, Sol za $4 / $20 — przez jeden punkt końcowy zgodny z OpenAI.
Co dokładnie się zmieniło?
Rodzina OpenAI GPT-5.6 działa jak drabina poziomów: Luna (szybka, najtańsza), Terra (średnia) i Sol (flagowa). Cięcie z 30 lipca dotknęło dwóch tańszych poziomów. Według opublikowanego cennika GPT-5.6 Luna spadła z 1 USD / 6 USD do 0,20 USD / 1,20 USD za milion tokenów wejściowych/wyjściowych — czyli o około 80% zarówno w przypadku wejścia, jak i wyjścia — a GPT-5.6 Terra spadła z 2,50 USD / 15 USD do 2 USD / 12 USD, czyli o około 20%. GPT-5.6 Sol, flagowy model zbudowany do najtrudniejszych zadań związanych z rozumowaniem i kodowaniem agentowym, nie został wtedy dotknięty — ale 21 sierpnia 2026 roku OpenAI ogłosiło tymczasową obniżkę także dla niego: ceny API spadają o ponad 20% na najbliższe trzy miesiące, do 4 USD za milion tokenów wejściowych i 20 USD za milion tokenów wyjściowych, a tokeny wejściowe z cache kosztują 0,40 USD zamiast 0,50 USD. W tym samym ogłoszeniu podano, że kupowane kredyty wystarczą na więcej w Codex w planach opartych na tokenach, a użycie wliczone w subskrypcję pozostaje bez zmian.
Stawka bazowa za token to nie cała historia. Cennik GPT-5.6 obejmuje również progi długości wejścia (bardzo długie konteksty przechodzą na wyższą stawkę), zniżkę za cachowanie promptów (odczyt z pamięci podręcznej jest znacznie tańszy niż świeże wejście) oraz opcję wsadową (zadania asynchroniczne ze zniżką). Wszystkie trzy przekładają się na obniżkę, więc efektywna cena dla obciążenia opartego na cache lub wsadach może być jeszcze niższa. Uważaj na próg długiego kontekstu w drugą stronę: podawanie ogromnych promptów może przenieść cię na wyższy próg.

Dwie optymalizacje stojące za cięciem.
To nie był gest w stylu loss-leadera — OpenAI przedstawiło to jako dywidendę z efektywności. W poście technicznym z 29 lipca 2026 roku członkowie zespołu technicznego OpenAI opisali optymalizacje w zakresie inferencji oraz środowiska agentowego (agent harness) stojącego za Codex i ChatGPT Work. Wyróżniają się dwie z nich. Po pierwsze, przepisanie jąder GPU w całej infrastrukturze produkcyjnej — z wykorzystaniem Sol, działającego wewnątrz Codex, do przepisania własnych jąder firmy — co według OpenAI obniżyło kompleksowe koszty serwowania o około 20%. Po drugie, przeprojektowany model wstępny do dekodowania spekulatywnego, który według doniesień poprawił wydajność generowania tokenów o ponad 15%. Niższy koszt serwowania, przeniesiony na klientów jako niższe ceny w planach o wysokim wolumenie, to sedno tej historii — i przedsmak pętli sprzężenia zwrotnego, za którą goni cała branża: wykorzystywanie modeli granicznych do optymalizacji tej samej infrastruktury, która je obsługuje.
Ogłoszona 21 sierpnia obniżka Sol ma takie samo uzasadnienie. Według OpenAI redukcja — ponad 20% przez najbliższe trzy miesiące — wynika z tego, że firma zwiększa wydajność działania modelu, i jest wyraźnie tymczasowa, a nie trwałą zmianą ceny.
Jak wypadają nowe ceny
Obniżka cen jest wymierzona bezpośrednio w konkurencję. Według doniesień Unite.AI, nowa cena Luny wynosząca 0,20 USD / 1,20 USD jest niższa od ceny Haiku 4.5 firmy Anthropic o około 5 razy na wejściu i około 4 razy na wyjściu, a nowa cena Terry wynosząca 2 USD / 12 USD jest niższa od standardowej ceny Claude Sonnet 5 (podawanej jako 3 USD / 15 USD, obowiązującej po 31 sierpnia 2026 r.). Na tle modeli o otwartych wagach Luna znajduje się teraz blisko dolnego progu taniej inferencji wyznaczonego przez linię V4 DeepSeek oraz GLM-5.2 od Zhipu (mniej więcej 1,20 USD / 4,10 USD), a poziomy Qwen od Alibaba i Gemini Flash od Google są w podobnym sąsiedztwie. Tymczasowa obniżka Sol do 4 USD / 20 USD utrzymuje model flagowy wyraźnie powyżej jego własnych poziomów wolumenowych, ale zmniejsza premię — a obniżka o jedną trzecią cen tokenów wyjściowych jest najistotniejsza dla obciążeń agentowych, w których dominuje generowanie danych wyjściowych. Doniesienia na temat tego posunięcia wskazują, że ma ono miejsce, gdy OpenAI mierzy się z rosnącą konkurencją ze strony Anthropic i chińskich modeli AI.
Inferencja staje się coraz tańsza.
Patrząc z szerszej perspektywy, ta obniżka wpisuje się w wieloletni trend: koszt danego poziomu możliwości gwałtownie spadał z pokolenia na pokolenie, w miarę jak laboratoria wyciskają coraz większą przepustowość z tego samego sprzętu. Własne starsze pakiety OpenAI ilustrują tę tendencję spadkową w czasie, a każdy przełom w wydajności — lepsze jądra, spekulatywne dekodowanie, tańsza attention — zwykle objawia się obniżką cen w ciągu kilku miesięcy. Dla kupujących praktyczny wniosek jest taki, by projektować architekturę dla świata, w którym wnioskowanie tanieje zgodnie z harmonogramem: nie wiązać się na stałe z cenami jednego modelu i utrzymywać niskie koszty przełączania.
Ukryty koszt, na który warto uważać: tokeny rozumowania
Modele GPT-5.6 to modele rozumujące, co wpływa na rzeczywiste koszty. Gdy rozumowanie jest włączone, model generuje wewnętrzne tokeny rozumowania, które są rozliczane jako wyjście — więc efektywny koszt wyjścia może być wyższy, niż sugerowałoby naiwne oszacowanie „słów w odpowiedzi”, zwłaszcza w przypadku trudnych promptów z wysokim poziomem rozumowania. Rozwiązaniem jest dostrojenie poziomu rozumowania do zadania (niski lub wyłączony w przypadku prostych wywołań), ograniczenie wyjścia tam, gdzie to możliwe, oraz mierzenie rzeczywistego użycia tokenów zamiast zakładania. Niższa stawka za token pomaga, ale kontrolowanie liczby generowanych tokenów pomaga bardziej.
Co to oznacza dla programistów
Jeśli używasz GPT-5.6 Luna lub Terra do pracy o dużej objętości — klasyfikacji, ekstrakcji, routingu, lekkich agentów, czatu — Twój rachunek właśnie spadł, w niektórych przypadkach o większość swojej wartości, bez konieczności zmiany kodu. To sprawia, że progi wolumenowe są jeszcze bardziej atrakcyjne dla obciążeń wrażliwych na koszty i zawęża lukę cenową w porównaniu z tanimi otwartymi modelami. Zmieniła się też matematyka flagowego modelu, przynajmniej na razie: Sol w cenie 4 $ / 20 $ przez następne trzy miesiące obniża koszt pracy wymagającej intensywnego rozumowania i pracy agentowej w najwyższym progu, a tokenowe kredyty Codex i ChatGPT Work wystarczają na dłużej. To nadal premium wybór do najtrudniejszych zadań — tylko tańszy niż kiedyś. Zwycięski wzorzec pozostaje ten sam: kieruj ruchem według trudności — tanie progi (lub tanie otwarte modele) dla łatwych 80%, flagowy model tylko tam, gdzie zwraca swój koszt.
Jak obniżyć swój rachunek jeszcze bardziej
Obniżka ceny to fundament do budowania, a nie meta. Największe dodatkowe dźwignie: cache'owanie promptów (użyj stabilnego promptu systemowego lub długiego kontekstu i zapłać znacznie niższą stawkę za wejście z cache'u); opcja wsadowa (uruchamiaj niepilne zadania asynchronicznie ze zniżką); routing warstw i modeli (wysyłaj każde żądanie do najtańszego modelu, który sobie z nim poradzi, w tym modele otwarte); oraz kontrola rozumowania (nie płać za głębokie rozumowanie przy trywialnych wywołaniach). Zastosowane łącznie, te dźwignie regularnie obniżają realne rachunki znacznie bardziej niż jakakolwiek pojedyncza zmiana stawek. Jako konkretny punkt odniesienia: przy 10 milionach tokenów miesięcznie z 70% udziałem wejścia, nowe stawki Luny wynoszą około $5 miesięcznie (około $4.37 z cache'owaniem); ta sama ilość na Sol to około $125 miesięcznie — najmocniejszy argument za routingiem według trudności.
Jak natychmiast skorzystać z niższych cen
Oto część, która spina to wszystko w całość. OrcaRouter pobiera 0% marży i przekazuje ceny dostawców bezpośrednio, więc obniżki OpenAI są już dostępne na OrcaRouter: na stronach modeli już teraz widnieją ceny — GPT-5.6 Luna $0.20 / $1.20, Terra $2 / $12, a GPT-5.6 Sol $4 / $20 — te same stawki, co na karcie cenowej samego OpenAI, osiągalne przez jeden kompatybilny z OpenAI endpoint wraz z 185+ innymi modelami. Obniżki dostajesz bez migracji, a ceny modeli Sol, Luna i Terra możesz porównywać z DeepSeek, GLM, Qwen, Gemini i Claude w jednym miejscu, a następnie kierować każde żądanie do najtańszego modelu dla danego zadania. Jest też darmowy plan i strona z ofertami, które pozwalają zaoszczędzić jeszcze więcej.

Obniżki są już dostępne na OrcaRouter: GPT-5.6 Luna za 0,20 $ / 1,20 $ oraz GPT-5.6 Sol za 4 $ / 20 $ za 1 mln tokenów, przekazywane z 0% marżą.
Wyznacz trasę według trudności, aby zaoszczędzić jeszcze więcej
Najtańszy rachunek to nie jeden model — to właściwy model dla każdego żądania. Ponieważ OrcaRouter udostępnia całą gamę modeli przez jeden endpoint, możesz wysyłać łatwe, wysokowolumenowe wywołania do Luny lub taniego otwartego modelu, a Sol lub inny flagowy model rezerwować dla trudnych — przełączając się zmianą konfiguracji zamiast ponownej integracji. Obniżka ceny Luny sprawia, że ta strategia trasowania według trudności jest jeszcze tańsza, a tymczasowy rabat na Sol obniża koszt trudnych wywołań — bez przebudowywania czegokolwiek.

Najczęściej zadawane pytania
O ile OpenAI obniżyło ceny GPT-5.6?
GPT-5.6 Luna spadła z 1 USD / 6 USD do 0,20 USD / 1,20 USD za milion tokenów (około 80%), a GPT-5.6 Terra z 2,50 USD / 15 USD do 2 USD / 12 USD (około 20%). 21 sierpnia 2026 r. OpenAI obniżyło również ceny GPT-5.6 Sol z 5 USD / 30 USD do 4 USD / 20 USD na kolejne trzy miesiące.
Kiedy weszła w życie obniżka cen?
Obniżki Luna i Terra weszły w życie 30 lipca 2026 roku i obowiązują w opublikowanym cenniku. OpenAI ogłosiło 21 sierpnia 2026 roku tymczasową obniżkę Sol na kolejne trzy miesiące.
Dlaczego OpenAI obniżyło ceny?
OpenAI przypisuje lipcową obniżkę optymalizacjom wnioskowania — przepisanym produkcyjnym jądrom GPU (około 20% niższy koszt serwowania) oraz przeprojektowanemu modelowi wstępnemu do dekodowania spekulatywnego (ponad 15% wydajności generowania tokenów) — według wpisu inżynieryjnego z 29 lipca 2026 r. W ten sam sposób uzasadniło obniżkę Sol, jako krok podjęty, gdy model staje się tańszy w uruchomieniu, na rynku o rosnącej konkurencji.
Czy flagowiec (Sol) staniał?
Tak — tymczasowo. Obniżka z 30 lipca pozostawiła GPT-5.6 Sol na poziomie 5 USD / 30 USD, ale 21 sierpnia 2026 r. OpenAI ogłosiło redukcję cen o ponad 20% na kolejne trzy miesiące, do 4 USD / 20 USD za milion tokenów. Kredyty oparte na tokenach w Codex i ChatGPT Work również pozwalają kupić więcej, podczas gdy użycie w ramach subskrypcji pozostaje bez zmian.
Jak nowe ceny wypadają w porównaniu z Anthropic i otwartymi modelami?
Według raportów Luna jest teraz tańsza od Haiku 4.5 firmy Anthropic o około 5x w przypadku wejścia / 4x w przypadku wyjścia, a Terra jest poniżej standardowej ceny Claude Sonnet 5 (3 $ / 15 $). Luna znajduje się również blisko niskiego progu cenowego otwartych modeli wyznaczonego przez DeepSeek i GLM-5.2.
Jaki jest haczyk z tokenami rozumowania?
GPT-5.6 to modele rozumujące; wewnętrzne tokeny rozumowania są rozliczane jako wyjście, więc efektywny koszt wyjścia może przekroczyć naiwne szacunki. Dostosuj wysiłek rozumowania i ogranicz wyjście, aby to kontrolować.
Jak uzyskać nowe niższe ceny?
Już są dostępne na API OpenAI i, przy 0% marży, na OrcaRouter — gdzie GPT-5.6 Luna pokazuje $0.20 / $1.20, a GPT-5.6 Sol $4 / $20 — przez jeden endpoint zgodny z OpenAI, bez potrzeby zmian w kodzie.
Konkluzja
Obniżka z 30 lipca sprawiła, że GPT-5.6 Luna i Terra stały się znacznie tańsze w przypadku pracy o dużej skali, a ogłoszenie z 21 sierpnia rozszerza tę historię na flagowy model: GPT-5.6 Sol spada do 4 $ / 20 $ na kolejne trzy miesiące, podczas gdy kredyty tokenów Codex dają więcej, a korzystanie z subskrypcji pozostaje bez zmian. Obie rundy to dywidendy efektywności — przepisanie jądra i zyski z predykcyjnego dekodowania z jednej strony, tańsze serwowanie z drugiej — oraz wyraźna odpowiedź na prawdziwą wojnę cenową. Kieruj ruch według trudności, opieraj się na cache'u i przetwarzaniu wsadowym oraz kontroluj tokeny rozumowania, aby zaoszczędzić najwięcej. A ponieważ OrcaRouter przekazuje ceny dostawców z 0% marżą, niższe stawki są już tam aktywne — Luna po 0,20 $ / 1,20 $, Sol po 4 $ / 20 $ — ta sama cena, jeden kompatybilny z OpenAI endpoint, całe pole modeli w jednym miejscu. Skorzystaj z obniżek bez zmiany ani jednej linijki kodu i pozwól, aby każde żądanie wybierało najtańszy model, który poradzi sobie z zadaniem.
