Cennik GPT-5.6 po obniżce: Luna vs Terra vs Sol, i który poziom wybrać
Guides & Insights

Cennik GPT-5.6 po obniżce: Luna vs Terra vs Sol, i który poziom wybrać

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Po obniżce cen O​penAI z 30 lipca 2026 roku rodzina GP​T-5.​6 — GPT-5.6 Luna, GPT-5.6 Terra i GPT-5.6 Sol — nigdy nie była tańsza w użyciu na dużą skalę. Tydzień później, 6 sierpnia, O​penAI wprowadziło te same poziomy do samego ChatGPT: GPT-5.6 Luna staje się domyślnym modelem dla kont Free i Go z nieograniczonymi czatami tekstowymi, a GPT-5.6 Sol został zaktualizowany dla planów Plus i Pro. 19 sierpnia O​penAI i Replit ogłosiły, że nowy tryb Free Mode Replita dla subskrybentów Core i Pro działa na GPT-5.6 Luna — to jak dotąd największy zakład strony trzeciej na poziom wolumenowy. Pod koniec sierpnia O​penAI rozpoczęło wdrażanie rozwiązania awaryjnego dla intensywnie korzystających z planów konsumenckich użytkowników: puli „Luna Reserve”, która wybranym kontom ChatGPT Plus i Pro przyznaje ograniczone korzystanie z GPT-5.6 Luna w Codex i ChatGPT Work po wyczerpaniu zwykłych limitów. Ale te trzy poziomy mają bardzo różne ceny, a wybór właściwego (plus umiejętne korzystanie z cache, trybu wsadowego i routingu) to najważniejsza dźwignia wpływająca na rachunek za API. Ten przewodnik przedstawia pełne ceny po obniżce, przykładowe kalkulacje kosztów, porównanie każdego poziomu z konkurencją oraz sposób kierowania ruchu między nimi przez jeden endpoint.

Ceny podawane są za milion tokenów (wejście / wyjście) i odzwierciedlają opublikowaną kartę stawek po obniżce oraz strony modeli pass-through OrcaRouter; stawki warstwowe i cache pochodzą ze stron modeli OrcaRouter, a dane konkurencji są przypisane do źródeł. Szczegóły wdrożenia ChatGPT w tym materiale są takie, jak podało OpenAI 6 sierpnia 2026 r., a szczegóły Replit Free Mode są takie, jak podały OpenAI i Replit 19 sierpnia 2026 r. — dane dostawców, nie mierzone niezależnie. Szczegóły dotyczące Luna Reserve są takie, jak udokumentowało OpenAI w swoim centrum pomocy oraz jak podali pracownicy OpenAI i pierwsi użytkownicy pod koniec sierpnia 2026 r. — dane dostawcy i społeczności, niezweryfikowane niezależnie. Ceny się zmieniają — sprawdź przed rozpoczęciem tworzenia.

TL;DR

GPT-5.6 Luna ($0.20 / $1.20) to koń roboczy do dużych wolumenów; Terra ($2 / $12) to zrównoważony środek; Sol ($5 / $30) to model flagowy do najtrudniejszych zadań wymagających rozumowania i kodowania agentowego. Wszystkie trzy mają kontekst ~1,05 mln tokenów i maksymalne wyjście 128K. Cache'owanie promptów i opcja wsadowa (batch) dodatkowo obniżają koszty, a przy bardzo długich wejściach przechodzisz do wyższej taryfy. Po stronie konsumenckiej O​penAI ogłosiło 6 sierpnia, że GPT-5.6 Luna staje się domyślnym modelem dla kont ChatGPT Free i Go z nieograniczoną liczbą czatów tekstowych, a zaktualizowany GPT-5.6 Sol jest udostępniany dla subskrybentów Plus i Pro. 19 sierpnia Replit uruchomił Free Mode na GPT-5.6 Luna dla subskrybentów Core i Pro, kierując trudniejsze zadania do GPT-5.6 Sol w razie potrzeby. Pod koniec sierpnia O​penAI rozpoczęło również wdrażanie mechanizmu awaryjnego „Luna Reserve”, który daje wybranym kontom ChatGPT Plus i Pro ograniczone użycie GPT-5.6 Luna w Codex i ChatGPT Work po wyczerpaniu regularnych limitów — udokumentowany przez O​penAI, a o wdrożeniu na wybranych kontach informowali użytkownicy. Używaj Luny do łatwej większości, Terry, gdy potrzebujesz więcej, a Sola tylko tam, gdzie zwraca swój koszt — i kieruj zadania według trudności przez jeden endpoint zgodny z O​penAI, aby zminimalizować koszty.

Najważniejsze wnioski

• Luna: 0,20 USD / 1,20 USD za 1M tokenów — szybka, tania, do zastosowań o dużym wolumenie i niskich opóźnieniach.

• Terra: $2 / $12 — zrównoważona średnia półka do trudniejszych zadań, które nie wymagają flagowca.

• Sol: $5 / $30 — flagowy model do głębokiego rozumowania, programowania na dużą skalę i agentów o długim horyzoncie działania.

• Buforowanie i przetwarzanie wsadowe dodatkowo obniżają koszty; długie wejścia przenoszą Cię do droższego poziomu długiego kontekstu.

• ChatGPT (wg OpenAI, 6 sierpnia): Luna staje się domyślną opcją w wersjach free/Go z nieograniczonymi czatami tekstowymi; Sol otrzymuje aktualizację niezawodności dla Plus/Pro.

• Replit (ogłoszono 19 sierpnia): Free Mode dla Core/Pro działa na GPT-5.6 Luna — do 30x więcej użycia na Replit, z trudniejszymi zadaniami kierowanymi do GPT-5.6 Sol. Według deklaracji Replit, niezweryfikowane niezależnie.

• Luna Reserve (koniec sierpnia, udokumentowane przez O​penAI): ograniczony przydział zapasowy, który pozwala wybranym kontom ChatGPT Plus i Pro nadal korzystać z GPT-5.6 Luna w Codex i ChatGPT Work po wyczerpaniu zwykłych limitów — nie jest nieograniczony i nie jest dostępny w przestrzeniach roboczych Business ani Enterprise.

• Największa dźwignia oszczędności: kieruj zadania według trudności — nie płać stawek Sol za pracę, którą Luna może wykonać.

Nowa cena bazowa GP​T-5.​6

Oto podstawowe ceny po obniżce za milion tokenów wejściowych/wyjściowych: Luna $0,20 / $1,20 (spadek z $1 / $6), Terra $2 / $12 (spadek z $2,50 / $15) oraz Sol $5 / $30 (bez zmian). Dwie tańsze warstwy zostały obniżone 30 lipca 2026 r.; flagowa się utrzymała. Mówiąc wprost, niższe warstwy są teraz wycenione pod skalę, a flagowa pozostaje premium.

Cennik warstwowy, buforowany i wsadowy

Stawka bazowa to tylko punkt wyjścia. Cennik GP​T-5.​6 ma trzy modyfikatory, które w istotny sposób zmieniają Twój efektywny koszt:

• Poziomy długiego kontekstu. Ceny rosną dla bardzo długich wejść. Na stronach pass-through OrcaRouter, Luna kosztuje 0,20 $ / 1,20 $ do dużego poziomu kontekstu i 0,40 $ / 1,80 $ powyżej niego; Sol kosztuje 5 $ / 30 $ na podstawowym poziomie i 10 $ / 45 $ na najwyższym. Poziom jest wybierany na podstawie liczby tokenów wejściowych każdego żądania, więc kilka ogromnych promptów może po cichu podnieść średnią cenę.

• Buforowanie promptów. Ponownie wykorzystywany kontekst jest rozliczany po znacznie niższej stawce — odczyt z cache Luny to mniej więcej 0,02 USD za milion tokenów (wobec 0,20 USD za świeży kontekst), a zapis do cache to około 0,25 USD; odczyt z cache Sola to około 0,50 USD (wobec 5 USD za świeży kontekst). W przypadku agentów i czatu ze stabilnym promptem systemowym buforowanie jest często największą pojedynczą oszczędnością.

{{1}}Przetwarzanie wsadowe{{/1}}. {{2}}Zadania niepilne są uruchamiane asynchronicznie po niższej cenie{{/2}} — {{3}}idealne do klasyfikacji masowej, ewaluacji i generowania offline, gdzie opóźnienia nie mają znaczenia.{{/3}}

Przykładowe wyliczenia: ile to naprawdę kosztuje

Konkretne liczby sprawiają, że poziomy stają się namacalne. Weźmy 10 milionów tokenów miesięcznie przy podziale 70% na wejście / 30% na wyjście (typowa mieszanka czatu/agenta):

• Luna: około 5 dolarów miesięcznie (mniej więcej 4,37 dolara z buforowaniem promptów).

• Terra: około 50 dolarów miesięcznie.

• Sol: około 125 dolarów miesięcznie (mniej więcej 109 dolarów z buforowaniem).

To 25-krotna rozpiętość między Luna a Sol dla tego samego wolumenu — i właśnie dlatego przyporządkowanie każdego żądania do najtańszego wystarczającego poziomu ma większe znaczenie niż jakakolwiek pojedyncza stawka. (Wartości te odpowiadają kalkulatorowi kosztów na stronie OrcaRouter, który szacuje na podstawie ceny katalogowej; Twoje rzeczywiste liczby zależą od buforowania oraz proporcji danych wejściowych i wyjściowych.)

Do czego tak naprawdę służy każdy poziom

GPT-5.6 Luna — koń roboczy do dużych wolumenów

Luna to szybka i opłacalna warstwa, zoptymalizowana pod kątem obciążeń o dużej objętości i wrażliwych na opóźnienia: czat, klasyfikacja, ekstrakcja, routing oraz lekkie zadania agentowe, z czasem do pierwszego tokena na poziomie p50 wynoszącym około 1,65 sekundy. Po obniżce, w cenie 0,20 USD / 1,20 USD, jest wyceniany tak, aby bezpośrednio konkurować z tanimi otwartymi modelami — to domyślny wybór dla przeważającej większości prostych wywołań. Jest to również warstwa, ku której O​penAI kieruje konsumenckiego ChatGPT: zgodnie z ogłoszeniem z 6 sierpnia, GPT-5.6 Luna staje się domyślnym modelem dla kont Free i Go, z nielimitowanymi czatami tekstowymi i nowym przyciskiem Think, umożliwiającym głębsze rozumowanie przy trudniejszych pytaniach, który pojawi się w następnym tygodniu (limity plików, obrazów i głosu pozostają bez zmian). O​penAI twierdzi, że Luna popełnia o 62% mniej błędów faktycznych niż zastępowany model GPT-5.5 Instant — to dane podawane przez producenta, ale jasny sygnał, że to właśnie warstwa wolumenowa jest tam, gdzie firma kieruje większość swojego ruchu.

19 sierpnia 2026 r. Replit uczynił GPT-5.6 Luna silnikiem nowego trybu Free Mode — domyślnego doświadczenia dla subskrybentów Core i Pro. Codzienne czaty, burze mózgów i proste zadania programistyczne działają na Lunie bez zużywania płatnego budżetu na kredyty AI; Replit twierdzi, że użytkownicy Core mogą teraz tworzyć do 30 razy więcej miesięcznie, w tym do 30 godzin czatów. Gdy zadanie wymaga głębszego rozumowania, Agent Replita kieruje tę część zapytania do większego modelu — trybów Power/Max lub GPT-5.6 Sol — a następnie wraca do Luny. To informacje podawane przez Replita i O​penAI, niezależnie niezweryfikowane — ale kierunek jest zgodny z obniżką ceny: tańsza o 80% Luna sprawia, że poziom zawsze włączony i domyślnie dołączony jest opłacalny.

Pod koniec sierpnia 2026 r. pojawiła się kolejna konsumencka komplikacja: Luna Reserve. Jak dokumentuje O​penAI w swoim centrum pomocy, wybrane konta ChatGPT Plus i Pro mogą otrzymać ograniczoną pulę korzystania z GPT-5.6 Luna w Codex i ChatGPT Work jako rozwiązanie zapasowe, gdy ich zwykły limit użycia zostanie wyczerpany — po osiągnięciu limitu pojawia się powiadomienie lub wskaźnik księżyca, a Ty możesz nadal pracować na Luna, dopóki rezerwa wystarczy. Nie jest to nieograniczone przedłużenie: rezerwa jest oddzielona od zwykłego limitu i sama też jest ograniczona, zawsze obsługuje tylko GPT-5.6 Luna (nigdy Terra ani Sol), nie jest dostępna w przestrzeniach roboczych Business ani Enterprise, a osiągnięcie zwykłego limitu nie gwarantuje dostępu. Pracownicy O​penAI potwierdzili istnienie rezerwy 27 sierpnia, a wczesne raporty użytkowników opisują jej wdrażanie na wybranych kontach — informacje od dostawcy i społeczności, niezweryfikowane niezależnie. Niektóre wczesne raporty społecznościowe zauważają również, że rezerwa korzysta z okrojonej wersji przeglądarkowej GPT-5.6 Luna, więc zadania polegające na inspekcji stron na żywo mogą nie działać w czasie korzystania z rezerwy.

GPT-5.6 Terra — zrównoważony środek

Terra plasuje się między modelem volume a flagowcem: bardziej wydajna niż Luna w trudniejszych zadaniach wymagających rozumowania i kodowania, ale znacznie tańsza niż Sol. Przy cenie 2 USD / 12 USD to rozsądny wybór domyślny, gdy Luna nie wystarcza, ale nie potrzebujesz flagowca — ekstrakcja o średnim stopniu złożoności, tworzenie szkiców i zadania wieloetapowe, które wciąż działają na dużą skalę.

GPT-5.6 Sol — flagowy model

Sol został zbudowany do najtrudniejszych zadań: głębokiego wieloetapowego rozumowania, inżynierii oprogramowania na dużą skalę i długoterminowych procesów agencyjnych, zachowując spójność w kontekście ~1,05 mln tokenów i do 128 tys. tokenów wyjściowych. Przy cenie $5 / $30 (bazowej) to opcja premium — zarezerwuj ją dla zadań, które naprawdę tego wymagają, takich jak złożone kodowanie wieloplikowe czy długie przebiegi agentów. 6 sierpnia O​penAI zaktualizowało także GPT-5.6 Sol w ChatGPT dla użytkowników Plus i Pro: firma twierdzi, że wersja czatowa jest bardziej niezawodna pod względem faktów — o 68% mniej błędów merytorycznych, według O​penAI — i udziela bardziej skoncentrowanych odpowiedzi, z nowym suwakiem do kontrolowania, ile wysiłku rozumowania zastosuje. Aktualizacja dotyczy wyłącznie czatu (Sol w Work i Codex jest bez zmian), a warstwa API pozostaje w cenie $5 / $30.

Zastrzeżenie dotyczące tokenów rozumowania.

GPT-5.6 to modele rozumujące, więc efektywny koszt wyjściowy może przekroczyć naiwne szacunki: gdy rozumowanie jest włączone, wewnętrzne tokeny rozumowania są rozliczane jako wyjście. Przy trudnych promptach i wysokim wysiłku rozumowania może to zdominować Twój rachunek. Dostosuj wysiłek rozumowania do zadania (niski lub wyłączony dla prostych wywołań), ogranicz tokeny wyjściowe, gdzie to możliwe, i mierz rzeczywiste zużycie. Niższe stawki za token pomagają; generowanie mniejszej liczby tokenów pomaga bardziej.

Jak każdy poziom wypada na tle konkurencji

Obniżka zmieniła pozycję GP​T-5.​6 na tle konkurencji. Według doniesień, Luna z cenami $0,20 / $1,20 jest teraz o około 5x tańsza na wejściu i 4x na wyjściu od Claude Haiku 4.5, a Terra za $2 / $12 jest niższa od standardowych cen Claude Sonnet 5 (podawanych jako $3 / $15). Na tle modeli open weights Luna znajduje się blisko dolnej granicy wyznaczonej przez linię V4 firmy Deep​Seek oraz GLM-5.2 firmy Zhi​pu (około $1,20 / $4,10), a w pobliżu są poziomy Qw​en i Gem​ini Flash. Wniosek: w przypadku zadań wrażliwych na koszty Luna jest teraz konkurencyjna wobec najtańszych wydajnych modeli, a nie ich droższą alternatywą — podczas gdy Sol pozostaje prawdziwym poziomem premium dla możliwości, których nie da się uzyskać tanio.

Prawdziwa dźwignia oszczędności: kieruj według trudności

Najtańszy rachunek to nie pojedynczy poziom — to dopasowanie każdego żądania do najtańszego modelu, który sobie z nim poradzi. W praktyce: łatwe, wysokowolumenowe zapytania kieruj do Luna (lub taniego otwartego modelu), w przypadku trudniejszych zadań przechodź na Terra, a Sol stosuj tylko dla rzeczywiście trudnej mniejszości. W połączeniu z buforowaniem i przetwarzaniem wsadowym takie podejście rutynowo obniża koszty znacznie bardziej niż jakakolwiek pojedyncza zmiana cen. Haczyk tkwi w warstwie operacyjnej: nie chcesz integrować osobno trzech poziomów O​penAI oraz alternatyw opartych na otwartych modelach.

Uzyskaj dostęp do wszystkich trzech (i tańszych konkurentów) przez jeden punkt końcowy.

W tym miejscu pomaga router neutralny względem dostawcy. OrcaRouter udostępnia GPT-5.6 Luna, Terra i Sol — po tych samych cenach po obniżce, z 0% marży — przez jeden endpoint kompatybilny z O​penAI, obok tańszych otwartych modeli, takich jak DeepSeek V4 Pro, GLM-5.2 i Qw​en. Przełączanie poziomów (lub testy A/B Luny z otwartym modelem) to zmiana konfiguracji, a nie ponowna integracja, a każde żądanie można kierować do najtańszej opcji. Luna Reserve to konsumencka wersja tego samego pomysłu — wbudowany mechanizm awaryjny, który utrzymuje wybranych użytkowników na GPT-5.6 Luna po wyczerpaniu ich regularnego limitu — a odpowiednikiem po stronie API jest automatyczne przełączanie awaryjne, które OrcaRouter obsługuje, gdy dostawca ogranicza liczbę żądań lub zwraca błąd.

Karta stawek Luna po obniżce jest widoczna na stronie modelu OrcaRouter w cenie katalogowej — 0,20 USD / 1,20 USD za milion tokenów — ponieważ router przekazuje ceny dostawców z zerową marżą, a na stronie znajduje się kalkulator kosztów typowego miesięcznego rachunku. Dostępny jest również bezpłatny poziom oraz strona Offers umożliwiająca dodatkowe oszczędności.

Najczęściej zadawane pytania

Jakie są ceny GP​T-5.​6 po obniżce?

Luna 0,20 $ / 1,20 $, Terra 2 $ / 12 $, a Sol 5 $ / 30 $ za milion tokenów wejściowych/wyjściowych. Luna i Terra zostały obniżone 30 lipca 2026 r.; Sol pozostaje bez zmian.

Którego poziomu GP​T-5.​6 powinienem użyć?

Luna do pracy o dużej objętości i wrażliwej na opóźnienia; Terra do trudniejszych zadań, które nie wymagają flagowego modelu; Sol do najtrudniejszego rozumowania i kodowania agentowego. Kieruj się trudnością, aby zminimalizować koszty.

Czy GPT-5.6 Luna jest darmowy w ChatGPT?

O​penAI ogłosiło 6 sierpnia, że GPT-5.6 Luna staje się domyślnym modelem dla bezpłatnych kont ChatGPT i kont Go, z nieograniczonymi czatami tekstowymi; limity pozostają w przypadku przesyłania plików, obrazów i narzędzi głosowych, a przycisk Think do wyższego rozumowania jest wprowadzany osobno. Są to plany ogłoszone przez O​penAI, niezweryfikowane niezależnie.

Dlaczego Replit korzysta z GPT-5.6 Luna w trybie darmowym?

Tryb Free w Replicie, ogłoszony 19 sierpnia 2026 r., domyślnie uruchamia codzienne czaty, burze mózgów i proste kodowanie na GPT-5.6 Luna dla subskrybentów Core i Pro, kierując trudniejsze zadania do większego modelu — trybów Power/Max lub GPT-5.6 Sol — w razie potrzeby. Replit przypisuje obniżce cen API Luna z 30 lipca, wynoszącej około 80%, zasługę za sprawienie, że ekonomia się spina. To plany deklarowane przez dostawcę, niezweryfikowane niezależnie.

Czym jest Luna Reserve?

Przydział awaryjny, który O​penAI dokumentuje dla Codexa i ChatGPT Work: wybrane konta Plus i Pro w ChatGPT otrzymują ograniczoną pulę użycia GPT-5.6 Luna po wyczerpaniu zwykłego limitu, dzięki czemu nadal działają, zamiast zostać odcięte. Zawsze obsługuje wyłącznie GPT-5.6 Luna — nigdy Terra ani Sol — ma własny limit, jest oddzielony od zwykłego użycia i nie jest dostępny w przestrzeniach roboczych Business ani Enterprise. Istnienie jest potwierdzone przez O​penAI (personel potwierdził to 27 sierpnia); wdrożenie na wybranych kontach jest zgłaszane przez społeczność, a nie niezależnie zweryfikowane.

Ile kosztuje GP​T-5.​6 miesięcznie?

Przy 10M tokenów miesięcznie (70% wejściowych): około $5 na Luna, $50 na Terra i $125 na Sol — 25-krotna różnica, przed cachingiem. Twój rzeczywisty koszt zależy od cachowania i proporcji wejściowych do wyjściowych.

Czy wszystkie trzy poziomy mają to samo okno kontekstowe?

Tak — mniej więcej 1,05 mln tokenów kontekstu i do 128 tys. tokenów na wyjściu, z obsługą wizji, narzędzi, JSON i rozumowania.

Jak buforowanie promptów wpływa na koszt?

Cache'owanie znacznie obniża koszt powtarzającego się kontekstu — odczyt z cache Luny to około 0,02 USD za milion tokenów wobec 0,20 USD za świeży — dlatego gdziekolwiek to możliwe, używaj ponownie promptów z cache. Z kolei długie dane wejściowe mogą przenieść Cię do droższej taryfy długiego kontekstu.

Jak poziomy wypadają w porównaniu z Anthropic lub otwartymi modelami?

Według doniesień, Luna jest tańsza niż Claude Haiku 4.5 (~5x wejście / 4x wyjście), a Terra wypada poniżej Claude Sonnet 5 ($3 / $15). Luna jest też blisko dolnego progu cenowego tanich modeli open-source (DeepSeek, GLM-5.2 ~$1.20/$4.10).

Gdzie mogę użyć wszystkich trzech poziomów razem?

Poprzez pojedynczy endpoint OrcaRouter zgodny z OpenAI z 0% narzutu, wraz z tańszymi otwartymi modelami do routingu opartego na poziomie trudności.

Konkluzja

Po obniżce cen GPT-5.6 Luna (0,20 $ / 1,20 $) i Terra (2 $ / 12 $) są atrakcyjne do pracy o dużej skali i średniej klasy, a Sol (5 $ / 30 $) pozostaje flagowym modelem premium — 25-krotna rozpiętość kosztów, która nagradza inteligentne kierowanie ruchu. Wdrożenie dla konsumentów wzmacnia ten podział: OpenAI czyni Lunę darmową domyślną opcją, zastrzegając aktualizację niezawodności Sola dla planów płatnych, a tryb Free Mode Replita z 19 sierpnia — zbudowany na GPT-5.6 Luna, z trudniejszymi zadaniami kierowanymi do GPT-5.6 Sol — pokazuje, że produkty o dużym ruchu trafiają na ten sam poziom, a wprowadzony pod koniec sierpnia mechanizm awaryjny Luna Reserve kontynuuje ten schemat, utrzymując wybranych użytkowników planów Plus i Pro na GPT-5.6 Luna nawet po wyczerpaniu ich zwykłych limitów. Dla twórców API to kolejny powód, aby kierować łatwy ruch do Luny. Największe oszczędności przynosi kierowanie ruchu według trudności, korzystanie z pamięci podręcznej i przetwarzania wsadowego oraz kontrolowanie tokenów rozumowania, zamiast domyślnie używać jednego poziomu. Najłatwiej to osiągnąć przez pojedynczy endpoint z 0% narzutem, taki jak OrcaRouter, gdzie wszystkie trzy poziomy (w nowych cenach) znajdują się obok tańszych otwartych modeli, z którymi warto je porównać.