
GPT-6 Luna i GPT-6 Sol: tania warstwa, której OpenAI nie wypuściło
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
W tej historii jest jeden twardy, weryfikowalny artefakt i nie jest to żadna z nazw w nagłówku. 21 września deweloperzy donieśli, że widzieli ciąg GPT-6 Sol medium w rekordach scalania kodu NVIDIA — a więc w repozytorium strony trzeciej, nie samego dostawcy. Wokół tego jednego artefaktu narosła znacznie większa plotka: że OpenAI przygotowuje premierę GPT-6 Sol jako średniej klasy konia roboczego, a GPT-6 Luna jako swojej taniej warstwy, poniżej flagowego GPT-6 Astra, który OpenAI faktycznie wypuściło 3 września 2026 r. Ani GPT-6 Sol, ani GPT-6 Luna nie mają identyfikatora modelu, ceny, okna kontekstowego, karty systemowej ani wzmianki w dokumentacji OpenAI. Warstwa, którą miałyby zajmować, ma jednak już żywego lokatora w GPT-5.6 Luna — budżetowym członku rodziny GPT-5.6, w sprzedaży od 9 lipca 2026 r. za 0,20 dolara za milion tokenów wejściowych i 1,20 dolara za milion wyjściowych. Ta asymetria to cała historia i to właśnie ona sprawia, że warto ten tekst przeczytać, a nie tylko się nim asekurować.
Co jest faktycznie udokumentowane, a co jest wnioskowaniem?
Zacznij od artefaktu, ponieważ to jedyna rzecz tutaj, do której czytelnik może pójść i ją obejrzeć. Rekord scalenia NVIDIA jest prawdziwy w tym sensie, że osoby, które o nim informowały, czytały publiczne repozytorium, a opisana zmiana kodu jest prozaiczna: commit napisany z pomocą GPT-6 Astra, a następnie sprawdzony przez coś oznaczonego jako GPT-6 Sol. Artykuł 新智元, który przekazał to ustalenie szerszej publiczności, przedstawił je jako działający przykład „AI 打工矩阵” — łańcucha, w którym jeden model pisze, a drugi recenzuje. Traktuj to ujęcie jako komentarz. Sam rekord scalenia mówi, że ktoś wewnątrz infrastruktury strony trzeciej przygotowuje się do udostępniania modelu pod tą nazwą. Nie mówi, że OpenAI wydało taki model, i nie mówi zupełnie nic o Lunie.
Reszta argumentów za premierą GPT-6 Sol jest słabsza, niż sugerują otaczające ją doniesienia. Chińska prasa technologiczna donosiła o przeciekowej cenie 2,50 USD za milion tokenów wejściowych i 15 USD za milion tokenów wyjściowych — mniej więcej połowie tego, ile kosztuje GPT-5.6 Sol — wraz z twierdzeniami, że wsparcie było podłączane w OpenAI API, Codex OAuth, obsłudze wejścia obrazowego i długiego kontekstu, oraz z domniemaną premierą we wtorek 22 września. Część tych doniesień wskazywała na 3:00 we wtorek. W chwili pisania tego tekstu nie ma ogłoszenia OpenAI, żadnego ciągu identyfikatora, wpisu na stronie z cennikiem ani śladu w selektorze modeli dla GPT-6 Sol lub GPT-6 Luna. Jeden z serwisów relacjonujących ten sam łańcuch plotek zauważył, że jego własne liczby cenowe nie zgadzały się ze sobą, przytaczając 2,50/15 USD, 4/30 USD i inne krążące liczby — tak wygląda plotka po czterech tłumaczeniach, a nie tak wygląda cennik.
GPT-6 Luna wypada jeszcze słabiej i warto powiedzieć to bez ogródek. Obecność Luny w tej historii wywodzi się z jednego posta z 6 września, w którym konto na X @kimmonismus napisało, że OpenAI „już przygotowuje wydanie GPT-6 Sol”, a następnie na podstawie wzorca nazewnictwa GPT-5.6 wywnioskowało, że „Sol, Terra i Luna jeszcze przed nami”. To argument oparty na symetrii nazw. Luna nigdy nie była przedmiotem samodzielnego twierdzenia — żadnego przecieku, żadnego zrzutu ekranu, żadnego ciągu modelu, żadnej ceny. Pojawia się w późniejszych podsumowaniach tylko dlatego, że pojawiła się w pierwszym poście.
Trzy daty i co każda z nich udowodniła
Chronologie przecieków warto czytać jako kartę wyników, bo ta już taką ma.
• 6 września — twierdzenie o rodzinie. Wnioskowanie społeczności na podstawie precedensu GPT-5.6, bez dołączonego artefaktu. Niesprawdzone wtedy, niesprawdzone teraz.
• 15–16 września — Sam Altman napisał, że OpenAI miało „dużą premierę w tym tygodniu, a potem na devday sześć premier”, po czym następnego wieczoru wycofał się z pierwszej części, mówiąc, że to, czego premiery najbardziej wyczekiwał, pojawi się dopiero w następnym tygodniu i będzie „warte czekania”. W żadnym z wpisów nie wymienił żadnego produktu. To jedyny element całej historii podany przez przedstawiciela kierownictwa i odnosi się wyłącznie do terminu, a nie do niczego więcej.
• 21 września — rekord scalenia NVIDII i pierwszy artefakt w tym łańcuchu. Rekord scalenia w cudzym repozytorium to realny sygnał, że model jest przygotowywany do serwowania. To nie jest wydanie.
• wtorek, 22 września — dzisiaj, i data, którą sama plotka wskazała. Na dzień pisania tego tekstu nie ma żadnego ogłoszenia OpenAI, żadnego identyfikatora modelu, żadnego wpisu w cenniku ani żadnego pojawienia się w selektorze modeli dla GPT-6 Sol, a dla GPT-6 Luna — w ogóle żadnego.
Następnym punktem na osi czasu z konkretną datą jest DevDay we wtorek, 29 września, w Fort Mason Center — „ship x 6”, do którego odnosił się Altman, oraz zapasowa data, na którą wskazywały chińskie doniesienia, gdyby wtorkowa premiera nie doszła do skutku. Jeśli istnieje naprawdę model szóstej generacji klasy średniej lub budżetowy, to właśnie tam najprawdopodobniej się pojawi, a jeden wiersz na liście modeli samego OpenAI rozstrzygnąłby wszystko, co ten artykuł musi obwarować zastrzeżeniami.
Ten poziom już istnieje i jest tani.
Oto część tej historii, którą można w pełni zweryfikować, i to jest powód, dla którego „GPT-6 Luna” to coś, na co dziwnie jest czekać. GPT-5.6 Luna jest już dostępny, i jest tani w sposób, w jaki modele czołowe nie są.
• Cena — 0,20 USD za milion tokenów wejściowych i 1,20 USD za milion tokenów wyjściowych, zgodnie z dokumentacją API samego OpenAI. Wprowadzono ją 9 lipca 2026 r. w cenie 1,00 USD / 6,00 USD, a pod koniec lipca obniżono ją o około 80%.
• Stawki za buforowane dane i długi kontekst — odczyty zbuforowanych danych wejściowych są objęte około 90% zniżką; żądania przekraczające próg długiego kontekstu są rozliczane na poziomie około 0,40 USD / 1,80 USD za całe żądanie.
• Kontekst i dane wyjściowe — okno kontekstu 1M tokenów z maksymalnym wyjściem 128K. Mediana czasu do pierwszego tokenu wynosi 1,83 sekundy.
• Rola — OpenAI zastąpiło GPT-5.5 Instant modelem GPT-5.6 Luna jako domyślnym modelem dla ChatGPT Free i Go w dniach 6–7 sierpnia 2026 r., a w następnym tygodniu dodało przycisk „Think” do głębszego rozumowania.
• Efekt obniżki — 9 września dyrektor finansowa OpenAI Sarah Friar powiedziała na konferencji Goldman Sachs Communacopia, że obniżka cen wywołała około dziesięciokrotny wzrost użycia, i argumentowała, że wdrożenie Luna jest tańsze niż uruchamianie GLM 5.3 od Z.ai w warstwie chmurowej. Obie są danymi dostawcy przedstawionymi przez dyrektor finansową na wydarzeniu inwestorskim: warte relacjonowania, ale nie warte traktowania jako niezależnie zweryfikowane.

Zestaw obok siebie te dwa punkty cenowe, a kwestia podziału na poziomy rozstrzygnie się sama. Podawana cena GPT-6 Sol wynosząca 2,50 USD / 15 USD jest ponad dwunastokrotnie wyższa niż stawka GPT-5.6 Luna za tokeny wejściowe. Szóstogeneracyjna Luna nie konkurowałaby z Sol — konkurowałaby z modelem, który OpenAI już rozdaje za darmo jako domyślny w darmowym planie.
Dlaczego tani poziom GPT-6 jest mimo wszystko prawdopodobny
Pod plotką kryje się prawdziwy argument handlowy i dotyczy on tego, gdzie są tokeny, a nie tego, gdzie jest ranking. GPT-6 Astra kosztuje 10 USD za milion tokenów wejściowych i 50 USD za milion tokenów wyjściowych, a żądania z długim kontekstem są rozliczane według wyższej stawki. Podaje okno kontekstowe o rozmiarze 1 mln tokenów — tej samej klasy co generacja 5.6, przy znacznie wyższej stawce. W Artificial Analysis konfiguracja Astra z maksymalnym rozumowaniem uzyskuje 53 punkty w Intelligence Index tego trackera przy około 3,26 USD za zadanie, co jest ceną możliwą do uzasadnienia w przypadku pracy frontierowej, a niemożliwą do uzasadnienia w przypadku klasyfikacji, ekstrakcji, routingu lub pętli agentowych o dużym wolumenie.
Ta luka ma dokładnie taki kształt, który wyłonił Sol, Terra i Lunę w generacji 5.6, i dlatego doniesienia wciąż wskazują na Sola ze średniej półki, a nie na drugi flagowiec. Samo zachowanie OpenAI w zakresie cen wspiera ten kierunek: jej odpowiedzią na presję kosztową w lipcu było obniżenie ceny taniej warstwy o 80%, a nie zastąpienie jej, a jej dyrektor finansowy wszedł na scenę we wrześniu, by spierać się o cenę z chińskimi modelami o otwartych wagach. Firma broniąca dolnego końca rynku to firma, która zamierza nadal wypuszczać produkty na dolnym końcu.
Kontrargument jest równie realny i właśnie dlatego logika samego przecieku jest słabsza, niż się wydaje. Wprowadzenie na rynek budżetowego modelu z serii 6 oznacza poproszenie każdego zespołu, który dostroił już prompty, mechanizmy buforowania i narzędzia ewaluacyjne wokół GPT-5.6 Luna, o ponowną kwalifikację tego wszystkiego dla niewielkiej korzyści. To autentyczny powód, dla którego GPT-6 Luna może nigdy nie zostać ogłoszona — nie dlatego, że plotka jest fałszywa, lecz dlatego, że decyzja produktowa, którą zakłada, mogła nie zostać podjęta.

Jak przygotować się, nie stawiając na model, który nie istnieje
Nie można wywołać GPT-6 Sol ani GPT-6 Luna. Nikt nie może, a żadna platforma ich nie hostuje — najwięcej, co zgłoszono, to że jeden deweloper zobaczył zwrócony ciąg modelu GPT-6 Sol tam, gdzie oczekiwano żądania GPT-5.6 Sol, co jest ciekawostką dotyczącą routingu, a nie dostępnością. Możesz natomiast sprawić, by ewentualne pojawienie się było tanie we wdrożeniu, a zaskoczenie nim — drogie.
Praktyczne podejście polega na trzymaniu nazwy modelu poza kodem aplikacji. Jeśli Twój stack wywołuje model za pomocą zakodowanego na sztywno ciągu, przyjęcie modelu średniej klasy szóstej generacji oznacza wdrożenie, ponowną kwalifikację promptów i nowy przebieg ewaluacji. Jeśli wywołuje trasę, oznacza to zmianę jednej linii. OrcaRouter udostępnia ponad 200 modeli za pośrednictwem jednego API z 0% narzutu — cena katalogowa dostawcy jest przekazywana bezpośrednio dalej, więc gdy dostawca obniża cenę, kwota po naszej stronie zmienia się tego samego dnia; właśnie tak 80-procentowa obniżka GPT-5.6 Luna pojawiła się tutaj, mimo że nikt niczego nie renegocjował. Automatyczny failover robi resztę: skieruj trasę na najtańszy poziom, który spełnia próg Twojej ewaluacji, a niewydany model pozostaje poza ścieżką, dopóki nie istnieje i nie przejdzie testów.

To jest uczciwe wykorzystanie przecieku takiego jak ten: nie po to, by planować migrację do modelu, którego nie ogłoszono, lecz po to, by zauważyć, które miejsce w twoim stacku wypełniłby nowy model średniej klasy, i zadbać, by wypełnienie go później było zmianą konfiguracji, a nie projektem.
Co mogłoby się liczyć jako dowód
Granica między przeciekiem, który warto śledzić, a przeciekiem, który warto zignorować, zależy od tego, czy artefakt został wytworzony przez dostawcę, czy przez neutralną stronę. Zastosowanie tutaj:
• Liczy się — identyfikator modelu w dokumentacji API OpenAI, karta systemowa, wpis na stronie cennika OpenAI, pojawienie się w selektorze modeli ChatGPT, pierwsze niezależne uruchomienie testu porównawczego w trackerze takim jak Artificial Analysis lub pozycja w katalogu routingu z prawdziwym endpointem za nią.
• Nie liczy się — sam zapis scalenia w cudzym repozytorium, nieprzypisana lista plotek w przeglądzie, wyciekły zrzut ekranu z ceną, którą trzy redakcje podają na trzy różne sposoby, obserwacja anonimowego dewelopera albo prawdopodobieństwo z rynku predykcyjnego. Pod koniec lipca rynki predykcyjne wyceniały wydanie GPT-6 do 30 września na około 77–78%. To opinia rynku o dacie, a nie dowód dotyczący modelu, i została wyceniona, zanim Astra została wydana.
Dopóki coś z pierwszej listy nie wejdzie na rynek, właściwe stanowisko wobec obu nazw jest wąskie i bez blasku. GPT-6 Sol to ciąg znaków w rekordzie scalenia NVIDIA i cena, co do której nikt nie może się zgodzić. GPT-6 Luna to nazwa, która pojawia się w rodzinnej plotce, na liście, do której nikt się nie przyznaje, zajmując poziom, który GPT-5.6 Luna już wypełnia w cenie $0.20 na wejściu i $1.20 na wyjściu. Nie ma do czego migrować, nie ma czego benchmarkować i nie ma czego wyceniać. Jedyne, co warto dziś zrobić, to upewnić się, że gdy już będzie, twój routing nie będzie wymagał przepisania, aby do niego dotrzeć.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
