Wygenerowana karta hero z nagłówkiem „Trzy posty w dół” i podtytułem „GPT-6.1 Ultrafast jest dostępny w planie Pro $500 tylko w ChatGPT — otwarty dla wszystkich użytkowników API”, z chipami o treści „plan Pro $500”, „kwalifikujące się Enterprise i Edu” oraz „wszyscy użytkownicy API”, a także stopką o treści „Dostępność zgodnie z dokumentacją OpenAI, 8 października 2026”.
Guides & Insights

GPT-6.1 Ultrafast to wersja Pro za jedyne 500 dolarów, a ten szczegół był dopiero trzy posty głębiej.

Autor

Alistair Wren

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

GPT-6.1 Sol Ultrafastpojawił się 8 października 2026 roku z najrzadszą rzeczą, jaką może zaoferować poziom szybkości: opublikowaną ceną. 12,00 USD za milion tokenów wejściowych, 60,00 USD za milion tokenów wyjściowych — dokładnie sześć razy więcej, niż GPT-6.1 Sol — model udostępniony przez OpenAI 29 września 2026 roku podczas keynote DevDay 2026 — kosztuje na standardowym torze. To, od czego nie zaczął wątek z ogłoszeniem, to gdzie subskrybent ChatGPT może faktycznie go włączyć, a odpowiedź, trzy posty niżej, brzmi: plan Pro za 500 USD. Ta kolejność zasługuje na więcej uwagi, niż jej poświęcono, ponieważ połowa API i połowa subskrypcyjna tego wdrożenia są ograniczane w przeciwny sposób, a różnica decyduje o tym, czy Ultrafast to coś, czego możesz spróbować w tym tygodniu, czy coś, dla czego musisz wykupić plan.

W modelu nic się nie zmieniło. GPT-6.1 Sol Ultrafast to ten sam checkpoint, to samo okno kontekstowe o rozmiarze 1 050 000 tokenów, ten sam limit wyjściowy 128 000 tokenów, ta sama data odcięcia wiedzy 30 kwietnia 2026 r. i te same odpowiedzi co GPT-6.1 Sol. Ultrafast to warstwa usługi — priorytet szeregowania, o który się prosi — a nie drugi model. Cały produkt to opóźnienie, sprzedawane za wielokrotność ceny, a liczą się tylko dwa pytania: jak dużo go dostajesz i komu wolno go kupić.

Co faktycznie mówi zapis, w kolejności, w jakiej to mówi

Wersja roszczeniowa tej historii jest taka, że OpenAI zakopało bramę. Dokładna wersja jest bardziej szczegółowa i można ją zweryfikować linijka po linijce względem własnej dokumentacji OpenAI.

Dziennik zmian dla deweloperów zawiera wpis z 8 października: dodanie trybu Ultrafast dla GPT-6.1 Sol w Responses API, którego można zażądać, wysyłając model: "gpt-6.1-sol" wraz z service_tier: "ultrafast", opisanego jako skracający czas między generowanymi tokenami wyjściowymi i określonego jako dostępny dla wszystkich użytkowników API z zastrzeżeniem limitów szybkości, z globalnym przetwarzaniem oraz rezydencją danych w USA i UE. Czytany samodzielnie, to nieograniczone uruchomienie po opublikowanej stawce.

Dokumentacja poziomu mówi, że Ultrafast to najszybszy poziom usługi w API, powszechnie dostępny dla GPT-6 Astra i GPT-6.1 Sol, z dostępem w wersji zapoznawczej dla GPT-5.6 Sol, i zaleca dla niego WebSockets. Wciąż nie ma wzmianki o planie.

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

Szczegół dotyczący subskrypcji znajduje się na stronie szybkości po stronie ChatGPT i są to trzy ograniczenia zebrane w jednym akapicie: Ultrafast jest dostępny w Codex i ChatGPT Work, w planie Pro za 500 USD oraz w kwalifikujących się planach Enterprise i Edu. Administratorzy Enterprise mają go domyślnie wyłączonego i muszą włączyć go dla poszczególnych użytkowników lub obszarów roboczych. A konsumencki interfejs Chat w ogóle nie oferuje tego poziomu — sam GPT-6.1 Sol działa w Work i Codex, więc Chat nigdy nie wchodził w zakres.

Połącz te trzy strony razem, a obraz staje się jasny. Klucz API to bilet. Subskrypcja ChatGPT to bilet tylko wtedy, gdy jest to najdroższa, jaką OpenAI sprzedaje, albo gdy administrator włączył ją dla ciebie. Nikt, kto czyta pierwszy post ogłoszenia, nie domyśliłby się tego.

Dlaczego brama istnieje i nie jest arbitralna

Nasuwa się oczywista interpretacja: OpenAI wykorzystuje szybką ścieżkę, aby sprzedawać plany za 500 dolarów. Mechanizm, który za tym stoi, jest mniej cyniczny i bardziej użyteczny: Ultrafast to drogi licznik, a plan za 500 dolarów to jedyny plan konsumencki, w którym licznik 8x mieści się w wliczonym w plan użyciu.

W subskrypcji wliczone użycie jest zużywane w tempie ośmiokrotnie wyższym od standardowego, gdy korzystasz z Ultrafast, więc jedna tura Ultrafast zużywa tyle samo limitu co osiem standardowych tur. To konsekwencja tego, co robi ten poziom — kupuje czas rzeczywisty, wydając moce obsługi, a subskrypcja jest produktem o stałej pojemności. Nalicz taki sam limit za ośmiokrotne zużycie pojemności, a ekonomika planu za 20 USD miesięcznie się załamie. Nalicz ośmiokrotny limit, a ten poziom po prostu stanie się nieatrakcyjny w małym planie. Tak czy inaczej, poziom trafia tam, gdzie limit jest wystarczająco duży, by go wchłonąć.

API nie ma takiego ograniczenia, ponieważ jest rozliczane na podstawie zużycia. Tam Ultrafast otrzymuje własny budżet limitu szybkości, oddzielny od budżetów Standard i Fast, a O​penAI opisuje te limity jako ustalane dla poszczególnych organizacji, a nie publikowane na stronie danego planu. To druga rzecz, na którą trzeba uważać, a której ogłoszenie nie wyeksponowało: przeniesienie obciążenia na Ultrafast nie tylko zwielokrotnia rachunek, lecz przenosi to obciążenie pod inny pułap, a jeśli zwiększysz ruch ponad to, co przyznano organizacji, limity samego planu stają się źródłem awarii.

Arytmetyka zakupu szybkości na dwa różne sposoby

Oto decyzja w liczbach i to jest część, którą warto przeliczyć na podstawie własnych zliczeń tokenów, a nie moich. Weź sesję agenta, która wysyła 30 000 tokenów wejściowych i otrzymuje 1500 tokenów wyjściowych na turę, przez 40 tur.

• Łączna liczba tokenów na przebieg — 1 200 000 na wejściu, 60 000 na wyjściu, rozłożona na 40 żądań, z których każde z zapasem mieści się poniżej progu 272 000 tokenów, przy którym OpenAI zmienia cenę całego żądania.

• W standardowym GPT-6.1 Sol — 1,2 miliona tokenów po 2,00 USD za milion to 2,40 USD, plus 60 000 po 10,00 USD za milion to 0,60 USD. Trzy dolary za uruchomienie.

• W przypadku GPT-6.1 Sol Ultrafast — 1,2 miliona po 12,00 USD daje 14,40 USD, plus 60 000 po 60,00 USD daje 3,60 USD. Osiemnaście dolarów za uruchomienie.

• Różnica — 15,00 USD za uruchomienie, aby usunąć większość czasu generowania w zadaniu, które poza tym się nie zmienia.

Te $15.00 za przebieg to liczba, którą należy zestawić z subskrypcją. Jeśli jedyną rzeczą, jaką daje plan Pro, jest Ultrafast, to przy tych liczbach tokenów około 33 przebiegi miesięcznie to punkt, w którym $500 za plan i licznik API naliczający opłaty za token się przecinają — poniżej tego licznik jest tańszym sposobem kupowania tego poziomu, a powyżej plan zaczyna wygrywać. Twoje liczby tokenów przesuną ten punkt przecięcia, czasem znacznie, więc przeprowadź własne obliczenia, zanim uznasz 33 za próg. To nasze obliczenia dla podanego obciążenia, a nie opublikowany próg rentowności.

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>Dwie uwagi strukturalne, które przetrwają dowolną liczbę tokenów.

Twierdzenie o szybkości jest zapożyczone i to jedyna rzecz, którą należy przeczytać uważnie.

Ultrafast jest sprzedawany pod hasłem „do 8 razy szybciej”, a jedyny pomiar dotyczący konkretnego modelu, jaki OpenAI publikuje na poparcie tego sformułowania, należy do innego modelu. W jego dokumentacji znajduje się zdanie, że GPT-6 Astra Ultrafast generuje tokeny do 8 razy szybciej niż GPT-6 Astra w trybie Standard w Codex. To wynik dla Astry, zmierzony w Codex. Dokumentacja poziomu GPT-6.1 Sol opisuje go jako skracający czas między tokenami i wskazuje na tabelę stawek; nie podaje jednak dla niego liczby, a żaden niezależny podmiot nie opublikował również pomiaru liczby tokenów na sekundę dla wariantu Sol.

To może się okazać prawdą. Oba modele działają na tym samym stosie serwowania i mechanizm poziomu jest taki sam, więc mnożnik Astry jest rozsądnym priorem dla Sol. Ale „do 8x” to górna granica podana przez dostawcę, nieodtworzona, wzięta z modelu siostrzanego — a „do” odgrywa w tym zdaniu istotną rolę. Traktuj ten mnożnik jako hipotezę, którą testujesz na własnych promptach, ponieważ dokumentacja samego poziomu nigdy nie testuje jej za Ciebie.

To samo zastrzeżenie łatwiej sformułować w przypadku starszych poziomów. Ultrafast dla GPT-5.6 Sol ogłoszono 13 sierpnia 2026 r. z informacją „do 14 razy szybciej niż Standard processing” w ograniczonej wersji zapoznawczej, a trzy miesiące później dokumentacja wciąż mówi o dostępie w wersji zapoznawczej, podczas gdy tabela stawek Ultrafast zawiera dokładnie dwa wiersze — GPT-6 Astra i GPT-6.1 Sol. Liczba 14x bez opublikowanej ceny i bez ogólnej dostępności to deklaracja, a nie produkt, i stanowi przydatne przypomnienie, jak duża część tej drabiny poziomów wciąż ma charakter życzeniowy.

Jeśli plan za $500 nie dochodzi do skutku

Dla każdego, kto nie zamierza wydać 500 USD na Pro, żeby przetestować poziom opóźnień, sensownym posunięciem jest rozdzielenie dwóch rzeczy, które ogłoszenie połączyło w jeden pakiet. Ten poziom jest dostępny w API dla wszystkich użytkowników API, więc szybką ścieżkę można kupić bez subskrypcji — po 12,00 i 60,00 USD za milion tokenów, z własnym budżetem limitu szybkości, na obciążeniu wystarczająco małym, by je zmierzyć. Przetestuj ją najpierw tam, na własnych promptach, w porównaniu ze standardową ścieżką.

Standardowa ścieżka to ta, która istnieje bez tego wszystkiego. OrcaRouter udostępnia GPT-6.1 Sol jako openai/gpt-6.1-sol według własnego cennika O​penAI — 2,00 USD za milion tokenów wejściowych i 10,00 USD za milion tokenów wyjściowych — z 0% marży i ceną dostawcy przekazywaną bezpośrednio, więc zmiana cennika przez dostawcę trafia na naszą stronę tego samego dnia. Ultrafast to nie jest coś, co sprzedajemy: to flaga poziomu usługi rozliczana na Twoim własnym koncie O​penAI, i wolimy powiedzieć to wprost, niż pozwolić, by strona modelu sugerowała coś innego. To, co jeden klucz rzeczywiście daje, to możliwość kierowania ruchem standardową ścieżką oraz resztą katalogu — ponad 200 modeli za jednym punktem końcowym zgodnym z O​penAI — oraz automatyczne przełączanie awaryjne między dostawcami, gdy jeden z nich działa wadliwie, co jest najtańszym dostępnym ubezpieczeniem, jeśli zamierzasz umieścić warstwę opóźnień przed ścieżką produkcyjną.

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

A jeśli masz plan Plus lub Team i odpowiedzią, której szukałeś, było „czy mogę to po prostu włączyć?”, odpowiedź brzmi: nie, i ma konkretny kształt. Codex i ChatGPT Work działają w planie Pro za 500 USD lub w kwalifikującym się planie Enterprise albo Edu, włączane przez administratora, jeśli chodzi o Enterprise. Wszystko inne dociera do Ultrafast przez API i płaci za token.

Co obejrzeć dalej

Trzy rzeczy zmieniłyby to z ograniczonego wdrożenia w zwykłe, a wszystkie trzy można zaobserwować. Opublikowany limit szybkości Ultrafast dla GPT-6.1 Sol zakończyłby zgadywanie, czy własny pułap tego poziomu zadziała, zanim zrobi to rachunek. Pomiar szybkości specyficzny dla modelu — albo niezależny — zastąpiłby pożyczoną liczbę Astra czymś, na podstawie czego można oceniać poziom Sol. A dotarcie Ultrafast do ChatGPT Plus oznaczałoby, że matematyka przepustowości się zmieniła, co jest sygnałem, że ograniczenie wynikało z niedoboru na premierę, a nie z trwałego kształtu tego poziomu.

Do tego czasu uczciwe podsumowanie jest wąskie i weryfikowalne. GPT-6.1 Sol został udostępniony 29 września 2026 r. i pozostaje bez zmian. 8 października 2026 r. zyskał szybką ścieżkę z realną ceną: otwartą dla użytkowników API, a w ChatGPT dostępną dopiero w planie za 500 USD — szczegół, który zasługiwał na pierwszy wpis, a nie trzeci, i który dla większości czytelników rozstrzyga, czy to pozycja w zestawieniu, czy zamówienie zakupu.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie