
GPT-6.1 Ultrafast to wersja Pro za jedyne 500 dolarów, a ten szczegół był dopiero trzy posty głębiej.
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
GPT-6.1 Sol Ultrafastpojawił się 8 października 2026 roku z najrzadszą rzeczą, jaką może zaoferować poziom szybkości: opublikowaną ceną. 12,00 USD za milion tokenów wejściowych, 60,00 USD za milion tokenów wyjściowych — dokładnie sześć razy więcej, niż GPT-6.1 Sol — model udostępniony przez OpenAI 29 września 2026 roku podczas keynote DevDay 2026 — kosztuje na standardowym torze. To, od czego nie zaczął wątek z ogłoszeniem, to gdzie subskrybent ChatGPT może faktycznie go włączyć, a odpowiedź, trzy posty niżej, brzmi: plan Pro za 500 USD. Ta kolejność zasługuje na więcej uwagi, niż jej poświęcono, ponieważ połowa API i połowa subskrypcyjna tego wdrożenia są ograniczane w przeciwny sposób, a różnica decyduje o tym, czy Ultrafast to coś, czego możesz spróbować w tym tygodniu, czy coś, dla czego musisz wykupić plan.
W modelu nic się nie zmieniło. GPT-6.1 Sol Ultrafast to ten sam checkpoint, to samo okno kontekstowe o rozmiarze 1 050 000 tokenów, ten sam limit wyjściowy 128 000 tokenów, ta sama data odcięcia wiedzy 30 kwietnia 2026 r. i te same odpowiedzi co GPT-6.1 Sol. Ultrafast to warstwa usługi — priorytet szeregowania, o który się prosi — a nie drugi model. Cały produkt to opóźnienie, sprzedawane za wielokrotność ceny, a liczą się tylko dwa pytania: jak dużo go dostajesz i komu wolno go kupić.
Co faktycznie mówi zapis, w kolejności, w jakiej to mówi
Wersja roszczeniowa tej historii jest taka, że OpenAI zakopało bramę. Dokładna wersja jest bardziej szczegółowa i można ją zweryfikować linijka po linijce względem własnej dokumentacji OpenAI.
Dziennik zmian dla deweloperów zawiera wpis z 8 października: dodanie trybu Ultrafast dla GPT-6.1 Sol w Responses API, którego można zażądać, wysyłając model: "gpt-6.1-sol" wraz z service_tier: "ultrafast", opisanego jako skracający czas między generowanymi tokenami wyjściowymi i określonego jako dostępny dla wszystkich użytkowników API z zastrzeżeniem limitów szybkości, z globalnym przetwarzaniem oraz rezydencją danych w USA i UE. Czytany samodzielnie, to nieograniczone uruchomienie po opublikowanej stawce.
Dokumentacja poziomu mówi, że Ultrafast to najszybszy poziom usługi w API, powszechnie dostępny dla GPT-6 Astra i GPT-6.1 Sol, z dostępem w wersji zapoznawczej dla GPT-5.6 Sol, i zaleca dla niego WebSockets. Wciąż nie ma wzmianki o planie.

Szczegół dotyczący subskrypcji znajduje się na stronie szybkości po stronie ChatGPT i są to trzy ograniczenia zebrane w jednym akapicie: Ultrafast jest dostępny w Codex i ChatGPT Work, w planie Pro za 500 USD oraz w kwalifikujących się planach Enterprise i Edu. Administratorzy Enterprise mają go domyślnie wyłączonego i muszą włączyć go dla poszczególnych użytkowników lub obszarów roboczych. A konsumencki interfejs Chat w ogóle nie oferuje tego poziomu — sam GPT-6.1 Sol działa w Work i Codex, więc Chat nigdy nie wchodził w zakres.
Połącz te trzy strony razem, a obraz staje się jasny. Klucz API to bilet. Subskrypcja ChatGPT to bilet tylko wtedy, gdy jest to najdroższa, jaką OpenAI sprzedaje, albo gdy administrator włączył ją dla ciebie. Nikt, kto czyta pierwszy post ogłoszenia, nie domyśliłby się tego.
Dlaczego brama istnieje i nie jest arbitralna
Nasuwa się oczywista interpretacja: OpenAI wykorzystuje szybką ścieżkę, aby sprzedawać plany za 500 dolarów. Mechanizm, który za tym stoi, jest mniej cyniczny i bardziej użyteczny: Ultrafast to drogi licznik, a plan za 500 dolarów to jedyny plan konsumencki, w którym licznik 8x mieści się w wliczonym w plan użyciu.
W subskrypcji wliczone użycie jest zużywane w tempie ośmiokrotnie wyższym od standardowego, gdy korzystasz z Ultrafast, więc jedna tura Ultrafast zużywa tyle samo limitu co osiem standardowych tur. To konsekwencja tego, co robi ten poziom — kupuje czas rzeczywisty, wydając moce obsługi, a subskrypcja jest produktem o stałej pojemności. Nalicz taki sam limit za ośmiokrotne zużycie pojemności, a ekonomika planu za 20 USD miesięcznie się załamie. Nalicz ośmiokrotny limit, a ten poziom po prostu stanie się nieatrakcyjny w małym planie. Tak czy inaczej, poziom trafia tam, gdzie limit jest wystarczająco duży, by go wchłonąć.
API nie ma takiego ograniczenia, ponieważ jest rozliczane na podstawie zużycia. Tam Ultrafast otrzymuje własny budżet limitu szybkości, oddzielny od budżetów Standard i Fast, a OpenAI opisuje te limity jako ustalane dla poszczególnych organizacji, a nie publikowane na stronie danego planu. To druga rzecz, na którą trzeba uważać, a której ogłoszenie nie wyeksponowało: przeniesienie obciążenia na Ultrafast nie tylko zwielokrotnia rachunek, lecz przenosi to obciążenie pod inny pułap, a jeśli zwiększysz ruch ponad to, co przyznano organizacji, limity samego planu stają się źródłem awarii.
Arytmetyka zakupu szybkości na dwa różne sposoby
Oto decyzja w liczbach i to jest część, którą warto przeliczyć na podstawie własnych zliczeń tokenów, a nie moich. Weź sesję agenta, która wysyła 30 000 tokenów wejściowych i otrzymuje 1500 tokenów wyjściowych na turę, przez 40 tur.
• Łączna liczba tokenów na przebieg — 1 200 000 na wejściu, 60 000 na wyjściu, rozłożona na 40 żądań, z których każde z zapasem mieści się poniżej progu 272 000 tokenów, przy którym OpenAI zmienia cenę całego żądania.
• W standardowym GPT-6.1 Sol — 1,2 miliona tokenów po 2,00 USD za milion to 2,40 USD, plus 60 000 po 10,00 USD za milion to 0,60 USD. Trzy dolary za uruchomienie.
• W przypadku GPT-6.1 Sol Ultrafast — 1,2 miliona po 12,00 USD daje 14,40 USD, plus 60 000 po 60,00 USD daje 3,60 USD. Osiemnaście dolarów za uruchomienie.
• Różnica — 15,00 USD za uruchomienie, aby usunąć większość czasu generowania w zadaniu, które poza tym się nie zmienia.
Te $15.00 za przebieg to liczba, którą należy zestawić z subskrypcją. Jeśli jedyną rzeczą, jaką daje plan Pro, jest Ultrafast, to przy tych liczbach tokenów około 33 przebiegi miesięcznie to punkt, w którym $500 za plan i licznik API naliczający opłaty za token się przecinają — poniżej tego licznik jest tańszym sposobem kupowania tego poziomu, a powyżej plan zaczyna wygrywać. Twoje liczby tokenów przesuną ten punkt przecięcia, czasem znacznie, więc przeprowadź własne obliczenia, zanim uznasz 33 za próg. To nasze obliczenia dla podanego obciążenia, a nie opublikowany próg rentowności.

p>Dwie uwagi strukturalne, które przetrwają dowolną liczbę tokenów.
Twierdzenie o szybkości jest zapożyczone i to jedyna rzecz, którą należy przeczytać uważnie.
Ultrafast jest sprzedawany pod hasłem „do 8 razy szybciej”, a jedyny pomiar dotyczący konkretnego modelu, jaki OpenAI publikuje na poparcie tego sformułowania, należy do innego modelu. W jego dokumentacji znajduje się zdanie, że GPT-6 Astra Ultrafast generuje tokeny do 8 razy szybciej niż GPT-6 Astra w trybie Standard w Codex. To wynik dla Astry, zmierzony w Codex. Dokumentacja poziomu GPT-6.1 Sol opisuje go jako skracający czas między tokenami i wskazuje na tabelę stawek; nie podaje jednak dla niego liczby, a żaden niezależny podmiot nie opublikował również pomiaru liczby tokenów na sekundę dla wariantu Sol.
To może się okazać prawdą. Oba modele działają na tym samym stosie serwowania i mechanizm poziomu jest taki sam, więc mnożnik Astry jest rozsądnym priorem dla Sol. Ale „do 8x” to górna granica podana przez dostawcę, nieodtworzona, wzięta z modelu siostrzanego — a „do” odgrywa w tym zdaniu istotną rolę. Traktuj ten mnożnik jako hipotezę, którą testujesz na własnych promptach, ponieważ dokumentacja samego poziomu nigdy nie testuje jej za Ciebie.
To samo zastrzeżenie łatwiej sformułować w przypadku starszych poziomów. Ultrafast dla GPT-5.6 Sol ogłoszono 13 sierpnia 2026 r. z informacją „do 14 razy szybciej niż Standard processing” w ograniczonej wersji zapoznawczej, a trzy miesiące później dokumentacja wciąż mówi o dostępie w wersji zapoznawczej, podczas gdy tabela stawek Ultrafast zawiera dokładnie dwa wiersze — GPT-6 Astra i GPT-6.1 Sol. Liczba 14x bez opublikowanej ceny i bez ogólnej dostępności to deklaracja, a nie produkt, i stanowi przydatne przypomnienie, jak duża część tej drabiny poziomów wciąż ma charakter życzeniowy.
Jeśli plan za $500 nie dochodzi do skutku
Dla każdego, kto nie zamierza wydać 500 USD na Pro, żeby przetestować poziom opóźnień, sensownym posunięciem jest rozdzielenie dwóch rzeczy, które ogłoszenie połączyło w jeden pakiet. Ten poziom jest dostępny w API dla wszystkich użytkowników API, więc szybką ścieżkę można kupić bez subskrypcji — po 12,00 i 60,00 USD za milion tokenów, z własnym budżetem limitu szybkości, na obciążeniu wystarczająco małym, by je zmierzyć. Przetestuj ją najpierw tam, na własnych promptach, w porównaniu ze standardową ścieżką.
Standardowa ścieżka to ta, która istnieje bez tego wszystkiego. OrcaRouter udostępnia GPT-6.1 Sol jako openai/gpt-6.1-sol według własnego cennika OpenAI — 2,00 USD za milion tokenów wejściowych i 10,00 USD za milion tokenów wyjściowych — z 0% marży i ceną dostawcy przekazywaną bezpośrednio, więc zmiana cennika przez dostawcę trafia na naszą stronę tego samego dnia. Ultrafast to nie jest coś, co sprzedajemy: to flaga poziomu usługi rozliczana na Twoim własnym koncie OpenAI, i wolimy powiedzieć to wprost, niż pozwolić, by strona modelu sugerowała coś innego. To, co jeden klucz rzeczywiście daje, to możliwość kierowania ruchem standardową ścieżką oraz resztą katalogu — ponad 200 modeli za jednym punktem końcowym zgodnym z OpenAI — oraz automatyczne przełączanie awaryjne między dostawcami, gdy jeden z nich działa wadliwie, co jest najtańszym dostępnym ubezpieczeniem, jeśli zamierzasz umieścić warstwę opóźnień przed ścieżką produkcyjną.

A jeśli masz plan Plus lub Team i odpowiedzią, której szukałeś, było „czy mogę to po prostu włączyć?”, odpowiedź brzmi: nie, i ma konkretny kształt. Codex i ChatGPT Work działają w planie Pro za 500 USD lub w kwalifikującym się planie Enterprise albo Edu, włączane przez administratora, jeśli chodzi o Enterprise. Wszystko inne dociera do Ultrafast przez API i płaci za token.
Co obejrzeć dalej
Trzy rzeczy zmieniłyby to z ograniczonego wdrożenia w zwykłe, a wszystkie trzy można zaobserwować. Opublikowany limit szybkości Ultrafast dla GPT-6.1 Sol zakończyłby zgadywanie, czy własny pułap tego poziomu zadziała, zanim zrobi to rachunek. Pomiar szybkości specyficzny dla modelu — albo niezależny — zastąpiłby pożyczoną liczbę Astra czymś, na podstawie czego można oceniać poziom Sol. A dotarcie Ultrafast do ChatGPT Plus oznaczałoby, że matematyka przepustowości się zmieniła, co jest sygnałem, że ograniczenie wynikało z niedoboru na premierę, a nie z trwałego kształtu tego poziomu.
Do tego czasu uczciwe podsumowanie jest wąskie i weryfikowalne. GPT-6.1 Sol został udostępniony 29 września 2026 r. i pozostaje bez zmian. 8 października 2026 r. zyskał szybką ścieżkę z realną ceną: otwartą dla użytkowników API, a w ChatGPT dostępną dopiero w planie za 500 USD — szczegół, który zasługiwał na pierwszy wpis, a nie trzeci, i który dla większości czytelników rozstrzyga, czy to pozycja w zestawieniu, czy zamówienie zakupu.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
