
Agent „o" OpenAI: Co tak naprawdę mówi przeciek z DevDay 2026, a czego nie
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 610 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 189 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
Podana nazwa jest najmniej interesującą częścią. To, co wyciek mówi o stale działającym agencie firmy, sprowadza się do tego, że będzie się nazywał "o", że znajdzie się w każdej warstwie ChatGPT Pro i że jest z nim powiązany tryb Fast Mode — działający na krzemie Cerebras. Szczegół, na którym warto się zatrzymać, jest mniejszy i dziwniejszy: odniesienie rzekomo zauważono na stronie aktualizacji dla planu Pro za 100 USD, a nie dla planu za 200 USD, w tym samym miesiącu, w którym firma całkowicie zaprzestała sprzedaży planu za 200 USD. Nie ma strony produktu, ceny, identyfikatora modelu ani oświadczenia firmy używającego tej litery jako nazwy produktu. Wpis stojący za tym artykułem to podsumowanie jednego konta tego, co według niego widziało, a konferencja, do której się to odwołuje, jest prawdziwa: DevDay 2026 odbędzie się 29 września w Fort Mason Center w San Francisco. Agent, z którym konkuruje, też jest prawdziwy — Grok Bot, produkt cyfrowego współpracownika, który SpaceXAI wprowadziło do wczesnej bety 11 sierpnia. Model, na którym agent prawdopodobnie miałby działać, jest prawdziwy i ma datę: GPT-6 Astra, ogólnie dostępny od 3 września. Prawie nic innego w tym twierdzeniu nie jest.
Z czego właściwie składa się wyciek, posortowane według wagi
Zgłaszane są trzy rzeczy i nie zasługują na to, by odczytywać je jako jedno twierdzenie.
Odniesienia widoczne na zrzutach ekranu są najmocniejszą częścią. Doniesienia opublikowane 26 września mówią, że odniesienia do „O” pojawiają się w samej konfiguracji ChatGPT — jako nazwa wyświetlana oraz jako sufiks adresu e-mail zapisany jako „-o” — a ten sam ciąg został niedawno wymieniony jako korzyść na stronie ulepszenia planu ChatGPT Pro za 100 USD. To artefakty o charakterze wdrożeniowym, a nie wymysł: powierzchnie konfiguracyjne to miejsce, w którym firma przygotowuje produkt przed jego ogłoszeniem, podobnie jak w przypadku flag funkcji. Są też najsłabszym dostępnym rodzajem artefaktu, ponieważ przygotowany ciąg można zmienić, przypisać mu inne zastosowanie lub go porzucić, a nie niesie on ze sobą żadnego zachowania. Raport wprost wskazuje tę lukę: co robi agent, do czego może mieć dostęp, czy cokolwiek planuje, jak długo pamięta i kto go otrzyma — wszystko to pozostaje nieokreślone.
Nazwa to roszczenie drugiego rzędu. Zawieszone konto @o na X jest podawane jako możliwa rezerwacja. Zawieszona nazwa użytkownika to punkt danych o intencji w pewnym momencie, a nie o tym, czym jest produkt, a ta sama litera przeszła już raz przez dział nazewnictwa OpenAI — więcej o tym poniżej.
Trzecia warstwa to część, która pochodzi z sygnału z tego tygodnia, a nie z doniesień: że „o” występuje we wszystkich planach Pro, że Fast Mode został potwierdzony, że jest przypuszczalnie dołączony do planu subskrypcji za 500 dolarów oraz że to krzem Cerebras umożliwia tę prędkość. „Przypuszczalnie” odgrywa w tym zdaniu widoczną rolę. Sam post sygnałowy jest ucięty w przechwyconym przez radar zapisie — jego piąty punkt zaczyna się od „shared m…” i się urywa — więc czytaj tę listę jako niekompletną, a nie jako pięć ustalonych punktów.
Problem nazewnictwa, którego nikt nie sprawdził
OpenAI już użyło tej litery. Jego modele rozumowania zostały wydane pod nazwami o1, o3, o3-mini i o4-mini w latach 2024 i 2025, a linia została raczej wygaszona niż rozbudowana: o4-mini wycofano z ChatGPT w lutym 2026 r., GPT-4.5 wycofano w czerwcu, a o3 objęto 90-dniowym okresem wygaszania ogłoszonym 28 maja w notatkach do wydania modelu — wycofanie, które ten blog opisał wówczas, ponieważ użytkownicy zgłaszali znikające odpowiedzi przed terminem.
Zatem samo „o” jako nazwa agenta dla konsumentów kolidowałoby z niedawną historią samej firmy i byłoby niejednoznaczne w jedynym miejscu, w którym niejednoznaczność jest kosztowna: w selektorze modeli. To nie dowód, że przeciek jest błędny — dostawcy recyklingują litery, a wewnętrzny kryptonim często ginie podczas przeglądu nazewnictwa — ale jest to powód, by traktować tę nazwę jako element tej historii, którego najłatwiej się pozbyć. Jeśli „o” zostanie wydane pod inną etykietą, każdy opatrzony datą fakt poniżej nadal pozostaje w mocy.
Dlaczego wybór momentu jest wiarygodny, mimo że produkt nie jest
Najmocniejszym dowodem na premierę agenta na DevDay nie jest przeciek. Jest nim to, co OpenAI zdążyło już przygotować w ciągu czterech tygodni przed nią.
• 3 września — GPT-6 Astra osiągnął ogólną dostępność jako flagowy model OpenAI: kontekst 1,05 mln tokenów, maksymalnie 128 tys. tokenów wyjściowych, w cenie 10,00 USD za milion tokenów wejściowych i 50,00 USD za milion tokenów wyjściowych, przy czym wejście z pamięci podręcznej kosztuje 1,00 USD, a zapisy do pamięci podręcznej – 12,50 USD. Nasz własny katalog zawiera ten sam model z datą wpisu 2026-09-04; Artificial Analysis datuje premierę na 3 września.
• 10 września — OpenAI udostępniło Agents API w publicznej becie, sprzedając deweloperom zarządzany harness Codex: OpenAI prowadzi orkiestrację, kompakcję kontekstu i odzyskiwanie, a deweloper dostarcza zadanie, model, narzędzia i środowisko. To infrastruktura agenta działającego nieprzerwanie, sprzedawana jako produkt dla deweloperów.
• 10 września — tego samego dnia wstrzymano nowe rejestracje i przejścia na plan ChatGPT Pro za $200, podając jako powód popyt na GPT-6 Astra. Plan za $100, Plus, Go, Business i Enterprise oraz API pozostały dostępne.
• 22 września — GPT-6 Sol i GPT-6 Lunazostały udostępnione w cenie 2,00 / 10,00 USD oraz 0,10 / 0,50 USD za milion tokenów, którą OpenAI określiło jako stałą, a nie promocyjną, rozszerzając tanią część oferty, po którą agent sięgałby w rutynowej pracy.
• 26 września — dokumentacja warstwy obsługi Ultrafast została rozszerzona; w Responses API Playground zauważono niepublikowany selektor szybkości oferujący Standard, Fast i Ultrafast, a doniesienia wskazują na szersze wdrożenie w okolicach DevDay.
• 29 września — DevDay 2026, keynote transmitowany na żywo, otwarcie przez Sama Altmana. Konto deweloperskie OpenAI opublikowało „72 godziny do OpenAI DevDay” w ten sam weekend, w którym ukazał się raport o agentach.

Przeczytaj te sześć linijek razem, a kształt tej historii jest spójny: OpenAI skomercjalizowało agent harness, sprzedało go deweloperom, reglamentowało konsumencką opcję z najlepszym modelem i ma keynote za cztery dni. Konsumencka wersja tego samego harnessu — sprzedawana jako subskrypcja, a nie endpoint rozliczany za token — to oczywisty kolejny ruch. Nic z tego nie sprawia, że nazwa, poziom czy powiązanie z Cerebras są zweryfikowane. To czyni timing wiarygodnym, co jest twierdzeniem innym i słabszym.
Fast Mode, Ultrafast i twierdzenie Cerebras
Sygnał mówi, że Fast Mode jest „potwierdzony”, a chip Cerebras „działa”. Trzeba je od siebie oddzielić, ponieważ jedno to udokumentowana infrastruktura platformy, a drugie to wniosek o tym, który chip obsługuje który produkt.
Tryb Fast to realny, płatny poziom w API OpenAI dla linii GPT-6: rozliczany jest według podwójnej stawki standardowej i zapewnia około 2,5× szybsze generowanie, a to ten sam poziom, który 30 lipca 2026 r. przemianowano z Priority processing — API akceptuje zarówno service_tier: "fast" jak i service_tier: "priority". Nie jest dostępny przy włączonej rezydencji danych w UE w przypadku co najmniej jednego modelu w tej linii. W ramach puli subskrypcji ChatGPT doniesienia na temat struktury kredytów subskrypcyjnych wskazują, że tryb Fast rozliczany jest według stawki 2,5× kredytu, a nie 2× jak w API, co sprawia, że najszybsze ustawienie jest nieco mniej korzystne wewnątrz ChatGPT niż poza nim — szczegół wart poznania, zanim uzna się, że korzyść z trybu Fast jest warta tego, jak brzmi.
Ultrafast to poziom Cerebras i jest to zupełnie inna bajka. OpenAI ogłosiło go 13 sierpnia 2026 r. jako pierwszy produkt swojego partnerstwa obliczeniowego z Cerebras — umowy o wartości około 10 miliardów dolarów na przestrzeni trzech lat — i zapewnia do 14× standardowej przepustowości oraz do 750 tokenów wyjściowych na sekundę na modelu GPT-5.6 Sol, modelu, do którego jest obecnie ograniczony. Dostęp do niego jest kontrolowany, nie ma opublikowanej ceny, a od tego tygodnia nadal jest poziomem z listą oczekujących, a nie ogólnodostępnym. Dokumentacja API Responses wymienia ultrafast jako wartość parametru service_tier z zastrzeżeniem, że jest "obecnie dostępny dla gpt-5.6-sol".
Właśnie dlatego zdanie o Cerebras z tego przecieku należy traktować jako domysł o prawdopodobnych podstawach, a nie jako potwierdzenie. Konsumencki agent działający w sposób ciągły byłby zdominowany przez opóźnienia i koszt przypadający na zadanie, a szybkość klasy Cerebras jest autentyczną odpowiedzią na pierwszą połowę tego problemu. Nie ma jednak jeszcze udokumentowanej ścieżki Ultrafast dla żadnego modelu GPT-6, brak dla niej cennika i niczego od OpenAI, co wiązałoby konsumenckiego agenta z tym krzemem. Kierunek tego wnioskowania jest rozsądny; pewność w sformułowaniu nie jest uzasadniona.
Co by cię kosztowało „dostępne we wszystkich planach Pro”
To jest ta część twierdzenia, którą czytelnik może faktycznie ocenić, ponieważ struktura poziomów będąca jego podstawą jest publikowana.
• Ceny miesięczne — plany ChatGPT Pro za 100 USD i 200 USD były w sprzedaży przez wrzesień; nowe zapisy do planu za 200 USD zostały wstrzymane od 10 września, a OpenAI nie opublikowało żadnego progu wznowienia.
• Wersja tej samej funkcji rozliczana za użycie — GPT-6 Pro ma limit 200 wiadomości tygodniowo w planie za 200 USD i 50 tygodniowo w planie za 100 USD, przy czym to drugie ograniczenie pochodzi z przydziału współdzielonego z GPT-5.6 Sol Pro. Plany biznesowe mają niższe limity. To opublikowane przez OpenAI liczby i to one stanowią realny limit tego, ile warta jest „korzyść na stronie aktualizacji”.
• Arytmetyka tokenów w modelu bazowym — przy $10.00 / $50.00 za milion, $500 w GPT-6 Astra API to około 50 mln tokenów wejściowych lub 10 mln tokenów wyjściowych; przy efektywnej pracy powyżej progu 272K tokenów wejściowych liczba ta ponownie maleje o połowę, ponieważ całe żądanie jest przeliczane po $20.00 / $2.00 / $75.00.
Tańsza połowa linii — za te same 500 USD kupisz około 250 mln tokenów wejściowych lub 50 mln tokenów wyjściowych w GPT-6 Sol po 2,00 / 10,00 USD, a dziesięć razy więcej w GPT-6 Luna po 0,10 / 0,50 USD.
Jeśli agent pojawi się w ramach istniejącej subskrypcji, porównanie przestaje dotyczyć ceny katalogowej, a zaczyna dotyczyć tego, za które stanowisko już płacisz. Jeśli pojawi się jako osobna pozycja na rachunku, OpenAI musi go uzasadnić w kategorii, w której rywal ma produkt na rynku od sześciu tygodni. Tak czy inaczej, agent działający nieprzerwanie zmienia kształt rachunku: asystent, który pracuje dalej, gdy śpisz, zużywa tokeny bez człowieka w pętli, a to właśnie ten rodzaj obciążenia, który karze model rozliczania za zużycie, a pochłania abonament za stanowisko. To także obciążenie, w którym o sumie decyduje wejście z pamięci podręcznej w cenie jednej dziesiątej świeżego wejścia — trwały agent wysyła ponownie niemal niezmieniony kontekst przy każdej turze, co jest dokładnie tym wzorcem, pod który stworzono rabat za pamięć podręczną.
To jest warstwa, na której działa OrcaRouter, i warto jasno powiedzieć, czego nie obejmuje. Rozliczamy modele OpenAI za token, przekazując cenę katalogową dostawcy przy 0% marży, więc zmiana stawek dostawcy obowiązuje tu tego samego dnia, z automatycznym przełączaniem awaryjnym między dostawcami oraz DSL routingu do komponowania wywołań. GPT-6 Astra, GPT-5.6 Sol, GPT-6 Sol i GPT-6 Luna są wszystkie dostępne na jednym kluczu. Nie możemy ci sprzedać subskrypcji ChatGPT ani agenta, który jeszcze nie istnieje — nie ma czego routingować, dopóki OpenAI go nie wypuści.
Poprzeczka, którą agent musi przeskoczyć, jest niższa, niż się wydaje.
Grok Bot to porównanie, którego dokonuje sam przeciek, a uczciwa jego interpretacja jest taka, że SpaceXAI ustanowiło niską poprzeczkę. Trafił do wczesnej bety 11 sierpnia w podstawowej konfiguracji za 120 USD za miejsce, dołączonej do Cursor Premium Teams, z indywidualnymi planami za 200 i 300 USD miesięcznie, a użycie ponad wliczone limity rozliczane jest według kosztu tokenów. Każdy bot otrzymuje własną chmurową maszynę wirtualną z przeglądarką, systemem plików i terminalem; loguje się do aplikacji, które nie mają API; zapisuje zademonstrowane przepływy pracy jako rutyny i działa dalej po zamknięciu laptopa.
Nie opublikowano tej części, która cokolwiek by przesądziła. SpaceXAI nie udostępniła żadnych niezależnych benchmarków ani danych o niezawodności na jego temat, router modeli stojący za nim jest automatyczny, a użytkownicy nie mogą przypiąć konkretnego modelu; pierwsi testerzy publicznie nie byli zachwyceni, a recenzenci zwracają uwagę na brak warstwy kontroli dla przedsiębiorstw — brak uprawnień zakresowych, reguł eskalacji i śladu audytowego. Muse od Meta dołączył 8 września do kategorii, która liczy teraz trzy produkty.

Ten ostatni wiersz jest sednem całego porównania. Nie ma indeksu Artificial Analysis dla pytania „czy agent ukończył zadanie, nie robiąc czegoś katastrofalnego”, więc trwałego agenta kupuje się na tych samych dowodach, na których w 2023 r. kupowano chatbota: dema i vibe. Jedynym ograniczeniem opatrzonym datą, o którym nikt w tej historii nie wspomina, jest własne podejście OpenAI do bezpieczeństwa. GPT-6 Astra osiągnął krytyczny próg zdolności w zakresie cyberbezpieczeństwa wyznaczony przez firmę, a OpenAI ostrzegło, że monitorowanie może spowalniać, wstrzymywać lub zatrzymywać uzasadnione zadania — w tym wyraźnie zadania długotrwałe. Agent działający bez przerwy jest z definicji zadaniem długotrwałym — na platformie, która już oświadczyła, że może je przerwać.
Co uczyniłoby to sprawdzalnym, i kiedy
Plotki o produkcie cztery dni przed premierą są tanie, a sprawdzenia są konkretne.
• Strona OpenAI, informacja o wydaniu lub wpis w centrum pomocy, które używają tej nazwy jako nazwy produktu. Jak dotąd nic się nie pojawiło, a historia tej litery wewnątrz OpenAI sprawia, że to właśnie ten test ma największe szanse na niepowodzenie.
• Powierzchnia konfiguracji, która przetrwa odświeżenie — plan, który naprawdę można kupić, wymieniony przydział, strona ustawień — a nie ciąg znaków do wyświetlenia, wstawiony na etapie kompilacji.
• Jakakolwiek specyfikacja zachowania w ogóle: co można mu przyznać, co planuje, jak długo pamięta, czy ma własną tożsamość mailową na produkcji, czy tylko w pliku konfiguracyjnym.
• Cena. „We wszystkich planach Pro” to nie cena, a plan za 500 USD nie staje się faktem tylko dlatego, że w osobnym raporcie znaleziono w innym miejscu ciągi znaków subskrypcji za 500 USD.
• To, czy link Cerebras pojawia się w samej dokumentacji OpenAI dotyczącej obsługi tego poziomu — tak jak w przypadku ograniczenia Ultrafast do GPT-5.6 Sol — czy też nie pojawia się wcale.

Decyzja, którą to zostawia czytelnikowi, jest mniejsza, niż sugeruje wyciek, i nie chodzi o list. Jeśli oceniasz stale aktywnego agenta do pracy, produktem, który istnieje dziś, jest Grok Bot, a rozsądnym krokiem jest krótki test na własnym workflow, a nie zobowiązanie do wykupienia miejsca — jego wejściowy plan za 120 USD to dolna granica, a nie sufit, a użycie ponad wliczone limity jest rozliczane według kosztu tokenów. Jeśli budujesz, Agents API jest w publicznej becie od 10 września i to część tej historii, którą możesz faktycznie przetestować już dziś, z harnessem, sandboxem i rozliczeniami — wszystko udokumentowane.
A jeśli wyceniasz, ile kosztowałoby uruchomienie czegokolwiek z tego, rób to na modelach, a nie na plotce. GPT-6 Astra w cenie 10,00 / 50,00 USD za milion tokenów jest dostępny na OrcaRouter w cenniku samego OpenAI, bez doliczonej marży, GPT-6 Sol i GPT-6 Luna są tam po 2,00 / 10,00 USD i 0,10 / 0,50 USD, a stawka za odczyt z pamięci podręcznej — 1,00 USD wobec 10,00 USD dla Astry — to pozycja, która decyduje o tym, ile faktycznie kosztuje stałe obciążenie. Modelu, którego OpenAI nie ogłosiło, nie da się zbenchmarkować, skierować do niego ruchu ani go kupić. Tokeny pod nim można, już dziś, a licznik, który zbudujesz w oparciu o nie, nadal będzie właściwym licznikiem, nawet jeśli nazwa na pudełku okaże się czymś innym niż pojedyncza litera.
Porównane w tym artykule2
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
