Wygenerowana karta tytułowa dla cennika GPT-6 Astra z trzema plakietkami statystyk o treści: „Cena katalogowa: $10.00 za wejście / $1.00 z pamięci podręcznej / $50.00 za wyjście za 1 mln”, „Tryb wsadowy: $5.00 / $25.00 — Tryb szybki: $20.00 / $100.00” oraz „Próg rentowności względem GPT-5.6 Sol: 40% tokenów”, z przypisem: „Model wydany 3 września 2026. Stawki odczytane z własnej strony cennika OpenAI 16 września 2026.”
Guides & Insights

Cennik GPT-6 Astra: Dlaczego trzy różne ceny są wszystkie poprawne i ile naprawdę kosztuje zadanie

Autor

Alistair Wren

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Najważniejsze na początek: GPT-6 Astra kosztuje 10,00 USD za milion tokenów wejściowych, 1,00 USD za milion buforowanych tokenów wejściowych i 50,00 USD za milion tokenów wyjściowych w standardowym planie Ope​nAI. To własna cena katalogowa Ope​nAI, odczytana ze strony z cennikiem Ope​nAI w dniu 16 września 2026 r. — a data ma znaczenie, ponieważ model był wyceniany różnie w różnych okresach, a czytelnicy wciąż natrafiają na te inne liczby. GPT-6 Astra sam został wydany 3 września 2026 r., trzynaście dni przed tą stroną. To nie jest artykuł o premierze ani tekst ogłoszeniowy; to strona referencyjna modelu, który jest już ogólnie dostępny i od tego tygodnia powszechnie wdrożony. GPT-5.6 Sol pojawia się poniżej jako cena bazowa, powyżej której sprzedaje się Astra, a nie jako temat.

Powód, dla którego cennik wymaga całej strony, jest taki, że krążące liczby są rozbieżne. Wyszukaj cenę tego modelu, a znajdziesz $10/$50 od OpenAI, stawkę wsadową $5/$25, wyceny Azure zarówno na $10/$50, jak i $11/$55 oraz co najmniej jeden endpoint wyceniony na $20/$100. Żadna z tych wartości nie jest literówką ani po cichu zmienioną ceną katalogową. To różne poziomy usług i różni odsprzedawcy, a odróżnienie ich to różnica między budżetem a zgadywaniem.

Cennik, z każdą pozycją oznaczoną i opatrzoną datą

Wszystko w tej sekcji zostało odczytane z własnej dokumentacji cenowej i dokumentacji modeli Ope​nAI w dniu 16 września 2026 r.. Jeśli dana liczba pochodzi od kogoś innego, zdanie, w którym się znajduje, mówi o tym.

Standard, żądania o nie więcej niż 272 000 tokenów wejściowych — $10,00 za 1 mln tokenów wejściowych, $1,00 za 1 mln tokenów wejściowych z pamięci podręcznej, $12,50 za 1 mln zapisów do pamięci podręcznej, $50,00 za 1 mln tokenów wyjściowych (własna tabela cen Ope​nAI, odczytana 2026-09-16).

Linia zapisu do pamięci podręcznej jest prawdziwa i ludzie ją przeoczają — przy pierwszym wysłaniu prefiksu następuje zapis po $12,50 za 1 mln, a nie odczyt po $1,00. Zapisy do pamięci podręcznej są rozliczane według 1,25x standardowej stawki za dane wejściowe.

Standard, żądania powyżej 272 000 tokenów wejściowych — 20,00 USD za wejście, 2,00 USD za wejście z pamięci podręcznej, 25,00 USD za zapis do pamięci podręcznej, 75,00 USD za wyjście za 1 mln. Ponownej wycenie podlega całe żądanie, a nie tylko tokeny przekraczające ten próg (własna tabela cen Ope​nAI, odczyt 2026-09-16).

Batch i Flex — połowa standardowej stawki: 5,00 USD za wejście, 0,50 USD za wejście z pamięci podręcznej, 6,25 USD za zapisy do pamięci podręcznej, 25,00 USD za wyjście za 1 mln tokenów (własna tabela cen Ope​nAI, odczytana 2026-09-16). Powyżej 272 tys. tokenów wejściowych stawka Batch wynosi 10,00 USD / 1,00 USD / 12,50 USD / 37,50 USD.

Tryb szybki — podwójny standard: 20,00 USD za wejście, 2,00 USD za wejście z pamięci podręcznej, 25,00 USD za zapisy do pamięci podręcznej, 100,00 USD za wyjście za 1 mln (własna tabela cenowa Ope​nAI, odczyt 2026-09-16).

Specyfikacja modelu, która decyduje o wysokości rachunku — okno kontekstowe 1 050 000 tokenów, maksymalne wejście 922 000, maksymalne wyjście 128 000, data odcięcia wiedzy 2026-04-30, obsługa tokenów rozumowania: tak, wartości wysiłku rozumowania: low / medium / high / xhigh / max (dokumentacja własna modelu Ope​nAI, odczyt 2026-09-16).

Jeśli chcesz wersję w jednym zdaniu: w warstwie standardowej żądanie, które nie przekracza 272 tys. tokenów wejściowych, kosztuje 10 USD za milion tokenów wejściowych i 50 USD za milion tokenów wyjściowych, odczyty z pamięci podręcznej stanowią jedną dziesiątą stawki za wejście, a wszystko inne w tym artykule to albo zniżka za zaakceptowanie wolniejszego przetwarzania, albo dopłata za przekroczenie progu.

Dlaczego zobaczysz inną liczbę i która jest która

Pięć odrębnych czynników prowadzi do oferty, która nie opiewa na $10/$50. Cztery z nich możemy powiązać z dokumentacją; jednego nie możemy i powiemy o tym, zamiast zgadywać.

$5/$25 to poziom Batch i jest to cena samego Ope​nAI. To nie jest rabat odsprzedawcy ani wynegocjowana stawka enterprise. Strona cennika Ope​nAI podaje przetwarzanie wsadowe jako połowę standardowej stawki, a wiersz Batch dla Astra podaje 5,00 USD za dane wejściowe i 25,00 USD za dane wyjściowe. Jeśli jakieś źródło podaje ci $5/$25 tak, jakby chodziło o inny model, to ten sam model, te same wagi, w wolniejszej kolejce. Batch to właściwa odpowiedź w przypadku nocnych uruchomień ewaluacyjnych i zła odpowiedź w przypadku czegokolwiek interaktywnego.

11 USD i 55 USD to dokładnie 10% podwyżki względem ceny katalogowej, a Ope​nAI dokumentuje 10% podwyżkę dla punktów końcowych z rezydencją. Strona z cennikiem Ope​nAI podaje, że w przypadku punktów końcowych z rezydencją naliczana jest 10% podwyżka dla modeli wydanych 5 marca 2026 r. lub później. GPT-6 Astra został wydany 3 września 2026 r., więc się kwalifikuje. Pomnóż cenę katalogową przez 1,1, a otrzymasz 11,00 USD i 55,00 USD co do centa. To mocne wyjaśnienie, skąd bierze się wyższa oferta w stylu Azure — punkt końcowy związany z rezydencją objęty udokumentowaną podwyżką, a nie marża wymyślona przez resellera. Powinniśmy być precyzyjni co do ograniczenia tego twierdzenia: podwyżka jest udokumentowana przez Ope​nAI, a arytmetyka zgadza się dokładnie, ale konkretna oferta Azure, którą widzieliśmy, sama nie stwierdza, że jest to punkt końcowy z rezydencją. Traktuj to jako prawdopodobne wyjaśnienie, a nie potwierdzone.

$20/$100 to stawka trybu Fast OpenAI dla tego modelu. To ten, który najbardziej wygląda na fałszywą liczbę, a jest nią w najmniejszym stopniu. Tryb Fast podwaja każdą pozycję, a standardowy wiersz Fast Astry to 20,00 USD za wejście i 100,00 USD za wyjście za 1 mln. Endpoint podający $20/$100 podaje inny poziom usługi — przetwarzanie priorytetowe — a nie inną cenę katalogową i nie inny model. Jeśli zobaczysz tę kwotę obok nazwy Astry, pytanie, które trzeba zadać, brzmi: który poziom przetwarzania, a nie który dostawca.

Ceny poniżej ceny katalogowej istnieją i stanowią czyjąś marżę. Zewnętrzne bramy i resellerzy reklamują Astrę poniżej ceny katalogowej. Jedna z bram publicznie podaje stawkę o około 20% niższą od stawki Ope​nAI. To decyzja komercyjna tego operatora, a nie zmiana ceny ze strony Ope​nAI — i wiąże się z takimi warunkami przetwarzania danych i niezawodności, jakie stosuje ten operator. Nie zamierzamy ich wymieniać z nazwy ani traktować ich rabatu jako dowodu w sprawie ceny tego modelu, bo jest to dowód dotyczący ich działalności, a nie cennika Ope​nAI.

Czego nie udało nam się zweryfikować. Widzieliśmy listę routera, na której model podano jako gpt-6-astra z poziomem batch po $5/$25 oraz ruchomym aliasem w kształcie ~openai/gpt-astra-latest. Wartość dla batcha zgadza się ze stroną samego Ope​nAI. Alias to konstrukcja bramy: dokumentacja modeli Ope​nAI wymienia dokładnie jeden wpis w sekcji snapshotów i jest to samo gpt-6-astra, bez formy z datą i bez aliasu -latest. Nie wpisuj aliasu bramy do konfiguracji tak, jakby opublikował go dostawca. Osobno: nie znaleźliśmy żadnej dokumentacji Ope​nAI dla jakiegokolwiek osobno wycenianego poziomu „Astra Pro”, „Astra-Medium” czy podobnego. „Pro” pojawia się w nazewnictwie planów ChatGPT, a nie w cenniku API, a lista routera nie jest dokumentacją dostawcy. Jeśli chcesz potwierdzić jakiś poziom, potwierdź go na stronie samego Ope​nAI.

A single-column rate-card graphic for GPT-6 Astra listing Input $10.00 per 1M, Cached input $1.00 per 1M, Cache writes $12.50 per 1M, Output $50.00 per 1M, Over 272K input $20.00 / $75.00 per 1M, and Batch tier $5.00 / $25.00 per 1M, footnoted 'OpenAI standard rates read September 16, 2026. Batch is half the standard rate.'

Astra obok reszty cennika Ope​nAI

Cena ma sens tylko w zestawieniu z alternatywami na tej samej karcie. To wszystkie standardowe stawki samego OpenAI, wszystkie odczytane 16 września 2026 r., wszystkie za milion tokenów, wszystkie dla danych wejściowych do 272 tys. tokenów lub mniej.

GPT-6 Astra — $10.00 za dane wejściowe / $1.00 za dane z pamięci podręcznej / $12.50 za zapis / $50.00 za dane wyjściowe.

GPT-5.6 Sol — $4.00 za wejście / $0.40 za dane z pamięci podręcznej / $5.00 za zapis / $20.00 za wyjście.

GPT-5.6 Terra — $2.00 za wejście / $0.20 za dane z pamięci podręcznej / $2.50 za zapis / $12.00 za wyjście.

GPT-5.6 Luna — $0.20 za wejście / $0.02 za dane z pamięci podręcznej / $0.25 za zapis / $1.20 za wyjście.

Wersje z długim kontekstem — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80.

Pod tą tabelą działa promocja i to ona decyduje o mnożniku, o którym wszyscy się spierają. Strona cennika Ope​nAI wskazuje, że promocyjna cena GPT-5.6 Sol jest dostępna co najmniej do 21 listopada 2026 r. W porównaniu z promocyjną stawką obowiązującą dzisiaj, Astra wynosi 2,5x Sol w każdym pojedynczym wierszu — 2,5x na wejściu, 2,5x na wejściu z pamięci podręcznej, 2,5x na wyjściu. W porównaniu z niepromocyjną stawką Sol wynoszącą 5,00 USD za wejście i 30,00 USD za wyjście, Astra wynosi 2x na wejściu i około 1,67x na wyjściu. Oba mnożniki są arytmetycznie poprawne i opisują te same dwa modele tego samego dnia. Różnica polega wyłącznie na tym, którą stawkę Sol użyjesz jako mianownik, a uczciwa odpowiedź na pytanie „czy Astra to 2,5x Sol?” brzmi: tak, do 21 listopada 2026 r. albo do momentu, gdy Ope​nAI zakończy promocję, w zależności od tego, co nastąpi pierwsze.

Rozwijamy ten wątek tak obszernie, ponieważ to najczęstszy błąd w omówieniach tego modelu, także na tym blogu. Mnożnik na token, który po cichu wybiera jeden kurs Sol i nie nazywa go, nie jest faktem o Astrze. To fakt dotyczący tego, kiedy zdanie zostało napisane.

A screenshot of OpenAI's own API pricing page, captured September 16, 2026, showing short-context and long-context rates per 1M tokens for gpt-6-astra ($10.00 input, $1.00 cached input, $12.50 cache writes, $50.00 output; long context $20.00 / $2.00 / $25.00 / $75.00) alongside gpt-5.6-sol, gpt-5.6-terra and gpt-5.6-luna, with the page's notes that data-residency endpoints carry a 10% uplift for models released on or after March 5, 2026 and that GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026.

Koszt za zadanie, nie koszt za token

Samo stanowisko OpenAI jest takie, że porównywanie cen tokenów dla tego modelu to niewłaściwe porównanie, ponieważ Astra została zaprojektowana do wykonywania pracy o długim horyzoncie czasowym przy użyciu mniejszej liczby tokenów i z mniejszą liczbą ponownych prób. To twierdzenie warto potraktować wystarczająco poważnie, by przeprowadzić obliczenia, zamiast je powtarzać. Oto więc przykład obliczeniowy z założeniami podanymi na wstępie, abyś mógł je zmienić tak, by pasowały do własnego obciążenia.

Obciążenie: przebieg agenta na 200 wywołań, przypominający nocną migrację. Każde wywołanie obejmuje 10 000 tokenów wejściowych, z czego 8 000 to odczyty z pamięci podręcznej, a 2 000 to nowe tokeny, i generuje 500 tokenów wyjściowych. W całym przebiegu daje to 400 000 nowych tokenów wejściowych, 1 600 000 tokenów wejściowych z pamięci podręcznej i 100 000 tokenów wyjściowych, plus pojedynczy zapis 10 000 tokenów do pamięci podręcznej w celu zainicjowania prefiksu. Warstwa standardowa, poniżej 272 tys. na żądanie, więc nie obowiązuje dopłata za długi kontekst.

GPT-6 Astra — nowe 0,4 mln × 10,00 USD = 4,00 USD; z pamięci podręcznej 1,6 mln × 1,00 USD = 1,60 USD; zapis 0,01 mln × 12,50 USD = 0,13 USD; wyjście 0,1 mln × 50,00 USD = 5,00 USD. Razem 10,73 USD.

GPT-5.6 Sol w cenie promocyjnej — nowe $1.60; z pamięci podręcznej $0.64; zapis $0.05; wyjście $2.00. Razem $4.29.

GPT-5.6 Sol w cenie niepromocyjnej — świeże 2,00 USD; z pamięci podręcznej 0,80 USD; zapis 0,06 USD; wyjście 3,00 USD. Razem 5,86 USD.

GPT-5.6 Terra — świeże $0.80; z pamięci podręcznej $0.32; zapis $0.03; wyjście $1.20. Razem $2.35.

GPT-5.6 Luna — nowe $0.08; z cache $0.03; zapis $0.00; wyjście $0.12. Razem $0.23.

Zatem przy identycznej liczbie tokenów Astra to około 46x Luna i 4,6x Terra. Nikt nie kupuje Luny, żeby wykonywać zadanie wielkości Astry, a ten przypis jest całym powodem, dla którego porównania kosztu na token między tymi dwoma modelami to teatr. Porównanie z Sol jest tym, które coś rozstrzyga, więc oto liczba, która się liczy.

Próg wyrównania to 40%. Ponieważ Astra jest dokładnie 2,5 raza droższa od Sol w każdej pozycji przy promocyjnej stawce Sol, Astra może zużyć nawet 40% tokenów Sol na tym samym zadaniu i wciąż trafić na ten sam rachunek — i dotyczy to dowolnej kombinacji świeżego wejścia, wejścia z pamięci podręcznej i wyjścia, ponieważ proporcja jest jednolita. Jeśli Astra zużyje jedną trzecią tokenów Sol, wychodzi taniej; jeśli zużyje połowę, jest droższa. W zestawieniu z pozapromocyjną stawką Sol próg wyrównania łagodnieje do około 55% w tej kombinacji z dużym udziałem pamięci podręcznej, ponieważ mnożnik wyjścia Astry spada do 1,67x, a mnożnik wejścia spada do 2x.

Ta pojedyncza liczba jest tą przydatną i to tutaj deklaracja dostawcy i niezależny pomiar przestają się zgadzać. OpenAI podaje, że w Terminal-Bench 4.0 Astra osiąga 57,9% wobec 37,3% dla GPT-5.6 Sol, przy około 9% niższym szacowanym koszcie API na zadanie — dane dostawcy. Artificial Analysis w niezależnej ewaluacji opublikowanej 9 września 2026 r. zmierzyło, że Astra zużywa około jednej trzeciej tokenów Sol na zadanie w swoim Coding Agent Index, a mimo to ustaliło, że Astra kosztuje 7,09 USD za zadanie przy maksymalnym wysiłku — około 15% więcej niż Sol (max) — przy wyniku wyższym o 7 punktów. W swoim Intelligence Index ta sama ewaluacja umieściła Astrę między 0,82 USD a 3,26 USD za zadanie na różnych poziomach wysiłku, co oznacza około 60% wyższy koszt niż w przypadku Sol przy maksymalnym wysiłku.

Jedno i drugie może być prawdą jednocześnie, a różnica między nimi to uczciwy nagłówek. Oszczędności na tokenach są realne i duże — jedna trzecia to dokładnie ten rodzaj liczby, który przekracza próg rentowności na poziomie 40% — ale oszczędności mierzone na tokenach wyjściowych nie zmniejszają pozycji odczytu z pamięci podręcznej i świeżych danych wejściowych, które dominują w długiej sesji agenta. To, czy Astra jest tańsza na zadanie niż Sol, zależy od Twojej mieszanki obciążeń, a kierunek zmienia się między obciążeniami. Ktokolwiek mówi Ci, że jest po prostu tańsza albo po prostu 2,5 razy droższa, cytuje jedną pozycję z rachunku, jakby była sumą całkowitą.

Co tak naprawdę wpływa na wysokość rachunku w tym modelu?

Dominują trzy kwestie i wszystkie trzy są charakterystyczne dla tego, do czego Astra jest przeznaczona.

Tokeny rozumowania są tokenami wyjściowymi. Są rozliczane po 50,00 USD za milion, tak samo jak widoczne dane wyjściowe. Strona modelu Ope​nAI wymienia obsługiwane wartości wysiłku jako low, medium, high, xhigh i max, a nie ma ustawienia wyłączającego — dolny próg jest wyższy niż w starszych modelach. W niezależnym pomiarze Intelligence Index różnica między poziomami wysiłku low i max wynosiła od 0,82 USD do 3,26 USD na zadanie, czyli czterokrotność przy identycznej pracy. Poziom wysiłku to największa pojedyncza dźwignia kosztowa, jaką kontrolujesz, i warto ustawiać go dla każdego wywołania, a nie globalnie.

Ponowne próby mnożą wszystko. Agent, który zawiedzie i zostanie uruchomiony ponownie, płaci za cały prefiks jeszcze raz. To mechanizm stojący za twierdzeniem Ope​nAI o mniejszej liczbie ponownych prób i to także dlatego arytmetyka na tokenach myli w obu kierunkach: model, który kosztuje 2,5x za token, ale kończy w jednym przebiegu, może wygrać z tańszym modelem, który potrzebuje trzech. Jeśli oceniasz Astrę względem czegokolwiek, mierz ukończone zadania na dolara, a nie tokeny na dolara.

Długi kontekst to tryb zaprojektowany celowo i objęty dodatkową opłatą. Okno wynosi 1 050 000 tokenów. Przekrocz 272 000 tokenów wejściowych w pojedynczym żądaniu, a całe żądanie zostanie wycenione od nowa na 20,00 USD za wejście i 75,00 USD za wyjście za milion — nie tylko nadwyżka. Żądanie na 280 000 tokenów kosztuje około dwa razy więcej niż żądanie na 270 000 przy zaledwie około 4% większym wejściu. W modelu stworzonym do pracy długodystansowej to najprostszy sposób, by niepostrzeżenie przekroczyć budżet — i dlatego podzielenie zadania długodystansowego na żądania poniżej 272 tys. tokenów jest zwykle tańsze niż wysłanie go w całości, mimo że model jest w stanie przyjąć je w całości.

Przeciwwagą jest buforowanie i to właśnie tam długie sesje agentów faktycznie oszczędzają pieniądze. Odczyty z pamięci podręcznej kosztują 1,00 USD wobec 10,00 USD za świeże dane, czyli redukcja o 90%, a długa sesja ponownie wysyła ten sam prefiks dziesiątki razy. Zapis do pamięci podręcznej za 12,50 USD płaci się tylko raz. W powyższym przykładzie, gdyby każde wywołanie musiało ponownie wysyłać swój 8 000-tokenowy prefiks bez buforowania, rachunek firmy Astra wzrósłby z 10,73 USD do około 25,00 USD — pamięć podręczna robi więcej dla budżetu niż jakakolwiek inna pojedyncza pozycja.

Zapis dotyczący wielokrotności

Kilka stron na tym blogu, w tym GPT-6 Astra vs GPT-5.6 Sol: czy cena 2,5 razy wyższa jest tego warta? oraz Popyt na GPT-6 Astra wstrzymuje nowe zapisy do ChatGPT Pro za 200 USD, stwierdza, że Astra jest wyceniona na 2,5-krotność ceny tokenów GPT-5.6 Sol. Wartość tę obliczono na podstawie promocyjnej stawki Sol wynoszącej 4,00 USD za tokeny wejściowe i 20,00 USD za tokeny wyjściowe, która to stawka widnieje obecnie na stronie z cennikiem OpenAI i jest określana jako promocyjna, dostępna co najmniej do 21 listopada 2026 r.

Zatem ta wielokrotność nie przestała być prawdziwa — zyskała datę ważności, której wcześniejsze strony nie zawierały. W zestawieniu z niepromocyjną stawką Sol wynoszącą 5,00 USD za wejście i 30,00 USD za wyjście, Astra wypada na poziomie 2x dla wejścia i około 1,67x dla wyjścia, a nie 2,5x. Strony podające 2,5x należy czytać jako dotyczące okresu promocyjnego; kierunek porównania się nie zmienia, ale wielkość różnicy maleje o jedną piątą do jednej trzeciej w momencie zakończenia promocji. Każdy, kto planuje budżet po 21 listopada 2026 r., powinien przyjąć 5,00 USD i 30,00 USD jako mianownik dla Sol oraz 2x / 1,67x jako wielokrotność Astry. Nie powtarzamy argumentów z tych stron — rozumowanie dotyczące benchmarku i niezawodności tam zawarte broni się samo — korygujemy jedynie mianownik, względem którego je obliczono.

Pytanie o „free”, na które odpowiedziano bez ogródek

Nie ma darmowego planu dla tego modelu ani darmowej ścieżki API do niego. Użytkownicy ChatGPT w planach Free i Go nie dostają w ogóle GPT-6 Astra. Subskrybenci Plus otrzymują go tylko przez ChatGPT Work i Co​dex, a nie w zwykłym czacie. API jest rozliczane od pierwszego tokena po 10,00 USD za milion tokenów wejściowych, a najtańszym legalnym sposobem obniżenia tej kwoty jest poziom batch za 5,00 USD za milion, co kosztuje cię opóźnieniem, a nie możliwościami. Każdy, kto reklamuje darmowy dostęp do API GPT-6 Astra, odsprzedaje coś — zwykle pulę kredytów próbnych na bramie innej firmy z własnymi warunkami dotyczącymi danych. To niekoniecznie zła oferta, ale nie jest darmowa i nie pochodzi od Ope​nAI.

Warto wiedzieć, jeśli planujesz moce przerobowe w oparciu o subskrypcję, a nie API: 10 września 2026 r. Ope​nAI wstrzymało nowe rejestracje i ulepszenia do swojego planu ChatGPT Pro za 200 USD, powołując się na popyt na Astra. Plan za 100 USD, Plus, Go, API oraz konta Business i Enterprise pozostały otwarte. Konsumenci zostali objęci reglamentacją; dostęp przez API i dla przedsiębiorstw nie. Jeśli Twój plan zależy od limitu użycia subskrypcji konsumenckiej, to właśnie to ryzyko należy uwzględnić w modelu.

Routing tego i to, czego router nie naprawia

Astra to jeden z modeli dostępnych przez OrcaRouter w ramach openai/gpt-6-astra, w tej samej cenie 10,00 USD za wejście i 50,00 USD za wyjście, jaką pobiera dostawca, z progami powyżej 272K pokazanymi na naszej stronie modelu. Przekazujemy cenę katalogową dostawcy z 0% marży, co ma w przypadku tego modelu większe znaczenie niż w większości: liczby w tym artykule zmieniły się już raz w ciągu życia tego modelu, a cena przekazywana bezpośrednio zmienia się w dniu, w którym zmieni ją dostawca, a nie wtedy, gdy ktoś przypomni sobie o aktualizacji tabeli.

A screenshot of the OrcaRouter model page for GPT-6 Astra, model id openai/gpt-6-astra, captured September 16, 2026, showing $10.00 per 1M input tokens and $50.00 per 1M output tokens, a 1M-token context window, 128K maximum output, text, image and file input, p50 time to first token of 6.70 s and 181.0M tokens of traffic over 7 days.

Uczciwym argumentem za routingiem tutaj nie jest cena, bo nie ma żadnej zniżki, którą moglibyśmy ci sprzedać — chodzi o to, że powyższa kalkulacja kosztów zależy od obciążenia i nie będziesz wiedzieć, po której stronie progu rentowności 40% wylądujesz, dopóki tego nie uruchomisz. Umieszczenie Astry za jednym punktem końcowym obok Sol, Terra i Luna oznacza, że możesz mierzyć liczbę ukończonych zadań na dolara na własnym ruchu i przełączać modele bez drugiej umowy czy zmiany kodu. DSL routingu pozwala złożyć wywołanie obejmujące kilka modeli zamiast przypisywać ścieżkę produkcyjną do jednego, a automatyczny failover obejmuje przypadek, który ten model już dwukrotnie zademonstrował — że popyt na niego może przerosnąć przepustowość.

Kompromisy są równie realne i warte nazwania. Router to jeden skok na ścieżce żądania, a w modelu, którego atutem jest autonomiczna praca w długim horyzoncie, ten skok jest kolejnym elementem w domenie awarii; jeśli twoja tolerancja na to wynosi zero, skontaktuj się bezpośrednio z dostawcą. Kilka rzeczy w tym artykule istnieje wyłącznie w przypadku bezpośredniej relacji: opcja Zero Data Retention, którą OpenAI oferuje kwalifikującym się klientom API w obsługiwanych punktach końcowych, wymaga zgody OpenAI, a włączenie funkcji dla przedsiębiorstw — domyślnie wyłączone przy uruchomieniu i włączane przez administratorów zgodnie z ich obowiązującym cennikiem — jest umową między tobą a OpenAI, a nie czymś, co może przyznać router. OpenAI dokumentuje również, że tryb Fast dla tego modelu jest niedostępny przy rezydencji danych w UE, więc jeśli potrzebujesz jednocześnie rezydencji i szybkości, to ograniczenie dotyczy modelu, a nie trasy. A zerowy narzut routera nie jest rabatem: nie jesteśmy tańsi niż przy bezpośredniej współpracy, mamy tę samą cenę przy mniejszej liczbie integracji do utrzymania.

Co obejrzeć

Jedna data i jedna liczba. Data to 21 listopada 2026 r., kiedy promocyjne ceny Sol nie będą już gwarantowane — jeśli wygasną, mnożnik Astry względem Sol spadnie z 2,5x do 2x na wejściu i 1,67x na wyjściu, a każde krążące porównanie kosztu na zadanie stanie się o jedną piątą do jednej trzeciej bardziej korzystne dla Astry, choć w samej Astrze nie zmieni się ani jedna rzecz. Liczba to twój własny próg opłacalności: uruchom jedno reprezentatywne zadanie długiego horyzontu na obu modelach, policz ukończone zadania i łączne dolary, a otrzymasz odpowiedź użyteczniejszą niż cokolwiek opublikowane, w tym ta strona.

Umieszczenie Astra za jednym punktem końcowym obok Sol, Terra i Luna oznacza, że możesz mierzyć ukończone zadania na dolara na własnym ruchu i przełączać modele bez drugiej umowy ani zmiany w kodzie.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie