
Czym jest Grok 4.5? Flagowiec V9, który sprzedał ekonomię tokenów zamiast najwyższych wyników
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Grok 4.5 to model rozumowania oparty na mieszaninie ekspertów o 1,5 biliona parametrów od dostawcy — firmy, która obecnie dostarcza i promuje pod marką SpaceXAI — wydany 8 lipca 2026 r. Przyjmuje na wejściu tekst i obrazy, zwraca tekst, ma okno kontekstowe o rozmiarze 500 000 tokenów, a jego cena katalogowa to 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych. To ten model wyniósł „tokeny na ukończone zadanie” na pierwszy plan slajdu premiery i to jest model, na którym laboratorium zbudowało od tego czasu dwa nowsze flagowe modele.
Ta ostatnia klauzula to cały powód, dla którego ta strona musi powstać. Wpisz w wyszukiwarkę „Grok 4.5” i dostaniesz materiały z premiery z lipca: partnerstwo z Cursor, cytat „Opus-class”, twierdzenie o 80 tokenach na sekundę. Czego nie dostaniesz, to bezpośredniej odpowiedzi na pytanie, które deweloper faktycznie ma pod koniec września: czy Grok 4.5 wciąż warto podłączać do czegokolwiek, skoro istnieją Grok 4.6 i Grok 4.7 w tej samej cenie katalogowej. Ta strona jest więc wpisem referencyjnym, a nie artykułem newsowym: czym jest model, gdzie się plasuje, co mierzalnie robi dobrze, co mierzalnie robi źle i kto powinien wybrać coś innego. Nic tutaj nie jest przedstawiane jako premiera, bo nią nie jest.
Jeśli chodzi o źródła — ponieważ na stronie takiej jak ta ma to większe znaczenie niż zwykle — każda liczba poniżej jest oznaczona informacją, skąd pochodzi. Liczby, które xAI opublikowało na temat własnego modelu, są oznaczone jako zgłoszone przez dostawcę. Liczby pochodzące z Artificial Analysis to niezależne pomiary, odczytane bezpośrednio ze strony modelu w dniu 23 września 2026 r. Jeśli jakiejś liczby nie można było potwierdzić w źródle pierwotnym, strona mówi o tym, zamiast szacować.
Gdzie Grok 4.5 plasuje się w swojej własnej rodzinie — i nie zajmuje najwyższej pozycji
Najczęstszym błędem w omówieniach Grok 4.5 jest traktowanie go jako flagowca. Był nim przez około pięć tygodni. Od tego czasu xAI wypuściło Grok 4.6 12 sierpnia 2026 r. i Grok 4.7 na początku września; oba wciąż kosztują 2,00 i 6,00 USD za milion tokenów. Grok 4.5 jest teraz pośrodku stosu: ma większe możliwości niż tania warstwa, jest o dwie generacje za czołówką i — to jest ta część, która ma znaczenie — jest jedynym modelem w obecnej linii Grok, którego stawka za wejście z pamięci podręcznej jest niższa niż u jego następców. Grok 4.5 ma cache w cenie 0,30 USD za milion tokenów; Grok 4.6 i Grok 4.7 mają cache w cenie 0,50 USD, zgodnie z tabelą cenową samego xAI.
Oto zestawienie, tak jak obecnie wymienia je dokumentacja cenowa dostawcy — wszystkie wartości w przeliczeniu na milion tokenów i wszystkie opublikowane przez dostawcę:
• Grok 4.20 (trzy warianty: wieloagentowy, rozumujący, nierozumujący) — kontekst 1M, $1,25 za wejście / $2,50 za wyjście, $0,20 za pamięć podręczną, wydany 31 marca 2026
• Grok 4.3 — kontekst 1 mln, 1,25 USD za wejście / 2,50 USD za wyjście, 0,20 USD za dane z pamięci podręcznej, plus zniżka za przetwarzanie wsadowe; najtańszy sposób na uzyskanie miliona tokenów kontekstu Grok
• Grok 4.5 — 500K kontekstu, $2,00 za wejście / $6,00 za wyjście, $0,30 buforowane, wydany 8 lipca 2026
• Grok 4.6 — kontekst 500 tys., 2,00 USD za wejście / 6,00 USD za wyjście, 0,50 USD za pamięć podręczną, wydany 12 sierpnia 2026
• Grok 4.7 — kontekst 500K, 2,00 USD za wejście / 6,00 USD za wyjście, 0,50 USD z pamięci podręcznej, wydany na początku września 2026
• Grok Build 0.1 — kontekst 256K, 1,00 USD za wejście / 2,00 USD za wyjście, specjalista od kodowania, a nie model ogólnego przeznaczenia
Z tej listy wynikają dwie rzeczy. Po pierwsze, Grok 4.5 nie dostał obniżki ceny, gdy przestał być flagowcem — zachował cenę flagowca, co oznacza, że Grok 4.6 oferuje teraz zdecydowanie lepszy stosunek wartości do ceny za te same pieniądze, chyba że konkretnie chcesz tańszej stawki za cache albo jesteś przypięty do snapshotu 4.5. Po drugie, Grok 4.5 ma o połowę mniejszy kontekst niż Grok 4.3 i rodzina 4.20, przy dwukrotnie wyższej cenie wejściowej. Powodem jest fundament V9: 1,5 biliona parametrów, około trzy razy więcej niż w Grok 4.3, a większy model bazowy to właśnie on pozwolił uzyskać tę możliwość kosztem okna kontekstowego.
Jeśli tak naprawdę potrzebujesz długiego kontekstu przy ograniczonym budżecie, uczciwą odpowiedzią w tej rodzinie jest Grok 4.3, a nie Grok 4.5. Ten kompromis — możliwości kontra okno — to decydujący wybór w linii Grok i warto powiedzieć to wprost, zamiast udawać, że nowszy numer jest lepszy we wszystkim.
Arkusz specyfikacji

To specyfikacje, które xAI publikuje na własnej stronie modelu, a nie szacunki stron trzecich:
• Identyfikator modelu — grok-4.5, z aliasami grok-4.5-latest i grok-build-latest
• Modalność — tekst i obraz na wejściu, tekst na wyjściu. Obrazy są akceptowane jako dane wejściowe; model ich nie generuje
• Okno kontekstu — 500 000 tokenów, współdzielonych między promptem a odpowiedzią, a nie 500 tys. na wejściu plus osobny limit wyjściowy
• Licencja — zastrzeżona. Nie ma otwartych wag ani checkpointu do pobrania; do Grok 4.5 uzyskujesz dostęp przez API lub przez własne produkty dostawcy
• Cena katalogowa — 2,00 USD za milion tokenów wejściowych, 6,00 USD za milion tokenów wyjściowych, 0,30 USD za milion tokenów wejściowych z pamięci podręcznej
• Cennik dla długiego kontekstu — przy 200 000 tokenów promptu i powyżej stawka wzrasta do 4,00 USD za tokeny wejściowe / 12,00 USD za tokeny wyjściowe / 0,60 USD za tokeny z pamięci podręcznej, a wyższa stawka dotyczy każdego tokena w żądaniu, nie tylko tokenów powyżej progu. To absolutnie najkosztowniejszy szczegół na stronie, który można przeoczyć
• Kontrola rozumowania — cztery poziomy: low, medium, high i xhigh, domyślnie high. Rozumowania nie można całkowicie wyłączyć, a tokeny rozumowania są rozliczane jako tokeny wyjściowe
• Wsparcie narzędzi i formatów — wywoływanie funkcji i ustrukturyzowane dane wyjściowe są obsługiwane natywnie. Narzędzia wyszukiwania po stronie serwera są rozliczane dodatkowo ponad zużycie tokenów; nie udało się potwierdzić aktualnych stawek za wywołanie na stronie modelu dostawcy, jedynie to, że istnieją
• Limity szybkości — 150 żądań na sekundę i 50 milionów tokenów na minutę
• Batch API — nieobsługiwane w Grok 4.5, w przeciwieństwie do Grok 4.3
• Obsługiwane regiony — us-east-1 i us-west-2 w momencie uruchomienia. Europejska dostępność była wprost niedostępna pierwszego dnia i została opisana przez dostawcę jako przewidywana na połowę lipca 2026 r.; nie znaleźliśmy późniejszego oświadczenia z pierwotnego źródła potwierdzającego dokładną datę jej uruchomienia, więc traktuj harmonogram UE jako niepotwierdzony w tym miejscu.
Jedną rozbieżność warto odnotować, a nie wygładzać: własny wpis katalogowy OrcaRouter dla grok/grok-4.5 podaje stawkę odczytu z pamięci podręcznej w wysokości $0.50 za milion, co odpowiada temu, co xAI pobiera za Grok 4.6 i Grok 4.7, a nie $0.30, które tabela cenowa dostawcy podaje dla Grok 4.5. Dokumentacja dostawcy jest źródłem wiążącym w kwestii ceny; nasza strona zdaje się zawierać stawkę pamięci podręcznej następcy i została ona oznaczona, a nie po cichu tu powtórzona.
W czym Grok 4.5 jest mierzalnie dobry
Głównym hasłem przy premierze była ekonomia tokenów i to jedyne twierdzenie na stronie premiery, za którym stoi jakiś mechanizm, a nie tylko wynik. W SWE-bench Pro xAI podaje, że Grok 4.5 zużywa średnio 15 954 tokeny wyjściowe na rozwiązane zadanie wobec 67 020 w przypadku Claude Opus 4.8 działającego z maksymalnym wysiłkiem — około 4,2 razy mniej tokenów na wykonanie tej samej pracy. Mniejsza liczba tokenów wyjściowych na rozwiązane zadanie to różnica między modelem, który jest tańszy, a modelem, który jest tańszy i szybszy w czasie rzeczywistym, bo to właśnie na tokeny wyjściowe się czeka. Zgłoszone przez dostawcę, na jego własnym środowisku testowym i niepowtórzone przez nikogo niezależnego — ale to twierdzenie strukturalne, a nie wyselekcjonowany procent.
Tabela wyników testów porównawczych dostawcy, opublikowana wraz z modelem i w związku z tym w całości pochodząca od dostawcy, przedstawia się następująco w zestawieniu z tymi samymi modelami:
• DeepSWE 1.0 — Grok 4.5 62,0%, za Claude Fable 5 z 66,1% i GPT-5.5 z 64,31%, przed Claude Opus 4.8 z 55,75%
• SWE Marathon, wskaźnik rozwiązanych zadań — Grok 4.5 29,0%, wyprzedzając Claude Opus 4.8 z 26,0% i Claude Fable 5 z 24,0%. To jedyny benchmark programistyczny, w którym Grok 4.5 prowadził stawkę.
• Terminal-Bench 2.1 — Grok 4.5 83,3%, praktycznie na równi z Claude Fable 5 (84,3%) i GPT-5.5 (83,4%), przed Claude Opus 4.8 (78,9%)
• DeepSWE 1.1 — Grok 4.5 53%, za Claude Fable 5 z 70% i GPT-5.5 z 67%
• SWE-bench Pro — Grok 4.5 64,7%, za Claude Fable 5 z 80,4% i Claude Opus 4.8 z 69,2%
Uczciwa interpretacja jest taka, że Grok 4.5 wygrywa w rozwiązywaniu zadań o długim horyzoncie oraz w ekonomice kończenia zadania, a przegrywa w trudniejszych jednorazowych benchmarkach kodowania. To dobry model do pętli agentowych i przeciętny do trudnych problemów jednorazowych — a ta różnica jest dokładnie tym, czym według wskaźnika efektywności tokenowej powinna być.

Niezależny obraz jest uboższy i to właśnie tutaj ta strona musi zachować ostrożność. Artificial Analysis obecnie podaje dla Grok 4.5 (high) wynik 39 w Intelligence Index, pozycję #52 spośród 212 modeli, w wersji indeksu v4.3.2 — powyżej mediany 25 dla porównywalnych modeli, ale nie w czołówce. Jeśli w lipcowych materiałach widziałeś podawany dla tego modelu wynik 54 lub 56, nie porównuj go z 39: Artificial Analysis zrewidowało indeks od czasu premiery i te dwie liczby pochodzą z różnych wersji. To dokładnie ten rodzaj porównywania nieaktualnych liczb, który sprawia, że tabele benchmarków są niewiarygodne, i dlatego ta strona podaje wersję indeksu obok wyniku.
W czym Grok 4.5 jest mierzalnie słaby
Artificial Analysis podaje prędkość generowania wynoszącą 55,1 tokena na sekundę, co daje 126. miejsce wśród 212 modeli i wynik poniżej mediany wynoszącej 74 — daleko od 80 tokenów na sekundę, które xAI podawało przy premierze, i jeszcze dalej od ok. 340 tokenów na sekundę, jakie osiągają najszybsze obecne modele. Podaje też czas do pierwszego tokena wynoszący 10,94 sekundy wobec mediany 3,86 sekundy. Te dwie liczby razem opisują prawdziwy koszt modelu rozumującego, który domyślnie działa na wysokimpoziomie i którego nie można wyłączyć: najpierw czekasz, a potem mówi powoli. Zostaw domyślny poziom rozumowania, a Grok 4.5 będzie sprawiał wrażenie najwolniejszego modelu, jaki masz na kluczu.
Trzy kolejne wyważone negatywy, w kolejności od tego, jak bardzo powinny wpływać na decyzję:
• Artificial Analysis oznaczyło Grok 4.5 jako przestarzały i twierdzi, że nadal testuje go wyłącznie przy domyślnym obciążeniu wejściowym wynoszącym 10 000 tokenów. To strona trzecia, która mówi ci, że przestała w pełni mierzyć model, który rozważasz, i zamiast tego zaleca Grok 4.6. Status przestarzały na liście rankingowej nie oznacza niedostępności w API — oznacza, że niezależna baza dowodów została zamrożona.
• Przegrywa w dwóch benchmarkach, które najbardziej przypominają trudne, jednorazowe kodowanie — DeepSWE 1.1 i SWE-bench Pro — zarówno z Claude Fable 5, jak i z GPT-5.5, zgodnie z własną tabelą xAI
• Ma o połowę mniejszy kontekst niż Grok 4.3 przy dwukrotnie wyższej cenie danych wejściowych i w ogóle nie ma API wsadowego. Jeśli Twoje obciążenie obejmuje przetwarzanie długich dokumentów lub wsadowe wnioskowanie offline, Grok 4.5 jest złym modelem we własnej rodzinie
Jeśli chodzi o halucynacje i kalibrację, ta strona nie mogła potwierdzić aktualnej niezależnej wartości. W lipcowych doniesieniach krążył wskaźnik halucynacji na poziomie około 54%, ale nie mogliśmy zweryfikować tej liczby na czytanej przez nas stronie modelu Artificial Analysis i nie pojawia się ona również na stronie dostawcy. Zamiast powtarzać wartość, dla której nie możemy podać źródła, zapisujemy ją tutaj jako niezmierzoną.
Kto powinien wybrać Grok 4.5, a kto powinien wybrać coś innego
Wybierz Grok 4.5, jeśli uruchamiasz pętle agentowe, w których koszt przypadający na ukończone zadanie liczy się bardziej niż koszt na token, i jeśli już zmierzyłeś, że zachowanie gospodarki tokenowej V9 utrzymuje się w Twoim obciążeniu. To również właściwy wybór, jeśli potrzebujesz snapshotu z rodziny Grok ze stawką 0,30 USD za buforowane wejście przy dużym, stabilnym, wielokrotnie trafianym prefiksie — ta stawka za pamięć podręczną jest naprawdę niższa niż to, co pobierają Grok 4.6 i Grok 4.7, a przy obciążeniu mocno opartym na pamięci podręcznej ta różnica może przeważyć nad dwiema generacjami możliwości.
Zamiast tego wybierz Grok 4.6 lub Grok 4.7 do prawie wszystkiego innego. Ta sama cena katalogowa, to samo okno 500K, nowszy trening, lepsze niezależne wyniki i własna rekomendacja Artificial Analysis. Nie ma takiej wersji „chcę najlepszego Groka”, w której odpowiedzią dzisiaj jest 4.5.
Wybierz Grok 4.3, jeśli ograniczeniem jest kontekst: 1 mln tokenów w cenie 1,25 i 2,50 USD, z rabatem za przetwarzanie wsadowe, którego Grok 4.5 nie oferuje. RAG na długich dokumentach i analiza całego repozytorium to wciąż jego domena.
Wybierz coś spoza rodziny, jeśli optymalizujesz pod kątem szczytowego wyniku, a nie ceny za zadanie — Claude Fable 5 prowadzi w każdym benchmarku kodowania we własnej tabeli porównawczej xAI, a GPT-5.5 plasuje się przed Grok 4.5 w DeepSWE 1.0 i 1.1. Jeśli chcesz otwartych wag i możesz zaakceptować mniejszy model, to zupełnie inna kategoria zakupu i żaden model Grok nie jest w niej konkurencją.
Wywoływanie Grok 4.5 bez drugiej umowy
Grok 4.5 jest już dostępny w OrcaRouter w cenie katalogowej xAI, a stawka dostawcy jest przekazywana z zerową marżą — więc podane powyżej 2,00 USD i 6,00 USD to dokładnie to, co płacisz, a zmiana ceny przez dostawcę trafia po naszej stronie tego samego dnia, w którym trafia po ich stronie. Ma to większe znaczenie niż zwykle w przypadku tego konkretnego modelu, ponieważ decyzja stojąca przed większością czytelników to nie „Grok 4.5 albo nic”, lecz „Grok 4.5 albo Grok 4.6 albo Grok 4.3”, a porównanie trzech modeli z jednej rodziny to dokładnie to, co pojedynczy endpoint obejmujący ponad 200 modeli czyni tanim. Jeden klucz, bez drugiej umowy i test A/B, który jest zmianą ciągu znaków, a nie integracją.
Argument za przełączaniem awaryjnym jest tu nietypowo konkretny. Grok 4.5 wciąż nadaje się do kierowania ruchu, ale nie jest już w pełni benchmarkowany przez niezależnych śledzących i nie jest już flagowym modelem dostawcy — to model, który warto mieć w łańcuchu zapasowym, a nie jako jedyną ścieżkę. Automatyczne przełączanie awaryjne między dostawcami to mechanizm, który pozwala zachować go do tego, w czym jest dobry, bez stawiania produkcyjnej trasy na migawce, którą ekosystem zaczął już pomijać.
To, czego ta strona nie zrobi, to udawanie, że wybór jest oczywisty. Grok 4.5 to dobry model o konkretnej mocnej stronie, należący do rodziny, w której za te same pieniądze można teraz dostać nowszy model. Jeśli zaczynasz dziś od zera, uczciwa rekomendacja brzmi: Grok 4.6. Jeśli już używasz Grok 4.5 w pętli agenta i kończy on zadania przy liczbie tokenów, na którą przeznaczyłeś budżet, uczciwa rekomendacja to nic nie zmieniać i ponownie to zmierzyć za kwartał.

Grok 4.5 można dziś kierować przez OrcaRouter, podobnie jak Grok 4.6, Grok 4.7 i Grok 4.3. OrcaRouter przekazuje cenę katalogową dostawcy bez marży, więc zmiana ceny przez dostawcę trafia po naszej stronie tego samego dnia, co po ich stronie, a przeniesienie obciążenia między dwoma modelami Grok to zmiana ciągu znaków, a nie druga umowa.
Porównane w tym artykule4
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
