
Dots kontra Grok 4.6: Agent, który sam umawia sobie spotkania, przeciwko modelowi, który odpowiada
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 349 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 210 tok/s
- OrcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- xAISpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
Spróbuj napisać numer telefonu dla kropki, a poniesiesz porażkę, i ta porażka jest najbardziej użyteczną rzeczą w tej parze. Dots to stale aktywny agent firmy, ogłoszony na DevDay 29 września 2026 r.: każda kropka otrzymuje własny komputer w chmurze i przeglądarkę, łączy się z ponad 4 000 aplikacjami i jest dostępna w ChatGPT, Slack i Teams, działa na GPT-6 Astra i jest wliczona w Pro i Business Premium bez dodatkowej opłaty. Grok 4.6 to czołowy model SpaceXAI, opublikowany 12 sierpnia 2026 r., i jest zupełnie innym rodzajem obiektu: okno kontekstowe o rozmiarze 500 000 tokenów, wejście tekstowe, obrazowe i plikowe z wyjściem tekstowym, konfigurowalny poziom wysiłku rozumowania, natywne wywoływanie narzędzi i ustrukturyzowane dane wyjściowe, w cenie 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych przy prompcie poniżej 200 000 tokenów, a powyżej tej wartości dwukrotnie więcej. Jeden z nich to współpracownik z harmonogramem. Drugi to funkcja, którą wywołujesz.
Oba naprawdę dobrze radzą sobie z pracą agentową, i właśnie dlatego to zamieszanie jest takie powszechne. Grok 4.6 osiąga 88,4 w Terminal-Bench 2.1 oraz 50,7 w wycinku τ-banking dotyczącym użycia narzędzi — liczby, które sprawiają, że model bywa opisywany jako „agent”. Nie jest nim. To silnik rozumowania, z którego dopiero buduje się takiego agenta.
Czym każdy z nich właściwie jest
• Tożsamość — hostowany produkt bez identyfikatora modelu, do którego można się zwracać (Dots), w przeciwieństwie do nazwanego, routowalnego modelu ze stabilnym ciągiem znaków, który można umieścić w pliku konfiguracyjnym (Grok 4.6)
• Gdzie odbywa się wykonanie — na komputerze w chmurze OpenAI, z własną przeglądarką, odizolowanym od twojej maszyny, chyba że je połączysz (Dots) — w przeciwieństwie do tego, gdzie uruchamiasz wywołanie: kontener, który kontrolujesz, worker kolejki, zadanie cron (Grok 4.6)
• Zasięg — ponad 4000 aplikacji przez konektory OpenAI (Dots) w porównaniu do dowolnych narzędzi, które sam podłączysz, ponieważ wywoływanie narzędzi to protokół, a nie katalog (Grok 4.6)
Pamięć zadania — przenoszona przez produkt przez dni, aplikacje i nowe wątki (Dots) w porównaniu z oknem 500 000 tokenów i tym, co sam utrwalisz (Grok 4.6)
• Koszt — wliczony w subskrypcję, przydział nieujawniony (Dots) w porównaniu z 2,00 USD i 6,00 USD za milion tokenów, podwajany po przekroczeniu 200 000 tokenów wejściowych, z odczytami z pamięci podręcznej po 0,50 USD (Grok 4.6)
• Dowody — demonstracja dostawcy i deklaracje możliwości, brak niezależnego benchmarku (Dots) w zestawieniu z wynikiem 76,8 w Artificial Analysis Coding Index — piątym spośród 138 zmierzonych modeli — oraz 94,9 w GPQA Diamond (Grok 4.6)
Liczba, która rozstrzyga większość kwestii: limit.
OpenAI opublikowało jedną cenę za kropki i nie jest to cena w żadnej jednostce, w której można mierzyć pracę. Pierwsza kropka jest wliczona w Pro lub Business Premium; rozmowy z nią nie zużywają limitów użytkowania ChatGPT; rozszerzone limity obowiązują w pierwszym miesiącu. To cała opublikowana struktura kosztów. Brak liczby przydziału, brak ceny drugiej kropki, brak stawki za zadanie, brak ceny Enterprise dla wyspecjalizowanych kropek, o których mówi się, że są w testach wewnętrznych. Relacja CNBC z prezentacji głównej podaje, że dyrektor finansowa Sarah Friar wycenia plan Pro 500 za 500 dolarów miesięcznie jako dodatek na użytkowanie plus nowy tryb Ultrafast, a nie jako stawkę za kropkę, co oznacza, że najdroższy plan w cenniku OpenAI nadal nie daje kosztu na jednostkę pracy agenta.
Grok 4.6 idzie w przeciwnym kierunku i publikuje wszystko, w tym tę część, która boli. Granica poziomu przy 200 000 tokenów wejściowych to przepaść: żądanie na 199 000 tokenów jest rozliczane po połowie stawki tego na 201 000. To nie jest ukryta pułapka, to liczba w cenniku i zmienia sposób projektowania zadania z długim kontekstem. Dzielisz na fragmenty na granicy albo świadomie akceptujesz drugi poziom.

Następca został wydany, gdy porównywano tę parę
Grok 4.7 został wydany 21 września 2026 r. i jest teraz flagowym modelem linii Grok, z tym samym kontekstem 500 000 tokenów, tym samym interfejsem wejściowym, tym samym podstawowym cennikiem i znacznie większym maksymalnym wyjściem wynoszącym 450 000 tokenów. Grok 4.6 pozostaje dostępny i nadal jest wymieniany jako aktualny model — podniesienie wersji nie jest wycofaniem — ale każdy, kto dziś wybiera model Grok, powinien wybierać między 4.6 a 4.7, zamiast zakładać, że 4.6 to czołówka. Powód, by powiedzieć to wprost, jest taki, że artykuł, który czytasz, dotyczy porównania, które przetrwa tę zmianę: niezależnie od tego, jak w przyszłym kwartale będzie się nazywał najwyższy model linii Grok, to nadal model rozliczany według cennika, a dot to nadal subskrypcja z niepublikowanym limitem.
To także argument za kierowaniem wywołań modelu przez abstrakcję, a nie przez dostawcę zaszytego na stałe. Gdy pojawi się następca, zmiana modelu to edycja jednej linijki, a nie migracja.

Budowanie agenta zamiast wynajmowania go
Ciekawym następstwem tego połączenia jest to, że Grok 4.6 pozwala zbudować to, co sprzedaje Dots — najpierw kiepsko, a potem lepiej. Pętla, która odczytuje kolejkę, wywołuje model z dołączonymi narzędziami, zapisuje wyniki i ponawia próbę w razie niepowodzenia, nie jest trudna; trudne są te części, które dot daje za darmo — przeglądarka zachowująca się jak u człowieka, konektory napisane przez dostawców aplikacji, przepływ zatwierdzania i dziennik aktywności. Są warte subskrypcji właśnie dlatego, że są żmudne.
Tam, gdzie wygrywa strona rozliczana, jest moment, w którym praca przestaje być generyczna. Moment, w którym potrzebujesz, aby to samo wywołanie mogło działać z innym dostawcą w następnym kwartale, zostać odtworzone z logu, wycenione co do centa lub przełączone awaryjnie na tańsze rodzeństwo w trakcie, gdy dostawca nadrzędny szwankuje. Na OrcaRouter Grok 4.6 jest udostępniany jako grok/grok-4.6 w cenie katalogowej SpaceXAI z 0% marży dodatkowo — stawka samego dostawcy, przekazywana dalej, więc obniżka ceny dostawcy trafia na twoje rozliczenie tego samego dnia — w tym samym katalogu co ponad 200 innych modeli za jednym kluczem, z automatycznym przełączaniem awaryjnym i DSL routingu do komponowania kilku modeli w jedno wywołanie. Nie ma odpowiednika dla kropki: żadnego endpointu, żadnego identyfikatora, niczego, na co można by przełączyć awaryjnie.
Test do zastosowania
Zapytaj, czy dana praca nadal by istniała, gdyby nikt na nią nie patrzył. Jeśli odpowiedź brzmi tak — musi odbywać się zgodnie z harmonogramem, w kilku narzędziach, bez osoby otwierającej okno czatu — dot jest produktem stworzonym właśnie do tego, a model rozliczany jest komponentem wewnątrz tego, co zbudujesz. Jeśli odpowiedź brzmi nie, jeśli ktoś czeka na wynik, a wynik ma format i termin, to model rozliczany jest właściwym zakupem, a agent to kosztowny objazd.
Błędem, którego warto uniknąć, jest kupowanie Dot, aby uzyskać lepszą odpowiedź. Dot nie jest mądrzejszym modelem; to dłuższa smycz przypięta do modelu. A drugim błędem jest płacenie za subskrypcję, aby uzyskać możliwość, którą cennik już sprzedaje ci za token, a arytmetyka jest widoczna z góry.

Porównane w tym artykule2
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
