
Mercury 2.5 Preview kontra Grok 4.6: Czy wersja zapoznawcza o prędkości 1 107 tokenów/s pobije mistrza wartości?
- AlibabaNOWOŚĆQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiNOWOŚĆZ.ai: GLM 5.3 Flash2026-08-2658Inteligencja72Kod
- DeepSeekNOWOŚĆDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1860Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1552Inteligencja68Kod
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1261Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0557Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencja69Kod
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencja49Kod
- metaMeta: Muse Spark 1.12026-07-1653Inteligencja71Kod
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencja76Kod
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencja71Kod
Oto odpowiedź w jednym zdaniu: Mercury 2.5 Preview to najtańszy wiarygodny model rozumowania dostępny obecnie w produkcji, w cenie 0,04 USD / 0,15 USD za milion tokenów, a Grok 4.6 to najtańszy model na granicy inteligencji, w cenie 2,00 USD / 6,00 USD — więc praktyczne pytanie między nimi brzmi, czy zapowiadany model dyfuzyjny, który Inception jedynie określa jako „porównywalny z” GPT-5.6 Luna (Low) i Claude Haiku 4.5, wykona zadania, za które w przeciwnym razie płaciłbyś stawkę z najwyższej półki. Mercury 2.5 Preview, wydany 31 sierpnia 2026 r., generuje tokeny równolegle i deklaruje 1107 tokenów na sekundę na standardowych procesorach graficznych; Grok 4.6, flagowy model z czołówki, wydany 12 sierpnia 2026 r., uzyskuje 61 punktów w indeksie Artificial Analysis Intelligence Index, ex aequo 3. miejsce na świecie, i robi to w cenie niespotykanej dotąd na tej półce. To zderzenie — najszybsza deklaracja na dole krzywej cenowej spotykająca się z najlepszą wartością na jej szczycie — jest tematem tego artykułu.
Najważniejsze wnioski
• Grok 4.6 za 2,00 $ / 6,00 $ ze wskaźnikiem inteligencji AA wynoszącym 61 to mistrz wartości w czołówce modeli; Mercury 2.5 Preview za 0,04 $ / 0,15 $ to zakład, że wystarczająco dobra jakość za 1/50 ceny pokona czołową jakość, której rzadko potrzebujesz.
Twierdzenia dotyczące szybkości i jakości Mercury 2.5 Preview pochodzą wyłącznie od Inception; pierwszego dnia nie było żadnych niezależnych wyników benchmarków.
• 80% rabat z okazji premiery Mercury 2.5 Preview wygasa 8 września 2026, po czym jego cena katalogowa wyniesie $0.20 / $0.75 — nadal 10× taniej niż Grok 4.6 na wejściu, ale to mniejsza historia.
• Grok 4.6 jest dziś trasowany przez OrcaRouter po cenie katalogowej; Mercury 2.5 Preview nie jest jeszcze trasowany i jest udostępniany przez własne API Inception oraz kilka platform zewnętrznych.
Tablica wyników

• Inteligencja — Mercury 2.5 Preview: brak niezależnego indeksu; Inception twierdzi, że osiąga parytet z warstwą zoptymalizowaną pod kątem kosztów. Grok 4.6: AA Intelligence Index 61, ex aequo na 3. miejscu na świecie (według Artificial Analysis; dane laboratorium są raportowane przez producenta).
• Cena — Mercury 2.5 Preview: $0.04 / $0.15 za 1M (80% taniej od $0.20 / $0.75, do 8 września 2026 r.). Grok 4.6: $2.00 / $6.00 za 1M, podwajające się do $4.00 / $12.00 dla promptów o długości co najmniej 200K tokenów.
• Prędkość — Mercury 2.5 Preview: 1 107 tokenów/sek. według deklaracji producenta. Grok 4.6: prędkość nie jest kluczową specyfikacją; model jest stworzony do długich zadań agentowych, a nie szybkiego strumieniowania.
• Kontekst — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.
• Praca agentowa — Mercury 2.5 Preview: brak publicznych wyników, choć równoległe wywołania narzędzi są obsługiwane. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (raportowane przez dostawcę, w dużej mierze niereprodukowane).
• Wagi — Mercury 2.5 Preview: zamknięte, autorskie. Grok 4.6: zamknięte, autorskie.
Mistrz wartości i pomijacz ceny.
Pozycja Grok 4.6 jest niezwykła. Model zajmuje 3. miejsce w indeksie Artificial Analysis pod względem inteligencji — ex aequo z GPT-5.6 Sol Max — a przy tym jest tańszy niż każdy model w odległości dziesięciu punktów od niego, a relacje z premiery podkreślały długie serie agentowe kończące się średnio kosztem około 0,84 USD za zadanie w jednej ocenie przeprowadzonej przez dostawcę. To definicja mistrza wartości: możliwości bliskie czołówce w cenie, która sprawia, że koszty poszczególnych zadań widać w arkuszach kalkulacyjnych. Mercury 2.5 Preview nie próbuje tym być. Inception pozycjonuje go względem modeli takich jak GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite i Claude Haiku 4.5 — czyli warstwy zoptymalizowanej kosztowo, a nie czołówki. Jeśli Inception ma rację, Mercury 2.5 Preview wypada o poziom niżej niż Grok 4.6 pod względem możliwości i o kilka poziomów niżej pod względem ceny, co jest produktem w pełni spójnym: przeskokiem cenowym dla obciążeń, w przypadku których czołowa warstwa jest marnotrawstwem.
Co tak naprawdę zmienia równoległe dekodowanie
Architektura jest częścią, którą warto zrozumieć, ponieważ zmienia znaczenie słowa „szybko”. Modele autoregresyjne generują jeden token na krok, więc przepustowość jest ograniczona przez sekwencyjne opóźnienie; dyfuzyjny model językowy, taki jak Mercury 2.5 Preview, generuje blok tokenów równolegle i udoskonala je w krokach denoisingu, co oddziela przepustowość od liczby wyprodukowanych tokenów. Dlatego Inception może deklarować 1 107 tokenów na sekundę na standardowych procesorach graficznych — bez specjalnych akceleratorów i bez trików z przetwarzaniem wsadowym — oraz dlatego rzeczywista deklaracja produktu to czas do pierwszego tokenu poniżej 300 milisekund dla obciążeń interaktywnych. Dla agenta głosowego, potoku wyszukiwania czy podagenta programistycznego, który wywołuje model przy każdej turze, ta różnica w opóźnieniu jest produktem: to różnica między pętlą głosową, która sprawia wrażenie na żywo, a taką, która robi pauzy. Haczyk polega na tym, że dyfuzyjne modele językowe to młoda dziedzina badań, liczba 1 107 pochodzi od Inception, a żadne niezależne laboratorium nie odtworzyło tej prędkości ani nie zmierzyło dryfu jakości, jeśli w ogóle występuje, jaki generowanie równoległe wprowadza w przypadku długich lub adwersarialnych promptów.
Gdzie Grok 4.6 wciąż robi swoje
Nic w Mercury 2.5 Preview nie dotyka tych części rynku, które Grok 4.6 faktycznie wygrywa. Zyski Groka względem Grok 4.5 skupiały się na benchmarkach agentowych i programistycznych — DeepSWE w górę o 11.9 punktu, APEX-Agents o 10.4, Terminal-Bench o 10.3 — a jego okno kontekstu 500K istnieje dla agentów długoterminowych, którzy muszą utrzymywać całe zadanie w kontekście. Mercury 2.5 Preview oferuje równoległe wywołania narzędzi, ale model bez niezależnych wyników agentowych, z limitem wyjścia 65 536 tokenów i kontekstem 260K nie jest narzędziem do 50-etapowego zadania z inżynierii oprogramowania. Oba modele ledwie pokrywają się w użyciu: Grok 4.6 to silnik do pracy, która musi faktycznie zostać ukończona; Mercury 2.5 Preview to silnik do pracy, która ma się wydawać natychmiastowa i kosztować prawie nic za wywołanie.
Okno z 80% rabatem
Ceny tutaj mają datę ważności i to zmienia decyzję. Stawka Mercury 2.5 Preview wynosząca 0,04 USD / 0,15 USD to 80% zniżki od ceny katalogowej 0,20 USD / 0,75 USD, a firma Inception zapowiedziała, że promocja obowiązuje do 8 września 2026 r. Cena Grok 4.6 wynosząca 2,00 USD / 6,00 USD to stabilna cena katalogowa o przejrzystej strukturze — wejście z pamięci podręcznej za 0,50 USD, poziom priorytetowy za 2× oraz próg dla długich promptów na poziomie 200 tys. tokenów, który obciąża całe żądanie wyższą stawką. Jeśli porównujesz dzisiejsze liczby, Mercury jest 50× tańszy na wejściu i 40× tańszy na wyjściu; jeśli zniżka wygaśnie zgodnie z planem, realna długoterminowa różnica wynosi 10× na wejściu i 5× na wyjściu. Żadne z tych ujęć nie jest nieuczciwe — to po prostu różne horyzonty czasowe, a pipeline wyceniony z uwzględnieniem zniżki bez punktu ponownej oceny to pipeline, którego 9 września czeka niemiła niespodzianka. Cena Grok 4.6 wynosząca 2,00 USD / 6,00 USD to dokładnie tyle, ile płacisz w OrcaRouter, gdzie cena katalogowa dostawcy jest przekazywana dalej z zerową marżą — gdy dostawca zmieni liczbę, tego samego dnia jest ona aktywna na tym samym kluczu, z automatycznym przełączaniem awaryjnym, jeśli jedna ścieżka dostawcy nałoży limit żądań.
Werdykt w jednym zdaniu
Jeśli zadanie musi zostać ukończone i chcesz możliwości z najwyższej półki w najlepszej cenie w tej klasie, kup Grok 4.6 — to sprawdzony mistrz wartości, dostępny na OrcaRouter za $2.00 / $6.00 już dziś. Jeśli zadanie to przetwarzanie dużych wolumenów tekstu o krytycznym znaczeniu dla opóźnień, gdzie wystarczająco dobre odpowiedzi można tanio zweryfikować, Mercury 2.5 Preview za $0.04 / $0.15 to cenowa okazja, którą warto przetestować w oknie rabatowym — pamiętaj tylko, że każde twierdzenie po jej stronie należy do Inception, a dowód wciąż nie został przedstawiony.


OrcaRouter przekazuje ceny katalogowe dostawców z 0% narzutem i automatycznym przełączaniem awaryjnym, dzięki czemu zmiana ceny dostawcy wchodzi w życie na tym samym kluczu tego samego dnia.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
