Karta tytułowa z nagłówkiem „PORÓWNANIE MODELI" i tekstem „Gemini 4 vs Gemini 4 Argon", z podtytułem „Jednego z nich ogłoszono 30 września. Drugi to prefiks rodziny." oraz czterema plakietkami: „Gemini 4 · brak identyfikatora modelu", „Gemini 4 Argon · ogłoszony 2026-09-30", „$2 / $10 cena wprowadzająca" i „Indeks AA 53 · Vals #1", nad wierszem stopki: „Dane Google'a podane przez dostawcę i niepowtórzone; dane indeksu według Artificial Analysis; pozycja w rankingu według Vals." Logo OrcaRouter jest nałożone w prawym dolnym rogu.
Guides & Insights

Gemini 4 vs Gemini 4 Argon: Jeden z tych dwóch modeli nie istnieje

Autor

Gideon Frost

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Google ogłosił model frontierowy 30 września 2026 r. To nie ten, który wyobraża sobie większość ludzi. Gemini 4 Argon to prawdziwa nazwa przypisana do prawdziwego ogłoszenia, prawdziwego cennika i opublikowanego zestawu benchmarków. Gemini 4 to prefiks rodziny, pod którym znajduje się ta nazwa — a zgodnie z dostępnymi dziś informacjami nie jest produktem. Nie ma dla niego identyfikatora modelu, endpointu, karty modelu ani ceny za milion tokenów. Nie jest to zatem porównanie dwóch systemów. To porównanie jednego ogłoszonego modelu z nazwą, którą wiele osób, w tym ten blog, od miesięcy traktuje jak model.

Ta różnica ma konkretny wymiar finansowy. G​emini 4 Argon ma cenę wprowadzającą 2 USD za milion tokenów wejściowych i 10 USD za milion tokenów wyjściowych, która po okresie wprowadzającym, niezdefiniowanym przez G​oogle, wzrośnie do 4 USD i 20 USD. To liczby podane przez dostawcę w oficjalnym wpisie ogłoszeniowym G​oogle. Jeśli planujesz budżet na migrację do warstwy pro w 2026 r., kwotą, na której możesz się oprzeć, jest 2 USD/10 USD, a „ilekolwiek kosztuje G​emini 4” nie jest żadną liczbą — nie opublikowano nic na ten temat, ponieważ nie ma jeszcze czego publikować.

Czym „Gemini 4” tak naprawdę jest według oficjalnych zapisów

Wyszukaj stronę produktu Gemini 4, a znajdziesz tylko jeden dokument: własny wpis Google'a zatytułowany Gemini 4 Argon: nasza kolejna era inteligencji frontier, opublikowany 30 września 2026 r. o 20:00 UTC i podpisany nazwiskiem Koraya Kavukcuoglu. Przeczytaj go uważnie, a „Gemini 4” nigdy nie występuje tam jako samodzielny model. Każde twierdzenie o możliwościach, każda cena i każdy benchmark w tym wpisie są przypisane do pełnej nazwy. Forma skrócona pojawia się wyłącznie tam, gdzie nazwa pełni rolę przedrostka — „możliwości Gemini 4 Argon” — czyli w tej samej roli gramatycznej, którą zajmował Gemini 3, zanim Gemini 3 Pro, Gemini 3.1 Pro i cztery warianty Flash stały się każdy osobnym bytem.

Historia kolejnych generacji przemawia za takim odczytaniem. Telekonferencja wynikowa Alphabetu z 23 lipca utrwaliła te ramy: Sundar Pichai powiedział, że kolejna generacja modeli frontier „wymaga znacznie większych modeli bazowych”, i wskazał kodowanie oraz kodowanie agentowe jako obszary wymagające poprawy. 23 września, podczas wydarzenia organizowanego przez The Information, Kavukcuoglu powiedział, że pre-training został zakończony, a model znajduje się na wczesnym etapie post-trainingu, że zespół widział wyniki i że ma nadzieję wydać wczesną wersję po post-trainingu na długo przed końcem roku. Business Insider opisał ogłoszenie z 30 września jako pierwszy model serii 4 — serii, i to jest wymowne. Wszystkie trzy to wypowiedzi dostawcy o jego własnej pracy, przekazane przez strony trzecie.

Co to praktycznie oznacza: „Gemini 4” to generacja, a generacja ma jednego nazwanego członka. Struktura poziomów, którą Google wprowadza od dwóch lat — Pro na szczycie, Flash poniżej, wariant Cyber dostępny tylko w ramach tego samego programu — nie została jeszcze wypełniona dla generacji 4. „Gemini 4 Pro” albo „Gemini 4 Ultra” to domysł na podstawie własnego schematu nazewnictwa Google, a nie przeciek i nie pozycja na roadmapie. Każdy tekst, który porównuje Gemini 4 Argon z „Gemini 4”, traktuj tak, jakby porównywał model z jego własnym nazwiskiem.

Czym właściwie jest Gemini 4 Argon

Gemini 4 Argon został ogłoszony 30 września 2026 r. na blogu Google, a Demis Hassabis tego wieczoru ogłosił ten sam model własnymi słowami na X. Wdrożenie jest etapowe i tylko pierwszy etap ma datę: Argon trafia najpierw do zweryfikowanych cyberobrońców w ramach Fairwind Program – poziomu dostępnego wyłącznie na wniosek, który Google stworzył dla rządów i krajowych organów ds. cyberbezpieczeństwa, operatorów infrastruktury krytycznej i kluczowych platform technologicznych. W swoim poście Hassabis napisał, że firma wdraża go „zaczynając od rządu i zaufanych cyberobrońców w ramach naszego Fairwind Program”. Następnie, według sformułowania Google, na kolejnym miejscu są płacący klienci API i subskrybenci Google AI Ultra, a potem deweloperzy, przedsiębiorstwa i konsumenci. Żaden z tych późniejszych etapów nie ma daty.

To, czego nie ma na tej liście, jest tym, co liczy się dla każdego, kto planuje prace: data ogólnej dostępności, identyfikator modelu, okno kontekstowe, liczba parametrów, karta modelu lub karta systemowa. Google opublikowało limit wyjściowy, a nie okno kontekstowe. Wynosi on 1 milion tokenów, w porównaniu z pułapem 64 tys. stosowanym w poprzedniej rodzinie Gemini, a Google nazywa go najlepszym w branży. Wzrost o rząd wielkości w tym, ile może zwrócić pojedyncze wywołanie, to realna zmiana dla długich trajektorii agentów i renderowania w jednym przebiegu, i jest to jedyna liczba techniczna w ogłoszeniu, która nie budzi żadnych wątpliwości.

A capture of Google's own blog post announcing Gemini 4 Argon, carrying a Published Time of 2026-09-30T20:00:00+00:00 and the headline "Gemini 4 Argon: our next era of frontier intelligence" credited to Koray Kavukcuoglu, followed by the Fairwind Program rollout and the vendor-reported benchmark set: DeepSWE v1.1 77.9%, AutomationBench 51.3%, LVBench 91.7%, CWE-bench v1 68%, an output limit of 1 million tokens up from 64K, and pricing of $2 / $10 stepping to $4 / $20.

Zestaw benchmarków jest szeroki i w całości nieodtworzony. Google podaje 77,9% dla DeepSWE v1.1, pierwsze miejsce w AutomationBench z wynikiem 51,3%, 91,3% w LVBench, ex aequo pierwsze miejsce w CWE-bench v1 z 68%, wiodące wyniki w Vals Index, w swoim Vals Finance Agent v2, w Legal Agent Benchmark firmy Harvey oraz najlepszy wynik w benchmarku Indirect Prompt Injection firmy Gray Swan. Każda z tych wartości to liczba samego dostawcy, opublikowana przez dostawcę, i żadna z nich nie została niezależnie odtworzona. Odrębny zestaw liczb krążący we wrześniu, przedstawiany jako przewidywane wyniki benchmarków Gemini 4 z wynikiem 48,7% w AutomationBench, okazał się recyklingiem z niepowiązanej premiery i nie jest publikacją Google. Rzeczywisty, podany przez Google wynik w AutomationBench to 51,3%, czyli inna liczba pochodząca z innego źródła.

Tablica wyników, którą tworzą te dwa nazwiska

Postaw te dwa obok siebie w sześciu wymiarach, na których to zestawienie faktycznie się opiera, a kształt problemu jest oczywisty:

• Istnieje jako nazwany produkt — Gemini 4: nie. Gemini 4 Argon: tak, ogłoszony 30.09.2026.

• Możliwe do wywołania już dziś — Gemini 4: nie istnieje żaden identyfikator modelu ani punkt końcowy. Gemini 4 Argon: również nie istnieje żaden identyfikator modelu ani punkt końcowy; dostęp jest ograniczony przez Fairwind i tylko na wniosek.

• Cena — Gemini 4: nie opublikowano. Gemini 4 Argon: 2 USD / 10 USD za milion tokenów w ramach oferty wprowadzającej, następnie 4 USD / 20 USD. Podane przez dostawcę.

• Maksymalna długość odpowiedzi — Gemini 4: nie opublikowano. Gemini 4 Argon: 1 milion tokenów, w porównaniu z 64K w poprzedniej generacji. Według producenta.

• Indeks inteligencji — Gemini 4: nie oceniano. Gemini 4 Argon: 53 w Indeksie Inteligencji Artificial Analysis przy wysokim wysiłku rozumowania, z kosztem 1,99 USD za zadanie indeksowe. Według Artificial Analysis.

• Pozycja w niezależnym rankingu — Gemini 4: bez miejsca w rankingu. Gemini 4 Argon: pierwszy w Vals Index z wynikiem 68,90% przy koszcie 15,68 USD za test, przy 13,40 mld tokenów wejściowych i 142,01 mln tokenów wyjściowych. Według Vals.

A two-column scoreboard card headed "Gemini 4 vs Gemini 4 Argon — the scoreboard", with the subtitle "One announced model against a name with nothing behind it". The left column, headed Gemini 4, reads: exists as a named product, no; callable today, no model ID or endpoint; published price, none; maximum output, none published; intelligence index, not evaluated; independent rank, not ranked. The right column, headed Gemini 4 Argon, reads: exists as a named product, yes, announced 2026-09-30; callable today, no, Fairwind-gated; published price, $2 / $10, then $4 / $20; maximum output, 1M tokens, up from 64K; intelligence index, 53, $1.99 per task; independent rank, 1st, Vals 68.90%. A footer reads that the Argon price and output limit are per Google's own announcement, the index and per-task cost per Artificial Analysis, the rank and score per Vals, and that no figure on the left has a published source because Gemini 4 has no product page. The OrcaRouter logo is composited in the bottom-right corner.

Przeczytaj dwa ostatnie wiersze razem, a otrzymasz jedyny naprawdę interesujący spór w tym porównaniu. Artificial Analysis umieszcza Gemini 4 Argon na 53 punktach, co daje mu remis z Claude Fable 5.1 i GPT-6 Astra oraz pięć punktów straty do Claude Opus 5.5 z wynikiem 58. Vals stawia go bezapelacyjnie na pierwszym miejscu. Oba rankingi są niezależne, oba mierzą coś realnego i mierzą różne rzeczy — indeks AA waży stały zestaw dziesięciu ewaluacji obejmujących kodowanie, rozumowanie i pracę z wiedzą, podczas gdy Indeks Vals waży cztery sektory według ich udziału w wartości dodanej gospodarki USA. Model może prowadzić w jednym, a nie w drugim, i żaden z tych rankingów nie musi być błędny.

Jest druga rzecz, którą warto zauważyć w wierszu Vals, i to właśnie na niej powinien skupić się klient korporacyjny. Vals podaje cennik Argonu jako 4 USD/20 USD — cenę po okresie wprowadzającym — podczas gdy samo ogłoszenie Google mówi o 2 USD/10 USD. Jeśli koszt 15,68 USD za test obliczono przy stawce 4 USD/20 USD, to klient akceptujący stawkę wprowadzającą zobaczyłby istotnie niższą kwotę za tę samą pracę, a klient, który przegapi okno wprowadzające, już nie. Google nie podało, jak długo trwa to okno. Ta pojedyncza niezdefiniowana zmienna zmienia najważniejszą dla decyzji liczbę w całej tej premierze.

Co możesz dziś nazwać

Nic nie istnieje pod nazwą Gemini 4, i to obejmuje nas. Sprawdziliśmy katalog: google/gemini-4, google/gemini-4-argon, google/gemini-4-pro i google/gemini-3.8-flash-cyber zwracają „model not found”, i tak samo jest z każdą inną platformą routingu, ponieważ żadna z nich nie ma identyfikatora modelu do routowania. Własna lista modeli Gemini API — Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.1 Pro, Gemini 3 Flash — nie zawiera żadnego wpisu Gemini 4. Dopóki Argon nie przejdzie przez kolejkę Fairwind i nie otrzyma identyfikatora, nie ma ceny rozliczeniowej ani żadnego endpointu nigdzie.

Działający płatny poziom Google pro to inna historia. Gemini 3.1 Pro Preview jest w naszym katalogu od 19 lutego 2026 r. w cenie 2,00 USD za dane wejściowe i 12,00 USD za dane wyjściowe za milion tokenów, z oknem kontekstowym wynoszącym 1 048 576 tokenów, maksymalną długością danych wyjściowych wynoszącą 65 536 tokenów oraz multimodalnymi danymi wejściowymi obejmującymi tekst, obraz, dźwięk, wideo i plik. Po ośmiu miesiącach wciąż jest oznaczony jako Preview na własnej liście modeli Gemini API, co samo w sobie jest argumentem, że Argon istnieje. Po przekroczeniu 200 000 tokenów wejściowych stawka podwaja się do 4 USD i 18 USD.

A capture of the OrcaRouter model page for Gemini 3.1 Pro Preview, showing the Google provider, a release date of 2026-02-19, a 1,048,576-token context window, a 65,536-token maximum output, pricing of $2.00 input and $12.00 output per million tokens with $4.00 and $18.00 over the 200,000-token threshold, multimodal input icons for text, image, video, audio and file, and capability chips for reasoning, tool calling, structured outputs, prompt caching, assistant prefill, computer use and web search.

To jedyne miejsce, w którym to porównanie ma operacyjną odpowiedź. Gemini 3.1 Pro Preview działa za tym samym punktem końcowym zgodnym z OpenAI co pozostałe ponad 200 modeli, które obsługujemy, w cenie katalogowej dostawcy bez marży — więc gdy Google w końcu opublikuje identyfikator i stawkę rozliczeniową dla Gemini 4 Argon, a potem, jeśli wzorzec nazewnictwa się utrzyma, bliźniaka z poziomu Pro, przekazywanie oznacza, że te stawki pojawią się po naszej stronie tego dnia, w którym pojawią się po stronie Google. W międzyczasie, jeśli chcesz zmierzyć poziom pro, a nie tylko o nim czytać, to jest model, który warto zmierzyć. Jeśli chcesz wypróbować model, którego zachowanie wciąż jest charakteryzowane, automatyczne przełączanie awaryjne między dostawcami to sposób, by zrobić to bez stawiania ścieżki produkcyjnej na wersji zapoznawczej, którą sam Google opisuje jako stopniowo wprowadzaną.

Jedno zastrzeżenie, o którym trzeba wspomnieć jednym tchem razem z ceną.

Bloomberg poinformował 30 września, że niektórzy pracownicy Google z bezpośrednim dostępem do Argon twierdzą, że radzi sobie on gorzej w rzeczywistej pracy, niż sugerowałyby wyniki benchmarków, przy czym konkretnie wymieniono projektowanie front-endu, a dwóch pracowników użyło określenia „benchmaxxing”. Google kwestionuje ten opis. Warto zestawić to z listą benchmarków właśnie dlatego, że lista benchmarków stanowi całą publiczną bazę dowodów dla tego modelu. Gdy mamy liczby jednego dostawcy i nie ma sposobu, by je odtworzyć, doniesienie, że liczby nie opowiadają całej historii, nie jest przypisem. To połowa dowodów.

Kto powinien wybrać, które

Jeśli wybierasz między tymi dwoma nazwami, tak naprawdę jeszcze niczego nie wybierasz, a szczera rada jest taka, żeby planować wokół tego, a nie wokół porównania.

• Jeśli potrzebujesz w produkcji modelu Google klasy pro w tym kwartale, odpowiedzią jest Gemini 3.1 Pro Preview. Można go wywoływać, ma ustaloną cenę i jest to poziom, który Argon ma docelowo zastąpić. Czekanie na Argon to czekanie w kolejce, do której nie możesz dołączyć.

• Jeśli jesteś odbiorcą, dla którego Argon ma ograniczony dostęp — rządowy organ ds. cyberbezpieczeństwa, operator infrastruktury krytycznej, opiekun oprogramowania — Fairwind Program jest jedyną drogą, a specyfika tego ograniczenia jest faktem dotyczącym możliwości modelu, a nie zabiegiem marketingowym. Google wytrenowało go do wykrywania i łatania luk w zabezpieczeniach i nie udostępniło go powszechnie.

• Jeśli planujesz budżet na migrację w 2026 r., użyj $2/$10 dla okresu wprowadzającego i $4/$20 dla wszystkiego po nim. Nie używaj jednej uśrednionej kwoty i nie używaj kosztu $15.68 za test z Vals bez sprawdzenia, według której tabeli stawek został obliczony.

• Jeśli czekasz na „Gemini 4”, poczekaj na identyfikator modelu. Nazwa go otrzyma — wzorzec nazewnictwa Google’a na przestrzeni trzech generacji wskazuje, że poziom Pro i poziom Flash mają własne identyfikatory — ale ten wzorzec nie jest zapowiedzią i nie opublikowano nic na temat tego, czym byłby sam Gemini 4, ile miałby kosztować ani co miałby robić.

Szersza teza jest taka, że ten blog musiał ją już stawiać i przypuszczalnie będzie musiał postawić ją ponownie: nazwa generacji to nie model. Gemini 4 Argon to jedyna rzecz, którą Google opatrzyło nazwą, ceną, zestawem benchmarków i planem dostępu. Reszta rodziny to wzorzec, a wzorzec to coś, co można przewidzieć, ale nie coś, co można nazwać.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie