
Gemini 4 vs. Gemini 4 Argon: Eines dieser beiden Modelle existiert nicht
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 221 tok/s
- OpenAINEUOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAINEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAINEUGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 110 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Google kündigte am 30. September 2026 ein Frontier-Modell an. Es ist nicht das, was sich die meisten vorstellen. Gemini 4 Argon ist ein echter Name, der an eine echte Ankündigung, eine echte Preisliste und ein veröffentlichtes Benchmark-Set geknüpft ist. Gemini 4 ist das Familienpräfix, unter dem dieser Name steht – und nach den heute verfügbaren Informationen ist es kein Produkt. Es gibt dafür keine Modell-ID, keinen Endpunkt, keine Modellkarte und keinen Preis pro Million Tokens. Dies ist also kein Vergleich zweier Systeme. Es ist ein Vergleich eines angekündigten Modells mit einem Namen, den viele Leute, einschließlich dieses Blogs, monatelang wie ein Modell behandelt haben.
An dieser Unterscheidung hängt Geld. Gemini 4 Argon hat einen Einführungspreis von $2 pro Million Eingabe-Tokens und $10 pro Million Ausgabe-Tokens, der nach einem von Google nicht definierten Einführungszeitraum auf $4 bzw. $20 steigt. Das sind vom Anbieter angegebene Zahlen aus dem eigenen Ankündigungsbeitrag von Google. Wenn Sie eine Pro-Tier-Migration für 2026 budgetieren, ist $2/$10 die Zahl, mit der Sie planen können, und „was auch immer Gemini 4 kostet“ ist überhaupt keine Zahl — dafür wurde nichts veröffentlicht, weil es noch nichts zu veröffentlichen gibt.
Was „Gemini 4" offiziell tatsächlich ist
Suchen Sie nach einer Produktseite zu Gemini 4, und Sie finden genau ein Dokument: Googles eigenen Beitrag mit dem Titel Gemini 4 Argon: unsere nächste Ära der Frontier-Intelligenz, veröffentlicht am 30. September 2026 um 20:00 UTC und Koray Kavukcuoglu zugeschrieben. Lesen Sie ihn aufmerksam, und „Gemini 4“ erscheint nie als eigenständiges Modell. Jede Fähigkeitsaussage, jeder Preis und jeder Benchmark in dem Beitrag ist an den vollständigen Namen geknüpft. Die reine Form erscheint nur dort, wo der Name als Präfix verwendet wird – „Gemini 4 Argons Fähigkeiten“ –, was dieselbe grammatische Position ist, die Gemini 3 einnahm, bevor Gemini 3 Pro, Gemini 3.1 Pro und vier Flash-Varianten jeweils zu etwas Eigenem wurden.
Die Historie der Generationen stützt diese Lesart. Alphabets Telefonkonferenz zu den Quartalszahlen am 23. Juli brachte die Deutung offiziell zu Protokoll: Sundar Pichai sagte, die nächste Generation von Frontier-Modellen „erfordere viel größere Basismodelle“, und nannte Coding und agentisches Coding als die Bereiche, die verbessert werden müssten. Am 23. September sagte Kavukcuoglu bei einer von The Information ausgerichteten Veranstaltung, das Pre-Training sei abgeschlossen und das Modell befinde sich in einer frühen Phase des Post-Trainings, das Team habe die Ergebnisse gesehen, und er hoffe, eine frühe Post-Training-Version deutlich vor Ende des Jahres auszuliefern. Business Insider beschrieb die Ankündigung vom 30. September als das erste Modell der 4er-Serie – eine Serie, was der verräterische Hinweis ist. Alle drei sind Anbieteraussagen über die eigene Arbeit des Anbieters, weitergegeben von Dritten.
Was das praktisch bedeutet: „Gemini 4“ ist die Generation, und diese Generation hat ein benanntes Mitglied. Die Stufenstruktur, die Google seit zwei Jahren ausliefert – ein Pro an der Spitze, ein Flash darunter, eine Cyber-Variante, die nur über dasselbe Programm zugänglich ist –, ist für Generation 4 noch nicht besetzt. Ein „Gemini 4 Pro“ oder ein „Gemini 4 Ultra“ ist eine Schlussfolgerung aus Googles eigenem Namensschema, kein Leak und kein Roadmap-Eintrag. Betrachten Sie jede Abhandlung, die Gemini 4 Argon mit „Gemini 4“ vergleicht, so, als würde sie ein Modell mit seinem eigenen Nachnamen vergleichen.
Was Gemini 4 Argon tatsächlich ist
Gemini 4 Argon wurde am 30. September 2026 in Googles Blog angekündigt, und Demis Hassabis kündigte dasselbe Modell an jenem Abend mit eigenen Worten auf X an. Die Einführung erfolgt in Phasen, und nur die erste Phase hat ein Datum: Argon geht zuerst über das Fairwind Program an geprüfte Cyber-Verteidiger – die nur auf Antrag zugängliche Stufe, die Google für Regierungen und nationale Cyberbehörden, Betreiber kritischer Infrastrukturen und zentrale Technologieplattformen geschaffen hat. In Hassabis’ eigenem Post hieß es, das Unternehmen führe es „ab heute beginnend mit Regierungen und vertrauenswürdigen Cyber-Verteidigern über unser Fairwind Program“ ein. Danach nennt Googles Formulierung als Nächstes zahlende API-Kunden und Abonnenten von Google AI Ultra, dann Entwickler, Unternehmen und Verbraucher. Keine dieser späteren Phasen hat ein Datum.
Was nicht in dieser Liste steht, ist der Teil, der für alle wichtig ist, die Arbeit planen: ein Datum der allgemeinen Verfügbarkeit, eine Modell-ID, ein Kontextfenster, eine Parameteranzahl, eine Modellkarte oder eine Systemkarte. Google hat ein Ausgabelimit veröffentlicht, kein Kontextfenster. Es sind 1 Million Tokens, gegenüber der Obergrenze von 64K, die die vorherige Gemini-Familie verwendete, und Google nennt es branchenführend. Eine Erhöhung um eine Größenordnung bei der Menge, die ein einzelner Aufruf zurückgeben kann, ist eine echte Veränderung für lange Agenten-Trajektorien und Single-Shot-Rendering, und sie ist die einzige technische Zahl in der Ankündigung ohne Mehrdeutigkeit.

Das Benchmark-Set ist breit gefächert und in keinem einzigen Fall reproduziert. Google meldet DeepSWE v1.1 mit 77,9 %, den ersten Platz bei AutomationBench mit 51,3 %, LVBench mit 91,7 %, einen geteilten ersten Platz bei CWE-bench v1 mit 68 %, führende Ergebnisse im Vals Index, bei seinem Vals Finance Agent v2, bei Harvey's Legal Agent Benchmark und das stärkste Abschneiden beim Indirect Prompt Injection Benchmark von Gray Swan. Jede einzelne davon ist die eigene Zahl des Anbieters, vom Anbieter veröffentlicht, und keine wurde unabhängig reproduziert. Eine separate Reihe von Zahlen, die im September kursierte und als vorhergesagte Gemini-4-Benchmarks mit einem AutomationBench-Wert von 48,7 % präsentiert wurde, stellte sich als Wiederverwertung aus einer nicht damit zusammenhängenden Markteinführung heraus und ist keine Veröffentlichung von Google. Googles tatsächlich gemeldeter AutomationBench-Wert ist 51,3 %, was eine andere Zahl aus einer anderen Quelle ist.
Die Anzeigetafel, die die beiden Namen erzeugen
Stellt man die beiden auf den sechs Dimensionen nebeneinander, auf die es bei dieser Paarung tatsächlich ankommt, ist die Gestalt des Problems offensichtlich:
• Existiert als benanntes Produkt — Gemini 4: nein. Gemini 4 Argon: ja, angekündigt am 30.09.2026.
• Heute aufrufbar — Gemini 4: Es existiert keine Modell-ID und kein Endpunkt. Gemini 4 Argon: Es existiert ebenfalls keine Modell-ID und kein Endpunkt; der Zugang wird über Fairwind gesteuert und ist nur auf Antrag möglich.
• Preis — Gemini 4: kein veröffentlichter Preis. Gemini 4 Argon: 2 $ / 20 $ pro Million Token als Einführungspreis, danach 4 $ / 20 $. Vom Anbieter angegeben.
• Maximale Ausgabe — Gemini 4: keine veröffentlicht. Gemini 4 Argon: 1 Million Token, gegenüber 64K bei der vorherigen Generation. Vom Anbieter angegeben.
• Intelligenzindex — Gemini 4: nicht bewertet. Gemini 4 Argon: 53 im Intelligence Index von Artificial Analysis bei hohem Reasoning-Aufwand, mit Kosten von 1,99 $ pro Index-Aufgabe. Laut Artificial Analysis.
• Unabhängiger Leaderboard-Rang — Gemini 4: nicht platziert. Gemini 4 Argon: Erster im Vals Index mit 68,90 % bei Kosten von 15,68 $ pro Test, über 13,40 Mrd. Input- und 142,01 Mio. Output-Tokens. Laut Vals.

Liest man die letzten beiden Zeilen zusammen, stößt man auf den einzigen wirklich interessanten Widerspruch in diesem Vergleich. Artificial Analysis setzt Gemini 4 Argon auf 53, womit es mit Claude Fable 5.1 und GPT-6 Astra gleichauf liegt und fünf Punkte hinter Claude Opus 5.5 mit 58. Vals setzt es dagegen uneingeschränkt auf Platz eins. Beide sind unabhängig, beide messen etwas Reales, und sie messen unterschiedliche Dinge – der Index von AA gewichtet eine feste Auswahl von zehn Evaluierungen aus den Bereichen Coding, Reasoning und Wissensarbeit, während der Vals Index vier Sektoren nach ihrem Anteil an der US-Wertschöpfung gewichtet. Ein Modell kann bei dem einen vorne liegen und bei dem anderen nicht, ohne dass eine der beiden Ranglisten falsch wäre.
In der Vals-Zeile gibt es noch einen zweiten Punkt, der für einen Unternehmenskäufer relevant sein sollte. Vals verzeichnet Argons Preisliste mit $4/$20 – dem Preis nach der Einführungsphase –, während Googles eigene Ankündigung $2/$10 angibt. Wenn die Kosten von $15,68 pro Test auf Basis von $4/$20 berechnet wurden, dann würde ein Käufer, der den Einführungspreis akzeptiert, für dieselbe Leistung eine deutlich niedrigere Zahl sehen, während ein Käufer, der das Einführungsfenster verpasst, das nicht täte. Google hat nicht gesagt, wie lange dieses Fenster läuft. Diese eine undefinierte Variable verschiebt die entscheidungsrelevanteste Zahl der gesamten Markteinführung.
Was Sie heute anrufen können
Unter dem Namen Gemini 4 gibt es nichts, und das schließt uns mit ein. Wir haben den Katalog geprüft: google/gemini-4, google/gemini-4-argon, google/gemini-4-pro und google/gemini-3.8-flash-cyber geben alle „model not found“ zurück, und dasselbe gilt für jede andere Routing-Plattform, weil keine von ihnen eine Modell-ID zum Routing hat. Die eigene Modellliste der Gemini API – Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.1 Pro, Gemini 3 Flash – enthält keinerlei Eintrag für Gemini 4. Bis Argon die Fairwind-Warteschlange abgearbeitet hat und eine Kennung erhält, gibt es nirgendwo einen abgerechneten Preis und keinen Endpunkt.
Der aktive Google-Pro-Tarif ist eine andere Geschichte. Gemini 3.1 Pro Preview steht seit dem 19. Februar 2026 mit 2,00 $ für Eingabe und 12,00 $ für Ausgabe pro Million Tokens in unserem Katalog, mit einem Kontextfenster von 1.048.576 Tokens, einer maximalen Ausgabe von 65.536 Tokens und multimodaler Eingabe für Text, Bild, Audio, Video und Dateien. Acht Monate später ist es in der eigenen Modellliste der Gemini API immer noch als Preview gekennzeichnet, was an sich schon das Argument für die Existenz von Argon ist. Geht man über 200.000 Eingabe-Tokens hinaus, verdoppelt sich der Preis auf 4 $ und 18 $.

Das ist die eine Stelle, an der dieser Vergleich eine operative Antwort hat. Gemini 3.1 Pro Preview ist hinter demselben OpenAI-kompatiblen Endpunkt live wie die anderen über 200 Modelle, die wir routen – zum Listenpreis des Anbieters ohne Aufschlag — wenn Google also irgendwann eine Kennung und einen Abrechnungstarif für Gemini 4 Argon veröffentlicht und dann, falls das Namensmuster Bestand hat, ein Geschwistermodell der Pro-Stufe veröffentlicht, bedeutet die Durchreichung, dass diese Tarife auf unserer Seite an dem Tag erscheinen, an dem sie bei Google erscheinen. In der Zwischenzeit: Wenn Sie die Pro-Stufe messen möchten, statt über sie zu lesen, ist das das Modell, das Sie messen sollten. Wenn Sie ein Modell ausprobieren möchten, dessen Verhalten noch charakterisiert wird, automatisches Failover über Anbieter hinweg ist, wie Sie es tun, ohne einen Produktionspfad auf eine Vorschau zu setzen, von der Google selbst sagt, dass sie schrittweise eingeführt wird.
Ein Vorbehalt, der im selben Atemzug wie der Preis genannt gehört
Bloomberg berichtete am 30. September, dass einige Google-Mitarbeiter mit direktem Zugang zu Argon sagen, es schneide bei echter Arbeit schlechter ab, als die Benchmark-Ergebnisse vermuten lassen, wobei Frontend-Design ausdrücklich genannt wird und zwei Mitarbeiter den Begriff „benchmaxxing“ verwenden. Google bestreitet diese Darstellung. Es lohnt sich, dies direkt neben die Benchmark-Liste zu halten, gerade weil die Benchmark-Liste die gesamte öffentliche Beweisgrundlage für dieses Modell ist. Wenn es nur die Zahlen eines Anbieters gibt und keine Möglichkeit, sie zu reproduzieren, dann ist ein Bericht, wonach die Zahlen nicht die ganze Geschichte erzählen, keine Fußnote. Er ist die Hälfte der Beweise.
Wer sollte welche auswählen?
Wenn Sie zwischen diesen beiden Namen wählen, wählen Sie tatsächlich noch nichts, und der ehrliche Rat ist, die Planung darauf auszurichten statt auf einen Vergleich.
• Wenn Sie in diesem Quartal ein Google-Pro-Tier-Modell in der Produktion benötigen, lautet die Antwort Gemini 3.1 Pro Preview. Es ist aufrufbar, es hat einen Preis, und es ist die Stufe, die Argon ersetzen soll. Auf Argon zu warten bedeutet, auf eine Warteschlange zu warten, der Sie nicht beitreten können.
• Wenn Sie die Zielgruppe sind, für die Argon zugangsbeschränkt ist – eine staatliche Cyberbehörde, ein Betreiber kritischer Infrastruktur, ein Software-Maintainer –, ist das Fairwind Program der einzige Weg, und die Spezifität dieser Zugangsbeschränkung ist eine Tatsache über die Fähigkeiten des Modells, kein Marketing. Google hat es für das Entdecken und Beheben von Schwachstellen trainiert und es nicht allgemein ausgeliefert.
• Wenn Sie eine Migration für 2026 budgetieren, verwenden Sie $2/$10 für den Einführungszeitraum und $4/$20 für alles danach. Verwenden Sie weder einen einzelnen Mischwert noch den Kosten-pro-Test-Wert von Vals in Höhe von $15,68, ohne zu prüfen, mit welcher Tarifkarte er berechnet wurde.
• Wenn Sie auf „Gemini 4“ warten, warten Sie auf eine Modell-ID. Der Name wird eine bekommen – Googles Namensmuster über drei Generationen hinweg besagt, dass die Pro-Stufe und die Flash-Stufe eigene Kennungen erhalten –, doch das Muster ist keine Ankündigung, und es wurde nichts darüber veröffentlicht, was ein bloßes Gemini 4 wäre, kosten oder leisten würde.
Der übergeordnete Punkt ist einer, den dieser Blog schon einmal deutlich machen musste und vermutlich wieder deutlich machen muss: Ein Generationsname ist kein Modell. Gemini 4 Argon ist das Einzige, hinter das Google einen Namen, einen Preis, ein Benchmark-Set und einen Zugangsplan gestellt hat. Der Rest der Familie ist ein Muster, und ein Muster ist etwas, das man vorhersagen, aber nicht aufrufen kann.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
