
Gemini 3.7 Flash ist live: Zum halben Preis, 1M Kontext und was tatsächlich bestätigt ist
- grokNEUSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaNEUMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenNEUQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekNEUDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxNEUMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens · 2190 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenz77Coding
- grokxAI: Grok 4.52026-07-0856Intelligenz72Coding
- tencentTencent: Hy32026-07-0642Intelligenz59Coding
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligenz42Coding
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligenz39Coding
- anthropicAnthropic: Claude Sonnet 52026-06-3055Intelligenz72Coding
Gemini 3.7 Flash ist live. Google hat das nächste Modell seiner Flash-Stufe am 13. August 2026 veröffentlicht – nur drei Wochen nach Gemini 3.6 Flash – und es zu 0,75 $ pro Million Eingabe-Tokens und 3,75 $ pro Million Ausgabe-Tokens angekündigt, also genau der Hälfte der 1,50 $/7,50 $ von Gemini 3.6 Flash. Die Leaks, die dieser Blog vor einer Woche verfolgt hat, erwiesen sich in jedem wichtigen Punkt als zutreffend: Das Modell war echt, der Name „3.7“ überlebte bis zur offiziellen Modell-ID, und der gemunkelte halbe Preis war der angekündigte Preis.
Gemini 3.7 Flash ist ein multimodales Modell, das Googles Modellkarte als neuestes und leistungsfähigstes Flash-Modell beschreibt, entwickelt für komplexes Coding, agentische Workflows und zuverlässige mehrstufige Ausführung. Googles Launch-Framing stellt Verbesserungen beim Coding, bei der Wissensarbeit und in der Webentwicklung in den Vordergrund – Herstellerangaben, die weiter unten untersucht werden – während die technischen Daten bereits feststehen: dasselbe 1-Millionen-Token-Kontextfenster, das bei der Flash-Tier Standard ist, eine 64K-Token-Ausgabe und die Verfügbarkeit über die Gemini API (einschließlich Google AI Studio), Google Antigravity, Gemini Enterprise und Gemini Spark für AI-Pro- und Ultra-Abonnenten. Was das Modell ist, was es kostet und wo es läuft, ist nun dokumentiert; die offene Frage ist, was es tatsächlich leistet.
Eine Disziplin aus der Leak-Berichterstattung setzt sich direkt im Launch-Artikel fort: Googles Leistungsangaben beruhen auf Herstellerangaben, bis eine unabhängige Messung sie bestätigt. Die erste unabhängige Zahl kam innerhalb eines Tages — Artificial Analysis bewertet Gemini 3.7 Flash mit 56 auf seinem Intelligence Index bei hohem Reasoning, vier Punkte über den 52, die Gemini 3.6 Flash beim Launch erzielte, und laut AA auf der Pareto-Front von Intelligenz versus Geschwindigkeit. Googles eigene Benchmark-Zahlen für Programmierung, Wissensarbeit und Webentwicklung bleiben das Wort des Herstellers. Behandeln Sie den Preis, das Kontextfenster und die Verfügbarkeit als Tatsachen. Behandeln Sie die Leistungsdeltas als Versprechen, die auf dem Prüfstand stehen.
Vom Leak zum Launch: Die Signale, die sich bestätigten
Da dieses Modell hier zunächst als unbestätigtes Leak erfasst wurde, lohnt es sich festzuhalten, wie das Leak gealtert ist – es ist der Unterschied zwischen einem Gerücht und einem Muster, das die Flash tier nun wiederholt demonstriert hat.
• Der X-Beitrag vom 7. August von @chetaslua besagte, dass die Vorbereitungen für Gemini 3.7 Flash „auf ihrer Seite" abgeschlossen seien, ohne ein Datum zu nennen. Sechs Tage später erschien das Modell. Die Einschätzung „eher früher als später" war richtig.
• Die am 7. und 8. August in Googles eigenem Python-GenAI-SDK auf GitHub enthaltenen Verweise auf gemini-3.7-flash verwiesen auf eine echte Modell-ID — dieselbe ID, die jetzt in der Gemini-API vorhanden ist.
Der Bericht vom 13. August, dass Gemini 3.7 Flash auf Gemini Enterprise in einem versteckten Zustand bereitgestellt wurde, mit einer möglichen Veröffentlichung am selben Tag, war hinsichtlich des Datums korrekt, und der gemunkelte Preis von 0,75 $/3,75 $ war hinsichtlich des Preises korrekt.
All das macht die Leak-Berichterstattung nicht überflüssig — dieselben Signale hätten auch auf „verschoben“ oder „umbenannt“ lauten können. Aber eine Stufe, die so schnell, so leise und so günstig ausgeliefert wird, ist genau der Grund, warum Google seine interessanteste Arbeit weiterhin in Flash erledigt.
Was bestätigt ist versus was noch eine Behauptung ist.
Jetzt, wo das Modell live ist, dreht sich das Konto aus dem Leak-Post um: Der Großteil dessen, was „berichtet“ wurde, ist in die Spalte „bestätigt“ gewandert, und die verbleibende Unsicherheit betrifft die Leistung, nicht die Existenz.
• Bestätigt — Google hat eine Gemini-3.7-Flash-Modellkarte veröffentlicht; das Modell ist über die Gemini-API, Google AI Studio, Google Antigravity, Gemini Enterprise und Gemini Spark verfügbar; der angekündigte Preis beträgt 0,75 $/3,75 $ pro Million Token bis zum 31. Dezember 2026; das Kontextfenster umfasst 1 M Token mit einer Ausgabe von 64.000 Token.
• Unabhängig gemessen – Artificial Analysis nahm Gemini 3.7 Flash innerhalb eines Tages nach dem Start in seinen Intelligence Index auf: 56 bei hohem Reasoning (53 bei mittlerem, 51 bei niedrigem), vier Punkte über den 52, die Gemini 3.6 Flash beim Start erzielte, wobei AA die Verbesserungen größtenteils auf agentische Evaluierungen zurückführt.
• Vom Anbieter gemeldet — Googles eigene Evaluierungswerte für die wichtigsten Anwendungsfälle: 43,6 % bei FrontierCode 1.1 (gestiegen von 34,4 %), 65,3 % bei DeepSWE v1.1, eine Elo-Zahl von 1588 in der Web-Development-Arena, in der Google eigenen Angaben zufolge Platz 1 belegt, 34,0 % bei GDP.pdf und 30,4 % bei AutomationBench. Dies sind Googles Zahlen, bis eine externe Partei sie reproduziert.
• Noch nicht bekannt — ob Google den Einführungspreis über den 31. Dezember 2026 hinaus verlängert (er verdoppelt sich am 1. Januar 2027 auf $1.50/$7.50), ob die Fortschritte das Kalkül verändern, das Gemini 3.5 Pro unveröffentlicht gehalten hat, und wie sich das Modell bei Workloads schlägt, die der Anbieter nicht beworben hat.
Für den Kontext zu diesen „Verbesserungen gegenüber Gemini 3.6 Flash“-Behauptungen: Dies ist die unabhängige Baseline, gegen die Google gemessen wird:

Der unabhängig gemessene Artificial Analysis Intelligence Index von Gemini 3.6 Flash von 52 (Rang #26 von 185 Modellen zum Start) und dessen Eingabepreis von $1.50/1M sind die Zahlen, die Gemini 3.7 Flash übertreffen muss — und der Preis von 3.7 liegt bereits um die Hälfte unter dem Eingabepreis von 3.6, bevor überhaupt ein Leistungsvergleich beginnt.
Warum der Preis die Schlagzeile ist
Der halbe Preis ist der folgenreichste Teil dieses Launches, und die Rechnung ist einfach. Bei einer Workload mit 1M-Token-Eingabe / 1M-Token-Ausgabe kostet Gemini 3.6 Flash 1,50 $ plus 7,50 $, also 9,00 $. Gemini 3.7 Flash kostet zum angekündigten Satz 0,75 $ plus 3,75 $, also 4,50 $ — eine Reduzierung um 50 % bei gleichem Volumen, und falls Googles behauptete Effizienzverbesserungen Bestand haben, sinken die effektiven Kosten für jede abgeschlossene Aufgabe noch weiter.
Zwei Einschränkungen sind festzuhalten. Erstens ist der Satz von 0,75 $/3,75 $ ein Einführungspreis und zeitlich begrenzt: Google hat bestätigt, dass er bis zum 31. Dezember 2026 gilt und sich am 1. Januar 2027 auf 1,50 $/7,50 $ verdoppelt. Zweitens bieten einige Plattformen derzeit Aktionspreise an, die unter dem angekündigten Satz liegen. Prüfen Sie daher beim Abruf den aktuellen Preis, um zu erfahren, was Sie tatsächlich zahlen werden — der angekündigte Satz ist die verlässliche Untergrenze, aber eine Untergrenze mit einem Ablaufdatum.
Der Gemini 3.5 Pro Hintergrund ist immer noch wichtig.
Googles Flaggschiff Gemini 3.5 Pro ist Stand 14. August 2026 immer noch nicht ausgeliefert — Monate nach der I/O, wobei Bloomberg Mitte Juli berichtete, dass es wegen der Programmierfähigkeiten hinter dem Zeitplan zurückliege, und spätere Berichte interne Terminverschiebungen beschrieben. Die Flash-Stufe liefert weiterhin, während die Pro-Stufe stockt, weshalb ein halb so teures, schnelleres Flash ein größeres Ereignis ist als ein typisches Punkt-Release: Es ist der Beweis, dass Googles Arbeitstier-Linie diejenige ist, mit der das Unternehmen tatsächlich konkurriert.
Verwechsle es nicht mit Qwen 3.7 Flash.
Beide "3.7 Flash"-Modelle existieren nun als ausgelieferte Modelle, und sie könnten nicht unterschiedlicher sein.
• Gemini 3.7 Flash — Googles neues Flash-Modell für 0,75 $/3,75 $ pro Million Tokens, 1M Kontext, multimodal, angekündigt am 13. August 2026.
• Qwen 3.7 Flash — Alibabas Vision-Language-Modell, das Ende Juli 2026 still zu etwa 0,03 $/0,13 $ pro Million Tokens mit einem 1M-Kontextfenster veröffentlicht wurde, ausgerichtet auf multimodale Agenten und Computer-Use-Aufgaben.
Allein die Preisdifferenz – etwa das 25-Fache bei Input-Tokens – trennt sie, und auch der Anbieter tut das. Wenn jemand sagt: „Ich verwende 3.7 Flash", ist die erste Frage immer noch, welche gemeint ist.
Sollten Sie von Gemini 3.6 Flash wechseln?
Die ehrliche Antwort ist zweigeteilt. Was die Kosten angeht, ist der angekündigte halbe Preis ein echter Hebel: Wer ein nennenswertes Volumen über Gemini 3.6 Flash abwickelt, bekommt dieselbe Arbeitslast auf Gemini 3.7 Flash für die Hälfte an Tokens – noch bevor irgendwelche behaupteten Effizienzgewinne eingerechnet werden. Das ist ein Umstieg, den es sich lohnt, anhand der eigenen Aufrufmuster durchzurechnen. Beim Vertrauen hat sich das Bild innerhalb eines Tages nach dem Launch verbessert – der unabhängige Artificial Analysis Index liegt bereits bei 56 gegenüber 52 bei Gemini 3.6 Flash – aber die spezifischen Unterschiede bei Coding, Wissensarbeit und Webentwicklung, die Google anpreist, sind weiterhin reine Herstellerangaben, und Gemini 3.6 Flash bleibt der stabile, dokumentierte Standard. Das übliche Vorgehen ist, ein bewährtes Modell als Standard zu behalten und einen Teil des Traffics an das neue Modell weiterzuleiten, um die Qualität anhand der eigenen Aufgaben zu vergleichen.
Keiner der beiden Wechsel erfordert ein Projekt, wenn Sie auf einer Routing-Ebene arbeiten. Gemini 3.6 Flash und Gemini 3.5 Flash sind beide heute über einen einzigen OpenAI-kompatiblen Endpunkt auf OrcaRouter zum Listenpreis des Anbieters ohne Aufschlag verfügbar – daher schlägt sich eine Google-Preissenkung an beliebiger Stelle der Preisstufe noch am selben Tag bei uns nieder, und ein späterer Wechsel von einem Flash-Modell zu einem anderen ist eine Änderung des Modellnamens und keine Integration. Automatisches Failover ist das Muster zur Bewertung eines gerade ausgelieferten Modells, egal wie es bereitgestellt wird: Lenken Sie einen Teil des echten Datenverkehrs darauf, lassen Sie den Router bei Fehlern, Ratenbegrenzungen oder offensichtlichen Qualitätsregressionen auf ein bewährtes Modell zurückfallen, und behalten Sie das alte Modell als Sicherheitsnetz, bis das neue sich den Datenverkehr verdient hat. Die Routing-DSL und Modellfusion ermöglichen es Ihnen, das neue Modell in einem einzigen Aufruf mit anderen zu kombinieren, sodass das Testen gegen Ihre eigene Arbeitslast nur eine Konfigurationsänderung ist.
Was als Nächstes ansehen
• Die nächste unabhängige Prüfung – Artificial Analysis hat bereits seinen Intelligence Index veröffentlicht (56 bei hohem Reasoning), daher hat sich die offene Frage von „Ist der Gewinn real?“ zu der Frage verschoben, ob Googles Behauptungen zu Coding- und Webentwicklungs-Benchmarks einer externen Reproduktion standhalten und sich bei eigenen Workloads bewähren.
• Der Preis – der Satz von 0,75 $/3,75 $ ist nun an ein Datum gebunden: Er gilt bis zum 31. Dezember 2026 und verdoppelt sich dann. Beobachte, ob Google es verlängert und ob sich die Aktionspreise von Drittanbietern darauf normalisieren.
• Gemini 3.5 Pro – falls Googles Flaggschiff endlich erscheint, könnte sich das Framing des vergangenen Monats, „Flash ist der Ort, an dem Google liefert“, verschieben.
FAQ
Ist Gemini 3.7 Flash veröffentlicht?
Ja — am 13. August 2026. Google hat eine Modellkarte für Gemini 3.7 Flash veröffentlicht, in der es als sein neuestes und leistungsfähigstes Flash-Modell beschrieben wird. Die ID gemini-3.7-flash wird über die Gemini-API bereitgestellt, und Google listet es in Google AI Studio, Google Antigravity, Gemini Enterprise und Gemini Spark auf. Dies ist das Modell, dessen Vorbereitung hier am 7. August als Leak gemeldet wurde.
Wie viel kostet Gemini 3.7 Flash?
0,75 $ pro Million Input-Token und 3,75 $ pro Million Output zum angekündigten Einführungspreis – die Hälfte von Gemini 3.6 Flashs 1,50 $/7,50 $, laut Ankündigung von Google. Der Preis ist bis zum 31. Dezember 2026 bestätigt und verdoppelt sich am 1. Januar 2027 auf 1,50 $/7,50 $. Einige Plattformen bieten derzeit Aktionspreise unterhalb des angekündigten Preises an; der zum Zeitpunkt des Aufrufs gültige Live-Preis ist der, den Sie zahlen.
Sollte ich von Gemini 3.6 Flash auf Gemini 3.7 Flash upgraden?
Der Preis hat sich halbiert und der erste unabhängige Wert liegt vor — Artificial Analysis Index 56 bei hohem Reasoning, gestiegen von 52 des 3.6 Flash — aber die von Google genannten Verbesserungen bei Code, Wissensarbeit und Webentwicklung sind weiterhin nur vom Anbieter gemeldet. Standardpraxis: Gemini 3.6 Flash als Standard behalten, Gemini 3.7 Flash anhand der eigenen Arbeitslast mit Failover evaluieren und umstellen, sobald er den Traffic verdient.
Gemini 3.7 Flash ist die Flash-Stufe, die genau das tut, was die Flash-Stufe tut – schnell liefern, günstiger liefern, und dieses Mal mit einem unabhängigen Ergebnis, das ihren Vorgänger übertrifft. Das Leak hatte beim Namen, beim Datum und beim Preis recht; die Leistungsbehauptungen werden noch getestet. Wenn Kosten pro Aufgabe Ihr Hebel sind, macht der halbe Preis Gemini 3.7 Flash heute einen Benchmark wert. Wenn Stabilität Ihre Priorität ist, bleibt Gemini 3.6 Flash die bewährte Wahl – und ein späterer Umstieg ist eine Namensänderung des Modells, kein Projekt.
In diesem Artikel verglichen1
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
