
Gemini Omni 1.1 Flash Lässt Sie Mit Mehr Kontrolle Erstellen — Szenen-Erweiterung, Frame-Kontrolle und 4K kommen
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 223 tok/s
- OpenAINEUOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAINEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAINEUGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
Gemini Omni 1.1 Flash wurde am 27. August 2026 als Produktions-Update für das multimodale Videomodell ausgeliefert und verwandelte einen 10-Sekunden-Generator für Einzelaufnahmen in etwas, das eher einem steuerbaren Bearbeitungsinstrument ähnelt. Die Schlagzeilenzahlen sind leicht zu übersehen, weil sich der Preis nicht bewegte: Ein 720p-Clip kostet weiterhin 0,10 $ pro Sekunde. Geändert hat sich, wie viel von der Aufnahme Sie bestimmen können – das Modell erweitert Szenen jetzt auf bis zu 40 Sekunden, berücksichtigt einen bestimmten ersten und letzten Frame, erstellt Vorschauen in 360p zu etwa einem Drittel der Kosten von 720p und rendert die endgültige Ausgabe in 1080p oder 4K. Es ist die Art von Update, bei der die Versionshinweise wichtiger sind als der Launch.
Das Modell ist der Nachfolger der Gemini-Omni-Flash-Vorschau, die am 30. Juni 2026 für Entwickler verfügbar wurde, und es behält alles, was das Original auszeichnete: multimodale Eingabe — Text, Bilder, Audio und Video in einem einzigen Aufruf — und konversationelle Bearbeitung über mehrere Runden, bei der man einen Clip verfeinert, indem man darüber spricht, anstatt ihn von Grund auf neu zu generieren. Was Gemini Omni 1.1 Flash hinzufügt, ist Kontrolle an den Grenzen und Kontrolle über die Kosten – genau das, was eine Produktionspipeline braucht und eine Forschungsdemo nicht.
Was das Update tatsächlich hinzufügt
Vier Fähigkeiten unterscheiden 1.1 von der Juni-Vorschau, und jede beantwortet eine konkrete Beschwerde, die Entwickler mit dem Original hatten.
• Szenenerweiterung. Das Modell kann jetzt bis zu 10 Sekunden vorherigen Videokontext analysieren, wenn ein Clip fortgesetzt wird — frühere Versionen des Modells bezogen sich nur auf die letzte Sekunde. Erweiterungen erfolgen in 10-Sekunden-Schritten, bis zu einer kumulativen Gesamtdauer von 40 Sekunden. Zum ersten Mal kannst du etwas produzieren, das wie eine Sequenz mit Kontinuität wirkt, statt wie eine Ansammlung aneinandergereihter Clips.
• Steuerung des ersten/letzten Frames. Legen Sie den Start- und Endframe einer Aufnahme fest, und das Modell erzeugt kontinuierliches Video zwischen den beiden Keyframes. Genau das macht Kamera-Umkreisungen, Zoomübergänge und nahtlose Schleifen ohne Videobearbeitungsprogramm möglich, denn die Geometrie der Aufnahme ist nun eine Vorgabe statt einer Vermutung.
• 360p-Entwurfsmodus. Leichte Vorschauen rendern bis zu 60 % schneller als standardmäßiges 720p, zu ungefähr einem Drittel der Kosten. Das ist ein Storyboard-/Iterationswerkzeug: Du testest ein Dutzend Variationen günstig und renderst dann nur diejenige, die funktioniert, in voller Auflösung.
• 1080p- und 4K-Ausgabe. Endgültige Renderings können von der ursprünglichen 720p-Obergrenze auf 1080p oder 4K hochskaliert werden, was den Unterschied zwischen „für soziale Medien geeignet“ und „für Rundfunk geeignet“ ausmacht. Videoreferenzen von bis zu drei Sekunden Länge können jetzt auch als multimodale Eingabe einbezogen werden, um die Figuren- und visuelle Konsistenz über Einstellungen hinweg zu wahren.

Das Preisbild ist noch nicht gefestigt.
Der von allen zitierte Wert von 0,10 $ pro Sekunde entspricht der Standard-Stufe in 720p und ist gegenüber der Vorschau unverändert. Der Eingabepreis beträgt 1,50 $ pro Million Token, unabhängig davon, ob es sich um Text, Bilder, Audio oder Video handelt, und die Textausgabe kostet 9,00 $ pro Million Token – dieselbe Struktur wie beim Original. Was Google noch nicht veröffentlicht hat, ist die Preisgestaltung pro Sekunde für die neuen 1080p- und 4K-Stufen; Schätzungen Dritter gehen von dem 1,5- bis 3-fachen der 720p-Basis aus, aber das sind Schätzungen, nicht Googles Zahlen. Behandeln Sie daher jedes Produktionsbudget in hoher Auflösung als vorläufig, bis der offizielle Preis auf der Gemini-API-Preisseite erscheint.
Die 360p-Entwurfsstufe ist der bewusste Kostenhebel: Bei etwa einem Drittel des 720p-Preises und bis zu 60 % schneller verändert sie die Ökonomie der Iteration. Ein Team, das zehn Entwürfe einer Einstellung in 360p erstellt, gibt ungefähr so viel aus wie für drei Entwürfe in 720p – das ist der Unterschied zwischen Erkunden und frühzeitigem Festlegen. Durchgängig anbieterberichtet, aber die Durchsatzrechnung ist einfache Arithmetik auf Basis von Googles eigenen veröffentlichten Zahlen.

Wo man es tatsächlich anrufen kann.
Gemini Omni 1.1 Flash ist jetzt über die Gemini API in Google AI Studio unter der Modell-ID gemini-omni-1.1-flash verfügbar, und über die Gemini Enterprise Agent Platform für Produktionsworkloads – dieselbe Schnittstelle, auf der Adobe, Figma, GMI Cloud und Runway bereits für ihre Agent-Platform-Integrationen aufbauen. Der Verbraucherzugriff wurde parallel ausgerollt: Google Flow bietet allen Google AI Plus-, Pro- und Ultra-Abonnenten weltweit den vollen Funktionsumfang, und die Szenenerweiterung ist in der Gemini-App live. Mit anderen Worten: Dies ist kein Papierlaunch – die API, die Agent-Platform und die Verbraucheroberflächen wurden alle am selben Tag veröffentlicht.
Diese Breite ist einen Moment wert. Das ursprüngliche Gemini Omni Flash wurde am 30. Juni mit einem Public-Preview-Label an Entwickler ausgeliefert – mit einer harten 10-Sekunden-Generierungsgrenze, explizit nicht unterstützter Szenenerweiterung sowie Video-Referenzen, die vom Schema akzeptiert, aber nicht korrekt verarbeitet wurden. 1.1 räumt den Großteil dieser Liste in einem einzigen Update ab: Die 40-Sekunden-Obergrenze, funktionierende Video-Referenzen und eine ordentliche Auflösungsleiter sind genau die Lücken, die die Preview-Ära offengelassen hat. Wenn euch die Preview abgeschreckt hat, weil sie eine Szene nicht länger als zehn Sekunden zusammenhalten konnte, ist dieses Release die Antwort auf genau diese Beschwerde.

Was sich nicht geändert hat
Trotz all der neuen Kontrolle ist das zugrunde liegende Produkt dieselbe Modellfamilie mit denselben Kompromissen. Die Ausgabe ist weiterhin Kurzvideo mit synchronisiertem Audio – das ist nicht Veo 3.1, Googles separater One-Shot-High-Fidelity-Generator, und die beiden sind für unterschiedliche Aufgaben gedacht. Die Charakterkonsistenz über Szenenwechsel hinweg wird durch die längere Rückschau und die Referenzvideo-Eingabe verbessert, aber sie bleibt eine generative Schwäche, die Sie testen sollten, anstatt sie vorauszusetzen. Und das Modell trägt ein SynthID-Wasserzeichen auf der Ausgabe, was wichtig ist, wenn Sie ein Tool entwickeln, das Herkunftsgarantien benötigt.
Es ist auch wichtig, klar zu sagen, was noch nicht bewiesen wurde: Es gibt derzeit keinen unabhängigen Benchmark für Gemini Omni 1.1 Flash auf einer öffentlichen Video-Bestenliste. Googles Behauptungen — die 60-prozentige Beschleunigung für 360p, die Qualität bei 1080p/4K — stammen vom Anbieter. Bei dieser Veröffentlichung geht es um die Funktionsliste und den Preis, nicht um einen Wert in einer Rangliste, und wer Ihnen etwas anderes erzählt, zitiert eine Zahl, die niemand außerhalb des Labors erstellt hat.
Warum "mehr Kontrolle" die Geschichte ist
Der rote Faden dieses Releases ist, dass Google den Buildern endlich Stellschrauben gegeben hat: Länge, Bildausschnitt, Auflösung und Kosten sind jetzt Eingaben statt Ausgaben. Genau das macht ein generatives Modell zu einem Werkzeug statt zu einem Glücksspielautomaten, und aus demselben Grund ist Kostentransparenz auf der Infrastrukturseite wichtig. Jedes Team für generative Modelle, mit dem wir sprechen, kämpft mit denselben zwei Problemen — Unit Economics und Iterationsgeschwindigkeit — und ein Modell, das nur ein Drittel der Kosten für Iterationen verursacht, geht beide direkt an.
Genau bei diesem Kostenkontroll-Thema zeigt sich, warum eine Routing-Ebene ihren Wert hat. OrcaRouter gibt die Listenpreise der Anbieter ohne Aufschlag weiter – wenn sich also der Sekunden- oder Token-Preis eines Modells ändert, ändert sich der Preis, den Sie bei uns sehen, noch am selben Tag, ohne Marge zwischen Ihnen und der von Google veröffentlichten Zahl. Eine API deckt über 200 Modelle ab, mit automatischem Failover, falls ein Anbieter ausfällt oder ein einen Tag altes Modell mitten in der Produktion Fehler liefert. Bei einem Modell, das erst gestern erschienen ist, ist Failover der Weg, es zu testen, ohne eine Live-Pipeline darauf zu verwetten. Gemini Omni 1.1 Flash selbst ist bei uns noch nicht routbar – wir behaupten nicht, ein Modell zu hosten, das wir nicht hosten – aber die Preisdisziplin ist der Punkt: Wenn seine API-Stufe für Drittanbieter-Routing geöffnet wird, wird es zum Google-Listenpreis erscheinen, und die Integration ist eine Konfigurationsänderung, keine Neuentwicklung.
Fazit
Gemini Omni 1.1 Flash ist das Update, das Googles Videomodell zu einem Produktionstool statt zu einer Neuheit macht: Szenenverlängerung auf 40 Sekunden, Steuerung von erstem/letztem Frame, eine 360p-Entwurfsstufe zu einem Drittel der Kosten und 1080p/4K-Ausgabe. Der 720p-Preis von 0,10 $ pro Sekunde bleibt unverändert, die Preise für hohe Auflösungen sind weiterhin unveröffentlicht, und es gibt noch keinen unabhängigen Benchmark — behandeln Sie Googles Funktionsangaben als Herstellerangaben, bis jemand anderes das Modell ausführt. Wenn Sie auf die Vorschau gewartet haben, weil zehn Sekunden zu kurz und 720p zu klein war, ist das Warten vorbei. Wenn Sie vor Ihrer Entscheidung einen Benchmark oder einen offiziellen 4K-Preis benötigen, ist die ehrliche Antwort, dass es diese noch von niemandem gibt.
Beobachten Sie die Gemini-API-Preisseite für die Preise pro Sekunde bei 1080p/4K, achten Sie auf die ersten unabhängigen Bewertungen des 1.1-Updates, und verfolgen Sie die Einführung der Abonnenten von Google Flow als Indikator dafür, wie viel Vertrauen das Team in die Qualität des Modells im großen Maßstab hat. Die Veröffentlichung ist real, die Kontrollen sind real, und die Preislücke ist der einzige Teil, der sich noch bewegt.
