Gemini Omni 1.1 Flash låter dig bygga med mer kontroll — scenförlängning, bildkontroll och 4K anländer. Regenererad illustration.
Guides & Insights

Gemini Omni 1.1 Flash låter dig bygga med mer kontroll — scenförlängning, bildkontroll och 4K anländer

Författare

Magnus Corvin

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Gemini Omni 1.1 Flash lanserades den 27 augusti 2026 som en produktionsuppdatering av den multimodala videomodellen, och förvandlade en 10-sekunders engångsgenerator till något som liknar ett kontrollerbart redigeringsinstrument. Huvudsiffrorna är lätta att missa eftersom priset inte ändrades: ett 720p-klipp kostar fortfarande 0,10 USD per sekund. Det som ändrades är hur mycket av tagningen du får bestämma över – modellen kan nu förlänga scener upp till 40 sekunder, respekterar en angiven första och sista bildruta, skapar förhandsvisningar i 360p för ungefär en tredjedel av 720p-kostnaden och renderar slutresultat i 1080p eller 4K. Det är den typen av uppdatering där versionsinformationen betyder mer än lanseringen i sig.

Modellen är efterföljaren till Gemini Omni Flash-förhandsversionen som blev tillgänglig för utvecklare den 30 juni 2026, och den behåller allt som gjorde originalet utmärkande: multimodala indata — text, bilder, ljud och video i ett enda anrop — och konversationsbaserad redigering i flera omgångar där du förfinar ett klipp genom att prata om det i stället för att generera om från grunden. Det Gemini Omni 1.1 Flash tillför är kontroll vid gränserna och kontroll över kostnaden, vilket är precis vad en produktionspipeline behöver och en forskningsdemo inte gör.

Vad uppdateringen faktiskt tillför

Fyra funktioner skiljer 1.1 från juniförhandsvisningen, och var och en svarar mot ett konkret klagomål som utvecklare hade med originalet.

• Scenförlängning. Modellen kan nu analysera upp till 10 sekunder av tidigare videokontext när den fortsätter ett klipp — tidigare versioner av modellen refererade bara till den sista sekunden. Förlängningar sker i steg om 10 sekunder, upp till totalt 40 sekunder. För första gången kan du producera något som läses som en sekvens med kontinuitet istället för en uppsättning intilliggande klipp.

• Kontroll av första/sista bildrutan. Ange start- och slutbildrutan för en tagning så genererar modellen kontinuerlig video mellan de två nyckelbilderna. Detta är vad som gör kameraorbiter, zoomövergångar och sömlösa loopar möjliga utan en videoredigerare, eftersom tagningens geometri nu är en begränsning istället för en gissning.

• 360p-utkastläge. Lättviktiga förhandsvisningar renderas upp till 60 % snabbare än standard 720p, till ungefär en tredjedel av kostnaden. Det är ett storyboard-/iterationsverktyg: du testar ett dussin varianter billigt och renderar sedan bara den som fungerar i full upplösning.

• 1080p- och 4K-utdata. Slutliga renderingar kan uppskalas från det ursprungliga 720p-taket till 1080p eller 4K, vilket är skillnaden mellan "användbart för sociala medier" och "användbart för sändning." Videoreferenser upp till tre sekunder långa kan nu också inkluderas som multimodal indata för att bibehålla karaktärs- och visuell konsistens mellan tagningar.

A generated graphic titled 'What changed in Gemini Omni 1.1 Flash'. Left column 'Gemini Omni Flash (June preview)': 'Max clip: 10s', 'Lookback: 1s', 'Resolution: 720p only', 'Frame control: none', '360p tier: no'. Right column 'Gemini Omni 1.1 Flash (Aug 27)': 'Max length: 40s via scene extension', 'Lookback: 10s', 'Resolution: 1080p & 4K', 'Frame control: first/last frame', '360p drafting: ~1/3 cost'. A footer reads 'Prices: $0.10/s at 720p on both; 1080p/4K pricing not yet published.' The OrcaRouter logo is composited in the bottom-right corner.

Prisbilden håller fortfarande på att lägga sig.

Siffran på $0,10 per sekund som alla citerar gäller standardnivån för 720p, och den är oförändrad jämfört med förhandsversionen. Inmatning kostar $1,50 per miljon tokens, oavsett om tokens är text, bilder, ljud eller video, och textutmatning kostar $9,00 per miljon tokens – samma struktur som originalet. Det Google ännu inte har publicerat är prissättningen per sekund för de nya 1080p- och 4K-nivåerna; tredjepartsuppskattningar placerar dem i intervallet 1,5x till 3x av 720p-baspriset, men det är uppskattningar, inte Googles siffror, så betrakta produktionsbudgetar i hög upplösning som preliminära tills den officiella taxan visas på Gemini API:s prissättningssida.

360p-utkastnivån är den avsiktliga kostnadshävstången: till ungefär en tredjedel av 720p-priset och upp till 60 % snabbare förändrar den iterationens ekonomi. Ett team som gör tio utkast av en tagning i 360p spenderar ungefär lika mycket som tre utkast i 720p, vilket är skillnaden mellan att utforska och att binda sig tidigt. Leverantörsrapporterat genomgående, men genomströmningsmatten är enkel aritmetik på Googles egna publicerade siffror.

A screenshot of the Gemini API Pricing page (ai.google.dev, captured August 28, 2026) showing the Free/Paid availability tiers and the model list including 'Gemini Omni Flash Preview' and 'Gemini 3.1 Flash Lite Image (Nano Banana 2 Lite)' — the vendor page for the $1.50 per million input token structure and the availability tiers.

Där du faktiskt kan kalla det

Gemini Omni 1.1 Flash finns nu tillgänglig via Gemini API i Google AI Studio under modell-ID:t gemini-omni-1.1-flash, och via Gemini Enterprise Agent Platform för produktionsarbetsbelastningar – samma gränssnitt som Adobe, Figma, GMI Cloud och Runway redan bygger på för sina Agent Platform-integrationer. Konsumentåtkomsten rullades ut parallellt: Google Flow har hela funktionsutbudet för alla Google AI Plus-, Pro- och Ultra-prenumeranter globalt, och scenutökning är live i Gemini-appen. Med andra ord är detta ingen papperslansering – API:et, agentplattformen och konsumentytorna lanserades alla samma dag.

Den bredden är värd en stund. Den ursprungliga Gemini Omni Flash skickades till utvecklare den 30 juni med etiketten offentlig förhandsvisning, en hård gräns på 10 sekunders generering, scenutökning uttryckligen utan stöd, och videoreferenser som accepterades av schemat men inte behandlades korrekt. 1.1 rensar bort det mesta av den listan i en enda uppdatering – 40-sekunderstaket, fungerande videoreferenser och en riktig upplösningsstege är exakt de luckor som förhandsvisningsepoken lämnade öppna. Om du avfärdade förhandsvisningen för att den inte kunde hålla ihop en scen längre än tio sekunder, är den här utgåvan svaret på just det klagomålet.

A screenshot of the Gemini API developer documentation Models page (ai.google.dev, captured August 28, 2026) showing the docs navigation under 'Gemini API' — Models, Gemini Omni Flash, Nano Banana, Veo, Imagen — and the list of Gemini's generation models. It is the vendor's official developer page for the model family.

Vad som inte har förändrats

För all den nya kontrollen är den underliggande produkten samma modellfamilj med samma avvägningar. Utdata är fortfarande kortformsvideo med synkroniserat ljud – detta är inte Veo 3.1, Googles separata engångsgenerator med hög återgivning, och de två är avsedda för olika uppgifter. Karaktärskonsistens mellan scenbyten förbättras av den längre lookbacken och referensvideoinmatningen, men det är fortfarande en generativ svaghet som du bör testa snarare än anta. Och modellen bär SynthID-vattenmärkning på utdatan, vilket spelar roll om du bygger ett verktyg som behöver garantier om ursprung.

Det är också värt att säga rakt ut vad som ännu inte har bevisats: det finns inget oberoende riktmärke för Gemini Omni 1.1 Flash på en offentlig videotopplista när detta skrivs. Googles påståenden – 60 % snabbare för 360p, kvaliteten vid 1080p/4K – är leverantörsrapporterade. Historien om den här lanseringen är funktionslistan och priset, inte en poäng på en lista, och den som säger något annat citerar en siffra som ingen utanför labbet har producerat.

Varför ”mer kontroll” är historien.

Den röda tråden i denna release är att Google äntligen gav utvecklare reglage: längd, inramning, upplösning och kostnad är nu indata istället för utdata. Det är det som får en generativ modell att kännas som ett verktyg snarare än en spelautomat, och det är samma anledning till att kostnadstransparens spelar roll på infrastruktursidan. Varje generativt modellteam vi pratar med kämpar med samma två problem — enhetsekonomi och iterationshastighet — och en modell som kostar en tredjedel så mycket att iterera på angriper båda.

Det är på temat kostnadskontroll som ett routinglager visar sitt värde. OrcaRouter förmedlar leverantörernas listpriser utan påslag, så när en modells pris per sekund eller per token ändras, ändras priset du ser hos oss samma dag — ingen marginal mellan dig och Googles publicerade pris. Ett enda API täcker 200+ modeller, med automatisk failover om en leverantör ligger nere eller en dagsgammal modell returnerar fel mitt i produktionen; för en modell som släpptes igår är failover sättet att testa den utan att satsa en live-pipeline på den. Själva Gemini Omni 1.1 Flash kan ännu inte routas via oss — vi påstår inte att vi hostar en modell som vi inte hostar — men prisdisciplinen är poängen: när dess API-nivå öppnas för tredjepartsroutning kommer den att visas till Googles listpris, och integrationen är en konfigurationsändring, inte en omskrivning.

Slutsats

Gemini Omni 1.1 Flash är uppdateringen som gör Geminis videomodell användbar som ett produktionsverktyg snarare än en nyhet: scenförlängning till 40 sekunder, kontroll av första/sista bildrutan, en 360p-utkastnivå för en tredjedel av kostnaden och 1080p/4K-utdata. Priset på 0,10 dollar per sekund för 720p är oförändrat, prissättningen för hög upplösning är fortfarande inte publicerad, och det finns ännu inget oberoende benchmark – behandla Googles funktionspåståenden som leverantörsrapporterade tills någon annan kör modellen. Om du väntade på förhandsversionen eftersom tio sekunder var för kort och 720p för litet, är väntan över. Om du behöver ett benchmark eller en officiell 4K-taxa innan du förbinder dig, är det ärliga svaret att ingen har dem ännu.

Håll ett öga på Gemini API:s prissättningssida för priserna per sekund för 1080p/4K, håll utkik efter de första oberoende utvärderingarna av 1.1-uppdateringen, och följ Google Flows utrullning av prenumeranter som en indikator på hur mycket förtroende teamet har för modellens kvalitet i stor skala. Lanseringen är verklig, kontrollerna är verkliga, och prisskillnaden är den enda del som fortfarande är i rörelse.