
Gemini Omni 1.1 Flash blir produktionsredo: 40-sekundersscener, bildkontroll och en 4K-finish
- AlibabaNYQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiNYZ.ai: GLM 5.3 Flash2026-08-2658Intelligens72Kodning
- DeepSeekNYDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1M tokens
- z-aiNYZ.ai: GLM 5.32026-08-1860Intelligens75Kodning
- obsidianNYQwen3.8 27B2026-08-1552Intelligens68Kodning
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1261Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0557Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligens69Kodning
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligens49Kodning
- metaMeta: Muse Spark 1.12026-07-1653Intelligens71Kodning
- kimiMoonshotAI: Kimi K32026-07-1560Intelligens76Kodning
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligens71Kodning
Om du ger en videomodell den sista sekunden av ett klipp och ber den fortsätta tagningen, satsar du på dess minne. Det är precis det som Gemini Omni 1.1 Flash — produktionsuppdateringen som Gogle släppte den 27 augusti 2026 — byggdes för att eliminera: i stället för att titta tillbaka på en sekund av materialet när en scen förlängs, läser den nu upp till tio sekunder. På vägen flyttade Gogle modellens mest efterfrågade kontroller ut ur experimentkolumnen: konditionering av första och sista bildrutan, en 360p-utkastnivå som kostar ungefär en tredjedel så mycket som standardutdata i 720p, och slutgiltiga renderingar upp till 4K. Priset på arbetshästenivån förblev oförändrat — ett 720p-klipp kostar fortfarande 0,10 dollar per sekund — så berättelsen om den här releasen handlar om kontroll och kostnad, inte en prischock.
Gemini Omni 1.1 Flash är efterträdaren till förhandsversionen av Gemini Omni Flash som nådde utvecklare den 30 juni 2026, och den ärver allt som gjorde originalet ovanligt: multimodal inmatning som accepterar text, bilder, ljud och video i ett enda anrop, inbyggt synkroniserat ljud på varje klipp, och konversationsbaserad flervarvsredigering där du förfinar en scen genom att prata med modellen istället för att börja om med en ny prompt. Det som 1.1 tillför är den saknade verktygsuppsättningen – längd, inramning, upplösning och iterationskostnad är nu parametrar som en byggare faktiskt kan ställa in.
Lookback-problemet, löst
Den enskilt mest avgörande förändringen är kontexten. Tidigare versioner av modellen refererade endast till den sista sekunden av ett klipp när de fortsatte det, vilket är anledningen till att förlängningar drev iväg i karaktär, belysning och kamerarörelser. Gemini Omni 1.1 Flash analyserar upp till 10 sekunder av tidigare video, och förlängningar körs i 10-sekundersintervall upp till en kumulativ total på 40 sekunder. Den praktiska skillnaden är mellan "en uppsättning angränsande klipp" och "en sekvens som fungerar som en enda scen." För en 30-sekundersreklam eller en loopande varumärkestillgång är det skillnaden mellan sammanfogning och regi.
• Scenförlängning. Fortsätt ett befintligt klipp i 10-sekunderssegment upp till ett tak på 40 sekunder, med upp till 10 sekunders tillbakablickande kontext för att hålla fortsättningen konsekvent.
• Första/sista bildrutekontroll. Ange start- och slutrutan för en tagning och modellen genererar kontinuerlig video mellan de två nyckelrutorna — grundprincipen bakom kameraorbiter, zoomövergångar och sömlösa loopar.
• Videoreferenser. Upp till tre sekunders referensfilm kan inkluderas i den multimodala inmatningen för att bibehålla karaktär, kostym och rörelsestil mellan tagningar.
• Nativt ljud. Genererade klipp innehåller fortfarande synkroniserad dialog, ljudeffekter och bakgrundsljud, så ett resultat är en färdig kortvideo snarare än en tyst tillgång som väntar på en ljudläggning.
Veos kontroller, Omnis pipeline
Tillkännagivandet bygger på frasen "dina favoritkontroller för kreativt skapande från Veo", och det är en korrekt beskrivning av var dessa funktioner kommer ifrån. Veo 3.1, Gogles separata one-shot-videogenerator med hög kvalitet, hade redan keyframe-liknande conditioning och uppskalning i sin verktygsuppsättning; Gemini Omni 1.1 Flash för in den kontrollvokabulären i den multimodala Omni-pipelinen — där indata kan vara bilder, ljud och referensvideo, och där redigering sker genom samtal snarare än en ny generation varje gång. De två modellerna är inte rivaler i Gogles utbud; Gemini API-dokumentationen positionerar Gemini Omni Flash som det rekommenderade standardvalet för videogenerering, med Veo som specialisten med högre kvalitet.
Det spelar roll av en praktisk anledning: kontrollerna sitter nu i den modell som du med största sannolikhet anropar för vardagligt videoarbete, inte i en separat premiumnivå som du måste lära dig ett andra API för att nå. Bildkontroll, utkast och uppskalering delar en slutpunkt och en prismodell.
Ett arbetsflöde från utkast till slutversion
360p-utkastnivån är den tystaste funktionen i tillkännagivandet och möjligen den mest värdefulla. Förhandsvisningar på 360p renderas upp till 60 % snabbare än standard 720p och kostar ungefär en tredjedel så mycket, vilket fullständigt förändrar ekonomin för iteration. Med de priser per sekund som folk anger kostar ett 10-sekunders 360p-utkast ungefär 0,30 $ jämfört med 1,00 $ på 720p – tre omgångar av utforskande för priset av en slutgiltig render.
Den avsedda arbetsgången är uppenbar: storyboarda och iterera i 360p, rendera sedan den tagning som fungerar i 720p, 1080p eller 4K. För ett team som producerar sociala klipp eller annonsvarianter omvandlar utkastnivån ett kostnadsbegränsat arbetsflöde till ett utforskningsbegränsat sådant. Siffrorna för hastighet och kostnad här är leverantörsrapporterade — Gogles egna påståenden, hittills ej reproducerade — men räkneexemplet ovanpå dem är enkelt.

Prisbilden
Siffran på 0,10 USD per sekund som ständigt citeras är Gogles publicerade standardnivå för 720p, oförändrad från förhandsvisningen. Inmatning kostar 1,50 USD per miljon tokens oavsett om dessa tokens är text, bilder, ljud eller video, och textutmatning kostar 9,00 USD per miljon tokens — samma struktur som originalet. 360p-nivån landar på ungefär 0,03 USD per sekund, vilket är vad Gogles formulering "ungefär en tredjedel av kostnaden" antyder och vad återförsäljarlistor nu visar.
Vad Gogle inte har publicerat är en taxa per sekund för de nya 1080p- och 4K-nivåerna. Återförsäljarlistor anger $0,15 per sekund för 1080p och $0,30 per sekund för 4K, men det är uppskattningar från marknadsplatser, inte Gogles siffror – behandla alla budgetar för högupplöst produktion som preliminära tills den officiella taxan visas på Gemini API:s prissida. För att sätta det i perspektiv: en fullt utdragen scen på 40 sekunder i 720p kostar upp till $4,00, en 10-sekunders 4K-slutversion ligger runt $3,00 enligt återförsäljartaxan, och samma 10 sekunder i utkastform i 360p kostar ungefär $0,30.
Per-sekund-prissättning är rubriken, men det belopp du faktiskt betalar sätts av plattformen du köper genom — Gogle säljer till listpris, och återförsäljare och API-gateways lägger på sina egna marginaler ovanpå. Det är just därför 0% påslags-policyn spelar roll på infrastruktursidan: OrcaRouter skickar leverantörens listpris rakt igenom, så när en modells prisändring sker ändras priset hos oss samma dag, utan något marginallager mellan dig och leverantörens publicerade siffra. Vi dirigerar ännu inte Gemini Omni 1.1 Flash — Gogle har inte öppnat Omni-video-API:et för tredjepartsdirigering, och vi påstår oss inte vara värd för en modell vi inte är värd för — men prisdisciplinen är poängen, och när den API-nivån öppnas kommer modellen att dyka upp till listpris.

Där du kan ringa det
Gemini Omni 1.1 Flash är nu live under modell-ID:t gemini-omni-1.1-flash via Gemini API i Gogle AI Studio, marknadsförd som produktionsredo snarare än en förhandsversion. Den är också tillgänglig via Gemini Enterprise Agent Platform för produktionsarbetsbelastningar — samma gränssnitt som Adobe, Figma, GMI Cloud och Runway redan integrerar med, enligt tillkännagivandet. På konsumentsidan har Gogle Flow hela funktionsuppsättningen för alla AI Plus-, Pro- och Ultra-abonnenter globalt, och scenutökning är live i Gemini-appen. Detta är ingen papperslansering: API, agentplattform och konsumentytor lanserades alla samma dag.
Om du provade juniförhandsvisningen och avskräcktes av dess hårda 10-sekundersgräns eller dess oförmåga att hålla ihop en scen, åtgärdar den här versionen exakt de klagomålen — 40 sekunders förlängning, fungerande videoreferenser och en ordentlig upplösningsstege. API:ets form är också värd att känna till: generering och redigering sker via Interactions API, vilket är det som möjliggör den konversationsbaserade, flervarviga redigeringsmodellen, och en response_format inställning kan låsa utdataupplösningen — 360p för utkast, full upplösning för finaler.

Vad som fortfarande inte är bevisat
Trots all den nya kontrollen är de avvägningar som präglade originalet fortfarande aktuella. Utdatan är fortfarande kortformatsvideo med synkroniserat ljud, inte en ersättning för Veo 3.1 — de två modellerna riktar in sig på olika uppgifter. Karaktärskonsistens över scenbyten förbättras av 10-sekunderslookbacken och inmatning av referensvideo, men det är fortfarande en generativ svaghet värd att testa på eget material snarare än att ta för given. Varje genererat klipp bär en SynthID-vattenstämpel, vilket är viktigt för verktyg som kräver garantier för ursprung.
Och den ärliga varningen: det finns inget oberoende benchmark för Gemini Omni 1.1 Flash på någon offentlig videotopplista i skrivande stund. Den 60-procentiga hastighetsökningen för 360p-utkast, kvaliteten vid 1080p och 4K, tillförlitligheten i villkoren för första/sista bildrutan — allt rapporterat av leverantören, inget reproducerat av tredje part. Den som idag citerar en kvalitetspoäng för den här modellen citerar en siffra som ingen utanför Gogles labb har tagit fram.
Vem ska flytta nu?
Tre grupper får värde av den här releasen direkt. Team som redan bygger på Omni API:t bör byta modell-ID och testa om sina tilläggs- och ramkontrollsökvägar — uppgraderingen är en ändring av ett requestfält, inte en omarkitekturering. Den som behöver kortformatsvideo i stor volym — annonsvarianter, sociala klipp, loopande varumärkestillgångar — bör prissätta 360p-arbetsflödet från utkast till färdig, för det är där kostnadsmatematiken verkligen är ny. Och team som väntade på förhandsversionen bör prova modellen nu, eftersom de två hindren som gjorde förhandsversionen oanvändbar för produktion — tio sekunder långa klipp och ingen scenkontinuitet — är precis vad den här uppdateringen tar bort.
Den grupp som bör avvakta är lika väldefinierad: om du behöver ett tredjepartsriktmärke eller en officiell 4K-takt per sekund innan du binder budget, så har ingen det ännu, och det är värt att säga rakt ut snarare än att sopa under mattan. Lanseringen är äkta, kontrollerna är äkta, och prisskillnaden är den enda delen som fortfarande är i rörelse. Bevaka Gemini API:s prissida för 1080p- och 4K-takterna, och håll utkik efter de första oberoende utvärderingarna — i samma stund som någon annan kör den här modellen får leverantörens rapporterade förbehåll för varje kvalitetspåstående i den här artikeln en bock eller en röd flagga.
