
Gemini Omni 1.1 Flash pozwala tworzyć z większą kontrolą — rozszerzanie sceny, kontrola klatek i 4K już dostępne
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 223 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1064 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Model Gemini Omni 1.1 Flash został wydany 27 sierpnia 2026 roku jako aktualizacja produkcyjna multimodalnego modelu wideo, przekształcając generator pojedynczych ujęć 10-sekundowych w coś bliższego sterowalnemu narzędziu do montażu. Najważniejsze liczby łatwo przeoczyć, ponieważ cena się nie zmieniła: klip 720p nadal kosztuje 0,10 USD za sekundę. Zmieniło się to, jak dużą część ujęcia możesz kontrolować — model potrafi teraz wydłużać sceny do 40 sekund, respektuje określoną pierwszą i ostatnią klatkę, tworzy podglądy w 360p za około jedną trzecią ceny 720p i renderuje końcowy materiał w 1080p lub 4K. To ten rodzaj aktualizacji, w której notatki o wydaniu mają większe znaczenie niż sama premiera.
Model jest następcą podglądu Gemini Omni Flash, który stał się dostępny dla programistów 30 czerwca 2026 roku, i zachowuje wszystko, co czyniło oryginał wyjątkowym: multimodalne wejście — tekst, obrazy, audio i wideo w jednym wywołaniu — oraz konwersacyjną edycję wieloetapową, w której dopracowujesz klip, rozmawiając o nim, zamiast generować go od nowa. To, co dodaje Gemini Omni 1.1 Flash, to kontrola na granicach i kontrola kosztów, czyli dokładnie to, czego potrzebuje produkcyjny potok, a czego nie potrzebuje demo badawcze.
Co właściwie dodaje aktualizacja
Cztery funkcje odróżniają wersję 1.1 od czerwcowej wersji zapoznawczej, a każda z nich odpowiada na konkretną skargę, jaką programiści mieli wobec oryginału.
• Rozszerzenie sceny. Model może teraz analizować do 10 sekund wcześniejszego kontekstu wideo podczas kontynuowania klipu — wcześniejsze wersje modelu odwoływały się tylko do ostatniej sekundy. Rozszerzenia następują w przyrostach co 10 sekund, aż do łącznej sumy 40 sekund. Po raz pierwszy możesz stworzyć coś, co czyta się jako sekwencję z ciągłością, a nie zbiór sąsiadujących ze sobą klipów.
• Kontrola pierwszej/ostatniej klatki. Określ klatkę początkową i końcową ujęcia, a model wygeneruje ciągłe wideo pomiędzy dwiema klatkami kluczowymi. To właśnie sprawia, że orbity kamery, przejścia zoom i płynne pętle są możliwe bez edytora wideo, ponieważ geometria ujęcia jest teraz ograniczeniem, a nie zgadywaniem.
• Tryb szkicowania 360p. Lekkie podglądy renderują się nawet o 60% szybciej niż standardowe 720p, przy około jednej trzeciej kosztów. To narzędzie do storyboardów/iteracji: testujesz tuzin wariantów niedrogo, a potem renderujesz tylko ten, który działa, w pełnej rozdzielczości.
• Wyjście 1080p i 4K. Końcowe renderingi mogą być skalowane w górę z pierwotnego limitu 720p do 1080p lub 4K, co stanowi różnicę między materiałem „nadającym się do mediów społecznościowych” a „nadającym się do emisji”. Referencje wideo o długości do trzech sekund mogą być teraz również dołączane jako multimodalne dane wejściowe, aby zachować spójność postaci i obrazu między ujęciami.

Sytuacja cenowa wciąż się kształtuje.
Kwota 0,10 USD za sekundę, którą wszyscy cytują, dotyczy standardowego poziomu 720p i nie zmieniła się względem wersji preview. Wejście kosztuje 1,50 USD za milion tokenów, niezależnie od tego, czy tokeny te stanowią tekst, obrazy, audio czy wideo, a wyjście tekstowe kosztuje 9,00 USD za milion tokenów — taka sama struktura jak w oryginale. To, czego Google jeszcze nie opublikował, to ceny za sekundę dla nowych poziomów 1080p i 4K; szacunki zewnętrzne plasują je w przedziale od 1,5x do 3x względem bazy 720p, ale to tylko szacunki, a nie liczby Google, więc traktuj każdy budżet produkcyjny w wysokiej rozdzielczości jako prowizoryczny, dopóki oficjalna stawka nie pojawi się na stronie z cennikiem Gemini API.
Poziom roboczy 360p to celowa dźwignia kosztowa: przy cenie wynoszącej mniej więcej jedną trzecią ceny 720p i nawet 60% większej szybkości zmienia ekonomikę iteracji. Zespół wykonujący dziesięć wersji roboczych ujęcia w 360p wydaje mniej więcej tyle samo, co przy trzech wersjach w 720p, a to różnica między eksplorowaniem a wczesnym angażowaniem się. Wszystkie dane pochodzą od dostawców, ale matematyka przepustowości to prosta arytmetyka na liczbach opublikowanych przez Google.

Gdzie faktycznie możesz to tak nazwać
Gemini Omni 1.1 Flash jest teraz dostępny przez API Gemini w Google AI Studio pod identyfikatorem modelu gemini-omni-1.1-flash, oraz przez Gemini Enterprise Agent Platform dla obciążeń produkcyjnych — ten sam interfejs, na którym Adobe, Figma, GMI Cloud i Runway już budują swoje integracje dla Agent Platform. Dostęp konsumencki został wdrożony równolegle: Google Flow ma pełen zestaw funkcji dla wszystkich subskrybentów Google AI Plus, Pro i Ultra na całym świecie, a rozszerzanie sceny jest dostępne w aplikacji Gemini. Innymi słowy, to nie jest premiera na papierze — API, platforma agentowa i powierzchnie konsumenckie zostały uruchomione tego samego dnia.
Ta rozpiętość zasługuje na chwilę uwagi. Oryginalny Gemini Omni Flash trafił do programistów 30 czerwca z etykietą publicznej wersji podglądowej, twardym limitem generowania wynoszącym 10 sekund, jawnie nieobsługiwanym rozszerzaniem sceny oraz referencjami wideo akceptowanymi przez schemat, ale nieprzetwarzanymi poprawnie. Wersja 1.1 w jednej aktualizacji zamyka większość tej listy — pułap 40 sekund, działające referencje wideo i właściwa drabinka rozdzielczości to dokładnie te luki, które pozostawiła era wersji podglądowej. Jeśli zniechęciłeś się do wersji podglądowej, bo nie potrafiła utrzymać sceny w całości dłużej niż dziesięć sekund, to wydanie jest odpowiedzią na dokładnie tę skargę.

Co się nie zmieniło
Przy całej nowej kontroli, podstawowy produkt pozostaje w tej samej rodzinie modeli z tymi samymi kompromisami. Wynikiem nadal jest krótkie wideo z zsynchronizowanym dźwiękiem — to nie jest Veo 3.1, oddzielny generator Google o wysokiej wierności do jednorazowych ujęć, a te dwa narzędzia są przeznaczone do różnych zadań. Spójność postaci między zmianami scen jest poprawiona dzięki dłuższemu spojrzeniu wstecz i wejściowemu wideo referencyjnemu, ale to wciąż słabość generatywna, którą należy przetestować, a nie zakładać. Ponadto model nakłada na wyjściu znak wodny SynthID, co ma znaczenie, jeśli budujesz narzędzie wymagające gwarancji pochodzenia.
Warto też otwarcie powiedzieć, czego jeszcze nie udowodniono: w chwili pisania tego tekstu nie istnieje niezależny benchmark dla Gemini Omni 1.1 Flash w publicznym rankingu wideo. Twierdzenia Google — przyspieszenie o 60% dla 360p, jakość w 1080p/4K — pochodzą wyłącznie od producenta. Historia tej premiery to lista funkcji i cena, a nie wynik na wykresie, a każdy, kto twierdzi inaczej, powołuje się na liczbę, której nikt poza laboratorium nie wygenerował.
Dlaczego "większa kontrola" to sedno sprawy
Głównym wątkiem tej wersji jest to, że Google w końcu dało twórcom dźwignie: długość, kadrowanie, rozdzielczość i koszt są teraz wejściami, a nie wyjściami. To sprawia, że model generatywny wydaje się narzędziem, a nie automatem do gier, i z tego samego powodu przejrzystość kosztów ma znaczenie po stronie infrastruktury. Każdy zespół pracujący nad modelami generatywnymi, z którym rozmawiamy, zmaga się z tymi samymi dwoma problemami — ekonomiką jednostkową i szybkością iteracji — a model, którego iterowanie kosztuje jedną trzecią, uderza w oba.
Ten motyw kontroli kosztów to miejsce, w którym warstwa routingu pokazuje swoją wartość. OrcaRouter przekazuje cennikowe stawki dostawców bez żadnej marży, więc gdy zmienia się stawka za sekundę lub za token danego modelu, cena, którą widzisz po naszej stronie, zmienia się tego samego dnia — bez żadnej różnicy między Tobą a publikowaną przez Google liczbą. Jedno API obejmuje ponad 200 modeli, z automatycznym przełączaniem awaryjnym, gdy dostawca nie działa lub gdy model sprzed kilku dni zwraca błędy w trakcie produkcji; dla modelu wydanego wczoraj przełączenie awaryjne to sposób na jego przetestowanie bez stawiania na szali działającego potoku. Sam Gemini Omni 1.1 Flash nie jest jeszcze u nas routowalny — nie twierdzimy, że hostujemy model, którego nie hostujemy — ale dyscyplina cenowa jest sednem sprawy: gdy jego warstwa API zostanie otwarta na routing osób trzecich, pojawi się w cenie listowej Google, a integracja będzie zmianą konfiguracji, a nie przepisywaniem kodu.
Konkluzja
Gemini Omni 1.1 Flash to aktualizacja, która sprawia, że model wideo Gemini staje się narzędziem produkcyjnym, a nie tylko nowością: wydłużenie sceny do 40 sekund, kontrola pierwszej/ostatniej klatki, wariant szkicowy 360p za jedną trzecią kosztów oraz wyjście 1080p/4K. Cena 720p wynosząca 0,10 USD za sekundę pozostaje bez zmian, cennik wysokich rozdzielczości wciąż nie został opublikowany i nie ma jeszcze niezależnego benchmarku — traktuj deklaracje Google o możliwościach modelu jako dane producenta, dopóki ktoś inny nie uruchomi modelu. Jeśli czekałeś na podgląd, bo dziesięć sekund było za krótko, a 720p za małe, czekanie dobiegło końca. Jeśli potrzebujesz benchmarku lub oficjalnej stawki 4K, zanim się zdecydujesz, uczciwa odpowiedź brzmi: nikt ich jeszcze nie ma.
Śledź stronę cenową Gemini API w poszukiwaniu stawek za sekundę dla 1080p/4K, czekaj na pierwsze niezależne oceny aktualizacji 1.1 i obserwuj udostępnianie Google Flow subskrybentom jako wskaźnik tego, jak duże zaufanie zespół ma do jakości modelu przy skalowaniu. Premiera jest realna, mechanizmy kontroli są realne, a luka cenowa to jedyna część, która wciąż się zmienia.
