Card hero de título para o artigo de lançamento do Gemini Omni 1.1 Flash. O título grande diz 'Gemini Omni 1.1 Flash — mais controle sobre seu vídeo'. Quatro chips de recursos exibem 'Extensão de cena até 40s', 'Controle do primeiro/último frame', 'Rascunho em 360p a ~1/3 do custo', 'Saída em 1080p e 4K'. O rodapé diz 'Lançado em 27 de agosto de 2026 via Gemini API.' O logotipo do OrcaRouter é compositado no canto inferior direito.
Guides & Insights

Gemini Omni 1.1 Flash chega pronto para produção: cenas de 40 segundos, controle de quadros e acabamento em 4K

Autor

Alistair Wren

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Entregue a um modelo de vídeo o último segundo de um clipe e peça para ele continuar a cena, e você estará apostando na memória dele. É exatamente isso que o Gemini Omni 1.1 Flash — a atualização de produção que o Go​gle lançou em 27 de agosto de 2026 — foi criado para eliminar: em vez de olhar apenas um segundo de gravação ao estender uma cena, agora ele lê até dez. Nesse processo, o Go​gle tirou os controles mais solicitados do modelo da coluna experimental: condicionamento de primeiro e último quadro, uma camada de rascunho em 360p que custa cerca de um terço do preço da saída padrão em 720p, e renderizações finais de até 4K. O preço da camada principal não mudou — um clipe em 720p ainda custa US$ 0,10 por segundo —, então a história deste lançamento é controle e custo, não um susto no preço.

Gemini Omni 1.1 Flash é o sucessor da prévia do Gemini Omni Flash que chegou aos desenvolvedores em 30 de junho de 2026, e herda tudo o que tornou o original incomum: entrada multimodal que aceita texto, imagens, áudio e vídeo em uma única chamada, áudio nativo sincronizado em cada clipe e edição conversacional em várias rodadas, em que você refina uma cena conversando com o modelo em vez de recomeçar do zero. O que o 1.1 adiciona é a ferramenta que faltava — duração, enquadramento, resolução e custo de iteração agora são entradas que um desenvolvedor pode realmente definir.

O problema do lookback, resolvido

A mudança mais consequente é o contexto. As versões anteriores do modelo referenciam apenas o último segundo de um clipe ao continuá-lo, e é por isso que as extensões divergiam em personagem, iluminação e movimento de câmera. O Gemini Omni 1.1 Flash analisa até 10 segundos de vídeo anterior, e as extensões são executadas em incrementos de 10 segundos até um total cumulativo de 40 segundos. A diferença prática é entre "um conjunto de clipes adjacentes" e "uma sequência que se lê como uma única cena". Para um anúncio de 30 segundos ou um ativo de marca em loop, essa é a diferença entre montagem e direção.

• Extensão de cena. Continue um clipe existente em blocos de 10 segundos até um limite de 40 segundos, com até 10 segundos de contexto de retrocesso para manter a continuidade consistente.

• Controle do primeiro/último quadro. Especifique o quadro inicial e final de uma cena e o modelo gera vídeo contínuo entre os dois quadros-chave — a base por trás de órbitas de câmera, transições de zoom e loops contínuos.

• Referências de vídeo. Até três segundos de filmagem de referência podem ser incluídos na entrada multimodal para manter o personagem, o figurino e o estilo de movimento entre as tomadas.

• Áudio nativo. Os clipes gerados ainda carregam diálogo sincronizado, efeitos sonoros e som ambiente, então o resultado é um curta finalizado, em vez de um ativo silencioso aguardando uma passagem de som.

Os controles da Veo, o pipeline da Omni

O anúncio se apoia na frase "seus controles criativos favoritos do Veo", e é uma descrição precisa de onde esses recursos vieram. O Veo 3.1, o gerador de vídeo autônomo de alta fidelidade de disparo único do Go​gle, já tinha condicionamento estilo keyframe e upscaling em seu conjunto de ferramentas; o Gemini Omni 1.1 Flash traz esse vocabulário de controle para o pipeline multimodal Omni — onde a entrada pode ser imagens, áudio e vídeo de referência, e onde a edição é conversacional em vez de uma nova geração a cada vez. Os dois modelos não são rivais dentro da linha do Go​gle; a documentação da API Gemini posiciona o Gemini Omni Flash como o padrão recomendado para geração de vídeo, com o Veo como o especialista em alta fidelidade.

Isso importa por uma razão prática: os controles agora ficam no modelo que você provavelmente usará para trabalhos de vídeo do dia a dia, não em um nível premium separado para o qual você precisa aprender uma segunda API. Controle de quadros, rascunho e upscaling compartilham um mesmo endpoint e um mesmo modelo de preços.

Um fluxo de trabalho do rascunho ao final

O nível de rascunho em 360p é o recurso mais discreto do anúncio e possivelmente o mais valioso. As prévias em 360p renderizam até 60% mais rápido que as de 720p padrão e custam cerca de um terço do preço, o que muda completamente a economia da iteração. Nas tarifas por segundo que as pessoas estão citando, um rascunho de 10 segundos em 360p sai por cerca de US$ 0,30 contra US$ 1,00 em 720p — três rodadas de exploração pelo preço de uma renderização definitiva.

O fluxo pretendido é óbvio: criar storyboard e iterar em 360p, depois renderizar o único take que funciona em 720p, 1080p ou 4K. Para uma equipe que produz cortes para redes sociais ou variações de anúncios, o nível de rascunho converte um fluxo de trabalho limitado por custos em um limitado pela exploração. Os números de velocidade e custo aqui são relatados pelo fornecedor — afirmações da própria Go​gle, ainda não reproduzidas — mas a aritmética por cima deles é simples.

A generated scoreboard titled 'Gemini Omni 1.1 Flash — the scoreboard'. Six rows read 'Max scene length: 40s (10s increments)', 'Lookback context: 10s (was 1s)', 'Resolution: 720p, 1080p, 4K', 'Frame control: first/last frame', 'Draft tier: 360p, ~1/3 cost, ~60% faster', 'Independent benchmark: none yet'. A footer reads 'Vendor-reported; no independent scores yet. 720p $0.10/s per Google.' The OrcaRouter logo is composited in the bottom-right corner.

O panorama de preços

O valor de US$ 0,10 por segundo que continua sendo citado é o nível padrão de 720p publicado pelo Go​ogle, inalterado desde a prévia. A entrada custa US$ 1,50 por milhão de tokens, independentemente de esses tokens serem texto, imagens, áudio ou vídeo, e a saída de texto custa US$ 9,00 por milhão de tokens — a mesma estrutura do original. O nível de 360p equivale a cerca de US$ 0,03 por segundo, o que é o que a descrição de "aproximadamente um terço do custo" do Go​ogle implica e o que as listagens de revendedores agora mostram.

O que o Go​gle não publicou é uma taxa por segundo para os novos níveis de 1080p e 4K. Listagens de revendedores citam US$ 0,15 por segundo para 1080p e US$ 0,30 por segundo para 4K, mas essas são estimativas de mercado, não números do Go​gle — trate qualquer orçamento de produção em alta resolução como provisório até que a taxa oficial apareça na página de preços da API Gemini. Para ter uma noção de escala, uma cena totalmente estendida de 40 segundos em 720p custa até US$ 4,00, um acabamento de 10 segundos em 4K fica em torno de US$ 3,00 na taxa citada pelo revendedor, e os mesmos 10 segundos rascunhados em 360p custam cerca de US$ 0,30.

A cobrança por segundo é o destaque, mas o valor que você realmente paga depende da plataforma pela qual você compra — a Go​gle vende pelo preço de tabela, e revendedores e gateways de API adicionam suas próprias margens por cima. É exatamente por isso que a política de markup de 0% é tão importante na infraestrutura: a OrcaRouter repassa o preço de tabela do provedor diretamente, então, quando o preço de um modelo muda, o nosso preço muda no mesmo dia, sem nenhuma camada de margem entre você e o valor publicado pelo fornecedor. Ainda não roteamos o Gemini Omni 1.1 Flash — a Go​gle não abriu a API de vídeo Omni para roteamento por terceiros, e não afirmamos hospedar um modelo que não hospedamos — mas o ponto central é a disciplina de preços, e, quando esse nível da API for aberto, o modelo será oferecido pelo preço de tabela.

A screenshot of the Gemini API Pricing page (ai.google.dev, captured August 28, 2026) showing the developer-docs navigation (Models, Gemini Omni Flash, Veo, Nano Banana, Imagen), the 'Gemini Developer API pricing' heading, and the Free tier card for developers getting started with the Gemini API — Google's own page for the model family's pricing and availability tiers.

Onde você pode chamá-lo

O Gemini Omni 1.1 Flash já está no ar sob o ID do modelo gemini-omni-1.1-flashpor meio da API Gemini no Go​gle AI Studio, apresentado como pronto para produção, e não como prévia. Ele também está disponível na Gemini Enterprise Agent Platform para cargas de trabalho de produção — a mesma interface com a qual Adobe, Figma, GMI Cloud e Runway já estão se integrando, segundo o anúncio. No lado do consumidor, o Go​gle Flow oferece o conjunto completo de recursos para todos os assinantes de AI Plus, Pro e Ultra no mundo todo, e a extensão de cenas já está disponível no aplicativo Gemini. Não se trata de um lançamento apenas no papel: API, plataforma de agentes e superfícies de consumo foram disponibilizadas no mesmo dia.

Se você experimentou a prévia de junho e esbarrou no limite rígido de 10 segundos ou na incapacidade de manter uma cena coerente, esta versão responde exatamente a essas queixas — 40 segundos de extensão, referências de vídeo funcionando e uma escada de resolução adequada. O formato da API também vale a pena conhecer: geração e edição passam pela Interactions API, que é o que torna possível o modelo de edição conversacional em múltiplas etapas, e um response_format pode fixar a resolução de saída — 360p para rascunhos, resolução total para finais.

A screenshot of the Gemini API developer documentation Models page (ai.google.dev, captured August 28, 2026) showing the docs navigation under 'Gemini API' — Models, Gemini Omni Flash, Nano Banana, Veo, Imagen — and the list of Gemini's generation models. It is the vendor's official developer page for the model family.

O que ainda não foi provado

Para todo o novo controle, as concessões que definiram o original permanecem. A saída continua sendo vídeo de formato curto com áudio sincronizado, não um substituto do Veo 3.1 — os dois modelos atendem a funções diferentes. A consistência dos personagens entre mudanças de cena é melhorada pelo lookback de 10 segundos e pela entrada de vídeo de referência, mas continua sendo uma fragilidade generativa que vale a pena testar no seu próprio material em vez de presumir. Cada clipe gerado carrega uma marca d'água SynthID, o que importa para ferramentas que precisam de garantias de proveniência.

E a ressalva honesta: não existe um benchmark independente para o Gemini Omni 1.1 Flash em nenhum ranking público de vídeo no momento em que escrevo. O aumento de 60% na velocidade para rascunhos em 360p, a qualidade em 1080p e 4K, a confiabilidade do condicionamento do primeiro/último quadro — tudo relatado pelo fornecedor, nada reproduzido por terceiros. Qualquer pessoa que cite uma pontuação de qualidade para este modelo hoje está citando um número que ninguém fora dos laboratórios da Go​gle produziu.

Quem deve se mover agora

Três grupos obtêm valor deste lançamento imediatamente. Equipes que já desenvolvem na API Omni devem trocar os IDs de modelo e testar novamente seus caminhos de extensão e controle de quadros — a atualização é uma mudança de campo de solicitação, não uma rearquitetura. Quem precisa de vídeo curto em volume — variantes de anúncios, cortes para redes sociais, ativos de marca em loop — deve avaliar o preço do fluxo de trabalho de rascunho para final em 360p, porque é aí que o cálculo de custo é genuinamente novo. E as equipes que aguardavam a prévia devem experimentar o modelo agora, porque os dois bloqueios que tornaram a prévia inutilizável para produção — clipes de dez segundos e ausência de continuidade de cena — são precisamente o que esta atualização elimina.

O grupo que deve esperar também está bem definido: se você precisa de um benchmark de terceiros ou de uma taxa oficial de 4K por segundo antes de comprometer o orçamento, ninguém tem isso ainda, e vale a pena dizer isso claramente em vez de encobrir. O lançamento é real, os controles são reais, e a diferença de preço é a única parte que ainda está em movimento. Fique de olho na página de preços da Gemini API para as taxas de 1080p e 4K, e fique atento às primeiras avaliações independentes — no momento em que outra pessoa executar este modelo, a ressalva relatada pelo fornecedor sobre cada alegação de qualidade neste artigo ganha uma marca de verificação ou uma bandeira vermelha.

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

providers@orcarouter.ai

Junte-se à comunidade

Discordsupport@orcarouter.aiXGitHubYouTube