Tarjeta de título principal para el artículo de lanzamiento de Gemini Omni 1.1 Flash. El titular grande dice: «Gemini Omni 1.1 Flash — más control sobre tu vídeo». Cuatro chips de características muestran: «Extensión de escena hasta 40s», «Control del primer/último fotograma», «Borrador en 360p a ~1/3 del coste», «Salida en 1080p y 4K». El pie de página dice: «Publicado el 27 de agosto de 2026 mediante la Gemini API». El logotipo de OrcaRouter aparece compuesto en la esquina inferior derecha.
Guides & Insights

Gemini Omni 1.1 Flash listo para producción: escenas de 40 segundos, control de fotogramas y un acabado 4K

Autor

Alistair Wren

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Ponle a un modelo de video el último segundo de un clip y pídele que continúe la toma, y estarás apostando a su memoria. Eso es exactamente lo que Gemini Omni 1.1 Flash — la actualización de producción que Go​gle lanzó el 27 de agosto de 2026 — fue diseñado para eliminar: en lugar de mirar hacia atrás un segundo de metraje al extender una escena, ahora lee hasta diez. En el proceso, Go​gle sacó los controles más solicitados del modelo de la columna experimental: condicionamiento de primer y último fotograma, un nivel de borrador a 360p que cuesta aproximadamente un tercio de la salida estándar de 720p, y renderizados finales de hasta 4K. El precio del nivel de caballo de batalla no cambió — un clip de 720p sigue costando $0.10 por segundo — así que la historia de este lanzamiento es control y costo, no un shock de precio.

Gemini Omni 1.1 Flash es el sucesor de la vista previa de Gemini Omni Flash que llegó a los desarrolladores el 30 de junio de 2026, y hereda todo lo que hizo singular al original: entrada multimodal que acepta texto, imágenes, audio y video en una sola llamada, audio sincronizado nativo en cada clip, y edición conversacional de múltiples turnos en la que se refina una escena hablando con el modelo en lugar de volver a generar la indicación desde cero. Lo que 1.1 añade es el conjunto de herramientas que faltaba: la duración, el encuadre, la resolución y el costo de iteración ahora son entradas que un creador realmente puede configurar.

El problema de la retrospectiva, resuelto

El cambio más trascendental de todos es el contexto. Las versiones anteriores del modelo solo tomaban como referencia el último segundo de un clip al continuarlo, por lo que las extensiones se desviaban en cuanto a personaje, iluminación y movimiento de cámara. Gemini Omni 1.1 Flash analiza hasta 10 segundos de video previo, y las extensiones se ejecutan en incrementos de 10 segundos hasta un total acumulado de 40 segundos. En la práctica, la diferencia está entre {{1}}"un conjunto de clips adyacentes"{{/1}} y {{2}}"una secuencia que se percibe como una sola escena"{{/2}}. Para un anuncio de 30 segundos o un activo de marca en bucle, esa es la diferencia entre {{3}}ensamblaje{{/3}} y {{4}}dirección{{/4}}.

• Extensión de escena. Continúe un clip existente en segmentos de 10 segundos hasta un límite de 40 segundos, con hasta 10 segundos de contexto retrospectivo para mantener la coherencia de la continuación.

• Control del primer/último fotograma. Especifica el fotograma inicial y final de una toma y el modelo genera video continuo entre los dos fotogramas clave: la base detrás de las órbitas de cámara, las transiciones de zoom y los bucles sin fisuras.

• Referencias de video. Se pueden incluir hasta tres segundos de metraje de referencia en la entrada multimodal para mantener el personaje, el vestuario y el estilo de movimiento entre tomas.

• Audio nativo. Los clips generados aún incluyen diálogo sincronizado, efectos de sonido y sonido ambiente, por lo que el resultado es un corto terminado en lugar de un recurso silencioso que espera una pasada de sonido.

Los controles de Veo, el pipeline de Omni.

El anuncio se apoya en la frase {{1}}"tus controles creativos favoritos de Veo"{{/1}}, y es una descripción precisa de dónde provienen estas funciones. Veo 3.1, el generador de video independiente de una sola pasada y alta fidelidad de {{2}}Go​gle{{/2}}, ya incluía condicionamiento por fotogramas clave y ampliación de escala en su conjunto de herramientas; {{3}}Gemini Omni 1.1 Flash{{/3}} aporta ese vocabulario de control al pipeline multimodal Omni, donde la entrada puede ser imágenes, audio y video de referencia, y donde la edición es conversacional en lugar de una generación nueva cada vez. Los dos modelos no son rivales dentro de la cartera de productos de {{4}}Go​gle{{/4}}; la documentación de la API de Gemini posiciona a Gemini Omni Flash como la opción predeterminada recomendada para la generación de video, con Veo como el especialista de mayor fidelidad.

Esto importa por una razón práctica: los controles ahora se encuentran en el modelo al que probablemente recurrirás para el trabajo de video cotidiano, no en un nivel premium aparte al que debas aprender a acceder mediante una segunda API. El control de fotogramas, la creación de borradores y la ampliación comparten un único punto final y un único modelo de precios.

Un flujo de trabajo de borrador a final

El nivel de borrador a 360p es la función más discreta del anuncio y posiblemente la más valiosa. Las vistas previas a 360p se renderizan hasta un 60 % más rápido que las de 720p estándar y cuestan aproximadamente un tercio, lo que cambia por completo la economía de la iteración. Con las tarifas por segundo que se manejan, un borrador de 10 segundos a 360p cuesta alrededor de $0.30 frente a $1.00 a 720p: tres rondas de exploración por el precio de un render definitivo.

El flujo previsto es obvio: hacer un storyboard e iterar en 360p, y luego renderizar la única toma que funcione a 720p, 1080p o 4K. Para un equipo que produce cortes para redes sociales o variantes de anuncios, el nivel de borrador convierte un flujo de trabajo limitado por el costo en uno limitado por la exploración. Las cifras de velocidad y costo aquí son reportadas por el proveedor —las propias afirmaciones de Go​gle, no reproducidas hasta ahora—, pero la aritmética a partir de ellas es simple.

A generated scoreboard titled 'Gemini Omni 1.1 Flash — the scoreboard'. Six rows read 'Max scene length: 40s (10s increments)', 'Lookback context: 10s (was 1s)', 'Resolution: 720p, 1080p, 4K', 'Frame control: first/last frame', 'Draft tier: 360p, ~1/3 cost, ~60% faster', 'Independent benchmark: none yet'. A footer reads 'Vendor-reported; no independent scores yet. 720p $0.10/s per Google.' The OrcaRouter logo is composited in the bottom-right corner.

El panorama de precios

La cifra de $0.10 por segundo que se sigue citando es el nivel estándar de 720p publicado por Go​gle, sin cambios desde la vista previa. La entrada cuesta $1.50 por millón de tokens, independientemente de si esos tokens son texto, imágenes, audio o video, y la salida de texto cuesta $9.00 por millón de tokens — la misma estructura que el original. El nivel de 360p equivale a unos $0.03 por segundo, que es lo que implica el enfoque de Go​gle de "aproximadamente un tercio del costo" y lo que ahora muestran los listados de los revendedores.

Lo que Go​gle no ha publicado es una tarifa por segundo para los nuevos niveles de 1080p y 4K. Los listados de revendedores citan $0.15 por segundo para 1080p y $0.30 por segundo para 4K, pero esas son estimaciones del mercado, no las cifras de Go​gle — trate cualquier presupuesto de producción en alta resolución como provisional hasta que la tarifa oficial aparezca en la página de precios de Gemini API. Para tener una idea de escala, una escena completamente extendida de 40 segundos a 720p cuesta hasta $4.00, un acabado de 10 segundos en 4K cuesta alrededor de $3.00 según la tarifa citada por los revendedores, y los mismos 10 segundos en borrador a 360p cuestan alrededor de $0.30.

El precio por segundo es el titular, pero la cifra que realmente pagas la establece la plataforma a través de la cual compras: {{1}}Go​gle{{/1}} vende al precio de lista, y los revendedores y las pasarelas de API añaden sus propios márgenes por encima. Es exactamente por eso que la política de margen del 0 % importa en el lado de la infraestructura: {{KEEP}}OrcaRouter{{/KEEP}} transmite el precio de lista del proveedor directamente, de modo que cuando cambia la tarifa de un modelo, el precio en nuestro lado cambia el mismo día, sin capa de margen entre tú y la cifra publicada por el proveedor. Aún no enrutamos Gemini Omni 1.1 Flash — {{2}}Go​gle{{/2}} no ha abierto la API de video Omni al enrutamiento de terceros, y no afirmamos alojar un modelo que no alojamos — pero la disciplina de precios es el punto, y cuando ese nivel de API se abra, el modelo aparecerá al precio de lista.

A screenshot of the Gemini API Pricing page (ai.google.dev, captured August 28, 2026) showing the developer-docs navigation (Models, Gemini Omni Flash, Veo, Nano Banana, Imagen), the 'Gemini Developer API pricing' heading, and the Free tier card for developers getting started with the Gemini API — Google's own page for the model family's pricing and availability tiers.

Dónde puedes llamarlo

Gemini Omni 1.1 Flash ya está disponible con el ID de modelo gemini-omni-1.1-flash a través de la API de Gemini en Go​gle AI Studio, presentado como listo para producción y no como vista previa. También está disponible a través de Gemini Enterprise Agent Platform para cargas de trabajo de producción — la misma interfaz con la que Adobe, Figma, GMI Cloud y Runway ya están integrando, según el anuncio. En el lado del consumidor, Go​gle Flow ofrece el conjunto completo de funciones para todos los suscriptores de AI Plus, Pro y Ultra a nivel mundial, y la extensión de escenas ya está disponible en la aplicación de Gemini. No se trata de un lanzamiento únicamente sobre el papel: la API, la plataforma de agentes y las superficies de consumo se activaron todas el mismo día.

Si probaste la vista previa de junio y te topaste con su estricto límite de 10 segundos o su incapacidad para mantener una escena unida, esta versión responde a esas mismas quejas: una extensión de 40 segundos, referencias de video funcionales y una escalera de resolución adecuada. También vale la pena conocer la forma de la API: la generación y la edición se ejecutan a través de la API de Interactions, que es lo que hace posible el modelo de edición conversacional de múltiples turnos, y un ajuste response_format puede fijar la resolución de salida: 360p para borradores, resolución completa para finales.

A screenshot of the Gemini API developer documentation Models page (ai.google.dev, captured August 28, 2026) showing the docs navigation under 'Gemini API' — Models, Gemini Omni Flash, Nano Banana, Veo, Imagen — and the list of Gemini's generation models. It is the vendor's official developer page for the model family.

¿Qué es lo que aún no está probado?

Para todo el {{1}}control{{/1}} nuevo, los {{2}}compromisos{{/2}} que definieron el original se mantienen. El resultado sigue siendo {{3}}video de formato corto{{/3}} con {{4}}audio sincronizado{{/4}}, no un {{5}}reemplazo de Veo 3.1{{/5}} — los {{6}}dos modelos{{/6}} apuntan a trabajos diferentes. La {{7}}consistencia de personajes{{/7}} entre cambios de escena mejora gracias a la {{8}}retroalimentación de 10 segundos{{/8}} y la {{9}}entrada de video de referencia{{/9}}, pero sigue siendo una {{10}}debilidad generativa{{/10}} que vale la pena probar con tu propio material en lugar de asumir. Cada clip generado lleva una {{11}}marca de agua SynthID{{/11}}, lo que importa para herramientas que necesitan {{12}}garantías de procedencia{{/12}}.

Y la advertencia honesta: no existe ningún benchmark independiente para Gemini Omni 1.1 Flash en ninguna tabla de clasificación pública de video al momento de escribir esto. La aceleración del 60% para borradores de 360p, la calidad a 1080p y 4K, la fiabilidad del condicionamiento del primer/último fotograma — todo reportado por el proveedor, nada reproducido por un tercero. Cualquiera que te cite una puntuación de calidad para este modelo hoy está citando un número que nadie fuera de los laboratorios de Go​gle ha producido.

Quién debería moverse ahora

Tres grupos obtienen valor de esta versión de inmediato. Los equipos que ya desarrollan sobre la API de Omni deberían cambiar los IDs de modelo y volver a probar sus rutas de extensión y control de fotogramas — la actualización es un cambio de campo de solicitud, no una rearquitectura. Quienes necesiten video de formato corto a gran escala — variantes de anuncios, cortes para redes sociales, activos de marca en bucle — deberían calcular el precio del flujo de trabajo de 360p desde el borrador hasta la versión final, porque ahí es donde la matemática de costos es realmente nueva. Y los equipos que estaban esperando la vista previa deberían probar el modelo ahora, porque los dos bloqueos que hacían inutilizable la vista previa para producción — clips de diez segundos y falta de continuidad de escena — son precisamente lo que esta actualización elimina.

El grupo que debería esperar está igualmente bien definido: si necesitas un benchmark de terceros o una tasa oficial de 4K por segundo antes de comprometer presupuesto, nadie los tiene todavía, y eso merece decirse sin rodeos en lugar de encubrirlo. El lanzamiento es real, los controles son reales, y la brecha de precios es la única parte que aún se mueve. Vigila la página de precios de la API de Gemini para conocer las tarifas de 1080p y 4K, y estate atento a las primeras evaluaciones independientes — en el momento en que otra persona ejecute este modelo, la salvedad reportada por el proveedor sobre cada afirmación de calidad en este artículo recibirá una marca de verificación o una bandera roja.

© 2026 OrcaRouter

Para proveedores

¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.

providers@orcarouter.ai

Únete a la comunidad

Discordsupport@orcarouter.aiXGitHubYouTube