Gemini Omni 1.1 Flash te permite crear con más control: llegan la extensión de escenas, el control de fotogramas y la resolución 4K. Ilustración regenerada.
Guides & Insights

Gemini Omni 1.1 Flash te permite crear con más control: extensión de escenas, control de fotogramas y llegada del 4K.

Autor

Magnus Corvin

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Gemini Omni 1.1 Flash se lanzó el 27 de agosto de 2026 como una actualización de producción del modelo de video multimodal, convirtiendo un generador de una sola toma de 10 segundos en algo más parecido a un instrumento de edición controlable. Las cifras destacadas son fáciles de pasar por alto porque el precio no cambió: un clip de 720p todavía cuesta $0.10 por segundo. Lo que cambió es cuánto de la toma puedes decidir: el modelo ahora extiende escenas hasta 40 segundos, respeta un primer y último fotograma especificados, genera vistas previas a 360p por aproximadamente un tercio del costo de 720p, y produce el resultado final a 1080p o 4K. Es el tipo de actualización donde las notas de la versión importan más que el lanzamiento.

El modelo es el sucesor de la vista previa de Gemini Omni Flash que estuvo disponible para desarrolladores el 30 de junio de 2026, y conserva todo lo que hizo distintivo al original: entrada multimodal — texto, imágenes, audio y video en una sola llamada — y edición conversacional de múltiples turnos donde refinas un clip hablando de él en lugar de regenerarlo desde cero. Lo que Gemini Omni 1.1 Flash agrega es control en los límites y control sobre el costo, que es precisamente lo que necesita un pipeline de producción y no una demostración de investigación.

Lo que realmente añade la actualización

Cuatro capacidades diferencian la versión 1.1 de la vista previa de junio, y cada una responde a una queja concreta que los desarrolladores tenían con la versión original.

Extensión de escena. El modelo ahora puede analizar hasta 10 segundos de contexto de video previo al continuar un clip; las versiones anteriores del modelo solo hacían referencia al último segundo. Las extensiones se realizan en incrementos de 10 segundos, hasta un total acumulado de 40 segundos. Por primera vez puedes producir algo que se lea como una secuencia con continuidad en lugar de un conjunto de clips adyacentes.

• Control de primer/último fotograma. Especifica el fotograma inicial y final de una toma y el modelo genera video continuo entre los dos fotogramas clave. Esto es lo que hace posibles las órbitas de cámara, las transiciones de zoom y los bucles sin interrupciones sin necesidad de un editor de video, porque la geometría de la toma ahora es una restricción en lugar de una suposición.

• Modo de borrador a 360p. Las vistas previas ligeras se renderizan hasta un 60% más rápido que el estándar de 720p, con aproximadamente un tercio del costo. Es una herramienta de guion gráfico/iteración: pruebas una docena de variaciones a bajo costo y luego renderizas solo la que funciona a resolución completa.

• Salida en 1080p y 4K. Los renders finales pueden ampliarse desde el límite original de 720p hasta 1080p o 4K, lo que marca la diferencia entre «apto para redes sociales» y «apto para transmisión». Las referencias de video de hasta tres segundos de duración ahora también pueden incluirse como entrada multimodal para mantener la consistencia del personaje y la coherencia visual entre tomas.

A generated graphic titled 'What changed in Gemini Omni 1.1 Flash'. Left column 'Gemini Omni Flash (June preview)': 'Max clip: 10s', 'Lookback: 1s', 'Resolution: 720p only', 'Frame control: none', '360p tier: no'. Right column 'Gemini Omni 1.1 Flash (Aug 27)': 'Max length: 40s via scene extension', 'Lookback: 10s', 'Resolution: 1080p & 4K', 'Frame control: first/last frame', '360p drafting: ~1/3 cost'. A footer reads 'Prices: $0.10/s at 720p on both; 1080p/4K pricing not yet published.' The OrcaRouter logo is composited in the bottom-right corner.

El panorama de precios aún se está estabilizando.

La cifra de 0,10 dólares por segundo que todo el mundo cita corresponde al nivel estándar de 720p y no ha cambiado desde la vista previa. La entrada cuesta 1,50 dólares por millón de tokens, ya sean de texto, imágenes, audio o vídeo, y la salida de texto cuesta 9,00 dólares por millón de tokens, con la misma estructura que el original. Lo que Google aún no ha publicado es el precio por segundo para los nuevos niveles de 1080p y 4K; las estimaciones de terceros los sitúan entre 1,5x y 3x respecto a la base de 720p, pero son estimaciones, no cifras de Google, así que trate cualquier presupuesto de producción en alta resolución como provisional hasta que la tarifa oficial aparezca en la página de precios de la API de Gemini.

El nivel de borrador de 360p es la palanca de costos deliberada: a aproximadamente un tercio del precio de 720p y hasta un 60% más rápido, cambia la economía de la iteración. Un equipo que hace diez borradores de una toma a 360p gasta aproximadamente lo mismo que tres borradores a 720p, que es la diferencia entre explorar y comprometerse temprano. Según lo reportado por el proveedor en todos los casos, pero los cálculos de rendimiento son aritmética simple sobre las propias cifras publicadas por Google.

A screenshot of the Gemini API Pricing page (ai.google.dev, captured August 28, 2026) showing the Free/Paid availability tiers and the model list including 'Gemini Omni Flash Preview' and 'Gemini 3.1 Flash Lite Image (Nano Banana 2 Lite)' — the vendor page for the $1.50 per million input token structure and the availability tiers.

Donde realmente puedes llamarlo

Gemini Omni 1.1 Flash ya está disponible a través de la API de Gemini en Google AI Studio bajo el ID de modelo gemini-omni-1.1-flash, y a través de la Gemini Enterprise Agent Platform para cargas de trabajo de producción: la misma interfaz sobre la que Adobe, Figma, GMI Cloud y Runway ya están construyendo sus integraciones con Agent Platform. El acceso para consumidores se implementó en paralelo: Google Flow tiene el conjunto completo de funciones para todos los suscriptores de Google AI Plus, Pro y Ultra a nivel mundial, y la extensión de escenas ya está disponible en la aplicación Gemini. En otras palabras, no es un lanzamiento en papel: la API, la plataforma de agentes y los canales de consumo se lanzaron el mismo día.

Esa amplitud merece un momento. El Gemini Omni Flash original se envió a los desarrolladores el 30 de junio con una etiqueta de vista previa pública, un límite estricto de generación de 10 segundos, la extensión de escenas explícitamente no admitida y referencias de video aceptadas por el esquema pero no procesadas correctamente. La versión 1.1 resuelve la mayor parte de esa lista en una sola actualización: el tope de 40 segundos, las referencias de video funcionales y una escalera de resolución adecuada son exactamente las brechas que dejó abiertas la era de la vista previa. Si la vista previa te echó para atrás porque no podía mantener una escena unida más allá de diez segundos, esta versión es la respuesta a esa queja específica.

A screenshot of the Gemini API developer documentation Models page (ai.google.dev, captured August 28, 2026) showing the docs navigation under 'Gemini API' — Models, Gemini Omni Flash, Nano Banana, Veo, Imagen — and the list of Gemini's generation models. It is the vendor's official developer page for the model family.

Lo que no ha cambiado

Con todo el nuevo control, el producto subyacente es la misma familia de modelos con las mismas compensaciones. La salida sigue siendo video de formato corto con audio sincronizado — esto no es Veo 3.1, el generador independiente de alta fidelidad de una sola toma de Google, y ambos están orientados a tareas diferentes. La consistencia de los personajes a través de los cambios de escena mejora con la retrospectiva más larga y la entrada de video de referencia, pero sigue siendo una debilidad generativa que deberías probar en lugar de asumir. Y el modelo lleva marca de agua SynthID en la salida, lo cual importa si estás construyendo una herramienta que necesita garantías de procedencia.

También vale la pena dejar claro lo que aún no se ha demostrado: no existe un benchmark independiente para Gemini Omni 1.1 Flash en un ranking público de video al momento de escribir esto. Las afirmaciones de Google —el 60% de aumento de velocidad para 360p, la calidad en 1080p/4K— provienen del proveedor. La historia de este lanzamiento es la lista de funciones y el precio, no una puntuación en una tabla, y cualquiera que te diga lo contrario está citando un número que nadie fuera del laboratorio ha producido.

Por qué «más control» es la historia

El hilo conductor de esta versión es que Google por fin les dio controles a los desarrolladores: longitud, encuadre, resolución y costo son ahora entradas en lugar de salidas. Eso es lo que hace que un modelo generativo se sienta como una herramienta y no como una máquina tragamonedas, y es la misma razón por la que la transparencia de costos importa en el lado de la infraestructura. Todos los equipos de modelos generativos con los que hablamos están luchando con los mismos dos problemas — economía unitaria y velocidad de iteración — y un modelo cuya iteración cuesta la tercera parte ataca ambos.

Ese tema de control de costos es donde una capa de enrutamiento demuestra su valor. OrcaRouter transmite los precios de lista de los proveedores sin margen alguno, de modo que cuando cambia la tarifa por segundo o por token de un modelo, el precio que ves de nuestro lado cambia el mismo día: sin margen entre tú y la cifra publicada por Google. Una API cubre más de 200 modelos, con conmutación automática por error si un proveedor está caído o un modelo de un día devuelve errores en plena producción; para un modelo que se lanzó ayer, la conmutación por error es la forma de probarlo sin arriesgar un pipeline en vivo por él. El propio Gemini Omni 1.1 Flash aún no es enrutable a través de nosotros — no afirmamos alojar un modelo que no alojamos — pero la disciplina de precios es el punto: cuando su nivel de API se abra al enrutamiento de terceros, aparecerá al precio de lista de Google, y la integración es un cambio de configuración, no una reescritura.

En resumen

Gemini Omni 1.1 Flash es la actualización que hace que el modelo de video de Gemini sea utilizable como herramienta de producción en lugar de una novedad: extensión de escenas a 40 segundos, control del primer y último fotograma, un nivel de borrador a 360p por un tercio del costo y salida a 1080p/4K. El precio de $0,10 por segundo a 720p no cambia, los precios de alta resolución siguen sin publicarse y todavía no hay un benchmark independiente: las afirmaciones de funciones de Google deben considerarse como reportadas por el proveedor hasta que otra persona ejecute el modelo. Si estaba esperando la vista previa porque diez segundos era demasiado corto y 720p demasiado pequeño, la espera terminó. Si necesita un benchmark o una tarifa oficial de 4K antes de comprometerse, la respuesta honesta es que nadie los tiene todavía.

Observa la página de precios de la API de Gemini para conocer las tarifas por segundo en 1080p/4K, espera las primeras evaluaciones independientes de la actualización 1.1 y observa el despliegue de suscriptores de Google Flow como un indicador de cuánta confianza tiene el equipo en la calidad del modelo a escala. El lanzamiento es real, los controles son reales, y la brecha de precios es la única parte que aún se está moviendo.