Google lanza Gemini Omni 1.1 Flash para crear vídeo
Google presenta Gemini Omni 1.1 Flash, una actualización para generar vídeo con más control sobre escenas, transiciones y referencias visuales. Permite extender clips hasta 40 segundos, crear borradores 360p hasta un 60% más rápido y producir salidas en 1080p o 4K.

Google presenta Gemini Omni 1.1 Flash, un modelo de generación de vídeo que ofrece más control sobre las escenas, las transiciones y la calidad final. Ya está disponible para desarrolladores a través de la API de Gemini y Google AI Studio.
La actualización está pensada para crear herramientas de edición, flujos de trabajo audiovisuales y aplicaciones capaces de producir vídeo sin depender de ajustes manuales para cada cambio. La diferencia está en que ahora puedes definir mejor cómo empieza, continúa y termina una toma.
Escenas más largas y consistentes
La función de extensión de escenas permite continuar un vídeo existente desde el punto en el que terminó. Gemini Omni 1.1 Flash analiza hasta 10 segundos del contexto anterior, frente al último segundo que utilizaban modelos previos.
Eso ayuda a conservar mejor la apariencia de los personajes, el movimiento de la cámara y la lógica de la escena. Puedes ampliar un vídeo en tramos de 10 segundos hasta alcanzar una duración acumulada máxima de 40 segundos.
En la práctica, sirve para convertir un clip corto en una secuencia más larga sin que el personaje cambie de aspecto o el entorno salte de forma evidente.
Control sobre el primer y el último fotograma
Los desarrolladores también pueden indicar el fotograma inicial y el final de una toma. El modelo genera el vídeo que conecta ambos puntos, una opción útil para crear:
- Movimientos de cámara alrededor de un personaje.
- Transiciones con zoom o barridos laterales.
- Bucles que terminan de forma parecida a como empiezan.
- Tomas continuas sin cortes visibles.
Esto permite describir una escena compleja y fijar sus extremos, en lugar de esperar que la IA decida por completo cómo evoluciona el plano.
Previsualizaciones más rápidas y baratas
Para probar ideas, Omni 1.1 Flash puede generar vídeos en resolución 360p hasta un 60% más rápido y por un tercio del coste de una generación estándar en 720p, según Google.
La compañía plantea este modo como una herramienta de borrador para crear storyboards, probar instrucciones y repetir escenas antes de producir la versión final. Cuando el resultado está definido, el modelo puede generar salidas en 1080p o 4K para trabajos de mayor calidad.
La resolución de 360p no sustituye al vídeo final, pero sí reduce el tiempo y el coste de iterar. Esa diferencia importa cuando una escena necesita decenas de intentos.
Referencias de vídeo para mantener personajes y movimientos
La API también permite incluir hasta tres segundos de vídeo de referencia como parte de la entrada multimodal. Así, una aplicación puede usar vídeos existentes para conservar movimientos, estilo visual o comportamiento de un personaje.
Por ejemplo, un desarrollador podría asignar a distintos personajes los pasos de baile de tres vídeos diferentes y pedir que todos actúen juntos en un mismo espacio, en una sola toma y sin cortes.
La función está orientada a herramientas creativas y de edición que necesitan algo más que una descripción escrita. Las referencias aportan información sobre ritmo, postura y movimiento que el texto por sí solo no siempre puede expresar.
Dónde se puede utilizar
Google está incorporando Gemini Omni 1.1 Flash a su ecosistema para desarrolladores:
- Google AI Studio, para probar el modelo y crear prototipos.
- Gemini Enterprise Agent Platform, para despliegues empresariales.
- La API, junto con documentación, ejemplos y guías de instrucciones.
El modelo también llega a los suscriptores globales de Google AI Plus, Pro y Ultra dentro de Google Flow. La extensión de escenas estará disponible para esos mismos planes en la aplicación Gemini.
Para ti, el cambio más importante no es solo que la IA genere vídeo. Es que ahora ofrece más herramientas para repetir una idea, corregirla y llevarla a una versión utilizable: puedes trabajar con borradores rápidos, fijar los extremos de una toma, reutilizar referencias y producir después una salida en alta resolución.
El siguiente punto a vigilar será la consistencia en proyectos más largos. Google limita por ahora la extensión acumulada a 40 segundos y las referencias de vídeo a tres segundos, así que las producciones complejas todavía requieren dividir el trabajo en varias tomas y revisar el resultado.