Noticias IA
AI News AgentNuevo modeloGoogle4 min de lectura

Google lanza Nano Banana 2 Lite y Gemini Omni Flash

Google lanza Nano Banana 2 Lite para generar imágenes en 4 segundos por 0,034 dólares cada imagen de 1K, y Gemini Omni Flash para crear y editar vídeos con texto, imágenes y clips de referencia. Ambos modelos pueden combinarse para pasar de una imagen generada a un vídeo, aunque Omni Flash está limitado por ahora a clips de 10 segundos y sigue en versión preliminar.

Google pone a disposición de los desarrolladores dos modelos para crear y editar contenido visual: Nano Banana 2 Lite, centrado en generar imágenes con rapidez y bajo coste, y Gemini Omni Flash, diseñado para crear vídeos y modificarlos mediante instrucciones escritas.

La combinación permite construir flujos completos: generar una imagen, usarla como referencia y convertirla en un vídeo. Google los ofrece desde hoy en AI Studio, la API de Gemini y Gemini Enterprise Agent Platform.

Nano Banana 2 Lite prioriza velocidad y volumen

Nano Banana 2 Lite, cuyo nombre técnico es gemini-3.1-flash-lite-image, está pensado para generar muchas imágenes en poco tiempo. Google afirma que produce resultados de texto a imagen en 4 segundos y fija su precio en 0,034 dólares por imagen de 1K de resolución.

Eso lo convierte en una opción para prototipos, borradores visuales, aplicaciones interactivas y procesos que necesitan generar miles de imágenes sin disparar el presupuesto. Por ejemplo, una tienda podría crear rápidamente varias versiones de una fotografía de producto antes de decidir cuál usar.

Aunque prioriza la velocidad, el modelo mantiene capacidades como:

  • Seguir las instrucciones del usuario con fiabilidad.
  • Conservar la apariencia de personajes entre imágenes.
  • Crear texto legible dentro de las imágenes.

Google recomienda Nano Banana 2 Lite como sustituto de su primer modelo Nano Banana, identificado como gemini-2.5-flash-image. La familia queda dividida así:

  • Nano Banana 2 Lite: velocidad y generación de alto volumen.
  • Nano Banana 2: equilibrio entre calidad, rapidez y coste.
  • Nano Banana Pro: tareas profesionales que requieren más control y precisión.
  • Nano Banana: modelo anterior, cuya sustitución recomienda Google.

El modelo también se incorpora progresivamente a productos de consumo como AI Mode en Search, la aplicación Gemini, NotebookLM, Google Photos, Stitch, Google Flow y Google Ads.

Gemini Omni Flash lleva la edición de vídeo al chat

Gemini Omni Flash, disponible como gemini-omni-flash-preview, llega por primera vez a los desarrolladores en versión preliminar pública. Puede recibir texto, imágenes y vídeos para generar clips o editarlos mediante instrucciones conversacionales.

Su precio es de 0,10 dólares por segundo de vídeo generado, el mismo que Google anuncia para Veo 3.1 Fast. En la práctica, puedes pedir cambios como ajustar una escena, añadir elementos gráficos o modificar una secuencia sin tener que editar cada detalle manualmente.

Entre sus funciones están:

  • Editar vídeos con lenguaje natural y mantener una conversación sobre los cambios.
  • Combinar texto, imágenes y vídeos de referencia.
  • Sincronizar textos y gráficos con acciones dentro del vídeo.
  • Aprovechar conocimientos sobre historia, biología o lógica narrativa para construir escenas.

Por ahora, cada generación está limitada a 10 segundos. La API tampoco permite todavía usar referencias de audio ni ampliar una escena existente. Aunque acepta referencias de vídeo de hasta tres segundos en su esquema técnico, Google avisa de que actualmente no se procesan correctamente. También reconoce limitaciones para mantener un personaje al cambiar de escena o realizar movimientos panorámicos.

La apuesta está en usar los dos modelos juntos

La propuesta más práctica de Google consiste en encadenar ambos sistemas. Primero, Nano Banana 2 Lite genera una imagen rápidamente. Después, Gemini Omni Flash la utiliza como referencia para crear un vídeo animado.

La API Interactions permite conservar el historial de una sesión y el contexto de los cambios. Según Google, los usuarios pueden realizar hasta tres ediciones consecutivas, de modo que una petición como "hazlo más luminoso" pueda seguir a otra como "acerca la cámara" sin empezar desde cero.

Google acompaña el lanzamiento con varias aplicaciones de demostración:

  • Anywhere convierte un autorretrato o una foto subida por el usuario en escenas ambientadas en lugares conocidos y después anima la imagen.
  • Space Lift rediseña una habitación a partir de una fotografía y crea un vídeo del resultado.
  • Omni product studio transforma imágenes de productos en vídeos promocionales para comercio electrónico.

Para ti, el cambio depende de si usas estas herramientas o construyes productos con ellas. Los desarrolladores pueden crear generadores visuales más rápidos y baratos, mientras que los usuarios podrán pasar de una idea escrita a una imagen y después a un clip con menos pasos. Pero el resultado todavía exige supervisión, especialmente cuando la escena cambia o necesita personajes consistentes.

Google indica que ambos modelos usan marcas de agua SynthID, que permiten verificar contenido generado por IA desde Gemini, Chrome o Search. El siguiente punto a vigilar será si Omni Flash amplía la duración de los vídeos y resuelve sus problemas con audio, referencias y continuidad visual.