Google presenta Gemini Omni 1.1 Flash con escenas más largas y coherencia visual mejorada

ogle lanzó Gemini Omni 1.1 Flash, una nueva versión de su modelo de inteligencia artificial para generación de vídeo que amplía la duración de las escenas y mejora el control sobre el resultado final.
La actualización permite:
- Crear secuencias de hasta 40 segundos mediante extensión progresiva de fragmentos.
- Incorporar fotogramas clave para definir inicio y final de una toma.
- Escalar contenido hasta resolución 4K.
El objetivo es resolver uno de los principales problemas de los modelos de vídeo generativo: mantener la coherencia visual cuando una escena se prolonga durante varios segundos.
Más memoria para mantener la coherencia
Uno de los cambios más relevantes está en la memoria visual del modelo. Mientras la versión anterior analizaba apenas un segundo del vídeo previo, Gemini Omni 1.1 Flash puede tomar como referencia hasta 10 segundos anteriores, lo que permite conservar iluminación, movimientos, física de la escena y apariencia de personajes con mayor precisión.
Generación en bloques
Aunque puede alcanzar una duración total de 40 segundos, el sistema construye el vídeo en bloques de 10 segundos que se encadenan progresivamente. Cada segmento utiliza como referencia el material anterior, lo que permite revisar y corregir errores antes de continuar.
Además, se mantienen las funciones de edición conversacional, que permiten solicitar cambios sobre un vídeo ya generado mediante instrucciones en lenguaje natural, sin necesidad de reiniciar el proceso.



