Google lanza Gemini Omni 1.1 Flash, una IA para crear y ampliar vídeos con calidad profesional
Google ha presentado Gemini Omni 1.1 Flash, una nueva versión de su modelo de inteligencia artificial para la generación y edición de vídeo. La herramienta incorpora funciones orientadas a creadores, productoras y desarrolladores, como la ampliación de escenas, la creación de clips a partir de dos fotogramas de referencia y la generación de prototipos económicos antes de producir el resultado final.
El modelo ya está disponible para los suscriptores de Google AI Plus, Pro y Ultra a través de Google Flow. La función de extensión de escenas también llega a la aplicación Gemini para los usuarios de estos planes. Además, Gemini Omni 1.1 Flash se puede utilizar mediante la API de Google y desde Google AI Studio, la plataforma de la compañía para probar y desarrollar aplicaciones basadas en inteligencia artificial.
Extiende vídeos hasta 40 segundos sin romper la escena
Una de las principales novedades es la posibilidad de ampliar un vídeo existente hasta 40 segundos adicionales. La inteligencia artificial analiza el contenido original y genera nuevos fragmentos que intentan mantener la continuidad visual, el movimiento de los personajes y la coherencia de la narración.
La mejora más relevante frente a la versión anterior está en el contexto que utiliza el modelo. En lugar de fijarse únicamente en el último segundo del vídeo, Gemini Omni 1.1 Flash puede analizar los 10 segundos finales. Esta referencia más amplia le permite comprender mejor la acción, la iluminación, el escenario y la evolución de los elementos que aparecen en pantalla.
El límite de 40 segundos no se alcanza en una única generación. La herramienta trabaja con ampliaciones de hasta 10 segundos por cada operación, por lo que el usuario puede añadir nuevos tramos de manera progresiva. Este sistema también facilita revisar el resultado después de cada paso y corregir posibles errores antes de continuar.
Del primer al último fotograma con IA
Gemini Omni 1.1 Flash también permite crear un vídeo a partir de dos imágenes de referencia: una que define el comienzo y otra que marca el final. El modelo genera la transición entre ambos puntos, construyendo los fotogramas intermedios de acuerdo con las instrucciones del usuario.
Esta función puede resultar útil para producir animaciones, transiciones cinematográficas o demostraciones de producto. Por ejemplo, el creador puede indicar cómo debe aparecer un objeto al inicio y cuál debe ser su posición al terminar, mientras la inteligencia artificial se encarga de desarrollar el movimiento entre ambos momentos.
Como ocurre con cualquier sistema generativo, el resultado dependerá de la calidad de las imágenes de partida y de la descripción proporcionada. Las referencias claras y las instrucciones precisas ayudan a reducir cambios inesperados en la apariencia de los personajes, los objetos o los escenarios.
Prototipos en 360p para ahorrar tiempo y dinero
Otra de las funciones destacadas es la creación de vídeos preliminares en 360p. Esta resolución es inferior a la alta definición, pero permite generar borradores con mayor rapidez y un coste menor. De este modo, el usuario puede probar una idea, modificar el guion o ajustar el estilo visual antes de crear la versión definitiva.
En la práctica, este flujo de trabajo separa la fase de experimentación de la producción final. Si un encuadre no funciona o la evolución de una escena no convence, es posible repetir el proceso sin consumir tantos recursos como sucedería con un vídeo en 1080p o 4K.
La resolución 360p no está pensada para publicar el resultado final, sino para validar conceptos. Una vez aprobado el prototipo, el contenido puede generarse con una calidad superior, siempre teniendo en cuenta que aumentan tanto el tiempo de procesamiento como el precio.
Escalado hasta 4K y precios por segundo
El modelo también incorpora funciones de escalado de vídeo. Esta tecnología aumenta la resolución de un clip original, por ejemplo, desde una calidad baja hasta 1080p o 4K. El sistema intenta reconstruir detalles y mejorar la definición, aunque el escalado no equivale necesariamente a recuperar información que nunca estuvo presente en la grabación original.
El precio de Gemini Omni 1.1 Flash depende de la resolución y de la duración del vídeo generado:
- 360p: 0,03 dólares por segundo.
- 720p: 0,10 dólares por segundo.
- 1080p: 0,15 dólares por segundo.
- 4K: 0,30 dólares por segundo.
Con estas tarifas, un clip de 40 segundos costaría 1,20 dólares en 360p, 4 dólares en 720p, 6 dólares en 1080p y 12 dólares en 4K, sin contar otros posibles costes asociados al servicio. En el caso de las extensiones, el gasto final dependerá de los segundos añadidos y de la resolución seleccionada.
Disponibilidad para usuarios y desarrolladores
Google orienta Gemini Omni 1.1 Flash tanto a consumidores como a profesionales. Los usuarios de pago pueden acceder a sus funciones desde Google Flow y la aplicación Gemini, mientras que los desarrolladores tienen la opción de integrarlas en sus propios servicios mediante una API, una interfaz que permite que dos aplicaciones intercambien instrucciones y resultados.
La llegada a Google AI Studio facilita además las pruebas rápidas del modelo y la creación de prototipos técnicos. Con esta actualización, Google refuerza su apuesta por la generación de vídeo mediante IA con un sistema que combina edición, creación desde referencias, experimentación de bajo coste y producción en resoluciones de hasta 4K.



