
El canal de YouTube Xavier Mitjana publicó un video en el que analiza en profundidad el nuevo modelo de inteligencia artificial de Google orientado a la generación y edición de video, presentado como Gemini 1.1 Flash. A lo largo de la demostración, el autor pone a prueba la herramienta con varios ejemplos propios y explica cómo usarla tanto en Google Flow, la plataforma oficial de Google, como en servicios externos como Magnific.
El punto central del análisis es que este modelo permite tomar un video ya grabado y aplicarle una instrucción en lenguaje natural, como incorporar un objeto, cambiar el material de un elemento, modificar el estilo de la escena o eliminar algo que aparecía en el plano. Según lo mostrado, el resultado conserva la luz, el encuadre y el movimiento de cámara originales, sin necesidad de recurrir a herramientas tradicionales de composición como After Effects ni a técnicas de rotoscopia.
El video recuerda que el modelo salió el 27 de agosto y debutó en el primer puesto del listado de video de Design Arena. Su predecesor ya lideraba esa lista, por lo que la mejora clave no estaría en la posición, sino en la forma de trabajar: ahora el usuario puede probar una idea en calidad borrador por un costo muy bajo y, si el resultado convence, escalarlo después a resoluciones superiores.
Una de las funciones destacadas es la extensión de escenas. El modelo puede tomar hasta 10 segundos de contexto previo y generar incrementos de 10 segundos, hasta llegar a 40 segundos de duración total acumulada. En la prueba mostrada, una misma escena inicial recibió tres instrucciones distintas y mantuvo la continuidad visual en los tres casos.
También se explica el flujo de trabajo con la resolución de borrador de 360p. Esa opción reduce el tiempo de generación en 60% y abarata el costo a un tercio en comparación con la resolución estándar de 720p, con la posibilidad de reescalar el clip elegido a 720p o incluso a 4K. De hecho, el autor destaca que el modelo admite clips de hasta 10 segundos en definición 4K y que desde su lanzamiento se ofrece también a través de APIs.
El autor generó sus ejemplos utilizando Magnific, donde automatizó parte del proceso mediante MCP y accedió a generación ilimitada de imágenes y video con modelos como Nano Banana 2 y Clean 2.5. Además, explicó que Google Flow permite generar alrededor de 50 videos al mes para quienes cuentan con una cuenta Pro de Gemini, trabajando en 720p o 360p y descargando en 1080p. La resolución 4K quedaría reservada para las cuentas Ultra. En el video se advierte que, al generar clips con personas desde Europa, pueden aparecer restricciones, por lo que el presentador recomienda el uso de una VPN.
Entre los ejemplos creados por Xavier Mitjana figuran un control de Xbox que cambia de material, una libreta convertida en libro con textos coherentes en portada, lomo y contraportada, y una serpiente que sale de la pantalla de un portátil. También se mostraron tareas más complejas, como eliminar un micrófono del plano, incorporar un gato en movimiento, transformar a una persona en llamas o reemplazar el fondo de una escena. El autor destaca la posibilidad de trabajar de manera iterativa: un primer video se vuelve a ingresar al sistema para introducir nuevos ajustes y mantener la coherencia del resultado.
El análisis concluye que el nivel de control y la calidad obtenida ya resultan suficientes para sectores con alta demanda de producción audiovisual, como la arquitectura o la publicidad digital. A modo de ejemplo, se muestra cómo generar un video de un edificio a partir de una imagen estática o cómo crear clips para exhibir productos que no existen físicamente. El presentador cierra con una pregunta para la audiencia: si la inteligencia artificial en este estado de desarrollo hace innecesario aprender a utilizar herramientas como After Effects.
APLICABILIDAD PARA ABOGADOS
Las funciones demostradas en el video pueden tener aplicación concreta en la actividad jurídica. Por ejemplo, la eliminación de objetos y la mejora de resolución permiten limpiar videos que se ofrecerán como prueba, quitando elementos que obstruyen la visión y logrando una imagen nítida en 1080p o 4K para su exhibición en audiencia. Esto resuelve el problema de los registros audiovisuales defectuosos o de baja calidad.
La generación de planos a partir de una imagen de referencia puede servir para producir animaciones breves que reconstruyan visualmente un escenario o una secuencia de hechos, facilitando la preparación de informes periciales o la exposición de una hipótesis fáctica ante el tribunal. Esta herramienta ayuda a comunicar circunstancias que hasta ahora solo podían describirse verbalmente.
La extensión de escenas con continuidad visual permite crear videos explicativos más largos, por ejemplo, para mostrar el desarrollo de un procedimiento o el paso del tiempo en un lugar determinado, sin cortes bruscos entre tomas. Por su parte, la edición por instrucciones sirve para actualizar materiales de capacitación interna de un estudio jurídico, como videos de inducción o de actualización normativa, cambiando fondos o elementos sin necesidad de regrabar.
Finalmente, el escalado a alta resolución es útil para preparar presentaciones audiovisuales para audiencias o reuniones de trabajo, asegurando que los videos se vean con nitidez en pantallas grandes. Estas aplicaciones derivan de las capacidades exhibidas en el video y pueden adaptarse a las necesidades específicas de cada abogado o equipo jurídico.
Nota del Editor Fotografía referencial generada por Inteligencia Artificial.








