Qué están creando cinco desarrolladores con Gemini Omni

Gemini Omni transforma la producción de video al permitir generar y editar clips mediante instrucciones conversacionales. Aquí revisamos cinco proyectos destacados y qué posibilidades abren para creadores, empresas y equipos en América Latina.

Por Redaccion TD
Qué están creando cinco desarrolladores con Gemini Omni

Un salto hacia el video conversacional

Gemini Omni, presentado por Google como parte de la familia Omni, propone una forma distinta de crear y editar video: hablarle a la herramienta como si fuera una conversación y obtener resultados realistas. Omni acepta entradas de texto, imagen, video o audio, y aplica comprensión del mundo físico junto con conocimiento general para mantener coherencia en escenas complejas.

Aunque la tecnología aún se describe como experimental, los primeros accesos para desarrolladores han generado demos que ayudan a entender el potencial creativo y productivo de esta generación de modelos.

Cambiar ángulos y perspectivas sin regrabar

Una de las capacidades más llamativas de Omni es la facilidad para modificar el punto de vista en una toma. En manos del creador Leon Lin, identificado como @LexnLin, se transformó un único registro de una mujer en el centro de una ciudad en alrededor de 20 perspectivas distintas.

El resultado muestra la misma escena desde primeros planos y tomas lejanas, vistas desde arriba y desde abajo, perfiles y planos frontales. Algunos encuadres hacen zoom, otros permanecen fijos, y el fondo varía entre aceras, cruces y calles con peatones, autos y tranvías.

Para equipos de producción en América Latina, esto abre la posibilidad de ampliar el material grabado localmente sin necesidad de costosas regrabaciones o desplazamientos. Productoras pequeñas y departamentos de marketing pueden explorar múltiples narrativas visuales a partir de una sola jornada de rodaje.

Transformar el mundo que aparece en pantalla

Omni permite alterar la acción y los detalles ambientales de un video preservando la coherencia del conjunto. Un ejemplo claro fue el trabajo de Carlos Santana, conocido en redes como @DotCSV, quien con comandos de voz transformó un exterior diurno en una escena nocturna, añadió cielos nublados y sonidos de lluvia, convirtió hojas verdes en colores otoñales y cubrió el suelo de nieve.

Este tipo de edición no solo facilita variaciones estéticas, también es útil para creativos que necesitan simular condiciones climáticas o temporales distintas según audiencias o campañas sin salir a filmar nuevamente.

Animar objetos cotidianos con bocetos

Integrando Omni en Google Flow, es posible transformar garabatos en elementos animados dentro de un video. El creador Pan, identificado como @sebatheepan, realizó una serie de transformaciones lúdicas: un limón que se convierte en un submarino, una taza de espresso que se eleva como un globo aerostático, o unas tijeras que pasan a ser un tiburón.

La herramienta deja decidir si los elementos dibujados permanecen como parte del producto final o solo sirven de guía para el movimiento. Para diseñadores y equipos de experiencia de usuario en la región, esto abre caminos para prototipado visual rápido y presentaciones más atractivas sin depender de largos procesos de animación tradicionales.

Jugar con estilos y efectos visuales

Otra línea de uso es cambiar por completo la estética de un clip. Con referencias visuales o una descripción en lenguaje natural, Omni puede reestilizar una secuencia para adoptar distintos lenguajes visuales.

El desarrollador Jerrod Lew demostró esta capacidad al transformar un video de una mujer caminando en la calle, pasando fluidamente del live action a estilos como anime o claymation sin interrumpir la progresión natural del personaje.

Esta flexibilidad es valiosa para agencias creativas y estudios que atienden múltiples mercados latinoamericanos y buscan adaptar una pieza a distintas audiencias con estéticas locales o internacionales.

Prototipos y soluciones prácticas

El equipo de Hyperagent mostró usos orientados a producto: integrar propuestas de paisajismo en un parque vacío para visualizar antes y después; personificar datos con un profesor animado que explica dashboards; y gamificar listas de tareas mediante personajes que resuelven pendientes.

Estos ejemplos subrayan cómo Omni puede servir tanto a narrativas creativas como a aplicaciones de negocio: desde propuestas de diseño urbano hasta herramientas internas de comunicación. La mezcla de lógica del mundo real con creatividad permite escenas que respetan continuidad y física básica, algo crítico cuando se busca credibilidad en videos para clientes o usuarios finales.

Dónde probar Omni

Según los demos y el anuncio, Omni está accesible a través de varias herramientas y plataformas de Google, incluyendo la app Gemini, Google Flow, Google AI Studio, la Gemini API y la Gemini Enterprise Agent Platform. Cada una ofrece distintos flujos para creadores, desarrolladores y equipos corporativos.

Implicaciones y oportunidades en América Latina

Para la región, las aplicaciones de Gemini Omni pueden ser muy concretas: crear material audiovisual multilingüe y localizable sin grandes presupuestos, acelerar la generación de contenido para e-learning en mercados con baja disponibilidad de producción profesional, apoyar a pequeñas agencias y estudios para competir con piezas de alto valor visual, y facilitar propuestas urbanísticas o arquitectónicas mediante visualizaciones rápidas.

Al mismo tiempo, es importante considerar aspectos éticos y legales: derechos sobre material original, representación de personas y entornos, y el uso responsable de imágenes generadas que podrían parecer reales. La declaración de experimentalidad de la tecnología invita a probarla con atención, establecer controles de calidad y transparencia para audiencias y clientes.

Conclusión

Los primeros proyectos con Gemini Omni muestran cómo la generación y edición de video pueden virar hacia una experiencia conversacional y creativa. Desde cambiar ángulos y estilos hasta animar bocetos y prototipar soluciones de negocio, los demos ofrecen un mapa de posibilidades para creadores y empresas.

Para equipos en América Latina, Omni representa una herramienta que puede reducir costos y tiempos de producción, ampliar la capacidad creativa de pequeños estudios y facilitar la localización de contenidos. Sin embargo, su uso debe combinarse con criterios de verificación, respeto por derechos y consideración ética, mientras la tecnología sigue evolucionando.

Fuente original: Google AI Blog