Qué es y en qué destaca
Google presentó Gemini Omni en mayo de 2026 como un modelo que une lo aprendido con Gemini, Veo y sus modelos de imagen. La idea es que el vídeo se pueda generar y editar por conversación: «quita el coche del fondo», «haz que llueva más», «cambia la luz a hora dorada», sin perder al personaje.
La versión Flash 1.1 está pensada para ser rápida y barata. Genera clips cortos con audio y vive dentro de Flow, la herramienta de montaje de Google, aunque también se puede usar desde otras plataformas.
Lo que vimos en nuestra prueba
Fue el modelo que más libertades se tomó con el encuadre: en lugar de respetar la posición del faro, giró la escena para que el haz de luz apuntara casi a cámara. El resultado es vistoso, pero si necesitas fidelidad al fotograma de partida, puede ser un problema.
El movimiento de la actriz es correcto y generó audio aunque no se lo pedimos de forma explícita. Costó unos 1.200 créditos en Magnific por 5 segundos a 1080p, un precio razonable.
Cuándo usarlo y cuándo no
Úsalo si trabajas en Flow, si te gusta corregir hablando en lugar de reescribir el prompt y para piezas cortas de redes donde la creatividad pesa más que la exactitud.
No lo uses cuando el fotograma de partida tenga que respetarse al milímetro, como en planos de continuidad de una historia. Para eso, FLUX 3 o Kling son más fieles.
Si quieres entender cómo encaja cada modelo de Google en un flujo de trabajo, lo tienes en el capítulo «Mapa de herramientas y grandes plataformas» del libro.
PROMPT DE EJEMPLO
Low-angle shot. The detective in the red raincoat slowly looks up as the lighthouse beam sweeps across the stormy night sky. Keep the lighthouse on the right side of the frame and the camera position unchanged. Slow push-in. Audio: heavy rain and wind.
Con Gemini Omni conviene indicar qué no debe cambiar, porque tiende a reinterpretar el encuadre.


