Google lança Gemini Omni, modelo multimodal que transforma vídeos reais em cenas surreais
O Google apresentou na Google I/O 2026 o Gemini Omni, um novo modelo de IA capaz de gerar vídeos a partir de múltiplos formatos, incluindo texto, áudio, imagens estáticas e até mesmo vídeos reais. A ferramenta, que evolui a partir do Veo, permite criar cenas surreais com consistência de personagens e elementos, inicialmente disponível para usuários pagantes do Gemini via Flow e gratuitamente para Remixes no YouTube Shorts.
Funcionalidades e disponibilidade
O Gemini Omni, anunciado durante o Google I/O 2026, é um modelo multimodal que expande as capacidades do Veo, permitindo a geração de vídeos não apenas a partir de texto e áudio, mas também utilizando imagens estáticas e vídeos reais como base. A ferramenta, batizada de Omni Flash, promete transformar cenas cotidianas em produções surreais, mantendo a consistência de personagens e elementos visuais ao longo das múltiplas frames. Inicialmente, o Omni estará disponível para usuários pagantes do Gemini através da plataforma Flow, além de uma versão gratuita para criação de Remixes no YouTube Shorts.
Tecnologia por trás do Omni
O Gemini Omni representa um avanço significativo na geração de vídeos por IA, construído sobre a base do Veo, que já se destacava pela capacidade de criar cenas completas com sincronia labial quase perfeita. Enquanto o Veo 3 e sua versão mais recente, Veo 3.1, limitavam-se à criação de vídeos puramente gerados por IA a partir de texto e áudio, o Omni introduz a possibilidade de modificar e reformular vídeos reais, combinando diferentes tipos de entrada para produzir resultados inéditos e criativos.