Google lança Gemini Omni, IA que cria e edita vídeos por conversa com consistência entre cenas
O Google apresentou o Gemini Omni, uma nova família de modelos de IA capaz de gerar e editar vídeos por meio de conversas em linguagem natural. A ferramenta, integrada ao YouTube Shorts e ao YouTube Create, permite alterar personagens, cenários e estilos visuais com comandos simples. O Gemini Omni Flash, primeiro modelo da linha, combina recursos do Veo e do Nano Banana, garantindo consistência entre cenas e interpretação dinâmica de movimentos.
Recursos e integrações do Gemini Omni
O Gemini Omni foi revelado durante o Google I/O 2026 e destaca-se pela capacidade de editar vídeos utilizando texto, imagens, áudio e outros vídeos como referência. A ferramenta permite que usuários conversem com a IA para realizar modificações, como trocar personagens, alterar cenários ou ajustar estilos visuais, tudo por meio de comandos em linguagem natural. O modelo foi desenvolvido para manter a consistência entre cenas e interpretar movimentos e dinâmicas de objetos de forma coesa, combinando tecnologias já presentes no Veo e no Nano Banana. O Gemini Omni Flash, primeiro integrante da família, começa a ser liberado nesta semana para assinantes e será integrado ao YouTube Shorts e ao aplicativo YouTube Create.
Contexto competitivo e encerramento do Sora
O lançamento do Gemini Omni ocorre em um momento de intensa competição no mercado de IA generativa. Recentemente, a OpenAI lançou o Images 2.0, uma ferramenta de edição conversacional dentro do ChatGPT, que foi vista como uma resposta ao sucesso do Nano Banana. No entanto, o Sora, que seria o principal concorrente direto do Gemini Omni, foi encerrado pela OpenAI em março de 2026. Com isso, o Google busca preencher essa lacuna, expandindo a lógica da edição conversacional para vídeos multimodais e utilizando o conhecimento contextual do Gemini para criar cenas mais coerentes e detalhadas.