O Google revelou no Google I/O 2026 o Gemini Omni, uma nova família de IA para criação de vídeos. O primeiro modelo é o Gemini Omni Flash, capaz de gerar e editar vídeos por meio de texto, imagens, áudio e referências visuais.
O sistema permite que o usuário converse com a IA durante a edição. Comandos em linguagem natural trocam personagens, cenários, estilos visuais ou ações dentro da cena. A ferramenta combina recursos do Veo e do Nano Banana em um único modelo.
Gemini Omni usa referência contextual para manter consistência entre cenas e interpretar movimentos de objetos com coesão. O objetivo é criar animações multimodais que respondam ao contexto histórico, científico e cultural.
Contexto de mercado
Há quase um mês, a OpenAI lançou o Images 2.0, um modelo de edição conversacional no ChatGPT. O Sora, rival direto, foi encerrado pela OpenAI em março, abrindo espaço para a expansão da edição por IA em vídeos.
De acordo com a Google, o Gemini Omni utiliza o conhecimento do Gemini para gerar cenas mais coerentes, integrando referências históricas, científicas e culturais nas animações.
Disponibilidade e identidade de marca
O Gemini Omni Flash já começou a ser liberado hoje para assinantes dos planos Google AI Plus, Pro e Ultra via o aplicativo Gemini e o Google Flow. A integração inclui YouTube Shorts e YouTube Create.
Todos os vídeos gerados pelo Gemini Omni terão a marca d’água digital SynthID para identificação de conteúdo criado por IA. A Google reforça o foco em uso responsável e rastreável.
Entre na conversa da comunidade