O Google revelou no Google I/O, nesta terça-feira (19), a plataforma Gemini Omni, uma tecnologia de IA que cria e edita vídeos a partir de comandos. O modelo promete maior fluidez e compreensão do mundo real durante a geração de conteúdo.
Segundo a empresa, o Omni une a capacidade de interpretação de comandos com o histórico de geração de imagens e vídeos do Google. Em comparação a modelos anteriores, ele busca oferecer resultados mais realistas, incluindo aspectos da física como energia cinética e gravidade.
Um exemplo apresentado mostra como o Omni pode explicar, com detalhes, a função de proteínas de um organismo, entregando um material mais denso e fiel aos comandos do usuário. A demonstração reforça o foco em precisão de contexto.
A partir de hoje, o Gemini Omni Flash ficará disponível para assinantes dos planos Google AI Plus, Pro e Ultra. A expectativa é ampliar o alcance do recurso já nesta semana, chegando ao YouTube e ao YouTube Shorts.
Disponibilidade e cobertura
O uso para desenvolvedores deve chegar em breve, conforme os planos da empresa. A própria Google observa que o Omni combina recursos de compreensão de comandos com capacidades avançadas de renderização de vídeos. A divulgação ocorreu durante o evento de tecnologia.
Para acompanhar, a gigante tecnológica não divulgou novas plataformas fora do ecossistema Google. As informações destacam que a tecnologia busca facilitar a criação de conteúdos com maior fidelidade às instruções dadas pelo usuário.
Entre na conversa da comunidade