⚡ ÚLTIMA HORA
ModelosGeração de Mídia 🇺🇸 27.07.2026 14:04

Google DeepMind apresenta Gemini Omni: modelo multimodal para criação e edição de vídeos

Google/DeepMindGoogle/DeepMind DeepMindDeepMind
O Google DeepMind revelou o Gemini Omni, um modelo de IA multimodal capaz de gerar e editar vídeos a partir de qualquer combinação de imagens, áudio, vídeo e texto. O primeiro modelo da família, o Gemini Omni Flash, está sendo disponibilizado para assinantes do Google AI Plus, Pro e Ultra por meio do aplicativo Gemini e do Google Flow, e estará disponível gratuitamente para usuários do YouTube Shorts.
O Google DeepMind anunciou o Gemini Omni, um modelo multimodal que combina o raciocínio do Gemini com capacidades criativas para gerar e editar vídeos a partir de qualquer modalidade de entrada, incluindo imagens, áudio, vídeo e texto. O modelo suporta edição de vídeo em linguagem natural, mantém a consistência dos personagens e a física entre as edições, e pode gerar vídeos fundamentados no conhecimento do Gemini sobre o mundo real em física, história, ciência e cultura. Oferece recursos como edição por conversa, transformação de cenas, adição de objetos e refinamento em múltiplas interações. O primeiro modelo, o Gemini Omni Flash, está sendo disponibilizado para assinantes do Google AI Plus, Pro e Ultra globalmente por meio do aplicativo Gemini e do Google Flow, e também para usuários do YouTube Shorts e do YouTube Create App sem custo. Todos os vídeos gerados incluem marca d'água digital SynthID para transparência. O acesso para desenvolvedores e empresas via Application Programming Interface (API) está planejado para as próximas semanas.
Fonte: Google DeepMind — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas