Google DeepMind présente Gemini Omni : un modèle multimodal pour la création et l'édition vidéo
Google DeepMind a annoncé Gemini Omni, un nouveau modèle capable de générer des vidéos à partir de n'importe quelle combinaison d'entrées : images, audio, vidéo et texte. La première version, Gemini Omni Flash, est déjà disponible dans l'application Gemini, Google Flow et YouTube Shorts, et sera bientôt accessible aux développeurs via API.
Google/DeepMind
DeepMind

