⚡ BREAKING
Google DeepMind introduceert Gemini Omni: multimodale model voor videocreatie en -bewerking
Google/DeepMind
DeepMind
Google DeepMind heeft Gemini Omni onthuld, een multimodaal AI-model dat video's kan genereren en bewerken op basis van elke combinatie van afbeeldingen, audio, video en tekst. Het eerste model in de familie, Gemini Omni Flash, wordt uitgerold naar abonnees van Google AI Plus, Pro en Ultra via de Gemini-app en Google Flow, en zal gratis beschikbaar zijn voor gebruikers van YouTube Shorts.
Google DeepMind heeft Gemini Omni aangekondigd, een multimodaal model dat de redeneervaardigheden van Gemini combineert met creatieve mogelijkheden om video's te genereren en te bewerken vanuit elke invoermodaliteit, waaronder afbeeldingen, audio, video en tekst. Het model ondersteunt natuurlijke taalvideobewerking, handhaaft karakterconsistentie en fysica bij bewerkingen en kan video's genereren die gebaseerd zijn op Gemini's real-world kennis van natuurkunde, geschiedenis, wetenschap en cultuur. Het biedt functies zoals bewerken via gesprekken, scènes transformeren, objecten toevoegen en verfijnen over meerdere rondes. Het eerste model, Gemini Omni Flash, wordt wereldwijd uitgerold naar Google AI Plus-, Pro- en Ultra-abonnees via de Gemini-app en Google Flow, en ook naar YouTube Shorts- en YouTube Create App-gebruikers zonder extra kosten. Alle gegenereerde video's bevatten SynthID digitale watermerken voor transparantie. API-toegang voor ontwikkelaars en bedrijven is gepland voor de komende weken.
Bron: Google DeepMind —
origineel
