Google introduceert Auto Frame: neuraal netwerk verandert achteraf het perspectief van foto's
Google/DeepMind
Google DeepMind
Google Research
Google heeft Auto Frame gelanceerd in Google Foto's, een nieuwe functie die gebruikmaakt van ML-modellen en generatieve AI om foto's achteraf van een andere hoek te voorzien. Het systeem reconstrueert een 3D-scène, past de camerapositie en brandpuntsafstand aan en vult verborgen content in via diffusie-inpainting. Het detecteert en corrigeert ook automatisch groothoekvervorming bij portretten.
Google Research en Google DeepMind hebben Auto Frame geïntroduceerd, een functie die nu beschikbaar is in Google Foto's en waarmee foto's worden bewerkt door het cameraperspectief na het maken van de opname te veranderen. In tegenstelling tot traditioneel bijsnijden, interpreteert het een foto als een 3D-scène, schat het een 3D-puntkaart per pixel samen met de oorspronkelijke brandpuntsafstand, en gebruikt het vervolgens klassieke 3D-rendering om een nieuwe camerapositie en -intrinsieke parameters te simuleren. De gerenderde afbeelding heeft onvermijdelijk gaten op plaatsen waar voorheen onzichtbare inhoud zou verschijnen; deze worden opgevuld door een speciaal getraind latent diffusiemodel dat leert de doelweergave te reconstrueren vanuit een opnieuw gerenderde bronweergave. Voor portretten detecteren ML-modellen gezichten en hun 3D-oriëntatie om automatisch optimale kadrering voor te stellen en wijde-hoekvervorming te corrigeren door virtuele camera-intrinsieke parameters aan te passen. De volledig automatische oplossing is beschikbaar als de tweede weergaveoptie binnen de Auto Frame-kandidaten in Google Foto's.
Bron: Google Research —
origineel
