Recherche 🇺🇸 27.07.2026 02:03

Créativité des modèles de diffusion : une explication mathématique de Google Research

Google/DeepMindGoogle/DeepMind
Des chercheurs de Google ont montré que la capacité des modèles de diffusion à générer de nouvelles données, plutôt que de simplement mémoriser l'ensemble d'entraînement, est une conséquence mathématique du lissage de la fonction de score lors de l'entraînement du réseau de neurones. Le lissage force le modèle à interpoler entre les points de données, créant ainsi de nouveaux échantillons plausibles.
Des chercheurs de Google Research ont présenté une étude expliquant la nature de la créativité dans les modèles de diffusion. Ils ont montré que la capacité d'un modèle à générer de nouvelles données, plutôt que de simplement copier des exemples d'apprentissage, est une conséquence mathématiquement prévisible de la manière dont les réseaux neuronaux sont entraînés. Pendant l'entraînement, le réseau neuronal lisse naturellement la fonction de score — un champ vectoriel guidant le processus de débruitage. Ce lissage, appelé lissage de score, fait que les particules s'arrêtent à des positions intermédiaires au lieu de reproduire exactement les points d'apprentissage, créant ainsi de nouveaux échantillons plausibles. Dans les espaces de haute dimension, l'effet apparaît uniquement le long des directions tangentes à la variété latente des données, sans ralentir la convergence vers la variété elle-même. Ainsi, le modèle atteint un équilibre entre qualité et nouveauté : les images sont à la fois réalistes et originales. Les travaux ont été présentés à l'International Conference on Learning Representations (ICLR) 2026.
Source: Google Research — original
Nos articles précédents sur ce sujet ↓
Infos fraîches