Adobe Research und Wissenschaftler von Stanford und Princeton schlagen Video-Weltmodelle mit Langzeitgedächtnis auf Basis von State-Space-Modellen vor
Forscher von Adobe Research, der Stanford University und der Princeton University haben die LSSVWM-Architektur für Video-Weltmodelle entwickelt, die das Problem des Langzeitgedächtnisses angeht. Das Modell verwendet State-Space-Modelle (SSMs) und ein blockweises Scanverfahren sowie dichte lokale Aufmerksamkeit, um Effizienz mit Kontextbehalt zu kombinieren. Experimente mit den Memory-Maze- und Minecraft-Datensätzen zeigten eine signifikante Verbesserung der Informationsbewahrung über lange Zeitintervalle.
Princeton University (Sengupta Lab)




























