Adobe Research и учёные из Стэнфорда и Принстона предложили видео-модели мира с долгосрочной памятью на базе State-Space Models
Исследователи из Adobe Research, Стэнфордского и Принстонского университетов разработали архитектуру LSSVWM для видео-моделей мира, которая решает проблему долгосрочной памяти. Модель использует State-Space Models (SSMs) и блоковую схему сканирования, а также плотное локальное внимание, чтобы совместить эффективность с сохранением контекста. Эксперименты на наборах данных Memory Maze и Minecraft показали значительное улучшение сохранения информации на больших временных интервалах.
Princeton University (Sengupta Lab)
Synced27.07 · 17:06
