Adobe Research与斯坦福和普林斯顿科学家提出基于状态空间模型的带长期记忆的视频世界模型
来自Adobe Research、斯坦福大学和普林斯顿大学的研究人员开发了LSSVWM架构,用于视频世界模型,解决了长期记忆问题。该模型使用状态空间模型和分块扫描方案,以及密集局部注意力,将效率与上下文保留相结合。在Memory Maze和Minecraft数据集上的实验表明,在长时间间隔内信息保留有显著改善。
Princeton University (Sengupta Lab)
Synced27.07 · 17:06
