Forschung RSS

Forschung 🇺🇸

Adobe Research, Stanford und Princeton schlagen Video-Weltmodelle mit Langzeitgedächtnis auf Basis von Zustandsraummodellen vor

Forscher der Stanford University, der Princeton University und von Adobe Research haben eine neue Architektur für Video-Weltmodelle namens LSSVWM entwickelt, die Zustandsraummodelle (State-Space Models, SSMs) nutzt, um das zeitliche Gedächtnis effizient zu erweitern. Das Modell umgeht die quadratischen Rechenkosten von Aufmerksamkeitsmechanismen durch blockweises SSM-Scannen und dichte lokale Aufmerksamkeit und ermöglicht so ein Langzeitgedächtnis für Aufgaben wie räumliches Abrufen und logisches Denken in Minecraft- und Memory-Maze-Umgebungen.

Princeton University (Sengupta Lab)Princeton University (Sengupta Lab)
Synced27.07 · 17:06
Forschung 🇺🇸

MIT stellt SEAL vor: Ein neuer Schritt zu selbstverbessernder KI

Forscher am MIT haben SEAL (Self-Adapting LLMs) vorgeschlagen, ein Framework, das großen Sprachmodellen ermöglicht, ihre eigenen Gewichte durch bestärkendes Lernen zu aktualisieren. Die Methode generiert Selbst-Editierungen, um Trainingsdaten zu erzeugen, und verbessert die Leistung bei nachgelagerten Aufgaben. Experimentelle Ergebnisse zu Few-Shot-Lernen und Wissensintegration zeigen signifikante Verbesserungen gegenüber den Baselines.

MITMIT MetaMeta Alibaba/QwenAlibaba/Qwen OpenAIOpenAI DeepMindDeepMind
Synced27.07 · 17:06
Aktuelle Nachrichten