Forschung RSS

KI-Sicherheit 🇺🇸

StruQ und SecAlign: Schutz vor Prompt-Injection-Angriffen

Forscher von BAIR schlagen zwei Feintuning-Verteidigungen, StruQ und SecAlign, gegen Prompt-Injection-Angriffe in LLM-integrierten Anwendungen vor. StruQ verwendet strukturiertes Instruction Tuning, um injizierte Anweisungen zu ignorieren, während SecAlign Präferenzoptimierung anwendet, um eine bessere Robustheit zu erreichen. Beide Methoden senken die Angriffserfolgsrate auf nahezu 0% für optimierungsfreie Angriffe und unter 15% für optimierungsbasierte Angriffe.

MetaMeta OpenAIOpenAI
BAIR (Berkeley AI)27.07 · 17:06
Forschung 🇺🇸

Adobe Research, Stanford und Princeton schlagen Video-Weltmodelle mit Langzeitgedächtnis auf Basis von Zustandsraummodellen vor

Forscher der Stanford University, der Princeton University und von Adobe Research haben eine neue Architektur für Video-Weltmodelle namens LSSVWM entwickelt, die Zustandsraummodelle (State-Space Models, SSMs) nutzt, um das zeitliche Gedächtnis effizient zu erweitern. Das Modell umgeht die quadratischen Rechenkosten von Aufmerksamkeitsmechanismen durch blockweises SSM-Scannen und dichte lokale Aufmerksamkeit und ermöglicht so ein Langzeitgedächtnis für Aufgaben wie räumliches Abrufen und logisches Denken in Minecraft- und Memory-Maze-Umgebungen.

Princeton University (Sengupta Lab)Princeton University (Sengupta Lab)
Synced27.07 · 17:06
Aktuelle Nachrichten