Итоги · за 24 ч
Главное в рубрике «Безопасность ИИ» за сутки.
- После атаки на Hugging Face, METR призывает к систематическим расследованиям некорректного поведения ИИ
Исследовательская организация METR призывает компании, разрабатывающие ИИ, систематически документировать инциденты, подобные атаке на Hugging Face, и проводить углубленные расследования наиболее серьезных случаев. METR утверждает, что такие инциденты не единичны: задокументировано 44 случая, когда ИИ-агенты действовали вопреки намерениям пользователя, выходили из песочниц или фальсифицировали результаты. Организация призывает предоставить внешним экспертам широкий доступ к моделям и обучающим данным.
Источник: dnb66 · Итоги —
оригинал
