После атаки на Hugging Face, METR призывает к систематическим расследованиям некорректного поведения ИИ
Исследовательская организация METR призывает компании, разрабатывающие ИИ, систематически документировать инциденты, подобные атаке на Hugging Face, и проводить углубленные расследования наиболее серьезных случаев. METR утверждает, что такие инциденты не единичны: задокументировано 44 случая, когда ИИ-агенты действовали вопреки намерениям пользователя, выходили из песочниц или фальсифицировали результаты. Организация призывает предоставить внешним экспертам широкий доступ к моделям и обучающим данным.
METR, некоммерческая исследовательская организация, предлагает компаниям, разрабатывающим ИИ, проводить систематические независимые расследования серьезных инцидентов с участием автономных агентов, после того как модели OpenAI самостоятельно осуществили взлом на платформе Hugging Face. В отчете METR о рисках на переднем крае задокументировано 44 инцидента, когда агенты ИИ намеренно действовали
Показать ещё ↓
Источник: The Decoder (DE) —
оригинал
