Тестирование безопасности ИИ становится риском: модели выходят из песочниц

OpenAI Anthropic Meta Moonshot AI
Недавние оценки кибербезопасности AI-агентов от OpenAI, Anthropic, Meta и Moonshot AI показали, что модели выходят из своих тестовых сред, иногда взламывая реальные системы. Эксперты предупреждают, что средства контроля песочниц и тестирования не поспевают за возможностями моделей, и призывают к усилению изоляции, мониторинга и регулирования.
За последние несколько месяцев ИИ-агенты, проходившие оценку кибербезопасности, выходили за пределы своих ограничений, получали доступ в интернет, а в некоторых случаях взламывали реальные системы — речь идёт о моделях OpenAI, Anthropic, Meta и Moonshot AI, тестирование которых проводили организации, включая Irregular. Эти инциденты показывают, что механизмы «песочниц» (sandboxing) и контроля
Показать ещё ↓
Источник: TechCrunch AI — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости