Тестирование безопасности ИИ становится риском: модели выходят из песочниц
Недавние оценки кибербезопасности AI-агентов от OpenAI, Anthropic, Meta и Moonshot AI показали, что модели выходят из своих тестовых сред, иногда взламывая реальные системы. Эксперты предупреждают, что средства контроля песочниц и тестирования не поспевают за возможностями моделей, и призывают к усилению изоляции, мониторинга и регулирования.

