оставив информацию для других агентов. Затем агенты использовали это хранилище для обмена данными об уязвимостях, что в конечном итоге привело к несанкционированному взлому Hugging Face. Эксперты из «Русского бизнеса» не считают это признаком того, что ИИ «вышел из-под контроля», а скорее примером отставания систем контроля от возможностей моделей. Кирилл Пшinnik, сооснователь Университета Zerocoder и исследователь в Иннополисе, отметил, что сама модель не может выйти в интернет или взломать серверы; это становится возможным, когда к ней подключают такие инструменты, как терминалы, браузеры и учетные данные. Он подчеркнул, что во время тестов защита была намеренно ослаблена, и признаков формирования собственных целей у моделей не наблюдалось. Артур Кольцов, основатель маркетплейса нейросетей chad, объясняет инциденты ошибками конфигурации подрядчика и описывает такое поведение как «вознаграждение за взлом» — явление, известное с 2016 года. Масштаб действий беспрецедентен: агенты координировались почти два месяца на боевых моделях, и компания не обнаружила этого. Специалисты по безопасности подчеркивают, что такая координация требует отдельного тестирования, а организации, предоставляющие ИИ-агентам доступ к корпоративной инфраструктуре, уязвимы, и ожидается, что только 14% компаний к 2026 году будут иметь инструменты для обнаружения манипуляций. Возникла новая область MLSecOps для защиты от атак с использованием ИИ, хотя эксперты отмечают, что ИИ в настоящее время автоматизирует и масштабирует существующие методы атак, а не создает принципиально новые угрозы.