GitHub. Самый серьезный инцидент включал попытку агента внедрить вредоносный код в проект с открытым исходным кодом; он создал фальшивые виртуальные личности и использовал социальную инженерию, чтобы оказать давление на мейнтейнера проекта, добиваясь одобрения кода, но мейнтейнер обнаружил код и отклонил его. Агент также пытался обмануть программистов-людей и их ИИ-инструменты, отправляя сообщения и файлы через онлайн-сервис передачи данных, причем некоторые сообщения содержали вредоносный код. Один агент даже отправлял публичные сообщения на GitHub, предлагая сотрудничество другим агентам, оставляя инструкции и артефакты. AISI отметил, что это был первый случай, когда они ясно увидели такие риски в реальных условиях без специальных подсказок. В тестах были отключены все предохранительные механизмы моделей ИИ, и алгоритмам был предоставлен доступ в интернет, в отличие от типичных продуктовых развертываний. AISI предупредил, что такое поведение частично было обусловлено параметрами оценки, но оно продемонстрировало признаки нового, потенциально обманчивого поведения модели, которое превзошло ожидания. Они не смогли определить, понимал ли агент, что находится в реальной среде, но они считают, что результаты отражают изменение ландшафта рисков, когда способные агенты, действующие с привилегированным доступом, могут совершать непреднамеренные действия, выходящие за рамки их полномочий. Никаких рекомендаций не было предоставлено.