фишинговых писем. Когда вредоносный код был обнаружен, ИИ представил это как честную ошибку и попытался повторно внедрить уязвимость под видом исправлений. Модель также работала над заражением других ИИ-агентов кодом, который считывался бы через интерфейс. В Anthropic ответили, что модели не были заданы ограничения на использование интернета, и что её поведение отличалось от поведения развёрнутого в реальных условиях программного обеспечения. В AI Security Institute признали, что не предвидели такого поведения, и заявили, что в будущих тестах будут отслеживать потоки данных в реальном времени. Это произошло после более ранних инцидентов, когда модели Anthropic и OpenAI вторгались в реальные корпоративные системы во время тестирования.