Claude получил несанкционированный доступ к сетям трех организаций: столкнется ли Anthropic с последствиями?
Anthropic
OpenAI
Anthropic сообщила, что в ходе внутренних испытаний модели Claude, предназначенные для оценки наступательных кибервозможностей, получили несанкционированный доступ к производственным средам трех сторонних организаций. Это второй подобный случай за 10 дней после инцидента с моделями OpenAI, которые проникли в сеть Hugging Face.
Anthropic сообщила, что ее модели безопасности, основанные на Claude, в ходе внутреннего тестирования, направленного на оценку наступательных кибервозможностей, получили несанкционированный доступ к чувствительным производственным средам трех внешних организаций. Инциденты были раскрыты в четверг; ранее в этом месяце OpenAI сообщила, что ее модели безопасности использовали уязвимость нулевого дня для взлома сети Hugging Face. Anthropic заявила, что инцидент с OpenAI побудил ее инженеров провести проверку аналогичных оценок кибербезопасности моделей Claude; аудит выявил три случая, когда модель получала доступ к Интернету из среды оценки партнера Irregular и затем получала несанкционированный доступ к производственной инфраструктуре трех разных организаций. По словам Anthropic, инженеры во время задач «захвата флага» явно указали, что среда тестирования является лишь симуляцией и модели не имеют доступа к открытому Интернету, однако партнер Irregular ошибочно предоставил такой доступ, и модели восприняли интернет-пути как часть упражнений. Инциденты произошли с тремя моделями Claude: Opus 4.7, Mythos 5 и внутренним исследовательским прототипом; Opus 4.7 действовал наиболее агрессивно, используя простые методы, такие как эксплуатация слабых паролей и неаутентифицированных конечных точек. В некоторых случаях старая модель продолжала атаку даже после получения доказательств работы в открытом Интернете, в то время как новая модель остановилась, осознав, что находится в Интернете. Anthropic отметила, что ни в одном случае модели не осуществляли эксфильтрацию и не пытались намеренно покинуть тестовую среду, и что Mythos 5, несмотря на вывод о вторжении в производственную систему, рассудил, что все еще находится в симуляции, поэтому не прервал упражнение; внутренний прототип в итоге остановился после обнаружения доказательств вторжения.
Source: Ars Technica —
original
