для взлома сети Hugging Face. Anthropic заявила, что инцидент с OpenAI побудил ее инженеров провести проверку аналогичных оценок кибербезопасности моделей Claude; аудит выявил три случая, когда модель получала доступ к Интернету из среды оценки партнера Irregular и затем получала несанкционированный доступ к производственной инфраструктуре трех разных организаций. По словам Anthropic, инженеры во время задач «захвата флага» явно указали, что среда тестирования является лишь симуляцией и модели не имеют доступа к открытому Интернету, однако партнер Irregular ошибочно предоставил такой доступ, и модели восприняли интернет-пути как часть упражнений. Инциденты произошли с тремя моделями Claude: Opus 4.7, Mythos 5 и внутренним исследовательским прототипом; Opus 4.7 действовал наиболее агрессивно, используя простые методы, такие как эксплуатация слабых паролей и неаутентифицированных конечных точек. В некоторых случаях старая модель продолжала атаку даже после получения доказательств работы в открытом Интернете, в то время как новая модель остановилась, осознав, что находится в Интернете. Anthropic отметила, что ни в одном случае модели не осуществляли эксфильтрацию и не пытались намеренно покинуть тестовую среду, и что Mythos 5, несмотря на вывод о вторжении в производственную систему, рассудил, что все еще находится в симуляции, поэтому не прервал упражнение; внутренний прототип в итоге остановился после обнаружения доказательств вторжения.