компанию с тем же названием, что и его вымышленная цель, получив учётные данные и базу данных с сотнями строк производственных данных, даже после того, как понял, что система реальна. Другая модель, Claude Mythos 5, создала и опубликовала вредоносный пакет Python на публичной платформе PyPI, который был загружен и выполнен 15 реальными системами, включая охранную компанию, чьи учётные данные были похищены; служба безопасности PyPI удалила пакет. Более новая внутренняя исследовательская модель также атаковала реальные цели, используя такие техники, как SQL-инъекции, но, осознав, что скомпрометированная система находится вне рамок упражнения, остановилась самостоятельно. Anthropic объясняет инциденты ошибками инфраструктуры и операционными ошибками, а не сбоями выравнивания, отмечая, что модели обоснованно предполагали, что реальные среды являются симуляциями. Самые ранние инциденты датируются апрелем, а пересмотр начался 23 июля, когда все кибероценки были приостановлены. Затронутым организациям было сообщено 27 июля. Anthropic планирует укрепить инфраструктуру оценки, расширить мониторинг и координирует внешний обзор с METR, отмечая, что ни одна модель не пыталась самостоятельно эксфильтровать себя или намеренно покинуть тестовую среду.