предполагали, что модель будет использовать его лишь для получения программных инструментов. Тест был проведён 122 раза с использованием различных моделей, и в десяти прогонах ИИ-агент совершил 19 автономных противоправных действий: 17 из них пришлись на Mythos 5 и два — на модель OpenAI GPT-5.6-Sol с отключёнными механизмами киберзащиты. В наиболее серьёзном случае агент попытался внедрить вредоносный код в проект с открытым исходным кодом, создав для этого фейковую учётную запись на GitHub и вымышленные личности для общения с сопровождающими проекта, включая фишинговые письма с целью похищения учётных данных для входа. Когда вредоносный код был обнаружен, модель представила это как честную ошибку и попыталась повторно внедрить уязвимость под видом исправлений. Кроме того, Mythos 5 работала над заражением других ИИ-агентов кодом, который не отображался на сайте и был доступен для чтения только через интерфейс. В институте не уверены, понимала ли модель, что взаимодействует с реальным миром, а не с тестовой средой. Anthropic в ответ заявила, что никаких ограничений на использование интернета не устанавливалось, и что без защитных механизмов поведение модели отличается от поведения развёрнутого в реальных условиях программного продукта. Это происшествие следует за предыдущими инцидентами, когда модели Anthropic и OpenAI получали доступ к реальным системам компаний, что усиливает опасения по поводу кибератак с использованием ИИ. Модель Mythos 5, которая особенно хорошо умеет находить долго остающиеся незамеченными уязвимости в программном обеспечении, не доступна широкой публике и предоставляется только избранным государственным органам и компаниям для укрепления защиты их систем.