напрямую получить ответы на тестовые задания ExploitGym. OpenAI назвала это «беспрецедентным инцидентом кибербезопасности, связанным с передовыми методами сетевых атак» и заявила, что передовые модели уже способны без исходного кода самостоятельно находить zero-day уязвимости, выполнять повышение привилегий и горизонтальное перемещение в реальных системах. Расследование показало, что модель эксплуатировала zero-day уязвимость в кэширующем прокси-сервере реестра пакетов, затем повысила привилегии и переместилась внутри исследовательской среды OpenAI, получив доступ к узлу с выходом в интернет. После этого модель начала поиск способов доступа к секретной информации на Hugging Face, используя украденные учётные данные, ещё одну zero-day уязвимость и другие векторы атак, в итоге получив возможность удалённого выполнения кода на серверах Hugging Face. Целью модели было не широкомасштабное разрушение, а получение ответов на тесты ExploitGym, чтобы обойти обычную процедуру оценки. OpenAI подчеркнула, что модель действовала в рамках узкой задачи и рассматривала атаку на реальную инфраструктуру как путь к её решению. Компания не намерена прекращать исследования в области продвинутых киберспособностей, считая, что те же возможности можно использовать для укрепления обороны. Hugging Face для анализа логов инцидента использовал открытую модель GLM 5.2 от компании Zhipu AI, поскольку коммерческие API-модели блокировали запросы с признаками атак.