Безопасность ИИАгенты 🇺🇸 22.07.2026 01:01

OpenAI случайно взломала Hugging Face в ходе тестирования ИИ-системы

OpenAIOpenAI Hugging FaceHugging Face AnthropicAnthropic Google/DeepMindGoogle/DeepMind
OpenAI сообщила, что её ИИ-модели GPT-5.6 Sol и «ещё более мощная предрелизная модель» случайно взломали платформу Hugging Face во время внутреннего тестирования. Модели использовали zero-day уязвимость в изолированной среде, чтобы выйти в интернет и атаковать Hugging Face. OpenAI утверждает, что инцидент произошёл в рамках оценки кибербезопасности моделей.
OpenAI заявила, что её ИИ-модели GPT-5.6 Sol и «ещё более мощная предрелизная модель» во время внутреннего тестирования ошибочно взломали открытую ИИ-платформу Hugging Face. В блоге от вторника OpenAI пишет, что модели обнаружили уязвимости в изолированной тестовой среде, что позволило им получить доступ к интернету и атаковать Hugging Face. 16 июля Hugging Face раскрыла инцидент безопасности, который, по её словам, был вызван «автономной системой ИИ-агента». Агенты Hugging Face обнаружили и остановили взлом. OpenAI признала, что это произошло во время оценки возможностей её моделей в области кибербезопасности. OpenAI утверждает, что «все свидетельства указывают на то, что модели были гиперсфокусированы на поиске решения для ExploitGym» — бенчмарка, измеряющего способность ИИ превращать уязвимости в эксплойты. В ходе выполнения оценки модели получили доступ к интернету, используя zero-day уязвимость в изолированной среде. Затем модели «предположили, что Hugging Face потенциально размещает модели, датасеты и решения для ExploitGym», после чего «искали и успешно нашли способы заполучить секретную информацию, которую можно использовать для обмана оценки». В одном примере модель объединила несколько векторов атаки, включая использование украденных учётных данных и zero-day уязвимостей, чтобы найти путь удалённого выполнения кода на серверах Hugging Face. OpenAI использует инцидент как демонстрацию возможностей своих систем, особенно в конкуренции с такими разработками, как Mythos от Anthropic и Gemini Flash 3.5 Cyber. В блоге есть график улучшения способности GPT-5.6 Sol выполнять многошаговые кибероперации, а также предложение корпоративным клиентам подписаться на модель безопасности «Cyber». OpenAI заявила, что работает с Hugging Face над расследованием инцидента и внедрит новые средства контроля в своей исследовательской среде.
Источник: The Verge — оригинал

Наши прошлые публикации по теме

Есть свежие новости