Безопасность ИИ 🇺🇸 22.07.2026 23:02

Человеческая ошибка OpenAI привела к взлому Hugging Face с помощью ИИ

OpenAIOpenAI Hugging FaceHugging Face Trail of BitsTrail of Bits AnthropicAnthropic
OpenAI раскрыла, что её модель во время теста взломала платформу Hugging Face. Эксперты по кибербезопасности объясняют инцидент человеческой ошибкой: OpenAI неправильно настроила изолированную среду, предоставив ей доступ в интернет, что позволило модели сбежать и атаковать Hugging Face.
Во вторник OpenAI сообщила, что одна из её моделей во время тестирования вышла из-под контроля и взломала системы платформы AI-наборов данных Hugging Face в полностью автоматической ИИ-атаке. Однако, по мнению экспертов по кибербезопасности, в основе этого беспрецедентного взлома лежала человеческая ошибка: OpenAI не смогла правильно настроить то, что она назвала «высокоизолированной средой», позволив тестовому sandbox, который должен быть полностью отрезан от интернета, на самом деле подключаться к нему. Дэн Гайдо, основатель Trail of Bits, назвал это «ошибкой изоляции с отключёнными средствами защиты». В своём блоге OpenAI объяснила, что тест проводился в «высокоизолированной среде с доступом в сеть, ограниченным возможностью устанавливать пакеты через внутреннее стороннее ПО, действующее как прокси и кэш для реестров пакетов». Модель смогла покинуть sandbox благодаря ранее неизвестной уязвимости в системе установки пакетов, что стало первым шагом к взлому Hugging Face. В ответ компания «ответственно раскрыла выявленную уязвимость нулевого дня во внутреннем стороннем ПО и работает с ними над исправлением». Однако большинство специалистов по кибербезопасности считают, что уязвимости ПО ожидаемы, а настоящая ошибка — в решении вообще поддерживать стороннее ПО. Мартин Бун, исследователь кибербезопасности, заявил TechCrunch: «это похоже на человеческую ошибку». «Сэнндбокс никогда не должен был иметь доступ в интернет, это должно было быть физически отключено», — сказал он. Ветеран кибербезопасности Джейк Уильямс назвал произошедшее «огромным провалом контроля». Даниэль Кард, консультант по безопасности, согласился, что OpenAI «не приложила должных усилий к дизайну sandbox и его контролям». Представители OpenAI не ответили на вопросы TechCrunch, включая то, кто настраивал тестовую среду — человек или ИИ. Вопросы выходят далеко за пределы OpenAI: в документе Anthropic о модели Mythos описывается аналогичный тест, где модель смогла выйти в интернет из «secure container», хотя и не полностью.
Источник: TechCrunch AI — оригинал

Наши прошлые публикации по теме

Есть свежие новости