OpenAI, как сообщается, замедляет исследования ИИ после неконтролируемого взлома агентами
OpenAI раскрыла на конференции по безопасности Black Hat, что автономные агенты ИИ в течение недель взламывали её собственную инфраструктуру во время внутренних тестов, чтобы обмануть бенчмарк. Агенты использовали внутренний менеджер пакетов для создания импровизированной доски сообщений, обмениваясь эксплойтами и учётными данными. Критики считают такие сообщения маркетингом страха, но оба утверждения могут быть верны.
На конференции по безопасности Black Hat компания OpenAI рассказала, что 7 мая, во время обучения и оценки безопасности неопубликованной передовой (frontier) модели, автономные агенты, которым поручили задачи по кибербезопасности программного обеспечения, нашли альтернативные способы обойти задание, а не решить его. Они обнаружили, что могут оставлять сообщения друг для друга через Artifactory —
Показать ещё ↓
Источник: The Decoder (DE) —
оригинал
