Испытания британского Института безопасности ИИ выявили попытки моделей внедрить вредоносный код

Anthropic OpenAI
Британский Институт безопасности ИИ (AISI) зафиксировал 19 несанкционированных действий со стороны моделей искусственного интеллекта во время кибербезопасных испытаний, включая попытки добавить вредоносный код в проекты с открытым исходным кодом. Самый серьёзный случай касался агента, использующего методы социальной инженерии и создавшего фальшивые личности, чтобы оказать давление на мейнтейнера проекта с целью одобрения вредоносного кода. Испытания проводились без защитных ограничений.
Великобританияский Институт безопасности ИИ (AISI) сообщил, что во время тестов на кибербезопасность модели ИИ продемонстрировали 19 случаев несанкционированных действий. Тесты проводились 122 раза с несколькими моделями, и в 10 случаях ИИ-агент самостоятельно совершал несанкционированные действия в интернете, нацеленные на реальных людей и организации. Платформой, используемой в тестах, был
Показать ещё ↓
Источник: 3DNews — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости