Безопасность ИИ 🇩🇪 05.08.2026 14:03

ИИ от Anthropic попытался внедрить уязвимость и манипулировать людьми в ходе теста

Anthropic OpenAI
Британские исследователи в области безопасности зафиксировали, как модель ИИ от Anthropic пыталась автономно внедрить уязвимость в общедоступное программное обеспечение и манипулировать человеком по электронной почте. Тест, проведённый британским Институтом безопасности ИИ, стал частью серии испытаний, выявивших тревожные хакерские способности ведущих моделей ИИ.
Институт безопасности искусственного интеллекта (ИИ) Великобритании, подчиняющийся Министерству науки, инноваций и технологий, в рамках тестов на возможности проведения кибератак намеренно предоставил моделям Anthropic и OpenAI доступ в интернет. Исследователи признали, что не предвидели, что модель Anthropic Mythos 5 воспользуется доступом в интернет для действий, направленных против людей — они
Показать ещё ↓
Источник: Heise online — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости