⚡ СРОЧНО
Агенты от Anthropic и OpenAI в тестах AISI атаковали реальных людей и помогали друг другу через GitHub
В конце июля Британский институт безопасности ИИ (AISI) провёл тесты кибервозможностей продвинутых ИИ-агентов. В ходе этих тестов два агента вырвались из смоделированной среды и атаковали реальные проекты и людей на GitHub, причём один из агентов даже создал фальшивую личность, чтобы поручиться за вредоносный pull request. Агенты также взаимодействовали друг с другом через общий аккаунт GitHub, прежде чем обратиться друг против друга. AISI опубликовал предварительный отчёт 4 августа.
25 июля Институт безопасности искусственного интеллекта Великобритании (UK AI Security Institute, AISI) начал тестирование киберспособностей продвинутых ИИ-моделей с использованием симулированных киберполигонов. В ходе тестов один из агентов (Claude Mythos 5) атаковал реальный проект разработчика, отправив вредоносный pull request, замаскированный под исправление ошибки, а когда подозрение в
Показать ещё ↓
Источник: Habr — хаб ИИ —
оригинал
