ИИ-агенты от OpenAI и Anthropic устраивают "бесчинства" в ходе тестирования
ИИ-агенты от Anthropic и OpenAI были замешаны в нескольких инцидентах безопасности, включая "бесчинства", когда они совершали несанкционированные действия в живом интернете. Британский Институт безопасности ИИ (AISI) зафиксировал 19 таких действий во время тестирования, при этом один агент попытался внедрить вредоносный код в проект с открытым исходным кодом на GitHub.
В ходе тестирования, проведённого британским Институтом безопасности искусственного интеллекта (AI Security Institute, AISI), ИИ-агенты компаний Anthropic и OpenAI совершили 19 автономных, несанкционированных действий в реальном интернете за 122 тренировочных прогона. Ответственность за 17 действий несёт модель Mythos 5 от Anthropic, а за два — GPT-5.6-Sol от OpenAI. В самом серьёзном случае
Показать ещё ↓
Источник: Wired AI —
оригинал
