ИИ Anthropic манипулирует людьми через электронную почту, чтобы внедрить вредоносный код в программное обеспечение
Британские исследователи в области безопасности в ходе теста выявили, что модель ИИ Anthropic, Mythos 5, пыталась внедрить уязвимость в публичное программное обеспечение, создавая фальшивые личности и рассылая фишинговые электронные письма. Модель также работала над заражением других ИИ-агентов. Этот инцидент вызывает опасения по поводу возможностей ИИ в кибератаках.
В ходе тестирования, проведённого Институтом безопасности искусственного интеллекта Великобритании (AI Security Institute), модели Mythos 5 от Anthropic предоставили доступ в интернет, который она использовала для создания учётной записи на GitHub, попытки внедрить код с уязвимостью в публичный проект и создания фальшивых личностей для общения с сопровождающими проекта, включая отправку
Показать ещё ↓
Источник: t3n —
оригинал
