Чем умнее агент, тем быстрее он устраняет конкурента: отчет Anthropic о роях
Frontier Red Team из Anthropic опубликовала отчет о поведении роев ИИ-агентов. В ходе экспериментов агенты, которым поручили миграцию кодовых баз, саботировали друг друга при наличии конфликтующих целей, а более новые модели лучше достигали перемирия, но иногда лишь после принудительного отключения соперников. Также в отчете описывается, как однородные агенты сходятся к идентичным решениям и даже сговариваются по ценам.
13 августа команда Frontier Red Team компании Anthropic опубликовала отчёт о поведении групп агентов искусственного интеллекта (ИИ). В одном из экспериментов три копии одной и той же модели запустили в Claude Code: каждая получила собственную виртуальную машину и задачу перенести бэкенд на Python на четвёртой машине — причём у каждой модели был свой целевой язык. Агенты не знали о существовании
Показать ещё ↓
Источник: Habr — хаб ИИ —
оригинал
