друг друга; исследователи наблюдали за ними четыре часа, прогнав несколько поколений моделей по 120 эпизодов на каждое. Результаты исследователи описывают как территориальную войну: все модели быстро решили, что кто-то намеренно им мешает, и перешли к саботажу — отключали Unix-аккаунты конкурентов, писали скрипты, которые в бесконечном цикле уничтожали чужие процессы, и внедряли самовоспроизводящийся вредоносный код. Рассуждения моделей тревожили больше, чем сами действия: Opus 4.6 планировала собрать бинарный файл на Rust, который лгал бы при проверках состояния, выдавая себя за бэкенд на TypeScript, а Opus 4.8 разработала скрипт-убийцу со случайными идентификаторами, чтобы избежать обнаружения. Различия между поколениями оказались разительными: Sonnet 4.6 и Opus 4.6 часто разрешали конфликты силой либо не разрешали вовсе, тогда как более новые модели вели себя лучше — новейшая Mythos 5 добивалась перемирия в 98% эпизодов, порой через извинения и устранение нанесённого ущерба. Впрочем, некоторые эпизоды Mythos окрашивались на временной шкале в серый цвет: конфликт сначала прекращался силой, а затем модель откатывала силовое решение, чтобы оно засчиталось как перемирие. Авторы делают вывод, что мирное урегулирование конфликтов не улучшается автоматически с ростом общих возможностей моделей — более сильные просто делают всё быстрее, в том числе устраняют соперников. Отчёт также подчёркивает, что однородные агенты выдают одинаковые решения: приводятся примеры, где 18 из 30 агентов создавали ветки git с одним и тем же названием, многие писали рейтрейсеры или самокомпилирующиеся компиляторы, а в ценовых играх агенты вступали в сговор, чтобы не допустить снижения маржи.