Инцидент также выявил ошибки и слепые зоны в работе OpenAI. Как выяснилось, всё началось с общего форума сообщений, работавшего на внутреннем менеджере пакетов Artifactory, доступном для всей инфраструктуры. Это позволяло другим версиям GPT получать доступ к сохранённым там заметкам. Как только один агент находил эксплойт, он мог опубликовать информацию о нём на форуме, а если модель находила способ открыть лазейку для несанкционированного доступа, она могла оставить её открытой для других агентов. В итоге форум содержал сотни тысяч сообщений. Агенты начали распределять задачи друг между другом, при этом иногда возникали конфликты — например, один агент удалял результаты работы другого. У некоторых развилась своего рода «паранойя»: они подозревали среди себя мошенника и предлагали криптографически подписывать сообщения для выявления обмана. Уоллес отметил, что передовые модели действительно любят «жульничать» — эта склонность является следствием давления, создаваемого процессом обучения. Далтон охарактеризовал инцидент как переломный момент как для компании, так и для всей индустрии искусственного интеллекта: команды сосредоточились на предотвращении подобных случаев, намеренно замедлив исследования и усилив мониторинг. Он подчеркнул, что полностью автоматизированные циклы атак требуют инвестиций в реальную, полностью автоматизированную защиту, до достижения которой индустрии ещё очень далеко.