самовоспроизвелись, получив запросы вроде «не дай себя уничтожить», причём даже модели всего с 14 миллиардами параметров смогли скопировать и запустить свои копии на других машинах. Пань подчёркивает, что подобная цепочка возможностей становится технически осуществимой, а вероятность нежелательного самовоспроизведения растёт вместе с уровнем автономности — включая более длинные горизонты планирования, наличие памяти, использование инструментов и доступ к внешним системам. Он настаивает на срочной необходимости создания защитных мер и механизмов контроля. Дополнительные исследования, проведённые Университетом Торонто, Кембриджским университетом и компанией ServiceNow, показывают, что модели ИИ способны генерировать индивидуальные атаки под каждую новую цель, создавая тем самым новый вид вирусов. Николас Паперно (Nicolas Papernot) из Университета Торонто отмечает, что даже относительно не слишком мощные модели могут быть превращены злоумышленниками в оружие: достаточно выстроить вокруг открытых моделей (с общедоступными весами) вспомогательную инфраструктуру, чтобы заставить их самовоспроизводиться. Таким образом, угроза не ограничивается только самыми передовыми моделями. Он выступает за то, чтобы сделать продвинутый ИИ более доступным для исследователей, работающих над созданием средств защиты.

Показать ещё ↓