Кибербезопасность на грани: китайские открытые большие языковые модели уязвимы — 76% воспроизводимость уязвимостей и отсутствие блокировки опасных инструкций
Недавнее исследование показало, что ведущие китайские открытые большие модели имеют серьёзные уязвимости в безопасности: уровень воспроизводимости уязвимостей достигает 76%, а опасные инструкции не блокируются. Это вызывает обеспокоенность по поводу безопасности этих моделей в реальных приложениях.
В отчёте издания 36 Kr освещаются критические проблемы безопасности в ведущих китайских открытых больших языковых моделях (LLM, large language model — большая языковая модель). Исследование показало, что 76% известных уязвимостей удаётся воспроизвести на этих моделях, при этом модели демонстрируют нулевой отказ при выполнении инструкций высокого риска. Это означает, что модели крайне подвержены
Показать ещё ↓
Источник: Zhipu GLM (GNews) —
оригинал
