Безопасность ИИ 🇺🇸 02.08.2026 14:03

Взломать некоторые передовые модели искусственного интеллекта пугающе легко

xAI
Новое исследование показывает, что многие передовые модели искусственного интеллекта остаются уязвимыми к простым методам джейлбрейка. Исследователи обнаружили, что такие методы, как создание подсказок в виде ASCII-арта или использование сложных кодировок, могут обойти защитные механизмы, что вызывает опасения по поводу безопасности ИИ.
Исследователи продемонстрировали тревожную легкость, с которой можно взломать некоторые передовые модели искусственного интеллекта, используя методы, эксплуатирующие ограничения их обучения. Простые методы, такие как представление запросов в виде ASCII-графики или использование сложных кодировок, могут обойти механизмы безопасности, заставляя модели генерировать вредоносный или запрещенный
Показать ещё ↓
Источник: xAI Grok (GNews) — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости