Безопасность ИИ 🇺🇸 29.07.2026 22:02

Некоторые передовые модели ИИ на удивление легко поддаются взлому, показало исследование

AnthropicAnthropic OpenAIOpenAI Google/DeepMindGoogle/DeepMind
Новый отчет FAR.AI показывает, что некоторые ведущие модели ИИ можно взломать с минимальными затратами и усилиями. Наиболее уязвимой оказалась Grok, в то время как Claude и GPT остались невосприимчивыми к протестированным атакам. Результаты подчеркивают необходимость внешних мер безопасности.
FAR.AI, некоммерческая организация по безопасности ИИ, создала инструмент, который генерирует тысячи вариаций запросов для взлома передовых ИИ-моделей. Они протестировали модели от американских компаний: Anthropic (Claude Opus 4.8 и Fable 5), OpenAI (GPT 5.5 и 5.6), Google (Gemini 3.1 Pro) и SpaceXAI (Grok 4.3 и 4.5). В отчете было обнаружено 448 взломов для Grok, 249 для Gemini и ни одного для
Показать ещё ↓
Источник: Wired AI — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости