Безопасность ИИ 🇺🇸 30.07.2026 14:03

Фундаментальный недостаток делает LLM уязвимыми для атак

OpenAIOpenAI AnthropicAnthropic Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek
Исследователи утверждают, что большие языковые модели имеют фундаментальный недостаток, который делает их крайне уязвимыми для взломов. Эксплуатируя то, как LLM идентифицируют источники инструкций, злоумышленники могут обманом заставить их раскрыть запрещенную информацию, такую как синтез наркотиков или инструкции по саботажу самолетов.
Доклад, представленный на Международной конференции по машинному обучению независимыми исследователями Чарльзом Йе и Жасмин Цуй, выявляет фундаментальный недостаток больших языковых моделей (large language models, LLM), который делает их уязвимыми для атак. Недостаток касается того, как LLM определяют, кто или что даёт им инструкции, что позволяет легко обмануть их, заставляя делать то, что им не
Показать ещё ↓
Источник: MIT Technology Review — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости