Безопасность ИИ RSS

Google DeepMind представляет Gemini 3.5 Flash Cyber — лёгкую модель для кибербезопасности

Google DeepMind анонсировала Gemini 3.5 Flash Cyber — специализированную модель на базе 3.5 Flash, доработанную для поиска, проверки и исправления уязвимостей. Модель будет доступна по ограниченной пилотной программе правительствам и доверенным партнёрам для опережающего устранения критических уязвимостей.

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMind24.07 · 11:04

Prompt injection не лечится фильтрами: как изолировать недоверенный текст с помощью архитектурных паттернов

Prompt injection — структурный дефект LLM, при котором недоверенный текст исполняется как инструкция. Фильтры и системные промпты неэффективны: даже лучшие защиты пробиваются в 90% случаев при адаптивных атаках. Рабочие подходы — Dual-LLM, CaMeL и правило двух Meta — строят изоляцию, а не пытаются отличить добро от зла.

OpenAIOpenAI AnthropicAnthropic Google DeepMindGoogle DeepMind MicrosoftMicrosoft
Habr — хаб ИИ24.07 · 11:01
Свежие новости