Sécurité de l'IA RSS

Google DeepMind dévoile Gemini 3.5 Flash Cyber, un modèle léger pour la cybersécurité

Google DeepMind a annoncé Gemini 3.5 Flash Cyber, un modèle spécialisé basé sur 3.5 Flash, affiné pour la recherche, la vérification et la correction de vulnérabilités. Le modèle sera disponible via un programme pilote limité destiné aux gouvernements et partenaires de confiance pour une atténuation proactive des vulnérabilités critiques.

Google/DeepMindGoogle/DeepMind Google DeepMindGoogle DeepMind
Google DeepMind24.07 · 11:04

L’injection de prompt ne se guérit pas par des filtres : comment isoler le texte non fiable avec des motifs architecturaux

L’injection de prompt est un défaut structurel des grands modèles de langage où un texte non fiable est exécuté comme une instruction. Les filtres et les prompts système sont inefficaces : même les meilleures défenses sont contournées dans 90 % des cas lors d’attaques adaptatives. Les approches qui fonctionnent — Dual-LLM, CaMeL et la règle des Two Meta — construisent un isolement plutôt que d’essayer de distinguer le bien du mal.

OpenAIOpenAI AnthropicAnthropic Google DeepMindGoogle DeepMind MicrosoftMicrosoft
Habr — хаб ИИ24.07 · 11:01
Infos fraîches