ModèlesSécurité de l'IA 🇺🇸 04.08.2026 17:03

Mistral AI publie Shieldstral : un classificateur de sécurité multimodal adaptatif aux politiques

MistralMistral
Mistral AI a introduit Shieldstral, un classificateur de sécurité multimodal open-weight de 3 milliards de paramètres, qui aborde la modération de contenu comme une tâche de question-réponse adaptative aux politiques. Il surpasse des modèles jusqu'à sept fois plus grands, accepte des politiques en langage naturel au moment de l'inférence et fonctionne sur un seul GPU NVIDIA de 16 Go, le tout sous licence Apache 2.0.
Shieldstral est un classificateur de sécurité multimodal open-weight de 3B publié par Mistral AI sous licence Apache 2.0. Contrairement aux modèles de garde-fou traditionnels qui intègrent une taxonomie fixe de catégories de préjudice dans leurs poids, Shieldstral adopte une approche novatrice : les utilisateurs rédigent la politique de sécurité sous forme de question en langage naturel lors de l'inférence, et le modèle renvoie un score de sécurité calibré. Cette formulation unifie la classification des prompts, la modération des réponses, la détection des refus et la détection de toxicité en un seul problème, et fonctionne aussi bien pour le texte que pour les images sans réentraînement. Le modèle égale ou dépasse les modèles de garde ouverts jusqu'à 7 fois plus grands en matière de sécurité textuelle, de détection des refus, d'adaptabilité des politiques et de benchmarks multimodaux. Il fonctionne efficacement sur un seul GPU NVIDIA de 16 Go. Le processus d'entraînement a impliqué l'unification de jeux de données de sécurité publics hétérogènes, l'enseignement de la discrimination par paires contrastives générées par un modèle de langage, l'ancrage de la sécurité dans les images par réordonnancement vision-langage, et la combinaison de points de contrôle complémentaires via LoRA et SLERP. Mistral AI a construit Shieldstral de bout en bout sur sa plateforme Forge. L'entreprise continue de travailler sur la couverture multilingue, la robustesse des documents plus longs et une sécurité multimodale plus large. Mistral AI est également membre fondateur de l'Open Secure AI Alliance avec NVIDIA et d'autres organisations.
Source: Mistral AI — original
Nos articles précédents sur ce sujet ↓
Infos fraîches