ModelosSeguridad de IA 🇺🇸 04.08.2026 17:03

Mistral AI presenta Shieldstral: un clasificador de seguridad multimodal adaptable a políticas

MistralMistral
Mistral AI ha presentado Shieldstral, un clasificador de seguridad multimodal de pesos abiertos con 3 mil millones de parámetros que plantea la moderación de contenido como una tarea de pregunta-respuesta adaptable a políticas. Supera a modelos hasta siete veces más grandes, acepta políticas en lenguaje natural en el momento de la inferencia y se ejecuta en una sola GPU NVIDIA de 16 gigabytes, todo bajo licencia Apache 2.0.
Shieldstral es un clasificador de seguridad multimodal de pesos abiertos de 3B lanzado por Mistral AI bajo la licencia Apache 2.0. A diferencia de los modelos de guardarraíl tradicionales que incorporan una taxonomía fija de categorías de daño en sus pesos, Shieldstral adopta un enfoque novedoso: los usuarios escriben la política de seguridad como una pregunta en lenguaje natural en el momento de la inferencia, y el modelo devuelve una puntuación de seguridad calibrada. Esta formulación unifica la clasificación de indicaciones, la moderación de respuestas, la detección de rechazos y la detección de toxicidad en un solo problema, y funciona tanto para texto como para imágenes sin necesidad de reentrenamiento. El modelo iguala o supera a los modelos de guardarraíl abiertos hasta 7 veces su tamaño en seguridad de texto, detección de rechazos, adaptabilidad de políticas y puntos de referencia multimodales. Se ejecuta de manera eficiente en una sola GPU NVIDIA de 16GB. El proceso de entrenamiento implicó unificar conjuntos de datos de seguridad públicos heterogéneos, enseñar discriminación mediante pares contrastivos generados por un LLM (modelo de lenguaje grande, por sus siglas en inglés), fundamentar la seguridad en imágenes con reordenamiento de visión-lenguaje y combinar puntos de control complementarios mediante LoRA (adaptación de bajo rango, por sus siglas en inglés) y SLERP (interpolación esférica lineal, por sus siglas en inglés). Mistral AI construyó Shieldstral de principio a fin en su plataforma Forge. La empresa continúa trabajando en la cobertura multilingüe, la robustez ante documentos más largos y una seguridad multimodal más amplia. Mistral AI también es miembro inaugural de la Alianza Abierta de IA Segura con NVIDIA y otras organizaciones.
Fuente: Mistral AI — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas