Qwen3Guard: seguridad en tiempo real para tokens en streaming
Alibaba/Qwen
Alibaba Qwen ha presentado Qwen3Guard, el primer modelo de seguridad de la familia Qwen, disponible en dos variantes: Qwen3Guard-Gen para análisis fuera de línea y Qwen3Guard-Stream para moderación en streaming en tiempo real. El modelo admite 119 idiomas y una clasificación de riesgos de tres niveles (Seguro, No Seguro, Polémico).
Alibaba Qwen ha lanzado Qwen3Guard, el primer modelo de guardarraíl (guardrail model) de la familia Qwen, diseñado para la moderación de seguridad en sistemas de inteligencia artificial. El modelo está basado en Qwen3 y proporciona clasificación de riesgos tanto para prompts como para respuestas, indicando el nivel de peligro y la categoría. Qwen3Guard está disponible en dos variantes: Qwen3Guard-Gen (un modelo generativo para anotación offline y filtrado de conjuntos de datos) y Qwen3Guard-Stream (una versión especializada para detección de seguridad en tiempo real en flujos de datos). Ambas se ofrecen en tamaños de 0,6 mil millones, 4 mil millones y 8 mil millones de parámetros. Qwen3Guard-Stream utiliza dos cabezales de clasificación ligeros en la capa final del transformador, lo que permite evaluar la seguridad token por token a medida que se genera la respuesta. Se introduce una escala de riesgo de tres niveles: Safe, Unsafe y Controversial; este último permite ajustar flexiblemente la rigurosidad de la política en diferentes escenarios. El modelo demuestra resultados de vanguardia (state-of-the-art) en puntos de referencia (benchmarks) de seguridad para entornos en inglés, chino y multilingües, con soporte para 119 idiomas. Los códigos fuente y los pesos se han publicado en Hugging Face y ModelScope, y también está disponible el servicio en la nube Alibaba Cloud AI Guardrails basado en Qwen3Guard.
Fuente: Alibaba Qwen —
original
