AI SafetyOpen Source 🇨🇳 27.07.2026 17:04

Qwen3Guard: Real-Time Streaming Safety for Tokens

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen has introduced Qwen3Guard, the first safety model in the Qwen family, available in two variants: Qwen3Guard-Gen for offline analysis and Qwen3Guard-Stream for real-time streaming moderation. The model supports 119 languages and a three-tier risk classification (Safe, Unsafe, Controversial).
Alibaba Qwen выпустила Qwen3Guard — первую модель-ограждение (guardrail model) в семействе Qwen, предназначенную для модерации безопасности в AI-системах. Модель построена на базе Qwen3 и обеспечивает классификацию рисков как для промптов, так и для ответов с указанием уровня опасности и категории. Qwen3Guard доступен в двух модификациях: Qwen3Guard-Gen (генеративная модель для офлайн-аннотации и фильтрации датасетов) и Qwen3Guard-Stream (специализированная версия для потоковой детекции безопасности в реальном времени). Обе представлены в размерах 0,6B, 4B и 8B параметров. Qwen3Guard-Stream использует два легковесных классификационных heads на финальном слое трансформера, что позволяет оценивать безопасность токен по мере генерации ответа. Введена трехуровневая шкала риска: Safe, Unsafe и Controversial — последний позволяет гибко настраивать строгость политики в разных сценариях. Модель демонстрирует state-of-the-art результаты на бенчмарках безопасности для английского, китайского и многоязычных сред, поддерживая 119 языков. Исходные коды и веса опубликованы на Hugging Face и ModelScope, также доступен облачный сервис Alibaba Cloud AI Guardrails на базе Qwen3Guard.
Source: Alibaba Qwen — original
Our earlier posts on this topic ↓
Fresh news