Qwen3Guard: Echtzeit-Streaming-Sicherheit für Token
Alibaba/Qwen
Alibaba Qwen hat Qwen3Guard vorgestellt, das erste Sicherheitsmodell der Qwen-Familie, das in zwei Varianten erhältlich ist: Qwen3Guard-Gen für die Offline-Analyse und Qwen3Guard-Stream für die Echtzeit-Streaming-Moderation. Das Modell unterstützt 119 Sprachen und eine dreistufige Risikoklassifizierung (Sicher, Unsicher, Kontrovers).
Alibaba Qwen hat Qwen3Guard veröffentlicht, das erste Guardrail-Modell der Qwen-Familie, das für die Sicherheitsmoderation in KI-Systemen entwickelt wurde. Das Modell basiert auf Qwen3 und bietet eine Risikoklassifizierung sowohl für Prompts als auch für Antworten mit Angabe der Gefahrenstufe und Kategorie. Qwen3Guard ist in zwei Varianten erhältlich: Qwen3Guard-Gen (generatives Modell für die Offline-Annotation und Filterung von Datensätzen) und Qwen3Guard-Stream (spezialisierte Version für die Echtzeit-Sicherheitserkennung in Datenströmen). Beide sind in den Größen 0,6B, 4B und 8B Parametern verfügbar. Qwen3Guard-Stream verwendet zwei leichte Klassifikationsköpfe auf der letzten Transformer-Schicht, sodass die Sicherheit Token für Token während der Antwortgenerierung bewertet werden kann. Es wurde eine dreistufige Risikoskala eingeführt: Safe, Unsafe und Controversial – letztere ermöglicht eine flexible Anpassung der Richtlinienstrenge in verschiedenen Szenarien. Das Modell erzielt State-of-the-Art-Ergebnisse in Sicherheits-Benchmarks für Englisch, Chinesisch und mehrsprachige Umgebungen und unterstützt 119 Sprachen. Die Quellcodes und Gewichte wurden auf Hugging Face und ModelScope veröffentlicht. Zudem ist der Cloud-Dienst Alibaba Cloud AI Guardrails auf Basis von Qwen3Guard verfügbar.
Quelle: Alibaba Qwen —
Original
