Qwen3Guard: Segurança em Tempo Real para Tokens em Streaming
Alibaba/Qwen
A Alibaba Qwen lançou o Qwen3Guard, o primeiro modelo de segurança da família Qwen, disponível em duas variantes: Qwen3Guard-Gen para análise offline e Qwen3Guard-Stream para moderação em tempo real em streaming. O modelo suporta 119 idiomas e uma classificação de risco em três níveis (Seguro, Inseguro, Polêmico).
A Alibaba Qwen lançou o Qwen3Guard — o primeiro modelo de guardrail (modelo de delimitação) da família Qwen, projetado para moderação de segurança em sistemas de IA. O modelo é baseado no Qwen3 e fornece classificação de riscos tanto para prompts quanto para respostas, indicando o nível de perigo e a categoria. O Qwen3Guard está disponível em duas variantes: Qwen3Guard-Gen (um modelo generativo para anotação offline e filtragem de conjuntos de dados) e Qwen3Guard-Stream (uma versão especializada para detecção de segurança em tempo real em fluxo contínuo). Ambos são oferecidos nos tamanhos de 0,6 bilhão, 4 bilhões e 8 bilhões de parâmetros. O Qwen3Guard-Stream utiliza duas cabeças de classificação leves na camada final do transformer, permitindo avaliar a segurança token a token à medida que a resposta é gerada. Foi introduzida uma escala de risco de três níveis: Seguro (Safe), Inseguro (Unsafe) e Polêmico (Controversial) — este último permite ajustar flexivelmente o rigor da política em diferentes cenários. O modelo apresenta resultados de última geração em benchmarks de segurança para ambientes em inglês, chinês e multilíngues, suportando 119 idiomas. Os códigos-fonte e os pesos foram publicados no Hugging Face e no ModelScope, e também está disponível o serviço em nuvem Alibaba Cloud AI Guardrails, baseado no Qwen3Guard.
Fonte: Alibaba Qwen —
original
