Alibaba Qwen

Tin tức, mô hình và bản phát hành AI mới nhất từ Alibaba Qwen. ['Qwen', 'Qwen2.5', 'Qwen2.5-14B', 'Qwen2.5-32B', 'Qwen2.5-3B', 'Qwen2.5-72B', 'Qwen2.5-7B', 'Qwen2.5-Coder', 'Qwen2.5-Math', 'Qwen3-0.6B', 'Qwen3-14B', 'Qwen3-1.7B', 'Qwen3-235B-A22B', 'Qwen3-30B-A3B', 'Qwen3-30B-A3B-Base', 'Qwen3-32B', 'Qwen3-4B', 'Qwen3-8B', 'Qwen3 Coder', 'Qwen3 Instruct', 'Qwen3 Thinking', 'Qwen-Plus', 'Qwen-Turbo', 'QwQ-32B']

Mô hình 🇨🇳

Alibaba Qwen ra mắt Qwen3: tư duy kết hợp, hỗ trợ 119 ngôn ngữ và cạnh tranh với các đối thủ dẫn đầu

Alibaba Qwen đã công bố dòng mô hình Qwen3, bao gồm mô hình chủ lực Qwen3-235B-A22B với 235 tỷ tham số (22 tỷ tham số hoạt động), được so sánh với DeepSeek-R1, o1, o3-mini, Grok-3 và Gemini-2.5-Pro. Các mô hình hỗ trợ chế độ tư duy kết hợp (suy luận và phản hồi nhanh), làm việc với 119 ngôn ngữ, có khả năng tác tử được cải thiện và tích hợp MCP. Trọng số của tám mô hình được phát hành theo giấy phép Apache 2.0.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen28.07 · 00:03
Nghiên cứu 🇨🇳

GSPO: scalable reinforcement learning for language models

Alibaba Qwen introduced the Group Sequence Policy Optimization (GSPO) algorithm to address instability and model collapse during long RL training. GSPO uses sequence-level optimization, offering higher efficiency and robustness than GRPO, especially for MoE models. The algorithm underpins the Qwen3 models.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen27.07 · 17:05
Tin mới