阿里巴巴Qwen团队发布Qwen3.8模型,开源权重采用Apache-2.0协议
Alibaba/Qwen
阿里巴巴的AI团队Qwen发布了Qwen3.8的开源模型权重。核心模型Qwen3.8-27B是一个拥有270亿参数的多模态密集模型,在许多领域优于较大的Qwen3.7-Plus,尤其是在编程和办公任务方面。该模型原生支持最多262,000个标记的上下文长度,并可通过YaRN方法扩展到一百万个标记。
阿里巴巴的AI团队Qwen已根据免费的Apache-2.0许可证发布了Qwen3.8系列模型的开放权重。旗舰模型Qwen3.8-27B是一个拥有270亿参数的多模态密集模型,据报道在许多领域,尤其是编程和办公任务方面,超越了更大的Qwen3.7-Plus。Qwen还强调了改进的智能体能力,模型能够更独立地规划并更可靠地完成任务。它原生支持多达262,000个令牌的上下文,并可通过YaRN方法扩展到一百万个令牌。除了文本,该模型还能理解图像和视频,例如图表、文档或长达数小时的视频。灵活的思考模式默认启用,但可根据请求禁用或调整深度。此外,Qwen还发布了更大的Qwen3.8-2.4T-A95B模型的权重,该模型旨在提供顶级性能。这两个模型均可在Hugging Face和ModelScope上获取。通过阿里云的AI服务Qwen Cloud,将很快提供支持一百万个令牌上下文的托管版本。
来源: The Decoder (DE) —
原文
