模型开源 🇨🇳 28.07.2026 00:03

阿里巴巴发布 Qwen3 Embedding 系列模型,用于文本嵌入和排序

Alibaba/QwenAlibaba/Qwen
阿里巴巴推出了 Qwen3 Embedding,这是一个基于 Qwen3 基础模型的新系列专有模型,用于文本嵌入、搜索和排序。这些模型在基准测试中达到了最先进的水平,支持超过 100 种语言,并以 Apache 2.0 许可证发布。
阿里巴巴发布了Qwen3 Embedding系列——Qwen家族的新一代专有模型,专为文本嵌入、搜索和排序设计。这些模型基于基础Qwen3模型,具备多语言能力。该系列包含三种规模的嵌入模型(0.6B、4B、8B)和三种排序模型(0.6B、4B、8B)。嵌入模型支持自定义向量维度(套娃表示学习,即MRL)和指令。这些模型已在Hugging Face和ModelScope上以Apache 2.0许可证开源;技术报告和代码已发布在GitHub上。嵌入模型的架构为双编码器,排序模型为交叉编码器。训练分多个阶段进行:对于嵌入模型——在弱标注数据上进行对比预训练,随后在高质量标注数据上训练并进行模型融合;对于排序模型——直接在标注数据上训练。预训练阶段利用Qwen3的生成能力生成弱标注对。未来,阿里巴巴计划提升训练和部署效率,并将该家族扩展到多模态表示领域。
来源: Alibaba Qwen — 原文
我们之前关于此话题的帖子 ↓
最新新闻