النماذجمفتوح المصدر 🇨🇳 28.07.2026 00:03

أطلقت علي بابا سلسلة Qwen3 Embedding لتضمين النصوص وترتيبها

Alibaba/QwenAlibaba/Qwen
أعلنت شركة علي بابا عن إطلاق Qwen3 Embedding، وهي مجموعة جديدة من النماذج المملوكة لتضمين النصوص والبحث وترتيبها، المبنية على أساس Qwen3. تحقق النماذج جودة متطورة في المعايير القياسية، وتدعم أكثر من 100 لغة، وتُطرح بموجب ترخيص Apache 2.0.
أعلنت شركة علي بابا عن إطلاق سلسلة Qwen3 Embedding، وهي نماذج جديدة مملوكة لعائلة Qwen، مصممة لتضمين النصوص والبحث والترتيب. تعتمد هذه النماذج على النموذج الأساسي Qwen3، مما يمنحها إمكانيات متعددة اللغات. تضم السلسلة ثلاثة أحجام من نماذج التضمين (0.6B، 4B، 8B) وثلاثة نماذج ترتيب (0.6B، 4B، 8B). تدعم نماذج التضمين أبعادًا مخصصة للمتجهات (تعلم التمثيل متداخل الأبعاد، MRL) والتعليمات. تم إطلاق هذه النماذج كمصدر مفتوح بموجب ترخيص Apache 2.0 على منصتي Hugging Face وModelScope؛ كما تم نشر التقرير التقني والشفرة على GitHub. بنية نماذج التضمين هي مشفر مزدوج، بينما بنية نماذج الترتيب هي مشفر متقاطع. تم التدريب على عدة مراحل: لنماذج التضمين - تدريب تمهيدي تبايني على بيانات ضعيفة التصنيف، يليه تدريب على بيانات عالية الجودة ومصنفة، ثم دمج النماذج؛ لنماذج الترتيب - تدريب مباشر على البيانات المصنفة. تم استخدام القدرة التوليدية لـ Qwen3 لتوليد أزواج ضعيفة التصنيف خلال مرحلة التدريب التمهيدي. في المستقبل، تخطط علي بابا لتحسين كفاءة التدريب والنشر، بالإضافة إلى توسيع العائلة لتشمل تمثيلات متعددة الوسائط.
المصدر: Alibaba Qwen — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة