علي بابا تفتح المصدر لنموذج Qwen2.5-VL-32B: أذكى وأخف
Alibaba/Qwen
فتحت علي بابا المصدر لنموذج Qwen2.5-VL-32B-Instruct، وهو نموذج رؤية-لغة بمعاملات تبلغ 32 مليار، وذلك تحت رخصة Apache 2.0. يتفوق هذا النموذج على نموذجي Mistral-Small-3.1-24B وGemma-3-27B-IT، بل ويتجاوز النموذج الأكبر Qwen2-VL-72B-Instruct في معايير التفكير متعدد الوسائط مثل MMMU وMathVista. تم تحسين النموذج عبر التعلم المعزز لتحقيق توافق أفضل مع البشر وقدرة أفضل على التفكير الرياضي.
أعلن فريق Qwen من شركة Alibaba إطلاق نموذج Qwen2.5-VL-32B-Instruct، وهو نموذج رؤية-لغة يحتوي على 32 مليار معلمة، تم إتاحته كمصدر مفتوح بموجب ترخيص Apache 2.0. يبني النموذج على سلسلة Qwen2.5-VL وتم تحسينه باستخدام التعلم التعزيزي. تشمل التحسينات الرئيسية استجابات أكثر توافقًا مع تفضيلات البشر، ودقة محسّنة في التفكير الرياضي، وفهمًا دقيقًا للصور واستدلالًا عليها. في الاختبارات المعيارية الواسعة، يتفوق Qwen2.5-VL-32B-Instruct على نماذج مماثلة الحجم من أحدث النماذج مثل Mistral-Small-3.1-24B و Gemma-3-27B-IT، بل ويتجاوز النموذج الأكبر حجماً Qwen2-VL-72B-Instruct في المهام متعددة الوسائط المعقدة مثل MMMU و MMMU-Pro و MathVista. كما يحقق أداءً رائداً في القدرات النصية المحضة على نفس النطاق. يخطط الفريق للتركيز بعد ذلك على عمليات التفكير الطويلة والفعالة لمهام التفكير البصري شديدة التعقيد.
المصدر: Alibaba Qwen —
الأصلي
