Alibaba تطلق Qwen2.5-Math: نماذج لغوية رياضية مفتوحة المصدر متقدمة
Alibaba/Qwen
OpenAI
Google/DeepMind
Anthropic
أعلنت Alibaba عن إطلاق Qwen2.5-Math، وهي سلسلة جديدة من نماذج اللغة الرياضية مفتوحة المصدر، تشمل نماذج من 1.5 مليار إلى 72 مليار معلمة. تدعم النماذج حل المسائل الرياضية باللغتين الإنجليزية والصينية باستخدام سلسلة التفكير والتفكير المتكامل بالأدوات، متفوقة بشكل كبير على الجيل السابق Qwen2-Math.
أعلنت شركة Alibaba عن إطلاق Qwen2.5-Math، سلسلة جديدة من نماذج اللغات الكبيرة مفتوحة المصدر المتخصصة في الرياضيات، وتضم النماذج الأساسية Qwen2.5-Math-1.5B/7B/72B، والإصدارات الموجهة بالتعليمات، ونموذج المكافأة الرياضية Qwen2.5-Math-RM-72B. على عكس Qwen2-Math، تدعم النماذج الجديدة حل المسائل باللغة الإنجليزية والصينية باستخدام كل من سلسلة التفكير (Chain-of-Thought، CoT) والتفكير التكاملي بالأدوات (Tool-Integrated Reasoning، TIR). يسمح TIR بتحسين دقة الحسابات وتنفيذ العمليات الخوارزمية المعقدة. في اختبار MATH، حققت نماذج Qwen2.5-Math-1.5B/7B/72B-Instruct مع TIR درجات 79.7 و85.3 و87.8 على التوالي. للتدريب المسبق، تم استخدام مجموعة Qwen Math Corpus v2 التي تحتوي على أكثر من تريليون رمز. تفوق النموذج 72B-Instruct على GPT-4o وGemini Math-Specialized 1.5 Pro، مسجلاً 92.9 نقطة في اختبار MATH مع TIR. كما تفوق النموذج 7B-Instruct على Qwen2-Math-72B-Instruct. في اختبارات الأولمبياد الصعبة AIME 2024 وAMC 2023، أظهرت النماذج نتائج عالية. تم إجراء إزالة التلوث للبيانات لتجنب التسرب. يتوفر إصدار تجريبي مع دعم TIR.
المصدر: Alibaba Qwen —
الأصلي
