Alibaba ने Qwen2.5-Math जारी किया: अत्याधुनिक ओपन-सोर्स गणितीय LLM
Alibaba/Qwen
OpenAI
Google/DeepMind
Anthropic
Alibaba ने Qwen2.5-Math पेश किया, जो ओपन-सोर्स गणितीय भाषा मॉडलों की एक नई श्रृंखला है, जिसमें 1.5B से 72B पैरामीटर तक के मॉडल शामिल हैं। ये मॉडल चेन-ऑफ-थॉट और एकीकृत टूल-एन्हांस्ड रीजनिंग के माध्यम से अंग्रेजी और चीनी में गणितीय समस्या-समाधान का समर्थन करते हैं, जो पिछली पीढ़ी Qwen2-Math से काफी बेहतर प्रदर्शन करते हैं।
Alibaba ने Qwen2.5-Math जारी किया है, जो ओपन मैथेमेटिकल LLM की एक नई श्रृंखला है, जिसमें 베이स मॉडल Qwen2.5-Math-1.5B/7B/72B, इंस्ट्रक्टिव वर्ज़न और एक मैथेमेटिकल रिवॉर्ड मॉडल Qwen2.5-Math-RM-72B शामिल हैं। Qwen2-Math के विपरीत, नए मॉडल चेन ऑफ थॉट (CoT) और इंटीग्रेटेड टूल-इंटीग्रेटेड रीजनिंग (TIR) दोनों के माध्यम से अंग्रेजी और चीनी में समस्या समाधान का समर्थन करते हैं। TIR गणना सटीकता को बढ़ाने और जटिल एल्गोरिदमिक संचालन करने की अनुमति देता है। MATH बेंचमार्क पर, TIR के साथ Qwen2.5-Math-1.5B/7B/72B-Instruct मॉडल ने क्रमशः 79.7, 85.3 और 87.8 अंक प्राप्त किए। प्रीट्रेनिंग के लिए 1 ट्रिलियन से अधिक टोकन के Qwen Math Corpus v2 का उपयोग किया गया। 72B-Instruct मॉडल ने TIR के साथ MATH पर 92.9 अंक प्राप्त करके GPT-4o और Gemini Math-Specialized 1.5 Pro को पीछे छोड़ दिया। 7B-Instruct मॉडल ने Qwen2-Math-72B-Instruct को पीछे छोड़ दिया। जटिल ओलंपियाड परीक्षणों AIME 2024 और AMC 2023 में भी मॉडलों ने उच्च परिणाम दिखाए। डेटा लीक से बचने के लिए डीकंटैमिनेशन किया गया। TIR समर्थन के साथ डेमो उपलब्ध है।
स्रोत: Alibaba Qwen —
मूल
