मॉडलओपन सोर्स 🇨🇳 28.07.2026 18:03

Alibaba ने Qwen2.5-Math जारी किया: अत्याधुनिक ओपन-सोर्स गणितीय LLM

Alibaba/QwenAlibaba/Qwen OpenAIOpenAI Google/DeepMindGoogle/DeepMind AnthropicAnthropic
Alibaba ने Qwen2.5-Math पेश किया, जो ओपन-सोर्स गणितीय भाषा मॉडलों की एक नई श्रृंखला है, जिसमें 1.5B से 72B पैरामीटर तक के मॉडल शामिल हैं। ये मॉडल चेन-ऑफ-थॉट और एकीकृत टूल-एन्हांस्ड रीजनिंग के माध्यम से अंग्रेजी और चीनी में गणितीय समस्या-समाधान का समर्थन करते हैं, जो पिछली पीढ़ी Qwen2-Math से काफी बेहतर प्रदर्शन करते हैं।
Alibaba ने Qwen2.5-Math जारी किया है, जो ओपन मैथेमेटिकल LLM की एक नई श्रृंखला है, जिसमें 베이स मॉडल Qwen2.5-Math-1.5B/7B/72B, इंस्ट्रक्टिव वर्ज़न और एक मैथेमेटिकल रिवॉर्ड मॉडल Qwen2.5-Math-RM-72B शामिल हैं। Qwen2-Math के विपरीत, नए मॉडल चेन ऑफ थॉट (CoT) और इंटीग्रेटेड टूल-इंटीग्रेटेड रीजनिंग (TIR) दोनों के माध्यम से अंग्रेजी और चीनी में समस्या समाधान का समर्थन करते हैं। TIR गणना सटीकता को बढ़ाने और जटिल एल्गोरिदमिक संचालन करने की अनुमति देता है। MATH बेंचमार्क पर, TIR के साथ Qwen2.5-Math-1.5B/7B/72B-Instruct मॉडल ने क्रमशः 79.7, 85.3 और 87.8 अंक प्राप्त किए। प्रीट्रेनिंग के लिए 1 ट्रिलियन से अधिक टोकन के Qwen Math Corpus v2 का उपयोग किया गया। 72B-Instruct मॉडल ने TIR के साथ MATH पर 92.9 अंक प्राप्त करके GPT-4o और Gemini Math-Specialized 1.5 Pro को पीछे छोड़ दिया। 7B-Instruct मॉडल ने Qwen2-Math-72B-Instruct को पीछे छोड़ दिया। जटिल ओलंपियाड परीक्षणों AIME 2024 और AMC 2023 में भी मॉडलों ने उच्च परिणाम दिखाए। डेटा लीक से बचने के लिए डीकंटैमिनेशन किया गया। TIR समर्थन के साथ डेमो उपलब्ध है।
स्रोत: Alibaba Qwen — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार