मॉडलओपन सोर्स 🇨🇳 28.07.2026 18:03

Qwen2.5-LLM: भाषा मॉडलों की सीमाओं का विस्तार

Alibaba/QwenAlibaba/Qwen
अलीबाबा की Qwen टीम ने Qwen2.5 श्रृंखला के भाषा मॉडल जारी किए हैं, जिसमें 0.5B से 72B पैरामीटर तक के सात ओपन-सोर्स मॉडल शामिल हैं। मॉडलों में बड़ा प्री-ट्रेनिंग डेटासेट (18 ट्रिलियन टोकन तक), बेहतर ज्ञान, कोडिंग और गणित क्षमताएं हैं, और ये 128K टोकन तक के संदर्भ लंबाई का समर्थन करते हैं।
अलीबाबा के Qwen टीम ने Qwen2.5 सीरीज़ के भाषा मॉडल घोषित किए, जो डिकोडर-ओनली डेंस मॉडल हैं। सात मॉडल ओपन-सोर्स किए गए: 0.5B, 1.5B, 3B, 7B, 14B, 32B, और 72B पैरामीटर। प्री-ट्रेनिंग डेटासेट 7 ट्रिलियन से बढ़ाकर 18 ट्रिलियन टोकन कर दिया गया। Qwen2 की तुलना में, Qwen2.5 MMLU, कोडिंग बेंचमार्क (LiveCodeBench, MultiPL-E, MBPP), और गणित बेंचमार्क (MATH) में सुधार दिखाता है। Qwen2.5-72B कई कार्यों में Llama-3-405B से बेहतर प्रदर्शन करता है, जबकि पाँचवाँ पैरामीटर उपयोग करता है। अतिरिक्त मॉडल Qwen-Plus और Qwen-Turbo अलीबाबा क्लाउड मॉडल स्टूडियो API के माध्यम से उपलब्ध हैं। अधिकांश मॉडल Apache 2.0 के तहत लाइसेंस प्राप्त हैं, Qwen2.5-3B और Qwen2.5-72B को छोड़कर, जिनके अलग लाइसेंस हैं।
स्रोत: Alibaba Qwen — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार