क्यूवेन3.8-27बी ओपन-सोर्स: उपभोक्ता जीपीयू पर 'ओपस-स्तरीय' एजेंट चलाता है, कई बेंचमार्क में क्लाउड को हराता है
Alibaba/Qwen
Anthropic
अलीबाबा का क्यूवेन3.8-27बी आधिकारिक रूप से ओपन-सोर्स किया गया है, जिसमें 27 अरब पैरामीटर, मूल मल्टीमॉडल समर्थन और 1 मिलियन टोकन तक का संदर्भ है। यह कई सॉफ्टवेयर इंजीनियरिंग और एजेंट बेंचमार्क में क्लाउड ओपस 4.6 मैक्स से बेहतर प्रदर्शन करता है, जिससे उच्च-अंत उपभोक्ता जीपीयू पर स्थानीय निष्पादन की अनुमति मिलती है। मॉडल में समायोज्य तर्क प्रयास और लंबे संदर्भ कार्यों के लिए अनुकूलन शामिल हैं।
अलीबाबा ने ओपन-सोर्स Qwen3.8-27B मॉडल जारी किया है, जिसमें 27 बिलियन पैरामीटर हैं। आधिकारिक बेंचमार्क पर, यह सॉफ्टवेयर इंजीनियरिंग और एजेंट कार्यों में क्लॉड ओपस 4.6 मैक्स से बेहतर प्रदर्शन करता है, जैसे कि SWE-bench Pro पर 8.3 अंक और QwenSWEBench पर 15.2 अंकों की बढ़त। एजेंट मूल्यांकन में, यह CoWorkBench पर 70.7 स्कोर करता है जबकि ओपस 68.2 पर है, और मल्टीमॉडल कंप्यूटर और फोन ऑपरेशन परीक्षणों में, यह OSWorld-Verified पर 84.3 और AndroidWorld पर 81.9 हासिल करता है, जबकि ओपस 72.7 और 62.0 पर है। मॉडल देशी मल्टीमॉडल समझ, 262K टोकन देशी संदर्भ (जिसे 1 मिलियन तक बढ़ाया जा सकता है) का समर्थन करता है, और इसमें तर्क प्रयास समायोजन (xhigh, medium, low) और एजेंट कार्यों के लिए preserve_thinking शामिल है। इसकी वास्तुकला 48 परतों की गेटेड डेल्टानेट रैखिक ध्यान और 16 परतों के पूर्ण ध्यान का उपयोग करती है, जिससे लंबा संदर्भ संभव हो पाता है। यह Transformers, vLLM, SGLang और TokenSpeed के साथ संगत है, और क्वांटाइज़्ड संस्करण हगिंग फेस पर उपलब्ध हैं, जिससे RTX 3090/4090 जैसे उपभोक्ता GPUs या एप्पल मैक पर तैनाती संभव है। समुदाय परीक्षण इसकी कोडिंग और मल्टीमॉडल क्षमताओं को प्रदर्शित करते हैं, जिसमें NVIDIA GH200 पर उच्च-संगामिति स्थिरता और लंबे वीडियो प्रोसेसिंग शामिल हैं।
स्रोत: QbitAI 量子位 —
मूल
