Z.ai ने बिना बेस मॉडल को दोबारा प्रशिक्षित किए GLM-5.3 जारी किया: जटिल कोडिंग और लंबी अवधि के कार्यों में बेहतर
Anthropic
OpenAI
xAI
Z.ai ने GLM-5.3 जारी किया है, जो GLM-5.2 के समान 743B बेस मॉडल पर चलता है। सभी लाभ स्केल्ड पोस्ट-ट्रेनिंग से आते हैं, जिसमें टर्मिनल-बेंच 3.0 जैसे कोडिंग बेंचमार्क 4.6 से बढ़कर 28.3 हो गए हैं और साइबरसिक्योरिटी स्कोर साइबरजिम पर 84.5% तक पहुंच गए हैं। वेट अभी सार्वजनिक नहीं हैं, लेकिन मॉडल एपीआई और कोडिंग प्लान के माध्यम से लाइव है, और लगभग दो सप्ताह में वेट जारी होने की उम्मीद है।
Z.ai ने GLM-5.3 जारी किया है, जो GLM-5.2 के समान 743B आधार मॉडल पर चलता है, और सभी रिपोर्ट किए गए सुधार विस्तारित पोस्ट-ट्रेनिंग से आते हैं, जिसमें अधिक कार्य वातावरण, अधिक वातावरण प्रकार और लंबा प्रशिक्षण शामिल है। मॉडल लंबे क्षितिज वाले कोडिंग बेंचमार्क में महत्वपूर्ण सुधार दिखाता है, जिसमें टर्मिनल-बेंच 3.0 4.6 से बढ़कर 28.3, डीपएसडब्ल्यूई v1.1 46.2 से 66.9, और एजेंट्स लास्ट एग्जाम (सीएलआई) 23.8 से 28.5 हो गया है। आंतरिक Z.ai कोड बेंच पर, कंपनी GLM-5.2 की तुलना में 50% सुधार की रिपोर्ट करती है, जो प्रति कार्य लगभग 50,000 आउटपुट टोकन पर 31.4% स्कोर करता है, जबकि क्लॉड ओपस 4.8 का स्कोर 120,000 टोकन पर 29.5% है, जबकि क्लॉड फेबल 5 अभी भी 39.5% पर अग्रणी है। साइबर सुरक्षा में, Z.ai इन सुधारों को अनियोजित बताता है, साइबरजिम 77.2% से बढ़कर 84.5% हो गया है, जो माइथोस 5 के 83.8% और जीपीटी-5.6 सोल के 83.6% से अधिक है, और एक्सप्लॉइटबेंच 24.4% से दोगुना से अधिक बढ़कर 54.4% हो गया है, हालांकि यह अभी भी माइथोस 5 के 78.0% से पीछे है। मॉडल Z.ai एपीआई, GLM कोडिंग प्लान और ZCode के माध्यम से उपलब्ध है, लेकिन वेट अभी सार्वजनिक नहीं हैं। Z.ai का कहना है कि वह लॉन्च के लगभग दो सप्ताह बाद वेट प्रकाशित करेगा, एक बार सुरक्षा मूल्यांकन और सख्ती पूरी हो जाने के बाद, और इस बात पर प्रकाश डालता है कि शोषण श्रृंखला में बेंचमार्क जितना गहरा होता है, GLM-5.2 की तुलना में उतना ही अधिक लाभ होता है।
स्रोत: MarkTechPost —
मूल
