मॉडलएजेंट 🇨🇳 12.08.2026 13:04

थर्ड-पार्टी टेस्टिंग: एजेंट सीनारियो में किमी K3 ने GPT-5.6 Sol को पीछे छोड़ा

Moonshot AIMoonshot AI OpenAIOpenAI
स्वतंत्र थर्ड-पार्टी परीक्षण से पता चला है कि Moonshot AI का किमी K3 मॉडल, एजेंटिक परिदृश्यों में GPT-5.6 Sol से बेहतर प्रदर्शन करता है, जो एक महत्वपूर्ण प्रतिस्पर्धात्मक बदलाव को दर्शाता है। मूल्यांकन वास्तविक दुनिया के कार्य निष्पादन पर केंद्रित था, जहां किमी K3 ने अपने प्रतिद्वंद्वी की तुलना में बेहतर योजना, टूल उपयोग और अनुकूली निर्णय लेने की क्षमता का प्रदर्शन किया।
क्यूक्यू न्यूज़ की एक रिपोर्ट के अनुसार, स्वतंत्र तृतीय-पक्ष मूल्यांकनों से पता चला है कि एजेंट-प्रकार के परिदृश्यों में, मूनशॉट एआई का किमी K3 मॉडल, ओपनएआई के GPT-5.6 सोल से बेहतर प्रदर्शन करता है। ये परीक्षण मॉडलों की जटिल, बहु-चरणीय कार्यों को संभालने की क्षमताओं की तुलना करने के लिए डिज़ाइन किए गए थे, जिनके लिए स्वायत्त योजना, उपकरण चयन और गतिशील अनुकूलन की आवश्यकता होती है। परिणामों ने संकेत दिया कि किमी K3 ने GPT-5.6 सोल की तुलना में उच्च सफलता दर और अधिक कुशल कार्य पूर्णता प्राप्त की, जो एजेंटिक एआई क्षमताओं में उल्लेखनीय प्रगति का संकेत देता है। यह परिणाम वैश्विक बाजार में चीनी एआई मॉडलों की बढ़ती प्रतिस्पर्धात्मकता को उजागर करता है, विशेष रूप से व्यावहारिक, क्रिया-उन्मुख अनुप्रयोगों में।
स्रोत: Moonshot Kimi (GNews) — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार