चीनी ओपन-वेट AI: Kimi K3 ने US फ्रंटियर मॉडल्स को चुनौती दी
Moonshot AI
OpenAI
Anthropic
Meta
Mistral
DeepSeek
चीनी स्टार्टअप Moonshot AI ने Kimi K3 जारी किया है, जो 2.8 ट्रिलियन पैरामीटर वाला ओपन-वेट मॉडल है, और बेंचमार्क में शीर्ष प्रदर्शन का दावा करता है। Artificial Analysis द्वारा किए गए स्वतंत्र परीक्षणों में, यह उनके इंटेलिजेंस इंडेक्स पर तीसरे स्थान पर है, केवल Claude Fable 5 और GPT-5.6 Sol से पीछे। Kimi K3 एजेंटिक और स्वचालन कार्यों में उत्कृष्ट है, जो US फ्रंटियर मॉडल्स के लिए एक महत्वपूर्ण चुनौती पेश करता है।
चीनी स्टार्टअप Moonshot AI, जिसे चीनी इंटरनेट और कॉमर्स समूह Alibaba का समर्थन प्राप्त है, ने 2.8 ट्रिलियन पैरामीटर वाला एक ओपन-वेट मॉडल Kimi K3 जारी किया है। आंतरिक बेंचमार्क के अनुसार, यह असाधारण रूप से अच्छा प्रदर्शन करता है, जो प्रतिस्पर्धियों Claude Fable 5 और GPT-5.6 Sol के उच्च-स्तरीय संस्करणों से ठीक पीछे है। कोडिंग कार्यों में, Kimi K3 छह में से दो विषयों में जीतता है और अन्य सभी में कम से कम तीसरे स्थान पर रहता है। एक सार्वभौमिक एजेंट के रूप में, यह और भी बेहतर प्रदर्शन करता है, छह में से तीन परीक्षण जीतता है, जबकि Fable 5 समग्र रूप से आगे है। प्रयोगशाला Artificial Analysis द्वारा एक स्वतंत्र मूल्यांकन ने समान परिणाम पाए: Kimi ने उनके इंटेलिजेंस इंडेक्स पर 57 अंक प्राप्त किए, रैंक 17 से कूदकर रैंक 3 पर पहुंच गया, जो Claude Fable 5 से सिर्फ तीन अंक और GPT-5.6 Sol से दो अंक पीछे है। Kimi K3 ने एजेंटिक और स्वचालन कार्यों में विशेष रूप से अच्छा प्रदर्शन किया, यहां तक कि स्वचालन में Fable 5 को भी हराया। इसकी भ्रम दर (हैलुसिनेशन रेट) K2 संस्करण (51%) की तुलना में काफी बढ़ गई, लेकिन Fable 5 (55%) और GPT-5.6 Sol (85%) इस मीट्रिक में बदतर प्रदर्शन किया। यह जनवरी 2025 में DeepSeek की रिलीज़ के बाद OpenAI, Google और Anthropic की स्थापित मल्टीमॉडल एआई के लिए एक और मौलिक चुनौती है, जो सुझाव देता है कि अमेरिकी चिप प्रतिबंध के बावजूद ओपन-सोर्स मॉडल पश्चिमी सीमांत मॉडल के साथ प्रतिस्पर्धा कर सकते हैं।
स्रोत: Heise online —
मूल
