Anthropic का Opus 5: टोकन दक्षता पर ध्यान, क्षमताओं में छलांग नहीं

AnthropicAnthropic OpenAIOpenAI
Anthropic ने अपने मॉडल का नया संस्करण Opus 5 जारी किया है। मुख्य जोर लागत दक्षता पर है: मॉडल लगभग अधिक शक्तिशाली Fable जैसा प्रदर्शन करता है लेकिन लगभग आधी कीमत पर। बेंचमार्क पर Opus 5 क्रमिक सुधार दिखाता है, लेकिन प्रशिक्षण विशिष्टताओं के कारण साइबर सुरक्षा कार्यों में पिछड़ जाता है।
Anthropic ने Opus 5 लॉन्च किया है, जो प्रोग्रामिंग और डेवलपमेंट के लिए लोकप्रिय अपने मॉडल का नवीनतम अपडेट है। यह रिलीज़ एजेंटिक कोडिंग में Opus 4.5 के स्तर की कोई सफलता नहीं है। Anthropic के चार्ट के अनुसार, Opus 5 कोडिंग कार्यों में Fable मॉडल के बराबर परिणाम प्राप्त करता है और लगभग सभी परीक्षणों में Opus 4.8 और OpenAI GPT-5.6-Sol से बेहतर प्रदर्शन करता है, लेकिन प्रदर्शन सुधार क्रांतिकारी के बजाय क्रमिक है। मुख्य लाभ लागत है: Opus 5 लगभग आधी कीमत पर Fable के करीब क्षमताएँ प्रदान करता है। इस बीच, Anthropic ने जानबूझकर Opus 5 को उन्नत साइबर सुरक्षा कार्यों पर प्रशिक्षित नहीं किया, इसलिए मॉडल इस क्षेत्र में Fable और Mythos से काफी पीछे है। Opus 5 कमजोरियाँ खोजने में अच्छा है लेकिन उनका शोषण करने में Mythos 5 से काफी कम है। Fable के विपरीत, Opus 5 में घटना विश्लेषण के लिए 30-दिवसीय डेटा प्रतिधारण जैसी सख्त सुरक्षा उपाय नहीं हैं।
स्रोत: Ars Technica — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार