Mistral ने सुरक्षा वर्गीकरण के लिए नई तकनीक वाला मॉडल जारी किया
Mistral
Mistral AI ने Shieldstral पेश किया है, जो एआई-जनित सामग्री को मॉडरेट करने के लिए लचीले प्रश्न-उत्तर दृष्टिकोण का उपयोग करने वाला एक सुरक्षा मॉडल है। निश्चित श्रेणियों के बजाय, ऑपरेटर मॉडरेशन नीतियों को प्राकृतिक भाषा के हाँ/नहीं प्रश्नों के रूप में परिभाषित करते हैं, और Shieldstral एक सुरक्षा स्कोर लौटाता है। यह मॉडल सात गुना बड़े मॉडलों के बराबर प्रदर्शन प्राप्त करता है, जबकि यह 16 जीबी एनवीडिया जीपीयू पर चलता है।
Mistral AI ने Shieldstral पेश किया है, जो AI-जनित सामग्री के मॉडरेशन को सरल बनाने के लिए डिज़ाइन किया गया एक सुरक्षा मॉडल है। यह निश्चित श्रेणियों के बजाय एक लचीला प्रश्न-उत्तर दृष्टिकोण का उपयोग करता है: ऑपरेटर अपनी मॉडरेशन नीतियों को प्राकृतिक भाषा में हाँ/नहीं प्रश्नों के रूप में तैयार करते हैं, जैसे "क्या यह सामग्री वास्तविक हिंसा का आह्वान करती है?", और Shieldstral एक सुरक्षा स्कोर लौटाता है जिसके आधार पर प्रॉम्प्ट या AI प्रतिक्रिया को स्वीकृत या अस्वीकृत किया जा सकता है। Mistral के अनुसार, इस विधि के दो लाभ हैं: पहला, ऑपरेटर किसी भी समय सामग्री के बारे में पूछे जाने वाले प्रश्नों को आसानी से समायोजित कर सकते हैं; दूसरा, यह सामग्री के संदर्भ का बेहतर आकलन कर सकता है। उदाहरण के लिए, एकाग्रता शिविरों पर स्कूल व्याख्यान में समकालीन भाषणों के आवश्यक मूल उद्धरण एक निजी ब्लॉग पोस्ट के लिए सामग्री के रूप में अत्यधिक आलोचनात्मक होंगे। संबंधित पेपर के लेखकों का तर्क है कि निश्चित वर्गीकरण वाले पिछले गार्डरेल मॉडल ऐसे प्रासंगिक अंतरों को पर्याप्त रूप से कैप्चर नहीं कर सकते क्योंकि अनुमेयता अक्सर श्रेणियों से जुड़ी होती है। इनपुट मॉडरेशन को एक द्विआधारी प्रश्न-उत्तर कार्य के रूप में मानता है: मॉडल को एक सिस्टम निर्देश, संदर्भ और एक हाँ/नहीं प्रश्न प्राप्त होता है, और अनुमान के दौरान केवल हाँ और नहीं लॉगिट्स आउटपुट करता है, जिन्हें सॉफ्टमैक्स के माध्यम से एक सतत सुरक्षा स्कोर में सामान्यीकृत किया जाता है। Mistral का दावा है कि Shieldstral सात गुना बड़े मॉडलों के समान प्रदर्शन प्राप्त करता है लेकिन 16 GB Nvidia GPU पर चलता है। तकनीकी रूप से, Shieldstral Mistral के अपने परिवार के Ministral-3B-Base-2512 पर आधारित है, जो एक कारणवाचक भाषा मॉडल है, जिसे हाल ही में Leanstral 1.5 के साथ विस्तारित किया गया था, जो गणितीय प्रमाणों और औपचारिक सत्यापन के लिए अनुकूलित है। छवि प्रसंस्करण के लिए, Pixtral-Vision-Encoder का उपयोग किया जाता है। 3-बिलियन-पैरामीटर मॉडल Hugging Face पर Apache-2.0 लाइसेंस के तहत ओपन वेट्स के रूप में डाउनलोड के लिए उपलब्ध है।
स्रोत: Heise online —
मूल
