मिस्ट्रल एआई ने शील्डस्ट्राल जारी किया: एक नीति-अनुकूल मल्टीमॉडल सुरक्षा वर्गीकरणकर्ता
Mistral
मिस्ट्रल एआई ने शील्डस्ट्राल पेश किया है, जो 3बी-पैरामीटर वाला ओपन-वेट मल्टीमॉडल सुरक्षा वर्गीकरणकर्ता है जो सामग्री मॉडरेशन को नीति-अनुकूल प्रश्न-उत्तर कार्य के रूप में तैयार करता है। यह अपने आकार के 7 गुना तक के मॉडल से बेहतर प्रदर्शन करता है, अनुमान के समय सादे-भाषा नीतियों को स्वीकार करता है, और एक ही 16GB एनवीडिया जीपीयू पर चलता है, यह सब अपाचे 2.0 के तहत उपलब्ध है।
Shieldstral मिस्ट्रल एआई द्वारा अपाचे 2.0 लाइसेंस के तहत जारी किया गया एक 3B ओपन-वेट मल्टीमॉडल सुरक्षा क्लासिफायर है। पारंपरिक गार्डरेल मॉडल के विपरीत, जो अपने वेट में हानि श्रेणियों की एक निश्चित टैक्सोनॉमी बेक करते हैं, शील्डस्ट्राल एक नया दृष्टिकोण अपनाता है: उपयोगकर्ता सुरक्षा नीति को इन्फेरेंस समय पर एक सादे-भाषा प्रश्न के रूप में लिखते हैं, और मॉडल एक कैलिब्रेटेड सुरक्षा स्कोर लौटाता है। यह सूत्रीकरण प्रॉम्प्ट वर्गीकरण, प्रतिक्रिया मॉडरेशन, रिफ्यूज़ल का पता लगाने, और टॉक्सिसिटी डिटेक्शन को एक ही समस्या में एकीकृत करता है, और यह बिना रीट्रेनिंग के टेक्स्ट और इमेज दोनों के लिए काम करता है। मॉडल टेक्स्ट सुरक्षा, रिफ्यूज़ल डिटेक्शन, नीति अनुकूलनशीलता, और मल्टीमॉडल बेंचमार्क में अपने आकार के 7 गुना तक के ओपन गार्ड मॉडल से मेल खाता है या बेहतर प्रदर्शन करता है। यह एक सिंगल 16GB एनवीडिया GPU पर कुशलतापूर्वक चलता है। प्रशिक्षण प्रक्रिया में विषम सार्वजनिक सुरक्षा डेटासेट को एकीकृत करना, एक LLM द्वारा उत्पन्न कंट्रास्टिव जोड़ों के माध्यम से भेदभाव सिखाना, विज़न-लैंग्वेज रीरैंकिंग के साथ छवियों में सुरक्षा को आधार बनाना, और LoRA और SLERP के माध्यम से पूरक चेकपॉइंट्स को संयोजित करना शामिल था। मिस्ट्रल एआई ने शील्डस्ट्राल को अपने फोर्ज प्लेटफॉर्म पर एंड-टू-एंड बनाया है। कंपनी बहुभाषी कवरेज, लंबे-दस्तावेज़ मजबूती, और व्यापक मल्टीमॉडल सुरक्षा पर काम करना जारी रखे हुए है। मिस्ट्रल एआई एनवीडिया और अन्य संगठनों के साथ ओपन सिक्योर एआई एलायंस का संस्थापक सदस्य भी है।
स्रोत: Mistral AI —
मूल
