ميسترال إيه آي تكشف عن شيلدسترال 1.0 3B: مصنف سلامة متعدد الوسائط مفتوح الأوزان يتفوق على نماذج أكبر منه بسبعة أضعاف

MistralMistral
أصدرت ميسترال إيه آي نموذج شيلدسترال 1.0 3B، وهو مصنف سلامة متعدد الوسائط مفتوح الأوزان وقابل للتكيف مع السياسات. يعالج هذا النموذج مراجعة المحتوى كسؤال بنعم أو لا واحد، بدلاً من تصنيف ثابت لفئات الضرر. ويداني النموذج أداء GPT-OSS-Safeguard-20B في سلامة النصوص، ويتصدر في سلامة الوسائط المتعددة.
أصدرت Mistral AI نموذج Shieldstral 1.0 3B، وهو مصنف سلامة متعدد الوسائط مفتوح الأوزان وقابل للتكيف مع السياسات، ويعالج الإشراف على المحتوى كسؤال بنعم أو لا واحد بدلاً من تصنيف ثابت لفئات الضرر. على عكس معظم نماذج الحماية التي تدمج فئات الضرر في أوزانها، يتيح Shieldstral للمشغلين كتابة السياسة كسؤال بلغة بسيطة في وقت الاستدلال، مع إرجاع درجة سلامة معايرة من تمريرة واحدة للأمام. مبني على قاعدة Ministral-3-3B-Base-2512 مع مشفر رؤية Pixtral أصلي، ومُصدر تحت رخصة Apache 2.0، ويحقق متوسط دقة F1 بنسبة 84.9% في سلامة النصوص، بما يعادل نموذج GPT-OSS-Safeguard-20B، و83.8% في السلامة متعددة الوسائط، متقدمًا على جميع المعايير التي قيّمتها Mistral. يتسع النموذج في ذاكرة 16GB من VRAM بصيغة BF16، ويعمل على بطاقة رسومية واحدة، ويدعم vLLM وllama.cpp وSGLang وTransformers. تتضمن بيانات تدريبه حوالي 54.1 مليون عينة، مع توليد تبايني لإنشاء أمثلة سلبية صعبة لتعليم انتهاكات محددة للسياسة. تشمل نقاط الضعف أداءً أقل على اللغات منخفضة الموارد مثل العربية والإندونيسية، وموثوقية منخفضة على المدخلات العدائية أو المشوشة والمستندات الطويلة جدًا.
المصدر: MarkTechPost — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة