Mistral AI, Shieldstral'ı Yayınladı: Politika Uyarlamalı Çok Modlu Güvenlik Sınıflandırıcısı
Mistral
Mistral AI, içerik denetimini politika uyarlamalı bir soru-cevap görevi olarak çerçeveleyen, 3 milyar parametreli, açık ağırlıklı çok modlu güvenlik sınıflandırıcısı Shieldstral'ı tanıttı. Bu model, kendisinden 7 kata kadar daha büyük modelleri geride bırakıyor, çıkarım zamanında düz dilde politikaları kabul ediyor ve Apache 2.0 lisansı altında tek bir 16 gigabaytlık NVIDIA grafik işlem biriminde (GPU) çalışıyor.
Shieldstral, Mistral AI tarafından Apache 2.0 lisansı altında yayınlanan, 3B parametreli, açık ağırlıklı çok modlu bir güvenlik sınıflandırıcısıdır. Ağırlıklarına sabit bir zarar kategorileri taksonomisi yerleştiren geleneksel önlem modellerinin aksine, Shieldstral yeni bir yaklaşım benimser: kullanıcılar güvenlik politikasını çıkarım sırasında düz dilde bir soru olarak yazar ve model kalibre edilmiş bir güvenlik puanı döndürür. Bu formülasyon, istem sınıflandırmayı, yanıt denetimini, reddetme tespitini ve toksisite tespitini tek bir problemde birleştirir ve yeniden eğitim gerektirmeden hem metin hem de görüntüler için çalışır. Model, metin güvenliği, reddetme tespiti, politika uyarlanabilirliği ve çok modlu kıyaslamalarda 7 kat daha büyük açık önlem modelleriyle eşleşir veya onları geride bırakır. Tek bir 16GB NVIDIA GPU üzerinde verimli bir şekilde çalışır. Eğitim süreci, heterojen kamu güvenliği veri kümelerinin birleştirilmesini, bir LLM tarafından üretilen zıt çiftler aracılığıyla ayrım öğretilmesini, görsel-dil yeniden sıralama ile görüntülerde güvenliğin temellendirilmesini ve LoRA ve SLERP aracılığıyla tamamlayıcı denetim noktalarının birleştirilmesini içeriyordu. Mistral AI, Shieldstral'ı uçtan uca Forge platformunda geliştirdi. Şirket, çok dilli kapsam, daha uzun belge sağlamlığı ve daha geniş çok modlu güvenlik üzerinde çalışmaya devam ediyor. Mistral AI ayrıca NVIDIA ve diğer kuruluşlarla birlikte Açık Güvenli Yapay Zeka İttifakı'nın kurucu üyesidir.
Kaynak: Mistral AI —
orijinal
