на естественном языке во время логического вывода, и модель возвращает калиброванную оценку безопасности. Такая формулировка объединяет классификацию промптов, модерацию ответов, обнаружение отказов и определение токсичности в единую задачу, работая как с текстом, так и с изображениями без дополнительного обучения. Модель соответствует или превосходит открытые модели-ограничители, превосходящие ее по размеру до 7 раз, по показателям безопасности текста, обнаружения отказов, адаптивности политик и мультимодальным бенчмаркам. Она эффективно работает на одном графическом процессоре NVIDIA с 16 ГБ памяти. В процессе обучения были объединены разнородные публичные наборы данных по безопасности, обучение разграничению проводилось с помощью контрастных пар, сгенерированных языковой моделью, безопасность изображений обеспечивалась с помощью визуально-языкового реранжирования, а совместимые контрольные точки комбинировались с помощью LoRA и SLERP. Mistral AI разработала Shieldstral от начала до конца на своей платформе Forge. Компания продолжает работу над многоязычным покрытием, устойчивостью к длинным документам и расширением мультимодальных мер безопасности. Mistral AI также является одним из основателей альянса Open Secure AI Alliance вместе с NVIDIA и другими организациями.