Shieldstral: небольшая открытая модель Mistral превосходит гораздо более крупные классификаторы безопасности
Новая статья от Mistral показывает, что её модель Shieldstral с 3 миллиардами параметров соответствует производительности гораздо более крупных классификаторов безопасности на текстовых бенчмарках и устанавливает рекорд в мультимодальной классификации. Shieldstral использует простой формат вопросов с ответами да/нет, что позволяет операторам задавать собственные критерии безопасности без переобучения.
Согласно новой статье, Shieldstral — модель французской AI-компании Mistral с 3 миллиардами параметров — на стандартных тестах безопасности текста показывает результаты, сопоставимые с моделями втрое большего размера. А в задаче одновременной классификации текста и изображений она, по заявлению авторов, устанавливает новый лучший результат. Существующие модели безопасности часто используют
Показать ещё ↓
Источник: The Decoder (DE) —
оригинал
