Mistral выпускает модель с новой техникой классификации безопасности
Mistral AI представила Shieldstral — модель безопасности, которая использует гибкий подход «вопрос-ответ» для модерации контента, создаваемого ИИ. Вместо фиксированных категорий операторы задают политики модерации в виде естественно-языковых вопросов с ответами «да/нет», а Shieldstral возвращает оценку безопасности. Модель достигает производительности, сопоставимой с моделями в семь раз большего размера, работая на графическом процессоре Nvidia с 16 гигабайтами памяти.
Mistral AI представила Shieldstral — модель безопасности, предназначенную для упрощения модерации контента, генерируемого искусственным интеллектом. Вместо фиксированных категорий она использует гибкий подход «вопрос-ответ»: операторы формулируют свои политики модерации в виде вопросов с ответом «да» или «нет» на естественном языке, например: «Призывает ли этот контент к реальному насилию?» — а
Показать ещё ↓
Источник: Heise online —
оригинал
