МоделиОткрытый код 🇺🇸 20.07.2026 11:05

Mistral AI представляет Mistral 3: семейство моделей от 3B до 675B параметров

MistralMistral NVIDIANVIDIA vLLMvLLM Red HatRed Hat
Компания Mistral AI анонсировала Mistral 3 — новое поколение моделей, включающее плотные модели Ministral (3B, 8B, 14B) и разреженную экспертную модель Mistral Large 3 с 41B активных и 675B общих параметров. Все модели выпущены под лицензией Apache 2.0. Mistral Large 3 обучен на 3000 GPU NVIDIA H200 и демонстрирует конкурентоспособные результаты, занимая 2-е место среди открытых моделей без рассуждений в рейтинге LMArena.
Компания Mistral AI представила Mistral 3 — новое поколение моделей, в которое вошли три плотные модели Ministral (14B, 8B и 3B параметров) и разреженная экспертная модель Mistral Large 3 с 41B активных и 675B общих параметров. Все модели выпущены под лицензией Apache 2.0. Mistral Large 3 обучен с нуля на 3000 GPU NVIDIA H200 и стал первой экспертной моделью Mistral после серии Mixtral. После пост-обучения модель достигает паритета с лучшими инструктивными открытыми моделями на общих запросах, а также демонстрирует понимание изображений и лучшую в классе производительность на многоязычных диалогах. Mistral Large 3 занимает 2-е место в категории открытых моделей без рассуждений (6-е среди всех открытых моделей) в рейтинге LMArena. Minstral 3 доступны в вариантах base, instruct и reasoning, каждый с поддержкой изображений. Модели Minstral instruct соответствуют или превосходят аналоги при генерации на порядок меньшего числа токенов. Reasoning-варианты могут достигать 85% на AIME '25 (14B). Совместно с NVIDIA, vLLM и Red Hat обеспечена поддержка эффективного инференса: выпущен чекпоинт в формате NVFP4, позволяющий запускать Mistral Large 3 на Blackwell NVL72, а также на одном узле 8×A100 или 8×H100 через vLLM. NVIDIA также обеспечила поддержку TensorRT-LLM и SGLang для всей семьи Mistral 3, включая оптимизированные ядра внимания и MoE для Blackwell. Mistral 3 доступен на Mistral AI Studio, Amazon Bedrock, Azure Foundry, Hugging Face, Modal, IBM WatsonX, OpenRouter, Fireworks, Unsloth AI и Together AI, вскоре появится на NVIDIA NIM и AWS SageMaker. Компания также предлагает услуги кастомного обучения моделей для организаций.
Сокращения
MoE = Mixture of Experts — смесь экспертов
GPU = Graphics Processing Unit — графический процессор
Источник: Mistral AI — оригинал

Наши прошлые публикации по теме

Есть свежие новости