⚡ ÚLTIMA HORA
Mistral AI presenta la familia de modelos Mistral 3, incluido Mistral Large 3
Mistral
Mistral AI
NVIDIA
Red Hat
vLLM
Mistral AI anuncia la familia Mistral 3, con tres modelos densos (14B, 8B, 3B) y el modelo estrella Mistral Large 3, un modelo MoE disperso con 41B parámetros activos y 675B totales. Todos los modelos se publican bajo Apache 2.0. Mistral Large 3 alcanza rendimiento de frontera, comprensión de imágenes y capacidades multilingües, ocupando el puesto #2 entre modelos OSS no razonadores en LMArena.
Mistral AI ha presentado la familia Mistral 3, que incluye tres modelos densos pequeños (parámetros 14B, 8B y 3B) y el buque insignia Mistral Large 3, un modelo sparse mixture-of-experts entrenado con 41B de parámetros activos y 675B totales. Todos los modelos se publican bajo la licencia Apache 2.0. Mistral Large 3 fue entrenado desde cero en 3000 GPU NVIDIA H200 y cuenta con capacidades de comprensión de imágenes y multilingüismo, logrando el puesto #2 entre los modelos OSS no razonadores en el ranking LMArena. La serie Ministral 3 ofrece modelos de parámetros 3B, 8B y 14B con variantes base, instruct y reasoning, cada una compatible con comprensión multimodal. Mistral colaboró con NVIDIA, vLLM y Red Hat para optimizar la inferencia y el despliegue. Mistral 3 está disponible en múltiples plataformas, incluyendo Mistral AI Studio, Amazon Bedrock, Azure Foundry, Hugging Face, entre otras. También se ofrecen servicios personalizados de entrenamiento de modelos para clientes empresariales.
Fuente: Mistral AI —
original
