⚡ ÚLTIMA HORA
Mistral AI apresenta a família de modelos Mistral 3, incluindo o Mistral Large 3
Mistral
Mistral AI
NVIDIA
Red Hat
vLLM
A Mistral AI anuncia a família Mistral 3, com três modelos densos (14B, 8B, 3B) e o principal Mistral Large 3, um modelo MoE esparso com 41B ativos e 675B parâmetros totais. Todos os modelos são lançados sob a licença Apache 2.0. O Mistral Large 3 alcança desempenho de fronteira, compreensão de imagens e capacidades multilíngues, classificando-se em #2 entre os modelos OSS não raciocinadores no LMArena.
A Mistral AI lançou a família Mistral 3, que inclui três modelos densos pequenos (14B, 8B e 3B parâmetros) e o carro-chefe Mistral Large 3, um modelo esparso de mistura de especialistas treinado com 41B parâmetros ativos e 675B parâmetros totais. Todos os modelos são liberados sob a licença Apache 2.0. O Mistral Large 3 foi treinado do zero em 3000 GPUs NVIDIA H200 e possui capacidade de compreensão de imagens e recursos multilíngues, alcançando o 2º lugar entre modelos OSS não raciocinadores no ranking LMArena. A série Ministral 3 oferece modelos de 3B, 8B e 14B parâmetros com variantes base, instruct e reasoning, cada uma suportando compreensão multimodal. A Mistral colaborou com a NVIDIA, vLLM e Red Hat para otimizar inferência e implantação. O Mistral 3 está disponível em várias plataformas, incluindo Mistral AI Studio, Amazon Bedrock, Azure Foundry, Hugging Face e outras. Serviços personalizados de treinamento de modelo também são oferecidos para clientes empresariais.
Fonte: Mistral AI —
original
