⚡ EILMELDUNG
Mistral AI stellt die Modellfamilie Mistral 3 vor, darunter Mistral Large 3
Mistral
Mistral AI
NVIDIA
Red Hat
vLLM
Mistral AI kündigt die Mistral-3-Familie an, die drei dichte Modelle (14B, 8B, 3B) und das Flaggschiff Mistral Large 3 umfasst, ein spärliches MoE-Modell mit 41B aktiven und 675B Gesamtparametern. Alle Modelle werden unter Apache 2.0 veröffentlicht. Mistral Large 3 erzielt Spitzenleistungen, Bildverständnis und mehrsprachige Fähigkeiten und belegt Platz 2 unter den Open-Source-Nicht-Reasoning-Modellen auf LMArena.
Mistral AI hat die Mistral 3-Familie vorgestellt, die drei kleine dichte Modelle (14B, 8B und 3B Parameter) sowie das Flaggschiff Mistral Large 3 umfasst, ein spärliches Mixture-of-Experts-Modell, das mit 41B aktiven und 675B Gesamtparametern trainiert wurde. Alle Modelle werden unter der Apache-2.0-Lizenz veröffentlicht. Mistral Large 3 wurde von Grund auf mit 3000 NVIDIA H200 GPUs trainiert und bietet Bildverständnis und mehrsprachige Fähigkeiten. Es erreicht Platz 2 unter den Open-Source-Nicht-Reasoning-Modellen auf der LMArena-Rangliste. Die Ministral 3-Serie bietet Modelle mit 3B, 8B und 14B Parametern in den Varianten Base, Instruct und Reasoning, die alle multimodales Verständnis unterstützen. Mistral hat mit NVIDIA, vLLM und Red Hat zusammengearbeitet, um Inferenz und Bereitstellung zu optimieren. Mistral 3 ist auf mehreren Plattformen verfügbar, darunter Mistral AI Studio, Amazon Bedrock, Azure Foundry, Hugging Face und andere. Für Unternehmenskunden werden auch maßgeschneiderte Modelltraining-Dienste angeboten.
Quelle: Mistral AI —
Original
