⚡ BREAKING
Mistral AI luncurkan keluarga model Mistral 3, termasuk Mistral Large 3
Mistral
Mistral AI
NVIDIA
Red Hat
vLLM
Mistral AI mengumumkan keluarga Mistral 3, yang mencakup tiga model padat (14B, 8B, 3B) dan model unggulan Mistral Large 3, sebuah model MoE jarang dengan 41B parameter aktif dan 675B parameter total. Semua model dirilis di bawah lisensi Apache 2.0. Mistral Large 3 mencapai performa kelas atas, pemahaman gambar, dan kemampuan multibahasa, menempati peringkat #2 di antara model OSS non-penalaran di LMArena.
Mistral AI telah meluncurkan keluarga Mistral 3, yang mencakup tiga model small dense (parameter 14B, 8B, dan 3B) serta flagship Mistral Large 3, sebuah model sparse mixture-of-experts yang dilatih dengan parameter 41B aktif dan total 675B. Semua model dirilis di bawah lisensi Apache 2.0. Mistral Large 3 dilatih dari awal pada 3000 GPU NVIDIA H200 dan memiliki kemampuan pemahaman gambar serta multibahasa, menempati peringkat #2 di antara model non-reasoning sumber terbuka (open-source software/OSS) pada papan peringkat LMArena. Seri Ministral 3 menawarkan model dengan parameter 3B, 8B, dan 14B dengan varian base, instruct, dan reasoning, masing-masing mendukung pemahaman multimodal. Mistral berkolaborasi dengan NVIDIA, vLLM, dan Red Hat untuk mengoptimalkan inferensi dan deployment. Mistral 3 tersedia di berbagai platform termasuk Mistral AI Studio, Amazon Bedrock, Azure Foundry, Hugging Face, dan lainnya. Layanan pelatihan model kustom juga ditawarkan untuk klien perusahaan.
Sumber: Mistral AI —
asli
