⚡ TIN NÓNG
Mistral AI ra mắt dòng mô hình Mistral 3, bao gồm Mistral Large 3
Mistral
Mistral AI
NVIDIA
Red Hat
vLLM
Mistral AI công bố dòng Mistral 3, gồm ba mô hình dense (14B, 8B, 3B) và mô hình chủ lực Mistral Large 3, một mô hình MoE thưa thớt với 41B tham số hoạt động và 675B tổng tham số. Tất cả các mô hình đều được phát hành theo giấy phép Apache 2.0. Mistral Large 3 đạt hiệu suất tiên phong, khả năng hiểu hình ảnh và đa ngôn ngữ, xếp thứ #2 trong số các mô hình không suy luận mã nguồn mở trên LMArena.
Mistral AI vừa ra mắt dòng Mistral 3, bao gồm ba mô hình dày đặc nhỏ (14 tỷ, 8 tỷ và 3 tỷ tham số) cùng mô hình chủ lực Mistral Large 3, một mô hình hỗn hợp chuyên gia thưa (sparse mixture-of-experts) được huấn luyện với 41 tỷ tham số hoạt động và 675 tỷ tham số tổng cộng. Tất cả các mô hình đều được phát hành dưới giấy phép Apache 2.0. Mistral Large 3 được huấn luyện từ đầu trên 3000 GPU NVIDIA H200, sở hữu khả năng hiểu ảnh và đa ngôn ngữ, đạt vị trí thứ 2 trong số các mô hình mã nguồn mở không suy luận trên bảng xếp hạng LMArena. Dòng Ministral 3 cung cấp các mô hình với 3 tỷ, 8 tỷ và 14 tỷ tham số, bao gồm các phiên bản base, instruct và reasoning, tất cả đều hỗ trợ đa phương thức. Mistral đã hợp tác với NVIDIA, vLLM và Red Hat để tối ưu hóa suy luận và triển khai. Mistral 3 có sẵn trên nhiều nền tảng bao gồm Mistral AI Studio, Amazon Bedrock, Azure Foundry, Hugging Face và các nền tảng khác. Dịch vụ huấn luyện mô hình tùy chỉnh cũng được cung cấp cho khách hàng doanh nghiệp.
Nguồn: Mistral AI —
bản gốc
