⚡ 突发新闻
Mistral AI 发布 Mistral Small 4:兼具推理与多模态能力的通用模型
Mistral
NVIDIA
Mistral AI 发布了 Mistral Small 4,这是一款将推理、多模态和智能体编码能力整合到单一系统中的新模型。它采用 Apache 2.0 许可证、混合专家架构,并提供可配置的推理努力,相比之前版本效率更高。
Mistral AI 发布了 Mistral Small 4,这是 Mistral Small 产品线的最新成员。该模型是首款将旗舰型号——Magistral(推理)、Pixtral(多模态)和 Devstral(智能体编码)——的能力整合到一个通用模型中的 Mistral 模型。它采用混合专家架构,包含 128 个专家,每个 token 激活 4 个,总参数为 1190 亿,但每个 token 仅激活 60 亿参数。该模型支持 256k 上下文窗口,可接受文本和图像输入,并配备可配置的推理努力参数。Mistral Small 4 遵循 Apache 2.0 许可证发布,完全开源。性能亮点包括:相比 Mistral Small 3,端到端完成时间减少 40%,每秒请求数提升高达 3 倍。该模型可通过 Mistral API、AI Studio 以及 NVIDIA NIM 获取,并支持使用 NVIDIA NeMo 进行定制。Mistral AI 还作为创始成员加入了 NVIDIA Nemotron Coalition。
来源: Mistral AI —
原文
