模型开源 🇺🇸 27.07.2026 15:06

Mistral AI 发布 Mistral Small 4:兼具推理与多模态能力的全能模型

MistralMistral NVIDIANVIDIA
Mistral AI 发布了 Mistral Small 4,这是一个融合了推理、多模态和智能体编码的模型。该模型拥有 1190 亿参数(80 亿活跃),支持文本和图像,上下文长度可达 256k token,并可灵活调整推理努力程度。Mistral Small 4 采用 Apache 2.0 许可证发布。
Mistral AI 发布了 Mistral Small 4,这是 Small 系列的新模型,首次融合了公司旗舰模型的能力:Magistral(推理)、Pixtral(多模态)和 Devstral(智能体编码)。用户可以通过 `reasoning_effort` 参数来调节推理投入程度,在快速响应和深入的多步骤推理之间做出选择。该模型采用了混合专家(Mixture of Experts,MoE)架构,拥有 128 个专家(每个 token 激活 4 个),总共 1190 亿参数,其中 80 亿为激活参数(包括嵌入层和输出层)。上下文窗口为 256k token。与 Mistral Small 3 相比,整体执行时间缩短了 40%,吞吐量提升了 3 倍。Mistral Small 4 在效率上超越了 GPT-OSS 120B,在同等或更优质量下生成明显更短的响应。该模型基于 Apache 2.0 许可证发布,可通过 Mistral API、AI Studio 以及 NVIDIA build.nvidia.com 平台上的 NIM 使用。Mistral Small 4 支持文本和图像输入,可用于聊天、编码、文档分析和复杂推理。公司还宣布已加入 NVIDIA Nemotron Coalition 成为联合创始人。
来源: Mistral AI — 原文
我们之前关于此话题的帖子 ↓
最新新闻