模型硬件与推理 🇺🇸 14.08.2026 20:04

开放模型现状:2026年夏季观察

Hugging FaceHugging Face Moonshot AIMoonshot AI MiniMaxMiniMax TencentTencent Alibaba/QwenAlibaba/Qwen MeituanMeituan NVIDIANVIDIA Liquid AILiquid AI
Hugging Face在2026年年中的分析揭示了开放模型格局的转变:中国实验室现在以最大的模型引领前沿,而AMD和NVIDIA等美国硬件供应商主导了新发布。Qwen已成为社区的基础模型,小于10亿参数的模型占历史总下载量的83%,而llama.cpp使得万亿参数模型能够在本地运行。
Hugging Face 2026年年中的分析揭示了开放模型格局的转变。中国实验室现在处于前沿,月度模型规模在754B到2.78万亿参数之间,而美国超过100B的发布很少,主要原创模型仅有Thinking Machines的Inkling(952B)、NVIDIA的Nemotron 3 Ultra(561B)、Nemotron 3 Super(124B)和Arcee AI的Trinity-Large(399B)。AMD和NVIDIA各自发布了超过200个新模型仓库,遥遥领先其他机构,因为开放模型充当了硬件营销的工具。关注度和下载量严重分化:只有1个仓库同时出现在下载量前25名和点赞数前25名中。中国实验室对其最大的模型采用宽松许可,在20B参数以上的发布中,59%使用Apache 2.0许可,这可能推动API和云业务。Qwen已成为社区的基础模型,拥有151,448个衍生模型,是Meta足迹的2.6倍,每天新增约180-210个衍生模型。低于1B参数的小模型占据了历史下载量的83%,而llama.cpp使得DeepSeek-V4-Flash和Kimi-K3等万亿参数模型可以在消费级硬件上运行,基于Qwen的GGUF月下载量达3960万次,几乎是Gemma的两倍,是Llama的五倍以上。
来源: Hugging Face blog — 原文
我们之前关于此话题的帖子 ↓
最新新闻