硬件与推理 🇺🇸 27.07.2026 02:05

能效比是AI基础设施效率的关键指标

NVIDIANVIDIA CoreWeaveCoreWeave Perplexity AIPerplexity AI Fireworks AIFireworks AI
能效比是AI工厂的基础,因为电力是主要约束条件。NVIDIA的Blackwell NVL72平台在MoE模型上的能效比相比Hopper提升了高达25倍,即将推出的Vera Rubin平台在此基础上进一步提升了机架级能源效率。
英伟达(NVIDIA)认为,电力是AI基础设施不可回避的制约因素,这使得每瓦性能成为决定营收和盈利能力的关键指标。随着前沿AI模型日益采用专家混合(Mixture-of-Experts,MoE)架构,GPU域的规模变得至关重要:要高效地服务于MoE模型,需要72-GPU域,而不是Hopper一代所用的8-GPU域。Blackwell NVL72平台通过全栈协同设计,在运行最新的开源模型时,每瓦性能相较Hopper最高提升达25倍。英伟达强调,实际生产环境中的应用经验才是关键:Anthropic、OpenAI和SpaceXAI在推理任务中使用Blackwell NVL72,而CoreWeave、Perplexity和Fireworks AI则在该平台上部署了各类模型。下一代Vera Rubin平台将在此基础上进一步提升能效表现。
来源: NVIDIA blog — 原文
我们之前关于此话题的帖子 ↓
最新新闻