Hardware e Inferência 🇺🇸 27.07.2026 02:05

Performance por Watt é a Métrica Chave para Eficiência em Infraestrutura de IA

NVIDIANVIDIA CoreWeaveCoreWeave Perplexity AIPerplexity AI Fireworks AIFireworks AI
Performance por watt é a base para as fábricas de IA, já que a energia é a principal restrição. A plataforma Blackwell NVL72 da NVIDIA oferece até 25x mais performance por watt em comparação com Hopper para modelos MoE, e a próxima plataforma Vera Rubin se baseia nisso para melhorar ainda mais a eficiência energética em escala de rack.
A NVIDIA argumenta que a energia é a restrição inevitável para a infraestrutura de IA, tornando o desempenho por watt a métrica crítica para receita e lucratividade. Com modelos de IA de ponta usando cada vez mais a arquitetura de mistura de especialistas (mixture-of-experts, ou MoE), o tamanho do domínio da GPU é importante: servir MoE de forma eficiente requer um domínio de 72 GPUs, em vez do domínio de 8 GPUs da geração Hopper. A plataforma Blackwell NVL72, com codesign de pilha completa, oferece até 25 vezes mais desempenho por watt em relação à Hopper para os modelos abertos mais recentes. A NVIDIA enfatiza que a experiência em produção é fundamental: a Anthropic, a OpenAI e a SpaceXAI usam a Blackwell NVL72 para inferência, enquanto a CoreWeave, a Perplexity e a Fireworks AI implantam vários modelos na plataforma. A plataforma Vera Rubin da próxima geração baseia-se nessa fundação para elevar ainda mais a eficiência energética.
Fonte: NVIDIA blog — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas