Matériel et Inférence 🇺🇸 27.07.2026 02:05

La performance par watt est la métrique clé pour l'efficacité des infrastructures d'IA

NVIDIANVIDIA CoreWeaveCoreWeave Perplexity AIPerplexity AI Fireworks AIFireworks AI
La performance par watt est le fondement des usines d'IA, car l'énergie est la principale contrainte. La plateforme NVIDIA Blackwell NVL72 offre jusqu'à 25 fois plus de performance par watt que Hopper pour les modèles MoE, et la plateforme à venir Vera Rubin s'appuie sur cela pour améliorer encore l'efficacité énergétique à l'échelle du rack.
NVIDIA soutient que l'énergie est la contrainte inéluctable de l'infrastructure IA, faisant de la performance par watt la mesure clé pour le chiffre d'affaires et la rentabilité. À mesure que les modèles d'IA de pointe adoptent de plus en plus l'architecture à experts mixtes (MoE), la taille du domaine GPU devient cruciale : servir efficacement un modèle MoE nécessite un domaine de 72 GPU plutôt que le domaine de 8 GPU de la génération Hopper. La plateforme Blackwell NVL72, grâce à une co-conception de la pile complète, offre jusqu'à 25 fois plus de performance par watt que Hopper pour les derniers modèles ouverts. NVIDIA souligne que l'expérience en production est essentielle : Anthropic, OpenAI et SpaceXAI utilisent Blackwell NVL72 pour l'inférence, tandis que CoreWeave, Perplexity et Fireworks AI déploient divers modèles sur cette plateforme. La prochaine génération de plateforme Vera Rubin s'appuie sur ces fondations pour améliorer encore l'efficacité énergétique.
Source: NVIDIA blog — original
Nos articles précédents sur ce sujet ↓
Infos fraîches