Leistung pro Watt ist die Schlüsselkennzahl für die Effizienz der KI-Infrastruktur
NVIDIA
CoreWeave
Perplexity AI
Fireworks AI
Die Leistung pro Watt ist die Grundlage für KI-Fabriken, da Strom der Hauptengpass ist. NVIDIAs Blackwell NVL72-Plattform liefert für MoE-Modelle bis zu 25-mal mehr Leistung pro Watt als Hopper, und die kommende Vera-Rubin-Plattform baut darauf auf, um die Energieeffizienz auf Rack-Ebene weiter zu verbessern.
NVIDIA argumentiert, dass Strom die unvermeidbare Einschränkung für KI-Infrastruktur darstellt, weshalb die Leistung pro Watt die entscheidende Kennzahl für Umsatz und Rentabilität ist. Da immer mehr hochmoderne KI-Modelle auf Mixture-of-Experts-Architektur (MoE) setzen, kommt es auf die GPU-Domänengröße an: Eine effiziente Bereitstellung von MoE erfordert eine 72-GPU-Domäne anstelle der 8-GPU-Domäne der Hopper-Generation. Die Blackwell NVL72-Plattform, die durch Full-Stack-Codesign optimiert wurde, erzielt bei den neuesten offenen Modellen eine bis zu 25-mal höhere Leistung pro Watt als Hopper. NVIDIA betont, dass praktische Erfahrung entscheidend ist: Anthropic, OpenAI und SpaceXAI nutzen Blackwell NVL72 für Inferenz, während CoreWeave, Perplexity und Fireworks AI verschiedene Modelle auf der Plattform einsetzen. Die nächste Generation, die Vera-Rubin-Plattform, baut auf dieser Grundlage auf, um die Energieeffizienz weiter zu steigern.
Quelle: NVIDIA blog —
Original
