एआई बुनियादी ढांचे की दक्षता के लिए प्रति वॉट प्रदर्शन मुख्य मीट्रिक है
NVIDIA
CoreWeave
Perplexity AI
Fireworks AI
प्रति वॉट प्रदर्शन एआई फैक्ट्रियों की नींव है, क्योंकि बिजली मुख्य बाधा है। NVIDIA का Blackwell NVL72 प्लेटफॉर्म MoE मॉडलों के लिए Hopper की तुलना में प्रति वॉट 25 गुना तक बेहतर प्रदर्शन देता है, और आगामी Vera Rubin प्लेटफॉर्म इसी पर आधारित है ताकि रैक-स्तरीय ऊर्जा दक्षता में और सुधार हो सके।
NVIDIA का तर्क है कि AI बुनियादी ढांचे के लिए बिजली एक अपरिहार्य बाधा है, जिससे प्रदर्शन प्रति वॉट राजस्व और लाभप्रदता के लिए महत्वपूर्ण मीट्रिक बन जाता है। चूंकि फ्रंटियर AI मॉडल तेजी से मिक्सचर-ऑफ-एक्सपर्ट्स (MoE) आर्किटेक्चर का उपयोग कर रहे हैं, GPU डोमेन आकार मायने रखता है: MoE को कुशलतापूर्वक सेवा देने के लिए 72-GPU डोमेन की आवश्यकता होती है, न कि Hopper पीढ़ी के 8-GPU डोमेन की। Blackwell NVL72 प्लेटफॉर्म, फुल-स्टैक कोडिज़ाइन के साथ, नवीनतम ओपन मॉडल्स के लिए Hopper की तुलना में 25 गुना तक प्रदर्शन प्रति वॉट देता है। NVIDIA इस बात पर जोर देता है कि प्रोडक्शन अनुभव महत्वपूर्ण है: Anthropic, OpenAI, और SpaceXAI इनफरेंस के लिए Blackwell NVL72 का उपयोग कर रहे हैं, जबकि CoreWeave, Perplexity, और Fireworks AI प्लेटफॉर्म पर विभिन्न मॉडल तैनात कर रहे हैं। अगली पीढ़ी का Vera Rubin प्लेटफॉर्म ऊर्जा दक्षता को और बढ़ाने के लिए इसी नींव पर बनाया गया है।
स्रोत: NVIDIA blog —
मूल
