एआई बुनियादी ढांचे की दक्षता के लिए प्रति वॉट प्रदर्शन मुख्य मीट्रिक है

NVIDIANVIDIA CoreWeaveCoreWeave Perplexity AIPerplexity AI Fireworks AIFireworks AI
प्रति वॉट प्रदर्शन एआई फैक्ट्रियों की नींव है, क्योंकि बिजली मुख्य बाधा है। NVIDIA का Blackwell NVL72 प्लेटफॉर्म MoE मॉडलों के लिए Hopper की तुलना में प्रति वॉट 25 गुना तक बेहतर प्रदर्शन देता है, और आगामी Vera Rubin प्लेटफॉर्म इसी पर आधारित है ताकि रैक-स्तरीय ऊर्जा दक्षता में और सुधार हो सके।
NVIDIA का तर्क है कि AI बुनियादी ढांचे के लिए बिजली एक अपरिहार्य बाधा है, जिससे प्रदर्शन प्रति वॉट राजस्व और लाभप्रदता के लिए महत्वपूर्ण मीट्रिक बन जाता है। चूंकि फ्रंटियर AI मॉडल तेजी से मिक्सचर-ऑफ-एक्सपर्ट्स (MoE) आर्किटेक्चर का उपयोग कर रहे हैं, GPU डोमेन आकार मायने रखता है: MoE को कुशलतापूर्वक सेवा देने के लिए 72-GPU डोमेन की आवश्यकता होती है, न कि Hopper पीढ़ी के 8-GPU डोमेन की। Blackwell NVL72 प्लेटफॉर्म, फुल-स्टैक कोडिज़ाइन के साथ, नवीनतम ओपन मॉडल्स के लिए Hopper की तुलना में 25 गुना तक प्रदर्शन प्रति वॉट देता है। NVIDIA इस बात पर जोर देता है कि प्रोडक्शन अनुभव महत्वपूर्ण है: Anthropic, OpenAI, और SpaceXAI इनफरेंस के लिए Blackwell NVL72 का उपयोग कर रहे हैं, जबकि CoreWeave, Perplexity, और Fireworks AI प्लेटफॉर्म पर विभिन्न मॉडल तैनात कर रहे हैं। अगली पीढ़ी का Vera Rubin प्लेटफॉर्म ऊर्जा दक्षता को और बढ़ाने के लिए इसी नींव पर बनाया गया है।
स्रोत: NVIDIA blog — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार