Multiverse Computing's AI Model Compression Boosts Performance on Standard Hardware

Multiverse ComputingMultiverse Computing
Multiverse Computing has introduced a technology for compressing AI models that significantly improves performance on standard hardware. The solution enables large language models (LLMs) to run on ordinary GPUs at high speed, potentially reducing infrastructure costs and making AI more accessible.
क्वांटम कंप्यूटिंग में विशेषज्ञता रखने वाली कंपनी मल्टीवर्स कंप्यूटिंग ने AI मॉडल्स को कंप्रेस करने की एक विधि विकसित करने की घोषणा की है, जो मानक उपकरणों पर काम को काफी तेज कर सकती है। यह तकनीक बड़े भाषा मॉडल्स (एलएलएम) को बिना महत्वपूर्ण सटीकता खोए संपीड़ित करती है, जिससे उन्हें सामान्य ग्राफिक्स प्रोसेसिंग यूनिट्स (जीपीयू) पर विशेष चिप्स के उपयोग के बराबर प्रदर्शन के साथ चलाया जा सकता है। कंपनी के अनुसार, इससे कम्प्यूटेशनल लागत और ऊर्जा खपत में कमी आती है, जिससे उन्नत AI मॉडल छोटे और मध्यम व्यवसायों के लिए अधिक सुलभ हो जाते हैं। अभी तक उन विशिष्ट मॉडलों के विवरण का खुलासा नहीं किया गया है जिन पर परीक्षण किया गया, लेकिन दावा किया गया है कि यह विधि विभिन्न आर्किटेक्चर पर लागू होती है।
स्रोत: Meta AI (GNews) — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार