एनवीडिया ने तेज़, विशेष एजेंटिक कार्यों के लिए नेमोट्रॉन 3.5 लाइटनिंग पेश किया
NVIDIA
एनवीडिया ने अपने नेमोट्रॉन 3 मॉडल परिवार का विस्तार करते हुए नेमोट्रॉन 3.5 लाइटनिंग पेश किया है, जो एक ओपन 30 बिलियन पैरामीटर मिक्सचर-ऑफ-एक्सपर्ट्स मॉडल है, जिसे हमेशा-चालू एजेंटों के लिए डिज़ाइन किया गया है। यह अपनी श्रेणी के ओपन मॉडलों की तुलना में 4 गुना तेज़ टोकन उत्पादन और 30 प्रतिशत तेज़ पूर्णता समय प्रदान करता है। मॉडल को व्यक्तिगत कार्यों के लिए फाइन-ट्यून किया जा सकता है और विभिन्न एनवीडिया प्लेटफार्मों पर स्थानीय रूप से चलाया जा सकता है। एनवीडिया ने नेमो स्विचयार्ड नामक एक ओपन-सोर्स रूटिंग लाइब्रेरी भी पेश की है, जो सटीकता, गति और लागत के लिए एजेंट वर्कफ़्लो को अनुकूलित करती है, और रिपोर्ट के अनुसार बेंचमार्क पूरा करने की लागत को अकेले ओपस 4.8 की तुलना में लगभग एक-तिहाई तक कम कर देती है।
NVIDIA ने Nemotron 3.5 Lightning की घोषणा की है, जो हमेशा-ऑन एजेंटों के लिए एक अनुकूलन योग्य ओपन 30B मिश्रण-ऑफ-एक्सपर्ट्स (MoE) मॉडल है, जो अपने Nemotron 3 परिवार का विस्तार करता है। यह मॉडल अपनी श्रेणी के ओपन मॉडलों की तुलना में 4 गुना तेज टोकन जनरेशन और 30% तेज पूर्णता समय प्रदान करता है। चूंकि इसके वेट्स खुले हैं, डेवलपर्स इसे विशिष्ट शैलियों, विशेषज्ञताओं या कोडिंग परंपराओं के लिए फाइन-ट्यून कर सकते हैं, जिससे व्यक्तिगत स्थानीय एजेंटिक AI अनुभव जैसे ईमेल प्रबंधन, स्मार्ट-होम रूटीन या कोडिंग साथी सक्षम होते हैं। NVIDIA ने अनुकूलित स्थानीय परिनियोजन विकल्प प्रदान करने के लिए vLLM, Ollama, llama.cpp, LM Studio और Unsloth के साथ सहयोग किया है, जिसमें NVFP4 और GGUF प्रारूप शामिल हैं। यह मॉडल NVIDIA RTX PC, DGX Spark से लेकर Jetson तक के उपकरणों पर स्थानीय रूप से चलता है, और Acer, ASUS, Dell और Lenovo जैसे साझेदारों के Blackwell सिस्टम के साथ वर्कस्टेशन और डेटा सेंटरों तक स्केल करता है। इसके अतिरिक्त, NVIDIA ने NeMo Switchyard पेश किया है, एक ओपन-सोर्स रूटिंग लाइब्रेरी जो एजेंट कार्यप्रवाह के प्रत्येक चरण को सटीकता, गति और लागत के आधार पर सबसे उपयुक्त मॉडल की ओर निर्देशित करती है, जिससे उद्यमों को टोकन लागत प्रबंधित करने में मदद मिलती है। आंतरिक बेंचमार्क से पता चलता है कि NeMo Switchyard ने बेंचमार्क पूरा करने की लागत को Opus 4.8 के लगभग एक-तिहाई तक कम कर दिया, जबकि फ्रंटियर-स्तरीय कार्य पूर्णता बनाए रखी। NeMo Switchyard GitHub पर उपलब्ध है।
स्रोत: NVIDIA blog —
मूल
