मॉडलओपन सोर्स 🇫🇷 01.08.2026 06:01

पुर्तगाल ने €7M में ओपन एलएलएम अमालिया पेश किया, जबकि फ्रांस अभी भी एआई संप्रभुता पर बहस कर रहा है

Mistral AIMistral AI MetaMeta Hugging FaceHugging Face
1 जुलाई 2026 को, पुर्तगाल ने आधिकारिक रूप से अमालिया प्रस्तुत किया, जिसे यूरोपीय पुर्तगाली में विकसित पहला ओपन लार्ज लैंग्वेज मॉडल बताया गया है। रिकवरी एंड रेजिलिएंस प्लान द्वारा €7 मिलियन के सार्वजनिक निवेश से वित्तपोषित, अमालिया को मौजूदा ओपन मॉडलों को अनुकूलित करके और साझा यूरोपीय कंप्यूटिंग इंफ्रास्ट्रक्चर का उपयोग करके बनाया गया था। यह फ्रांस के विपरीत है, जो मिस्ट्रल एआई में वैश्विक चैंपियन और एक सार्वजनिक सुपरकंप्यूटर होने के बावजूद, राष्ट्रीय सार्वजनिक भाषा मॉडल प्रदान नहीं कर सका है।
1 जुलाई 2026 को, पुर्तगाली सरकार ने अमालिया (Amália) प्रस्तुत किया, जिसे वह यूरोपीय पुर्तगाली में विकसित पहला खुला बड़ा भाषा मॉडल (Large Language Model - LLM) बताती है। लिस्बन की NOVA यूनिवर्सिटी के समन्वय में अन्य विश्वविद्यालयों और शोध केंद्रों के साथ बनी इस परियोजना ने साठ से अधिक शोधकर्ताओं को जुटाया और इसे रिकवरी एंड रेज़िलिएंस प्लान (Recovery and Resilience Plan - PRR) से वित्तपोषित किया गया, जिसमें 2027 तक सार्वजनिक निवेश €7 मिलियन तक पहुँचने का अनुमान है। यह मॉडल हगिंग फेस (Hugging Face) पर अपाचे 2.0 लाइसेंस के तहत उपलब्ध है। अमालिया एक एकल प्रणाली नहीं है, बल्कि मॉडलों का एक समूह है: एक 9 अरब पैरामीटर वाला टेक्स्ट मॉडल, एक विज़न मॉडल और एक वाक् पहचान घटक। टेक्स्ट मॉडल मौजूदा खुले मॉडलों, विशेष रूप से यूरोएलएलएम-9बी (EuroLLM-9B) और ग्लोरिया (GlorIA) पर आधारित है, जो यूरोएलएलएम के पूर्व-प्रशिक्षण को बढ़ाकर यूरोपीय पुर्तगाली ज्ञान में सुधार करता है और संदर्भ विंडो को 32,000 टोकन तक बढ़ाता है। यह दृष्टिकोण शुरुआत से प्रशिक्षण की तुलना में काफी कम लागत वाला था। यूरोप में इसी तरह की रणनीतियों का उपयोग किया गया है, जैसे बास्क भाषा का लैट्क्सा (Latxa), स्पेन का एलिया (ALIA), जर्मनी का ट्यूकेन-7बी (Teuken-7B), और यूरोपीय संघ की ओपनयूरोएलएलएम (OpenEuroLLM) परियोजना। इसके विपरीत, फ्रांस में मिस्ट्रल एआई (Mistral AI) है, जो एक निजी कंपनी है, और अल्बर्ट (Albert) है, जो एक राज्य अवसंरचना है जो तृतीय-पक्ष ओपन मॉडल की सेवा करती है, लेकिन ब्लूम (BLOOM) जैसे पिछले प्रयासों के बावजूद कोई सार्वजनिक रूप से प्रशिक्षित राष्ट्रीय भाषा मॉडल नहीं है। अमालिया की सीमाएँ हैं: यह एक मौजूदा आधार का अनुकूलन है और केवल 9 अरब पैरामीटर है, जो शीर्ष स्तरीय अमेरिकी या चीनी प्रणालियों से बहुत दूर है। फिर भी, यह प्रदर्शित करता है कि एक विश्वविद्यालय संघ, यूरोपीय कोष और साझा कंप्यूटिंग अवसंरचना के साथ एक भाषा के अनुकूलित संप्रभु, खुला एलएलएम प्राप्त किया जा सकता है।
स्रोत: ActuIA — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार