Statista: ल्लामा एआई के लगभग एक चौथाई स्रोत किताबें थीं
Meta
Statista के विश्लेषण के अनुसार, मेटा ल्लामा भाषा मॉडल के प्रशिक्षण डेटा में लगभग 25% किताबों से प्राप्त हुआ था। यह इंटरनेट स्रोतों (समाचार, सोशल मीडिया, और अन्य पाठ) के हिस्से के बराबर है।
एनालिटिक्स कंपनी स्टेटिस्टा ने मेटा की लैंग्वेज मॉडल लामा के प्रशिक्षण के लिए डेटा स्रोतों का आकलन प्रकाशित किया है। स्टेटिस्टा के अनुसार, सभी उपयोग किए गए टेक्स्ट सामग्री का लगभग एक चौथाई (लगभग 25%) किताबों से आया है। यह आंकड़ा उस डेटा की मात्रा के बराबर है जो इंटरनेट से लिया गया है, जिसमें समाचार, सोशल मीडिया और अन्य ऑनलाइन संसाधन शामिल हैं। यह आकलन मेटा द्वारा प्रकाशित प्रशिक्षण सेटों के खुले डेटा के विश्लेषण पर आधारित है। किताबों का हिस्सा आधुनिक बड़े लैंग्वेज मॉडल के लिए ज्ञान के स्रोत के रूप में मुद्रित प्रकाशनों के महत्व को रेखांकित करता है।
स्रोत: Meta AI (GNews) —
मूल
