एलएलएम रिसर्च पेपर्स: 2025 की दूसरी छमाही की सूची
सेबेस्टियन राश्का जुलाई से दिसंबर 2025 तक के बड़े भाषा मॉडलों पर दिलचस्प शोध पत्रों का एक चयन प्रस्तुत करते हैं। सामग्री में रीज़निंग मॉडल, प्रशिक्षण विधियाँ, आर्किटेक्चर, मल्टीमॉडल मॉडल और अधिक जैसी श्रेणियाँ शामिल हैं। यह सूची त्वरित संदर्भ और आगे के अध्ययन के लिए है।
जून 2025 में, सेबेस्टियन राश्का ने भुगतान करने वाले ग्राहकों के लिए एक बोनस लेख प्रकाशित किया जिसमें शोध पत्रों का चयन शामिल था। अब, सभी समर्थकों को धन्यवाद के रूप में, उन्होंने जुलाई-दिसंबर 2025 के लिए एक समान सूची तैयार की है, जिसे श्रेणियों में व्यवस्थित किया गया है: तर्क मॉडल (प्रशिक्षण, अनुमान-समय रणनीतियाँ, मूल्यांकन और समझ), अन्य सुदृढीकरण सीखने के तरीके, अनुमान-समय स्केलिंग, मॉडल रिलीज़ और तकनीकी रिपोर्ट, आर्किटेक्चर, कुशल प्रशिक्षण, डिफ्यूज़न भाषा मॉडल, मल्टीमॉडल और विज़न-भाषा मॉडल, और डेटा और प्रीट्रेनिंग सेट। लेखक ने स्वयं संक्षेप में सार पढ़े और केवल एक छोटा सा हिस्सा पढ़ा, लेकिन उन्हें परियोजनाओं पर काम करते समय ऐसी सूचियों को फिर से देखना उपयोगी लगता है। यह ध्यान दिया गया है कि संग्रह मूल रूप से वार्षिक समीक्षा "स्टेट ऑफ़ एलएलएम 2025: प्रगति, चुनौतियाँ और भविष्यवाणियाँ" के हिस्से के रूप में था, लेकिन लेख बहुत लंबा हो गया, इसलिए राश्का ने सूची को अलग से प्रकाशित करने का निर्णय लिया।
स्रोत: Sebastian Raschka —
मूल
