إدارة مستويات التفكير في نماذج اللغة الكبيرة
يشرح سيباستيان راشكا كيفية عمل أوضاع التفكير ذات التعقيد المتفاوت (منخفض، متوسط، عالٍ) في نماذج اللغة الكبيرة. ويناقش أساليب التعلم التعزيزي مع المكافآت القابلة للتحقق، بالإضافة إلى آليات التبديل بين الأوضاع، بما في ذلك الأساليب المستخدمة في نماذج مثل DeepSeek-R1 وQwen3 وGPT-5.6.
OpenAI
DeepSeek
Moonshot AI

