MiniMax

أحدث أخبار ونماذج وإصدارات الذكاء الاصطناعي من MiniMax. ['Abigail', 'Hailuo Minimax', 'M2.1', 'M2.5', 'MiniMax', 'MiniMax-M1', 'MiniMax-M2', 'MiniMax M2.1', 'MiniMax M2.5', 'MiniMax M2.7', 'MiniMax-M2.7', 'MiniMax M3', 'MiniMax-W']

الأبحاث 🇺🇸

ما وراء النماذج اللغوية الكبيرة القياسية: مزيج الانتباه الخطي، نماذج نشر النص، نماذج عالم الكود، والمحولات المتكررة الصغيرة

يستكشف المقال بدائل للنماذج اللغوية الكبيرة القياسية القائمة على المحولات ذاتية التغذية الراجعة: مزيج الانتباه الخطي (MiniMax-M1، Qwen3-Next، DeepSeek V3.2، Kimi Linear)، نماذج نشر النص، نماذج عالم الكود، والمحولات المتكررة الصغيرة. يلاحظ المؤلف عودة إلى الانتباه الكلاسيكي في MiniMax-M2 وتعقيد الانتباه الخطي في الإنتاج.

Moonshot AIMoonshot AI MiniMaxMiniMax Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek Google/DeepMindGoogle/DeepMind MistralMistral MetaMeta Hugging FaceHugging Face Allen Institute for AIAllen Institute for AI xAIxAI OpenAIOpenAI IBMIBM NVIDIANVIDIA
Sebastian Raschka27.07 · 17:04
الأبحاث 🇺🇸

مسح لأوراق بحثية حول نماذج اللغة الكبيرة للنصف الأول من عام 2026

نشر سيباستيان راشكا قائمة منسقة من الأوراق العلمية الرئيسية حول نماذج اللغة الكبيرة من يناير إلى مايو 2026. يسلط الاختيار الضوء على الاتجاهات: البنى الهجينة (تبادل طبقات الانتباه وطبقات فضاء الحالة)، والاستدلال الفعال، والأنظمة الوكيلة، ونماذج اللغة الانتشارية. يتم إيلاء اهتمام خاص لـ Nvidia's Nemotron 3 بتصميم هجين و Qwen3.6 مع Gated DeltaNet.

NVIDIANVIDIA Alibaba/QwenAlibaba/Qwen MistralMistral BaiduBaidu CohereCohere Technology Innovation InstituteTechnology Innovation Institute MiniMaxMiniMax
Sebastian Raschka27.07 · 12:03
أخبار جديدة