Alibaba Cloud

أحدث أخبار ونماذج وإصدارات الذكاء الاصطناعي من Alibaba Cloud. ['CMS 2.0', 'GLM-4.7-Flash', 'Qwen 122B', 'Qwen2.5-0.5B', 'Qwen2.5-14B', 'Qwen2.5-1.5B', 'Qwen2.5-32B', 'qwen2.5:3b', 'Qwen2.5-3B', 'Qwen2.5-72B', 'qwen2.5:7b', 'Qwen2.5-7B', 'Qwen2.5-Coder', 'Qwen2.5-Max', 'Qwen2.5-VL-3B', 'Qwen2-Math', 'Qwen 3', 'Qwen3', 'Qwen3 0.6B', 'Qwen3-0.6B', 'Qwen-3 14B', 'Qwen3-14B', 'Qwen3-235B-A22B-FP8', 'Qwen3-235B-A22B-Thinking-2507', 'Qwen3 235B-Instruct', 'Qwen3-30B-A3B', 'qwen3-32b', 'Qwen3-32B', 'Qwen3-4B', 'Qwen3.5', 'Qwen3.5-122B-A17B', 'Qwen3.5-27B', 'Qwen3.5-35B-A3B', 'Qwen3.5-397B-A17B', 'qwen 3.5 4B', 'Qwen3.5-4B', 'Qwen3.5-9B', 'Qwen3.5-Flash-02-23', 'Qwen3.5-Plus-02-15', 'Qwen3.6']

الأبحاث 🇺🇸

إدارة مستويات التفكير في نماذج اللغة الكبيرة

يشرح سيباستيان راشكا كيفية عمل أوضاع التفكير ذات التعقيد المتفاوت (منخفض، متوسط، عالٍ) في نماذج اللغة الكبيرة. ويناقش أساليب التعلم التعزيزي مع المكافآت القابلة للتحقق، بالإضافة إلى آليات التبديل بين الأوضاع، بما في ذلك الأساليب المستخدمة في نماذج مثل DeepSeek-R1 وQwen3 وGPT-5.6.

OpenAIOpenAI DeepSeekDeepSeek Moonshot AIMoonshot AI
Sebastian Raschka27.07 · 20:04
النماذج 🇨🇳

Qwen3-Coder: نموذج علي بابا الأكثر وكالة للبرمجة

أصدرت Alibaba Qwen نموذج Qwen3-Coder الرائد للبرمجة، بإجمالي 480 مليار معامل و35 مليار معامل نشط، محققًا نتائج متطورة بين النماذج المفتوحة في مهام البرمجة الوكيلة واستخدام المتصفح والأدوات. يدعم النموذج سياقًا يصل إلى 256 ألف رمز (حتى مليون مع الاستيفاء)، وتُدرّب على 7.5 تريليون رمز منها 70% أكواد برمجية، مع استخدام التعلم المعزز واسع النطاق، بما في ذلك التعلم المعزز طويل الأفق للتفاعل متعدد الخطوات في البيئات. إلى جانب النموذج، تم فتح مصدر أداة Qwen Code المستندة إلى Gemini Code.

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen27.07 · 18:03
أخبار جديدة