علي بابا تطلق Qwen3.8-Max: نموذج خليط الخبراء بمعاملات تبلغ 2.4 تريليون والأكثر قدرة في عائلة Qwen
Alibaba/Qwen
OpenAI
Anthropic
أصبح نموذج Qwen3.8-Max من فريق Qwen في علي بابا متاحًا على نطاق واسع، مع وعد بفتح الأوزان الأسبوع المقبل. يدعم النموذج، الذي يحتوي على 2.4 تريليون معامل ويستخدم تقنية خليط الخبراء، إدخال النصوص والصور والفيديو، ويتفوق على سلفه في المهام متعددة الوسائط والوكيلة.
أصدر فريق Qwen التابع لشركة Alibaba نموذج Qwen3.8-Max للاستخدام العام، وأكد أن أوزانه مفتوحة المصدر ستصدر الأسبوع المقبل، إلى جانب نقطة تفتيش ثانية هي Qwen3.8-27B. يعد Qwen3.8-Max نموذجًا مختلطًا من الخبراء بمعاملات تبلغ 2.4 تريليون، ويقبل إدخال النصوص والصور والفيديو ويعيد النصوص. واجهة برمجة التطبيقات المستضافة قابلة للنشر لشركات من أي حجم، ومتوافقة مع OpenAI وDashScope، بينما تمثل الأوزان المفتوحة المصدر بنية تحتية لمراكز بيانات متعددة العقد. لم تكشف Alibaba عن عدد المعاملات النشطة، مما يجعل تكلفة التشغيل غير معروفة. Qwen3.8-27B هو نقطة التفتيش التي تناسب أجهزة GPU التقليدية في المؤسسات. مجموعة الميزات المنشورة تغطي أربعة قطاعات: هندسة البرمجيات، مراجعة المستندات القانونية والمالية، عمليات الإعلام والتجارة الإلكترونية، والتصميم. تسرد صفحة النموذج نافذة سياق تبلغ مليون رمز (توكن)، مع حد أقصى للإدخال يبلغ 991 ألف رمز (983 ألف مع تمكين التفكير)، وحد أقصى للإخراج يبلغ 131 ألف رمز. السعر هو 2.00 دولار لكل مليون رمز إدخال و6.00 دولارات لكل مليون رمز إخراج، مع تكلفة إدخال مخبأ تبلغ 0.25 دولار لكل مليون رمز. تشمل القدرات المدعومة استدعاء الدوال، والمخرجات المنظمة، والدفعات، وإكمال البادئة، والضبط الدقيق، بالإضافة إلى خمس أدوات مدمجة في واجهة Responses API. في المعايير، يسجل Qwen3.8-Max نتيجة 86.6 على Terminal-Bench 2.1، متخلفًا عن GPT-5.6 Sol (الأقصى) الذي يسجل 88.8، ولكنه يتقدم على Claude Opus 4.8 وClaude Fable 5 اللذين يسجلان 84.6. يتصدر في PaperBench وIFBench، ويظهر تحسنًا في المهام متعددة الوسائط والوكيلة مقارنة بسلفه، على الرغم من أن المعايير متعددة الوسائط تقارنه بـ Qwen3.7-Plus وليس Qwen3.7-Max. يبلغ منحنى توسيع نطاق التعلم المعزز للنموذج ذروته عند 0.725 قرب 4000 بيئة تدريب، ثم ينخفض.
المصدر: MarkTechPost —
الأصلي
