إصدار Qwen3.8 Max يتفوق على Claude Fable 5 في مؤشر الوكيل بسعر 6 دولارات لكل مليون رمز
Alibaba/Qwen
Anthropic
أصدرت Alibaba النسخة النهائية من Qwen3.8 Max، وهو نموذج متعدد الوسائط يضم 2.4 تريليون معلمة مع سياق مليون رمز. تُظهر الاختبارات المستقلة أنه يتفوق على Claude Fable 5 في مؤشر الوكيل، كما أن تسعير واجهة برمجة التطبيقات الخاصة به أقل بشكل ملحوظ من المنافسين. ومع ذلك، لا تزال الأوزان المفتوحة معلقة.
أعلنت شركة علي بابا رسميًا عن إصدار نموذج Qwen3.8 Max، وهو نموذج مختلط الخبراء متعدد الوسائط أصلي بمعاملات تبلغ 2.4 تريليون. يدعم إدخال النصوص والصور والفيديو، ويخرج النصوص، مع نافذة سياق تصل إلى مليون رمز (983,000 رمز إدخال و131,000 رمز إخراج في وضع التفكير). يتميز النموذج بتفكير هجين مفعل افتراضيًا، واستدعاء الدوال، وأدوات مدمجة، ويُروَّج له للبرمجة وسير العمل الوكيل الاحترافي. أظهرت الاختبارات المستقلة التي أجرتها شركة Artificial Analysis أن Qwen3.8 Max يسجل 58.1 في مؤشر الذكاء (مقابل 62.1 لـ Claude Fable 5) و58.4 في المؤشر الوكيل (مقابل 56.6 لـ Claude Fable 5)، مع تفوق وضعين فقط من أوضاع Claude Opus 5. تم تحديد السعر عند 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، مع قراءات مخزنة مؤقتًا بسعر 0.25 دولار لكل مليون رمز - أي أرخص بحوالي خمس مرات من Claude Fable 5 على الإدخال و8.3 مرات على الإخراج. ومع ذلك، فإن النموذج مطول: فقد ولّد حوالي 150 مليون رمز في تشغيل كامل لمؤشر الذكاء، أي حوالي 2.3 مرة من الوسيط (66 مليون) للنماذج المماثلة. تبلغ السرعة حوالي 82 رمز إخراج في الثانية، مع زمن استجابة للرمز الأول حوالي 2.8 ثانية. اعتبارًا من صباح 10 أغسطس، لم تُنشر الأوزان المفتوحة لـ Qwen3.8 Max وQwen3.8-27B بعد، على الرغم من أن علي بابا وعدت بظهورها في الأسبوع الموافق 3 أغسطس. يتطلب النموذج الكبير حوالي 4.8 تيرابايت بصيغة BF16 أو 1.2 تيرابايت بدقة 4 بت، مما يجعل النشر المحلي غير عملي لمعظم المستخدمين. تشير المقالة إلى أن Qwen3.8 Max مناسب للبرمجة الوكيلة، وتحليل المستندات الطويلة، والعمليات متعددة الخطوات، وكخيار احتياطي لـ Claude، ولكنها توصي باختباره على المهام الخاصة قبل التحول إليه.
المصدر: Habr — хаб ИИ —
الأصلي
