النماذجتوليد الوسائط 🇨🇳 27.07.2026 17:05

Qwen-Image: نموذج لتوليد الصور مع عرض دقيق للنص

Alibaba/QwenAlibaba/Qwen
أصدرت Alibaba نموذج Qwen-Image، وهو نموذج أساسي لتوليد الصور يضم 20 مليار معامل. يتفوق على المنافسين في عرض النص المعقد، بما في ذلك التسميات التوضيحية متعددة الأسطر والأحرف الصينية، ويدعم تحرير الصور بدقة.
أعلنت شركة علي بابا (عبر وحدة Qwen) عن إطلاق Qwen-Image، وهو نموذج أساسي لتوليد الصور يعتمد على بنية MMDiT ويحتوي على 20 مليار معلمة. تشمل القدرات الرئيسية عرضًا فائقًا للنصوص (دعم التخطيطات متعددة الأسطر والفقرات واللغات الأبجدية واللوغوغرافية)، وتحريرًا متسقًا للصور مع الحفاظ على الدلالات والواقعية، وأداءً قويًا في الاختبارات المرجعية العامة (GenEval و DPG و OneIG-Bench و GEdit و ImgEdit و GSO و LongText-Bench و ChineseWord و TextCraft)، حيث يتفوق النموذج على النماذج المنافسة الحالية. تظهر العروض التوضيحية أمثلة على إعادة إنتاج دقيقة للأحرف الصينية على اللافتات واللفائف والكتب والملصقات، بالإضافة إلى النصوص الإنجليزية (بما في ذلك المقاطع الطويلة في مساحات صغيرة). يدعم النموذج إنشاء الملصقات والعروض التقديمية، والعمل بأنماط فنية مختلفة، وعمليات التحرير (التنميق، إضافة/إزالة الكائنات، تغيير النص والوضعيات).
المصدر: Alibaba Qwen — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة