النماذجمفتوح المصدر 🇩🇪 03.08.2026 17:02

MiniMax H3 يصبح أول نموذج فيديو مفتوح يتصدر ترتيب تحرير الفيديو

MiniMaxMiniMax ByteDanceByteDance
أصدرت MiniMax أوزان نموذج الفيديو الخاص بها H3، مما يجعله أول نموذج مفتوح يصل إلى قمة ترتيب الفيديو. وفقًا لـ Artificial Analysis، يحتل H3 المرتبة الأولى في تحرير الفيديو، والمرتبة الثانية في تحويل النص إلى فيديو، والمرتبة الثالثة في تحويل الصورة إلى فيديو. يعالج النموذج الذي يبلغ عدد معلماته 33 مليارًا النصوص والصور ومقاطع الفيديو والصوت بشكل مشترك، ويولد مقاطع فيديو مع صوت ستيريو، لكن بعض المكونات لا تزال مغلقة.
قامت MiniMax بنشر أوزان نموذج الفيديو الخاص بها H3 بشكل علني، مما يمثل المرة الأولى التي يتصدر فيها نموذج مفتوح ترتيبًا لفيديوهات. على منصة Artificial Analysis، يحتل H3 المرتبة الأولى في تحرير الفيديو، والثانية في تحويل النص إلى فيديو، والثالثة في تحويل الصورة إلى فيديو. يعالج النموذج الذي يبلغ عدد معلماته 33 مليارًا النصوص والصور ومقاطع الفيديو والصوت بشكل مشترك، وينتج مقطعًا مدته من 4 إلى 15 ثانية مع صوت استريو، ووفقًا لبطاقة النموذج، يمكنه التعامل مع ما يصل إلى تسع صور مرجعية، وثلاثة مقاطع فيديو، وثلاثة مقاطع صوتية لكل طلب. ومع ذلك، يبقى مكونان مغلقين: وحدة دقة 2K وH3-Context-IR، الذي يحول الطلبات والمواد المرجعية إلى شكل وسيط منظم. محليًا في ComfyUI، ينتج عن هذا مخرجات بدقة 768p، ولكن يمكن تكرار معالجة السياق باستخدام أدلة التوجيه المنشورة. تسمح الأوزان المفتوحة أيضًا بالضبط الدقيق، على سبيل المثال على لقطات خاصة أو شخصيات أو مظهر متناسق، على الرغم من أن الترخيص يسمح بالاستخدام التجاري فقط للشركات التي يقل إيرادها عن 20 مليون دولار. في الوقت نفسه، أصدرت ByteDance نموذج Seedance 2.5 المغلق، الذي يقدم مقاطع مدتها 30 ثانية مع الصوت.
المصدر: The Decoder (DE) — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة