نموذج الفيديو الجديد من ByteDance، Seedance 2.5، ينتج مقاطع مدتها 30 ثانية مع صوت مدمج
ByteDance
أصدرت شركة ByteDance نموذج Seedance 2.5، وهو نموذج فيديو بالذكاء الاصطناعي مطور ينتج الفيديو والصوت في مسار واحد، مما ينتج مقاطع يصل طولها إلى 30 ثانية. يمكن للمستخدمين تحميل عدة صور مرجعية ومقاطع فيديو وملفات صوتية لصياغة مشاهد تحتوي على شخصيات متعددة وزوايا كاميرا مختلفة. النموذج متاح على Jimeng AI وDoubao Pro، مع تخطيط لتوفير الوصول عبر واجهة برمجة التطبيقات من خلال BytePlus ModelArk.
أطلقت ByteDance نسخة جديدة من نموذجها للفيديو بالذكاء الاصطناعي، Seedance 2.5، الذي يولّد الفيديو والصوت في مسار واحد، منتجًا مقاطع يصل طولها إلى 30 ثانية يمكن تمديدها عدة مرات. ويتفوق هذا على المنافسين مثل Google's Gemini Omni Flash، الذي يدير حاليًا حوالي 10 ثوانٍ فقط في المرة الواحدة. يمكن للمستخدمين رفع حتى 30 صورة، و10 مقاطع فيديو، و10 ملفات صوتية كمواد مرجعية لتصميم مشاهد بشخصيات وزوايا كاميرا متعددة. يتميز النموذج بتحسين في القوام والإضاءة وتفاصيل البشرة. سابقه، Seedance 2.0، يتصدر قائمة أفضل النماذج لتحويل الصور إلى فيديو مع الصوت، وفقًا لـ “Artificial Analysis”. أظهرت ByteDance قدرات النموذج في فيلم قصير أنتج بالكامل باستخدام Seedance 2.5، مما يبرز سير عمل إنتاجيًا سلسًا للإعلانات والمحتوى البصري. يتوفر Seedance 2.5 على “Jimeng AI” و“Doubao Pro”، مع وصول عبر واجهة برمجة التطبيقات من خلال “BytePlus ModelArk” قريبًا. في السابق، أظهر المخرج نيل بلومكامب، مخرج فيلم “District 9”، ما يمكن أن تفعله النسخة السابقة من خلال فيلمه القصير الذي أنتجه بالكامل بالذكاء الاصطناعي “Nightborne”، والذي تبلغ مدته 13 دقيقة.
المصدر: The Decoder (DE) —
الأصلي
