⚡ عاجل
جوجل ديب مايند تطلق جيميني أومني: نموذج متعدد الوسائط لإنشاء وتحرير الفيديو
Google/DeepMind
DeepMind
كشفت جوجل ديب مايند عن جيميني أومني، وهو نموذج ذكاء اصطناعي متعدد الوسائط قادر على إنشاء وتحرير مقاطع الفيديو من أي مزيج من الصور والصوت والفيديو والنص. النموذج الأول في العائلة، جيميني أومني فلاش، يُطرح حالياً لمشتركي جوجل أي آي بلس، برو، وألترا عبر تطبيق جيميني و جوجل فلو، وسيكون متاحاً لمستخدمي يوتيوب شورتس مجاناً.
أعلنت جوجل ديب مايند عن نموذج "جيميني أومن"، وهو نموذج متعدد الوسائط يجمع بين قدرات التفكير المنطقي لنموذج جيميني والقدرات الإبداعية لتوليد وتحرير مقاطع الفيديو من أي وسيلة إدخال، بما في ذلك الصور والصوت والفيديو والنص. يدعم النموذج تحرير الفيديو باللغة الطبيعية، ويحافظ على ثبات الشخصيات والخصائص الفيزيائية عبر التعديلات، ويمكنه توليد مقاطع فيديو تستند إلى معرفة جيميني الواقعية بالفيزياء والتاريخ والعلوم والثقافة. يقدم ميزات مثل التحرير من خلال المحادثة، وتحويل المشاهد، وإضافة الكائنات، والتحسين عبر جولات متعددة. يتم طرح أول نموذج، وهو "جيميني أومن فلاش"، لمشتركي جوجل أي آي بلس، برو، وألترا حول العالم عبر تطبيق جيميني وجوجل فلو، وكذلك لمستخدمي يوتيوب شورتس وتطبيق يوتيوب كرايت مجانًا. تشمل جميع مقاطع الفيديو المُنشأة علامة سينث آي دي المائية الرقمية للشفافية. ومن المخطط توفير واجهة برمجة التطبيقات (API) للمطورين والمؤسسات خلال الأسابيع القادمة.
المصدر: Google DeepMind —
الأصلي
