إطلاق LTX-2.5: نموذج عالمي مفتوح الأوزان معجل من إنفيديا لإنتاج الفيديو محليًا
LTX
NVIDIA
Google/DeepMind
xAI
أصدرت LTX نموذج LTX-2.5، وهو نموذج عالمي مفتوح الأوزان لتوليد الفيديو، مُحسَّن للاستدلال المحلي على وحدات معالجة الرسوميات NVIDIA RTX وDGX Spark. يتيح النموذج توليد فيديو متعدد اللقطات بسرعة واتساق على جهاز مكتبي واحد، مع سرعة محلية تفوق بشكل ملحوظ البدائل المغلقة. يتماشى هذا الإصدار مع سلسلة الذكاء الاصطناعي المحلي من إنفيديا، والتي قدمت أيضًا نموذج العامل Nemotron 3.5 Lightning.
أطلقت LTX نموذج LTX-2.5، وهو نموذج عالمي مفتوح الأوزان لتوليد الفيديو والتطبيقات في الوقت الفعلي والذكاء الاصطناعي الفيزيائي، محسّن للعمل محليًا على وحدات معالجة الرسوميات NVIDIA RTX وDGX Spark، مما يقلل من متطلبات الذاكرة. يتميز بتوليد متعدد اللقطات أصلي لاتساق الشخصيات، ووحدة فك ترميز جديدة تقلل من التشوهات، وهيكل لغوي أساسي من نوع Gemma 4. تُظهر المعايير أنه يتم توليد مقطع فيديو مدته 10 ثوانٍ في 6.8 ثانية على وحدتي NVIDIA GB200، مقارنة بـ 52-70 ثانية لأسرع البدائل المغلقة وما يصل إلى 398 ثانية للبدائل الأبطأ. تتضمن سلسلة الذكاء الاصطناعي المحلي من NVIDIA أيضًا نموذج Nemotron 3.5 Lightning، وهو نموذج مفتوح من نوع خليط الخبراء بحجم 30 مليار معامل، ومكتبة NeMo Switchyard. يتوفر LTX-2.5 بأوزان مفتوحة على Hugging Face، وبشكل أصلي في ComfyUI، وعبر واجهة برمجة تطبيقات LTX، مجانًا للمنظمات التي يقل إيرادها السنوي المتكرر عن 10 ملايين دولار أمريكي. تتجاوز تنزيلات عائلة النماذج 33 مليونًا، مع تطبيقات مذكورة في استوديوهات أفلام مثل Asteria، ومنصات الوقت الفعلي مثل Reactor، والروبوتات مع Markov Robotics.
المصدر: MarkTechPost —
الأصلي
