Peluncuran LTX-2.5: Model Dunia dengan Bobot Terbuka yang Dipercepat NVIDIA untuk Produksi Video Lokal
LTX
NVIDIA
Google/DeepMind
xAI
LTX telah merilis LTX-2.5, sebuah model dunia dengan bobot terbuka untuk pembuatan video yang dioptimalkan untuk inferensi lokal di GPU NVIDIA RTX dan DGX Spark. Model ini memungkinkan pembuatan video multisbot yang cepat dan konsisten di satu desktop, dengan kecepatan di lokasi (on-prem) yang secara signifikan lebih cepat daripada alternatif tertutup. Peluncuran ini sejalan dengan seri AI lokal NVIDIA, yang juga memperkenalkan model agen Nemotron 3.5 Lightning.
LTX meluncurkan LTX-2.5, sebuah model dunia dengan bobot terbuka untuk pembuatan video, aplikasi real-time, dan AI fisik, yang dioptimalkan untuk dijalankan secara lokal di GPU NVIDIA RTX dan DGX Spark, sehingga mengurangi kebutuhan VRAM. Model ini memiliki fitur pembuatan multishot asli untuk konsistensi karakter, decoder baru yang mengurangi artefak, dan backbone bahasa Gemma 4. Tolok ukur menunjukkan klip 10 detik dihasilkan dalam 6,8 detik pada 2x NVIDIA GB200, dibandingkan dengan 52-70 detik untuk alternatif tertutup tercepat dan hingga 398 detik untuk yang lebih lambat. Seri AI lokal NVIDIA juga mencakup Nemotron 3.5 Lightning, model campuran pakar (mixture-of-experts) terbuka berukuran 30B, dan pustaka NeMo Switchyard. LTX-2.5 tersedia sebagai bobot terbuka di Hugging Face, asli di ComfyUI, dan melalui LTX API, gratis untuk organisasi dengan pendapatan berulang tahunan di bawah 10 juta dolar AS. Keluarga model ini telah diunduh lebih dari 33 juta kali, dengan aplikasi yang disebutkan di studio film seperti Asteria, platform real-time seperti Reactor, dan robotika dengan Markov Robotics.
Sumber: MarkTechPost —
asli
