ModèlesMatériel et Inférence 🇺🇸 12.08.2026 00:03

Lancement de LTX-2.5 : modèle de world model à poids ouverts accéléré par NVIDIA pour la production vidéo locale

LTXLTX NVIDIANVIDIA Google/DeepMindGoogle/DeepMind xAIxAI
LTX a publié LTX-2.5, un modèle de world model à poids ouverts pour la génération vidéo, optimisé pour l'inférence locale sur les GPU NVIDIA RTX et DGX Spark. Le modèle permet une génération vidéo multi-plans rapide et cohérente sur un seul poste de travail, avec une vitesse sur site nettement supérieure à celle des alternatives fermées. Cette sortie s'inscrit dans la série d'IA locale de NVIDIA, qui a également introduit le modèle d'agent Nemotron 3.5 Lightning.
LTX a lancé LTX-2.5, un modèle de monde ouvert pour la génération vidéo, les applications temps réel et l'IA physique, optimisé pour fonctionner localement sur les GPU NVIDIA RTX et DGX Spark, ce qui réduit les besoins en mémoire VRAM. Il propose une génération native multi-trames pour la cohérence des personnages, un nouveau décodeur réduisant les artefacts, et un backbone linguistique Gemma 4. Les benchmarks montrent qu'un clip de 10 secondes est généré en 6,8 secondes sur 2x NVIDIA GB200, contre 52 à 70 secondes pour les alternatives fermées les plus rapides et jusqu'à 398 secondes pour les plus lentes. La série d'IA locale de NVIDIA comprend également Nemotron 3.5 Lightning, un modèle ouvert de mélange d'experts de 30 milliards de paramètres, et la bibliothèque NeMo Switchyard. LTX-2.5 est disponible en poids ouverts sur Hugging Face, nativement dans ComfyUI, et via l'API LTX, gratuitement pour les organisations dont le revenu annuel récurrent est inférieur à 10 millions de dollars. La famille de modèles compte plus de 33 millions de téléchargements, avec des applications citées dans des studios de cinéma comme Asteria, des plateformes temps réel comme Reactor, et la robotique avec Markov Robotics.
Source: MarkTechPost — original
Nos articles précédents sur ce sujet ↓
Infos fraîches