模型硬件与推理 🇺🇸 12.08.2026 00:03

LTX-2.5 发布:面向本地视频制作的NVIDIA加速开放权重世界模型

LTXLTX NVIDIANVIDIA Google/DeepMindGoogle/DeepMind xAIxAI
LTX 发布了 LTX-2.5,这是一个用于视频生成的开放权重世界模型,针对在 NVIDIA RTX GPU 和 DGX Spark 上的本地推理进行了优化。该模型能够在单台桌面设备上实现快速、一致的多镜头视频生成,其本地处理速度显著快于闭源替代方案。此次发布与 NVIDIA 的本地 AI 系列相呼应,该系列还推出了 Nemotron 3.5 Lightning 智能体模型。
LTX发布了LTX-2.5,这是一款开权重世界模型,用于视频生成、实时应用和物理人工智能,并针对在NVIDIA RTX GPU和DGX Spark上本地运行进行了优化,降低了显存需求。它支持原生多镜头生成以保持角色一致性,新解码器减少了伪影,并采用Gemma 4语言主干。基准测试显示,在2块NVIDIA GB200上生成10秒片段仅需6.8秒,而最快的闭源替代方案需要52至70秒,较慢的方案则需长达398秒。NVIDIA的本地AI系列还包括Nemotron 3.5 Lightning,这是一款开源的300亿参数混合专家模型,以及NeMo Switchyard库。LTX-2.5以开放权重形式在Hugging Face上提供,原生支持ComfyUI,并通过LTX API提供,年经常性收入低于1000万美元的组织可免费使用。该模型家族下载量已超过3300万次,应用案例包括Asteria等电影工作室、Reactor等实时平台,以及Markov Robotics的机器人技术。
来源: MarkTechPost — 原文
我们之前关于此话题的帖子 ↓
最新新闻