모델하드웨어 및 추론 🇺🇸 12.08.2026 00:03

LTX-2.5 출시: NVIDIA 가속 오픈 가중치 월드 모델, 로컬 비디오 제작 지원

LTXLTX NVIDIANVIDIA Google/DeepMindGoogle/DeepMind xAIxAI
LTX가 LTX-2.5를 출시했습니다. 이는 NVIDIA RTX GPU 및 DGX Spark에서 로컬 추론에 최적화된 오픈 가중치 월드 모델로, 비디오 생성을 지원합니다. 이 모델은 단일 데스크톱에서 빠르고 일관된 멀티샷 비디오 생성을 가능하게 하며, 온프레미스 속도는 폐쇄형 대안보다 훨씬 빠릅니다. 이번 출시는 NVIDIA의 로컬 AI 시리즈와 함께 이루어졌으며, 해당 시리즈에는 Nemotron 3.5 Lightning 에이전트 모델도 도입되었습니다.
LTX가 비디오 생성, 실시간 애플리케이션 및 물리 인공지능(AI)을 위한 오픈 가중치(open weights) 월드 모델인 LTX-2.5를 출시했습니다. 이 모델은 엔비디아(NVIDIA) RTX GPU와 DGX Spark에서 로컬로 실행되도록 최적화되어 VRAM 요구 사항을 줄였습니다. 캐릭터 일관성을 위한 기본 멀티샷 생성, 아티팩트를 줄이는 새로운 디코더, 그리고 Gemma 4 언어 백본을 특징으로 합니다. 벤치마크에 따르면 2개의 엔비디아 GB200에서 10초 분량의 클립이 6.8초 만에 생성되는 반면, 가장 빠른 폐쇄형 대안은 52~70초, 더 느린 대안은 최대 398초가 소요됩니다. 엔비디아의 로컬 AI 시리즈에는 오픈 30B 전문가 혼합(MoE) 모델인 Nemotron 3.5 Lightning과 NeMo Switchyard 라이브러리도 포함됩니다. LTX-2.5는 허깅페이스(Hugging Face)에서 오픈 가중치로 제공되며, ComfyUI에 기본적으로 통합되고 LTX API를 통해서도 사용할 수 있습니다. 연간 반복 매출이 1천만 달러 미만인 조직은 무료로 사용할 수 있습니다. 이 모델 제품군은 3,300만 회 이상 다운로드되었으며, Asteria와 같은 영화 스튜디오, Reactor와 같은 실시간 플랫폼, Markov Robotics와 같은 로보틱스 분야에서 활용 사례가 확인되었습니다.
출처: MarkTechPost — 원문
관련 게시물 ↓
새로운 뉴스