LTX-2.5-julkaisu: NVIDIA-kiihdytetty avoimilla painoilla toimiva maailmanmalli paikalliseen videontuotantoon
LTX
NVIDIA
Google/DeepMind
xAI
LTX on julkaissut LTX-2.5:n, avoimilla painoilla toimivan maailmanmallin videogenerointiin, joka on optimoitu paikalliseen inferenssiin NVIDIA RTX -näytönohjaimilla ja DGX Sparkissa. Malli mahdollistaa nopean ja johdonmukaisen monikuvaisen videogeneroinnin yhdellä työasemalla, ja sen paikallinen nopeus on huomattavasti suurempi kuin suljettujen vaihtoehtojen. Julkaisu liittyy NVIDIA:n paikallisen tekoälyn sarjaan, jossa esiteltiin myös Nemotron 3.5 Lightning -agenttimalli.
LTX julkaisi LTX-2.5:n, avoimen painoisten maailmamallin videogenerointiin, reaaliaikaisiin sovelluksiin ja fyysiseen tekoälyyn, joka on optimoitu toimimaan paikallisesti NVIDIA RTX -näytönohjaimilla ja DGX Spark -järjestelmissä, vähentäen VRAM-muistin tarvetta. Se sisältää natiivin monikuvausominaisuuden hahmokonsistenssia varten, uuden dekooderin, joka vähentää artefakteja, sekä Gemma 4 -kielimallin runkona. Suorituskykytestit osoittavat, että 10 sekunnin leike generoidaan 6,8 sekunnissa kahdella NVIDIA GB200 -näytönohjaimella, kun nopeimmat suljetut vaihtoehdot vievät 52–70 sekuntia ja hitaammat jopa 398 sekuntia. NVIDIAn paikallinen tekoälysarja sisältää myös Nemotron 3.5 Lightning -mallin, avoimen 30 miljardin parametrin sekoite-asiantuntijoista -mallin, sekä NeMo Switchyard -kirjaston. LTX-2.5 on saatavilla avoimina painoina Hugging Facessa, natiivisti ComfyUI:ssa ja LTX API:n kautta, ilmaiseksi organisaatioille, joiden vuotuinen toistuva liikevaihto on alle 10 miljoonaa dollaria. Malliperheellä on yli 33 miljoonaa latausta, ja sovelluksia on käytössä elokuvastudioissa kuten Asteria, reaaliaikaisilla alustoilla kuten Reactor ja robotiikassa Markov Roboticsin kanssa.
Lähde: MarkTechPost —
Alkuperäinen
