Vivix lance A1 : le premier modèle en temps réel pour la communication interactive avec des personnages virtuels
Vivix
Vivix a dévoilé A1, le premier modèle interactif multimodal en temps réel qui permet aux utilisateurs d'avoir des conversations de type vidéo avec des personnages virtuels. Le modèle compte près de 30 milliards de paramètres activés, atteint plus de 10 000 tokens vidéo par seconde sur un seul GPU et fonctionne sur des GPU grand public grâce à des innovations telles que la distillation MJD et l'infrastructure d'inférence VMI. De plus, Vivix a présenté W1, qui permet aux utilisateurs d'intervenir et de modifier les scénarios en temps réel.
Vivix a dévoilé A1, un modèle multimodal interactif en temps réel qui permet aux utilisateurs de communiquer avec des personnages virtuels via une vidéo en direct. Contrairement aux humains numériques traditionnels, les personnages A1 possèdent un corps physique qui peut se déplacer, changer de posture et interagir avec leur environnement. Le modèle utilise une architecture de streaming unifiée intégrant des références multimodales, une interaction en temps réel et une génération en continu. Il compte près de 30 milliards de paramètres activés et atteint plus de 10 000 tokens vidéo par seconde sur un seul GPU grand public, grâce à des technologies telles que la distillation multidimensionnelle conjointe (Multidimensional Joint Distillation, MJD) et l'infrastructure de modèle Vivix (Vivix Model Infra, VMI). La VMI dissocie l'encodeur et le décodeur, utilise une conception conjointe entraînement-inférence native NVFP4 et emploie un moteur de co-ordonnancement calcul-communication-mémoire pour minimiser la latence. Le système répond aux nouvelles entrées en aussi peu que 300 millisecondes, avec un délai moyen de 0,6 seconde. Vivix a également présenté W1, qui permet aux utilisateurs d'intervenir et de modifier en temps réel les choix des personnages et les scénarios.
Source: QbitAI 量子位 —
original
