Vivix lanza A1: el primer modelo en tiempo real para comunicación interactiva con personajes virtuales
Vivix
Vivix ha presentado A1, el primer modelo interactivo multimodal en tiempo real que permite a los usuarios mantener conversaciones similares a videollamadas con personajes virtuales. El modelo cuenta con casi 30 mil millones de parámetros activados, alcanza más de 10 000 tokens de video por segundo en una sola GPU y funciona en GPUs de consumo gracias a innovaciones como la destilación MJD y la infraestructura de inferencia VMI. Además, Vivix introdujo W1, que permite a los usuarios intervenir y cambiar las tramas en tiempo real.
Vivix presentó A1, un modelo multimodal interactivo en tiempo real que permite a los usuarios comunicarse con personajes virtuales a través de video en vivo. A diferencia de los humanos digitales tradicionales, los personajes A1 poseen cuerpos físicos que pueden moverse, cambiar de postura e interactuar con su entorno. El modelo utiliza una arquitectura de streaming unificada que integra referencias multimodales, interacción en tiempo real y generación en streaming. Cuenta con casi 30 mil millones de parámetros activados y alcanza más de 10,000 tokens de video por segundo en una sola GPU de consumo, gracias a tecnologías como la Destilación Conjunta Multidimensional (Multidimensional Joint Distillation, MJD) y la Infraestructura de Modelo Vivix (Vivix Model Infra, VMI). VMI desacopla el codificador y el decodificador, utiliza un diseño conjunto de entrenamiento e inferencia nativo con NVFP4, y emplea un motor de co-programación entre cómputo, comunicación y memoria para minimizar la latencia. El sistema responde a nuevas entradas en tan solo 300 milisegundos, con un retardo promedio de 0,6 segundos. Vivix también presentó W1, que permite a los usuarios intervenir y alterar las decisiones de los personajes y las tramas en tiempo real.
Fuente: QbitAI 量子位 —
original
