Vivix lança A1: primeiro modelo em tempo real para comunicação interativa com personagens virtuais
Vivix
A Vivix apresentou o A1, o primeiro modelo multimodal interativo em tempo real que permite aos usuários conversar como em videoconferência com personagens virtuais. O modelo conta com quase 30 bilhões de parâmetros ativados, atinge mais de 10.000 tokens de vídeo por segundo em uma única GPU e funciona em GPUs de consumo graças a inovações como a destilação MJD e a infraestrutura de inferência VMI. Além disso, a Vivix introduziu o W1, que permite que os usuários intervenham e alterem enredos em tempo real.
A Vivix lançou o A1, um modelo multimodal interativo em tempo real que permite aos usuários se comunicarem com personagens virtuais por meio de vídeo ao vivo. Diferentemente dos humanos digitais tradicionais, os personagens A1 possuem corpos físicos que podem se mover, mudar de postura e interagir com o ambiente. O modelo utiliza uma arquitetura de streaming unificada que integra referências multimodais, interação em tempo real e geração em streaming. Ele conta com quase 30 bilhões de parâmetros ativados e alcança mais de 10 mil tokens de vídeo por segundo em uma única GPU de consumo, graças a tecnologias como a Destilação Conjunta Multidimensional (MJD, na sigla em inglês) e a Infraestrutura de Modelo Vivix (VMI, na sigla em inglês). A VMI desacopla o codificador e o decodificador, utiliza o co-design nativo de treinamento e inferência NVFP4 e emprega um mecanismo de co-escalonamento computação-comunicação-memória para minimizar a latência. O sistema responde a novas entradas em apenas 300 milissegundos, com um atraso médio de 0,6 segundos. A Vivix também apresentou o W1, que permite aos usuários intervir e alterar escolhas de personagens e enredos em tempo real.
Fonte: QbitAI 量子位 —
original
