Vivix 发布 A1:首个用于交互式虚拟角色通信的实时模型
Vivix
Vivix 推出 A1,这是首个实时多模态交互模型,使用户能够与虚拟角色进行类似视频的对话。该模型拥有近 300 亿激活参数,在单个 GPU 上每秒处理超过 10,000 个视频令牌,并通过 MJD 蒸馏和 VMI 推理基础设施等创新在消费级 GPU 上运行。此外,Vivix 还推出了 W1,允许用户实时干预并改变故事情节。
Vivix发布了A1,这是一款实时交互式多模态模型,允许用户通过实时视频与虚拟角色进行交流。与传统数字人不同,A1中的角色拥有可移动、可改变姿态并能与环境互动的实体形象。该模型采用统一的流式架构,将多模态参考、实时交互与流式生成整合于一体。它拥有近300亿激活参数,借助多维联合蒸馏(Multidimensional Joint Distillation,简称MJD)和Vivix模型基础设施(Vivix Model Infra,简称VMI)等技术,在单张消费级GPU上每秒可生成超过1万个视频token。VMI将编码器与解码器解耦,采用原生NVFP4训练-推理协同设计,并运用计算-通信-内存协同调度引擎以最大限度降低延迟。该系统对新输入的响应时间最快可达300毫秒,平均延迟为0.6秒。Vivix还推出了W1,让用户能够实时介入并改变角色的选择与故事走向。
来源: QbitAI 量子位 —
原文
