Vivix Merilis A1: Model Real-Time Pertama untuk Komunikasi Karakter Virtual Interaktif
Vivix
Vivix telah meluncurkan A1, model interaktif multimodal real-time pertama yang memungkinkan pengguna melakukan percakapan seperti video dengan karakter virtual. Model ini memiliki hampir 30 miliar parameter yang diaktifkan, mencapai lebih dari 10.000 token video per detik pada satu GPU, dan berjalan di GPU kelas konsumen melalui inovasi seperti distilasi MJD dan infrastruktur inferensi VMI. Selain itu, Vivix memperkenalkan W1, yang memungkinkan pengguna untuk campur tangan dan mengubah alur cerita secara real-time.
Vivix merilis A1, model multimodal interaktif real-time yang memungkinkan pengguna berkomunikasi dengan karakter virtual melalui video langsung. Berbeda dengan manusia digital tradisional, karakter A1 memiliki tubuh fisik yang dapat bergerak, mengubah postur, dan berinteraksi dengan lingkungannya. Model ini menggunakan arsitektur streaming terpadu yang mengintegrasikan referensi multimodal, interaksi real-time, dan generasi streaming. Model ini memiliki hampir 30 miliar parameter aktif dan mencapai lebih dari 10.000 token video per detik pada satu GPU konsumen, berkat teknologi seperti Multidimensional Joint Distillation (MJD) dan Vivix Model Infra (VMI). VMI memisahkan encoder dan decoder, menggunakan desain bersama pelatihan-inferensi NVFP4 asli, dan menerapkan mesin penjadwalan bersama komputasi-komunikasi-memori untuk meminimalkan latensi. Sistem merespons masukan baru dalam waktu 300 milidetik, dengan penundaan rata-rata 0,6 detik. Vivix juga memperkenalkan W1, yang memungkinkan pengguna mengintervensi dan mengubah pilihan karakter serta alur cerita secara real-time.
Sumber: QbitAI 量子位 —
asli
