Hoàn thiện vòng lặp đa phương thức: Bước đi chiến lược của Tencent Hunyuan với Hy ASR 3.0
Tencent
Chiến lược mô hình lớn Hunyuan của Tencent tiến thêm một bước quan trọng với Hy ASR 3.0, một mô hình nhận dạng giọng nói giúp hoàn thiện vòng lặp đa phương thức. Mô hình này tăng cường khả năng thính giác của hệ sinh thái Hunyuan, tạo vị thế cạnh tranh trong bối cảnh trí tuệ nhân tạo hiện nay.
Tencent vừa ra mắt Hy ASR 3.0, một mô hình nhận dạng giọng nói (Automatic Speech Recognition - ASR) đóng vai trò then chốt trong chiến lược "vòng lặp toàn phương thức" (full-modality loop) cho hệ sinh thái mô hình lớn Hunyuan. Bản phát hành này nhằm lấp đầy khoảng trống về khả năng nghe trong trải nghiệm đa phương thức, giúp các tương tác bằng giọng nói trở nên tự nhiên hơn.
Hy ASR 3.0 được thiết kế để tích hợp liền mạch với các mô hình khác trong hệ Hunyuan, qua đó củng cố vị thế cạnh tranh của Tencent trước các nhà cung cấp AI khác. Mô hình này thể hiện nỗ lực có chủ đích của Tencent nhằm mở rộng phạm vi hoạt động ra ngoài văn bản và thị giác, hướng tới năng lực đa phương thức toàn diện, phù hợp với xu hướng chung của ngành là phát triển các giải pháp AI theo hướng full-stack (tích hợp toàn bộ chuỗi công nghệ).
Nguồn: Tencent Hunyuan (GNews) —
bản gốc
