Tencent Hunyuan Hy ASR 3.0 bản xem trước ra mắt: Nhận dạng giọng nói hiểu ngữ cảnh
Tencent
Tencent đã phát hành bản xem trước của mô hình nhận dạng giọng nói Hunyuan Hy ASR 3.0, có khả năng hiểu ngữ cảnh. Mô hình này xử lý được cả tiếng Trung và tiếng Anh, đồng thời hỗ trợ các tính năng như tự động chấm câu, tách speaker và từ vựng tùy chỉnh. Nó cũng cung cấp các tùy chọn triển khai tại chỗ và hỗ trợ các đoạn âm thanh dài.
Tencent đã phát hành bản xem trước của mô hình nhận dạng giọng nói Hunyuan Hy ASR 3.0. Mô hình mới này được thiết kế để hiểu ngữ cảnh, giúp cải thiện độ chính xác nhận dạng bằng cách xem xét các từ và cụm từ xung quanh. Mô hình hỗ trợ cả tiếng Trung và tiếng Anh, có thể tự động thêm dấu câu và phân biệt các người nói khác nhau. Ngoài ra, người dùng còn có thể tùy chỉnh từ vựng cho các lĩnh vực chuyên biệt. Mô hình có thể được triển khai tại chỗ (on-premise) nhằm tăng cường quyền riêng tư dữ liệu, và hỗ trợ các đoạn âm thanh dài tới một giờ. Tencent cũng cung cấp các bản cập nhật cho mô hình mỗi một đến ba tháng để đảm bảo độ chính xác.
Nguồn: Tencent Hunyuan (GNews) —
bản gốc
