Tencent Yuanbao Lança Modelo de Reconhecimento de Fala Hy ASR 3.0 Preview: Entende Vários Dialetos e Ambientes Complexos
Tencent
A Tencent Yuanbao lançou o modelo de reconhecimento de fala Hy ASR 3.0 preview, capaz de reconhecer vários dialetos e ter desempenho robusto em ambientes acústicos complexos. O modelo é baseado em um modelo de fundação de áudio em larga escala com arquitetura de streaming em múltiplas camadas, alcançando alta precisão e baixa latência.
O Tencent Yuanbao, assistente de IA da Tencent, apresentou o modelo de reconhecimento de fala em pré-visualização Hy ASR 3.0. O modelo foi projetado para transcrever com precisão a fala em vários dialetos chineses e em condições acústicas desafiadoras, como ambientes ruidosos. Ele aproveita um modelo de fundação de áudio em larga escala com uma arquitetura de streaming em múltiplas camadas, permitindo alta precisão de reconhecimento e baixa latência. A versão de pré-visualização indica os esforços contínuos da Tencent para aprimorar suas capacidades de IA no processamento de fala.
Fonte: Tencent Hunyuan (GNews) —
original
