Tencent Yuanbao publie le modèle de reconnaissance vocale Hy ASR 3.0 en aperçu : capable de comprendre divers dialectes et environnements complexes
Tencent
Tencent Yuanbao a lancé le modèle de reconnaissance vocale Hy ASR 3.0 en aperçu, capable de reconnaître divers dialectes et de fonctionner de manière robuste dans des environnements acoustiques complexes. Le modèle est basé sur un modèle de fondation audio à grande échelle avec une architecture de streaming multicouche, offrant une haute précision et une faible latence.
Tencent Yuanbao, l'assistant IA de Tencent, a introduit le modèle de reconnaissance vocale Hy ASR 3.0 en version préliminaire. Ce modèle est conçu pour transcrire avec précision la parole dans divers dialectes chinois et dans des conditions acoustiques difficiles, comme les environnements bruyants. Il s'appuie sur un modèle de fondation audio à grande échelle avec une architecture de streaming multi-couches, permettant une haute précision de reconnaissance et une faible latence. Cette version préliminaire témoigne des efforts continus de Tencent pour améliorer ses capacités d'IA dans le traitement de la parole.
Source: Tencent Hunyuan (GNews) —
original
