Tencent Yuanbao, Hy ASR 3.0 Önizleme Konuşma Tanıma Modelini Yayınladı: Çeşitli Lehçeleri ve Karmaşık Ortamları Anlayabiliyor
Tencent
Tencent Yuanbao, çeşitli lehçeleri tanıyabilen ve karmaşık akustik ortamlarda sağlam performans gösteren Hy ASR 3.0 önizleme konuşma tanıma modelini piyasaya sürdü. Model, yüksek doğruluk ve düşük gecikme süresi elde eden çok katmanlı akış mimarisine sahip büyük ölçekli bir ses taban modeline dayanmaktadır.
Tencent'in yapay zeka asistanı Tencent Yuanbao, Hy ASR 3.0 önizleme konuşma tanıma modelini tanıttı. Model, çeşitli Çince lehçelerindeki konuşmayı ve gürültülü ortamlar gibi zorlu akustik koşullarda doğru bir şekilde yazıya dökmek üzere tasarlandı. Çok katmanlı akış mimarisine sahip büyük ölçekli bir ses temel modelini kullanarak yüksek tanıma doğruluğu ve düşük gecikme süresi sağlıyor. Önizleme sürümü, Tencent'in konuşma işleme alanındaki yapay zeka yeteneklerini geliştirmeye yönelik devam eden çabalarını gösteriyor.
Kaynak: Tencent Hunyuan (GNews) —
orijinal
