Tencent Yuanbao veröffentlicht Hy ASR 3.0 Vorschau-Spracherkennungsmodell: Kann verschiedene Dialekte und komplexe Umgebungen verstehen
Tencent
Tencent Yuanbao hat das Hy ASR 3.0 Vorschau-Spracherkennungsmodell veröffentlicht, das verschiedene Dialekte erkennen kann und in komplexen akustischen Umgebungen robust funktioniert. Das Modell basiert auf einem großen Audio-Foundation-Modell mit einer mehrschichtigen Streaming-Architektur, die hohe Genauigkeit und geringe Latenz erreicht.
Tencent Yuanbao, der KI-Assistent von Tencent, hat das Vorschaumodell Hy ASR 3.0 zur Spracherkennung eingeführt. Das Modell wurde entwickelt, um Sprache in verschiedenen chinesischen Dialekten und unter schwierigen akustischen Bedingungen, wie etwa in lauten Umgebungen, präzise zu transkribieren. Es nutzt ein groß angelegtes Audio-Grundlagenmodell mit einer mehrschichtigen Streaming-Architektur, die eine hohe Erkennungsgenauigkeit und geringe Latenzzeiten ermöglicht. Die Vorabversion zeigt Tencents anhaltende Bemühungen, seine KI-Fähigkeiten in der Sprachverarbeitung zu verbessern.
Quelle: Tencent Hunyuan (GNews) —
Original
