Tencent Yuanbao, 다양한 방언과 복잡한 환경을 이해하는 Hy ASR 3.0 프리뷰 음성 인식 모델 공개
Tencent
Tencent Yuanbao가 다양한 방언을 인식하고 복잡한 음향 환경에서도 안정적으로 작동하는 Hy ASR 3.0 프리뷰 음성 인식 모델을 출시했습니다. 이 모델은 대규모 오디오 파울데이션 모델과 다층 스트리밍 아키텍처를 기반으로 하여 높은 정확도와 낮은 지연 시간을 달성했습니다.
Tencent의 AI 어시스턴트인 Tencent Yuanbao가 음성 인식 모델 'Hy ASR(Automatic Speech Recognition, 자동 음성 인식) 3.0' 프리뷰 버전을 선보였습니다. 이 모델은 다양한 중국어 방언은 물론, 소음이 많은 환경처럼 까다로운 음향 조건에서도 음성을 정확하게 텍스트로 변환할 수 있도록 설계되었습니다. 대규모 오디오 파욘데이션 모델에 다층 스트리밍 아키텍처를 결합해 높은 인식 정확도와 낮은 지연 시간을 구현한 것이 특징입니다. 이번 프리뷰 공개는 음성 처리 분야에서 AI 역량을 꾸준히 강화해 온 Tencent의 노력을 보여줍니다.
출처: Tencent Hunyuan (GNews) —
원문
