텐센트 Hunyuan Hy ASR 3.0 프리뷰 출시: 문맥을 이해하는 음성 인식
Tencent
텐센트가 문맥을 이해할 수 있는 음성 인식 모델인 Hunyuan Hy ASR 3.0의 프리뷰 버전을 출시했습니다. 이 모델은 중국어와 영어를 모두 처리할 수 있으며, 자동 구두점, 화자 분리, 사용자 정의 어휘 등의 기능을 지원합니다. 또한 온프레미스 배포 옵션을 제공하고 긴 오디오 세그먼트를 지원합니다.
Tencent(텐센트)가 음성 인식 모델 Hunyuan Hy ASR 3.0의 프리뷰 버전을 공개했다. 이 신모델은 맥락을 이해하도록 설계되어 주변 단어와 문구를 함께 고려함으로써 인식 정확도를 높였다. 중국어와 영어를 모두 지원하며, 문장 부호를 자동으로 추가하고 서로 다른 화자를 식별할 수 있다. 또한 사용자가 특정 도메인에 맞춰 어휘를 맞춤 설정할 수도 있다. 이 모델은 데이터 프라이버시 강화를 위해 온프레미스(on-premise, 사내 서버 구축형) 방식으로 배포할 수 있으며, 최대 1시간 길이의 오디오 구간을 지원한다. Tencent는 정확도를 유지하기 위해 1~3개월마다 모델 업데이트도 제공한다.
출처: Tencent Hunyuan (GNews) —
원문
