Análise aprofundada do modelo duplex Seeduplex da ByteDance Doubao
ByteDance
A ByteDance Doubao lançou um novo modelo, Seeduplex, que suporta modos de voz simplex e duplex. O modelo é capaz de receber entrada de voz, percepção paralela, interrupção e reconhecimento de vários idiomas, incluindo misto chinês-inglês. O Seeduplex pode imitar várias vozes e estilos, incluindo um estilo híbrido que combina tons imperativos e suaves.
A ByteDance Doubao revelou um modelo chamado Seeduplex, que é um novo modelo de voz duplex. A análise destaca suas capacidades de percepção paralela e interrupção, além de reconhecer outras vozes. O modelo suporta entrada de voz, modos simplex e duplex; ele pode reconhecer simultaneamente sons, incluindo batidas em uma mesa. O Seeduplex pode imitar voz e estilo (por exemplo, um tom de comando com finais 'enérgicos'), bem como imitar uma voz suave e adicionar um toque de sorriso. Ele pode alternar entre vozes masculinas e femininas sob solicitação e mudar o tom de acordo com as instruções. Além disso, o modelo suporta mistura de chinês e inglês, reconhece a maioria dos sotaques chineses (por exemplo, alguns discursos 'do norte') e pode ler textos escritos à mão com várias fontes.
Fonte: ByteDance Doubao (GNews) —
original
