Análisis profundo del modelo dúplex Seeduplex de ByteDance Doubao
ByteDance
ByteDance Doubao ha lanzado un nuevo modelo, Seeduplex, que admite modos de voz simplex y dúplex. El modelo es capaz de entrada de voz, percepción paralela, interrupción y reconocimiento de múltiples idiomas, incluido el chino-inglés mixto. Seeduplex puede imitar varias voces y estilos, incluido un estilo híbrido que combina tonos imperativos y suaves.
ByteDance Doubao ha presentado un modelo llamado Seeduplex, que es un nuevo modelo de voz dúplex. El análisis destaca sus capacidades de percepción en paralelo e interrupción, así como el reconocimiento de otras voces. El modelo admite entrada de voz, modos símplex y dúplex; puede reconocer simultáneamente sonidos, incluidos golpes en una mesa. Seeduplex puede imitar voz y estilo (por ejemplo, un tono autoritario con finales "enérgicos"), así como imitar una voz suave y añadir un toque de sonrisa. Puede alternar entre voces masculinas y femeninas a petición y cambiar el tono según las instrucciones. Además, el modelo admite mezcla de chino e inglés, reconoce la mayoría de los acentos chinos (por ejemplo, algo del habla "norteña") y puede leer textos manuscritos con diversas tipografías.
Fuente: ByteDance Doubao (GNews) —
original
