Ein tiefer Einblick in ByteDance Doubaos Duplex-Modell Seeduplex
ByteDance
ByteDance Doubao hat ein neues Modell namens Seeduplex veröffentlicht, das Simplex- und Duplex-Sprachmodi unterstützt. Das Modell ist in der Lage, Spracheingaben, parallele Wahrnehmung, Unterbrechungen und die Erkennung mehrerer Sprachen, einschließlich gemischtem Chinesisch-Englisch, zu verarbeiten. Seeduplex kann verschiedene Stimmen und Stile imitieren, einschließlich eines hybriden Stils, der imperative und sanfte Töne kombiniert.
ByteDance Doubao hat ein Modell namens Seeduplex vorgestellt, ein neuartiges Duplex-Sprachmodell. Die Rezension hebt seine Fähigkeiten zur parallelen Wahrnehmung und Unterbrechung sowie zur Erkennung anderer Stimmen hervor. Das Modell unterstützt Spracheingabe, Simplex- und Duplex-Modi; es kann gleichzeitig Geräusche erkennen, einschließlich Klopfen auf einen Tisch. Seeduplex kann Stimme und Stil nachahmen (z. B. einen befehlenden Ton mit „kraftvollen“ Endungen) sowie eine sanfte Stimme imitieren und einen Hauch von Lächeln hinzufügen. Es kann auf Wunsch zwischen männlichen und weiblichen Stimmen wechseln und den Ton je nach Anweisung ändern. Darüber hinaus unterstützt das Modell gemischtes Chinesisch-Englisch, erkennt die meisten chinesischen Akzente (z. B. einige „nördliche“ Sprechweisen) und kann handgeschriebene Texte in verschiedenen Schriftarten lesen.
Quelle: ByteDance Doubao (GNews) —
Original
