ModelleMediengenerierung 🇨🇳 27.07.2026 18:04

Qwen-TTS spricht jetzt Dialekte: neuer Sprachsynthesizer von Alibaba

Alibaba/QwenAlibaba/Qwen
Alibaba Cloud hat Qwen-TTS aktualisiert, ein Text-zu-Sprache-Modell, das drei chinesische Dialekte (Pekingerisch, Shanghai-Dialekt, Sichuanesisch) und sieben zweisprachige chinesisch-englische Stimmen unterstützt. Das Modell erreicht eine menschenähnliche Natürlichkeit und Ausdruckskraft und ist über die Qwen-API verfügbar.
Alibaba Cloud hat das neueste Qwen-TTS-Modell (qwen-tts-latest oder qwen-tts-2025-05-22) über die Qwen-API angekündigt. Es wurde mit Millionen von Stunden Sprachdaten trainiert und passt Prosodie, Tempo und emotionale Betonungen automatisch an. Das Modell unterstützt drei chinesische Dialekte – Peking-, Shanghai- und Sichuan-Dialekt – mit sieben zweisprachigen Stimmen (Chinesisch/Englisch), darunter Cherry, Ethan, Chelsie, Serena, Dylan (Peking-Dialekt), Jada (Shanghai-Dialekt) und Sunny (Sichuan-Dialekt). Die Leistungskennzahlen auf dem SeedTTS-Eval-Benchmark zeigen eine niedrige Wortfehlerrate und eine hohe Sprecherähnlichkeit. Weitere Sprachen und Stile sind geplant. Die Nutzung wird anhand eines Python-Codeausschnitts über die DashScope-API demonstriert.
Quelle: Alibaba Qwen — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten