ModelleMediengenerierung 🇨🇳 27.07.2026 18:04

Qwen-TTS spricht Dialekte: neuer Sprachsynthesizer von Alibaba

Alibaba/QwenAlibaba/Qwen
Alibaba hat ein aktualisiertes Qwen-TTS-Modell (qwen-tts-latest) vorgestellt, das mit Millionen von Stunden Sprache trainiert wurde. Es unterstützt drei chinesische Dialekte und sieben zweisprachige Stimmen und passt Prosodie, Tempo und Emotionen automatisch an den Text an. Das Modell ist über die Qwen-API verfügbar.
Alibaba объявила о выходе обновлённой версии своей текстово-речевой модели Qwen-TTS (qwen-tts-latest или qwen-tts-2025-05-22), которая доступна через Qwen API. Модель обучена на крупномасштабном наборе данных, включающем миллионы часов речи, что позволяет ей достигать естественности и выразительности на уровне человека. Ключевая особенность — автоматическая подстройка просодики, темпа и эмоциональных интонаций под входной текст. Qwen-TTS поддерживает генерацию речи на трёх китайских диалектах: пекинском, шанхайском и сычуаньском. Всего представлено семь двуязычных голосов (китайско-английских): Cherry, Ethan, Chelsie, Serena, Dylan (пекинский), Jada (шанхайский) и Sunny (сычуаньский). В ближайшее время ожидается расширение языковой и стилистической поддержки. Модель также продемонстрировала высокие показатели на бенчмарке SeedTTS-Eval: низкий WER и высокое сходство голоса. Для использования через Qwen API прилагается пример кода на Python. Alibaba планирует дальнейшие улучшения и расширение поддержки языков.
Quelle: Alibaba Qwen — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten