ModelGenerasi Media 🇨🇳 27.07.2026 18:04

Qwen-TTS kini berbicara dalam dialek: synthesizer suara baru dari Alibaba

Alibaba/QwenAlibaba/Qwen
Alibaba Cloud telah memperbarui Qwen-TTS, model text-to-speech yang mendukung 3 dialek Tionghoa (Peking, Shanghai, Sichuan) dan 7 suara bilingual Tionghoa-Inggris. Model ini mencapai kealamian dan ekspresivitas setara manusia, tersedia melalui API Qwen.
Alibaba Cloud mengumumkan model Qwen-TTS terbaru (qwen-tts-latest atau qwen-tts-2025-05-22) melalui Qwen API. Dilatih dengan jutaan jam data ucapan, model ini secara otomatis menyesuaikan prosodi, tempo, dan infleksi emosional. Model ini mendukung 3 dialek Tionghoa — Beijing, Shanghai, dan Sichuan — dengan 7 suara dwibahasa Tionghoa-Inggris termasuk Cherry, Ethan, Chelsie, Serena, Dylan (Beijing), Jada (Shanghai), dan Sunny (Sichuan). Metrik kinerja pada tolok ukur SeedTTS-Eval menunjukkan Word Error Rate yang rendah dan kemiripan pembicara yang tinggi. Lebih banyak bahasa dan gaya direncanakan. Penggunaan didemonstrasikan melalui potongan kode Python menggunakan DashScope API.
Sumber: Alibaba Qwen — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru