Silero Menerbitkan TTS yang Stabil, Cepat, Berkualitas Tinggi, dan Terjangkau untuk 29 Bahasa Tambahan di Rusia
Silero
Silero telah merilis dua model TTS baru yang mencakup 29 bahasa tambahan di Rusia, terutama bahasa Turkik dan Kaukasus. Model-model ini mendukung SSML dan dioptimalkan untuk kualitas tinggi, tetapi tidak memungkinkan kontrol atas penempatan tekanan kata.
Silero, perusahaan yang dikenal dengan teknologi bicaranya, telah menerbitkan dua model text-to-speech baru yang mendukung 29 bahasa lain dari Rusia dan wilayah sekitarnya. Model pertama mencakup terutama bahasa-bahasa Turkik (14 bahasa, 33 suara), dan model kedua mencakup bahasa-bahasa Kaukasus (15 bahasa, 31 suara), termasuk banyak bahasa Abkhaz-Adyghe dan Nakh-Dagestan. Model-model ini menggunakan gabungan alfabet Sirilik resmi, mendukung SSML (Speech Synthesis Markup Language), dan dioptimalkan serupa dengan model-model sebelumnya. Mereka tidak dapat mengontrol penempatan tekanan kata, yang disebutkan sebagai keterbatasan. Bahasa-bahasa tersebut dipilih berdasarkan ketersediaan data dan kebutuhan untuk mencakup kelompok bahasa utama. Perusahaan juga menyediakan contoh kode dan notebook untuk kemudahan penggunaan, dan mencatat bahwa model mendukung generalisasi lintas bahasa. Rilis ini bertujuan untuk mengisi celah cakupan bahasa-bahasa Kaukasus, Dagestan, dan Chechnya.
Sumber: Habr — хаб ИИ —
asli
