Hoe vertaal je gemengd Russisch en Kazachs met synthetische data
Onderzoekers van MWS AI en verschillende universiteiten hebben een methode ontwikkeld voor het genereren van synthetische datasets om gemengd Russisch-Kazachse code-switching te vertalen. Hun aanpak, gebaseerd op SimAlign-uitlijning en het NLLB-3.3B-model, presteerde beter dan commerciële systemen in menselijke evaluatie, hoewel automatische metrieken het tegenovergestelde laten zien.
Meta
