Comment traduire le mélange russe et kazakh à l'aide de données synthétiques
Des chercheurs de MWS AI et de plusieurs universités ont développé une méthode pour générer des ensembles de données synthétiques afin de traduire le langage mixte russe-kazakh (code-switching). Leur approche, basée sur l'alignement SimAlign et le modèle NLLB-3.3B, a surpassé les systèmes commerciaux lors de l'évaluation humaine, bien que les métriques automatiques montrent l'inverse.
Meta
