Lancement du classement FFASR — un benchmark pour évaluer la reconnaissance vocale en conditions acoustiques réelles
Treble Technologies et Hugging Face ont lancé le classement FFASR, le premier benchmark communautaire ouvert pour évaluer les systèmes de reconnaissance automatique de la parole (ASR) en conditions de champ lointain. Le benchmark montre qu'à faible rapport signal sur bruit (SNR), les taux d'erreur de reconnaissance en champ lointain sont plusieurs fois supérieurs à ceux en champ proche. La plateforme permet d'évaluer à la fois la précision (taux d'erreur de mots, WER) et la vitesse (facteur temps réel, RTFx) des modèles.
Treble Technologies
Hugging Face
OpenAI
IBM
Cohere
Meta
SpeechBrain
Hugging Face blog27.07 · 10:05
