Pourquoi mon modèle ne fonctionne-t-il pas ?
L'article aborde les pièges courants en apprentissage automatique qui font échouer les modèles en conditions réelles, bien qu'ils paraissent performants lors des tests. Les problèmes clés incluent des données trompeuses (variables cachées, corrélations trompeuses, erreurs d'étiquetage), des fuites de données (prétraitement avant la séparation, biais de perspective, surapprentissage itératif sur l'ensemble de test) et un choix de métrique inapproprié (par exemple, la précision sur des données déséquilibrées). L'auteur recommande la liste de vérification REFORMS et des pratiques telles que l'utilisation de cartes de saillance, de références diversifiées et de séparations de données appropriées pour améliorer la fiabilité du modèle.
Cet article, basé sur les 20 ans d'expérience de l'auteur en apprentissage automatique et sur l'article « Comment éviter les pièges de l'apprentissage automatique : un guide pour les chercheurs académiques », décrit les erreurs courantes qui conduisent à l'échec des modèles en production. Premièrement, les données trompeuses : les variables cachées (par exemple, l'orientation du corps dans les scanners thoraciques pour le Covid) et les corrélations fallacieuses (par exemple, les pixels d'arrière-plan dans les images de chars) amènent les modèles à apprendre des schémas non pertinents. Les attaques adversariales exploitent ces corrélations fallacieuses. Les erreurs d'étiquetage, même à quelques pour cent, peuvent fausser les comparaisons de références. Deuxièmement, les fuites de données : effectuer un prétraitement dépendant des données (centrage, mise à l'échelle, sélection de caractéristiques, augmentation des données) sur l'ensemble des données avant de séparer les données de test fait fuiter des informations, gonflant les performances. Le biais de regard en avant dans la prévision de séries temporelles et le surajustement itératif de l'ensemble de test (entraînement sur l'ensemble de test) sont des fuites courantes. Troisièmement, les métriques inappropriées : l'utilisation de la précision sur des données déséquilibrées peut être trompeuse. L'auteur recommande la liste de vérification REFORMS pour la science basée sur l'apprentissage automatique et des pratiques telles que l'examen des cartes de saillance, l'utilisation de multiples références et la garantie de divisions appropriées des données.
Source: The Gradient —
original
