La trace comme enseignant : distiller le raisonnement dans les petits modèles
Meta
Une méthode d'entraînement où un grand modèle laisse une trace de son raisonnement, et un petit modèle apprend à partir de ces traces, permettant le transfert de la capacité de raisonnement logique vers des réseaux neuronaux compacts.
Le numéro #898 de Sequence Knowledge aborde une méthode intitulée « The Trace Is the Teacher ». L'essence de cette approche est qu'un grand modèle de langage, lorsqu'il résout un problème, génère non seulement une réponse mais aussi une chaîne d'étapes de raisonnement intermédiaires – une trace. Cette trace est ensuite utilisée comme signal d'apprentissage pour un petit modèle, qui apprend non seulement à reproduire la réponse finale mais l'ensemble du processus de réflexion. Ainsi, un réseau neuronal compact acquiert la capacité de raisonnement qui est typiquement inhérente uniquement aux grands modèles. Cette méthode appartient au domaine de la distillation des connaissances et permet une réduction significative de la taille du modèle sans sacrifier la qualité du raisonnement logique.
Source: Meta AI (GNews) —
original
