Les modèles de raisonnement ont besoin d'une nouvelle mesure : le classement public MERA Reason dévoilé
Le classement MERA Reason a été lancé pour évaluer les modèles de raisonnement en russe. Il comprend quatre ensembles de tâches : Luzitania (mathématiques de niveau olympiade), TMath (un large éventail de problèmes), MMReD (raisonnement contextuel dense) et un composant à venir. L'objectif est de mesurer objectivement la capacité d'un modèle à construire des chaînes de raisonnement, pas seulement à reproduire des connaissances.
Т-Банк
Alibaba/Qwen
Habr — хаб ИИ24.07 · 11:01
