Statista : environ un quart des sources de Llama AI provenaient de livres
Meta
Selon une analyse de Statista, environ 25 % des données ayant servi à entraîner le modèle linguistique Meta Llama provenaient de livres. Cette proportion est comparable à celle des sources issues d'Internet, notamment les actualités, les réseaux sociaux et d'autres textes.
La société d'analyse Statista a publié une évaluation des sources de données utilisées pour l'apprentissage du modèle linguistique Llama de Meta. Selon Statista, environ un quart (environ 25 %) de l'ensemble des textes utilisés provient de livres. Ce chiffre est comparable au volume de données extraites d'Internet, y compris les actualités, les réseaux sociaux et d'autres ressources en ligne. L'évaluation repose sur une analyse des données ouvertes relatives aux ensembles d'apprentissage publiées par Meta. La part des livres souligne l'importance des publications imprimées en tant que source de connaissances pour les grands modèles linguistiques modernes.
Source: Meta AI (GNews) —
original
