Statista: Ongeveer een kwart van de bronnen voor Llama AI kwam uit boeken
Meta
Volgens een analyse van Statista werd ongeveer 25% van de data waarop het taalmodel Meta Llama werd getraind, verkregen uit boeken. Dit is vergelijkbaar met het aandeel van bronnen van het internet, waaronder nieuws, sociale media en andere teksten.
Het analytische bedrijf Statista heeft een schatting gepubliceerd van de databronnen voor het trainen van het taalmodel Llama van Meta. Volgens Statista was ongeveer een kwart (ongeveer 25%) van al het gebruikte tekstmateriaal afkomstig uit boeken. Dit cijfer is vergelijkbaar met de hoeveelheid gegevens die uit het internet is gehaald, waaronder nieuws, sociale media en andere onlinebronnen. De schatting is gebaseerd op een analyse van openbare gegevens over trainingsdatasets die door Meta zijn gepubliceerd. Het aandeel van boeken benadrukt het belang van gedrukte publicaties als kennisbron voor moderne grote taalm modellen.
Bron: Meta AI (GNews) —
origineel
