Statista: Etwa ein Viertel der Llama-KI-Quellen stammte aus Büchern
Meta
Laut einer Analyse von Statista stammten etwa 25 Prozent der Daten, mit denen das Sprachmodell Meta Llama trainiert wurde, aus Büchern. Dies ist vergleichbar mit dem Anteil der Quellen aus dem Internet, einschließlich Nachrichten, sozialen Netzwerken und anderen Texten.
Die Analyse-Firma Statista hat eine Einschätzung der Datenquellen für das Training des Sprachmodells Llama von Meta veröffentlicht. Laut Statista entfiel etwa ein Viertel (rund 25%) aller verwendeten Textmaterialien auf Bücher. Dieser Anteil ist vergleichbar mit der Datenmenge, die aus dem Internet stammt, einschließlich Nachrichten, sozialen Medien und anderen Online-Ressourcen. Die Einschätzung basiert auf einer Analyse öffentlicher Daten zu Trainingsdatensätzen, die von Meta veröffentlicht wurden. Der Anteil der Bücher unterstreicht die Bedeutung gedruckter Ausgaben als Wissensquelle für moderne große Sprachmodelle.
Quelle: Meta AI (GNews) —
Original
