Modelos 🇺🇸 31.07.2026 02:03

Statista: aproximadamente una cuarta parte de las fuentes de Llama AI provino de libros

MetaMeta
Según un análisis de Statista, alrededor del 25% de los datos con los que se entrenó el modelo de lenguaje Meta Llama provino de libros. Esta cifra es comparable con la proporción de fuentes de internet, incluyendo noticias, redes sociales y otros textos.
La empresa analítica Statista ha publicado una estimación sobre las fuentes de datos utilizadas para entrenar el modelo de lenguaje Llama de Meta. Según Statista, aproximadamente una cuarta parte (alrededor del 25%) de todos los materiales textuales empleados provino de libros. Esta cifra es comparable al volumen de datos extraídos de internet, incluyendo noticias, redes sociales y otros recursos en línea. La estimación se basa en el análisis de los datos abiertos sobre los conjuntos de entrenamiento publicados por Meta. La proporción de libros subraya la importancia de las publicaciones impresas como fuente de conocimiento para los grandes modelos de lenguaje actuales.
Fuente: Meta AI (GNews) — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas