Statista: cerca de um quarto das fontes da IA Llama veio de livros
Meta
De acordo com uma análise da Statista, cerca de 25% dos dados usados para treinar o modelo de linguagem Llama da Meta foram obtidos de livros. Isso é comparável à parcela de fontes da internet, incluindo notícias, redes sociais e outros textos.
A empresa de análise Statista publicou uma avaliação das fontes de dados utilizadas para o treinamento do modelo de linguagem Llama, da Meta. Segundo a Statista, aproximadamente um quarto (cerca de 25%) de todo o material textual utilizado veio de livros. Esse percentual é comparável ao volume de dados extraídos da internet, incluindo notícias, redes sociais e outros recursos online. A avaliação baseia-se na análise de dados abertos sobre os conjuntos de treinamento publicados pela Meta. A parcela de livros destaca a importância das publicações impressas como fonte de conhecimento para os grandes modelos de linguagem modernos.
Fonte: Meta AI (GNews) —
original
