모델 🇺🇸 31.07.2026 02:03

Statista: Llama AI 학습 데이터의 약 4분의 1이 책에서 비롯됨

MetaMeta
Statista의 분석에 따르면, Meta의 Llama 언어 모델을 학습하는 데 사용된 데이터의 약 25%가 책에서 얻은 것으로 나타났습니다. 이는 뉴스, 소셜 미디어 및 기타 텍스트를 포함한 인터넷 출처의 비율과 비슷합니다.
Аналитическая компания Statista опубликовала оценку источников данных для обучения языковой модели Llama от Meta. По данным Statista, примерно четверть (около 25%) всех используемых текстовых материалов пришлась на книги. Этот показатель сопоставим с объёмом данных, извлечённых из интернета, включая новости, социальные сети и прочие онлайн-ресурсы. Оценка основана на анализе открытых данных о тренировочных наборах, опубликованных Meta. Доля книг подчёркивает значимость печатных изданий как источника знаний для современных больших языковых моделей.
출처: Meta AI (GNews) — 원문
관련 게시물 ↓
새로운 뉴스