Statista: Sekitar Seperempat Sumber Llama AI Berasal dari Buku
Meta
Menurut analisis Statista, sekitar 25% data yang digunakan untuk melatih model bahasa Meta Llama berasal dari buku. Jumlah ini sebanding dengan proporsi sumber dari internet, termasuk berita, media sosial, dan teks lainnya.
Perusahaan analitik Statista telah menerbitkan perkiraan sumber data untuk melatih model bahasa Llama dari Meta. Menurut Statista, sekitar seperempat (sekitar 25%) dari semua materi teks yang digunakan berasal dari buku. Angka ini sebanding dengan volume data yang diekstraksi dari internet, termasuk berita, media sosial, dan sumber daya daring lainnya. Perkiraan ini didasarkan pada analisis data terbuka tentang kumpulan pelatihan yang diterbitkan oleh Meta. Proporsi buku ini menegaskan pentingnya publikasi cetak sebagai sumber pengetahuan bagi model bahasa besar modern.
Sumber: Meta AI (GNews) —
asli
