モデル 🇺🇸 31.07.2026 02:03

Statista:Llama AI のソースの約4分の1は書籍が占める

MetaMeta
Statista の分析によると、Meta の Llama 言語モデルの学習データの約25%は書籍から取得されました。これは、ニュース、ソーシャルメディア、その他のテキストを含むインターネットのソースの割合に匹敵します。
分析会社スタティスタは、メタの言語モデル「ラマ」の学習用データの出所について評価を発表した。スタティスタによると、使用された全テキスト資料の約4分の1(約25%)が書籍によるものだった。この割合は、ニュースやソーシャルメディア、その他のオンラインリソースを含むインターネットから抽出されたデータ量に匹敵する。この評価は、メタが公開したトレーニングセットに関する公開データの分析に基づいている。書籍の割合は、現代の大規模言語モデルにとって知識源としての印刷物の重要性を浮き彫りにしている。
出典: Meta AI (GNews) — 原文
関連記事 ↓
新着ニュース