LLM研究論文:2025年後半のリスト
Sebastian Raschkaが2025年7月から12月までの大規模言語モデルに関する興味深い研究論文を厳選して紹介。推論モデル、トレーニング手法、アーキテクチャ、マルチモーダルモデルなどのカテゴリを含む。クイックリファレンスやさらなる研究のために作成されたリスト。
2025年6月,塞巴斯蒂安·拉什卡为付费订阅者发布了一篇奖励文章,其中精选了一些研究论文。现在,作为对所有支持者的感谢,他准备了一份2025年7月至12月的类似列表,并按类别进行了整理:推理模型(训练、推理时策略、评估与理解)、其他强化学习方法、推理时扩展、模型发布与技术报告、架构、高效训练、扩散语言模型、多模态与视觉-语言模型,以及数据和预训练集。作者本人只是粗略浏览了摘要,仅阅读了其中一小部分,但他发现这类列表在项目工作中回头查阅时非常有用。需要注意的是,这份列表原本是作为年度回顾《2025年LLM现状:进展、挑战与预测》的一部分,但文章篇幅过长,因此拉什卡决定将列表单独发布。
出典: Sebastian Raschka —
原文
