LLM研究论文:2025年下半年精选列表
Sebastian Raschka 精选了2025年7月至12月期间关于大型语言模型的有趣研究论文。内容包括推理模型、训练方法、架构、多模态模型等多个类别。该列表旨在提供快速参考和进一步学习。
2025年6月,塞巴斯蒂安·拉什卡为付费订阅者发布了一篇附加文章,其中精选了一些研究论文。现在,作为对所有支持者的感谢,他为2025年7月至12月准备了类似的列表,并按类别进行了整理:推理模型(训练、推理时策略、评估和理解)、其他强化学习方法、推理时扩展、模型发布和技术报告、架构、高效训练、扩散语言模型、多模态和视觉语言模型,以及数据和预训练集。作者本人只是简要浏览了摘要,仅阅读了其中一小部分,但他认为在项目工作中重新查阅这类列表很有用。需要说明的是,这份集合原本打算作为年度回顾《2025年LLMs现状:进展、挑战与预测》的一部分,但文章篇幅过长,因此拉什卡决定将列表单独发布。
来源: Sebastian Raschka —
原文
