MIT研究人员推出SEAL:迈向自我改进人工智能的一步
麻省理工学院的一个团队发表了论文《自适应语言模型》,提出了SEAL框架,使大型语言模型能够通过自我编辑和强化学习更新自身权重。在Llama-3.2-1B-Instruct和Qwen2.5-7B上的实验显示,在少样本学习和知识整合方面有显著提升。
MIT
Meta
Alibaba/Qwen
OpenAI
DeepMind
麻省理工学院的一个团队发表了论文《自适应语言模型》,提出了SEAL框架,使大型语言模型能够通过自我编辑和强化学习更新自身权重。在Llama-3.2-1B-Instruct和Qwen2.5-7B上的实验显示,在少样本学习和知识整合方面有显著提升。
MIT
Meta
Alibaba/Qwen
OpenAI
DeepMind
Google DeepMind 宣布推出三款新的 Gemini 模型:3.6 Flash 改进了编码和效率,3.5 Flash-Lite — 系列中速度最快、成本效益最高的模型,以及用于网络安全的 3.5 Flash Cyber。3.6 Flash 和 3.5 Flash-Lite 模型现已可在 Gemini API 和其他 Google 产品中使用。
Google/DeepMind
DeepMind