-
SRPO:快手新强化学习方法在LLM训练中效率比GRPO高10倍
EN
Synced ·
27.07 18:04
-
阿里巴巴发布Qwen-Image:20B参数的MMDiT模型,实现文字精准图像生成
ZH
Alibaba Qwen ·
27.07 17:05
-
自适应并行推理:高效人工智能推理扩展的新范式
EN
BAIR (Berkeley AI) ·
27.07 14:04
-
谷歌DeepMind推出Gemini Omni:用于视频创建和编辑的多模态模型
EN
Google DeepMind ·
27.07 14:04
-
ABBEL:训练大语言模型更新信念以实现高效长期交互
EN
BAIR (Berkeley AI) ·
27.07 07:02