西方回应中国:Poolside 发布最强开源模型 Laguna S 2.1
Poolside
OpenAI
DeepSeek
NVIDIA
Moonshot AI
初创公司 Poolside 发布了 Laguna S 2.1,这是一个拥有 1180 亿参数的开源代码生成模型,声称是西方最强大的开源模型。其性能可与数倍于其规模的模型相媲美,但落后于中国的 Kimi K3。该模型的发布正值美国讨论可能禁止使用中国开源模型之际。
初创公司Poolside发布了Laguna S 2.1——一款面向自主编程的1180亿参数开源模型,号称西方最强大的开源模型。其架构采用混合专家模型(Mixture-of-Experts, MoE),1180亿参数中每个令牌仅激活80亿,上下文窗口可达100万令牌。在基准测试中,该模型在Terminal-Bench 2.1上获得70.2%,在SWE-Bench Pro上获得59.4%。这一水平与DeepSeek V4 lite、NVIDIA的Nemotron 3 Ultra以及Thinking Machines的Inkling相当或更高,尽管这些模型规模是Laguna的2.5至8倍。公司公布了Laguna自行证明埃尔德什第397号问题的完整轨迹,并公开了所有基准测试运行的轨迹以确保可重复性。过去11个月,西方实验室自OpenAI的gpt-oss-120b以来,未发布过如此规模的开源模型。Poolside声称已构建了一个自动化实验的“模型工厂”,并在4000块H200 GPU上仅用4周就训练出Laguna S 2.1,承诺每5周发布一次更新。然而,面对中国竞争,Laguna不及Moonshot AI的Kimi K3:K3在Terminal-Bench 2.1上获得88.3%,其参数规模为2.8万亿,而Laguna仅为1180亿。此次发布正值美国讨论可能禁止使用中国开源模型之际。Moonshot承诺于7月27日公布Kimi K3的权重。
来源: Habr — хаб ИИ —
原文
