模型智能体 🇩🇪 03.08.2026 13:02

阿里巴巴发布Qwen3.8-Max,参数规模达2.4万亿,将开源权重

Alibaba/QwenAlibaba/Qwen Moonshot AIMoonshot AI
阿里巴巴发布了其最强大的语言模型Qwen3.8-Max,总参数达2.4万亿,旨在数天内自主完成复杂任务。在测试中,该模型编写了软件、复现了研究结果,并运营了一个模拟电商业务。该模型现已可用,权重将于下周发布。
阿里巴巴的Qwen团队推出了Qwen3.8-Max,这是一个总参数规模达2.4万亿、每次请求激活950亿参数的语言模型,基于Qwen3.5架构构建。其重点在于自主完成更长时间跨度的复杂任务。作为压力测试,团队展示了三次自主编码运行:模型在16天内构建了oh-my-cli工具,处理了265次提交、127个拉取请求和151个问题,无需人工干预;它复现并改进了研究论文的结果,在AIME24上比原方法高出2.7分;在多模态挑战中,它领先于526个参赛人类团队中的458个。此外,该模型设计了一款芯片,将逻辑门从8,298个减少到678个,芯片面积减少了81%,并模拟了一年的电子商务,使资本翻了两番,比GLM 5.2高出38%。多模态能力包括处理超过200页的文档和超过100小时的视频。在内部基准测试中,该模型的性能接近或高于Claude Opus 4.8、Claude Fable 5和GPT-5.6 Sol,但有待独立验证。权重将于下周在Hugging Face和ModelScope上发布。竞争对手月之暗面于7月27日发布了Kimi K3,该模型拥有2.8万亿参数和100万token的上下文窗口。
来源: The Decoder (DE) — 原文
我们之前关于此话题的帖子 ↓
最新新闻