Alibaba、Qwen3.8-Maxをリリース:2.4兆パラメータのMoEモデル、Qwenファミリーで最高性能
Alibaba/Qwen
OpenAI
Anthropic
AlibabaのQwenチームは、Qwen3.8-Maxを広く公開し、オープンウェイトは来週提供予定です。この2.4兆パラメータの混合エキスパート(MoE)モデルは、テキスト、画像、動画の入力をサポートし、マルチモーダルおよびエージェントタスクにおいて前モデルを上回る性能を発揮します。
阿里巴巴的Qwen团队已公开发布Qwen3.8-Max,并确认其开放权重将于下周发布,同时还有第二个检查点Qwen3.8-27B。Qwen3.8-Max是一个2.4万亿参数的混合专家模型,接受文本、图像和视频输入,但仅返回文本。托管API适用于任何规模的公司部署,并与OpenAI和DashScope兼容,而开放权重则是一个多节点数据中心产物。阿里巴巴未公开激活参数数量,导致服务成本未知。Qwen3.8-27B是适合普通本地GPU硬件的检查点。发布的功能集覆盖四个行业:软件工程、法律和金融文档审查、媒体和电商运营,以及设计。模型页面列出了100万令牌的上下文窗口,最大输入为99.1万令牌(启用思考时为98.3万),最大输出为13.1万令牌。定价为每百万输入令牌2美元,每百万输出令牌6美元,缓存输入每百万令牌0.25美元。支持的功能包括函数调用、结构化输出、批处理、前缀补全和微调,以及Responses API上的五个内置工具。在基准测试中,Qwen3.8-Max在Terminal-Bench 2.1上得分为86.6,落后于GPT-5.6 Sol(最高)的88.8,但领先于Claude Opus 4.8和Claude Fable 5的84.6。它在PaperBench和IFBench上领先,并在多模态和智能体任务上相对于前代有所提升,不过多模态表格基准测试是与Qwen3.7-Plus对比,而非Qwen3.7-Max。模型的强化学习缩放曲线在约4000个训练环境时达到峰值0.725,随后下降。
出典: MarkTechPost —
原文
