Qwen3.8-Max:2.4万亿参数的巨兽
Alibaba/Qwen
Moonshot AI
Anthropic
OpenAI
DeepSeek
阿里巴巴发布了Qwen3.8-Max,这是一款拥有2.4万亿参数的混合专家模型,支持百万级令牌的上下文,并声称其为编程和自主工作设定了新标准。此次发布包括首次开放Max级别模型权重的计划,并展示了长时间运行的自主任务能力。独立测试显示,它在智能指数上略逊于Kimi K3,但提供了强劲的性价比。
2026年8月3日,阿里巴巴的Qwen团队发布了Qwen3.8-Max,这是一个拥有2.4万亿参数的大型语言模型,不过由于其专家混合架构,每次请求仅激活约950亿参数。该模型具有一百万token的上下文窗口,可通过QwenCloud、阿里云百炼平台及QwenWork应用使用。公司计划于8月12日开放Qwen3.8-Max和较小的Qwen3.8-27B的权重,这将是Max级模型权重首次对外开放。演示显示,该模型能在16天内自主构建一个自更新的命令行工具,复现并改进一篇科学论文,参加真实竞赛,设计加密芯片,并在模拟电商环境中进行交易。独立测试机构Artificial Analysis给出的智能指数评分为56分,落后Kimi K3一分,但每任务成本更高。公司将其初始评分较低归因于API过载。基准测试结果参差不齐:该模型在PaperBench、IFBench和OSWorld-Verified上领先,但在SWE-bench Pro和FrontierSWE上落后。定价为每百万输入token 2美元,每百万输出token 6美元,低于许多竞争对手。社区期待能在消费级硬件上运行的紧凑型27B模型。此次发布凸显了一个趋势,即模型周围的工具链(或基础设施)日益重要,阿里巴巴声称其兼容Claude Code和Codex等多种工具链。
来源: Habr — хаб ИИ —
原文
