Alibaba lança Qwen3.8-Max com 2,4 trilhões de parâmetros, e abrirá o código dos pesos
Alibaba/Qwen
Moonshot AI
A Alibaba apresentou o Qwen3.8-Max, seu modelo de linguagem mais potente, com 2,4 trilhões de parâmetros no total, projetado para concluir tarefas complexas de forma autônoma ao longo de dias. Em testes, o modelo programou software, reproduziu resultados de pesquisa e administrou um negócio simulado de e-commerce. Ele já está disponível, com os pesos a serem liberados na próxima semana.
A equipe Qwen da Alibaba apresentou o Qwen3.8-Max, um modelo de linguagem que escala para 2,4 trilhões de parâmetros totais, com 95 bilhões ativos por solicitação, construído sobre a arquitetura Qwen3.5. O foco está em completar tarefas complexas de forma autônoma por períodos mais longos. Três execuções autônomas de codificação foram apresentadas como testes de estresse: o modelo construiu a ferramenta oh-my-cli ao longo de 16 dias, lidando com 265 commits, 127 pull requests e 151 issues sem intervenção humana; reproduziu e melhorou os resultados de um artigo de pesquisa, superando seu método no AIME24 por 2,7 pontos; e ficou à frente de 458 de 526 equipes humanas em um desafio multimodal. Além disso, o modelo projetou um chip, reduzindo as portas lógicas de 8.298 para 678 e a área do chip em 81%, e simulou um ano de comércio eletrônico, quadruplicando o capital e superando o GLM 5.2 em 38%. As capacidades multimodais incluem o processamento de documentos com mais de 200 páginas e vídeos com mais de 100 horas. O desempenho do modelo está próximo ou acima do Claude Opus 4.8, Claude Fable 5 e GPT-5.6 Sol em benchmarks internos, embora a verificação independente ainda esteja pendente. Os pesos serão liberados na próxima semana no Hugging Face e no ModelScope. O concorrente Moonshot AI lançou o Kimi K3 com 2,8 trilhões de parâmetros e contexto de 1 milhão de tokens em 27 de julho.
Fonte: The Decoder (DE) —
original
