Qwen3.8 Max Lançado: Supera Claude Fable 5 no Índice Agentic por US$ 6 por Milhão de Tokens
Alibaba/Qwen
Anthropic
A Alibaba lançou a versão final do Qwen3.8 Max, um modelo multimodal de 2,4 trilhões de parâmetros com contexto de um milhão de tokens. Testes independentes mostram que ele supera o Claude Fable 5 no Índice Agentic, e seu preço de API é significativamente menor que o dos concorrentes. No entanto, os pesos abertos ainda estão pendentes.
A Alibaba lançou oficialmente o Qwen3.8 Max, um modelo nativo multimodal de mistura de especialistas com 2,4 trilhões de parâmetros. Ele suporta entrada de texto, imagens e vídeo, e gera texto, com uma janela de contexto de até um milhão de tokens (983.000 de entrada e 131.000 de saída no modo de raciocínio). O modelo apresenta raciocínio híbrido habilitado por padrão, chamada de funções e ferramentas integradas, sendo promovido para programação e fluxos de trabalho agênticos profissionais. Testes independentes da Artificial Analysis mostram que o Qwen3.8 Max pontua 58,1 no Índice de Inteligência (em comparação com 62,1 do Claude Fable 5) e 58,4 no Índice Agêntico (em comparação com 56,6 do Claude Fable 5), com apenas dois modos do Claude Opus 5 classificados acima. O preço é de US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída, com leituras em cache a US$ 0,25 por milhão de tokens — aproximadamente cinco vezes mais barato que o Claude Fable 5 na entrada e 8,3 vezes mais barato na saída. No entanto, o modelo é prolixo: gerou cerca de 150 milhões de tokens em uma execução completa do Índice de Inteligência, cerca de 2,3 vezes a mediana (66 milhões) de modelos comparáveis. A velocidade é de cerca de 82 tokens de saída por segundo, com latência do primeiro token em torno de 2,8 segundos. Na manhã de 10 de agosto, os pesos abertos do Qwen3.8 Max e do Qwen3.8-27B ainda não haviam sido publicados, embora a Alibaba tenha prometido que apareceriam na semana de 3 de agosto. O modelo grande requer cerca de 4,8 TB em BF16 ou 1,2 TB em 4 bits, tornando a implantação local impraticável para a maioria. O artigo sugere que o Qwen3.8 Max é adequado para codificação agêntica, análise de documentos longos, processos de múltiplas etapas e como backup para o Claude, mas recomenda testar em suas próprias tarefas antes de migrar.
Fonte: Habr — хаб ИИ —
original
