ModelosCódigo Aberto 🇨🇳 15.08.2026 14:02

Qwen3.8-27B de código aberto: roda agente 'nível Opus' em GPU de consumo e supera Claude em vários benchmarks

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
O Qwen3.8-27B da Alibaba foi oficialmente lançado como código aberto, com 27 bilhões de parâmetros, suporte multimodal nativo e até 1 milhão de tokens de contexto. Ele supera o Claude Opus 4.6 Max em vários benchmarks de engenharia de software e agentes, permitindo execução local em GPUs de consumo de ponta. O modelo inclui esforço de raciocínio ajustável e otimizações para tarefas de contexto longo.
A Alibaba lançou o modelo open-source Qwen3.8-27B, com 27 bilhões de parâmetros. Em benchmarks oficiais, ele supera o Claude Opus 4.6 Max em engenharia de software e tarefas de agente, como liderar por 8,3 pontos no SWE-bench Pro e por 15,2 pontos no QwenSWEBench. Em avaliações de agente, ele marca 70,7 no CoWorkBench, contra 68,2 do Opus, e em testes multimodais de operação de computador e telefone, atinge 84,3 no OSWorld-Verified e 81,9 no AndroidWorld, em comparação com 72,7 e 62,0 do Opus. O modelo suporta compreensão multimodal nativa, contexto nativo de 262 mil tokens, expansível para 1 milhão, e inclui ajuste de esforço de raciocínio (xhigh, medium, low) e preservação de pensamento para tarefas de agente. Sua arquitetura usa 48 camadas de atenção linear Gated DeltaNet e 16 camadas de atenção total, permitindo contexto longo. É compatível com Transformers, vLLM, SGLang e TokenSpeed, e versões quantizadas estão disponíveis no Hugging Face, permitindo implantação em GPUs de consumo como RTX 3090/4090 ou Macs da Apple. Testes da comunidade demonstram suas capacidades de codificação e multimodais, incluindo estabilidade em alta concorrência no NVIDIA GH200 e processamento de vídeos longos.
Fonte: QbitAI 量子位 — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas