ModelosCódigo Abierto 🇨🇳 15.08.2026 14:02

Qwen3.8-27B de código abierto: ejecuta un agente de 'nivel Opus' en una GPU de consumo, supera a Claude en varios puntos de referencia

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
El Qwen3.8-27B de Alibaba se ha lanzado oficialmente como código abierto, con 27 mil millones de parámetros, soporte multimodal nativo y hasta un millón de tokens de contexto. Supera a Claude Opus 4.6 Max en varios puntos de referencia de ingeniería de software y agentes, permitiendo la ejecución local en GPUs de consumo de gama alta. El modelo incluye esfuerzo de razonamiento ajustable y optimizaciones para tareas de contexto largo.
Alibaba ha lanzado el modelo de código abierto Qwen3.8-27B con 27 mil millones de parámetros. En los benchmarks oficiales, supera a Claude Opus 4.6 Max en ingeniería de software y tareas de agente, liderando por ejemplo por 8.3 puntos en SWE-bench Pro y por 15.2 puntos en QwenSWEBench. En evaluaciones de agentes, obtiene 70.7 en CoWorkBench frente a los 68.2 de Opus, y en pruebas multimodales de operación de computadoras y teléfonos, alcanza 84.3 en OSWorld-Verified y 81.9 en AndroidWorld, en comparación con los 72.7 y 62.0 de Opus. El modelo admite comprensión multimodal nativa, un contexto nativo de 262 mil tokens ampliable a 1 millón, e incluye un ajuste de esfuerzo de razonamiento (xhigh, medium, low) y preserve_thinking para tareas de agente. Su arquitectura utiliza 48 capas de atención lineal Gated DeltaNet y 16 capas de atención completa, lo que permite un contexto largo. Es compatible con Transformers, vLLM, SGLang y TokenSpeed, y hay versiones cuantizadas disponibles en Hugging Face, lo que permite su implementación en GPUs de consumo como RTX 3090/4090 o Macs de Apple. Las pruebas de la comunidad demuestran sus capacidades de codificación y multimodales, incluida la estabilidad de alta concurrencia en NVIDIA GH200 y el procesamiento de videos largos.
Fuente: QbitAI 量子位 — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas