El equipo Qwen de Alibaba lanza modelos Qwen3.8 con pesos abiertos bajo Apache-2.0
Alibaba/Qwen
El equipo de IA de Alibaba, Qwen, ha lanzado los pesos abiertos del modelo para Qwen3.8. El modelo principal Qwen3.8-27B es un modelo denso multimodal con 27.000 millones de parámetros que supera al más grande Qwen3.7-Plus en muchas áreas, especialmente en programación y tareas de oficina. El modelo maneja hasta 262.000 tokens de contexto de forma nativa y puede extenderse a un millón de tokens con el método YaRN.
El equipo de IA de Alibaba, Qwen, ha publicado los pesos abiertos de sus modelos Qwen3.8 bajo la licencia gratuita Apache-2.0. El modelo insignia, Qwen3.8-27B, es un modelo denso multimodal con 27 mil millones de parámetros que, según se informa, supera al Qwen3.7-Plus, de mayor tamaño, en muchos ámbitos, especialmente en programación y tareas de oficina. Qwen también destaca capacidades agénticas mejoradas, con el modelo planificando de forma más independiente y completando tareas de manera más fiable. De forma nativa, procesa hasta 262 000 tokens de contexto y puede ampliarse a un millón de tokens usando el método YaRN. Además de texto, el modelo comprende imágenes y videos, como diagramas, documentos o videos de varias horas de duración. Un modo de pensamiento flexible está habilitado por defecto, pero puede desactivarse por solicitud o ajustarse en profundidad. Adicionalmente, Qwen ha publicado los pesos del modelo mucho más grande Qwen3.8-2.4T-A95B, destinado a un rendimiento de primer nivel. Ambos modelos están disponibles en Hugging Face y ModelScope. Una versión alojada con un millón de tokens de contexto se ofrecerá próximamente a través de Qwen Cloud, el servicio de IA de Alibaba.
Fuente: The Decoder (DE) —
original
