L'équipe Qwen d'Alibaba publie les modèles Qwen3.8 avec des poids ouverts sous licence Apache-2.0
Alibaba/Qwen
L'équipe IA Qwen d'Alibaba a publié les poids de modèle ouverts pour Qwen3.8. Le modèle principal Qwen3.8-27B est un modèle dense multimodal de 27 milliards de paramètres qui surpasse le plus grand Qwen3.7-Plus dans de nombreux domaines, en particulier en programmation et en tâches bureautiques. Le modèle gère nativement jusqu'à 262 000 jetons de contexte et peut être étendu à un million de jetons avec la méthode YaRN.
L'équipe IA d'Alibaba, Qwen, a publié les poids ouverts de ses modèles Qwen3.8 sous la licence libre Apache-2.0. Le modèle phare, Qwen3.8-27B, est un modèle dense multimodal de 27 milliards de paramètres qui surpasserait le Qwen3.7-Plus, plus grand, dans de nombreux domaines, notamment la programmation et les tâches bureautiques. Qwen met également en avant des capacités agentiques améliorées, le modèle planifiant de manière plus autonome et accomplissant les tâches de manière plus fiable. Il traite nativement jusqu'à 262 000 jetons de contexte et peut être étendu à un million de jetons grâce à la méthode YaRN. Outre le texte, le modèle comprend les images et les vidéos, telles que des schémas, des documents ou des vidéos de plusieurs heures. Un mode de réflexion flexible est activé par défaut, mais peut être désactivé à la demande ou ajusté en profondeur. De plus, Qwen a publié les poids du modèle beaucoup plus volumineux Qwen3.8-2.4T-A95B, conçu pour des performances de niveau supérieur. Les deux modèles sont disponibles sur Hugging Face et ModelScope. Une version hébergée avec un million de jetons de contexte sera bientôt proposée via Qwen Cloud, le service IA d'Alibaba.
Source: The Decoder (DE) —
original
