ModèlesAgents 🇷🇺 07.08.2026 16:02

Qwen3.8-Max : un monstre de 2,4 billions de paramètres

Alibaba/QwenAlibaba/Qwen Moonshot AIMoonshot AI AnthropicAnthropic OpenAIOpenAI DeepSeekDeepSeek
Alibaba a publié Qwen3.8-Max, un modèle Mixture-of-Experts de 2,4 billions de paramètres avec un contexte d'un million de jetons, affirmant qu'il établit une nouvelle référence pour le codage et le travail autonome. La publication inclut des projets d'ouverture des poids du modèle de classe Max pour la première fois, et présente des tâches autonomes de longue durée. Des tests indépendants montrent qu'il est légèrement en retrait par rapport à Kimi K3 sur l'indice d'intelligence, mais il offre un excellent rapport qualité-prix.
Le 3 août 2026, l'équipe Qwen d'Alibaba a publié Qwen3.8-Max, un modèle de langage de grande taille avec 2,4 billions de paramètres, bien que seulement environ 95 milliards soient actifs par requête en raison de son architecture de mélange d'experts. Il possède une fenêtre de contexte d'un million de jetons et est disponible via QwenCloud, Alibaba Cloud Model Studio et l'application QwenWork. L'entreprise prévoit de publier les poids ouverts de Qwen3.8-Max et du plus petit Qwen3.8-27B le 12 août, marquant la première fois que les poids d'un modèle de classe Max seront ouverts. Des démonstrations montrent le modèle construisant de manière autonome un outil CLI auto-mis à jour sur 16 jours, reproduisant et améliorant un article scientifique, participant à une compétition réelle, concevant une puce cryptographique et négociant dans un environnement de commerce électronique simulé. Des tests indépendants par Artificial Analysis lui ont attribué 56 points sur l'indice d'intelligence, un point derrière Kimi K3, avec un coût plus élevé par tâche. L'entreprise a attribué des scores initiaux plus faibles à une surcharge de l'API. Les benchmarks montrent des résultats mitigés : il est en tête sur PaperBench, IFBench et OSWorld-Verified, mais traîne sur SWE-bench Pro et FrontierSWE. Le prix est de 2 $ par million de jetons d'entrée et 6 $ par million de jetons de sortie, moins cher que de nombreux concurrents. La communauté attend avec impatience le modèle compact 27B pouvant fonctionner sur du matériel grand public. La publication met en évidence une tendance où l'infrastructure (ou harnais) autour du modèle est de plus en plus importante, et Alibaba revendique une compatibilité avec divers harnais tels que Claude Code et Codex.
Source: Habr — хаб ИИ — original
Nos articles précédents sur ce sujet ↓
Infos fraîches