ModèlesAffaires et Marché 🇷🇺 10.08.2026 14:01

Qwen3.8 Max publié : surpasse Claude Fable 5 dans l'indice d'agence à 6 dollars par million de jetons

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
Alibaba a publié la version finale de Qwen3.8 Max, un modèle multimodal de 2 400 milliards de paramètres avec un contexte d'un million de jetons. Des tests indépendants montrent qu'il surpasse Claude Fable 5 dans l'indice d'agence, et son tarif API est nettement inférieur à celui des concurrents. Cependant, les poids ouverts sont toujours en attente.
Alibaba a officiellement publié Qwen3.8 Max, un modèle natif de mélange d'experts multimodal de 2,4 billions de paramètres. Il prend en charge l'entrée de texte, d'images et de vidéos, et produit du texte, avec une fenêtre de contexte pouvant atteindre un million de jetons (983 000 en entrée et 131 000 en sortie en mode de pensée). Le modèle dispose d'une pensée hybride activée par défaut, d'appels de fonctions et d'outils intégrés, et est présenté comme adapté à la programmation et aux workflows agentiques professionnels. Des tests indépendants menés par Artificial Analysis montrent que Qwen3.8 Max obtient un score de 58,1 dans l'indice d'intelligence (contre 62,1 pour Claude Fable 5) et de 58,4 dans l'indice agentique (contre 56,6 pour Claude Fable 5), seuls deux modes de Claude Opus 5 se classant plus haut. Le prix est fixé à 2 dollars par million de jetons en entrée et à 6 dollars par million de jetons en sortie, avec des lectures en cache à 0,25 dollar par million de jetons, soit environ cinq fois moins cher que Claude Fable 5 en entrée et 8,3 fois moins cher en sortie. Cependant, le modèle est verbeux : il a généré environ 150 millions de jetons lors d'un test complet de l'indice d'intelligence, soit environ 2,3 fois la médiane (66 millions) des modèles comparables. La vitesse est d'environ 82 jetons en sortie par seconde, avec une latence du premier jeton d'environ 2,8 secondes. Au matin du 10 août, les poids ouverts de Qwen3.8 Max et de Qwen3.8-27B n'avaient pas encore été publiés, bien qu'Alibaba ait promis qu'ils apparaîtraient la semaine du 3 août. Le grand modèle nécessite environ 4,8 téraoctets en BF16 ou 1,2 téraoctet en 4 bits, ce qui rend son déploiement local impraticable pour la plupart. L'article suggère que Qwen3.8 Max convient au codage agentique, à l'analyse de documents longs, aux processus en plusieurs étapes et comme solution de secours à Claude, mais recommande de le tester sur ses propres tâches avant de changer.
Source: Habr — хаб ИИ — original
Nos articles précédents sur ce sujet ↓
Infos fraîches