Matériel et InférenceModèles 🇨🇳 24.07.2026 01:03

Alibaba Cloud : la puce Zhenwu M890 s'adapte à Qwen3.8, le modèle est mis en ligne sur Bailian pour l'inférence

Alibaba/QwenAlibaba/Qwen
Alibaba Cloud a annoncé que sa puce supernœud Zhenwu M890 s'est adaptée avec succès au modèle Qwen3.8, permettant l'inférence sur la plateforme Bailian. Le Zhenwu M890 est une puce IA de nouvelle génération de T-Head, prenant en charge les précisions de FP32 à FP4 et atteignant une interconnexion de 800 Go/s via ICN Switch 1.0, permettant à une seule instance d'exécuter un modèle de 2,4 billions de paramètres.
Alibaba Cloud a annoncé le 23 juillet que la puce supernœud Zhenwu M890 a réussi à adapter Qwen3.8, le modèle phare d'Alibaba avec 2,4 billions de paramètres, et fournit désormais des services d'inférence sur la plateforme Bailian. C'est la première fois qu'un supernœud chinois exécute un modèle dépassant les 2 billions de paramètres. Le Zhenwu M890, développé par T-Head, est une puce IA de nouvelle génération prenant en charge des précisions de données allant de FP32 à FP4, adaptée à l'entraînement de haute précision et à l'inférence de faible précision. Grâce à l'ICN Switch 1.0, 64 puces Zhenwu M890 atteignent une interconnexion de 800 Go/s, offrant 9 To de mémoire vidéo et permettant un parallélisme expert pour les grands modèles MoE. Alibaba a également optimisé la pile complète, de la puce au cloud, pour Qwen3.8, améliorant l'efficacité de l'inférence jusqu'à 1,5 fois dans les scénarios agentiques.
Source: QbitAI 量子位 — original
Nos articles précédents sur ce sujet ↓
Infos fraîches