Hardware & InferentieModellen 🇨🇳 24.07.2026 01:03

Alibaba Cloud: Zhenwu M890-chip past zich aan aan Qwen3.8, model live op Bailian voor inferentie

Alibaba/QwenAlibaba/Qwen
Alibaba Cloud heeft aangekondigd dat zijn Zhenwu M890-supernodechip met succes is aangepast aan het Qwen3.8-model, waardoor inferentie op het Bailian-platform mogelijk is. De Zhenwu M890 is een nieuwe generatie AI-chip van T-Head, die ondersteuning biedt voor FP32 tot FP4-precisie en een interconnectiesnelheid van 800 GB/s via ICN Switch 1.0, waardoor een enkele instantie een model met 2,4 biljoen parameters kan draaien.
Alibaba Cloud maakte op 23 juli bekend dat de Zhenwu M890 supernode-chip met succes is aangepast voor Qwen3.8, het vlaggenschipmodel van Alibaba met 2,4 biljoen parameters, en nu inferentiediensten levert op het Bailian-platform. Dit is de eerste keer dat een Chinese supernode een model met meer dan 2 biljoen parameters heeft gedraaid. De Zhenwu M890, ontwikkeld door T-Head, is een nieuwe generatie AI-chip die dataprecisies van FP32 tot FP4 ondersteunt, geschikt voor hoge-precisietraining en lage-precisie-inferentie. Via ICN Switch 1.0 bereiken 64 Zhenwu M890-chips een interconnectiesnelheid van 800 GB/s, bieden 9 TB videogeheugen en maken expertparallelisme voor grote MoE-modellen mogelijk. Alibaba optimaliseerde ook de volledige stack van chip tot cloud voor Qwen3.8, wat de inferentie-efficiëntie in agentische scenario's tot 1,5 keer verbetert.
Bron: QbitAI 量子位 — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws