Hardware & InferenzModelle 🇨🇳 24.07.2026 01:03

Alibaba Cloud: Zhenwu M890-Chip passt an Qwen3.8 an, Modell auf Bailian für Inferenz live

Alibaba/QwenAlibaba/Qwen
Alibaba Cloud gab bekannt, dass ihr Zhenwu M890 Supernode-Chip erfolgreich das Qwen3.8-Modell angepasst hat und Inferenz auf der Bailian-Plattform ermöglicht. Der Zhenwu M890 ist ein KI-Chip der nächsten Generation von T-Head, der FP32- bis FP4-Präzision unterstützt und über ICN Switch 1.0 eine 800 GB/s große Verbindung zwischen den Chips erreicht, sodass eine einzelne Instanz ein Modell mit 2,4 Billionen Parametern ausführen kann.
Alibaba Cloud gab am 23. Juli bekannt, dass der Supernode-Chip Zhenwu M890 erfolgreich an Qwen3.8, das Flaggschiff-Modell von Alibaba mit 2,4 Billionen Parametern, angepasst wurde und nun Inferenzdienste auf der Bailian-Plattform bereitstellt. Dies ist das erste Mal, dass ein chinesischer Supernode ein Modell mit mehr als 2 Billionen Parametern ausführt. Der von T-Head entwickelte Zhenwu M890 ist ein KI-Chip der neuen Generation, der Datenpräzisionen von FP32 bis FP4 unterstützt und sich für hochpräzises Training und niedrigpräzise Inferenz eignet. Über ICN Switch 1.0 erreichen 64 Zhenwu M890-Chips eine Interconnect-Bandbreite von 800 GB/s, stellen 9 TB Videospeicher bereit und ermöglichen Expert Parallelism für große MoE-Modelle. Alibaba hat zudem den gesamten Stack vom Chip bis zur Cloud für Qwen3.8 optimiert und die Inferenzeffizienz in agentischen Szenarien um bis zu das 1,5-Fache verbessert.
Quelle: QbitAI 量子位 — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten