Laitteisto ja päättelyMallit 🇨🇳 24.07.2026 01:03

Alibaban pilvi: Zhenwu M890 -siru mukautuu Qwen3.8-malliin, malli julkaistaan Bailianilla päättelyä varten

Alibaba/QwenAlibaba/Qwen
Alibaban pilvi ilmoitti, että sen Zhenwu M890 -supernodesiru on onnistuneesti mukauttanut Qwen3.8-mallin, mikä mahdollistaa päättelyn Bailian-alustalla. Zhenwu M890 on T-Headin uuden sukupolven tekoälysiru, joka tukee FP32:sta FP4:ään tarkkuuksia ja saavuttaa 800 Gt/s:n yhteydet ICN Switch 1.0:n avulla, jolloin yksi instanssi voi ajaa 2,4 biljoonan parametrin mallin.
Alibaba Cloud ilmoitti 23. heinäkuuta, että Zhenwu M890 -supernode-siru on onnistuneesti sovitettu Qwen3.8:aan, Alibaban lippulaivamalliin, jossa on 2,4 biljoonaa parametria, ja tarjoaa nyt inferenssipalveluita Bailian-alustalla. Tämä on ensimmäinen kerta, kun kiinalainen supernode on ajanut yli 2 biljoonan parametrin mallia. T-Headin kehittämä Zhenwu M890 on uuden sukupolven tekoälysiru, joka tukee datan tarkkuuksia FP32:sta FP4:ään ja soveltuu sekä korkean tarkkuuden harjoitukseen että matalan tarkkuuden inferenssiin. ICN Switch 1.0:n avulla 64 Zhenwu M890 -sirua saavuttavat 800 Gt/s:n yhteenliitäntänopeuden, tarjoten 9 TB:n videomuistin ja mahdollistaen asiantuntijarinnakkaisuuden suurille MoE-malleille. Alibaba optimoi myös koko pinon sirusta pilveen Qwen3.8:aa varten, parantaen inferenssitehokkuutta jopa 1,5-kertaiseksi agenttipohjaisissa skenaarioissa.
Lähde: QbitAI 量子位 — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset