Zhipu.AI macht GLM Open Source: Modelle 8x schneller als DeepSeek-R1 und globale Expansion vor möglichem Börsengang
Das chinesische KI-Unternehmen Zhipu.AI hat seine nächste Generation von GLM-Modellen als Open Source veröffentlicht, darunter das Inferenzmodell GLM-Z1, das bis zu achtmal schneller ist als DeepSeek-R1 und 200 Tokens pro Sekunde auf Verbraucher-GPUs erreicht. Das Unternehmen hat außerdem eine internationale Plattform, Z.ai, gestartet und expandiert global, möglicherweise als Vorbereitung für einen Börsengang.
Zhipu.AI hat die umfassende Öffnung seiner GLM-Modelle als Open Source angekündigt, einschließlich der GLM-4-Serie und des GLM-Z1-Inferenzmodells. Das GLM-Z1-32B-0414 erreicht eine bis zu achtmal höhere Inferenzgeschwindigkeit als DeepSeek-R1 und liefert 200 Tokens pro Sekunde auf handelsüblichen GPUs, was 50-mal schneller ist als die menschliche Lesegeschwindigkeit. Dies wurde durch Optimierung der GQA-Parameter, Quantisierung und spekulatives Sampling erreicht. Zhipu stellte zudem das Modell GLM-Z1-Rumination-32B-0414 vor, das eigenständig im Internet suchen, Werkzeuge nutzen und Informationen selbstständig verifizieren kann. Das Open-Source-Portfolio umfasst das GLM-4-32B-0414 mit verbesserten Agent-Fähigkeiten sowie kleinere Versionen mit 9 Milliarden Parametern. Alle Modelle werden unter der MIT-Lizenz veröffentlicht. Zhipu hat die internationale Plattform Z.ai gestartet, über die globale Nutzer auf diese Modelle zugreifen können, und seine MaaS-Plattform bietet abgestufte API-Zugänge. Diese Open-Source-Strategie und globale Expansion signalisieren die Bereitschaft von Zhipu für einen möglichen Börsengang.
Quelle: Synced —
Original
