Zhipu.AI publie en open source ses modèles GLM : jusqu'à 8 fois plus rapides que DeepSeek-R1 et expansion mondiale avant une possible introduction en bourse
L'entreprise chinoise d'IA Zhipu.AI a publié en open source ses modèles GLM de nouvelle génération, dont le modèle d'inférence GLM-Z1 qui est jusqu'à huit fois plus rapide que DeepSeek-R1, atteignant 200 tokens par seconde sur des GPU grand public. L'entreprise a également lancé une plateforme internationale, Z.ai, et se développe à l'échelle mondiale, préparant potentiellement le terrain pour une introduction en bourse.
Zhipu.AI a annoncé l'open-source complet de ses modèles GLM, notamment la série GLM-4 et le modèle d'inférence GLM-Z1. Le GLM-Z1-32B-0414 atteint des vitesses d'inférence jusqu'à huit fois plus rapides que DeepSeek-R1, offrant 200 tokens par seconde sur des GPU grand public, soit 50 fois plus rapide que la vitesse de lecture humaine. Cela a été obtenu en optimisant les paramètres GQA, la quantification et l'échantillonnage spéculatif. Zhipu a également dévoilé le modèle GLM-Z1-Rumination-32B-0414, capable de rechercher sur Internet de manière autonome, d'utiliser des outils et de vérifier les informations par lui-même. Le portfolio open-source inclut le GLM-4-32B-0414 amélioré pour les capacités d'agent et des versions plus petites à 9 milliards de paramètres. Tous les modèles sont publiés sous licence MIT. Zhipu a lancé la plateforme internationale Z.ai pour permettre aux utilisateurs mondiaux d'accéder à ces modèles, et sa plateforme MaaS propose un accès API par niveaux. Cet open-source et cette expansion mondiale signalent la préparation de Zhipu pour une éventuelle introduction en bourse.
Source: Synced —
original
