GLM-5.3 officiellement publié : Z.ai utilise une stratégie de post-entraînement « sans expansion de paramètres » pour innover avec les grands modèles
Zhipu AI, en Chine, a officiellement publié son nouveau grand modèle de langage GLM-5.3. La société derrière, Z.ai, a adopté une stratégie de post-entraînement qui n'étend pas les paramètres, marquant une approche novatrice dans le développement des grands modèles.
Zhipu AI a officiellement dévoilé son nouveau grand modèle de langage, GLM-5.3. La société, désignée sous le nom de Z.ai, a adopté une stratégie de post-entraînement qui ne vise pas à augmenter le nombre de paramètres. Cette approche représente une nouvelle orientation dans la manière dont les grands modèles sont développés, car elle se concentre sur l'optimisation du modèle sans en accroître la taille. La sortie met en évidence la contribution novatrice de Z.ai dans le domaine de l'intelligence artificielle, montrant que des améliorations significatives peuvent être obtenues grâce à des techniques de post-entraînement astucieuses plutôt qu'en augmentant simplement les paramètres.
Source: Zhipu GLM (GNews) —
original
