GLM-5.3 officieel uitgebracht: Z.ai gebruikt een 'zonder-parameteruitbreiding' post-training strategie om iets nieuws te doen met grote modellen
Het Chinese Zhipu AI heeft officieel zijn nieuwe grote taalmodel GLM-5.3 uitgebracht. Het bedrijf erachter, Z.ai, heeft een post-training strategie gehanteerd die geen parameters uitbreidt, wat een nieuwe benadering markeert in de ontwikkeling van grote modellen.
Zhipu AI heeft officieel zijn nieuwe grote taalmodel GLM-5.3 uitgebracht. Het bedrijf, dat ook wel Z.ai wordt genoemd, heeft een post-training strategie toegepast die niet inhoudt dat het aantal parameters wordt uitgebreid. Deze aanpak vormt een nieuwe wending in de manier waarop grote modellen worden ontwikkeld, omdat het zich richt op het optimaliseren van het model zonder de omvang ervan te vergroten. De release benadrukt de innovatieve bijdrage van Z.ai aan het AI-veld en laat zien dat aanzienlijke verbeteringen kunnen worden bereikt door slimme post-training technieken in plaats van simpelweg het opschalen van parameters.
Bron: Zhipu GLM (GNews) —
origineel
