Zhipu.AI brengt GLM-modellen als open source uit: 8x sneller dan DeepSeek-R1 en wereldwijde expansie vóór mogelijke IPO
Het Chinese AI-bedrijf Zhipu.AI heeft zijn volgende generatie GLM-modellen als open source uitgebracht, waaronder het GLM-Z1-inferentiemodel dat tot acht keer sneller is dan DeepSeek-R1 en 200 tokens per seconde haalt op consumenten-GPU's. Het bedrijf lanceerde ook een internationaal platform, Z.ai, en breidt wereldwijd uit, mogelijk als voorbereiding op een beursgang.
Zhipu.AI heeft de volledige open-sourcing van zijn GLM-modellen aangekondigd, waaronder de GLM-4-serie en het GLM-Z1-inferentiemodel. De GLM-Z1-32B-0414 bereikt inferentiesnelheden die tot acht keer sneller zijn dan DeepSeek-R1, met 200 tokens per seconde op consumenten-GPU's, wat 50 keer sneller is dan de menselijke leessnelheid. Dit werd bereikt door optimalisatie van GQA-parameters, kwantisering en speculatieve sampling. Zhipu onthulde ook het GLM-Z1-Rumination-32B-0414-model, dat autonoom op internet kan zoeken, tools kan gebruiken en informatie kan verifiëren. De open-source-portfolio omvat de GLM-4-32B-0414, verbeterd voor agent-mogelijkheden, en kleinere 9B-parameterversies. Alle modellen worden uitgebracht onder de MIT-licentie. Zhipu lanceerde het internationale platform Z.ai voor wereldwijde gebruikers om toegang te krijgen tot deze modellen, en zijn MaaS-platform biedt getrapte API-toegang. Deze open-sourcing en wereldwijde uitbreiding signaleren dat Zhipu klaar is voor een mogelijke beursgang.
Bron: Synced —
origineel
