Zhipu.AI lanza como código abierto los modelos GLM: 8 veces más rápidos que DeepSeek-R1 y expansión global antes de una posible OPV
La empresa china de inteligencia artificial Zhipu.AI ha publicado como código abierto sus modelos GLM de nueva generación, incluido el modelo de inferencia GLM-Z1 que es hasta ocho veces más rápido que DeepSeek-R1, alcanzando los 200 tokens por segundo en GPU de consumo. La compañía también lanzó una plataforma internacional, Z.ai, y se está expandiendo globalmente, lo que posiblemente prepare el terreno para una Oferta Pública de Venta (OPV).
Zhipu.AI anunció la apertura completa del código fuente de sus modelos GLM, incluyendo la serie GLM-4 y el modelo de inferencia GLM-Z1. El GLM-Z1-32B-0414 alcanza velocidades de inferencia hasta ocho veces más rápidas que DeepSeek-R1, generando 200 tokens por segundo en GPU de consumo, lo que es 50 veces más rápido que la velocidad de lectura humana. Esto se logró optimizando los parámetros GQA, la cuantización y el muestreo especulativo. Zhipu también presentó el modelo GLM-Z1-Rumination-32B-0414, que puede buscar en internet de forma autónoma, usar herramientas y verificar información por sí mismo. El portafolio de código abierto incluye el GLM-4-32B-0414 mejorado para capacidades de agente y versiones más pequeñas de 9B parámetros. Todos los modelos se publican bajo la licencia MIT. Zhipu lanzó la plataforma internacional Z.ai para que usuarios globales accedan a estos modelos, y su plataforma MaaS ofrece acceso a API por niveles. Esta apertura de código y expansión global señalan la preparación de Zhipu para una posible Oferta Pública Inicial.
Fuente: Synced —
original
